같은 AI 게임 프롬프트, 싼 토큰이 더 싼 완성작은 아니었다 | DAKER 커뮤니티

AI 게임 제작에서 모델 가격표보다 중요한 것은 과제 하나를 끝내는 비용과 플레이 품질입니다. Lite AI Lab은 9월 24일 영상에서 같은 프롬프트로 3D 산호초 장면과 비치 버기 게임을 Opus 5.5와 GPT-6 Astra에 각각 한 번씩 맡기고, 결과물을 직접 실행·플레이했습니다. OpenCode 1.18.32·OpenRouter·기본 추론 설정을 사용한 제작자 실험입니다.

제작자 기록을 보면 API 단가는 100만 입력/출력 토큰당 Opus $4/$20, Astra $10/$50입니다. 그런데 두 과제 합산 청구액은 Opus $9.21, Astra $8.59, 작업 시간은 약 57분 대 36분이었습니다. 제작자는 사고 토큰이 각각 179,282개와 17,568개였다고 보고합니다. 더 싼 토큰이 더 싼 완료 과제를 보장하지 않는다는 사례입니다. Astra가 화면을 더 매끈하게 만들었지만 Opus의 게임 조작감과 소리가 낫다는 평가는 제작자의 주관적 플레이 평가입니다.

중요한 단서가 있습니다. Opus는 OpenCode의 기본 32,000 출력 토큰 상한에서 파일 생성 전에 멈춘 선행 시도가 있었고, 본 실험에서는 Opus에만 128,000 상한을 적용했습니다. Astra의 게임 작업은 병렬 실행 중 OpenRouter 잔액 부족으로 두 번 멈췄다가 재개됐습니다. 각 과제 1회씩이라 승패나 일반적인 비용 비율로 확대할 수 없습니다. 재현할 때는 동일 프롬프트만이 아니라 도구 버전·출력 상한·추론 설정·실제 청구액·완주율·플레이 품질을 함께 기록해야 합니다.

원본 영상: Lite AI Lab, 「Claude Opus 5.5 vs GPT-6 Astra: Same 3D Prompt, We Played Both」 (2026-09-24) https://www.youtube.com/watch?v=SRppZAavT-A

프롬프트·실험 기록: https://liteailab.com/claude-opus-5-5-vs-gpt-6-astra/

모델 가격 원문: Anthropic https://www.anthropic.com/claude-opus-5-5 / OpenAI https://developers.openai.com/api/docs/models/gpt-6-astra

도구 상한 관련 OpenCode 이슈: https://github.com/anomalyco/opencode/issues/29363

썸네일 출처: Lite AI Lab / YouTube 원본 영상 썸네일.

Anthropic 공식 발표: https://www.anthropic.com/claude-opus-5-5