ITCL · Project Debrief · 2026.07

AI 에이전트는
어떻게 게임을 만들었나

영문 프롬프트 858자 한 장에서 3만 5천 줄 FPS까지 — 43개 서브에이전트가 14시간 동안 실제로 무엇을 했는지, 무엇이 실패했는지의 전 과정 기록입니다.

▶ 브라우저에서 바로 플레이 그 이후 이야기 — 진화 기록 GitHub 저장소 설치 없이 링크만으로 실행됩니다 · 데스크톱 Chrome 권장
858자사용자 프롬프트 원본
43회서브에이전트 실행
5.93M소비 토큰
35,131줄생성된 코드
474장검증 스크린샷
34 → 45품질 점수 변화

01 · 모든 것을 시작한 프롬프트

2026년 7월 27일 06:05. 이 한 문단이 43개 에이전트의 작업 지시서가 되었습니다. 주목할 점은 '무엇을 만들지'뿐 아니라 '어떤 구조로 일할지'까지 지정하고 있다는 것입니다.

I want you to build a first-person shooter at the level of the most recent Call of Duty
games. It should be utterly perfect, visually beautiful, with every single thing done at
AAA quality—from textures to physics to anything you could think of.

Fan out sub-agents and have sub-agents tackle each one individually so that the game is
utterly perfect. You should /loop on each item and have a separate sub-agent check it
visually to ensure it looks triple A. That separate sub-agent should be a really harsh
critic, and if it doesn't look triple A, it should keep going.

Don't stop until each sub-agent is utterly wowed with the quality when compared with the
actual Call of Duty game. It should literally compare them side by side blind and say
which one looks better. Do this in ThreeJS. /loop until it's utterly perfect. Fan out
sub-agents and ultracode.

이 한 문단에 겹쳐 있던 9개의 명령

구분원문의 지시실제 의미구현된 결과
③~⑦이 이 프롬프트의 핵심입니다 — 결과물이 아니라 일하는 방식을 규정하고 있습니다.

02 · 화면으로 보는 네 단계

모두 같은 카메라 위치(spawn)에서 찍은 실제 캡처입니다. 이미지를 클릭하면 크게 볼 수 있습니다.

03 · 사용자 지시 9개와 그 결과

각 항목을 클릭하면 그 지시를 어떻게 해석하고, 무엇을 판단해, 어떻게 실행했는지 펼쳐집니다. '1번', '계속 작업해' 같은 두 글자 지시가 8개 에이전트를 움직였습니다.

04 · AI가 찾아낸 렌더링 버그 5종

이 프로젝트에서 가장 기술적으로 흥미로운 부분입니다. 다섯 개 중 네 개가 '모듈 경계'에서 발생했습니다 — 각 에이전트는 자기 파일 안에서 완벽하게 일했는데도 화면은 망가져 있었습니다.

N명이 병렬로 일하면 버그는 N개 파일이 아니라 N×(N−1)/2개의 경계에서 나옵니다. 그래서 매 라운드마다 '어떤 파일이든 고칠 수 있는 통합 담당 에이전트'를 단독으로 한 번씩 돌렸습니다.

05 · 품질 점수는 실제로 올랐는가

100점은 'Call of Duty MWIII 마케팅용 스크린샷'. 심사위원은 매번 새로 투입된 에이전트이며, 파일 쓰기 권한이 없고 기본 입장이 '거부'로 설정되어 있었습니다.

34 → 42 → 45. 점수는 분명히 올랐지만 '판정'은 한 번도 바뀌지 않았습니다. 블라인드 심사위원 3인은 서로 독립적으로 모두 "indie"를 선택했습니다. 자동 평가는 이 지점에서 한계에 닿습니다.

마지막 심사위원의 진단

"격차는 더 이상 지오메트리가 아니다 — 머티리얼과 라이팅 모델이다. 모델링을 아무리 더 해도 이것은 닫히지 않는다. 게임 안의 모든 표면이 하나의 BRDF 응답을 공유한다. 이것은 아트 변경이 아니라 렌더러 변경이다."

06 · 라이브러리 선택이 결과를 바꾼다

같은 도구라도 '사람이 쓸 때'와 'AI가 쓸 때'의 순위가 완전히 달라집니다. 아래 표를 필터링해 보세요.

도구AI 적합성AI가 잘하는 이유한계 · 주의점
판별 기준 하나 — "결과물이 텍스트로 표현되고, 그 결과를 기계가 다시 볼 수 있는가?" 이 둘을 만족할수록 AI가 잘합니다. 이번 프로젝트에서 "ThreeJS로 하라"는 한 문장이 43개 에이전트의 검증 방식 전체를 결정했습니다.

용어를 아는 만큼 프롬프트가 정확해진다

07 · 용어 사전

이 프로젝트에 등장한 기능 신조어를 개념부터 정리했습니다.

08 · 남는 것

게임 이야기를 걷어내면 남는 것 — 사람이 AI 여러 대에게 일을 시키는 방법론입니다.

직접 실행해 보기

git clone https://github.com/socialkim/blacksite-fps
cd blacksite-fps
npm install
npx vite --port 5173
# 브라우저에서 http://127.0.0.1:5173/ 접속 후 화면을 한 번 클릭

조작 — 이동 WASD · 사격 좌클릭 · 조준 우클릭 유지 · 재장전 R · 달리기 Shift · 앉기 Ctrl/C · 점프 Space · 기울이기 Q/E · 해제 Esc