← 전체 프로젝트
01. 한 줄로 보는 REMAKE DAY
REMAKE DAY
LLM NPC 추리 게임을, AI 제안을 사람이 어떻게 받아들이는지 기록하는 Human–AI 실험환경으로 설계한 프로젝트 — 원티드 AI Championship 2026
- FastAPI
- Next.js
- PostgreSQL · pgvector
- Ollama Gemma 4
- Claude API
- Gemini 임베딩
- Jekyll
↓ 스크롤 또는 ← → 키로 넘기기
02. 설계 원칙 - 합격선을 먼저, 모든 후보를 같은 시험으로
팀에서 평가 설계를 맡았습니다. GPU 16GB 한 장에 추리용 Core와 대화용 NPC가 함께 올라가야 했기에, "누가 더 똑똑한가"보다 "같이 상주할 수 있는가"부터 결정적 게이트로 판정했습니다.
03. 채점에서 검색을 뺐다
플레이어가 정답에 닿아도 점수가 21~42%에 머물렀습니다. 원인은 임베딩 유사도 상위 3개만 심판 모델에 넘기던 검색 단계였고, 후보가 8개뿐이라 전부 넘기는 쪽이 정확했습니다.


04. 채점기 번호 오류 - 인용으로 검산
채점 모델은 이유 설명에서 맞는 문장을 인용하면서도 번호만 틀리곤 했습니다. 근거 문장을 먼저 베껴 쓰게 하고, 그 인용으로 번호를 기계가 검산하게 했습니다.
05. 로컬과 외부 API를 설정 두 줄로 전환
심사 기간에는 동시 접속과 가용성이 문제였습니다. 엔진 코드는 그대로 두고, LLM 포트 뒤의 provider 어댑터만 설정 두 줄로 바꿔 끼울 수 있게 했습니다.
06. 측정하지 않은 것은 주장하지 않는다
게임을 사람의 AI 수용을 관찰하는 실험환경으로 보고, 데이터를 모으기 전에 가설과 한계를 먼저 공개하는 연구 사이트를 따로 운영했습니다.



근거: 연구 사이트 — 사전등록 · 연구 저장소
