AI 에이전트의 컨텍스트 붕괴를 방지하는 파일 기반 지속적 계획
계획, 연구 노트, 진행 로그를 세 개의 마크다운 파일로 고정하여 장시간 작업 중 /clear나 압축이 발생해도 컨텍스트 붕괴와 목표 이탈을 방지합니다. 매 턴 시작 시 재주입하여 목표 드리프트를 막습니다. Claude Code(플러그인) 또는 npx를 통해 다른 에이전트에서도 사용 가능합니다. Claude Code, Codex 등을 사용하는 중급 이상 개발자를 대상으로 합니다.
배경
2026년 9월, 개발자 커뮤니티는 자율 AI 에이전트 작업에서 반복되는 컨텍스트 붕괴 문제에 대한 경량 해결책을 제시했다. Claude Code, Codex 등 코딩 에이전트로 수 시간에 걸친 작업을 수행할 때, 대화 기록이 모델의 컨텍스트 창을 초과하면 시스템이 자동 압축을 수행하거나 수동 /clear를 강제하여 에이전트가 원래 목표, 중간 결정, 주요 발견을 잃어버리는 현상이 빈번했다. 이로 인해 엉뚱한 결과가 나오거나 작업이 반복되면서 장기 자율 작업에 대한 신뢰가 흔들렸다.
커뮤니티가 제안한 'planning-with-files' 방식은 놀랍도록 단순하다. 모델의 내부 컨텍스트 관리에 의존하는 대신, 에이전트의 작업 메모리를 plan.md, research.md, progress.md 세 개의 마크다운 파일로 외부화한다. 각 대화 턴 시작 시 이 파일들을 읽어 시스템 프롬프트나 접두사로 주입함으로써 전체 작업 컨텍스트를 효과적으로 복원한다. 이 방식은 처음 Claude Code 플러그인으로 출시되었고, npx를 통해 다른 에이전트로 즉시 이식 가능해 중급 이상 개발자들 사이에서 빠르게 확산되었다.
심층 분석
이 기법이 성공하는 이유는 대규모 언어 모델 에이전트의 근본적인 아키텍처 한계를 우회하기 때문이다. 수십만 토큰에 달하는 컨텍스트 창도 수 시간 작업에는 부족하며, 표준 압축 메커니즘인 슬라이딩 윈도우나 요약은 세밀한 상태를 돌이킬 수 없이 버린다. 반면 파일 기반 지속성은 파일 시스템을 외부의 감사 가능한 장기 기억으로 활용한다. 세 파일은 각각 뚜렷한 역할을 한다: plan.md는 작업 분해, 마일스톤, 현재 단계를 담고, research.md는 수집된 참고 자료, API 문서 발췌, 결정 근거를 저장하며, progress.md는 완료된 단계, 발생한 문제 및 해결책을 시간순으로 기록한다.
벡터 데이터베이스 기반의 검색 증강 기억과 비교하면, 파일 방식은 추가 임베딩 모델이나 인프라가 필요 없어 배포 비용이 거의 제로에 가깝다. 또한 완전히 결정론적이어서 개발자가 언제든 파일을 열어 에이전트의 '사고 과정'을 검사할 수 있어 디버깅과 수동 개입이 간편하다. 단순 대화 요약과 달리 구조화된 마크다운 형식은 풍부한 세부 사항과 논리적 관계를 보존하여 요약 기반 압축의 정보 왜곡 문제를 피할 수 있다. 개인 개발자나 소규모 팀에게 이러한 단순성, 통제력, 신뢰성의 균형은 즉각적인 실용성을 제공한다.
산업 영향
planning-with-files의 도입은 에이전트 도구 체인에 대한 기대를 이미 재편하고 있다. 장기 작업의 실패율을 극적으로 낮춤으로써, 개발자들이 더 복잡한 엔드투엔드 작업—여러 리포지토리에 걸친 리팩터링, 수일간의 기술 조사, 자동화된 DevOps 파이프라인—을 Claude Code나 Codex CLI 같은 에이전트에 위임하도록 장려한다. 이는 이러한 도구의 실용성을 직접적으로 증폭시키고 전문 소프트웨어 엔지니어링으로의 침투를 가속화한다.
이 관행은 또한 주류 에이전트 플랫폼의 상태 관리 공백을 드러내며, Anthropic과 OpenAI에 내장형 상태 관리를 제공하라는 압력을 가한다. Claude Code 팀은 플러그인의 피드백을 주목하고 있다고 알려졌으며, 이는 공식 체크포인트 복구나 설정 가능한 지속성이 뒤따를 수 있음을 시사한다. 더 넓은 생태계에서, 이전에 벡터 저장소나 단순 버퍼에 의존했던 LangChain, AutoGPT 같은 프레임워크들이 재검토되고 있다. 파일 기반 계획의 미니멀리즘과 즉각적인 효능은 업계를 '명시적이고 해석 가능하며 파일 기반'인 에이전트 메모리 패러다임으로 밀어붙이고 있으며, 이는 Cursor나 Windsurf 같은 차세대 에이전트 IDE의 설계에도 영향을 미칠 수 있다.
전망
단기적으로는 세 파일 패턴의 특화된 변형이 등장할 가능성이 높다. 연구 에이전트를 위한 문헌 노트 파일, 자동화 QA를 위한 테스트 케이스 상태 파일, 협업형 멀티 에이전트 설정을 위한 공유 계획 파일 등이 그 예다. 도구 측면에서는 이러한 파일을 자동 생성하고 관리하는 미들웨어가 발전하여 미래 에이전트 프레임워크의 표준 기능이 될 수 있다. 주목해야 할 주요 신호로는 Claude Code가 사용자 정의 템플릿과 함께 네이티브 파일 지속성을 통합할지, OpenAI의 Codex CLI나 GitHub Copilot Workspace가 유사한 체크포인트 메커니즘을 도입할지, 그리고 신흥 에이전트 IDE들이 파일 기반 계획을 상호작용 모델에 어떻게 내장할지 등이 있다.
컨텍스트 창이 수백만 토큰으로 확장되더라도 명시적 파일 지속성의 가치는 사라지지 않을 것이다. 작업 상태 파일은 에이전트가 목표 집중을 유지하도록 돕고, 중단 후 원활한 복구를 가능하게 하며, 인간에게 감사 가능한 의사 결정 추적을 제공한다. 더 깊은 수준에서, planning-with-files는 AI 에이전트 엔지니어링의 핵심 과제, 즉 신뢰할 수 없는 확률적 생성과 신뢰할 수 있는 결정론적 상태 관리를 연결하는 문제를 해결한다. 가장 오래되고 안정적인 정보 매체인 파일이 바로 이 두 세계를 잇는 이상적인 다리가 될 수 있다.