코딩 에이전트가 이전 대화와 도구 결과를 계속 누적하는 방식에서 벗어나, 작업 단계마다 필요한 문맥을 다시 선택하는 설계 초안이 공개됐다. 초안은 문맥을 고정된 기록이 아니라 매 라운드 조정할 대상으로 다룬다.
디오고 알메이다(Diogo Almeida) TypeSafe 창업자는 코딩 에이전트 설계 초안을 공개하며 커뮤니티가 직접 실험해 달라고 제안했다. 그는 TypeSafe가 이 아이디어를 모두 직접 구현할 시간은 부족할 가능성이 크다고 밝혔다. 관련 내용은 블록비츠가 전했다.
현재 코딩 에이전트는 대화 기록, 도구 실행 결과, 코드 상태를 다음 요청에 계속 전달하는 방식으로 운용된다. 문맥이 지나치게 길어지면 일부 내용을 압축하거나 에이전트를 다시 시작하는 방식이 일반적이다.
초안은 에이전트가 매 라운드마다 기존 캐시를 계속 사용할지, 더 적합한 문맥을 새로 구성할지 판단하도록 제안했다. 정보별로 전문을 유지할지, 요약할지, 아예 제외할지도 작업 상황에 따라 결정한다.
알메이다는 기존 에이전트 설계가 KV 캐시에 지나치게 묶여 있다고 지적했다. KV 캐시는 모델이 입력 문맥을 처리하면서 만든 중간 상태를 저장해 다음 요청에서 재활용하는 기술이다.
문맥의 앞부분이 같으면 KV 캐시를 통해 다시 계산해야 할 양을 줄일 수 있다. 반면 모델이나 입력 구조가 바뀌면 기존 캐시를 재활용하기 어려워진다.
초안에서 제시한 사례는 저가 모델과 고성능 모델을 오가는 작업이다. 작업을 먼저 저가 모델에 맡긴 뒤 고성능 모델로 전환하면, 고성능 모델이 긴 문맥을 다시 읽어야 해 전체 비용이 오히려 늘어날 수 있다는 설명이다.
도구 정의를 시스템 프롬프트에 계속 포함하는 방식도 비효율 요인으로 지목됐다. 실제로 사용하지 않는 도구 정보까지 매 요청에 들어가면 문맥 공간을 차지하고 캐시 활용을 어렵게 만든다.
문맥을 동적으로 재구성하면 모델 라우팅과 하위 에이전트 운용 방식도 달라질 수 있다. 단순한 작업은 저가 모델에 맡기고 필요한 도구만 불러오며, 하위 에이전트에는 각 작업과 관련된 상태만 전달하는 구조다.
초안은 MCP와 AGENTS.md 같은 개발 환경 구성 요소도 필요할 때 불러오는 대상으로 제시했다. 모든 설정과 도구를 처음부터 제공하는 대신 현재 작업에 맞는 정보만 골라 모델에 전달하는 방식이다.
MCP는 모델과 외부 도구를 연결하는 프로토콜이며, AGENTS.md는 에이전트의 작업 규칙을 담는 파일이다. 두 요소를 필요할 때만 문맥에 포함하면 작업별 입력 구성을 바꿀 수 있다는 구상이다.
알메이다는 이 접근을 잠정적으로 'Meta-attention'이라고 부르고 있다. 이는 모델이 문맥 전체에 동일하게 의존하기보다 매 라운드 어떤 정보에 주의를 기울일지 운영 단계에서 결정하는 방식에 가깝다.
TypeSafe가 9월 공개한 Jev는 텍스트를 생성하기보다 선택지와 점수, 확률을 반환하는 의사결정 모델로 소개됐다. 원자료는 Jev의 코딩 에이전트 내 작업 분배·도구 선택 활용 가능성을 별도로 확인하지 않았다.
이번 설계안은 코딩 에이전트의 성능이 기반 모델뿐 아니라 문맥 관리와 실행 환경 구성에도 영향을 받을 수 있다는 흐름과 맞닿아 있다. 본지는 앞서 코딩 에이전트 시장에서 하니스 설계가 결과를 좌우할 수 있다는 흐름을 전했다.
초안의 핵심은 긴 문맥을 무조건 유지하는 데 있지 않다. TypeSafe는 작업마다 필요한 정보만 남기고 모델·도구·하위 에이전트에 나눠 전달하는 구조를 커뮤니티가 직접 실험해 보길 제안했다.

이준한 기자
댓글0
첫 댓글을 남겨 보세요.