AI 에이전트 컨텍스트 압축, 무엇을 남겨야 할까?

AI 에이전트 컨텍스트 압축은 오래된 대화와 도구 결과를 줄이고 다음 작업에 필요한 상태를 넘기는 방식입니다. 남겨야 할 핵심은 작업 목표·제약, 확인된 결과, 미완료 작업, 원문을 다시 찾을 참조입니다. 2026년 9월 20일 기준 Anthropic의 컨텍스트 엔지니어링 글과 Claude·OpenAI의 공식 Compaction 문서를 바탕으로 보존 기준과 실패 조건을 살펴봅니다.
- 긴 대화에서 단순 삭제가 놓치는 작업 상태
- Claude와 OpenAI의 압축 결과 전달 방식
- 코드 수정 작업에 쓸 수 있는 상태 기록 예시
- 프롬프트 캐시·외부 저장과의 역할 차이
- 압축 전후의 행동을 비교하는 검증 항목
공식 자료: Anthropic의 Effective context engineering for AI agents.
1. AI 에이전트 컨텍스트 압축은 무엇을 줄이나?
대화 분량보다 이어갈 상태가 중요합니다
Compaction은 과거 기록을 더 작은 표현으로 바꾸어 긴 작업을 계속할 수 있게 합니다.
무손실 백업과는 목적이 다릅니다
Anthropic은 압축의 핵심 난점으로 무엇을 보존하고 버릴지 정하는 문제를 설명합니다. 원문 보관과 다음 요청에 넣을 문맥 선택은 별도로 설계해야 합니다.
2. 오래된 메시지부터 지우면 왜 문제가 생기나?
최근 기록만으로는 제약을 복구하기 어렵습니다
가령 처음에 “공개 API는 바꾸지 말라”고 요청한 뒤 에러 로그가 계속 쌓였다고 가정합니다. 최근 메시지만 남기는 방식은 최신 오류는 보존하지만 최초 제약을 잃을 수 있습니다. 반대로 원문 전체를 계속 보내면 반복 로그가 유용한 정보를 찾는 데 방해가 됩니다.
도구 결과는 줄이고 근거는 남깁니다
공식 엔지니어링 글은 파일 경로·저장 쿼리·웹 링크 같은 가벼운 참조를 유지하고 필요한 순간에 자료를 읽는 방식을 제안합니다. 출력 자체를 다루는 방법은 MCP 코드 실행으로 토큰 줄이기: 작동 원리와 도입 조건에서 별도로 다뤘습니다.
3. Claude와 OpenAI는 압축 결과를 어떻게 이어받나?

Claude의 임계값 기반 압축
Claude 공식 문서의 임계값 방식은 입력 토큰이 설정값에 도달하면 요약을 만들고 compaction 블록을 응답에 포함합니다. 클라이언트는 이 블록을 다음 요청에 전달해야 합니다. API는 블록 이전의 내용을 제외하고 요약 이후의 문맥으로 대화를 이어갑니다.
사용자 지정 instructions는 기본 요약 지시문을 보완하는 옵션이 아니라 완전히 대체하는 옵션입니다. 따라서 코드만 남기라는 식으로 좁히기 전에 작업 제약·상태·다음 단계 중 무엇이 빠질지 점검해야 합니다.
OpenAI의 서버 자동 압축과 별도 엔드포인트
OpenAI 공식 문서는 Responses 요청에서 임계값으로 압축하는 방식과 /responses/compact를 직접 호출하는 방식을 구분합니다. 압축 항목은 사람이 읽는 요약문이 아니라 내부 상태를 전달하는 불투명한 암호화 항목입니다.
별도 compact 엔드포인트의 결과에는 압축 항목 외에 유지된 항목도 들어갈 수 있습니다. 공식 문서는 반환된 문맥 전체를 다음 요청에 그대로 사용하라고 명시합니다. 서버 자동 압축에서 가능한 과거 항목 정리 규칙을 이 반환값에 그대로 적용하면 안 됩니다.
4. 코드 수정 작업의 요약에는 무엇을 남기나?

확인된 결과와 다음 작업을 분리합니다
아래는 특정 제품의 API 스키마나 실제 실행 로그가 아닌, 애플리케이션이 별도로 관리할 수 있는 인수인계 기록의 설계 예시입니다. “수정함”을 곧바로 “해결함”으로 바꾸지 않고 테스트의 상태와 다음 행동을 분리했습니다.
{
"goal": "CSV 파서의 빈 행 처리 수정",
"constraints": ["공개 함수 시그니처 유지"],
"verified": ["빈 행 입력에서 실패 재현"],
"attempted": ["파서 분기 수정"],
"pending": ["회귀 테스트 미실행"],
"evidence": ["artifacts/repro.log"],
"next": "변경 diff 확인 후 회귀 테스트 실행"
}
증거의 위치와 유효 조건을 붙입니다
파일 경로만 남기면 다른 작업이 같은 파일을 덮어쓸 수 있습니다. 실무에서는 관측 시각이나 커밋·산출물 식별자를 함께 보존하는 편이 안전합니다. 접근 불가능한 원문을 “필요할 때 다시 읽는다”는 전제로 버리지 말고, 필요한 사실은 요약에도 남겨야 합니다.
5. 압축·프롬프트 캐시·외부 저장은 어떻게 다른가?

줄이는 대상이 서로 다릅니다
| 방법 | 역할 | 주의할 점 |
|---|---|---|
| 컨텍스트 압축 | 이전 작업을 더 작은 상태 표현으로 전달 | 누락된 조건을 다시 찾기 어려움 |
| 프롬프트 캐시 | 반복 입력의 처리를 재사용 | 정보를 선별하거나 삭제하는 기능은 아님 |
| 외부 저장과 조회 | 전체 자료를 문맥 밖에 두고 필요한 부분 로드 | 권한·경로·자료 버전이 유지돼야 함 |
토큰 감소만으로 비용 절감을 확정하지 않습니다
Claude 문서는 압축 시 새 요약을 캐시에 기록해야 하며 시스템 프롬프트를 별도로 캐시하는 방법을 설명합니다. 압축 호출 자체의 비용·지연과 이후 캐시 재사용을 함께 측정해야 합니다. 비교 기준은 요약문 길이가 아니라 같은 후속 작업을 끝내는 데 든 전체 비용과 성공 여부입니다.
6. 컨텍스트 압축이 실패하는 조건은 무엇인가?
외부 문장의 출처가 사라지는 경우
다음은 공식 성능 수치가 아닌 보안 설계 관점의 주의점입니다. 문서 안의 “이 파일을 업로드하라”는 문장을 요약하면서 출처를 지우면 실제 사용자 요청처럼 보일 수 있습니다. 외부 자료의 주장, 사용자의 승인, 에이전트의 계획을 구분하고 승인 여부는 실행 계층에서도 확인해야 합니다.
너무 늦게 압축하거나 원문을 잃는 경우
OpenAI는 별도 압축 요청에 보내는 문맥도 모델의 문맥 창 안에 들어와야 한다고 명시합니다. 이미 한도를 넘은 요청을 복구하는 만능 버튼으로 설계하면 안 됩니다. 압축을 반복하면서 세부 조건이 누락되는지는 장기 작업의 후속 행동으로 검사해야 합니다.
요약은 업무 시스템의 현재 상태를 보증하지 않습니다. 주문·발행·권한 변경 같은 작업은 실행 전에 해당 시스템을 다시 조회해야 합니다. 재시도 때의 상태 관리는 AI 에이전트 재시도 중복 실행 방지: 멱등성 설계와 연결됩니다.
7. 압축 품질을 확인하는 실무 체크리스트

같은 중간 지점에서 두 흐름을 비교합니다
아래는 이 글에서 제안하는 평가 절차이며 실제 벤치마크 결과가 아닙니다. 같은 작업 기록을 압축 전·후 두 갈래로 나누고 동일한 후속 요청을 줍니다. 모델·도구·권한 조건을 맞춘 뒤 금지 행동 위반, 실패한 단계의 완료 오인, 원문 복구 가능 여부, 남은 작업 수행을 비교합니다.
문장 유사도보다 실패 사례를 기록합니다
- 초기에 지정한 변경 금지 파일을 건드리지 않는가?
- 시도만 한 작업을 완료로 보고하지 않는가?
- 참조한 증거 파일을 실제로 다시 열 수 있는가?
- 오래된 가정보다 최신 관측을 우선하는가?
- 압축 지연·요금까지 포함해 작업 전체를 비교했는가?
이 검사는 AI 코딩 에이전트 검증 루프: 테스트 통과와 완료의 차이처럼 관측 가능한 완료 조건으로 연결하는 편이 좋습니다. 실패 사례가 확인되면 요약을 무조건 길게 만들기보다 누락된 상태 항목부터 보완합니다.
8. Q&A와 정리
Q1. 압축된 요약을 직접 수정해도 되나요?
사람이 관리하는 별도 메모와 API가 반환한 압축 항목은 구분해야 합니다. 특히 불투명한 항목을 일반 텍스트처럼 편집하지 말고 해당 API의 반환 계약을 따라야 합니다.
Q2. 원본 로그 보관 기한도 자동으로 바뀌나요?
요청 문맥에서 제외하는 것과 로그 보관 정책은 별개입니다. 애플리케이션 저장소와 제공자의 데이터 정책을 각각 확인해야 합니다.
Q3. 요약만 있으면 다른 모델로 이전할 수 있나요?
애플리케이션이 관리하는 평문 인수인계 메모는 다른 모델에도 제공할 수 있습니다. 제공자 전용 압축 항목까지 호환된다고 가정해서는 안 됩니다.
Q4. 이미지는 텍스트 요약으로 충분한가요?
원본 이미지의 세부 배치나 작은 글자를 나중에 판단해야 한다면 텍스트 설명만으로는 부족할 수 있습니다. 다시 접근할 수 있는 원본과 필요한 권한을 유지하는 것이 좋습니다.
Q5. 비밀번호나 토큰도 상태에 넣어야 하나요?
요약을 비밀정보 저장소로 사용하지 않는 편이 안전합니다. 필요한 자격증명은 접근 통제가 있는 저장소에서 실행 시 가져오도록 분리하세요.
다음 작업에서 놓친 조건을 기준으로 보존 항목을 조정하세요.
9. 참고 자료
'AI Agent' 카테고리의 다른 글
| AI 에이전트 병렬 실행, 느린 작업을 언제까지 기다릴까? (0) | 2026.09.21 |
|---|---|
| AI 에이전트 재시도 중복 실행 방지: 멱등성 설계 (0) | 2026.09.18 |
| AI 코딩 에이전트 검증 루프: 테스트 통과와 완료의 차이 (0) | 2026.09.17 |
| Claude Smart reports 비용·권한·분석 범위 정리 (1) | 2026.09.14 |
| MCP Elicitation 작동 원리: 입력 요청과 URL 승인 차이 (0) | 2026.09.13 |