Codex의 긴 작업에서 필요한 컨텍스트 유지하기

긴 작업에서 검색 결과와 실패 로그, 중복된 계획이 쌓이면 현재 목표와 확인한 결과를 찾기 어려워질 수 있습니다. 다음 판단에 필요한 정보가 빠진 요약은 끝낸 조사를 다시 시작하게 만들 수도 있습니다. 상세 근거를 보존하면서 현재 상태와 다음 행동을 따로 기록해야 합니다.
이 글은 CJ Zafir의 팁을 lxfater가 소개한 Codex 운영 게시물을 바탕으로 합니다. 입력을 작업 단위로 관리하자는 제안을 다루며, 게시물의 성능 수치를 검증한 결과는 아닙니다. 모델의 역량, 도구 오류, 모호한 요구도 실패에 영향을 주므로 입력량만으로 원인을 설명할 수는 없습니다.
좁은 검색과 필요한 로그
관련 경로를 좁게 검색한 뒤 찾은 코드와 연결된 테스트를 읽을 수 있습니다. 검색으로 위치를 찾고 실제 코드에서 조건을 확인하면 저장소 전체를 반복해서 읽는 일을 줄일 수 있습니다.
도구 결과도 필요한 부분을 구분합니다. 로그 수천 줄을 그대로 입력하기보다 오류 원문, 실행한 명령, 환경, 다음 조사에 필요한 위치를 기록할 수 있습니다. 상세 로그는 파일에 보존하고 다음 판단에 사용할 정보만 읽습니다. 요약이 원인을 잘못 해석했다면 보존한 원문으로 돌아가 확인합니다.

본문의 401 상황을 직접 만든 예시 화면으로 표시했습니다. 그림에는 서버의 응답을 확인한 결과와 아직 검증하지 않은 클라이언트의 경로 이동을 별도로 적었습니다.
완료 기준과 현재 상태
작업 시작 전에 결과, 범위, 확인 방법을 적으면 같은 조사를 반복할 가능성을 줄일 수 있습니다. 긴 계획보다 현재 작업의 완료 기준을 확인할 수 있는 목록이 필요합니다.
목표: 만료된 세션에서 로그인 화면으로 이동
확인한 사실: 서버는 401을 반환하고 화면은 오류 상태에 머묾
다음 작업: 클라이언트의 401 처리와 경로 이동 확인
완료 기준: 만료 세션과 정상 세션의 기존 흐름을 각각 검사
위 예시에서는 서버의 401 응답을 확인했지만 클라이언트의 경로 이동은 아직 검사하지 않았습니다. 가설과 실행 결과를 구분해 기록해야 합니다. 실행하지 않은 검사를 통과한 것으로 적으면 다음 작업자는 확인하지 않은 동작을 정상이라고 판단할 수 있습니다.
별도로 맡길 수 있는 조사
서브에이전트는 다른 실행 단위에 일을 맡기는 방식입니다. 별도의 컨텍스트를 사용할 수 있지만 결과를 통합하고 근거를 확인하는 비용도 생깁니다. 한 파일의 작은 수정까지 나누면 조율이 작업보다 커질 수 있습니다.
독립된 조사가 있고 사용 환경과 권한이 허용할 때 범위를 나눌 수 있습니다. 맡길 목표, 읽거나 수정할 파일, 받을 근거를 정해야 합니다. 같은 파일을 동시에 수정하거나 요약만 받아 사실로 취급하면 새로운 오류가 생길 수 있습니다.
컨텍스트를 줄이겠다는 이유만으로 위임을 늘리기보다 현재 작업에서 반복되는 읽기와 불필요한 출력을 먼저 확인합니다.
다음 세션에 남길 근거
새 세션의 기록에는 현재 목표, 확정한 결정, 검사 결과, 남은 차단 사항을 담습니다. 로그인 오류 예시에서는 “서버의 401 응답을 확인했고 클라이언트의 경로 이동은 미검증”이라는 차이를 보존합니다. 그래야 다음 세션이 서버 조사부터 반복하지 않고 남은 검사를 이어갈 수 있습니다.
입력 정리의 효과를 비교하려면 같은 작업에서 반복한 읽기, 출력량, 놓친 근거를 함께 봅니다. 자료에 나온 설정 문자열과 절감 수치는 현재 도구의 지원 여부와 측정 조건을 확인한 뒤 적용해야 합니다.
인계 기록에는 다음에 실행할 검사와 상세 근거의 위치를 함께 남깁니다. 다음 작업자는 현재 상태를 읽고, 결과가 불명확하거나 환경이 바뀐 부분만 원문과 실제 동작으로 다시 확인합니다.