-
AI 에이전트 배치 공통비용을 결과물에 배분하는 법AI Agent 2026. 9. 3. 11:12728x90반응형

그림. 배치 원가는 공통 비용·개별 비용·실패 비용을 분리해야 설명됩니다.
reader_decision: 배치 비용을 결과물 수로 단순히 나누지 않고 공통 비용·개별 비용·실패 비용의 배분 규칙을 먼저 정합니다.
핵심은 분모입니다
배치에서 10개를 생성했다는 사실과 3개가 검증을 통과했다는 사실은 서로 다른 카운트입니다. 비용을 나누기 전에 결과물의 상태와 공통 단계의 귀속 규칙을 먼저 고정해야 합니다.토큰 비용만으로는 배치 원가를 설명할 수 없습니다
에이전트 배치에는 공통으로 발생한 프롬프트·검증·정리 비용, 특정 결과물에만 붙은 생성 비용, 실패와 재시도 비용, 사람의 검토와 재작업 시간이 함께 들어갑니다. 토큰 가격만 합치면 숫자는 깔끔하지만, 왜 READY 결과물의 비용이 달라졌는지 설명할 수 없습니다.
결과물 상태마다 분모가 달라집니다
배치 비용을 읽을 때는 created, reviewable, packet-aligned, READY, scheduled-confirmed를 같은 숫자로 쓰지 않습니다. 예를 들어 28개가 만들어졌어도 검토 가능한 것은 11개일 수 있고, 외부 예약까지 확인된 것은 더 적을 수 있습니다. 예약 상태는 내부 산출물 상태와 별도 열로 남깁니다.
설명용 fixture로 배분해 보기
아래 숫자는 실제 계정이나 회사 원장이 아니라 배분 규칙을 검증하기 위한 공개용 fixture입니다. 공통 비용은 420U, 결과물별 비용은 A 80U, B 120U, C 100U, 실패한 D 60U, D의 재시도 비용은 90U로 둡니다. READY는 A·B·C 세 개입니다.
공통 비용 420U를 READY 세 개에만 나누면 140U씩입니다. 따라서 A·B·C의 배분 후 원가는 각각 220U, 260U, 240U가 됩니다. D는 READY 분모에서 제외하지만, D에 들어간 60U와 재시도 90U를 버리지 않고 실패 비용 150U로 남깁니다. 전체 870U의 위치가 사라지지 않습니다.
단순 나누기와 비교하면
전체 870U를 결과물 네 개로 나누면 217.5U입니다. 이 값은 공통 비용을 나눈 것처럼 보이지만, 실패한 D의 재시도와 결과별 사용량을 숨깁니다. 반대로 870U를 READY 세 개에만 나누면 290U씩 되어 실패 비용을 성공 결과에 임의로 떠넘깁니다. 어느 방식이 맞는지가 아니라, 어떤 질문의 분모인지가 먼저입니다.
배치 원장을 이렇게 남깁니다
batch_id,status,common_cost,individual_cost,failure_cost b-001,READY,140,80,0 b-001,READY,140,120,0 b-001,READY,140,100,0 b-001,FAILED,0,60,90 READY 원가 = common_allocated + individual_cost 실패 원가 = individual_cost + failure_cost재작업 비용은 결과물 수 밖에 있습니다
기존 비용 초안에서 계속 드러난 문제는 거의 맞는 출력입니다. 제목과 본문은 좋아도 이미지가 빠졌거나 manifest가 끊기면 사람이 다시 검토해야 합니다. 100개를 만든 뒤 기준이 바뀌어 80개를 다시 보는 상황에서는 토큰보다 검토와 롤백 시간이 더 커질 수 있습니다. 그러므로 사람 시간은 “부가 메모”가 아니라 비용 원장의 한 묶음으로 기록합니다.
실무 순서
- 배치 ID와 공통 단계를 먼저 고정합니다.
- 결과물별 호출·토큰·이미지·검토 시간을 ID별로 연결합니다.
- 실패와 재시도는 성공 결과에 조용히 합치지 않고 별도 귀속합니다.
- READY 조건과 제외 이유를 먼저 선언한 뒤 분모를 계산합니다.
- 가격표·실제 청구액은 Q01의 장부와 연결하되, 이 글의 원장에 중복 합산하지 않습니다.
결론
배치 비용을 제대로 읽는 가장 쉬운 방법은 숫자를 더 많이 모으는 것이 아니라, 공통·개별·실패 비용과 결과물 상태를 서로 다른 열로 두는 것입니다. 결과 수로만 나누면 실패와 재작업이 사라집니다. 공통 비용은 합리적인 READY 분모에 배분하고, 개별 비용과 실패 비용은 원래 결과물에 남기면 다음 배치에서 무엇을 줄여야 하는지도 보입니다.
728x90반응형'AI Agent' 카테고리의 다른 글
컨텍스트 창 절단 때문에 사실이 빠졌는지 확인하는 법 (0) 2026.09.04 외부 메모리에 저장한 사실이 실제 답변에 쓰였는지 확인하는 법 (0) 2026.09.03 Test-Time Scaling(TTS) 조건별 정확도·지연시간 비교 (0) 2026.09.03 ccusage 사용량과 실제 결제액을 분리해 읽는 법 - Codex, Claude code 사용량 (0) 2026.09.02 AI 완료 보고의 artifact digest가 실제 산출물과 다른지 확인하기 (0) 2026.09.02