최신 AI로 문서 1만 건 요약하면 얼마? Astra·Fable 5.1·Gemini Flash 비용 계산
2026년 9월 9일 공식 API 가격 기준으로, 문서 1건당 입력 2,000토큰·요약 결과 300토큰으로 1만 건을 처리하면 GPT-6 Astra와 Claude Fable 5.1은 각각 약 350달러, Gemini 3.8 Flash는 프로모션 가격 기준 약 26.25달러입니다. 같은 토큰량인데 약 13.3배 차이가 납니다. 다만 세 모델의 성능 등급이 같다는 뜻은 아닙니다.
- 비교 작업: 문서 10,000건 요약 (건당 입력 2,000 + 출력 300토큰)
- 총 입력: 2,000만 토큰 · 총 출력: 300만 토큰
- GPT-6 Astra: 약 $350 (DERIQO 계산: 20×$10 + 3×$50)
- Claude Fable 5.1: 약 $350 (DERIQO 계산: 20×$10 + 3×$50)
- Gemini 3.8 Flash: 약 $26.25 (DERIQO 계산: 20×$0.75 + 3×$3.75, 프로모션가)
100만 토큰당 단가(Astra·Fable $10/$50, Gemini Flash $0.75/$3.75)는 각 회사가 공식 페이지에 공개한 값입니다. 1만 건 총비용·건당비용·배수는 그 단가를 DERIQO가 대입해 계산한 것입니다.
최신 모델 표준 API 가격
| 모델 | 입력 100만 토큰 | 출력 100만 토큰 |
|---|---|---|
| GPT-6 Astra | $10 | $50 |
| Claude Fable 5.1 | $10 | $50 |
| Gemini 3.8 Flash | $0.75 | $3.75 |
OpenAI는 GPT-6 Astra를 "가장 어려운 처음부터 끝까지의 작업을 위한 가장 강력한 모델"로 소개합니다. Anthropic은 Claude Fable 5.1을 "가장 어려운 지식 작업과 코딩 문제를 위한 차세대 지능"으로, 현재 일반 이용 가능한 가장 강력한 모델로 소개합니다. Google의 Gemini 3.8 Flash는 2026년 9월 출시된 최신 Flash 모델로, 속도와 비용 효율까지 고려한 제품입니다.
Gemini 3.8 Flash의 $0.75 / $3.75는 2026년 12월 31일까지의 프로모션 가격이며, 2027년 1월 1일부터 입력 $1.50, 출력 $7.50으로 오릅니다(Google 공식 명시).
문서 1만 건이면 토큰이 얼마나 필요한가
동일한 작업을 가정합니다. 문서 한 건에 입력 2,000토큰, 출력 300토큰이면, 10,000건은 입력 20,000,000토큰(20M) + 출력 3,000,000토큰(3M)입니다.
DERIQO 계산 결과
100만 토큰 단위로 환산하면 입력 20단위, 출력 3단위입니다. 이를 각 단가에 넣으면,
| 모델 | 입력비용 | 출력비용 | 합계 |
|---|---|---|---|
| GPT-6 Astra | 20 × $10 = $200 | 3 × $50 = $150 | $350 |
| Claude Fable 5.1 | 20 × $10 = $200 | 3 × $50 = $150 | $350 |
| Gemini 3.8 Flash | 20 × $0.75 = $15 | 3 × $3.75 = $11.25 | $26.25 |
같은 1만 건인데 약 13배 차이
| 모델 | 1만 건 비용 | 문서 1건당 |
|---|---|---|
| Gemini 3.8 Flash | $26.25 | 약 $0.0026 |
| GPT-6 Astra | $350 | $0.035 |
| Claude Fable 5.1 | $350 | $0.035 |
$350 ÷ $26.25 = 약 13.3배입니다. 10만 건으로 단순 확대하면 Gemini 3.8 Flash $262.50, Astra·Fable 5.1 각 $3,500으로, 차이는 $3,237.50까지 벌어집니다.
Gemini가 13배 싸니까 더 좋은 선택일까
그렇게 결론 내리면 안 됩니다. Astra와 Fable 5.1은 각 회사가 복잡한 전문 작업과 장기 에이전트 작업을 겨냥해 내놓은 최상위급 모델이고, Gemini 3.8 Flash는 Google의 Flash 계열(속도·비용 효율 우선) 최신 모델입니다.
이 표가 말하는 것은 "Gemini가 Astra보다 13배 좋은 가성비다"가 아니라, 동일한 양의 토큰을 처리하는 가격이 현재 최대 13배 이상 벌어질 수 있다는 것입니다. 작업 성공률까지 고려한 '완료된 작업 1건당 비용'은 별도의 성능 데이터가 있어야 계산할 수 있습니다.
출력 길이가 비용에 미치는 영향
Astra와 Fable 5.1은 출력 토큰이 입력보다 5배 비쌉니다. 요약 결과를 300토큰에서 150토큰으로 줄이면 출력비용은 $150 → $75, 전체 비용은 $350 → $275입니다. 출력 길이를 절반으로 줄였는데 전체 비용은 약 21.4% 감소합니다.
대량 처리에서는 모델 선택뿐 아니라 답변 길이 제한 자체가 비용관리 수단이 되는 이유입니다.
Gemini 가격은 2027년에 달라진다
Gemini 3.8 Flash의 프로모션 가격은 2026년 12월 31일까지입니다. 2027년 1월 1일부터의 정식 가격($1.50 / $7.50)으로 같은 문서 1만 건을 계산하면 입력 20 × $1.50 = $30, 출력 3 × $7.50 = $22.50, 합계 $52.50입니다.
그래도 Astra·Fable 5.1의 $350와 비교하면 약 6.7분의 1입니다.
DERIQO가 도출한 결론
각 회사의 공식 가격표에는 "100만 토큰당 몇 달러"만 적혀 있습니다. 실제 사용자가 궁금한 질문은 "내 문서 1만 개를 돌리면 얼마인가"입니다.
동일한 작업량으로 환산하면 2026년 9월 현재 GPT-6 Astra $350, Claude Fable 5.1 $350, Gemini 3.8 Flash $26.25입니다. Gemini 프로모션 종료 후 2027년 가격을 적용해도 $52.50입니다.
대량 AI 작업의 비용을 판단하려면 모델 이름이 아니라 입력 토큰 × 입력단가 + 출력 토큰 × 출력단가를 실제 작업량에 대입해야 합니다. 다만 이것은 가격 비교입니다. 어떤 모델이 더 적은 시도로 정확한 결과를 만드는지까지 포함하려면 성능·재시도율 데이터를 더해야 진짜 '작업 1건당 비용'이 나옵니다.
계산 기준
아래는 DERIQO가 각 회사의 공식 표준 API 단가를 이용해 계산한 파생값이며, 각 회사가 이 금액을 표로 발표한 것이 아닙니다.
- 문서당 입력 2,000토큰 · 출력 300토큰 · 총 10,000건
- 표준 API 가격 사용 (캐시·Batch·Flex·무료티어·지역 데이터레지던시 할증 제외)
- 웹검색·도구사용 등 별도 비용, 모델별 추론 토큰 과금 차이는 반영하지 않음
- 달러 기준
- 세 모델의 성능이 동일하다고 가정하지 않음 — 순수 토큰 가격 비교
- Gemini 3.8 Flash는 2026년 12월 31일까지 프로모션 가격($0.75/$3.75), 2027년 1월 1일부터 $1.50/$7.50
- Astra·Fable 5.1은 각 회사가 "가장 강력한 모델"로 안내하는 최상위 등급, Gemini 3.8 Flash는 Flash 등급
공식 원문 및 검증 자료
OpenAI Developers — GPT-6 Astra
모델 문서에서 표준 API 가격 입력 $10 / 출력 $50(100만 토큰당), "가장 강력한 모델" 소개, 272K 토큰 초과 프롬프트에 대한 할증(입력 2배·출력 1.5배)을 확인했습니다. 이 글의 문서당 2,000토큰은 할증 구간에 들지 않습니다.
Anthropic — Claude Fable 5.1
공식 페이지에서 입력 $10 / 출력 $50(100만 토큰당), 캐시 읽기 $0.25, 현재 일반 이용 가능한 가장 강력한 모델이라는 소개를 확인했습니다.
Google AI for Developers — Gemini API 가격
Gemini 3.8 Flash 유료 티어 가격이 2026년 12월 31일까지 입력 $0.75 / 출력 $3.75, 2027년 1월 1일부터 $1.50 / $7.50임을 공식 가격 페이지에서 확인했습니다.
Google AI for Developers — Gemini 3.8 Flash 모델 안내
Gemini 3.8 Flash가 2026년 9월 출시된 최신 Flash 모델이라는 점을 확인했습니다.
마지막 검증: 2026-09-09