---
title: "오픈AI, GPT-5.6 기업용 API 요금 최대 80% 인하"
published: 2026-07-30T19:05:02.031Z
canonical: https://jeff.news/article/5238
---
# 오픈AI, GPT-5.6 기업용 API 요금 최대 80% 인하

오픈AI가 공개 3주밖에 안 된 GPT-5.6 중·저가 모델의 기업용 API 요금을 최대 80% 낮췄음. 최상위 모델 가격은 유지하되 더 빠른 처리 모드를 추가했고, 앤트로픽과 중국 개방형 모델까지 끼어든 AI 가격 경쟁이 본격화되는 분위기임.

- 오픈AI가 GPT-5.6 중·저가 모델의 기업용 API 요금을 최대 80%까지 낮췄음
  - GPT-5.6은 공개된 지 불과 3주밖에 안 된 최신 모델 라인임
  - 이번 인하는 개발자들이 쓰는 응용프로그램인터페이스(API) 요금에 적용됨
  - 챗GPT 개인 구독료 자체가 내려간 건 아님

- 가격 인하 폭은 보급형 모델에서 특히 큼
  - 중위 모델인 GPT-5.6 테라는 20% 인하돼 100만 토큰당 2~12달러로 조정됨
  - 보급형 모델인 GPT-5.6 루나는 80% 내려가 100만 토큰당 0.2~1.2달러가 됨
  - 개인용 챗GPT에서도 이 모델들의 사용 한도는 인하된 요금에 비례해 늘어남

> [!IMPORTANT]
> GPT-5.6 루나가 100만 토큰당 0.2~1.2달러까지 내려간 게 포인트임. 대량 호출하는 서비스에서는 모델 선택 하나가 월 비용을 꽤 크게 바꿀 수 있음.

- 최상위 모델 GPT-5.6 솔은 가격을 그대로 유지했지만, 속도 옵션을 새로 붙였음
  - 두 배 요금을 내면 2.5배 빠른 처리 속도를 제공하는 모드가 도입됨
  - 싸게 많이 쓰는 모델과, 비싸도 빠르게 처리하는 모델을 나눠 기업 수요를 더 촘촘하게 잡으려는 전략으로 보임

- 오픈AI는 이번 가격 인하의 이유로 인프라 효율 개선을 들었음
  - 모델 자체의 효율이 좋아졌다고 설명함
  - 추론 시스템(inference system) 최적화도 언급함
  - 에이전트 연결 방식 등 인프라 전반의 개선이 비용 절감으로 이어졌다는 주장임

- 배경에는 기업 시장 점유율 싸움이 깔려 있음
  - 오픈AI는 기업공개(IPO)를 앞두고 기업 시장 매출을 더 키우려는 상황으로 풀이됨
  - 라이벌 앤트로픽은 기업 시장에서 강한 존재감을 쌓아온 경쟁자로 언급됨
  - 기업들이 AI 사용량을 늘리는 과정에서 비용 부담에 불만을 표시하면서, 중저가 모델 경쟁이 더 중요해졌음

- 앤트로픽과 중국 개방형 모델도 가격 경쟁을 밀어붙이는 압력으로 작동하고 있음
  - 앤트로픽은 25일 클로드 페이블5에 버금가는 클로드 오퍼스5를 내놓고 가격을 페이블5의 절반 수준으로 책정함
  - 문샷AI의 키미 K3 같은 중국산 개방형 모델 부상도 미국 AI 기업들의 가격 인하 경쟁에 영향을 준 것으로 평가됨
  - 이제 모델 경쟁은 성능표만이 아니라 토큰 단가, 처리 속도, 사용 한도까지 묶어서 보는 게임이 됐음

---

## 기술 맥락

- 이번에 오픈AI가 건드린 건 개인 구독료가 아니라 API 단가예요. 개발팀이 제품에 AI 기능을 붙일 때는 매 호출마다 토큰 비용이 쌓이기 때문에, 100만 토큰당 가격이 내려가면 기능 기획의 비용 한계가 바로 달라져요.

- GPT-5.6 테라는 20%, 루나는 80% 인하됐고, 솔은 가격을 유지한 대신 빠른 처리 모드를 붙였어요. 이건 모든 모델을 똑같이 싸게 파는 게 아니라, 대량 호출용 저가 모델과 빠른 응답이 필요한 고가 모델을 분리하는 선택이에요.

- 오픈AI가 추론 시스템과 에이전트 연결 방식의 효율 개선을 언급한 것도 중요해요. 모델 성능이 같아도 실제 서비스에서는 요청을 얼마나 싸고 빠르게 처리하느냐가 마진을 결정하거든요. 그래서 앞으로는 모델 벤치마크만큼 운영 단가와 지연시간이 선택 기준이 될 가능성이 커요.

## 핵심 포인트

- GPT-5.6 테라 요금은 20% 인하돼 100만 토큰당 2~12달러로 조정됨
- GPT-5.6 루나 요금은 80% 인하돼 100만 토큰당 0.2~1.2달러가 됨
- 가격 인하는 챗GPT 개인 구독료가 아니라 개발자용 API 요금에 적용됨
- 최상위 GPT-5.6 솔은 가격을 유지하되, 두 배 요금으로 2.5배 빠른 처리 속도를 제공하는 모드가 추가됨

## 인사이트

AI 모델 경쟁의 중심이 '누가 더 똑똑한가'에서 '이 성능을 얼마에 얼마나 빨리 쓰게 해주나'로 옮겨가는 장면임. 개발팀 입장에서는 모델 성능표만 볼 게 아니라 토큰 단가, 처리 속도, 사용량 한도까지 같이 봐야 하는 구간에 들어왔음.
