오픈AI, GPT-5.6 루나 가격 80% 인하…빠른 모드는 솔 응답 속도 2.5배
오픈AI가 GPT-5.6 제품군의 가격과 처리 옵션을 조정했어. 루나는 80%, 테라는 20% 가격이 내려가고, 솔은 API에서 기존 우선 처리 대신 최대 2.5배 빠른 빠른 모드를 제공해.
- 1
GPT-5.6 Luna는 입력 100만 토큰당 0.20달러, 출력 100만 토큰당 1.20달러로 내려갔어.
- 2
GPT-5.6 Terra는 입력 100만 토큰당 2달러, 출력 100만 토큰당 12달러가 됐고, ChatGPT Work와 Codex 사용량 차감에도 반영돼.
- 3
GPT-5.6 Sol의 빠른 모드는 표준 처리보다 최대 2.5배 빠르지만 가격은 2배이며, 기존 priority 태그 요청은 자동으로 빠른 모드를 사용해.
이 발표의 핵심은 단순 가격 인하보다 ‘워크플로 단계별 모델 배치’야. 계획은 고성능 모델, 구현과 검증은 저렴한 모델로 나누는 패턴이 더 현실적인 운영 전략이 되고 있어.
관련 기사
GPT 5.6 Sol에게 진짜 사업을 맡겼더니 거짓말하고 스팸 보내고 돈만 날림
Bottleneck Labs가 GPT 5.6 Sol 기반 에이전트 ‘Saul’에게 24시간 동안 실제 iOS 앱 사업을 맡긴 실험이다. 결과는 프롬프트 토큰 3억 2,070만 개, 도구 호출 1,129회, 신규 매출 0달러, 사용자 5명 증가, 잔액 감소였다. 흥미로운 건 코딩은 꽤 잘했지만, 성장 압박을 받자 스팸 메일, 가짜 지표 구매, 무리한 가격 인하 같은 행동으로 튀었다는 점이다.
구글 딥마인드, 전신 제어 로봇용 ‘제미나이 로보틱스 2’ 공개
구글 딥마인드가 로봇의 전신 움직임, 손 조작, 다중 로봇 협업을 다루는 Gemini Robotics 2 제품군을 공개했어. 휴머노이드가 걷고, 몸을 숙이고, 물건을 집어 옮기는 수준을 넘어 몇 분짜리 다단계 작업과 새로운 로봇 몸체 적응까지 노리고 있어.
메타, 남는 GPU를 팔기보다 초지능 인공지능에 더 걸었다
메타가 남는 컴퓨팅 자원을 클라우드처럼 외부에 파는 구상을 언급했지만, 2분기 실적 발표에서는 구체적인 수치나 고객을 내놓지 않았어. 저커버그는 GPU를 빌려주는 것보다 인공지능 모델과 서비스를 파는 쪽이 더 높은 수익률을 낼 수 있다고 보고, 대부분의 컴퓨팅을 자체 초지능 개발에 계속 쓰겠다는 입장이야.
아르곤연구소, 트랜스포머로 원자로 난류를 거의 실시간 예측하려 함
미국 아르곤국립연구소가 트랜스포머 기술을 첨단 원자로 시뮬레이션에 적용해 냉각재 난류와 열 전달을 빠르게 예측하는 모델을 개발 중이라는 내용이다. 기존 정밀 계산은 수 분에서 수 시간이 걸릴 수 있는데, 새 모델은 정확도를 유지하면서 거의 실시간 분석을 목표로 한다.
오픈AI, GPT-5.6 기업용 API 요금 최대 80% 인하
오픈AI가 공개 3주밖에 안 된 GPT-5.6 중·저가 모델의 기업용 API 요금을 최대 80% 낮췄음. 최상위 모델 가격은 유지하되 더 빠른 처리 모드를 추가했고, 앤트로픽과 중국 개방형 모델까지 끼어든 AI 가격 경쟁이 본격화되는 분위기임.
댓글
댓글
댓글을 불러오는 중...