OpenAI, GPT-5.6 효율성 개선 사항 공개
GPT-5.6 모델은 속도와 코딩 성능을 높이면서 AI 비용을 줄였습니다 Sol, Terra, Luna가 OpenAI의 스택 전반에서 지연 시간과 가격을 어떻게 낮추는지 확인해 보세요
OpenAI는 자사의 GPT5.6 모델 패밀리가 다양한 작업 전반에서 성능과 비용의 균형을 맞추도록 설계되었다고 말합니다. 회사는 플래그십 추론 모델인 GPT5.6 Sol이 Artificial Analysis Coding Agent Index에서 Claude Fable 5보다 더 나은 성능을 보이면서도 비용은 절반도 되지 않으며, Terra는 GPT5.5 지능 벤치마크와 비슷한 수준을 약 절반 가격에 맞추고, Luna는 가장 빠르고 가장 저렴한 옵션으로 자리 잡고 있다고 밝혔습니다.
7월 29일의 엔지니어링 게시물에서 OpenAI는 많은 개선이 모델 학습, 추론, 그리고 Codex와 ChatGPT Work에서 사용되는 에이전트 하니스 등 스택 전반의 변경에서 비롯되었다고 말했습니다. 회사는 라우팅, 스케줄링, 커널 최적화, 캐싱, 추측 디코딩, 컨텍스트 관리에 대한 작업이 컴퓨팅 사용량을 줄이고 처리량을 개선하는 방법이라고 강조했습니다.
OpenAI는 또한 GPT5.6 Sol이 프로덕션 트래픽 분석, 커널 재작성, speculator 모델 튜닝을 포함해 최적화 과정의 일부를 자동화하는 데 도움을 주었다고 말했습니다. 회사는 이러한 변화가 서비스 제공 비용을 낮추고 토큰 생성 효율을 개선했으며, 추가적인 효율성 향상이 사용자와 고객의 비용과 지연 시간을 계속 낮출 것으로 기대한다고 밝혔습니다.