OpenAI, GPT-5.6 정식 출시 · 성능·속도·비용 효율 모두 강화
이미지 출처: Pixabay / 작가: D1_TheOne
OpenAI가 복잡한 전문 업무와 장시간 이어지는 AI 에이전트 작업에 초점을 맞춘 차세대 모델 제품군 GPT-5.6을 정식 출시했습니다.
OpenAI는 2026년 7월 9일 공식 발표를 통해 GPT-5.6이 이전 모델보다 토큰당 더 많은 유용한 작업을 수행하고, 비용 대비 성능과 복잡한 과업 처리 능력을 강화했다고 밝혔습니다.
이번 제품군은 최상위 추론 모델인 GPT-5.6 Sol과 균형 잡힌 성능을 제공하는 Terra, 빠른 속도와 낮은 비용에 초점을 맞춘 Luna로 구성됩니다.
하나의 모델이 아닌 세 가지 제품군
GPT-5.6 Sol은 코딩과 과학 연구, 사이버 보안, 복잡한 문서 작성처럼 높은 수준의 추론이 필요한 작업을 위한 최상위 모델입니다.
Terra는 GPT-5.5와 경쟁할 수 있는 성능을 유지하면서 상대적으로 낮은 비용으로 일상적인 전문 업무를 처리하도록 설계됐습니다.
Luna는 세 모델 가운데 가장 빠르고 저렴한 모델로, 대량의 요청을 처리하거나 응답 속도가 중요한 서비스에 적합합니다.
기업과 개발자는 모든 작업에 가장 강력한 모델을 일괄 적용하지 않고, 업무의 난도와 비용, 속도 요구에 따라 적절한 모델을 선택할 수 있습니다.
토큰 가격보다 완료된 업무량에 초점
OpenAI는 GPT-5.6의 핵심 특징으로 ‘토큰당 더 많은 유용한 작업’을 강조했습니다.
AI 모델의 비용 효율성은 단순히 입력·출력 토큰 가격만으로 결정되지 않습니다. 모델이 정확한 결과를 만들기까지 여러 차례 재시도하거나 불필요하게 긴 답변을 생성한다면 실제 업무 비용은 오히려 증가할 수 있습니다.
반대로 더 적은 토큰과 도구 호출로 작업을 정확하게 완료하면, 개별 토큰 가격이 높더라도 전체 작업 비용은 낮아질 수 있습니다.
GPT-5.6은 복잡한 작업에서 필요한 단계와 출력 토큰, 도구 호출 횟수를 줄이면서 결과물의 품질을 높이는 방향으로 개선됐습니다.
OpenAI가 공개한 파트너 평가에 따르면 일부 법률 업무에서는 GPT-5.5보다 토큰 사용량을 줄이면서 품질이 향상됐으며, 애플리케이션 제작 과정에서는 작업 단계와 도구 호출 횟수도 감소했습니다.
다만 이러한 수치는 특정 기업의 내부 평가 환경에서 측정된 결과이므로 모든 업무에서 동일한 수준의 개선을 보장하는 것은 아닙니다.
복잡한 도구 작업 위한 기능 강화
GPT-5.6에는 여러 외부 도구를 효율적으로 조정하기 위한 ‘Programmatic Tool Calling’ 기능이 도입됐습니다.
기존 AI 에이전트는 검색이나 파일 분석, 코드 실행과 같은 도구를 사용할 때 각 단계의 중간 결과를 대화 문맥에 반복적으로 포함해야 했습니다. 이 과정은 입력 토큰과 처리 시간을 증가시키는 원인이 될 수 있습니다.
Programmatic Tool Calling은 GPT-5.6이 메모리 안에서 프로그램을 작성하고 실행해 여러 도구와 중간 결과를 관리하도록 지원합니다.
이를 통해 복잡한 자료 조사나 문서 분석, 데이터 처리 과정에서 불필요한 토큰 사용을 줄이고 여러 단계의 업무를 보다 효율적으로 수행할 수 있습니다.
여러 하위 에이전트를 동시에 실행하고 결과를 하나로 종합하는 멀티 에이전트 기능도 베타 형태로 제공됩니다.
코딩·과학·사이버 보안 성능 개선
GPT-5.6은 명령줄 작업과 소프트웨어 개발, 생명과학 연구, 사이버 보안 분야에서 이전 모델보다 향상된 성능을 보였습니다.
특히 GPT-5.6 Sol은 취약점을 발견하고 수정하는 방어적 보안 업무와 장시간 이어지는 에이전트형 작업에서 성능이 강화됐습니다.
OpenAI는 GPT-5.6이 공격 대상에 대한 완전한 사이버 공격을 자율적으로 수행하는 능력보다, 취약점을 찾아내고 해결하는 능력에서 더 강한 모습을 보였다고 설명했습니다.
생명과학 분야에서는 유전체와 정량 생물학 분석처럼 여러 단계가 필요한 연구 업무를 더 적은 토큰과 시간으로 수행하는 데 초점을 맞췄습니다.
OpenAI는 GPT-5.6이 생물학과 사이버 보안 분야에서 이전 모델보다 강력해졌지만, 자체 대비 프레임워크가 규정한 최고 위험 단계인 ‘Critical’ 수준에는 도달하지 않았다고 밝혔습니다.
추론 수준 사용자가 선택
GPT-5.6에는 복잡한 문제를 더 오래 검토하도록 하는 새로운 추론 강도인 ‘max’가 추가됐습니다.
최상위 ‘ultra’ 모드는 하나의 모델만 사용하는 대신 여러 하위 에이전트를 활용해 복잡한 과업을 나누어 처리합니다.
사용자는 빠른 응답이 필요한 단순 업무에서는 낮은 추론 수준을 선택하고, 코딩이나 연구, 정밀 분석처럼 어려운 작업에서는 더 높은 추론 수준을 사용할 수 있습니다.
이는 모델의 모든 요청에 동일한 연산량을 사용하는 대신, 작업의 난도에 맞춰 성능과 비용을 조절하기 위한 방식입니다.
ChatGPT·Codex·API에서 제공
GPT-5.6은 발표 당일부터 ChatGPT와 Codex, OpenAI API를 통해 순차적으로 제공됐습니다.
ChatGPT 유료 이용자는 Sol과 Terra, Luna 가운데 작업에 적합한 모델을 선택할 수 있으며, API 개발자도 세 모델을 각각 사용할 수 있습니다.
API 가격은 100만 토큰 기준으로 Sol이 입력 5달러·출력 30달러, Terra가 입력 2.5달러·출력 15달러, Luna가 입력 1달러·출력 6달러로 책정됐습니다.
GPT-5.6의 출시는 AI 모델 경쟁의 중심이 단순한 벤치마크 점수에서 실제 업무 완료량과 토큰 효율, 도구 사용 능력, 운영 비용으로 이동하고 있음을 보여줍니다.
기업 입장에서는 가장 강력한 모델을 사용하는 것보다 업무별로 적절한 모델과 추론 수준을 선택해 성공적인 작업당 비용을 낮추는 전략이 더욱 중요해질 것으로 보입니다.
댓글 (0)
비밀번호 확인
댓글 삭제를 위해 비밀번호를 입력해주세요.