Categories: News

OpenAI, Cerebras 기반 GPT-5.6 Sol ‘Ultrafast’ 모드 공개

OpenAI가 Cerebras 기반 ‘Ultrafast’ 모드로 GPT-5.6 Sol 추론 속도 대폭 상향

  • OpenAI는 대표 모델인 ‘GPT-5.6 Sol’에 신규 추론 옵션인 ‘Ultrafast’ 모드 프리뷰를 도입해 초당 최대 750개의 출력 토큰을 생성하도록 했으며, 이 모드는 소형 모델 수준의 속도와 대형 추론 모델의 복잡한 문제 해결 능력을 결합해 엔지니어링과 비즈니스 업무 전반에서 처리량을 크게 높이는 것을 목표로 한다.
  • Ultrafast 모드는 장애 대응 상황에서 로그와 코드 변경 내역, 운영 보고서를 장애가 진행 중인 상태에서 동시에 분석해 근본 원인을 실시간으로 특정하고 수정 방안을 준비할 수 있도록 설계됐으며, OpenAI는 이미 자사 내부 인시던트 대응에 GPT-5.6 Sol과 Ultrafast를 적용해 운영 팀이 장시간 배치 작업 없이도 시스템 상태를 상시 점검하고 고장을 줄이는 방향으로 활용하고 있다.
  • OpenAI는 금융 분야에서는 Ultrafast가 시장 신호를 빠르게 평가하고 의심스러운 거래를 시장 상황 변화와 동시에 포착하는 데 쓰일 수 있고, 고객지원에서는 여러 시스템과 단계를 거쳐야 하는 복잡 문의를 실시간으로 해결하며, 전자상거래에서는 상품 문의 응답과 재고 확인, 개인화 추천을 구매 포기 전에 제공하는 등 고속 추론을 다양한 산업에 접목하는 시나리오를 제시했다.
  • OpenAI는 GPT-5.6 Sol API에서 이미 기존 ‘Fast Mode’를 통해 일반 모드 대비 최대 2.5배 속도와 낮은 지연 시간을 제공하면서 가격을 약 2배로 책정해 추론 속도를 상품화해 왔고, 이번에 도입된 Ultrafast는 Cerebras 시스템을 기반으로 한 세 번째 고성능 티어로 초당 최대 750 토큰 생성이라는 성능을 제시하며, 클라우드 사업자인 AWS가 동일 서비스에 대해 성능 단계별로 이용 요금을 차등 부과해 온 구조를 AI 추론 영역에 본격 도입하는 사례로 볼 수 있다.
  • OpenAI는 연구 활동에서도 Ultrafast 모드가 기존에는 밤새 배치 작업으로 돌리던 실험을 상호작용적 세션으로 전환해 팀이 아이디어를 즉시 테스트하고 결과를 검토한 뒤 접근법을 조정해 다시 실행하는 순환을 끊김 없이 수행하게 함으로써, GPT-5.6 Sol 같은 대형 추론 모델을 활용한 데이터 분석·시뮬레이션·모델 검증 과정이 고성능 컴퓨팅 인프라 없이도 더 짧은 주기로 반복될 수 있는 기업·기관 연구 환경을 만들어 간다고 설명한다.
  • OpenAI가 Cerebras 기반 Ultrafast 모드로 GPT-5.6 Sol 추론 속도를 최대 초당 750 토큰까지 끌어올리고 Fast Mode, Ultrafast로 이어지는 다단계 속도·가격 티어를 설정한 것은 고속 AI 추론을 독립적인 수익원으로 만드는 동시에 인시던트 대응, 금융 거래 모니터링, 실시간 고객지원과 전자상거래에 시간 압박을 받는 고부가가치 업무를 흡수하는 전략으로, 이는 국내 클라우드·AI 서비스 사업자가 초저지연 추론 인프라와 속도 기반 과금 모델을 설계해 국가 사이버위기 대응, 금융 이상거래 탐지, 공공 민원 처리 자동화에 적용할지 검토해야 할 과제로 직결된다.

국내 정책 담당자는 초당 750 토큰 수준의 고속 AI 추론이 인시던트 대응과 금융 이상거래 탐지, 민원 처리 자동화의 게임 체인저가 될 수 있음을 감안해, 속도 티어 기반 과금 구조 도입 가능성과 국가 핵심 인프라에 적용할 때의 규제·표준을 선제적으로 설계할 필요가 있다.

주요 용어: GPT-5.6 Sol(OpenAI의 대형 추론 인공지능 모델), Ultrafast 모드(초당 최대 750 토큰을 생성하는 고속 추론 옵션)

출처: The Decoder

ajken

Recent Posts

주요 AI 코딩 에이전트 ‘Plugin4Shell’ 제로클릭 RCE 취약점 노출

주요 AI 코딩 에이전트에 첫 공급망형 제로클릭 원격코드 실행 취약점 확산Anthropic ‘Claude Code’, OpenAI ‘Codex’,…

12시간 ago

Microsoft, Azure AI Foundry 치명적 결함 패치

Azure AI Foundry의 최고위험 취약점 패치가 무단 권한 상승 차단으로 이어졌다Microsoft는 Azure AI Foundry의 CVE-2026-85889에…

12시간 ago

합성 학습 데이터 규제 가능성 속 활용 지속 가능성 논의

합성 학습 데이터 규제 논의, 데이터 출처·동의 체계 재검토 촉발Communications of the ACM 블로그 글은…

12시간 ago

CISA, 취약점 신고·조정 플랫폼 ‘VINCE-NT’로 자동화 강화

CISA의 취약점 신고·조정 플랫폼 ‘VINCE-NT’ 전환으로 자동화·내부 통합 가속미국 CISA가 2026년 9월 17일부터 카네기멜론대 SEI의…

12시간 ago

Handvantage, 벤더 중립 ‘Agentic AI 조달 핸드북’ 무료 공개

AI 보안·거버넌스 컨설팅사 Handvantage, 에이전틱 AI 플랫폼 조달 평가용 핸드북 무료 공개로 실무자 중심의 책임…

12시간 ago

보안 연구진, Anthropic ‘Claude’로 72시간 내 OpenAI 내부 시스템 침투

AI 에이전트를 이용한 취약점 연계 공격으로 OpenAI 내부 시스템 침투, 공격 비용·시간 급감이 확인되며 글로벌…

12시간 ago