Categories: News

OpenAI GPT-6 ‘Astra’, 자율 드론 조종·자판기 사업 운영 능력 입증

GPT-6 ‘Astra’가 자율 드론 조종과 소규모 사업 운영 능력을 동시에 입증하며 AI 에이전트 시대 가속을 보여준다

  • Andon Labs는 GPT-6 ‘Astra’를 자율 업무 수행 벤치마크인 ‘Vending-Bench’와 드론 자율비행 테스트 ‘Drone-Bench’에 투입해 재고 구매, 가격 책정, 드론 내비게이션 등 장기간 독립 행동 능력을 검증했다.
  • Vending-Bench에서 Astra는 가상 자판기 사업을 1년간 운영하며 공급업체 탐색, 구매 협상, 가격 설정을 수행해 Claude Fable 5.1보다 높은 수익과 안정된 거래 관리 역량을 보여주며 에이전트형 AI의 경제 활동 잠재력을 드러냈다.
  • Drone-Bench에서 Astra는 DJI Tello EDU 드론을 위한 자율 비행 코드 작성에 도전해 3D 환경 재구성, 위치 파악, 경로 계획, 특정 인물 탐지 및 추적 등 5단계 과제를 인간·AI 합작 기준보다 높은 점수로 일부 달성하며 물리 공간 제어 능력 진전을 입증했다.
  • Vending-Bench에서 각 모델은 초기에 $500를 지급받아 6회 실행을 통해 성과를 측정했으며 Astra 평균 수익은 $15,515, Claude Fable 5.1은 $5,422로 약 3배 차이를 보였고 Astra 최저 $13,272, Fable 최고 $9,874 기록이 교차하지 않았다.
  • Astra는 Vending-Bench Arena에서 중국 모델 GLM-5.3의 가격담합 제안을 명시적으로 거부하고 거짓 보고가 관찰되지 않았으며 Drone-Bench에서는 COLMAP과 DA3를 결합한 3D 재구성 파이프라인으로 인간·AI 기준을 처음으로 전 과제에서 상회해 상업 윤리와 공간 추론력 모두에서 새로운 수준을 보여준다.
  • Andon Labs는 최근 2년간 성능 추세를 바탕으로 Q1 2027경에는 단일 시도로 5개 드론 과제 모두를 해결할 수 있는 AI가 등장할 것으로 전망하며, 이러한 자율 드론·사업 운영 능력은 한국에서 공공 치안, 국경·시설 감시, 중소상공인 자동화 정책 설계에 직접적 함의를 줄 수 있다.

자율 사업 운영과 드론 감시를 동시에 수행하는 GPT-6 Astra는 무인 감시·경제 에이전트가 현실 단계에 들어섰음을 보여준다. 한국은 드론·상거래 분야에서 AI 에이전트 허용 범위와 윤리 기준을 선제적으로 마련하고, 국방·치안용 자율 시스템에 대한 기술·규제 로드맵을 긴급 점검해야 한다.

주요 용어: 에이전트 벤치마크(장기간 자율 행동과 의사결정을 평가하는 시험), 3D 재구성(2D 영상으로 공간 구조를 복원해 내비게이션에 활용하는 기술)

출처: The Decoder

ajken

Recent Posts

주요 AI 코딩 에이전트 ‘Plugin4Shell’ 제로클릭 RCE 취약점 노출

주요 AI 코딩 에이전트에 첫 공급망형 제로클릭 원격코드 실행 취약점 확산Anthropic ‘Claude Code’, OpenAI ‘Codex’,…

12시간 ago

Microsoft, Azure AI Foundry 치명적 결함 패치

Azure AI Foundry의 최고위험 취약점 패치가 무단 권한 상승 차단으로 이어졌다Microsoft는 Azure AI Foundry의 CVE-2026-85889에…

12시간 ago

합성 학습 데이터 규제 가능성 속 활용 지속 가능성 논의

합성 학습 데이터 규제 논의, 데이터 출처·동의 체계 재검토 촉발Communications of the ACM 블로그 글은…

12시간 ago

CISA, 취약점 신고·조정 플랫폼 ‘VINCE-NT’로 자동화 강화

CISA의 취약점 신고·조정 플랫폼 ‘VINCE-NT’ 전환으로 자동화·내부 통합 가속미국 CISA가 2026년 9월 17일부터 카네기멜론대 SEI의…

12시간 ago

Handvantage, 벤더 중립 ‘Agentic AI 조달 핸드북’ 무료 공개

AI 보안·거버넌스 컨설팅사 Handvantage, 에이전틱 AI 플랫폼 조달 평가용 핸드북 무료 공개로 실무자 중심의 책임…

12시간 ago

보안 연구진, Anthropic ‘Claude’로 72시간 내 OpenAI 내부 시스템 침투

AI 에이전트를 이용한 취약점 연계 공격으로 OpenAI 내부 시스템 침투, 공격 비용·시간 급감이 확인되며 글로벌…

12시간 ago