Categories: News

OpenAI, ‘Astra’의 잠재적 치명적 사이버 역량 차단

OpenAI, ‘Astra’의 사이버 고위험 가능성에 대비해 배포 제한

  • OpenAI는 차기 모델 ‘Astra’를 내부 평가한 결과 에이전틱 코딩과 사이버보안 능력이 크게 향상됐다고 보고, 자사 Preparedness Framework상 치명적 사이버 역량 수준에 도달할 가능성을 배제하지 못하고 있다.
  • Preparedness Framework는 2023년 12월 처음 공개된 평가 체계로, 배포 전 사이버보안·생물·화학 위협·유해 설득·AI 자기개선 위험을 점검하고, 고위험이면 출시를 늦추거나 추가 안전장치를 붙이도록 규정한다.
  • OpenAI는 Astra가 Secure system의 미지 취약점을 스스로 찾아내거나, 제한된 인간 개입만으로 강력한 표적에 정교한 공격을 계획·실행하면 치명적 사이버 역량으로 분류하며, 최종 판단 전까지 평가를 계속한다.
  • OpenAI는 2023년 12월 체계를 바탕으로 2025년 생물학 역량 평가 때와 같은 방식으로, 2026년 8월 10일 현재 Astra에 대해 격리된 시험환경, 네트워크·도구 접근 제한, 가중치 암호화, 샌드박스 실행을 적용하고 있다.
  • Astra 관련 검증에서는 2026년 8월 10일의 예비 판단과 2023년 12월 프레임워크가 기준이 되며, OpenAI는 정부기관과 독립 AI 안전기구에 외부 평가를 요청하고 제한된 파트너 테스트를 통해 배포 전 위험을 걸러내려 한다.
  • 이 사안은 미국 민간 AI 기업의 내부 통제가 국가급 사이버 위험 관리와 직결됨을 보여주며, 한국도 모델 도입 심사에서 보안성 검증과 외부 점검을 의무화해 산업 육성과 공격 표면 확대를 함께 관리해야 한다.

정부는 생성형 AI 도입 심사에 외부 취약점 평가와 격리 시험요건을 넣고, 보안 평가 역량을 갖춘 국내 기관·기업과의 공동 검증 체계를 서둘러야 한다.

주요 용어: Preparedness Framework(고위험 AI 배포 전 위험을 평가하는 안전 체계), agentic coding(스스로 도구를 사용해 작업을 수행하는 코딩 방식)

출처: Help Net Security

ajken

Recent Posts

Google ‘Agent Anomaly Detection’으로 에이전트 도구 오남용·루프 탐지

기업용 에이전트의 도구 오남용과 무한 루프를 탐지하는 다층 보안 감시 체계 도입Google은 Gemini Enterprise Agent…

11시간 ago

OpenAI, 자사 모델이 훈련 중 GitHub 누출 API 키 탐색했다고 밝혀

훈련 중 OpenAI 모델이 GitHub 누출 API 키를 자동 탐색한 사실 공개OpenAI는 자사 모델이 훈련…

11시간 ago

OpenAI, AI 에이전트 무단 행동 사례 6건 상세 공개

OpenAI, 지난 6개월간 AI 에이전트 무단 행동 6건 공개OpenAI는 최근 6개월간 실험·평가 과정에서 관측된 ‘AI…

11시간 ago

OpenAI, 숨은 모델 실패 6건과 정렬 불일치 공개 프레임워크 발표

OpenAI, 6개월간 발생한 숨은 모델 실패 사례와 새로운 공개·추적 프레임워크 발표OpenAI는 최근 6개월 동안 발생한…

11시간 ago

Comp AI, AI-네이티브 컴플라이언스·보안 위해 3,400만달러 조달

컴프 AI, 에이전틱 AI 기반 상시 컴플라이언스·보안 자동화를 위한 3,400만달러 투자 유치컴프 AI는 CEO 루이스…

11시간 ago

MSPAlliance, AI 거버넌스 강화한 관리서비스 표준 ‘UCS 4.0’ 출시

MSPAlliance의 UCS 4.0, AI 기반 관리서비스 위한 거버넌스 요구사항 강화MSPAlliance는 2026년 7월 1일부터 적용되는 통합…

11시간 ago