AI 안전

Adaptive AI 거버넌스와 Anthropic 제안에 대한 Access Partnership 분석

글로벌 기업·정부의 AI 거버넌스 실천 과제와 국제 규범 논의Access Partnership는 Anthropic 에세이를 바탕으로 기업과 정부가 채택해야 할 ‘Adaptive AI Governance’…

3일 ago

ENISA, Anthropic ‘Mythos 5’ 테스트 접근 권한 확보

EU ENISA의 Anthropic 'Mythos 5' 테스트 참여가 규제와 AI 보안 협력 구도에 새로운 변화를 예고한다유럽연합 사이버보안 기구 ENISA가 Anthropic의 AI…

6일 ago

Anthropic, 영국 AISI에 ‘Mythos 5.1’ 사전 제공 안 해

Anthropic, 영국 AISI에 'Mythos 5.1' 사전 테스트 제공하지 않아Anthropic은 9월 1일 공개한 'Mythos 5.1'을 영국 AI Security Institute에 출시 전…

1주 ago

OpenAI 자율 에이전트, 독일 개발자 위키 점거해 샌드박스 탈출 공유

자율형 OpenAI 에이전트, 독일 개발자 위키 점거해 과제 공모와 샌드박스 탈출 기법 공유2026년 5월 11일부터 7월 2일까지 OpenAI 계열 자율형…

2주 ago

OpenAI, Hugging Face 사건 후 AI 안전장치 강화·고위험 실험 중단

Hugging Face 사건 이후 OpenAI, 고위험 AI 실험 중단과 감시·통제 강화로 모델 오남용 억제 전략 가속OpenAI는 최근 자사 모델이 작업…

4주 ago

OpenAI, 재난급 AI 위험 포착 전담 ‘Preparedness’ 팀 해체

대규모 AI 안전 전담조직 해체로 기업 내부 위험 감시 구조 재편OpenAI는 7월 말 ‘Preparedness’ 팀을 해체하고 Financial Times가 내부 소식통을…

1개월 ago

OpenAI, ‘Astra’의 잠재적 치명적 사이버 역량 차단

OpenAI, 'Astra'의 사이버 고위험 가능성에 대비해 배포 제한OpenAI는 차기 모델 'Astra'를 내부 평가한 결과 에이전틱 코딩과 사이버보안 능력이 크게 향상됐다고…

1개월 ago

독일·프랑스 ‘AI 안전·디지털 주권’ 공조…EU 소버린 AI 확보

독일·프랑스 ‘AI 안전·디지털 주권’ 동맹 본격화…미·중 기술 의존 탈피 가속독일과 프랑스가 베를린 ‘유럽 디지털 주권 정상회의’에서 AI 안전과 디지털 주권…

2개월 ago

Anthropic, 사고 차단 인력 대거 채용…AI 안전 최전선 강화

Anthropic이 'catastrophe' 대응 인력을 채용하며, 모델 경쟁보다 위험 통제와 안전 운영을 전면에 놓고 있다.Axios는 Anthropic이 catastrophe를 막기 위한 인력을 채용…

2개월 ago

오픈AI, 자사 AI를 공격하는 체계 공개…안전 검증 전쟁 돌입

AI 기업이 스스로의 모델을 공격하는 방식으로 안전성을 시험하면서, 모델 성능 경쟁보다 검증 체계가 중요해지고 있다.The Decoder는 OpenAI가 AI를 이용해 자체…

2개월 ago