AI 안전

Anthropic ‘Claude Fable 5’ 공개 연기… AI 경쟁보다 안전·통제 우선

Anthropic의 일정 조정이 AI 안전성 경쟁의 우선순위를 드러내다Anthropic은 유료 사용자에게 제공하던 'Claude Fable 5' 무료 기간을 연장하며 출시 일정 조정에…

2개월 ago

Anthropic, Claude 내부 사고 가시화로 AI 안전 연구 앞당김

모델의 내부 추론 경로를 읽어내며, AI 안전성 검증을 ‘블랙박스 테스트’에서 ‘행동 감시’로 바꾼다Axios는 Anthropic이 Claude의 내부 사고를 읽을 수 있게…

2개월 ago

트럼프 행정부, Anthropic Fable 5 제약 해제하며 고위험 AI 통제 전략 조정함

미국 정부가 Claude Fable 5·Mythos 5에 대한 수출 통제를 완화하며, 고성능 에이전틱 AI를 안보 위험 관리 하에 글로벌 시장에 재복귀시키는…

3개월 ago

OpenAI, 작은 훈련으로 모델 안전성 끌어올려…규제 설계가 앞당겨짐

모델의 안전 행동을 소량의 훈련으로 넓게 강화할 수 있다는 결과가 AI 안전성의 조기 개입 가능성을 키우고 있다.OpenAI 연구진은 소량의 "beneficial…

3개월 ago

Anthropic, 건강형 챗봇 성능 끌어올려…AI 신뢰성 경쟁 격화

Anthropic이 Claude의 건강 답변 기능을 강화하면서, 민감 분야에서의 AI 정확성과 책임 문제가 다시 부각됐다The Decoder는 OpenAI의 건강 관련 업그레이드와 함께…

3개월 ago

Anthropic, Fable 논란 속 워싱턴 총력전…AI 안전 규제 압박 강화

미국 행정부와 빅테크의 AI 통제선을 둘러싼 충돌이 커지며, 한국도 생성형 AI 규제와 공공조달 기준을 서둘러 정비해야 하는 국면이다.Anthropic은 자사 모델…

3개월 ago

Claude Fable 5, Mythos 안전 서사 못 바꿔…AI 방어 기준 시험대

Anthropic의 Claude Fable 5가 등장했지만 Mythos 보안 서사를 바꾸지 못했다는 평가는, AI 안전 프레임워크가 모델 이름이 아니라 검증 가능한 통제…

3개월 ago

Anthropic, Claude Fable 5 고가 전략…AI 안전 경쟁의 새 변수

Anthropic이 Claude Fable 5를 더 비싼 가격에 내놓으면서, AI 안전성과 성능 경쟁이 이제는 품질보다 비용·통제 구조를 둘러싼 정책 논쟁으로 확장되고…

3개월 ago

Anthropic, Fable 5 공개…안전 필터가 가격과 주권을 바꾸다

Anthropic이 Claude Fable 5와 Mythos 계열을 내놓으면서, 고성능 AI 경쟁이 성능이 아니라 비용·필터링·통제 권한의 문제로 재편되고 있다.Anthropic은 Claude Fable 5를…

3개월 ago

독일, AI 안전연구소 승인…유럽 규제 공백 메우기 시작

독일이 영국식 AI 안전연구소를 채택하면서, EU AI Act 집행과 국가 차원의 모델 검증 체계가 한 단계 앞당겨지는 흐름이다.독일 국가안보회의가 영국의…

3개월 ago