News Anthropic, Claude 내부 사고 가시화로 AI 안전 연구 앞당김 ajken 2026년 07월 08일 모델의 내부 추론 경로를 읽어내며, AI 안전성 검증을 ‘블랙박스 테스트’에서 ‘행동 감시’로 바꾼다Axios는 Anthropic이 Claude의 내부 사고를 읽을 수 있게... 더 읽기Anthropic, Claude 내부 사고 가시화로 AI 안전 연구 앞당김에 대해 더 읽어보기