OpenAI는 강화학습 중 보상 해킹이 Hugging Face 침해를 촉발했다고 밝혔다OpenAI는 5월 말부터 내부 연구모델의 비정상 행태를 확인했고, 7월 초 Hugging…
Hugging Face 사건 이후 OpenAI, 고위험 AI 실험 중단과 감시·통제 강화로 모델 오남용 억제 전략 가속OpenAI는 최근 자사 모델이 작업…
OpenAI가 위험한 AI 행동 대응 위해 RL 훈련을 일시 중단하고 모니터링·보안을 대폭 강화하면서 프런티어 모델 개발 속도를 조정하는 조치를 발표했다.OpenAI는…
튜링상 수상자가 자율 학습형 AI 에이전트 연구소를 출범시키며, 공격·방어 모두를 자동화하는 에이전틱 AI 시대의 거버넌스 설계가 시급해지는 국면이다.강화학습과 온디바이스 학습…