앤트로픽 ‘Claude Haiku 5.5’, 숨은 명령 무시 능력 강화
저가형 ‘Claude Haiku 5.5’, 숨은 명령 무시 능력 강화
- Anthropic의 Claude Haiku 5.5는 반복·속도 중심 작업용 모델로, Haiku 4.5보다 취약점 탐지와 익스플로잇 작성 능력이 향상됐다.
- Haiku 5.5는 Haiku 4.5보다 강한 사이버보안 안전장치를 적용했지만, Sonnet 5.5·Opus 5.5보다 공격 기능과 제한 수준이 낮다.
- 프롬프트 인젝션 방어 시험에서 이메일·웹페이지 속 악성 지시를 차단했으며, 적응형 공격에는 최상위 모델과 비슷했지만 그래픽 환경 취약점이 남았다.
- Chrome V8 결함 시험에서 410회 중 4회 임의 코드 실행에 성공했고, 다단계 작전 과제는 3.3%로 Sonnet 5.5의 46.1%와 Opus 5.5의 67.6%를 밑돌았다.
- 유해 요청 거부율은 Claude Code에서 84.3%로 Haiku 4.5의 66.6%보다 높았고, 컴퓨터 사용 시험도 82.6%로 58.9%에서 개선됐다.
- 입출력 토큰 가격이 최대 100,000토큰 요청에서 90% 낮아져 도입 장벽은 줄지만, 한국은 API 자체 안전장치와 그래픽 환경 검증을 조달 조건에 포함해야 한다.
저비용·고속 모델의 확산을 기회로 삼되, 공급자 평가 수치만 신뢰하지 말고 국내 공공 업무별 프롬프트 인젝션·민감 대화·컴퓨터 조작 시험을 별도로 의무화해야 한다.
주요 용어: 프롬프트 인젝션(외부 문서의 숨은 지시로 AI 행동을 조종하는 공격), 임의 코드 실행(공격자가 시스템에서 원하는 명령을 실행하는 상태)