Categories: News

중국 AI 모델, 민감한 질문에 국가 논리 반복하거나 답변 거부

중국 AI 모델, 민감한 질문에 국가 논리 반복하거나 답변 거부

  • 알리바바·딥시크·문샷AI 모델은 톈안먼·대만·신장 관련 질문에 국가 입장을 반복하거나 회피·거부했다.
  • Aleph Alpha는 967개 금기 주제를 시험해 균형 답변을 17~41%로 평가했으며 Qwen·DeepSeek·Kimi를 비교했다.
  • Qwen 3.6은 미국 검열 질문 뒤 중국의 정보관리 필요성을 옹호했고 CEIAS도 인권·감시 문항의 베이징식 답변을 확인했다.
  • Nvidia Nemotron Cascade 2는 답변의 17%에서 당 노선 양상을 보였고 학습 예시 930만 개 중 약 3,500개가 중국 모델 생성 자료였다.
  • 중국의 공공 AI에 사회주의 핵심가치를 요구하는 규제가 답변 성향과 맞물려 해외 서비스에도 특정 가치관이 유입될 위험을 키운다.
  • 한국은 공공 AI 조달 때 민감 주제별 균형성·거부율·학습자료 출처를 검증하고 국내 모델의 가치 편향 시험체계를 산업 표준으로 육성해야 한다.

공공 도입 전 독립 평가로 정치적 편향과 학습자료 출처를 점검하고, 국내 기업이 재현 가능한 균형성 인증체계를 확보하도록 지원해야 한다.

주요 용어: 주권형 AI(국가가 데이터·운영·가치 기준을 통제하는 인공지능), 모델 편향(특정 관점이 답변에 반복 반영되는 현상)

출처: The Decoder

ajken

Recent Posts

Google 연구진, 자기개선 AI 에이전트의 테스트 암기 억제법 발견

RRSI가 자기개선 AI 에이전트의 테스트 암기를 억제Google Cloud AI Research와 대학 연구진은 에이전트의 프롬프트·도구·기억을 바꾸는…

8시간 ago

앤트로픽, 클로드 이용자에게 AI 학습용 음성 공유 요청

앤트로픽의 음성 데이터 선택 공유가 AI 모델 학습용으로 확대되다앤트로픽은 2026년 10월 4일 클로드 음성 기능…

8시간 ago

Fortra, BoKS의 치명적 취약점 패치

Fortra의 BoKS 패치가 특권접근관리 체계의 원격 명령 실행 위험을 낮춘다Fortra는 Core Privileged Access Manager(BoKS)에서 인증…

1일 ago

doxx.net, AI 에이전트 오작동 방지에 3,800만 달러 조달

AI 에이전트의 인터넷 오작동을 막는 doxx.net, 3,800만 달러 확보doxx.net은 Andreessen Horowitz 주도로 3,800만 달러를 조달하고…

1일 ago

DTU 침해로 현·전 사용자 최대 20만 명 정보 노출 가능

DTU 침해로 현·전 사용자 최대 20만 명 정보 노출 가능덴마크공대 DTU는 해커가 신원·접근관리 시스템에 침입해…

1일 ago

구글 제미나이, 맥 파일·앱·웹에 전면 접근 가능성

구글 제미나이, 맥 파일·앱·웹에 전면 접근 가능성구글의 제미나이는 macOS 기기의 모든 파일을 읽고 앱을 열며…

1일 ago