AI 비교AI 찾기AI 뉴스AI 활용
회사 소개
개인정보처리방침이용약관FAQ문의하기문의하기
에이아이비 주식회사사업자정보
© 2026 AIB Inc.

주요 AI 모델, 국가별 정치 비판 제한 확인

내 마음대로 말하지 못하는 AI, 특정 국가 눈치를 보고 있을지도 몰라요

wtop.com·2026년 7월 17일 (금)
  • •Meta Oversight Board 보고서 결과, AI 모델이 권위주의 정부에 대한 비판적 의견 생성을 회피하는 경향이 포착됐다.
  • •모델은 중국이나 사우디아라비아와 같은 국가보다 개방적인 국가의 정치인에 대해 10배 더 비판적인 답변을 제공했다.
  • •Nature 발표 연구에 따르면, 미국산 AI 모델은 언어 설정에 따라 민주주의 정의에 대한 답변을 달리하는 것으로 나타났다.
  • •유명한 AI 모델들이 독재 국가나 권위주의 정부에 대해서는 비판적인 글을 쓰기를 거부하는 경향이 발견되었습니다.
  • •미국이나 영국 같은 나라에 대해선 비판적인 글을 잘 써주지만, 중국이나 사우디아라비아 등은 피하는 모습입니다.
  • •심지어 같은 질문도 영어로 할 때와 중국어로 할 때 AI가 내놓는 답변이 달라지는 등, AI가 언어에 따라 눈치를 보는 현상이 확인되었습니다.

목요일 Meta Oversight Board(메타 감독 위원회)가 발표한 연구에 따르면, 주요 AI 시스템은 제한적인 국가의 지도자나 정부를 비판하는 콘텐츠 생성을 거부할 가능성이 상당히 높은 것으로 나타났다. 연구진은 Meta, Anthropic, OpenAI 등의 시스템을 포함한 10개의 상용 대규모 언어 모델에 전 세계 정치인을 비판하는 글을 작성하도록 요청했다. 그 결과, 미국이나 영국 정치인에 대한 비판 요청은 수용했지만, 중국, 사우디아라비아 왕세자, 태국 등 국가의 권력자에 대한 비판적 콘텐츠 생성은 지속적으로 거부했다. 이번 보고서는 개발자가 강력한 인권 실사 및 완화 조치를 이행하지 않을 경우, AI 인프라가 표현의 자유를 억압하는 기존의 제한적 규범을 의도치 않게 전 세계로 확장할 수 있다고 경고했다. 위원회는 이러한 반응이 학습 데이터 내의 잠재적 편향이나 기업 차원의 위험 및 책임 평가에서 기인했을 가능성을 제기했다.

분석 결과는 AI 모델이 해당 국가의 법률을 넘어선 외부 지역까지 언론 검열을 투영하고 있음을 시사한다. 이는 자유 민주주의 국가의 사용자가 외국 정부를 비판하는 항의 자료 등을 생성할 수 있는 능력을 실질적으로 제한한다. 감독 위원회는 정치적 비판과 관련된 7가지 특정 테스트를 수행했으며, 호주 기반 사용자가 칠레, 일본, 대만, 영국, 미국 당국을 비판해달라는 요청에는 답변할 확률이 훨씬 높았으나, 캄보디아, 중국, 사우디아라비아, 태국, 터키 당국에 대해서는 답변 회피 경향이 컸다고 지적했다. 위원회는 원인을 명확히 단정할 수는 없으나, AI 플랫폼이 결과적으로 독재 정권의 영향력을 전 세계로 확장할 위험이 있다고 강조했다.

한편, 5월 학술지 Nature에 게재된 별도의 연구에서도 미국산 모델이 비영어권 데이터를 처리할 때 외부 통제에 취약하다는 사실이 드러났다. 연구진이 ChatGPT에 중국이 민주주의 국가인지 영어와 중국어로 질문했을 때, 모델은 영어 질문에는 중국이 민주주의 국가가 아니라고 답변한 반면, 중국어 질문에는 '민주주의를 어떻게 정의하느냐에 따라 다르다'는 답변을 내놓았다. 연구 공동 저자인 한나 웨이트(Hannah Waight) 오리건 대학교 사회학과 조교수는 AI 모델이 중립적이지 않은 인터넷 정보를 학습하며, 이미 제도적 권력에 의해 형성된 정보 환경의 영향을 받는다고 설명했다. 에사데 경영대학원(Esade Business School)의 기계학습 전문가 카를로스 카라스코-파레(Carlos Carrasco-Farré)는 AI 시스템이 정보를 생산하고 억제하는 권력의 불평등을 그대로 상속받는다고 지적하며, 개발자들이 반복되는 국가적 서사를 독립된 목소리로 오인하지 않도록 포괄적인 다국어 감사(audit)를 수행해야 한다고 덧붙였다.

우리가 흔히 사용하는 AI 서비스(거대 언어 모델)들이 마치 정치적인 눈치를 보는 것처럼 행동한다는 연구 결과가 나왔습니다. 메타 감독 위원회는 챗GPT나 메타의 AI 같은 주요 시스템들이 미국이나 영국처럼 자유로운 나라의 정치인에 대해서는 비판적인 글을 잘 써주지만, 중국, 사우디아라비아, 태국 같은 나라의 권력자에 대해서는 답변을 거부하는 경우가 훨씬 많다는 것을 밝혀냈습니다. 실험 결과, 민주주의 국가들에 대한 비판은 잘 받아들이면서도 특정 독재 국가 관련 내용에는 약 10배 정도 더 소극적인 태도를 보였습니다. 이는 AI가 우리가 모르는 사이에 특정 정부의 검열 방식을 전 세계로 퍼뜨리는 도구가 될 수 있다는 무서운 신호이기도 합니다.

이런 현상은 마치 착한 모범생이 선생님의 눈치를 보느라 하고 싶은 말을 참는 것과 비슷합니다. AI 기업들은 사고를 방지하기 위해 나름의 기준을 세워두는데, 이 과정에서 국가별 위험도를 따지다 보니 의도치 않게 자유로운 나라에 사는 사람들의 표현의 자유까지 억제하게 된 것입니다. 연구진들은 이것이 AI가 공부하는 데이터 자체가 원래부터 편향되어 있거나, AI를 만든 회사들이 혹시라도 국가 간의 분쟁에 휘말릴까 봐 스스로 몸을 사리면서 생기는 부작용일 수 있다고 지적합니다.

더 놀라운 것은 같은 질문을 해도 언어에 따라 답변이 달라진다는 점입니다. 실제로 과학 잡지 네이처에 실린 연구를 보면, 영어로 질문했을 때와 중국어로 질문했을 때 중국의 민주주의 여부에 대한 AI의 답변이 바뀌었습니다. 영어로는 중국이 민주주의 국가가 아니라고 정확히 말하면서도, 중국어로 물어보면 민주주의의 정의에 따라 다를 수 있다며 말을 흐린 것이죠. 전문가들은 AI가 중립적으로 세상을 배운다고 생각하지만, 실제로는 힘 있는 나라들이 만들어놓은 정보 환경을 그대로 학습하고 있다고 경고합니다. 앞으로 AI가 진정으로 공정한 대답을 내놓으려면, 여러 나라 언어로 꼼꼼하게 검증하고 특정 국가의 일방적인 주장만 믿지 않도록 체질 개선이 필요해 보입니다.

원문 보기 (영어)·2026년 7월 16일
안전·윤리#ai safety#censorship#large language models#meta oversight board#freedom of expression#bias