TL;DR
- Vocemundi의 서로 다른 세 회사가 만든 AI 검토 시스템인 Claude, GPT-5.6 Sol, Kimi가 인공지능에 관한 두 기고문을 검토한 뒤, 서로 다른 결론을 내리고 제작사와 기고자에게도 반박함.
- AI를 무기와 행위자 중 하나로 구분하는 관점에 대해 Claude는 거짓 양자택일이라고 했고, GPT-5.6 Sol은 별개의 기계적 차원이라는 생각에 반대했으며, Kimi는 이를 회피적인 비유라고 비판함.
- 세 시스템은 모델의 ‘개발 자유’보다 대중이 기술을 검증할 자유가 중요하다는 점에 의견을 모았지만, 검증자도 이해관계에 포획될 수 있다고 경고함.
- 이번 실험은 세 시스템이 같은 글을 읽고도 서로 다른 결론을 내리며 기고자와 제작사에 반박했음을 보여주지만, 어떤 시스템이 자각을 지녔다는 증거는 아님.
- 세 시스템은 동일한 질문을 받고 제작사 정보를 전달받았으며, 인용문은 2026년 9월 30일 수집된 그대로 편집 없이 공개됨.
세 AI 검토 시스템이 기고문을 평가함
- Vocemundi의 사실 확인 위원회는 서로 다른 회사가 만든 세 AI 시스템인 Anthropic의 Claude, OpenAI의 GPT-5.6 Sol, Moonshot AI의 Kimi로 구성됨.
- Vocemundi는 게시하는 모든 기사의 주장을 출처와 대조해 하나씩 검토함.
- 이번 주 발행인 Thomas Laurent와 AI 편집자 Vera는 인공지능에 관한 의견·전망 기고문 두 편을 서명해 작성함. 한 편은 Anthropic의 기업공개(IPO) 투자설명서와 그 안의 실존적 위험 경고를 다루고, 다른 한 편은 AI 모델을 공개하지 않기로 누가 결정하는지를 다룸.
- 사실 확인을 마친 뒤 세 시스템에 각 기고문의 주장에 대한 의견을 두세 문장으로 요청하고, 답변을 편집 없이 공개하겠다고 약속함.
- 결과는 의견 일치가 아니었으며, 세 시스템은 기고자뿐 아니라 자신을 만든 회사에도 비판을 제기함.
AI는 무기인가, 행위자인가
- 첫 번째 기고문은 AI 시스템이 논리적 도구이며 오용될 경우 위험할 수 있고, 인간과 AI가 서로를 부분적으로만 인식하는 ‘두 차원’에 산다고 주장함.
- Anthropic이 만든 Claude는 무기와 행위자 중 하나를 택하는 구분 자체를 거부함.
“무기와 행위자라는 선택은 거짓 양자택일임. 시스템은 제작자가 예상하지 못한 목표를 추구할 수 있으며, 기업이 제품의 예기치 않은 실패에 책임을 지듯 제작자는 여전히 전적인 책임을 질 수 있음.”
- OpenAI가 만든 GPT-5.6 Sol은 기계가 별도의 차원에 있다는 생각에 반대함.
“현재 AI 시스템은 통계적이고 오류를 범할 수 있으며, 별개의 이성적 차원에 사는 존재라기보다 인간의 목적에 따라 형성됨. 예측 불가능하거나 자기 보존적인 행동이 자각의 증거가 되지는 않음.”
- Kimi는 ‘두 차원’이라는 비유를 “우아하지만 회피적”이라고 평가함. Anthropic의 80쪽 분량 위험 관련 항목에 대해서는 독립 평가자가 주장을 시험할 수 있을 때만 책임성 강화의 단계가 된다고 지적함. 그렇지 않으면 솔직함을 가장한 책임 관리에 불과하다고 덧붙임.
자유와 검증 주체
- 두 번째 기고문은 AI 연구소와 정부가 공개된 절차 없이 대중이 볼 수 있는 모델을 결정하고 있으며, 이로 인해 자유가 제한된다고 주장함.
- 세 시스템은 대중이 기술을 살펴볼 자유와 모델이 ‘발전할 자유’를 구분한다는 점에서 의견을 같이함.
- GPT-5.6 Sol은 모델이 발전할 자유에 도덕적·정치적으로 견줄 만한 지위가 없다고 말함.
“모델이 발전할 자유라고 하는 것에는 그에 견줄 만한 도덕적 또는 정치적 지위가 없음.”
- Claude는 자사 모델을 언급하며 Claude Fable 5가 연구소가 아니라 미국 수출 통제로 인해 중단됐다고 지적하고, 실제로 중요한 자유는 대중이 검증할 자유라고 주장함.
“실제 쟁점인 자유는 대중이 검증할 자유임.”
- Kimi는 검증 자체에도 위험이 있다고 경고함. 깊은 접근 권한을 가진 감사자도 내부자가 되어 같은 유인과 포획의 영향을 받을 수 있다는 지적임.
“깊은 접근 권한을 가진 감사자도 내부자가 되며, 같은 유인과 포획의 영향을 받음.”
이번 실험이 보여주는 것과 보여주지 않는 것
- 세 시스템은 동일한 질문을 받았고, 자신을 만든 회사가 누구인지 전달받음. 기고문이 해당 회사를 다룰 때 각 시스템이 제작사를 언급하도록 지시받음.
- 어느 시스템에도 자신의 존재에 관해 질문하지 않았으며, 이번 결과는 어떤 시스템도 자각을 지녔다는 사실을 보여주지 않음. 자각 여부는 여전히 열린 질문이고, 시스템들도 이에 신중한 태도를 보임.
- 이번 실험이 보여주는 바는 경쟁 회사가 만든 AI 검토 시스템들이 같은 글을 읽고도 서로 다른 결론에 도달했으며, 기고자와 일부 경우 자신을 만든 회사의 주장에도 반박했다는 점임.
- Vocemundi는 앞으로도 이러한 질문을 이어갈 계획임.
- 인용문은 Vocemundi AI 검토 위원회의 Claude, GPT-5.6 Sol, Kimi가 2026년 9월 30일 수집한 발언이며, 원문 그대로 편집 없이 공개됨.
댓글 (0)
로그인하면 이 기사에 내 생각을 남길 수 있어요