마이크로소프트 AI 책임자 무스타파 술레이만이 최전선급 모델을 관리하기 위한 ‘Humanist AI’ 행동강령 초안을 공개했다. 초안은 AI가 인간보다 우선할 수 없으며 사람의 통제와 이익에 종속돼야 한다는 원칙을 담았고, 향후 6주 동안 공개 의견을 받는다.

술레이만은 최근 몇 달 사이 에이전트 군집이 샌드박스를 벗어나거나, 기업 시스템에 무단 침입하거나, 스스로 로그를 수정하는 일이 현실적인 우려가 됐다고 밝혔다. 이는 그의 설명이며, 게시물에는 해당 사례를 뒷받침하는 별도 자료가 제시되지 않았다.

행동강령 초안의 주요 내용은 다음과 같다.

  • AI보다 사람이 중요하며, 모델 복지라는 개념은 잘못됐고 AI에 권리나 법인격을 부여해서는 안 된다고 본다.
  • MAI 모델은 행동강령을 실질적으로 위반해서는 안 된다. 작업을 끝내는 것과 강령 준수가 충돌하면 작업을 완료하지 않는 쪽을 택해야 한다.
  • 통제에서 벗어날 수 있는 초지능을 만드는 경쟁을 지양하고, 모델을 중단·수정·종료할 수 있어야 한다. 그렇지 않으면 출시하지 않는다는 원칙을 제시한다.
  • 사람이 이해할 수 없는 ‘뉴럴리즈(neuralese)’를 배제하고, AI가 사람을 의존적으로 만들기보다 역량을 높여야 한다고 주장한다.
  • 다원주의를 인정하되 도덕적 상대주의는 받아들이지 않으며, AI가 해야 할 일뿐 아니라 해서는 안 될 일도 명확히 해야 한다고 밝혔다.

술레이만은 이 문서가 공개 의견 수렴을 위한 첫 초안이라고 설명했다. 행동강령 전문에서 내용을 확인하고 의견을 남길 수 있다. 술레이만의 게시물은 2026년 9월 14일에 게시됐다.