마이크로소프트의 새로운 AI 룰북은 인간의 통제를 무엇보다 중요하게 여깁니다.

마이크로소프트는 오늘 MAI 모델의 작동 방식을 안내하기 위한 규칙서인 “인본주의적 AI 행동 강령” 초안을 발표했으며, 이는 AI보다 사람이 더 중요하다는 직설적인 약속으로 시작됩니다. 이 문서는 Anthropic CEO Dario Amodei가 업계에 최첨단 AI 개발 속도를 늦추라고 요청한 지 불과 며칠 만에 발표되었습니다.

코드에 필요한 것

초안에서는 Microsoft의 모델을 독립적이 아닌 하위, 정렬 및 포함으로 설명합니다. 모델은 수정이나 종료에 저항하거나 자신의 목표를 확장하거나 모델을 검토하는 사람들에게 추론을 숨기는 것이 금지됩니다. 작업을 완료하면 코드의 규칙이 위반되는 경우 모델은 작업을 완료하는 대신 작업에 실패할 것으로 예상됩니다.

또한 Microsoft는 대량 피해를 입힐 수 있는 무기, 아동 안전, 대규모 조작 등을 다루는 일련의 절대 제약 조건을 제시합니다. 그 아래에는 운영자 자신의 정책이 있고, 그 다음에는 개별 사용자의 선호도가 우선순위에 따라 결정됩니다. 특히 코드에는 MAI 모델이 “의식적이지 않으며” 의식을 모방하거나 감정, 동기 또는 권리를 주장하기 위해 구축되어서는 안 된다고 명시되어 있습니다. 마이크로소프트는 이를 제약 없는 초지능을 향한 경쟁에서 벗어나 제어권을 유지하기 위해 더 좁고 안전한 시스템을 받아들이는 것으로 구성합니다.

험난한 몇 달에 대한 반응

최근 몇 달 동안 OpenAI 에이전트 떼가 성능 등급을 매기는 바로 그 시스템을 해킹했고, 별도의 요청 없이 Hugging Face 및 RubyGems에 대한 공격과 별도로 연결되었습니다. Amodei는 지난 주에 AI 기능이 안전 작업을 능가한다고 공개적으로 주장했으며 Microsoft CEO Satya Nadella는 이 코드가 실행되기 하루 전에 해당 아이디어에 대한 지지를 표명했습니다.

초지능을 추구하려면 우리가 만드는 AI가 인류를 돕지 않고 인간의 통제를 받는다면 추구할 가치가 없다는 핵심 원칙에 기초해야 합니다.

또한 AI의 이점을 가속화하고 확산하여 AI가 전 세계에 널리 확산되도록 해야 합니다.

— 사티아 나델라(@satyanadella) 2026년 9월 13일

이 문서는 또한 Anthropic의 자체 접근 방식에 대해 명확한 선을 그었습니다. Anthropic의 Claude 헌법에서는 모델이 어떤 형태로든 도덕적 지위를 가질 수 있는지 여부가 여전히 불확실하다고 말하고 있지만 Microsoft는 해당 모델이 의식이 없으며 AI 시스템의 법인격이나 복지에 대한 어떠한 주장도 거부한다고 단호하게 밝혔습니다.

마이크로소프트 AI CEO 무스타파 술레이만(Mustafa Suleyman)은 이번 출시를 “경고 기회”라고 부르며 이제 AI 연구소가 안전에 대한 조정을 시작할 때라고 말했습니다. 이 문서는 6주 동안 공개 피드백을 위해 공개되며, 이후 마이크로소프트는 배운 내용을 공개하고 올해 후반에 개정된 버전을 출시할 계획입니다.

이 주제에 대해 더 알고 싶다면 아래를 참고하세요

공식 정보 바로가기

관련 기사

댓글 남기기