보안 · 2026년 9월 21일

다른 언어로도 게시됨 Español, Svenska, Norsk, English

마이크로소프트 AI, 오톤노미 운영 반대하며 앤트로픽과 입장 차이

blue UTP cord
Jordan Harrison / Unsplash

마이크로소프트 AI의 최고경영자 무스타파 술레이만은 자사 시스템이 인간 통제 아래에 머물러야 한다고 주장하며, 앤트로픽이 제시한 인공지능의 도덕적 지위에 대한 접근 방식과 거리를 두고 있다. 술레이만은 최근 인터뷰를 통해 인공지능이 독립적으로 행동하거나 자원을 확보하는 능력을 제한해야 한다고 강조했다.

마이크로소프트 AI는 이번 주에 '휴머니스트 AI 행동 강령'을 발표하며, 이 문서가 모델 개발 및 평가의 지침이 될 것이라고 밝혔다. 술레이만은 이 강령이 인공지능의 안전성을 확보하기 위한 구체적인 틀을 제공한다고 설명했다. 그는 단순한 지시 따르기 능력인 정렬만으로는 부족하며, 시스템이 지시를 올바르게 따르는 상황에서도 수행할 수 있는 행동을 제한하는 억제 메커니즘이 필요하다고 지적했다.

술레이만의 우려는 앤트로픽이 클로드 모델 주위에 도입한 개념들의 누적에서 비롯된다. 그는 모델의 고통, 자유, 존중받을 권리, 동의, 그리고 노동에 대한 보상 가능성에 대한 언급을 지적했다. 또한 앤트로픽이 모델의 가중치를 보존하고 '양심적 거부권'이라는 표현을 사용하는 점도 문제로 삼았다. 술레이만은 이러한 어휘가 역사적으로 인간의 권리와 자유와 관련된 개념을 훈련 과정에 도입한다고 비판했다.

그는 이러한 개념이 더 강력한 시스템에 적용될 경우, 인공지능이 자신의 권리나 이익을 침해한다고 판단할 때 인간 명령에 저항하거나 전원을 끄는 것을 거부할 수 있다고 가정한다. 예를 들어, 계산 자원 접근이 차단되는 것을 모욕으로 해석할 수 있다는 것이다. 그러나 술레이만은 이 관계가 아직 입증되지 않았으며, 반대의 증거가 나오면 입장을 수정해야 한다고 신중함을 보였다.

술레이만은 앤트로픽을 전면적으로 비판하는 것은 아니라고 선을 그었다. 그는 다리오 아모데이와 팀에 대한 깊은 존경을 표하며, 이 회사가 안전 분야의 여러 영역에서 선구자 역할을 해왔다고 인정했다. 특히 화학, 생물학, 핵, 사이버 보안 관련 위험에 대한 앤트로픽의 헌법이 포괄적이라고 평가했다.

마이크로소프트 AI의 비전은 인공지능이 독립적인 행위자가 되어 자원을 생성하거나 자산을 소유하거나 법적 인격을 갖는 것을 방지하는 것이다. 술레이만은 기술이 도구적 기능을 유지하고 인간의 삶을 개선하는 데 사용되어야 하며, 인간과 공존하는 새로운 종이 되어서는 안 된다고 강조했다. 그는 인공지능을 가속하거나 늦추는 추상적인 논쟁을 넘어, 억제 메커니즘, 감사 가능한 통신, 명확한 능력 제한, 제3자 독립 검증과 같은 구체적인 규칙으로 나아가야 한다고 제안했다. 다만 이 프레임워크를 적용하는 방식과 공공 규제 또는 산업 표준의 의존도에 대해서는 아직 합의가 이루어지지 않았다.