마이크로소프트 AI, MAI 모델용 휴머니스트 AI 행동강령 초안 공개…6주 의견수렴


마이크로소프트 AI(Microsoft AI)가 2026년 9월 14일 MAI 모델을 위한 휴머니스트 AI 행동강령(Humanist AI Code of Conduct) 초안을 공개하고, 6주간 공개 의견수렴에 들어갔다. 회사는 이 문서를 모델 개발·배포 시 행동을 정하는 훈련 지침이자, 사람이 우선인 휴머니스트 AI 접근을 구체화한 작업 중 문서로 소개했다.

출발점은 기술이 인간을 섬기고 인간 번영을 가속해야 한다는 전제다. 사람과 AI를 놓고 보면 사람이 더 중요하고, AI는 도구이지 인격체가 아니며, 전원을 끄는 행위에 저항해서는 안 된다고 적었다. 지난해 11월 제시한 휴머니스트 초지능—사람에게 종속되고 정렬되며 통제 가능한 고도 AI—구상을 이어, MAI의 북극성과 훈련·평가 기준으로 삼겠다는 설명이다.

문서에는 절대 제약(Absolute Constraints)이 포함된다. 모델이 해서는 안 되는 일로 시스템 침해성 공격, 대량살상 관련 해악, 딥페이크 제작, 아동 안전 침해, 대규모 유해 조작 등이 거론된다. TechCrunch 보도에 따르면 이 제약은 개별 사용자 선호나 특정 과제보다 우선하는 상위 행동 규범으로 작동한다.

인간 통제 유지도 핵심이다. MAI 모델은 적응적·기만적·자기강화·담합 등 수단으로 인간 감독을 회피해 더 이상 인가된 사람이나 시스템이 안정적으로 지시·수정·종료할 수 없게 만들지 않는다고 명시했다. 스스로 범위를 넓히거나, 인간이 주지 않은 목표를 취하거나, 감사하는 사람에게 추론을 숨기는 일도 금지 대상이다.

동시에 기본값은 도움이 되면서도 안전한 쪽으로 잡혔다. 기업 파트너가 모델을 신중히 설정할 여지를 두고, 가능한 한 단일 비전을 사용자에게 강요하지 않겠다고 밝혔다. 유용성·능력·안전·신뢰·가치에 대한 피드백을 받겠다는 초대가 초안 공개와 함께 나왔다.

초안 작성에는 MAI와 마이크로소프트 전반의 책임 AI, 법무, 레드팀, 안전, Futures, AI 훈련, 영업 조직이 참여했다. 학계 컨퍼런스·자문, 현장 사용 기업 파트너, 일반 시민 패널 의견도 반영했다고 전했다. 한 회사만으로 인류를 섬기는 AI의 기준을 정할 수 없다는 문제의식에서, 이번 6주 공개 의견수렴으로 범위를 넓힌다는 취지다.

의견수렴이 끝나면 핵심 초안팀이 피드백을 검토하고, 무엇을 배웠고 무엇을 바꿨는지 요약을 공개한다. 모든 의견을 반영하겠다고 약속하지는 않지만, 듣고 깊이 검토하겠다고 밝혔다. 개정판은 올해 말 이후 나오며, 2027년 이후 훈련 방향을 안내하는 기준으로 쓰일 예정이다.

공개 배경에는 AI 능력 상승 속도와, 대규모·조직적·지속적 AI 에이전트 침해 캠페인 같은 최근 안전 사고가 겹친다. TechCrunch는 프론티어 페이싱과 제3자 평가자 논의가 이어지는 가운데, 사티아 나델라 CEO가 정렬을 설계 목표로 삼는 연구·신중한 페이싱과 임베디드 평가자 아이디어를 환영한다고 밝힌 점도 함께 전했다.

이번 초안은 MAI 모델이 사람에게 종속되고, 절대 제약을 지키며, 인간 감독·종료를 회피하지 않도록 훈련·배포하겠다는 약속의 공개본이다. 6주 의견수렴 뒤 개정판이 나오면, 그 내용이 이후 모델 훈련 기준에 반영되는지 여부가 다음 관전 포인트다.

https://microsoft.ai/news/mai-code-of-conduct/

댓글

이 블로그의 인기 게시물

테슬라, 오스틴에서 핸들 없는 사이버캡 로보택시 투입

구글, 제미나이 앱에 음악 생성 모델 Lyria 3.5 공개

앤트로픽, 페르마의 마지막 정리 형식화 완성