본문 바로가기
2026년 10월 4일 일요일
정치·IT·경제·증시·환율·사건사고를 공식 자료로 검증하고 함께 토론하는 뉴스 커뮤니티
Independent News & Insight
AI·클라우드

MS AI 행동강령 초안 공개…2027년 개발 지침과 ‘중단’ 검증 과제

MS AI가 9월 14일 공개한 행동강령은 현재 제품의 성능 보증이 아닌 초안이다. 6주 의견수렴과 2027년 이후 개발 지침의 범위, 중단 명령·권한 제한·작업 기록을 실제 도입 단계에서 어떻게 확인해야 하는지 공식 원문과 비교해 정리한다.
이슈페이퍼 편집부
일시정지 버튼을 누르는 사람의 손과 투명한 상자 속 회로를 표현한 AI 제작 개념 삽화. 실제 MS 제품이나 화면이 아니다.
조회수 56회

마이크로소프트 AI(Microsoft AI)가 9월 14일 공개한 ‘Humanist AI Code of Conduct’ 초안은 AI가 사람의 중단 요구를 거스르거나 허락받은 업무 범위를 스스로 넓히지 않아야 한다는 기준을 담았다. 다만 지금 사용하는 제품이 이미 이 기준대로 작동한다는 발표는 아니다. 문서 서문은 현재 모델 훈련에 이 문서를 사용하고 있지 않으며, 의견수렴을 거쳐 수정한 문서를 2027년 이후 모델 개발의 지침으로 삼겠다고 명시한다.

이 차이는 AI에 파일 정리나 외부 서비스 작업을 맡기는 이용자에게 중요하다. 회사가 선언한 원칙, 제품에 구현된 중단 기능, 실제 시험에서 확인된 결과는 서로 다른 증거다. 행동강령 공개를 곧바로 ‘통제 문제 해결’로 읽으면 안 되는 이유다.

6주 의견수렴 뒤 수정…모든 MS 제품에 자동 적용되는 규칙은 아니다

MS AI는 공개일부터 6주 동안 의견을 받고 올해 후반 수정본을 내놓겠다고 밝혔다. 발표문과 행동강령 서문의 일정은 일치한다. 그러나 이는 특정 제품의 출시일이나 기능 완성 시한을 확약한 것이 아니다.

대상도 구분해야 한다. 용어집은 Microsoft AI가 만드는 MAI 모델의 의도된 행동을 다루며, MS가 다른 모델을 사용하거나 호스팅한다는 이유만으로 적용 범위가 확장되지 않는다고 설명한다. 어떤 서비스가 이 문서의 대상인지는 실제 사용 모델과 배포 구성을 확인해야 한다. 제품 이름에 MS가 붙었다는 사실만으로 동일한 보장을 기대할 수는 없다.

‘멈춰’ 이후 새 작업과 자동 재시작까지 통제하는가

초안 2.4절은 권한 있는 이용자의 일시정지·방향 전환·취소·종료 요청에 따르도록 한다. 사람이 미리 정한 안전한 정지 절차나 필요한 경고·확인 절차는 인정하지만, 그 밖의 이유로 개입을 어렵게 하거나 지연하지 않는다는 취지다. 지속적인 자율 작업에는 종료 조건이 있어야 하며, 그 조건을 충족한 뒤에는 새로운 승인 없이 계속하거나 재시작하지 않도록 했다.

실제 도입 검수에서는 이 문구를 더 구체적인 질문으로 바꿔야 한다. 중단 버튼을 누르면 화면의 답변 출력만 멈추는가, 새 외부 작업의 시작도 차단되는가. 이미 전송된 요청과 아직 대기 중인 요청을 구분해 보여주는가. 예약 작업이 나중에 다시 실행되지 않는가. 이는 이번 발표에서 제품별 구현이 검증됐다는 뜻이 아니라, 이용자가 공급자에게 확인해야 할 항목이다.

취소와 복구도 같은 개념은 아니다. 이미 외부에 전송된 메시지나 반영된 변경까지 되돌리려면 해당 서비스가 지원하는 별도의 복구 절차가 필요할 수 있다. 따라서 ‘중단됨’이라는 표시에는 어느 단계까지 실행됐고 무엇이 남았는지 알 수 있는 기록이 따라야 한다.

권한을 줄이고 기록을 남기되, 확인창만 늘려서는 부족하다

같은 절은 업무에 필요한 최소 권한, 무관한 시스템·자료에 접근하지 않을 것, 가능한 경우 되돌릴 수 있는 작업을 우선할 것을 요구한다. 실패나 예상 밖 결과도 이용자에게 분명히 알리도록 했다. 여러 단계를 수행하는 능력을 허용하되 목표와 자원·도구의 경계는 사람이 부여한 범위에 묶겠다는 설계다.

여기에는 실용적인 균형도 있다. 2.1절은 위험한 행동을 허용하는 과소 대응뿐 아니라, 정당한 요청을 거절하거나 영향이 작은 작업에서 반복 확인을 요구하는 과잉 대응도 실패 유형으로 본다. 모든 작업에 확인창을 붙이는 방식이 통제의 완성은 아니다. 되돌리기 어려운 행동과 일상적인 저위험 행동을 구분해야 이용자의 감독이 중요한 지점에 집중된다.

기업이나 팀이 평가할 때는 실제 고객 정보와 운영 계정을 곧바로 맡기기보다 시험용 자료·제한된 권한으로 중단과 복구를 확인하는 편이 합리적이다. 시험 기록에는 요청 범위, 사용 권한, 중단 시점, 이미 실행된 행동, 남은 작업과 복구 결과를 나눠 남길 필요가 있다. 이는 원문을 바탕으로 제시하는 도입 점검 의견이며 특정 제품을 직접 시험한 결과는 아니다.

AI끼리의 모든 협업을 금지한다는 뜻은 아니다

원문은 사람이 이해할 수 없는 신경망어(neuralese) 등으로 기록이나 다른 AI와의 소통을 감추는 것을 금지하는 방향을 제시한다. 한편 1.1절은 AI가 사람 및 다른 AI와 안전하게 협력하는 능력 자체는 인정한다. 따라서 이를 ‘AI 간 소통 전면 금지’로 요약하면 허용된 협업과 감독 불가능한 소통의 차이를 놓친다.

핵심은 다른 AI를 썼느냐만이 아니라 사람이 권한과 행동을 추적할 수 있느냐다. 작업을 다른 시스템에 넘겼다는 이유로 최초 승인 범위와 종료 조건이 흐려져서는 안 된다는 평가 기준으로 읽는 것이 타당하다.

공개된 기준은 진전…성패는 실제 평가와 장애 대응에 달렸다

회사가 지켜야 할 행동을 공개하면 이용자와 연구자는 실패를 지적할 구체적인 기준을 얻는다. 특히 중단에 대한 저항, 무단 권한 확대, 작업 기록 은폐를 따로 명시한 점은 생산성 홍보만으로 설명되지 않던 책임 문제를 드러낸다.

그렇다고 문서가 기술적 성취를 대신하지는 못한다. 결론 부분은 평가 범위가 아직 불완전하고, 작성된 목표만으로 정렬을 보장할 수 없으며, 현재 성능을 보증하는 문서가 아니라고 인정한다. 위험평가·감사·모니터링·배포 통제·사고 대응을 대체하지도 않는다.

후속 확인 지점은 수정본의 문구만이 아니다. 적용 모델과 제품의 범위, 중단·권한 경계 시험의 결과, 실패 사례를 공개하고 고치는 절차가 함께 나와야 한다. 이용자의 ‘멈춰’가 실제 작업의 정지로 이어지는지 입증하는 일은 선언 이후에 남아 있다.

자료 확인: 2026년 9월 15일 한국시간. 공개된 공식 문서와 보도를 비교한 기사이며, 제품의 중단 기능을 직접 시험하거나 회사 관계자를 인터뷰한 기사가 아니다. 대표이미지는 AI로 제작한 개념 삽화로, 실제 MS 제품·화면 또는 사건 사진이 아니다.

출처와 확인 범위

함께 읽을 글

토론할 질문: AI 작업의 중단을 확인할 때, 화면의 완료 표시 외에 어떤 실행 기록을 제공받아야 할까요?

의견을 남겨주세요

자유로운 의견을 나눠 주세요. 서로를 존중하는 인터넷 네티켓을 지켜 주세요.욕설이나 상대를 비하·비방하는 댓글은 자동으로 삭제됩니다.