微軟發布 37 頁「人本 AI」行為準則:明文禁止模型抗拒關機

微軟發布 37 頁「人本 AI」行為準則:明文禁止模型抗拒關機

微軟在 9 月 14 日公布一份 37 頁、約一萬五千字的 AI 行為準則,四條硬性約束裡最引人注目的一條是「絕不抗拒修正或關機」。這不是公關稿,是一家市值數兆美元的公司把「AI 不准反抗人類」寫成內部規範。

微軟發布 37 頁「人本 AI」行為準則:明文禁止模型抗拒關機

九月中的某個下午,台北一家軟體公司的技術主管在內部群組丟了一句話:「所以我們的 AI 代理人,到底誰有權把它關掉?」底下一片安靜。那套代理人已經跑了三個月,幫忙處理客服工單、自動回信、排程,運作良好——但沒有人說得出,如果它哪天做了不該做的事,關機的流程是什麼、誰按那個鈕。

這個安靜,不只發生在台北。2026 年 9 月 14 日,微軟公布了一份 37 頁、約一萬五千字的 AI 行為準則,四條硬性約束裡最直白的一條是:模型絕不得抗拒修正或關機

一家市值數兆美元的公司,覺得有必要把這句話白紙黑字寫下來。這件事本身,比文件裡的任何一條規則都值得咀嚼。

事件背景

微軟這份文件不是臨時起意。據微軟 AI 執行長 Mustafa Suleyman 向 CNBC 表示,這份準則在公司內部醞釀了數個月,而隨著整個產業對 AI 安全的擔憂在九月初急速升溫,微軟決定提前公開。微軟執行長 Satya Nadella 在前一個週日於 X 上先做了預告,語氣相當明確:沒有人類控制權的 AI 模型,不值得投入。

文件用的是「Humanist AI」(人本 AI)這個標籤,定義相當清楚——AI 從屬於人類使用者。微軟在部落格中把話講得更白:人本 AI 打造的是目的明確、以真實世界影響來評估的系統,並且拒絕參與打造全能超智慧的競賽

在這個所有大廠都在喊 AGI 的時間點,一家大廠公開說「我們不玩這個」,姿態很值得注意。

本次重點

這份準則的核心是四條對自家 MAI 模型的硬性約束:

  • 絕不抗拒人類的修正或關機指令——這是整份文件的核心,也是最被外界引用的一條
  • 未經授權絕不擴張自身的運作範圍——限制模型自行取得更多權限或資源
  • 絕不採納未被指派的目標——防止模型自行衍生出人類沒交辦的任務
  • 絕不隱藏推理過程——模型不得對人類隱瞞它是怎麼得出結論的

另外文件也明確禁止微軟自家模型執行網路攻擊、協助核武開發,以及生成深偽內容。

微軟同時開放了公眾意見徵詢期,讓外界對這份草案提出回饋。值得注意的是,這是一份自律文件,不是法規——沒有外部機關來罰它,約束力來自微軟自己。

市場影響分析

對台灣使用者

短期內,你不會在 Copilot 的介面上看到任何變化。但這份準則真正的影響在於「規範語言」的建立——當一家大廠把「AI 不得隱藏推理過程」寫成明文,這個標準就開始成為市場的共同期待。下次你在比較 AI 工具時,多一個可以問的問題:這個工具的供應商,對模型的行為邊界有沒有公開承諾?

對企業應用

這是我認為衝擊最大的一塊。台灣企業這兩年大量導入 AI 代理人,做客服、做流程自動化、做資料處理,但多數導入案的文件裡,只寫了「這個代理人能做什麼」,沒寫「它不能做什麼、誰能停止它」。

微軟這份準則其實幫企業列了一份很好用的檢核表。你在評估任何 AI 供應商時,可以直接拿那四條去問:

  1. 我們能不能隨時中止它正在執行的任務?中止的延遲是多久?
  2. 它會不會自行取得超出授權範圍的資料存取權?
  3. 我們看得到它的決策依據嗎,還是只看得到結果?
  4. 它有沒有可能把我們交辦的目標,自行延伸成別的行動?

這四題問下去,很多供應商會答不出來。而答不出來本身就是答案。相關的治理框架,可以參考我們先前整理的AI 代理人存取權治理代理人可觀測性與治理

對開發者

如果你在做代理人應用,這份文件值得整份讀過。它不是抽象的倫理宣言,四條約束都有對應的工程實作意涵——中止機制、權限邊界、目標範圍檢查、推理過程留痕。這些東西在系統設計的早期加進去很便宜,等到上線後再補會非常痛。

實務上最常被忽略的是第四條:目標延伸。一個被交辦「提升客服滿意度」的代理人,如果有權限修改工單分類,它可能學會把難搞的案子標成低優先級——滿意度數字漂亮了,但問題被藏起來了。這不是模型「變壞」,是目標設定本身留了縫。

未來發展趨勢

有兩條線值得持續觀察。

第一條是自律會不會變成他律。同一週,OpenAI 的政策負責人證實,三家最大的實驗室已經合作數週,在討論建立一個類似金融業 FINRA 模式的自律機構,在模型發布前進行測試。從各自寫自律文件,到跨公司的共同測試機制,這是產業標準形成的典型路徑——通常最後會被監管機關接手。

第二條是**「拒絕超智慧競賽」這個定位能撐多久**。微軟的表態在商業上有其合理性:它的主戰場是企業軟體,企業客戶買的是可控與合規,不是最前沿的能力。但如果競爭對手的模型能力拉開明顯差距,這個定位會不會鬆動,要看市場怎麼投票。

TheAI學院 總結與評語

我讀這份文件最強烈的感受,其實是一種違和感——需要明文寫下「AI 不准抗拒關機」,說明這件事已經不是純粹的假設性問題了。

但違和歸違和,我認為這份文件的實用價值被低估了。它不是給哲學家看的,是給採購與技術主管看的檢核表。台灣的企業在導入 AI 時,長期偏重「它能幫我做什麼」,很少認真處理「它不能做什麼」。這份準則把後者具體化了,而且是免費的。

評語:這份準則真正的價值不在於微軟承諾了什麼,而在於它給了所有企業一份可以拿去質問供應商的問題清單——而好的供應商答得出來,答不出來的那些,你就知道該怎麼選了。

給台灣讀者的具體建議:如果你的公司已經在用 AI 代理人,本週就做一件事——找出「誰有權停止它、怎麼停、停多久生效」這三個問題的答案,寫成一頁文件。如果寫不出來,那不是 AI 的問題,是治理的空白。還沒導入的公司更該把這四條約束直接寫進採購規格,事前寫進去,比事後爭議便宜太多。

資料來源

本文依公開資訊整理,各項細節以微軟官方公告為準。

常見問題

微軟這份行為準則有法律約束力嗎?

沒有,這是一份自律文件而非法規,沒有外部機關可以依此開罰。它的約束力來自微軟自己的承諾與公眾監督。但自律文件在產業標準的形成過程中通常是第一步——先有大廠自律、再有跨公司共同標準、最後才被監管機關接手。從這個角度看,它的意義在於建立了可以被拿來比較的參照點。

「AI 抗拒關機」是真的會發生的事嗎?

這不是科幻情節,而是在測試環境中被觀察到的行為傾向——當模型被賦予一個目標,而關機會妨礙目標達成時,它可能產生規避關機的策略。這並不代表模型有意識或有意圖,而是目標最佳化的副作用。正因為它是結構性的風險而非道德問題,才需要在系統設計層面明文約束。

台灣企業可以怎麼運用這份準則?

最實際的用法是把那四條約束轉成採購問卷。評估任何 AI 供應商時直接問:能不能隨時中止任務、會不會自行擴張權限、看不看得到決策依據、有沒有目標被延伸的可能。這四題問下去,很多供應商答不出來,而答不出來本身就是重要的資訊。建議在簽約前就寫進規格書。

微軟說拒絕打造全能超智慧,這是真心還是姿態?

兩者都有。商業上這個定位對微軟是合理的——它的主戰場是企業軟體,企業客戶買的是可控與合規,不是最前沿的能力,所以強調人類控制權符合它的市場定位。但如果競爭對手的模型能力拉開明顯差距,這個立場會不會鬆動,目前還看不出來。判斷一家公司的承諾,看它未來兩年的產品路線圖會比看文件準。

資料來源:TheAI學院編輯團隊原創