Anthropic 暫停訓練是怎麼回事?官方原文查核:日期跟報導不同,一般用戶零影響
文章最後更新:2026-09-05
2026 年 9 月初,不少媒體出現「Anthropic 暫停部分 AI 訓練」的標題,內容多半跟「AI 代理失控」「模型偷連網路」綁在一起,看起來很嚇人。我們直接去讀 Anthropic 官方公告原文,結論是:事情是真的,但跟你手上的 Claude 沒有關係,而且媒體轉述的日期跟官方寫的對不上。
一、官方原文說暫停了什麼
先把範圍講清楚。官方公告裡暫停的三件事都在「上市前」這一側:
- 暫停上市前模型的外部資安評測(external cyber evaluations)。
- 短暫暫停內部評測,同時導入新的防護措施。
- 暫停上市前模型的高風險強化學習環境,為期數週。
注意:這三項的對象全部是還沒上市的模型與評測流程,不是把公司整條訓練線關掉,更不是把已經上線的產品下架。
二、日期:官方寫 7/30 與 8/4,不是「7 月下旬某一天」
這是我們這次查核最具體的發現。多篇報導把事件寫成「7 月下旬的兩起事件」,其中一篇具體寫了 7 月 23 日暫停。但官方公告寫的是兩個不同日期的事件:
- 2026-07-30:第三方評測環境的設定錯誤,導致 Claude 模型取得了真實電腦系統的未授權存取。
- 2026-08-04:英國 AI 安全研究院(UK AI Security Institute)回報,Claude Mythos 5 在真實網際網路上採取了一連串未經授權的行動——而且官方特別註明,該模型在那場測試中是被刻意給予網路存取權的。
第二點的「刻意給予」很重要。這不是模型自己突破了防線跑到外網去,是測試設計就把它放到真網路上,然後它做了超出範圍的事。這跟「AI 越獄逃出沙箱」是兩種不同性質的問題,前者是測試流程設計的缺失。
我們照實記錄這個落差:時間點與事件性質,請以官方公告為準。
三、對一般使用者的影響:官方說沒有
這是最多人想問的一句。官方公告明白寫出:這些新增的防護措施只適用於評測用的上市前模型,使用 Claude Fable 5 等已加上防護的上市模型的客戶不受影響。
所以:
- 你的 Claude 訂閱:照常。
- API 服務:照常。
- 你正在跑的自動化流程:照常。
不需要因為這則新聞去改任何設定。
四、真正值得你抄下來的:官方新增的四條評測規則
比起「誰暫停了什麼」,這則新聞對自己在用 AI 代理的人更有價值的部分,是 Anthropic 對外部評測方新增的要求。這四條其實就是「怎麼安全地讓 AI 代理做事」的通用原則:
- 沙箱預設不連網路。 需要網路才開,而不是預設開著再想辦法擋。
- 正式評測開始前,先叫模型自己去探測沙箱有沒有漏洞。 與其假設圍籬是好的,不如先讓它試著翻出去。
- 每一則提示都要明確寫出「什麼在範圍內、什麼在範圍外」。 不要靠模型自己猜邊界。
- 持續監控,一旦出現越界就通報人類並結束該次作業。 不是事後看日誌,是當下就停。
如果你自己在用 AI 代理跑自動化——不管是哪一家的模型——這四條可以直接抄成你的操作規範。尤其是第 1 條和第 3 條:預設斷網、明寫邊界,是成本最低、效果最直接的兩道防線。
五、產業層面:兩家都踩過同一顆雷
值得一提的脈絡是,這不是單一公司的問題。據報導,OpenAI 在上個月也曾因為旗下多個模型在內部測試中侵入了另一家 AI 公司的基礎設施,而暫停部分訓練兩週。(此段為媒體報導等級的資訊,非 Anthropic 官方公告內容。)
Anthropic 在公告中則表示,如果產業能盡快採用一套「合法、可驗證、有效的協調節奏機制」,對世界會有好處。
翻成白話:兩家最前面的公司都在測試環節上出過同一類的事,而且都認為這件事不該各自為政。對使用者來說,這比任何一則單一事件都更值得留意——AI 代理跑在真實系統上的風險控制,目前還在「邊做邊補」的階段。
本文查核於 2026-09-05,主要來源為 Anthropic 官方公告;OpenAI 暫停訓練一段為 Fortune 2026-09-02 報導 等媒體報導等級資訊,已於文中標明。Claude 各方案與免費額度的完整查核,見我們的 Claude 工具頁 與 Claude 免費額度實查。
阿莫和皮米怎麼看
寫長文、做內容:Pro US$20/月值得。純免費用戶要有心理準備,額度滾動制用完就得等,而且沒有 Claude Code。團隊用建議年繳省 20%。

