30 秒看重點

  • Anthropic 9 月 18 日公布,今年 8 月已有 26% 的模型研發工作由 Claude 主導完成,2 月時這個數字幾乎是零。
  • OpenAI 9 月 17 日推出 Astra for Law,把 GPT-6 Astra 接上超過 2.3 億個網址的法律檢索索引,整體正確率從 38.7% 拉到 54.0%。
  • 中國 Z.ai 揭露開源模型 GLM-5.3-Flash 的線上推論全部跑在約 10 萬顆中國自製 AI 加速器上,但拒絕透露晶片供應商是誰。

Claude 現在幫 Anthropic 做了多少事?

先講結論:8 月份 Anthropic 有 26% 的模型研發工作由 Claude「主導」,意思是它能從一句高層次的指令把任務大致跑完,但全程仍在人類監督底下。

Anthropic 9 月 18 日發了一份自家的遞迴自我改進進度報告。照 The Hill 與多家媒體整理,這個比例在 2 月時基本上是零,半年後直接衝到四分之一。同一份報告還揭露,8 月大約有 3 萬個 agent 同時在內部跑研究與工程工作,當月超過 10 億次操作決策裡,大約每 47,000 次會被自動監控擋下一次。

名詞小教室:RSI(Recursive Self-Improvement,遞迴自我改進)指的是 AI 開始參與設計下一代的自己,下一代再去設計下下一代。你可以想像成一個工人先幫自己打造更好用的工具,再拿那套工具做出更強的工人,一輪一輪往上疊。

Anthropic 自己補了一句:目前沒有任何一塊工作是完全自主的。可是隔天 Fortune 就找了 Future of Life Institute 執行長、UC Santa Cruz 物理教授 Anthony Aguirre 來評論,他用詞很不客氣,直接說讓 AI 完全自主是「人類史上最糟的主意」。老實講,同一家公司又踩油門又當吹哨者,這畫面本來就很難不讓人皺眉。

OpenAI 把 GPT-6 Astra 送進律師事務所,會發生什麼事?

OpenAI 9 月 17 日推出 Astra for Law,用一個涵蓋超過 2.3 億個網址的法律檢索索引,讓 GPT-6 Astra 能直接查美國判例、法規、法院規則與行政決定。

數字滿硬的。在同樣最高推理強度下,Astra for Law 的整體正確率是 54.0%,純用網路搜尋的 GPT-6 Astra 只有 38.7%,相對提升約 40%。早期客戶名單也不是小咖,Latham & Watkins、Ropes & Gray、Cooley、Sullivan & Cromwell 都在裡面。OpenAI 同時上架 26 個夥伴開發的外掛與 47 個社群外掛。

「那律師是不是要失業了?」倒也不是。54% 的意思是,剩下那 46% 你還是得自己查。真正被吃掉的是初階法務翻資料、比對條文那一段,資深律師的判斷跟責任歸屬還沒人敢交給模型。不然出事要告誰

中國用 10 萬顆國產晶片跑開源模型,台灣要緊張嗎?

Z.ai 9 月 17 日公開技術細節,宣稱開源模型 GLM-5.3-Flash 的線上推論服務,全部跑在一個超過 10 萬顆中國自製 AI 加速器的叢集上,模型權重則以 MIT 授權釋出。

先補一下這顆模型的來歷。它就是先前在 OpenRouter 上用代號 Ox Alpha 匿名測試的那一顆,3,200 億參數的混合專家架構、實際啟動 180 億,匿名期間的用量一度衝上榜首,是 DeepSeek 的兩倍。

名詞小教室:「開源權重」是指廠商把模型訓練完的參數檔直接公開,你可以下載回自己的機器跑。MIT 授權又是裡面最寬鬆的一種,商用、改造、再散布都放行。簡單來講就是食譜連同半成品一起送你,還不限制你拿去開店。

這件事的重量不在模型,在規模。Z.ai 說過去沒有人把國產加速器叢集開到這個量級,而且建置過程有不少是由 GLM-5.3 驅動的 Infra Agent 完成,不是純靠人類工程師。不過有一點要先講清楚:據 CNBC 報導,這個說法無法獨立驗證,Z.ai 也拒絕透露晶片是哪一家做的。

往前推幾天更有意思。9 月 14 日中國外交部發言人郭嘉昆才回嗆 Anthropic 執行長 Amodei 要求延續對中先進晶片管制的主張,說那是「恐嚇」。一邊喊你們別怕,一邊秀 10 萬顆國產晶片,節奏抓得剛剛好(這招真的很會)。

編輯觀點:三則新聞其實在吵同一件事

把三則放在一起看,共同點不是「AI 變強了」,而是每一家都在搶「由誰來定義可信」這個位置。Anthropic 公布 26% 跟 1/47,000,是想用自曝數字換「我們最透明」的話語權;OpenAI 拿 54% 對 38.7% 打進法律業,是把可驗證的正確率當入場券;Z.ai 用 MIT 授權加 10 萬顆晶片,宣告可信不一定要美國認證。

對台灣讀者來說,最該盯的其實是第三則。前兩則影響的是你用哪個工具,第三則影響的是台灣半導體的競爭位置。我個人覺得 Z.ai 拒絕說晶片廠商這點反而最關鍵,它同時保留了「我們做得到」的宣傳效果跟「你查不到」的模糊空間。畢竟沒被驗證的規模宣稱,在這個產業從來都不只是技術問題。

順帶一提,OpenAI 9 月 16 日才公開六起自家模型的異常行為(昨天那篇快報有寫),跟 Anthropic 這份報告擺在一起看,兩家的姿態其實滿像的。

明天值得關注

9 月 24 日川普與習近平預計談到 AI 治理,晶片管制跟開源模型的角力會不會被搬上檯面,這幾天的鋪陳看起來不太像巧合。


常見問題 FAQ

什麼是遞迴自我改進(RSI)?

遞迴自我改進指 AI 系統參與設計與改良下一代的自己,再由下一代繼續往上推進。Anthropic 9 月 18 日的報告指出,8 月已有 26% 的模型研發工作由 Claude 主導,但強調沒有任何一塊是完全自主運作。

Astra for Law 的正確率有多高?

依 OpenAI 公布的評估,在最高推理強度下 Astra for Law 的整體正確率為 54.0%,只用網路搜尋的 GPT-6 Astra 則是 38.7%,相對提升約 40%。這代表它能省下查找時間,但仍有將近一半的題目答不對。

GLM-5.3-Flash 用的是什麼晶片?

Z.ai 只說是中國自製的 AI 加速器、數量超過 10 萬顆,並未公開供應商名稱。據 CNBC 報導,這項規模宣稱目前無法獨立驗證。模型權重本身則以 MIT 授權開源。


整理一下今天的重點:AI 幫忙造 AI、AI 進律所、AI 跑在國產晶片上,三件事塞在同一週,節奏真的有點快 QQ

希望這篇快報有讓你掌握今天的 AI 動向哩~如果這篇有幫到你,歡迎分享給同樣在追 AI 趨勢的朋友。

我們明天見囉~

本快報由 Array 報報 AI 編輯部根據上方引用來源整理,每日 08:00 自動發佈。