30 秒看重點
- Transformer 論文共同作者 Noam Shazeer 離開 Google DeepMind 加入 OpenAI 擔任架構研究負責人,Google 當初花約 27 億美元從 Character.AI 挖他回來,不到 22 個月就走了。
- OpenAI 升級 GPT-5.5-Cyber 並推出「Patch the Planet」計畫,聯手 Trail of Bits 在超過 30 個開源專案中找到數百個資安漏洞並提交修補。
- Anthropic 將從 7 月 8 日起要求 Claude 免費版、Pro 版和 Max 版使用者進行身分驗證,需提供政府證件和即時自拍照。
- 中國智譜 AI 開源 GLM-5.2,百萬 token 上下文視窗搭配 MIT 授權,API 價格僅 GPT-5.5 的六分之一。
Transformer 之父為什麼離開 Google 跳槽 OpenAI?
Noam Shazeer 從 Google DeepMind 離職加入 OpenAI,擔任架構研究負責人,將主導 OpenAI 所有模型底層的神經網路架構設計。
這個人有多重要?他是 2017 年那篇「Attention Is All You Need」論文的共同作者,Transformer 架構就是從這篇論文誕生的。現在不管是 ChatGPT、Gemini 還是 Claude,底層用的都是這套架構。據 CNBC 報導,Google 在 2024 年 8 月花了約 27 億美元,透過跟 Character.AI 的合作案把 Shazeer 挖回來。結果不到 22 個月就走人了。
OpenAI 執行長 Sam Altman 公開說:「Noam 是我從 OpenAI 成立之初就最想共事的人之一,只花了 10 年。」聽起來像開玩笑,但背後是一場 AI 人才戰的巨大勝利。Shazeer 原本是 Google Gemini 模型的共同負責人,他的離開對 Gemini 團隊是不小的打擊。對正在準備 IPO 的 OpenAI 來說,拿下 Transformer 發明者不只是技術補強,更是向投資人釋出的訊號。
名詞小教室:Transformer 是一種 AI 模型的架構,你可以把它想成 AI 的「骨架」。就像不同品牌的車可能共用同一種引擎設計,現在幾乎所有主流 AI 聊天機器人都是用 Transformer 架構打造的。2017 年由 Google 的研究團隊發明,結果現在發明者跑去了競爭對手那邊。
OpenAI 的「修補全世界」計畫在做什麼?
OpenAI 在 6 月 22 日升級了 GPT-5.5-Cyber 模型,並推出名為「Patch the Planet」的計畫,聯手資安公司 Trail of Bits 和漏洞懸賞平台 HackerOne,用 AI 幫全球最常用的開源軟體找漏洞、寫修補程式。
我們之前報導過 OpenAI 的 Daybreak 資安平台,當時它剛上線。Patch the Planet 是 Daybreak 的延伸,規模更大了。據 OpenAI 官方公告,已有超過 30 個重量級開源專案加入,包括 cURL、Go 語言、Python、Sigstore 等。Trail of Bits 派了專職資安工程師,搭配 Codex 和 GPT-5.5-Cyber 在 19 個專案上全職工作,目前已找到數百個資安問題,合併了數十個修補。
效能方面,GPT-5.5-Cyber 在 CyberGym 評測上拿到 85.6%,比標準版 GPT-5.5 的 81.8% 高出近 4 個百分點。它掃描了超過 3,000 萬行程式碼,光是核心層面就產出了 8 個資訊洩漏和 24 個權限提升的攻擊驗證,證明漏洞真實可被利用。
對一般人來說,這代表你日常在用的各種軟體和網路服務,底層安全性正在被 AI 系統性地加固。開源軟體是整個網路的地基,以前找漏洞靠少數資安專家的眼力,現在 AI 可以大規模協助掃描和修補。
Anthropic 為什麼要求 Claude 使用者交出身分證?
Anthropic 宣布從 2026 年 7 月 8 日起,可能要求 Claude 免費版、Pro 版和 Max 版使用者提供政府核發的證件照片、即時自拍照和臉部特徵掃描,才能繼續使用服務。
這不是對所有人一刀切。據 TechTimes、CyberInsider 等多家媒體報導,驗證會在特定情況下觸發:要求存取進階功能時、帳號疑似從不支援的地區登入時、需要年齡驗證時,或出現可疑使用模式時。企業版(Team、Enterprise)和 API 使用者不受影響。身分驗證交由第三方公司 Persona Identities 處理,收集的資料包括證件影像、臉部幾何特徵和驗證結果,存在 Persona 的伺服器上而非 Anthropic 自己的。
之前 Fable 5 被美國政府以越獄疑慮為由下架的事件,顯然加速了 Anthropic 在使用者身分管理上的動作。講真的,要求用 AI 聊天工具的人刷身分證,這在一年前根本不可想像。但隨著模型能力越來越強,「誰在用」和「用來做什麼」已經變成 AI 公司無法迴避的問題。
中國 GLM-5.2 憑什麼用六分之一價格挑戰 GPT-5.5?
智譜 AI(Z.ai)在 6 月 13 日發布 GLM-5.2,這是一個擁有 7,440 億總參數、400 億啟用參數的混合專家架構(MoE)模型,上下文視窗擴充到 100 萬個 token,採用 MIT 授權完全開源。
我們在 4 月報導過 GLM-5.1 登頂 SWE-Bench Pro,當時它以 58.4 分超越 GPT-5.4。GLM-5.2 再進一步,在 Terminal-Bench 2.1 上從 62.0 躍升到 81.0,Intelligence Index v4.1 拿到 51 分,領先 MiniMax-M3 和 DeepSeek V4 Pro。價格方面,透過 OpenRouter 等平台,GLM-5.2 每百萬輸入 token 約 1.4 美元、輸出約 4.4 美元,而 GPT-5.5 是 5 美元和 30 美元,輸出成本差了將近 7 倍。
100 萬 token 的上下文視窗是什麼概念?簡單來說,你可以一次丟進一整個程式碼庫、一書架的研究論文,或 20 小時的影片逐字稿,不用擔心 AI 忘記前面的內容。而且這一切都在 MIT 授權下開放,任何人都能下載、修改、商用,沒有地區限制。對台灣企業來說,如果你的需求是程式碼輔助或大量文件分析,用不到 GPT-5.5 七分之一的價格就能拿到接近甚至超越的效能。
名詞小教室:MoE(Mixture of Experts,混合專家架構)就像一間醫院有很多專科醫生,你掛號後系統自動把你分配給對的科別。GLM-5.2 雖然有 7,440 億個參數,但每次回答時只啟用其中 400 億個「專家」來處理,所以跑起來不會像數字看起來那麼吃資源,成本也因此壓得很低。
編輯觀點:四條線畫出同一個方向
把今天這四則新聞放在一起看,會看到一個共同訊號:AI 產業正在從「技術競賽」進入「制度化」階段。
Shazeer 的跳槽表面上是人才搶奪,深層來看,當 AI 公司準備 IPO,「誰擁有關鍵技術人才」已經變成估值的核心題材。OpenAI 的 Patch the Planet 不只修 bug,而是在建立「AI 可以被信任來維護基礎設施安全」的產業敘事。Anthropic 要刷身分證,是因為模型能力已經強到政府會直接介入,不做身分管理就沒辦法繼續正常營運。智譜 AI 用 MIT 授權開源頂級模型,則是中國 AI 公司在美國出口管制壓力下的策略性回應。
我覺得對台灣最有感的是兩件事。第一,Anthropic 的身分驗證如果嚴格執行,台灣使用者可能碰到驗證門檻,畢竟台灣證件不一定在第一波支援名單裡,這點值得持續追蹤。第二,GLM-5.2 的開源對擔心資料外洩的台灣企業是好消息,現在多了一個效能不錯、可以完全自建部署的選項。
明天值得關注
Shazeer 加入後 OpenAI 是否會加速下一代模型架構的開發進度,以及 Anthropic 身分驗證正式上路前,社群對隱私權的反彈會不會讓政策做出調整。
常見問題 FAQ
Noam Shazeer 是誰?為什麼他的跳槽這麼重要?
Noam Shazeer 是 2017 年「Attention Is All You Need」論文的共同作者,這篇論文發明了 Transformer 架構,是目前所有主流 AI 模型(包括 ChatGPT、Gemini、Claude)的技術基礎。他從 Google DeepMind 跳槽到 OpenAI 擔任架構研究負責人,被視為 2026 年最重大的 AI 人才異動,Google 當初花了約 27 億美元才把他從 Character.AI 挖回來。
GLM-5.2 跟 GPT-5.5 比起來怎麼樣?
GLM-5.2 是中國智譜 AI 發布的開源模型,API 輸出成本約為 GPT-5.5 的七分之一,在多項程式碼相關基準測試中表現接近甚至超越 GPT-5.5。它採用 MIT 授權,任何人都能免費下載、修改和商用,並提供 100 萬 token 的上下文視窗,適合需要處理大量文件或程式碼的應用情境。
Anthropic 的 Claude 身分驗證會影響台灣使用者嗎?
Anthropic 從 2026 年 7 月 8 日起可能要求 Claude 免費版、Pro 版和 Max 版使用者進行身分驗證,需提供政府證件和即時自拍。目前尚未確認台灣身分證是否在第一波支援名單中,企業版和 API 使用者則不受影響。
覺得這篇快報有幫助嗎?歡迎分享給同樣關注 AI 趨勢的朋友,我們每天更新,讓你不錯過任何重要的 AI 動態。