30 秒看重點
- GPT-5.6 Sol 在 TerminalBench 2.1 程式撰寫評測拿下 88.8%,Sol Ultra 模式達到 91.9%,但跟上一代 GPT-5.5 的 88.0% 只差 0.8 個百分點,前線模型的效能差距正在快速收斂。
- Qualcomm 正式宣布以近 40 億美元收購 AI 軟體新創 Modular,取得跨硬體 AI 部署平台,搭配先前洽談的 Tenstorrent 收購案,顯示 Qualcomm 正在拼一整套「晶片 + 軟體」的 AI 生態系。
- 本週 AI 產業同時在模型管控、晶片軍備、人才搶奪三條戰線上全面開打,密度之高堪稱 2026 年最瘋狂的一週。
GPT-5.6 Sol 的跑分到底有多強?
GPT-5.6 Sol 在 TerminalBench 2.1 程式撰寫評測中拿下 88.8% 的成績,而啟用多代理的 Sol Ultra 模式更達到 91.9%,是目前公開跑分最高的模型。
不過老實講,這個數字單看很唬人,放在脈絡裡看就沒那麼驚天動地了(0.8% 的進步,認真的嗎?)。前天報導 GPT-5.6 推出三款模型 Sol、Terra、Luna,當時大家關注的是美國政府管控和分層定價。現在跑分出來,Sol 的 88.8% 跟上一代 GPT-5.5 的 88.0% 只差了 0.8 個百分點。據 Lushbinary 的深度分析,前線模型之間的差距正在快速收斂,真正拉開差距的反而是 Sol Ultra 的 91.9%,但那個模式會自動拆出子代理來跑,成本也高上不少。
「那一般使用者什麼時候能用到?」據多家媒體報導,Sam Altman 在內部表示希望限量預覽結束後「幾週內」廣泛開放,業界普遍預估 7 月中旬 ChatGPT Plus 和 Pro 訂閱者就能用上 GPT-5.6,API 的全面開放可能落在 7 月下旬。
簡單來講,GPT-5.6 Sol 確實是目前跑分最高的模型,但它跟 GPT-5.5 之間的進步幅度已經不像前幾代那樣讓人嚇一跳了。AI 模型的進化正在從「飛躍式突破」轉向「漸進式打磨」。畢竟對開發者來說,這其實是好事,代表你的技術棧不用每隔幾個月就像 RPG 技能樹砍掉重練。
名詞小教室:TerminalBench 是一套專門測試 AI 模型寫程式和操作命令列能力的標準化評測,你可以把它想成程式設計師的模擬考,題目涵蓋實際開發場景的除錯、重構、部署等任務。分數越高代表 AI 在真實程式撰寫工作中越可靠。
Qualcomm 為什麼要花 40 億美元買一家軟體公司?
Qualcomm 在 6 月 24 日正式宣布以近 40 億美元收購 AI 新創 Modular,目標是取得一個能讓 AI 模型跨不同硬體架構運行的統一軟體平台,預計 2026 年下半年完成交割。
這筆交易乍看可能會讓人覺得「一家做手機晶片的公司,買軟體做什麼?」但其實邏輯很清楚。據 CNBC 報導,Modular 開發的平台最大的賣點就是讓開發者不用為了換一顆晶片就重寫整套 AI 程式碼。兩週前我們報導過 Qualcomm 正在洽談以 80 到 100 億美元收購 Jim Keller 的 AI 晶片新創 Tenstorrent,如果兩筆交易都成了,Qualcomm 就同時擁有自己的 AI 晶片設計能力和跨平台軟體工具鏈,等於把「硬體 + 軟體」一次打包。
這招其實跟 NVIDIA 的 CUDA 生態系策略如出一轍。NVIDIA 之所以在 AI 晶片市場稱霸這麼久,不只是因為 GPU 效能好,更是因為 CUDA 讓開發者離不開。Qualcomm 買 Modular,就是在蓋自己版本的「黏著度護城河」順便讓 NVIDIA 多流點冷汗。
對台灣的 AI 開發者來說,Modular 平台如果真的做到讓模型一鍵切換不同晶片,未來選擇 AI 推論硬體時就不用被單一廠商綁死,選擇權會多很多。
這一週 AI 圈到底發生了什麼事?
回顧 6 月 23 到 28 日這整週,AI 產業至少在三條戰線上同時爆發,密度之高連追新聞追得很勤的人都有點跟不上 XD。
第一條:模型管控戰。 GPT-5.6 在 6 月 26 日推出,但美國政府首度以行政命令要求 OpenAI 限制發布,只開放約 20 家核准企業試用。同一時間,Anthropic 的 Mythos 5 在被禁 15 天後獲准有限度重新上線,也只給防禦關鍵基礎設施的美國機構使用。兩大 AI 實驗室的最強模型,同一週都被政府掐著脖子才能發布。說白了,AI 模型的發布流程正在從「做好就上線」變成「做好先給政府看」。
第二條:晶片軍備戰。 OpenAI 跟 Broadcom 推出自研推論晶片 Jalapeño,Qualcomm 砸 40 億買 Modular 補軟體生態,再加上之前洽談的 Tenstorrent。AI 晶片不再是 NVIDIA 一家的戰場了。
第三條:人才搶奪戰。 Google 一週內連失 Noam Shazeer、John Jumper 等至少四名重量級研究員,分別被 OpenAI 和 Anthropic 挖走,Google 股價因此跌了超過 5%。
編輯觀點:當 AI 模型分數差不多,戰場就不在模型了
把這一週的事攤開來看,最有意思的訊號其實藏在 GPT-5.6 的跑分裡。Sol 跟上一代只差 0.8%,前線模型之間的差距也在持續縮小。當模型效能趨於同質化,競爭重心就必然往其他地方轉移。
OpenAI 選了晶片,自己做 Jalapeño 來壓低推論成本。Anthropic 選了人才,一口氣從 Google 挖走四位頂級研究員。Qualcomm 選了生態系,用併購把硬體和軟體綁在一起。而美國政府呢,選了管控,用行政命令讓自己成為前線模型的發布守門人。
我覺得這一週對台灣的 AI 產業有一個很具體的啟示:如果你還在糾結「該用哪個模型」,可能已經問錯問題了。前線模型的差距越來越小,真正會拉開差距的是推論成本、部署彈性、還有你能不能在法規框架下穩定拿到模型的存取權限。尤其美國政府管控模式如果成為常態,台灣企業未來能不能第一時間用到最新模型,會變成一個比「模型分數高不高」更實際的問題。
明天值得關注
GPT-5.6 廣泛開放的時間點越來越近,Sam Altman 暗示 7 月中旬就有機會。另外 Fable 5 的解禁談判還在持續,如果本週末有進展,下週一可能會有新消息。
常見問題 FAQ
GPT-5.6 Sol 的跑分到底比前一代強多少?
GPT-5.6 Sol 在 TerminalBench 2.1 程式撰寫評測拿下 88.8%,比上一代 GPT-5.5 的 88.0% 高出 0.8 個百分點。啟用多代理的 Sol Ultra 模式則達到 91.9%,但成本也更高。整體來看,前線模型之間的效能差距正在快速收斂。
Qualcomm 收購 Modular 對一般開發者有什麼影響?
Modular 開發的 AI 平台讓開發者不用為不同晶片重寫程式碼,如果 Qualcomm 成功整合這項技術,未來開發者在選擇 AI 推論硬體時會有更多彈性,不用被單一廠商綁定。交易預計 2026 年下半年完成。
GPT-5.6 一般使用者什麼時候能用?
據多家媒體報導,OpenAI 預計在 7 月中旬開放 ChatGPT Plus 和 Pro 訂閱者使用 GPT-5.6,API 全面開放可能在 7 月下旬。目前 GPT-5.6 僅限約 20 家經美國政府核准的企業透過 API 和 Codex 試用。
整理一下今天的重點:GPT-5.6 跑分出來了,Sol 確實最強,但跟前一代差距真的滿小的,AI 模型的競爭重心正在從「誰分數高」轉向「誰成本低、誰生態系完整、誰拿得到政府許可」。
希望這篇快報有讓你掌握這一週 AI 圈的瘋狂動態哩~如果這篇有幫到你,歡迎分享給同樣在追 AI 趨勢的朋友。
我們明天見囉~
本快報由 Array 報報 AI 編輯部根據上方引用來源整理,每日 08:00 自動發佈。