30 秒看重點
- 據英國《金融時報》10 月 10 日報導,輝達(Nvidia)正在初步洽談加碼投資或直接收購開源 AI 新創 Reflection AI,可能採「挖人加技術授權」的形式,以避開冗長的監管審查。
- Anthropic 在 10 月 7 日推出 Claude Haiku 5.5,官方表示平均執行成本比 Haiku 4.5 少約 75%,10 萬 token 以內的請求每百萬輸入 token 只要 0.10 美元。
- 微軟推出 Microsoft-Decision-1,它不寫文章,只替固定選項打機率分數,底層是阿里巴巴的開源模型 Qwen3.5-9B。
輝達為什麼想買 Reflection AI?
先講結論:輝達想把一家主打「美國開源前沿模型」的新創更緊地綁在身邊,而且可能用不算正式收購的方式完成。
事情是這樣的,英國《金融時報》引述多位知情人士說,雙方還在早期階段,最快幾週內可能談出結果,但也可能破局。交易形式有好幾種,其中一種是輝達聘用團隊、授權技術,而不是整間買下,這樣可以避開漫長的反壟斷審查。Reflection 拒絕評論,輝達則沒有立即回應。
輝達其實早就是大股東。據報導,Reflection 在 2025 年 10 月募到 20 億美元,其中 8 億美元來自輝達。這家公司由兩位前 Google DeepMind 研究員在 2024 年創立,投資人把它比喻成「西方的 DeepSeek」,今年 6 月還跟 SpaceX 簽下約 63 億美元的算力租賃合約。
老實講,賣晶片的人去買模型公司,就像賣鏟子的老闆乾脆自己下去挖金礦。輝達要的大概不只是模型,而是確保最好的開源模型都跑在自家晶片上 順便讓客戶更離不開 CUDA。
Claude Haiku 5.5 到底便宜多少?
簡單來講,Claude Haiku 5.5 是 Anthropic 目前最便宜、也最快的模型,10 萬 token 以內的請求,價格只剩 Haiku 4.5 的一成。
根據 Anthropic 官方文件,10 萬 token 以內每百萬輸入 token 收 0.10 美元、輸出 0.50 美元,Haiku 4.5 則是 1 美元和 5 美元;超過 10 萬 token 降幅縮小到 50%,平均算下來大約省 75%。它支援 100 萬 token 的上下文視窗,也是 Haiku 系列第一次能調整「思考力道」(effort)。
可是魔鬼藏在細節裡。官方文件寫得很清楚,Haiku 5.5 換了新的分詞方式,同一段文字會比 Haiku 4.5 多算約 30% 的 token。帳單還是會大幅下降,只是沒有標價看起來那麼誇張。
名詞小教室:Token 是 AI 讀文字的計費單位,你可以想像成計程車跳表,每讀一小段字就跳一次。Haiku 5.5 等於每跳一次的錢變少,但同一段路會多跳幾下。想看完整解釋可以讀AI 的 Token 是什麼。
官方把它定位在分類、摘要、即時客服這類大量又重複的工作,也適合當 Opus 或 Sonnet 底下的小幫手。複雜的寫程式任務,Anthropic 自己也說 Sonnet 5.5 和 Opus 5.5 比較強。
Microsoft-Decision-1 是什麼?
Microsoft-Decision-1 是微軟推出的「決策評分模型」,你給它一個情境和幾個固定選項,它不寫字,只回報每個選項的機率。
據 MarkTechPost 等多家媒體報導,它是拿阿里巴巴的 Qwen3.5-9B 再訓練出來的,鎖定分流、分類、排優先順序、驗證這些工作,上下文上限約 3.2 萬 token,只吃文字。價格是每百萬輸入 token 0.042 美元,輸出不收費(這招真的有夠狠),可以在 Microsoft Foundry 和 OpenRouter 上使用。
名詞小教室:模型微調(Fine-tuning)就像請一個已經大學畢業的人,再專門訓練他做一件事。Decision-1 就是把會聊天的 Qwen 練成只會打分數的裁判。想看完整解釋可以讀模型微調是什麼。
「那它到底準不準?」微軟說它在 36 項基準測試的平均準確率最高,但有評論指出官方的基準測試頁只有方法說明、沒有逐項數字。廠商自己出考卷又自己改,標準的球員兼裁判,分數先看看就好 XD
編輯觀點:最熱鬧的戰場其實在「便宜模型」
把三則新聞放一起看,會發現一個很有趣的共通點啦。Haiku 5.5 和 Decision-1 同一週出來,一個把價格砍到一成,一個乾脆把輸出變免費,大廠搶的已經不是誰最聰明,而是誰能用最少的錢做完最多次「小判斷」。AI Agent 一個任務可能要呼叫模型幾十次,單價才是真正的成本。
更諷刺的是血統。微軟的新模型底層是中國的 Qwen,輝達同時在砸錢加碼一家被當成「中國開源模型對手」的美國公司。開源模型的國籍,正在變成一門生意。
對台灣企業來說,這會直接卡到採購流程。數位發展部在 2025 年初就限制公部門使用 DeepSeek,如果你的客戶是政府或金融業,挑 Decision-1 這種以 Qwen 為底的模型之前,最好先問清楚法遵怎麼看。我自己的判斷是,便宜模型會先吃下客服和文件分類,而「模型從哪裡來」會變成採購單上的必填欄位。
明天值得關注
輝達和 Reflection 最快幾週內可能有結果,交易用收購還是「挖人加授權」,會決定監管機關有沒有機會插手。
常見問題 FAQ
Claude Haiku 5.5 多少錢?
Claude Haiku 5.5 在 10 萬 token 以內的請求,每百萬輸入 token 收 0.10 美元、輸出 0.50 美元;超過 10 萬 token 則是輸入 0.50 美元、輸出 2.50 美元。批次處理還能再打五折。
Reflection AI 是什麼公司?
Reflection AI 是 2024 年由兩位前 Google DeepMind 研究員創立的美國 AI 新創,主打開源權重的前沿模型,輝達是主要投資人之一,據報導曾投入 8 億美元。
Microsoft-Decision-1 跟一般聊天 AI 有什麼不同?
一般聊天 AI 會生成文字回答,Microsoft-Decision-1 只針對事先給定的選項回傳機率分數,適合用在客服分流、內容分類這類需要快速做選擇的流程。
整理一下今天的重點:輝達想把開源模型抓在手裡,Anthropic 和微軟則在比誰的小模型更便宜,這週真的是便宜模型的主場。
希望這篇快報有讓你掌握今天的 AI 動向哩~如果這篇有幫到你,歡迎分享給同樣在追 AI 趨勢的朋友。
我們明天見囉~
本快報由 Array 報報 AI 編輯部根據上方引用來源整理,每日 08:00 自動發佈。