30 秒看重點

  • Google 在 9 月 15 日推出兩款 Gemini 3.8 Live 語音模型,Extended Thinking 版以 82.6 分登上 Artificial Analysis 語音指數第一,每小時 3.5 美元比 GPT-Live-1 便宜約 4 成。
  • Novo Nordisk 在 9 月 16 日宣布與 Anthropic 合作,先把 Claude Science 放進研發流程特定環節試用,雙方沒有公布金額與時程。
  • Meta 在 9 月 15 日放出 WhatsApp Business Tools MCP,讓 Claude、Cursor 這類 AI agent 直接開商業帳號、驗證手機號碼、寫訊息範本。

Gemini 3.8 Live 是什麼?語音 AI 為什麼開始比價?

Gemini 3.8 Live 是 Google 新的語音對語音模型,它現在同時站在「品質第一」跟「價格更低」兩個位置。

先講結論吧,重點不在它多聰明。根據評測機構 Artificial Analysis 的數字,Extended Thinking(High)在語音對語音指數拿 82.6 分排第一,GPT-Live-1(Astra)是 81.5 分,差距很小。真正拉開的是價格:換算每小時 3.5 美元,比 GPT-Live-1(Astra, medium)的 5.83 美元便宜約 4 成,標準版每分鐘只要 0.005 美元。

那個指數怎麼算的?Artificial Analysis 說是語音推理、代理任務、競技場偏好、任務成功率四項各佔 25%,所以看的是模型能不能把事情辦完,不只是聲音好不好聽。

名詞小教室:語音對語音(Speech to Speech)是直接聽聲音、直接出聲音。傳統做法要三手接力,先把你的話轉成文字、丟給文字模型想、再合成語音念出來,就像你講中文請翻譯轉述給對方,每轉一手都掉一點語氣、多一點延遲。

我們先前寫過 GPT-Live-1 上架 API,當時的重點還是「終於可以互相插話了」,不到一週就變成在比一小時多少錢。

Novo Nordisk 找 Anthropic 做什麼?AI 真能加速新藥?

Novo Nordisk 要把 Anthropic 的 Claude Science 放進研發流程測試,目標是縮短從研究發現走到新藥的時間。

根據雙方 9 月 16 日的聲明,他們會針對 Novo 團隊「已經指認出來」的發現瓶頸共同開發解法,重點放在生物推理與科學工作流程,另外也用前沿模型強化內部軟體開發,並強調資料治理與人類監督。Anthropic 執行長 Dario Amodei 的說法是,AI 能力持續提升,帶來把一個世紀的生物與醫學突破壓縮進十年的可能。

老實講這句話 Amodei 講過不只一次,我一律先打個折(廠商講願景不用成本)。比較有資訊量的是「先測試特定環節」那幾個字。沒有金額、沒有時程,說白了就是把 Claude 帶進實驗室試用期。而且 Novo 手上本來就有 OpenAI 跟 Amazon 的 AI 合作,三家一起養著,比較像分散下注。

名詞小教室:生物推理(biological reasoning)要的是判斷力。就像資深研究員看一組實驗資料會直接說「這條路走不通,這個蛋白在細胞裡不會這樣折」,AI 要做的是淘汰錯誤方向,不是把論文摘要唸一遍給你聽。

Meta 讓 AI agent 設定 WhatsApp,做生意的人有感嗎?

Meta 推出 WhatsApp Business Tools MCP,讓 AI agent 幫你跑完商業帳號的開通與日常設定。

據 TechCrunch 等媒體報導,這個 MCP 伺服器能讓 Claude、Cursor、Codex 等 agent 建立 WhatsApp 商業帳號、用 OTP 驗證手機號碼、把號碼註冊到 Cloud API,再建立訊息範本、測試 webhook,還會檢查服務條款與商業驗證有沒有卡住。過去這些都得自己一頁頁點完。

名詞小教室:MCP(Model Context Protocol)你可以想像成 AI 的 USB 規格。以前每個系統都要自己接一條專用線,有了共同規格,AI 想用哪個服務就插上去,背後跑的是工具呼叫(Tool Calling)

台灣做生意的先別急,我們這邊主流是 LINE 不是 WhatsApp,工具本身跟多數人無關。真正的訊號是平台開始把自家後台做成 agent 操作得動的介面 順便把你黏得更緊,如果 LINE、蝦皮跟進,第一批消失的工作會是「設定」。別誤會,OTP 還是要人去收、商業驗證還是 Meta 在審,agent 只是幫你少開幾個分頁。

編輯觀點:三則都在賣「接線」,不是賣聰明

把這三則放在一起看,共同點不是模型變強,而是把 AI 接進現有流程這件事變便宜、變快了。Google 賣的是每小時單價,Novo 買的是把模型塞進研發動線的權限,Meta 送的是一個能被 agent 操作的後台。新聞標題還在比智商,帳單上比的其實是接線工。

老實講我覺得最被低估的是 Meta 那則,最被高估的是 Novo 那則(沒金額的合作我都先當公關稿看)。對台灣中小企業來說,每小時 3.5 美元是第一次能認真算的數字:一個客服班別 8 小時、模型成本約 28 美元,這個帳終於算得出來。可是真正的成本從來不在 API 那一行,是通話錄音的法規、話術品質、接錯要誰負責。畢竟 demo 永遠很順,帳單跟客訴比較誠實哩。

明天值得關注

OpenAI 會不會在語音定價上回一手,這是最直接的觀察點。另外 Novo 跟 Anthropic 的合作會不會長出具體專案與金額,畢竟聲明裡什麼都沒說。


常見問題 FAQ

Gemini 3.8 Live 跟 GPT-Live-1 差在哪?

兩者都是語音對語音模型。依 Artificial Analysis 評測,Gemini 3.8 Live Extended Thinking 以 82.6 分居首,GPT-Live-1(Astra)81.5 分,品質接近,價格是每小時 3.5 美元對 5.83 美元。

Claude Science 是什麼?

Claude Science 是 Anthropic 針對科學研究的方案。依雙方 9 月 16 日的聲明,Novo Nordisk 會先在特定研發流程中測試它,聚焦生物推理,並搭配資料治理與人類監督。

MCP 是什麼?我需要用嗎?

MCP(Model Context Protocol)是讓 AI 模型連接外部服務的共通規格。如果你會用 AI 工具串接自家系統,它能省下大量手動設定;只是用 ChatGPT 聊天的話,目前不需要特別了解。


整理一下今天的重點:語音 AI 真的開始比價了,製藥跟商業後台那兩則講的其實是同一件事,AI 正被接進別人的流程裡。

希望這篇快報有讓你掌握今天的 AI 動向哩~如果這篇有幫到你,歡迎分享給同樣在追 AI 趨勢的朋友。

我們明天見囉~

本快報由 Array 報報 AI 編輯部根據上方引用來源整理,每日 08:00 自動發佈。