30 秒看重點
- Google Gemini 3.5 Pro 據多家科技媒體報導鎖定 7 月 17 日正式上線,上下文窗口翻倍至 200 萬 Token,並新增 Deep Think 推理模式,預估 API 定價每百萬 Token 輸入約 1.25 美元。
- AI 推理晶片新創 SambaNova 完成 10 億美元 Series F 融資,估值達 110 億美元,JPMorgan 已部署其 SN40 和 SN50 系統作為企業 AI 推理基礎設施。
- 2026 世界人工智慧大會(WAIC)將於 7/17-20 在上海舉行,展覽面積首破 10 萬平方公尺,超過 300 款 AI 產品全球首發,包含全球首款 AI 智慧體手機。
Gemini 3.5 Pro 這次真的要來了嗎?
Google Gemini 3.5 Pro 據報導將在 7 月 17 日正式對外開放,這是 Google 在連續兩次跳票之後給出的最新時間點。
先講結論:如果這次 Google 真的準時交卷,Gemini 3.5 Pro 會是目前市面上上下文窗口最大的模型。據 Geeky Gadgets 和 TechTimes 等多家媒體報導,上下文窗口直接翻倍到 200 萬 Token,是現行 Gemini 2.5 Pro 的兩倍。200 萬 Token 是什麼概念?大約等於 30 本小說的文字量,你可以把整個專案的程式碼一次丟進去,不用再東切西切。
另一個亮點是新的 Deep Think 推理模式,據報導會鎖在月費 250 美元的 Ultra 方案裡。API 定價預估每百萬 Token 輸入約 1.25 美元,跟 GPT-5.6 Luna 的 1 美元和 Meta Muse Spark 的 1.25 美元差不多,價格戰已經打到這個水位了。
但老實講,Google I/O 說六月上線結果跳票、延到七月又沒給具體日期 Google 時間表永遠要打八折,現在「據報導 7/17」也還沒被官方正式確認。截至目前 Google 的公開 API 清單上只有 gemini-3.5-flash 跟 gemini-3.1-pro-preview,3.5 Pro 的 model card 跟定價文件都還沒出現。所以這次到底會不會再度放鴿子?(我是希望不要啦)
名詞小教室:上下文窗口(Context Window)就是 AI 一次能「記住」多少內容的容量上限。你可以想像成 AI 的工作桌面大小,桌面越大,能同時攤開的文件越多,就不用一直翻來翻去找資料。200 萬 Token 大概等於 150 萬字的中文,差不多是 30 本書同時攤在桌上。
SambaNova 拿 10 億美元要挑戰誰?
AI 推理晶片新創 SambaNova 在 7 月 8 日完成 10 億美元 Series F 融資首輪交割,估值達 110 億美元,由 General Atlantic 領投。
這家公司很多人可能沒聽過,但它做的事情滿有意思的:專門做 AI「推理」用的晶片,也就是模型訓練好之後、實際在回答你問題那個階段用的硬體。簡單來講,NVIDIA 的 GPU 像是幫 AI 念大學的教授,SambaNova 的晶片則像 AI 畢業後幫它快速處理公事的助理,兩者分工不同。
根據 TechCrunch 報導,這輪融資的投資陣容相當豪華:除了領投的 General Atlantic,還有 BlackRock、Intel Capital、卡達投資局(QIA)、T. Rowe Price、Battery Ventures、Vista Equity Partners 都有參與。最狠的是,這距離 SambaNova 今年二月拿到 3.5 億美元 Series E 才過了五個月,等於半年內連募兩輪、合計 13.5 億美元,這燒錢速度也太猛了吧 XD
已經有大咖客戶買單了。據 Bloomberg 報導,JPMorgan 選定 SambaNova 作為推理基礎設施合作夥伴,部署了 SN40 和 SN50 兩代系統來跑企業內部的安全 AI 推理。金融業最在意的就是資料不能跑到外面的雲端去,這種「自己的 AI 自己跑」的需求只會越來越大。
「所以 NVIDIA 該緊張了嗎?」也不完全是。NVIDIA 在訓練市場的地位短期內沒人撼動得了,但推理市場確實正在長出一批新玩家,除了 SambaNova 還有 Groq、Cerebras 這些。畢竟模型訓練一次就好,推理是每天每秒都在燒,誰能在推理端吃到份額,誰就抓住了 AI 商業化真正的入場券。
上海 WAIC 為什麼值得台灣讀者關注?
2026 世界人工智慧大會(WAIC)將於 7 月 17 日至 20 日在上海舉行,展覽總面積首次突破 10 萬平方公尺,超過 1,100 家企業參展、展品超過 3,000 件,其中 300 多款產品將全球首發。
這規模有多大?根據 CGTN 報導,去年 WAIC 的展覽面積大概 5 萬多平方公尺,今年直接翻倍。重點展品名單也很嚇人:華為最大規模超節點 Atlas 950 實機、MiniMax M3 多模態大模型、全球首款 AI 智慧體手機、近存運算 3D 晶片,還有一大票人形機器人和 AI 靈巧手。光一個展就塞了超過 140 場論壇、1,400 多位專家,同時還辦「AI 全球治理高級別會議」。
講真的,光看展品清單就能感覺到中國 AI 產業正從「追模型參數」轉向「做成產品賣出去」。之前我們報導過中國 AI 模型已經吃下美國企業近半的 Token 流量,現在 WAIC 又要一口氣丟 300 多款新產品出來,這個產業化速度確實猛。
對台灣有兩件事要盯。第一,WAIC 同時舉辦 AI 全球治理會議,各國怎麼談 AI 監管會直接影響台灣未來的 AI 法規走向。第二,華為 Atlas 950 和近存運算 3D 晶片都跟半導體製程有關,中國在晶片自主化上到底走到哪一步,台灣的半導體產業不可能不在意呀。
編輯觀點:7/17,兩個世界的 AI 同步秀肌肉
把今天三則新聞放在一起看,有一件很巧的事:Google Gemini 3.5 Pro 預計上線的日子跟上海 WAIC 開幕是同一天,都是 7 月 17 日。
這可能不只是巧合。Google 選在這個時間點放出憋了好幾個月的最強模型,WAIC 則集結整個中國 AI 生態系的 300 多款新品同場亮相,兩邊等於在同一天各自秀肌肉。加上 SambaNova 剛拿 10 億美元要在推理晶片市場開闢第二戰線,AI 的競爭已經從「誰的模型 benchmark 分數高」升級成「誰的生態系跑得比較快」。
我覺得台灣的開發者跟企業現在最該做的事,其實不是急著站隊 Google 還是中國方案,而是趁這波產品大爆發先把自己的需求搞清楚。200 萬 Token 的超長上下文適合處理法律合約、大型程式碼庫這類需要一次看完的場景;中國模型的低價 API 適合需要大量推理但不碰機密資料的應用。先搞清楚自己要什麼,再挑工具,才不會被行銷話術牽著鼻子走。
明天值得關注
7/17 倒數四天,Google 是否會在本週內正式公布 Gemini 3.5 Pro 的上線時間跟定價。另外 WAIC 的議程細節也在陸續公開中,特別是 AI 全球治理高級別會議會不會產生影響各國法規方向的新共識,值得持續追蹤。
常見問題 FAQ
Gemini 3.5 Pro 的 200 萬 Token 上下文有什麼用?
Gemini 3.5 Pro 據報導將提供 200 萬 Token 的上下文窗口,相當於約 30 本小說或 150 萬字中文的容量。這讓開發者可以一次將整個程式碼專案、完整法律合約或大量研究文獻丟進模型處理,不需要再手動拆分文件或依賴 RAG(檢索增強生成)等額外架構來處理長文件。
SambaNova 跟 NVIDIA 的差別是什麼?
SambaNova 專注於 AI 推理階段的晶片,也就是模型訓練完成後實際提供服務時的運算環節,而 NVIDIA 的 GPU 主要優勢在 AI 訓練階段。SambaNova 的 SN40 和 SN50 系統強調企業級安全推理,已獲 JPMorgan 等金融機構採用,適合需要在自家機房部署 AI、不想把資料送上雲端的企業。
2026 WAIC 世界人工智慧大會有哪些重點?
2026 WAIC 將於 7 月 17-20 日在上海舉行,據上海市政府公開資料,展覽面積首破 10 萬平方公尺,超過 1,100 家企業參展,300 多款 AI 產品全球首發,包含華為 Atlas 950 超節點、MiniMax M3 多模態模型和全球首款 AI 智慧體手機。同時舉辦 AI 全球治理高級別會議,有 140 多場論壇和 1,400 多位專家出席。
整理一下今天的重點:下週 7/17 真的超精彩,Google 跟中國 AI 生態系同一天秀肌肉,推理晶片市場也在燒錢搶地盤,AI 戰火已經從模型比武擴散到整個生態系的全面競賽了。
希望這篇快報有讓你掌握今天的 AI 動向哩~如果這篇有幫到你,歡迎分享給同樣在追 AI 趨勢的朋友。
我們明天見囉~
本快報由 Array 報報 AI 編輯部根據上方引用來源整理,每日 08:00 自動發佈。