30 秒看重點
- Anthropic 的旗艦模型 Fable 5 在被美國政府禁了 18 天後,於 7 月 1 日正式解禁回歸,同時聯合 Amazon、Microsoft、Google 提出業界首個越獄嚴重性評分框架。
- Claude Sonnet 5 同日全面上線成為所有使用者的預設模型,推出期間每百萬 Token 輸入只要 2 美元,比旗艦 Opus 4.8 便宜六成。
- Google 推出 Gemini 3.1 Flash Image 圖片生成模型,平價版每千張圖片只要 0.034 美元(約新台幣 1 元),4 秒就能產出一張圖。
- GPT-5.6 Sol 即將搭載 Cerebras 晶片以每秒 750 個 Token 的速度推出,OpenAI 表示數週內全面開放。
Fable 5 被禁 18 天後做了什麼才換到解禁?
Anthropic 的旗艦模型 Fable 5 在 7 月 1 日正式解除美國出口管制禁令,重新向全球使用者開放存取,結束了長達 18 天的「封印期」。
事情的來龍去脈其實我們之前有追過。6 月 12 日美國政府以國家安全為由封鎖了 Fable 5 和 Mythos 5,起因是 Amazon 研究人員發現了一種繞過安全機制的方法,可以讓 Fable 5 辨識出軟體漏洞。Anthropic 當時直接對全球所有使用者停用,因為要精確區分「外國人士」和「本國使用者」在技術上根本做不到。
那 Anthropic 到底做了什麼才讓政府點頭放行?根據多家媒體報導,至少三件事。第一,部署了全新的分類器來專門攔截越獄攻擊。第二,在 HackerOne 上開了漏洞回報獎勵計畫,等於是花錢請白帽駭客幫忙找洞。第三,組建了 24 小時全天候的越獄監控團隊。
更有意思的是 Glasswing 聯盟的動作。Anthropic 拉了 Amazon、Microsoft、Google 一起提出業界首個「越獄嚴重性評分框架」,從四個維度來評估越獄攻擊的危險程度:攻擊者獲得多少額外能力、涵蓋多廣的攻擊面、有多容易被武器化、技術本身有多容易被發現或散播。老實講,這有點像是幫 AI 安全蓋了一套「地震震度量表」,讓整個產業可以用同一把尺來衡量問題嚴不嚴重,而不是每次出事都各說各話。
6 月 30 日美國商務部正式解除禁令,隔天 Fable 5 就回來了。不過這 18 天的風波已經改變了整個 AI 產業的遊戲規則 — 以後模型發布,政府的態度已經不是「參考」而是「必要條件」了呢。
名詞小教室:越獄(Jailbreak)是透過特殊的提示詞來繞過 AI 的安全防線,讓它回答原本不該回答的問題。你可以想像成跟大樓警衛說一套特殊暗號,讓他放你進原本不能進的樓層。
Claude Sonnet 5 打了什麼折扣在搶市場?
Claude Sonnet 5 是 Anthropic 有史以來最強的 Sonnet 系列模型,7 月 1 日起成為所有免費版和 Pro 版使用者的預設模型,推出期間價格比旗艦便宜整整六成。
先講價格吧,因為這次的定價策略真的很積極。推出期間(到 8 月 31 日為止)每百萬 Token 輸入只要 2 美元、輸出 10 美元,之後恢復標準價 3 美元和 15 美元。拿它跟旗艦 Opus 4.8 比,推出期間便宜 60%,恢復原價後也還是便宜 40%。甚至比上一代 Sonnet 4.6 還便宜,這是什麼操作啊?
根據多家媒體報導,Sonnet 5 在推理、工具使用、程式撰寫和知識工作上都比 Sonnet 4.6 有明顯提升,而且在很多任務上表現已經逼近旗艦 Opus 4.8。Anthropic 主打的賣點是「agentic」能力,簡單來講就是讓 AI 不只會回答問題,還能自己規劃任務、操作瀏覽器和終端機、執行多步驟工作流程,像是一個會自己動手做事的 AI 員工。
「那幹嘛不直接用 Opus 4.8?」好問題。答案是 Sonnet 5 的性價比太香了。對大多數日常場景來說,Sonnet 5 已經夠強,價格只有旗艦的四折起,對想要大量呼叫 API 的開發者來說差非常多。順帶一提,VentureBeat 報導也提到 Anthropic 正在全力衝刺 IPO,這次低價策略顯然是想在上市前把使用者數字衝漂亮 順便把 OpenAI 的客戶挖過來。
名詞小教室:Agentic AI(代理式 AI)就是 AI 不只被動等你問問題,而是能自己拆解目標、規劃步驟、呼叫工具來完成任務。你可以想像成從「問一句答一句的客服」升級成「交辦任務就會自己去處理的助理」。
Google 的 AI 圖片生成有多便宜?
Google 在 6 月 30 日推出 Gemini 3.1 Flash Image 系列圖片生成模型(代號 Nano Banana 2),其中平價版 Flash-Lite 每千張圖只要 0.034 美元,大約新台幣 1 塊錢,4 秒就能產出一張圖。
這次 Google 一口氣端出兩個版本。標準版 Flash Image 走的是「高品質但價格親民」路線,每百萬 Token 輸入 0.5 美元、輸出 3 美元,適合需要精緻圖片的場景。Flash-Lite Image 則是極致壓價路線,專門為需要大量產圖的企業設計,根據 VentureBeat 報導,目標延遲壓到 2 秒以下,TPU 運算成本也大幅降低。
兩款模型都已經可以在 Google AI Studio、Gemini API 和 Gemini 企業代理平台(GEAP)上使用。老實講,千張圖片新台幣 1 塊錢這個定價,對那些需要大量生成產品圖、社群貼文素材的電商和行銷團隊來說,圖片生成的成本基本上可以忽略不計了(這個價格真的有點誇張)。
不過 Google 在大型語言模型這邊就沒這麼順利啦。Gemini 3.5 Pro 已經確認延遲到 7 月,據說是因為企業測試者反映在長時間 agentic 任務中消耗過多 Token。一邊在圖片生成狂降價,一邊連旗艦文字模型都還搞不定,Google 目前的 AI 策略有點「偏科」的感覺。
編輯觀點:政府審核成了 AI 發布的新常態
把 7 月初的這幾件事放在一起看,一個趨勢真的越來越清楚了:「先給政府看」已經不是選項,而是 AI 模型上線的標準流程。
Fable 5 的解禁過程,本質上就是 Anthropic 拿出整套安全升級方案,去跟美國商務部做交換。GPT-5.6 更是從一開始就走「政府先看、企業限量、最後才開放大眾」的路線,到現在還只有約 20 家經過核准的企業能碰到。回想 2023、2024 年那個「模型做好就上線」的時代,真的是完全不同的世界了。
我覺得對台灣的開發者和企業來說,這件事其實比任何一個模型的跑分都更值得注意。因為這代表未來最強的 AI 模型,你不一定第一時間用得到,而原因不是技術問題,是地緣政治問題。如果你的產品高度依賴某一家的最新模型,現在就該開始認真想多模型備援策略了吧。
明天值得關注
GPT-5.6 Sol 搭載 Cerebras 晶片的全速版本預計 7 月內上線,每秒可跑 750 個 Token,OpenAI 表示數週內向所有使用者開放。Gemini 3.5 Pro 也預計 7 月登場,兩大旗艦模型的正式開放時間值得持續追蹤。
常見問題 FAQ
Fable 5 解禁後跟被禁之前有什麼不同?
Fable 5 解禁後新增了專門攔截越獄攻擊的分類器、HackerOne 漏洞回報獎勵計畫,以及 24 小時全天候的越獄監控團隊。Anthropic 還聯合 Amazon、Microsoft、Google 建立了越獄嚴重性評分框架,從能力增益、攻擊廣度、武器化難度和可發現性四個維度來評估越獄威脅的等級。
Claude Sonnet 5 跟旗艦 Opus 4.8 差在哪裡?
Claude Sonnet 5 在許多任務上的表現已經逼近旗艦 Opus 4.8,但價格便宜了四到六成。推出期間每百萬 Token 輸入 2 美元、輸出 10 美元,8 月 31 日後恢復為 3 美元和 15 美元。Sonnet 5 特別強化了 agentic 能力,適合需要 AI 自主執行多步驟任務的開發場景。
Google Gemini 3.1 Flash Image 可以用在什麼地方?
Gemini 3.1 Flash Image 適合需要大量圖片生成的商業場景,例如電商產品圖、社群貼文素材、廣告創意等。標準版提供高品質輸出,Flash-Lite 版以每千張 0.034 美元的超低價格專攻高頻率大量生成的企業需求,已在 Google AI Studio 和 Gemini API 上開放使用。
整理一下今天的重點:7 月第一天 Anthropic 就放了大招,Fable 5 解禁加上 Sonnet 5 上線雙重出擊,Google 也用超低價圖片生成來攪局,AI 模型戰場真的是一天都不得閒。
希望這篇快報有讓你掌握今天的 AI 動向哩~如果這篇有幫到你,歡迎分享給同樣在追 AI 趨勢的朋友。
我們明天見囉~
本快報由 Array 報報 AI 編輯部根據上方引用來源整理,每日 08:00 自動發佈。