AI 詞彙百科
AI 越獄(Jailbreak)是什麼?為什麼有人問得出 AI 不該講的話
AI 越獄(Jailbreak)是用特製的說法繞過模型內建的安全規範,讓它講出原本會拒絕的內容。這篇帶你分清它跟提示詞注入的包含關係、跟新聞說的「模型衝出沙盒」差在哪,以及為什麼安全訓練修不掉它。
AI 詞彙百科
AI 越獄(Jailbreak)是用特製的說法繞過模型內建的安全規範,讓它講出原本會拒絕的內容。這篇帶你分清它跟提示詞注入的包含關係、跟新聞說的「模型衝出沙盒」差在哪,以及為什麼安全訓練修不掉它。
AI 趨勢
宇樹科技(Unitree)8/19 上海掛牌首日盤中暴漲 629%;輝達傳議 200 億美元估值投資資料標註新創 Mercor;CISA 為 Ray 框架 CVE-2025-62593 開出 8/20 修補死線。
AI 詞彙百科
Prompt Injection(提示詞注入)是把假指令藏進 AI 會讀到的內容裡,騙 AI 把它當成命令執行的攻擊手法。這篇用跑腿購物清單的比喻,帶你分清直接注入跟間接注入、它跟 AI 越獄差在哪,以及為什麼 OWASP 連兩版都把它排在第一名。
AI 趨勢
Anthropic 找三星用 2 奈米製程自造 AI 晶片挑戰 NVIDIA,美國 6 月就業僅增 5.7 萬人創新低,AI 漏洞發現工具推動 2026 年 CVE 預估突破 6.6 萬個。
AI 趨勢
Transformer 之父 Noam Shazeer 離開 Google 加入 OpenAI,GPT-5.5-Cyber 聯手修補開源漏洞,Anthropic 要求 Claude 使用者刷身分證,智譜 AI 開源 GLM-5.2 以六分之一價格叫板 GPT-5.5。
AI 趨勢
Anthropic 最強模型 Claude Fable 5 正式開放,中國砸 2950 億美元建 AI 算力網排擠 Nvidia,Miasma 蠕蟲攻破 73 個微軟 GitHub 儲存庫鎖定 AI 開發工具。
AI 趨勢
前 OpenAI 技術長 Mira Murati 的 Thinking Machines Lab 發表全雙工互動模型,回應速度僅 0.4 秒。OpenAI 推出 Daybreak 資安平台對抗 AI 駭客威脅,Google 首度攔截 AI 生成的零日漏洞攻擊,AI 聊天機器人悄悄成為心理健康諮詢工具。