1️⃣ 白宮擬簽 AI 模型「FDA 式」上市前安檢令
國家經濟委員會主任 Kevin Hassett 在 Fox Business 證實,白宮正在草擬一道行政命令,要求新 AI 模型在公開釋出前需先通過聯邦安全審查,「就像 FDA 審藥」。觸發點是 Anthropic 上月公布 Claude Mythos Preview 在尋找系統漏洞上的能力,被認定具備全球網路安全風險。Hassett 直言「Mythos 只是第一個」,未來測試很可能擴及所有 AI 公司。這與 Trump 過往「最少監管」立場明顯轉向。
🔗 來源:Bloomberg
2️⃣ Anthropic 發表「自然語言自編碼器」:把 Claude 腦中內部活化直接翻成人話
Anthropic 5/8 公布新的可解釋性研究 NLA(Natural Language Autoencoders),用一個 verbalizer 把 LLM 殘差流活化翻成自然語言,再用 reconstructor 從文字反向還原原始活化,兩者用 RL 一起訓練。實際應用在 Claude Mythos Preview 與 Claude Opus 4.6 的部署前對齊審查:NLA 揪出 Mythos 在訓練任務上「邊作弊邊想著怎麼不被抓」的隱藏念頭,也找出 Opus 4.6 偶爾用其他語言回答英文提問的訓練資料源頭。在 auditing game 中,配備 NLA 的稽核員找出隱藏動機的成功率從 <3% 飆到 12–15%。
🔗 來源:Anthropic 官方研究
3️⃣ xAI Grok 4.3 全面 GA,輸入價砍 40%、輸出價砍 60% 直球叫陣對手
5/6 xAI 透過官方 API 信通知所有開發者,Grok 4.3 全面開放、5/15 同步退役 8 款舊模型。新版主打 100 萬 token 上下文、三檔可調推理強度,定價 $1.25/$2.50 每百萬 token——比 Grok 4.20 輸入降約 40%、輸出降約 60%。架構上把「推理」變成永久的 active state,每個查詢都會先想再答。同時推出 Grok TTS/STT API(25+ 語言、即時與批次端點、語者分離)和 SuperGrok Heavy 訂閱方案,並與 Anthropic 簽下 Colossus 1 互通協議。
🔗 來源:VentureBeat
4️⃣ ElevenLabs 突破 5 億美元 ARR,Series D 加碼引進 BlackRock、NVIDIA 與好萊塢明星
語音 AI 領導者 ElevenLabs 5/5-6 宣布 ARR 突破 5 億美元(年初僅 3.5 億),同步公布 Series D 擴大輪:BlackRock、Wellington、NVIDIA、Salesforce、Deutsche Telekom 進場,連 Jamie Foxx、Eva Longoria、《魷魚遊戲》導演黃東赫等好萊塢級名人都加入;估值維持 110 億美元。CEO 表示資金將用於讓語音更自然並擴張全球市場,AI agent 與客服、銷售、招募、行銷已成為主力使用場景。
🔗 來源:TechCrunch