1️⃣ NYT:OpenAI 數學證明海嘯讓數學界既「震撼」又「崩潰」——單日推進高階數學前沿
OpenAI 以未發表的前沿模型一次發布 719 篇數學稿件後,紐約時報深入採訪數學界反應:有人稱之 breathtaking,有人直呼 devastating。數百則 AI 產生的新發現在一天內移動了高階數學的前沿,包括證明「允許任意有理數時數學世界仍不可排序」等結果;但迄今僅約 42%(約 300 篇)通過 Lean 電腦驗證,AGMAI 等機構提醒自然語言證明未經同儕審查前不應直接信任。AI 輔助定理證明已從實驗走向量產,數學界的工作方式正被永久改寫。
🔗 來源:The New York Times(📰媒體報導(NYT))
2️⃣ Mistral 預覽萬億參數 Large 4「Le Chonk」、Reflection AI 推 Beam:西方開源模型反攻
法國 Mistral 發表 Large 4(暱稱 le Chonk):1.05 兆參數 MoE、約 52B 活躍參數、1M 上下文,宣稱是全球最強開放權重模型,在自家歐洲資料中心以 3,800 張 Grace Blackwell GPU 從零訓練,權重月底開放;同日美國新創 Reflection AI 發表 501B 的 Beam,主打效率,Apache 2.0 權重本月釋出。在中國開源模型壓境下,西方陣營首次以兆級開放權重回擊,「主權 AI」與可自架部署的價值主張成為新戰場。
🔗 來源:Mistral 官方文件(📌官方公告)
3️⃣ OpenAI 推出 Decisions API 公測與 Ultrafast 模式:AI 競賽轉向速度與成本
OpenAI 宣布 Decisions API 進入公開測試:針對文字與圖片回傳型別化判斷(機率、固定選項、rubric 評分),速度比 Responses API 快約 10 倍,輸入每百萬 token 僅 $0.10,瞄準 Agent 工作流中大量低成本決策;同時為 GPT-6.1 Sol 推出 Ultrafast 模式,token 生成最快提升 8 倍,但費率高出標準模式甚多($12/$60 per 1M)。呼應微軟 Decision-1 佈局,產業焦點正從跑分轉向「每單位工作的時間與成本」。
🔗 來源:OpenAI 開發者文件(📌官方公告)
4️⃣ 滲透測試 AI Agent「ARTEX」被用於攻擊韓國銀行後,中國開發者宣布閉源
Reuters 報導,開源滲透測試 AI 代理 ARTEX(可串接 ChatGPT、Claude、DeepSeek 等模型)經 CrowdStrike 等資安公司認定涉及近期針對韓國銀行、外洩約 6.8 萬客戶資料的攻擊行動後,其中國開發者宣布專案停止更新、轉為閉源,GitHub 頁面已下架。這是「AI 安全工具雙刃劍」的標誌案例:降低資安門檻的同時也降低了攻擊門檻,凸顯 Agentic 資安工具治理的迫切性。
🔗 來源:Reuters(📰媒體報導(Reuters))