1️⃣ Moonshot 認栽:Kimi K3 上線 48 小時 GPU「撐到極限」,全球暫停新訂閱、明分「Kimi Membership + Kimi Code Membership」兩軌
Moonshot AI 7/19 於官方 X(@Kimi_Moonshot)宣布:Kimi K3 開放後 48 小時內需求已逼近現有算力上限,為保護既有訂閱者體驗,暫停新訂閱、逐批放行;現有訂閱不受影響。同步將訂閱制拆為兩軌 —「Kimi Membership」涵蓋 Web/App/Work,「Kimi Code Membership」專攻程式碼工作流,理由是「更精準分配算力、穩定體驗」。這是「開源模型也吃算力紅利」的最新實證,也解釋了 Moonshot 為何在 6 月 ARR 3 億美元下急推 6 個月內 IPO。
🔗 來源:Moonshot 官方 X(📌 官方公告)
2️⃣ Mira Murati 的 Thinking Machines 首波開源:多模態 MoE「Inkling」975B/41B active、Apache 2.0,SWE-bench Verified 77.6% 超美系開源同儕 Nemotron 3
Thinking Machines 7/19 於官方部落格揭 Inkling:Apache 2.0 授權、975B 總參數/41B active 的 MoE 多模態基礎模型,1M token context,預訓練 45T tokens(含文字/影像/音訊/影片)。SWE-bench Verified 77.6% 打敗 Nvidia Nemotron 3(71.9%)、AIME 2026 97.1% 微贏 DeepSeek V4 Pro(96.7%)、VoiceBench 91.4% 逼近 Gemini 3.1 Pro(94.4%)。首創「controllable thinking effort」拖桿(0.2~0.99)讓開發者調節推理成本;同步預覽 12B active 的 Inkling-Small。權重已上 Hugging Face、可於自家 Tinker 微調。
🔗 來源:Thinking Machines Lab 官方部落格(📌 官方公告)
3️⃣ Design Arena Agentic Web Dev 榜單洗牌:Sonnet-tier「Claude Sonnet 5」1333 分意外壓 Fable 5、Opus 4.8 登頂,開源 Inkling 1257 追平 Claude Opus 4.6
隨 Thinking Machines 7/19 揭 Inkling 而公開的 Design Arena「Agentic Web Dev」盲測榜單(人類評審對比生成 Web App)出現大逆轉:Claude Sonnet 5(1333)反超 Claude Fable 5(1329)、Claude Opus 4.8(1285)、GLM 5.2(1275)、Grok 4.5(1271)、GPT-5.6 Sol(1260)。Anthropic 中階 Sonnet 首次在頂級盲測 benchmark 登頂;開源新兵 Inkling(1257)追平 Opus 4.6,Kimi K2.6(1249)居第 10。前沿模型的「Sonnet-tier vs Opus-tier」性價比曲線被明顯重寫,「便宜中階模」在真實 Web 開發任務比昂貴旗艦更受人類偏好。
🔗 來源:Thinking Machines Inkling blog(引用 Design Arena 官方數據)(📰 媒體報導)