news

AI 日報|神秘隱身模型 Ox Alpha 亮相;Harvey 推出基於 Kimi K3 的法律模型;開源模型 Token 佔比暴增至 62%

August 24, 2026
Updated Aug 24
3 min read
kimi
推出基於 Kimi K3 的法
openrouter
pha — OpenRouter / 匿名開
grok
發布/更新 Grok 語音與 I
xai
面更新 — xAI / Gro
vercel
業變局 — Vercel AI Ga
openai
aper.@OpenAI Sol&#
news
AI 日報|神秘隱身模型 Ox Alpha 亮相;Harvey 推出基於 Kimi K3 的法律模型;開源模型 Token 佔比暴增至 62%
2026-08-24

AI 日報|神秘隱身模型 Ox Alpha 亮相;Harvey 推出基於 Kimi K3 的法律模型;開源模型 Token 佔比暴增至 62%


模型發布/更新

Ox Alpha — OpenRouter / 匿名開發者

  • 一言以蔽之:一款名為 Ox Alpha 的神秘高效推理模型意外登陸 OpenRouter,因卓越的程式碼能力與極佳的指令遵循度引發業界廣泛猜測。
  • 核心亮點
    • 頂級推理與程式設計表現:獲得 Stripe CEO Patrick Collison 等業界領袖高度評價,在多項複雜任務中表現驚艷。
    • 背景引發熱議:由於能流暢回答敏感政治與地理問題,外界排除其為中國團隊作品,猜測可能來自微軟 MAI 團隊或未曝光的新創。
  • 技術規格:推理模型 / 支援程式碼編寫與持續代理任務 / 閉源預覽
  • 傳送門:https://techcrunch.com/2026/08/23/whos-behind-the-new-stealth-model-ox-alpha

Harvey Tenet — Harvey

  • 一言以蔽之:頂尖法律科技公司 Harvey 正式推出基於 Kimi K3 基座的後訓練法律專用模型 Harvey Tenet 研究預覽版。
  • 核心亮點
    • 長時程法律任務最佳化:針對複雜法律合約與長期上下文進行深度訓練,在 LAB 評測合約保留任務中較基座大幅提升 20%。
    • 企業級安全隔離:目前未直接公開 API 或權重,採限時企業預覽模式,確保法律合規性。
  • 技術規格:基於 Kimi K3 / 法律垂直領域後訓練 / 企業訂閱制
  • 傳送門:https://www.marktechpost.com/2026/08/23/harvey-tenet-post-trained-kimi-k3-legal-agent-model

產品發布/更新

Grok 語音與 Imagine 發現頁面更新 — xAI / Grok

  • 更新內容:xAI 旗下 Grok 語音模式新增了 Aurora 與 Liora 兩款全新高品質語音選項;同時 Grok Imagine 推出全新發現頁面,讓使用者能探索並測試照片編輯、影像縮放等 AI 影象功能。
  • 適用人群:AI 語音互動愛好者 / 內容創作者 / 一般大眾
  • 體驗通道

產業動態

開源模型 Token 佔比暴增至 62%,價效比轉折點引發產業變局 — Vercel AI Gateway

  • 事件概述:Vercel AI Gateway 最新統計資料顯示,平臺上的開源開放權重模型 Token 佔比在短短兩個月內從 28.4% 飆升至 62%,顯示企業端正加速擁抱開源方案。
  • 影響分析:隨著多 AI Agent 架構與高效執行框架的普及,開發者更傾向依賴高價效比的開源模型來降低營運成本,對閉源巨頭的市佔率形成實質挑戰。
  • 新聞連結

Anthropic 旗艦模型 Fable 5 面臨高價與市場需求考驗 — Financial Times / Simon Willison

  • 事件概述:根據《金融時報》與 Ramp AI 指數的最新資料顯示,Anthropic 於 7 月底推出的旗艦模型 Fable 5 由於 API 定價高昂(為 Opus 5 的兩倍),其在付費用量中僅佔 3.5% 至 6%。
  • 影響分析:高昂成本促使企業客戶更傾向按任務難度精準匹配模型,轉向價效比更高的前沿模型或開源替代品,也凸顯出高階 AI 模型的商業定價壓力。
  • 新聞連結:https://simonwillison.net/2026/Aug/23/anthropics-best-ai-model-struggles-to-attract-users-as-cheaper-t/

論文研究

免訓練遞迴架構與動態模型啟發演化 — Google DeepMind

  • 研究動機:探索如何在不重新訓練大型模型的前提下,利用模型自身的啟發式機制來動態修改與最佳化架構。
  • 核心創新:提出一種推理時「再迴圈」機制,將啟用狀態直接反饋回模型自身,無須重新訓練即可追蹤信念狀態,生成成本保持平穩。
  • 研究成果:在 Gemma 3 系列上進行測試,其自適應變體成功將困惑度降低 23%,GSM8k 數學準確率提升 21%,同時原始權重保持凍結。
  • 論文地址

Agent Lightning v1.0:以端到端代理強化學習框架解鎖效能 — 微軟

  • 研究動機:探討如何讓現有 AI AI Agent 無須大規模重寫程式碼,即可直接接入強化學習以提升複雜任務表現。
  • 核心創新:微軟推出 Agent Lightning v1.0,透過約 3,500 行的端點代理介面,實現現有 AI AI Agent 與強化學習的無縫對接。
  • 研究成果:在僅需 6K 訓練樣本的情況下,成功將 Qwen3.5-9B 模型在 SWE-bench Verified 上的表現從 41.8% 大幅提升至 56.4%。
  • 論文地址

其他分享

MerchantBench:評估 AI AI Agent 長期經營連貫性的全新基準 — 研究社群

  • 內容簡介:研究人員推出全新基準測試 MerchantBench,讓 AI AI Agent 模擬經營網店一整年,涵蓋選品、定價與現金流管理。測試發現,多數 AI Agent 雖然短期表現亮眼,但長期經營中常出現「沉默停止運作」或連貫性缺陷,這項基準強調必須精確追蹤執行頻率與長期穩定性,為未來 AI Agent 評估提供重要指標。
  • 傳送門

AliExpress 被爆利用「裝置音訊指紋」追蹤使用者引發隱私關注 — 產業觀察

  • 內容簡介:近期海外社群熱議跨境電商平臺 AliExpress 涉嫌使用一種極具爭議的底層技術來追蹤使用者。當使用者開啟網頁時,平臺會利用不同系統與音效卡在處理同一段數學波形時的微小差異生成「音訊指紋」,由於人耳聽不到,且會佔用音訊通道,導致使用者的藍芽耳機(如 AirPods)頻繁被強制切換至電腦端。這項技術因繞過 Cookie 攔截而引發資安與隱私界的高度關注。
  • 傳送門
分享至:
Featured Partners

© 2026 Communeify. All rights reserved.