news

AI 日報|Grok Voice 2.0 登頂、Anthropic 引入 Accenture 獨立評估、Figure Helix 2.5 零樣本居家任務

September 19, 2026
Updated Sep 19
2 min read
grok
AI 日報|Grok Voice
anthropic
.0 登頂、Anthropic 引入 Ac
xai
2.0 — xAI 一言以蔽之
qwen
— 阿里雲 Qwen 一言以蔽之
jina
官方部落格 jina-ocr-v
nvidia
草稿頭,在 NVIDIA L4 等低
news
AI 日報|Grok Voice 2.0 登頂、Anthropic 引入 Accenture 獨立評估、Figure Helix 2.5 零樣本居家任務
2026-09-19

AI 日報|Grok Voice 2.0 登頂、Anthropic 引入 Accenture 獨立評估、Figure Helix 2.5 零樣本居家任務


模型發布/更新

Grok Voice Transcribe 2.0 — xAI

  • 一言以蔽之:xAI 正式發布 Grok Voice Transcribe 2.0,在多語言語音轉寫準確度上表現亮眼,成功登頂 Artificial Analysis 串流榜單首位。
  • 核心亮點
    • 轉寫準確度翻倍:在客服通話、口述憑證與短語音指令等複雜場景下的錯誤率較前代大幅降低。
    • 超高價效比:支援 Grok Voice API,批次處理定價為每小時 0.10 美元,串流模式為每小時 0.20 美元。
  • 技術規格:多語言流式轉寫 / 支援批次與串流 API / 人工智慧轉寫準確度第一梯隊
  • 傳送門

Qwen3.8-LiveTranslate — 阿里雲 Qwen

  • 一言以蔽之:Qwen 推出全新 Qwen3.8-LiveTranslate 即時同聲傳譯模型,採用 Interleave 架構與 Hybrid-MoE 雙引擎重構,將平均滯後時間(LAAL)壓縮至 2.3 秒。
  • 核心亮點
    • 架構創新:結合 Interleave 互動架構與 Hybrid-MoE Thinker-Talker 設計,兼顧翻譯準確度與極低延遲。
    • 即時流暢:有效解決長語句同步與語意對齊問題,大幅提升跨語言語音 AI Agent 的互動體驗。
  • 技術規格:MoE 架構 / 支援即時雙向語音 / 平均滯後 2.3 秒
  • 傳送門Qwen 官方部落格

jina-ocr-v1 — Jina AI

  • 一言以蔽之:Jina AI 發布總引數 3.4B、每 token 僅啟用 570M 的緊湊型端到端檔案解析模型,主打低預算 GPU 上的高效能圖文轉換。
  • 核心亮點
    • 高效前置壓縮:透過 DeepEncoder 將視覺 Patch 高效壓縮,大幅降低 Prefill 計算開銷與 KV Cache 佔用。
    • 推測解碼加強:內建專門設計的推測解碼草稿頭,在 NVIDIA L4 等低成本顯示卡上實現近乎翻倍的生成速度且完全無損。
  • 技術規格:3.4B MoE 架構(啟用 570M) / 吞吐量達 2.57 頁/秒 / 支援 OmniDocBench 與 olmOCR-Bench
  • 傳送門MarkTechPost 報導

產品發布/更新

Helix 2.5 — Figure

  • 更新內容:人形機器人公司 Figure 發表最新神經網路模型 Helix 2.5,並公開零樣本全身自主實驗。機器人在未曾採集資料、未經微調的 30 個陌生家庭中,成功完成客廳整理、鋪床與折毛巾等長時程全身任務,將零樣本成功率從 9% 大幅推升至 56%,展現強大的跨環境實體泛化能力。
  • 適用人群:[人形機器人開發者 / 實體 AI 研究人員 / 自動化產業從業者]
  • 體驗通道微信公眾號報導

AGENTS.md 專案指令支援 — Claude Code v2.1.277 / Anthropic

  • 更新內容:Claude Code 官方發布 v2.1.277 更新,正式引入對 AGENTS.md 檔案的原生支援。當專案資料夾中沒有 CLAUDE.md 時,Claude Code 將自動檢測並讀取 AGENTS.md 作為專案執行規則。開發者也可透過 /config 指令自由切換或自訂專案指令,解決多平臺協作時規則檔案不統一的痛點。
  • 適用人群:[軟體開發者 / Claude Code 重度使用者 / AI 輔助工程師]
  • 體驗通道GitHub Release 官方公告

產業動態

Anthropic 與 Accenture 達成 5 年至少 10 億美元合作,引入嵌入式獨立評估

  • 事件概述:Anthropic 宣佈與全球專業服務巨頭 Accenture(透過旗下 AI 業務 Faculty)達成重大戰略合作,由 Accenture 派駐專家團隊擔任首個「第三方嵌入式評估方」,在 Anthropic 內部常態化進行前沿模型的紅隊測試、對齊評估與安全防護測試,雙方未來五年預計將投入至少 10 億美元擴充相關容量。
  • 影響分析:標誌著前沿 AI 實驗室開始引入外部獨立機構進行深度合規與安全嵌入,有助於緩解公眾對封閉式模型安全透明度的疑慮。
  • 新聞連結Anthropic 官方新聞稿

AI 幻覺情報險些觸發美軍對華軍事行動

  • 事件概述:據 CNN 獨家報導,今年春季美伊衝突期間,美軍特種作戰司令部一名分析員利用 AI 聊天機器人綜合開源資料與機密訊號情報,因 AI 模型產生幻覺誤判一艘中東航行的中國船隻載有核武部件。美軍一度讓軍機升空並做好武裝登船準備,所幸在行動執行的最後一刻進行人工覆核,及時叫停了一場險些引發衝突的危機。
  • 影響分析:這起事件暴露出軍方在加速整合 AI 時,缺乏統一的人工校驗標準與安全流程。當 AI 產生的錯誤情報被直接包裝成標準官方報告並在內部流傳時,極易引發災難性後果。
  • 新聞連結CNN 專題報導

安全研究團隊利用 Claude 串聯漏洞,72 小時內攻破 OpenAI 內部員工賬戶

  • 事件概述:安全公司 Hacktron 的研究員揭露,他們在 7 月 25 日利用兩個高危漏洞(包含 Discourse 圖片上傳引發的 libheif 堆溢位與 SSO 單點登入缺陷),成功在 72 小時內接管了多名 OpenAI 員工的 ChatGPT 與 Codex 帳號。攻擊程式碼主要由 Anthropic 的 Claude 編寫,研究員僅在內部程式碼庫提交了一個無害的 PR 證明許可權即停止。
  • 影響分析:凸顯出當前 AI 輔助攻擊能力正以極高速度演進,企業級身份認證與第三方開源元件的安全性面臨嚴峻挑戰。
  • 新聞連結

論文研究

An Empirical Study of Harness Design for Coding Agents — 研究團隊 / 論文 (ArXiv)

  • 研究動機:隨著程式碼編寫 AI Agent 普及,開發者在規劃、動作空間與上下文管理等測試平臺(Harness)設計上面臨諸多取捨,過去缺乏系統性的實證評估。
  • 核心創新:研究團隊在 176 組匹配設定與 4 個主流模型上,結合 SWE-Bench Verified 與 Terminal-Bench 2.1 基準,深入評估不同 harness 架構對程式設計 AI Agent 效能的影響。
  • 研究成果:量化分析了規劃策略與上下文分配的最佳實踐,為工程師在建構高可靠性編碼 AI Agent 系統時提供明確的架構指導方針。
  • 論文地址

其他分享

AgentCloak:兼顧隱私與上下文的 AI 提示詞脫敏擴充功能

  • 內容簡介:一款免費且開源的瀏覽器擴充功能 AgentCloak,專為在 ChatGPT 或 Claude 等平臺上使用 AI 時保護個人隱私而設計。它會在傳送提示詞前自動將真實姓名、電話、地址等敏感資訊替換為逼真的虛構資料,並在 AI 回覆時無縫還原,讓使用者在除錯日誌或處理客服工單時既能保有完整上下文,又不會外洩個人隱私。
  • 傳送門
分享至:
Featured Partners

© 2026 Communeify. All rights reserved.