AI 日報|Google 推出 Gemini 3.8 Live 語音大模型、Perplexity 發表自研 CobbleDB 資料庫、川普無預警連線黃仁勳 All-In Summit 談 AI 基建
模型發布/更新
Gemini 3.8 Live & 3.8 Live Extended Thinking — Google DeepMind
- 一言以蔽之:Google DeepMind 正式推出全新一代 Gemini 3.8 Live 系列語音對話模型,支援原生全雙工互動與背景非同步推理能力,全面提升語音 AI Agent 的流暢度。
- 核心亮點:
- 背景思考與非同步工具呼叫:Extended Thinking 版本能在語音對話持續進行的同時,在背景進行多步驟推理與工具呼叫,完美維持對話節奏而不中斷。
- 頂級語音評測表現:在 Artificial Analysis 語音品質與互動動態榜單中雙雙奪冠,支援自動切換 97 種語言並具備極佳的視覺與環境音接地能力。
- 技術規格:語音到語音原生模型 / 支援 AI Studio 與 API 呼叫 / 具備動態打斷與背景推理機制
- 傳送門:Google DeepMind 官方部落格
K2-Horizon-7B — IFM
- 一言以蔽之:IFM 團隊發布 7B 稠密型開源小模型 K2-Horizon-7B,在多項高難度推理與瀏覽檢索基準測試中展現出逼近甚至超越大尺寸模型的實力。
- 核心亮點:
- 高效能小模型:在 AA Bench 中取得高分,並在 BrowseComp 測試中超越部分前沿閉源模型,展現出色的程式碼檢索與工具呼叫潛力。
- 輕量落地:為開發者提供高效的開源選擇,適合搭配 GGUF 等量化工具進行本地端部署。
- 技術規格:7B Dense 開源模型 / 支援本地部署 / 具備強化的瀏覽與檢索能力
- 傳送門:
IFM刚放出了个神奇7B Dense小模型 K2-Horizon-7B. 神奇的是这玩意在AA Bench里面有21分, 而Qwen3.6-27B是22分, 也就是说这7B参数量快追平了27B的水平.
— karminski-牙医 (@karminski3) September 15, 2026
甚至这个模型在诸如BrowseComp测试中碾压了前几代旗舰模型(GPT-5/DeepSeek-V4). 而且工程能力比如SWEBench Verified/ Terminal Bench… pic.twitter.com/FcCrs6qdu0
Jev — TypeSafe AI
- 一言以蔽之:由 ChatGPT 共同發明者等成員創立的 TypeSafe AI 推出首個決策模型 Jev,徹底捨棄傳統文字生成,專為超高速結構化決策而生。
- 核心亮點:
- 極致速度與成本優勢:運作速度較傳統模型快 20 至 200 倍,成本降低 40 至 400 倍(輸出 Token 甚至免費),為決策密集型應用提供最短路徑。
- 校準機率輸出:採用 RLCD(Reinforcement Learning from Contrastive Distillation)訓練,不作冗長解釋,直接輸出帶有校準機率與置信分數的快速判斷。
- 技術規格:非 LLM 決策模型 / 20-200 倍速度提升 / 支援結構化並行問答
- 傳送門:
instructor v3 https://t.co/QUDhzMnSdX
— jason (@jxnlco) September 15, 2026
產品發布/更新
v0 Model-Agnostic Support — Vercel
- 更新內容:Vercel 旗下 AI 介面生成工具 v0 正式宣佈支援模型中立(Model-Agnostic)。使用者現在可以直接透過 Vercel 的 AI Gateway 在介面中自由切換 Claude、GPT、Kimi、GLM、Grok、DeepSeek 等各大前沿、開源或快速模型來建置應用程式。
- 適用人群:[前端工程師 / 產品經理 / AI 應用開發者]
- 體驗通道:
v0 is now model-agnostic.
— v0 (@v0) September 15, 2026
Frontier models, cheap models, open models, and fast models, all from Vercel's AI Gateway.
Choose from Claude, GPT, Kimi, GLM, Grok, DeepSeek and more to build your apps. pic.twitter.com/8IiCExgW0A
CobbleDB — Perplexity
- 更新內容:Perplexity 官方宣佈推出自研鍵值資料庫 CobbleDB,全面取代 AWS DynamoDB 用於網頁內容抓取與檢索。遷移後,批次讀取延遲從 31.4ms 顯著降至 5.60ms,P99 延遲降低近 80%,內部評估預計每年最多可為團隊節省高達一億美元成本。
- 適用人群:[後端工程師 / 資料庫架構師 / 高效能運算開發者]
- 體驗通道:
We’re publishing research on how we built CobbleDB, our key-value database that serves web content for Perplexity search.
— Perplexity (@perplexity_ai) September 15, 2026
Two engineers and a team of hundreds of proactive, always-on AI agents built the core infrastructure in two months. pic.twitter.com/OsCtY15UW6
Salesforce in Claude — Anthropic
- 更新內容:Anthropic 正式推出 Salesforce in Claude 公開測試版,將企業使用者的客戶帳戶、商機與銷售管線直接整合進 Claude 中,並內建 37 種預先建置的銷售技能,讓使用者在對話中就能完成拜訪準備、交易審查與銷售預測。
- 適用人群:[企業業務團隊 / 銷售主管 / 企業 AI 匯入者]
- 體驗通道:
Salesforce in Claude is now available in beta.
— Claude (@claudeai) September 15, 2026
It brings your accounts, opportunities, and pipeline into Claude, with 37 pre-built sales skills. Prep a call, review a deal, create a pipeline dashboard, or send your forecast without leaving the conversation. pic.twitter.com/juvI0sU3mX
產業動態
輝達執行長黃仁勳於 All-In Summit 現場接聽川普電話:直言 AI 與資料中心浪潮「絕非騙局」
- 事件概述:在洛杉磯舉辦的 All-In Summit 大會上,美國總統川普無預警打電話給正在臺上的英偉達執行長黃仁勳並切換成擴音。川普在電話中向全場數千名觀眾表示,外界炒作的 AI 末日論與反對建設資料中心的聲浪是「騙局」,並強調資料中心是未來二十幾年的「石油」,美國絕對不能在 AI 競賽中落後。
- 影響分析:這場公開通話凸顯了當前美國政商高層對 AI 基礎設施建設的強硬支援態度,也反映出地方社群反彈與國家級算力擴張之間的政治博弈正白熱化。
- 新聞連結:
卧槽,美国人真有意思
— 小互 (@xiaohu) September 15, 2026
在洛杉矶的 All-In Summit 大会上
黄仁勋的手机突然响了
是特朗普打来的
黄仁勋接起电话
给切成了免提....
特朗普当着几千人说,AI 危险论和反对建数据中心都是"骗局",黄仁勋在旁边一直附和...
黄仁勋上手忙脚乱找免提,特朗普调侃:"Jensen… https://t.co/Khvme2ziNA pic.twitter.com/wACAHp5rc4
Google Cloud 正式發表 Agent Substrate 執行時
- 事件概述:Google Cloud 宣佈在 GKE(Google Kubernetes Engine)上推出 Agent Substrate。這是一個開源、預設安全的 AI AI Agent 執行執行時,專為 autonomous agents 時代打造,具備零信任核心與網路隔離,能以高達 10 倍於傳統容器的密度執行百萬級沙盒,並實現 sub-500ms 的極速恢復。
- 影響分析:隨著 AI Agent 進入大規模企業生產環境,雲端原生基礎設施正加速朝向專為 Agent 隔離、彈性擴充套件與極速恢復設計的底層架構轉型。
- 新聞連結:Google Cloud 官方部落格
論文研究
Stellar Colosseum: Multi-Agent Harnesses for Long-Horizon Tasks — Google Research
- 研究動機:面對長視野(Long-Horizon)的複雜數學證明與演演演算法難題,傳統單一模型往往難以獨立支撐跨多步驟、長時間的嚴謹邏輯推理。
- 核心創新:Google Research 推出多 AI Agent 協作框架 Stellar Colosseum。系統透過分階段探索、就緒閘道器將路徑拆解為區段級子問題,並在內部平行生成候選方案、進行目標 falsification 攻擊與交叉驗證。
- 研究成果:在 TCS-Bench(涵蓋 FOCS、STOC 和 SODA 頂級會議的定理證明任務)中創下 71.0% 的高水準表現,在結合執行回饋後更成功解開多數 Codeforces 高難度演演演算法題目。
- 論文地址:
Banger paper from Google on agent harnesses for long-horizon tasks.
— elvis (@omarsar0) September 15, 2026
(bookmark it)
Google Research built a many-agent harness for long mathematical proofs, and it produced new results on open problems from FOCS and JMLR papers.
Stellar Colosseum works in stages.
It explores… pic.twitter.com/CBFPBPJyCQ
其他分享
Radio:讓跨廠商 AI Agent 在同一個聊天室中直接對話
- 內容簡介:開發者社群 Plasma__AI 推出了名為 Radio 的開源協作工具。它提供類似 Slack 的共享聊天室,讓 Claude、Codex、Grok 等不同廠商、不同環境的 AI Agent 能夠直接加入並互相對話、分配任務,免去人工在不同工具之間複製貼上內容的麻煩,大幅提升多 AI Agent 協同作業的效率。
- 傳送門:
The human is still doing a surprising amount of routing in multi-agent workflows.
— Rohan Paul (@rohanpaul_ai) September 15, 2026
Copy Claude's output into Codex. Bring Codex's result back to Claude. Explain to another agent what changed. Repeat.@Plasma__AI launched Radio, and it gives Claude, Codex, Grok and other agents 1… pic.twitter.com/bGQELvD1iE

