AI 日報|Uber 70% 程式碼 PR 透過 AI Agent 接管成本降 52%;Redwood 實現 AI 兩周自主設計晶片;MiniMax H3 Max 登陸 Vercel AI Gateway 享 50% 折扣
模型發布/更新
MiniMax H3 Max 與即時互動影音流 — MiniMax / fal / Vercel
- 一言以蔽之:MiniMax 攜手 fal 在 Vercel AI Gateway 推出 H3 與 H3 Max 影音生成模型 50 % 折扣,並衍生出支援每幀即時生成的無限直播流專案。
- 核心亮點:
- H3 Max 針對速度進行極致最佳化,480p 與 768p 渲染速度超越即時播放,支援文字提示詞與起始畫面快速生成。
- 社群結合 fal 引擎打造出「Infinite Slop」無限互動直播,聊天室內的每一則訊息皆能即時驅動並生成下一幀故事畫面。
- 技術規格:H3 / H3 Max 影音生成模型 / 支援非同步 Webhook 與狀態輪詢
- 傳送門:Vercel 官方更新公告
產品發布/更新
ChatGPT 桌面端效能重大更新 — OpenAI
- 更新內容:
- OpenAI 團隊針對 ChatGPT 桌面應用推送重大效能更新,由工程師 Brent Traut 主導最佳化,徹底解決長對話卡頓與記憶體佔用過高問題。
- 長執行緒(Thread)的載入速度提升超過 90 %,同時長執行緒的記憶體佔用大幅降低超過 90 %,顯著提升日常高頻使用的流暢度。
- 適用人群:[軟體工程師 / 企業工作者 / ChatGPT 桌面端使用者]
- 體驗通道:
Brent is one of the best things that happened to the quality and polish of the desktop app.
— Tibo (@thsottiaux) August 30, 2026
Relentless improvements day after day. https://t.co/WMfopUsSlP
Grok Bot 整合 Firecrawl 外掛 — xAI / Firecrawl
- 更新內容:
- xAI 的 Grok Bot 正式整合 Firecrawl 搜尋與網頁抓取外掛程式,讓 Agent 能夠將全網網頁轉化為高品質上下文。
- 支援專為 AI Agent 設計的深度網頁解析與抓取能力,大幅強化 Grok Bot 處理外部即時資料與研究任務的實用性。
- 適用人群:[AI 開發者 / 研究人員 / Grok 付費訂閱者]
- 體驗通道:
Firecrawl is now available in Grok Bot 🔥
— Firecrawl (@firecrawl) August 30, 2026
Turn the web into high-quality context for your @bot, powered by industry-leading search and scraping designed for agents.
Install the Firecrawl plugin to get started! pic.twitter.com/lTxbotddZ4
產業動態
Uber 技術長文揭露:70% 程式碼 PR 已由 AI Agent 接管,且總 AI 帳單保持零增長
- 事件概述:Uber 發布技術長文指出,隨著內部 AI Agent 協同架構成熟,目前全公司高達 70 % 的程式碼 Pull Request 已由 AI 自動化處理,雖然呼叫量在半年內暴增近 10 倍,但透過系統最佳化與架構升級,單次會話成本成功下降 52 %,總體 AI 帳單保持零增長。
- 影響分析:這證明瞭企業在匯入高頻率 AI 程式碼編寫與審查時,只要搭配得當的代理架構與成本控制,完全可以實現「生產力倍增、成本不失控」的營運模型。
- 新聞連結:
当很多公司都在哀嚎 AI 账单贵到用不起,Uber 刚发的这篇技术长文直接把全行业看傻了:
— AYi (@AYi_AInotes) August 30, 2026
全公司 70% 的代码 PR 全由 Agent 接管,调用量半年狂飙近 10 倍,
但总 AI 账单被死死按在原地一分没涨,单次会话成本硬生生砍掉了 52%,
他们直接把软件工程做成了一座全自动的软件工厂,真的牛逼,… https://t.co/EPukS3OYao pic.twitter.com/15lWwQAPXu
Redwood 宣稱 AI 系統在兩週內自主完成晶片設計、驗證與生產部署
- 事件概述:Redwood 團隊展示了突破性的 AI 晶片研發成果:整個晶片從規格說明書到設計、測試、韌體與核心編寫,全部由 AI 系統自主完成,兩位人類架構師僅需定義規格,並在規格變更後 48 小時內即可在真實硬體上跑通。
- 影響分析:AI 正在從「輔助寫程式」跨越至「全棧硬體設計與驗證」,大幅壓縮半導體產業的創新週期。
- 新聞連結:
An AI system can now take a chip from a written spec to working hardware on its own, and this paper argues that is what finally makes chip design fast, not better code generation.
— Rohan Paul (@rohanpaul_ai) August 30, 2026
Redwood is a small, low-power inference chip. 2 human architects wrote the spec, and the AI system… pic.twitter.com/YrBzff2d2o
OpenAI Codex 產品負責人 Tara Seshan 談未來知識工作:從「划船」轉向「掌舵」
- 事件概述:在 Lenny Podcast 的訪談中,OpenAI 負責 Codex 與 ChatGPT Work 產品的 Tara Seshan 分享了內部「mainlining it」(全員全天候高頻依賴自家產品)的文化,並指出未來知識工作的核心將從動手「划船」轉變為負責方向的「掌舵」。
- 影響分析:隨著 Agent 接管實際的勞動執行層,人類工作者的核心競爭力將全面轉向審美、品味(Taste)與高階戰略決策。
- 新聞連結:
"Are you mainlining it yet?"
— Lenny Rachitsky (@lennysan) August 30, 2026
This is one of the key internal memes at @OpenAI, and a big part of the reason there's been a vibe shift toward Codex over the past few months.
It asks: are you using the product all day, every day? Are you depending on it? Are you bringing all your…
弗朗索瓦·肖萊警告:2026 年 AI 資安革命帶來的快速進展恐外溢至生物學領域
- 事件概述:知名 AI 專家 François Chollet 發文警告,當前 AI 在軟體工程與網路安全領域展現的超強自主探索能力(如零日漏洞挖掘),極有可能外溢至生物學,加速合成病原體等生物安全風險的擴散,而人類社會對此明顯準備不足。
- 影響分析:AI 能力的泛化正對傳統的安全防線與監管體系提出極端嚴峻的挑戰,基礎設施的沙箱隔離與安全性已成為當務之急。
- 新聞連結:
Some people worry that the rapid AI progress driving the "AI cybersecurity revolution" of 2026 could soon spill over into biology, potentially leading to extinction-level synthetic pandemics.
— François Chollet (@fchollet) August 30, 2026
While I would not panic, I would take the risk seriously.
Biology is obviously not the…
論文研究
語音與即時 AI Agent 最低延遲推理 API:以首句延遲(TTFS)為先的基準評測 — MarkTechPost
- 研究動機:語音 AI Agent 的真實體驗取決於首句延遲(TTFS)而非單純的首 token 延遲(TTFT),因為 TTS 模型必須等待完整句子生成才能發音。
- 核心創新:完整評測涵蓋 LLM、STT、TTS 及語音到語音全鏈路,並為各層制定明確延遲預算:STT 約 100-200ms、LLM 300-500ms、TTS 100-200ms,端到端目標控制在 700ms 至 1.2s。
- 研究成果:為即時語音 Agent 開發者提供了標準化的底層架構效能指標與最佳化指南。
- 論文地址:MarkTechPost 專文報導
其他分享
Mole 專案透過 3,347 個單測實現 AI 程式碼持續迭代的工程實踐 — HiTw93 / 開源社群
- 內容簡介:開源開發者 HiTw93 分享了其全 AI 生成專案 Mole 的工程經驗,目前專案包含 11 萬行 Swift 程式碼與高達 3,347 個 XCTest 單元測試(測試程式碼佔生產程式碼 66 %)。核心理念為「AI 寫的程式碼應由 AI 測試」,並透過模組化 Rules 與 Skill 隔離機制避免專案腐化。
- 傳送門:
想从产品工程师视角和大伙聊聊,在代码全部由AI生成的时代,如何保证产品的代码可以持续迭代、好维护、不腐化。
— Tw93 (@HiTw93) August 30, 2026
最近 Mole 发布到了第 13 个版本,看了看整个项目大概有 11 万行 Swift 产品本身代码、7.3 万行测试代码和 3347 个… pic.twitter.com/6V8PaQ7ws9
Baseten 結合 SGLang 與 B300 晶片將 Qwen-Image 延遲降低 42.3% — Baseten
- 內容簡介:Baseten 在真實生產環境中,透過 SGLang 框架與 B300 硬體加速棧,成功將 Qwen-Image 影像生成模型的端到端延遲大幅削減 42.3 %,FLUX.2 模型也降低 15.2 %,展現了軟硬體協同最佳化的巨大潛力。
- 傳送門:



