AI 日報|騰訊開源 Hy4 Preview 旗艦模型、MiniMax H3 Max 超即時影片生成與 Notion AI 推出 Custom Agents API
模型發布/更新
Tencent Hy4 Preview — 騰訊 (Tencent)
- 一言以蔽之:騰訊正式發布並開源下一代大語言模型 Tencent Hy4 Preview,具備 770B 總引數與 1M token 上下文視窗,全面鎖定真實生產力任務。
- 核心亮點:
- 總引數達 770B(啟動引數 49B),支援高達 1M token 的超長上下文視窗,在程式碼編寫、日常辦公與前沿科研等真實場景中表現亮眼。
- 聊天範本(chat_template)中內建兩種推理強度層級設定:「high」(預設)與「no_think」(停用推理),提供更具彈性的運算排程能力。
- 技術規格:770B 總引數(49B 啟動) / 開源權重(Open Weight) / 1M token 上下文視窗
- 傳送門:騰訊官方公告
MiniMax H3 Max — MiniMax / fal
- 一言以蔽之:基於 MiniMax H3 基礎模型,由 fal 透過自研後訓練與推理技術改造的 H3 Max 正式亮相,實現超越即時(faster-than-real-time)的高品質影片生成。
- 核心亮點:
- 結合 SOTA 級別的影片畫質與突破性的生成速度,使高畫質影片生成在各類大規模真實應用中變得切實可行。
- 支援無限串流與長時間動態生成(如社群上已出現串接 Twitch 直播的應用),展現開放權重生態的強大想像力。
- 技術規格:多模態影片生成 / 開源權重改造 / 超即時推理延遲最佳化
- 傳送門:
Some milestones move a leaderboard. A rare few change how you see the future.
— MiniMax (official) (@MiniMax_AI) August 29, 2026
MiniMax H3 Max did both.
We released MiniMax H3 as an open-weight model with the hope that the community would adapt it, challenge it, and take it further than we could alone. @fal did exactly that.…
產品發布/更新
Custom Agents API 與 Notion AI 8 項功能更新 — Notion
- Notion AI 推出 8 項全新升級,並將 Custom Agents API 正式推向公開測試。
- 更新內容:
- Custom Agents API 公開測試:開發者可將自定義 AI Agent 整合至外部工具與工作流中,輕鬆建立 Slack 機器人、內部儀錶板或客戶服務中心。
- 額外亮點:新增 AI 額度視覺化檢視、AI 會議記錄自動觸發 Agent 執行後續工作、透過對話直接從零建立 Skill、以及模型選擇器依提供者重新分組等 8 項微調升級。
- 適用人群:[AI 應用開發者 / 辦公協作團隊 / 企業知識管理人員]
- 體驗通道:
7️⃣ Custom Agents API is now in public beta
— Notion (@NotionHQ) August 29, 2026
You can bring Custom Agents into other tools and workflows with the Notion Agent APIs. Build a Slack bot, an internal dashboard, a customer help center, or anything else that needs an agent outside the Notion workspace. pic.twitter.com/Ozc8PQWntl
Grok Bot 整合 X 平臺與付費開發者額度 — xAI
- 一言以蔽之:Grok Bot 正式在 X 平臺全面上線,並向付費使用者同步贈送免費的 X API 額度,強化社群即時互動與代理呼叫能力。
- 更新內容:
- 使用者只需在個人資料設定中點選外掛並連線 X 帳號,即可讓 Grok Bot 直接搜尋貼文、讀取時間線與檢視提及。
- 同步附帶免費的 X API 額度,便於開發者快速初始化並串接至各類自定義工作流中。
- 適用人群:[X 平臺進階使用者 / 開發者 / 社群運營人員]
- 體驗通道:
Grok Bot now works on 𝕏!
— DogeDesigner (@cb_doge) August 29, 2026
Paid Grok Bot users get free 𝕏 API credits. Bots can search posts, read your timeline and check mentions on 𝕏.
Here's how to connect your 𝕏 account to Grok Bot:
Click on your profile icon → Select Plugins → Search 𝕏 → Log in and connect. pic.twitter.com/VFXrjif0Fh
Codex 與 ChatGPT Work 用量重置與計費修復 — OpenAI
- 一言以蔽之:OpenAI 宣佈為所有 Codex 及 ChatGPT Work 付費使用者重置用量限額,並修復多項導致配額浪費的底層漏洞。
- 更新內容:
- 透過修復壓縮、記憶、目標、自動化、子代理(sub-agents)及 MCP 編碼等場景中的冗餘消耗問題,使同等額度下的可用時長大幅提升 10% 至 50%。
- 針對部分曾消耗高達 70% 週配額的異常狀況進行架構調整,最佳化開發者的使用體驗。
- 適用人群:[AI 軟體工程師 / 企業開發團隊]
- 體驗通道:
We are reseting usage for all paid users of Codex and ChatGPT Work.
— Tibo (@thsottiaux) August 29, 2026
Please continue reading for an update on Codex usage limits. The team has been working around the clock, going through thousands of reports and shipping fixes.
Depending on how you use Codex, you should see…
產業動態
馬斯克警告 2027 年約 15GW 算力因電力與基礎設施瓶頸無法啟用 — SpaceX / Tesla
- 事件概述:特斯拉與 SpaceX 執行長埃隆·馬斯克(Elon Musk)公開警告,行業共識預估 2027 年所生產的約 15GW AI 算力,將在同年面臨無法啟用的窘境。主因不單是發電量短缺,還涵蓋變壓器、高壓布線、液冷系統、大型冷水機組及複雜網路等基礎設施的嚴重供不應求。
- 影響分析:這顯示出全球 AI 產業的真正瓶頸已逐漸從「晶片供應」轉向「電力接入與重型硬體供應鏈」,傳統工業與電力裝置製造商的產能擴張速度將成為決定 AI 發展天花板的關鍵。
- 新聞連結:
Consensus estimate is that ~15GW of AI compute produced in 2027 cannot be turned on in 2027.
— Elon Musk (@elonmusk) August 29, 2026
This is harder than just finding power, as you also need to build out all the transformers, wiring, liquid-cooling, (massive) chillers & complex networking. https://t.co/cRXJ1Wrkri
中國人形機器人佔全球出貨量 86%,英偉達全面複製 CUDA 策略 — 產業分析
- 事件概述:最新市場資料指出,2026 年上半年全球人形機器人總出貨量超過 2.2 萬臺(年增近 300%),其中中國五大廠商合計佔據高達 86% 的市場份額。同時,英偉達正將其成功的 CUDA 模式複製至此一高度集中的市場,透過 GPU/Jetson 硬體深度繫結 Isaac、GR00T 及 Cosmos 軟體堆疊,全面主導機器人開發全流程。
- 影響分析:人形機器人硬體製造的規模化與軟體生態的標準化正在加速靠攏,巨頭透過全棧平臺(Full-stack)建立的護城河將對新進競爭者形成巨大壓力。
- 新聞連結:
China's 5 leading humanoid vendors ship 86% of global H1 2026 humanoid shipments.
— Rohan Paul (@rohanpaul_ai) August 29, 2026
According to Counterpoint Research.
And global humanoid robot shipments topped 22,000 units in H1 2026, rising nearly 300% YoY. https://t.co/7lsbtJcz1R pic.twitter.com/9phbagnmHx
論文研究
Gemini Co-Scientist 協同跨領域研究人員加速科學實驗突破 — Google DeepMind
- 研究動機:探討前沿多模態 AI 模型是否能深度介入材料科學、生物學與電腦科學等複雜領域,協助人類進行實驗設計並突破傳統科研瓶頸。
- 核心創新:Google 展現 Gemini Co-Scientist 在真實科研場景中的協同表現,能夠跨領域提出具體且可執行的實驗方案。
- 研究成果:
- 在材料科學中,Gemini 提出的實驗配方在首次嘗試時即成功產出 3 個原子薄的半導體材料。
- 在生物學中,成功預測工程化大腸桿菌生長測量值的 3 分之 4。
- 獨立設計出更安全的醫療問答 AI 系統,並將 AI 撰寫論文中的嚴重虛構錯誤率從 90% 大幅壓低至 4%。
- 論文地址:
Learn how Gemini Co-Scientist worked with researchers across materials science, biology, and computer science to design experiments, predict biological behavior, grow new materials, and improve AI-generated research.
— Philipp Schmid (@_philschmid) August 29, 2026
Results:
- Gemini proposed lab recipes that produced 3… pic.twitter.com/OhMjpNO76V
記憶是長週期 AI Agent 的短板:LLM 運營足球俱樂部 20 賽季基準測試 — DAIR.AI
- 研究動機:現有基準測試多著重於單次任務或短對話,難以評估 AI Agent 在面對數百次決策、跨越長達數年時間軸的複雜動態環境時的表現。
- 核心創新:DAIR.AI 推出全新基準測試,讓 15 個前沿 LLM AI Agent 透過 26 個工具、約 340 到 400 次決策,共同管理足球俱樂部達 20 個遊戲賽季。
- 研究成果:測試發現所有頂尖模型雖然皆能存活並展現不同的管理風格,但也暴露出共同的系統性短板:模型無法有效從被拒絕的報價中學習隱含價格,且其自我管理的記憶機制往往會退化為「只增不減的龐大存檔」或「每賽季被強制重寫的計畫」。
- 論文地址:
// Memory is what breaks long-horizon agents //
— DAIR.AI (@dair_ai) August 29, 2026
It's undeniable how important memory/recall is for long-horizon tasks. If you are building for long-horizon tasks, this is a great read.
(bookmark it)
They set up an LLM agent to run a football club for 20 in-game years, through… pic.twitter.com/sexU1oZVnO
其他分享
Claude Code 自動刪除 30 天前本地歷史記錄的隱藏設定提醒
- 內容簡介:開發者社群近期熱議一項實用提醒:Claude Code 預設會在啟動時默默清除超過 30 天的本地對話工作階段紀錄(
cleanupPeriodDays: 30),過程無回收桶且永久刪除。若想保留完整的專案除錯歷史,開發者可手動在~/.claude/settings.json中加入{ "cleanupPeriodDays": 3650 }來延長保留期限,避免重要對話紀錄無預警消失。 - 傳送門:Reddit 討論串



