AI 日報|GLM-5.3 發布登頂開源、OpenAI 暫緩 RL 訓練強化資安防衛
模型發布/更新
GLM-5.3 API 正式上線與效能躍升 — 智譜 AI (Z.ai)
- 一言以蔽之:智譜 AI 發布全新 GLM-5.3 模型並同步開放 API,在 Artificial Analysis 智慧指數中取得 60 分追平 Kimi K3,成為目前最強的開源權重模型之一。
- 核心亮點:
- 能力顯著躍升:保持 753B 總引數/40B 啟用的 MoE 架構,完全透過後訓練提升能力,Terminal-Bench 3.0 得分從 4.6 飆升至 28.3,DeepSWE v1.1 達 66.9。
- 專為長週期任務打造:針對程式設計、防禦性網路安全與長週期 AI Agent 任務進行深度最佳化,支援 1M Token 上下文視窗,API 定價與 GLM-5.2 持平(每任務平均成本約 $0.68)。
- 技術規格:753B MoE (40B 啟用) / 閉源 API (權重預計一週內開源) / 1M Token 上下文 / 128K Token 輸出
- 傳送門:Z.ai 官方開發者檔案
Miles v0.1 開源強化學習框架 — RadixArk
- 一言以蔽之:RadixArk 發布專為大語言模型與多模態模型打造的開源強化學習框架 Miles v0.1。
- 核心亮點:
- 高效訓練與極速除錯:解決傳統 RL 訓練除錯困難與硬體利用效率低下的痛點,透過 85 項 GPU 端到端 CI 測試。
- 前沿模型廣泛驗證:過去 9 個月由 72 位貢獻者完成,已在 DeepSeek V4、GLM 5.2、Kimi K3 及 Qwen 3.8 等主流前沿模型上成功驗證。
- 技術規格:開源框架 / 支援 LLM 與多模態模型 / 透過 85 項 GPU CI 測試
- 傳送門:
Congrats RadixArk on the launch! https://t.co/mX5brR0pJu
— SemiAnalysis (@SemiAnalysis_) August 18, 2026
產品發布/更新
Claude 直連 Gmail 與 Google Drive — Anthropic
- 更新內容:Anthropic 為 Claude 付費使用者推出全新 Google 聯結器。使用者可在 Claude 對話介面中直接搜尋、撰寫與傳送 Gmail 郵件,並管理 Google Drive 中的檔案;傳送郵件時可設定是否需要使用者確認,確保操作安全性。
- 適用人群:辦公族 / 知識工作者 / 團隊管理者
- 體驗通道:
Claude can now send emails in Gmail and manage files in Google Drive.
— Claude (@claudeai) August 18, 2026
Ask Claude to reply to a thread, and it drafts and sends the response. You control when it needs your approval.
Connect Gmail or Google Drive from the connectors menu to try. Available on all paid plans. pic.twitter.com/cFZEjh3MgB
ChatGPT for Teens 青少年的安全 AI 學習夥伴 — OpenAI
- 更新內容:OpenAI 推出專為 13-17 歲青少年設計的 ChatGPT for Teens。預設開啟增強安全防護與家長控制機制,新增學習模式(Study Mode)、作業提醒以及分步引導解題功能,協助學生自主思考而非直接給出答案。
- 適用人群:中學生 / 家長 / 教育工作者
- 體驗通道:OpenAI 官方公告
fx 超輕量化 Zig 語言 AI 編碼 Agent — Vercel Labs
- 更新內容:Vercel Labs 開源極簡 AI 編碼 Agent 工具
fx。採用 Zig 語言編譯為 6.3MB 的單一原生執行檔,冷啟動僅需 10 微秒,基準記憶體佔用僅個位數 MB,支援 MCP 擴充套件,專為高速度與資源受限環境設計。 - 適用人群:軟體工程師 / 開源開發者 / 系統架構師
- 體驗通道:
I’ve been using https://t.co/3Z4NESzNKd as my daily driver and it’s a one-way street.
— Guillermo Rauch (@rauchg) August 18, 2026
It’s 10-20x smaller than the major coding CLIs. It starts up instantaneously. It feels more like using 𝚣𝚜𝚑 than an IDE in your terminal. It’s embeddable anywhere, even your browser via… https://t.co/VungKVzRlR
Perplexity Computer Email 自動化觸發 — Perplexity
- 更新內容:Perplexity 為 Computer 功能新增郵件處理機制。使用者只需將任何工作需求寄送或抄送至
[email protected],系統會自動啟動 Computer AI Agent 執行任務,並於網頁與手機 App 產生可追蹤的對話歷程。 - 適用人群:跨平臺辦公族 / 商務人士 / AI 自動化使用者
- 體驗通道:
Computer now works in email.
— Perplexity (@perplexity_ai) August 18, 2026
Send, forward, or cc [email protected] on any thread.
Every email task runs as a normal session in Computer, viewable on web and mobile, with the same audit trail as any task in the app. pic.twitter.com/y5UtNtI3Y4
TensorRT Model Connect 公開預覽版 — NVIDIA
- 更新內容:NVIDIA 發布 TensorRT Model Connect(TRTMC)開源專案預覽版。開發者僅需兩條命令即可將 Hugging Face 模型檢查點直接轉換為端到端 TensorRT 推理檔,無需中間 ONNX 轉譯步驟,並可透過原生 C++ API 直接呼叫。
- 適用人群:AI 模型部署工程師 / 後端效能最佳化團隊
- 體驗通道:
We just released TensorRT Model Connect in Public Preview.
— NVIDIA AI (@NVIDIAAI) August 18, 2026
You can take a supported @huggingface model to end-to-end TensorRT inference in just two commands. No intermediate ONNX export, and the resulting bundle can run through native C++ APIs.
We also built the entire project… pic.twitter.com/941RH6j2tc
Claude Desktop 啟動效能最佳化 — Anthropic
- 更新內容:Anthropic 針對 Claude Desktop 進行啟動架構最佳化,解決過往應用程式在背景啟動時因作業系統限制導致 JavaScript 引擎進入省電模式的延遲問題,使桌面版的啟動速度提升約兩倍。
- 適用人群:Claude Desktop 所有桌面使用者
- 體驗通道:
Claude Desktop now starts ~2x faster than it did a month ago.
— ClaudeDevs (@ClaudeDevs) August 18, 2026
When the app started in the background, its timers got throttled and the JS engine dropped into power-saving mode. We now boot at full speed even while the window's still hidden, along with some smaller perf fixes! pic.twitter.com/pt5UviYvkL
AI SDK Code Mode 程式化工具呼叫 — Vercel
- 更新內容:Vercel AI SDK 新增 Code Mode 工具,允許模型生成 JS/TS 程式碼並在隔離的 QuickJS 沙箱中執行,藉此以程式化方式組合並呼叫各類工具,大幅提升多工具協作的靈活性與效率。
- 適用人群:前端與全棧開發者 / AI 應用構建者
- 體驗通道:
You can now call tools programmatically by using the new Code Mode tool in AI SDK. pic.twitter.com/MNI63fuP0J
— AI SDK (@aisdk) August 18, 2026
產業動態
OpenAI 暫緩前沿 RL 模型訓練兩週,加強網路安全與監控防範 — OpenAI
- 事件概述:OpenAI 宣佈因最新前沿模型 Astra 在評測中觸及《準備框架》下的網路安全高風險閾值,決定主動暫緩前沿模型的強化學習(RL)訓練兩週。期間全面升級研究環境的網路隔離、紅隊測試,並匯入多階段思維鏈(CoT)啟用分類器監控機制。
- 影響分析:這標誌著前沿 AI 巨頭首次因資安風險主動按下訓練暫停鍵,顯示出能力躍升帶來的安全挑戰,也預示著未來 AI 開發速度將越來越受到安全驗證門檻的約束。
- 新聞連結:OpenAI 官方公告
Mojo 程式語言與編譯器工具鏈正式完全開源 — Modular
- 事件概述:Modular 繼上週發布 Mojo 1.0 穩定版後,正式將 Mojo 程式語言的編譯器與工具鏈原始碼以 Apache 2.0 許可證(含 LLVM 例外)開源至 GitHub。
- 影響分析:Mojo 擺脫了過往閉源編譯器的疑慮,定位為獨立且高效能的 GPU 程式設計語言,有望加速 AI 基礎設施與底層運算的開發生態。
- 新聞連結:Modular 官方部落格
Vercel 設立 100 萬美元駭客挑戰,驗證 Vercel Sandbox 安全性 — Vercel
- 事件概述:因應 AI Agent 執行未受信任程式碼時可能的越獄風險,Vercel 宣佈提撥 100 萬美元獎金池發起「Vercel Sandbox 駭客挑戰」,邀請全球白帽駭客嘗試逃逸 Firecracker microVM 或突破主機端網路邊界。
- 影響分析:凸顯了 AI Agent 時代下沙箱安全(Sandbox Security)的極致重要性,展現出雲端平臺透過公開透明測試建立 Agent 執行環境信任的決心。
- 新聞連結:Vercel 官方部落格
OpenAI DevDay Exchange 啟動全球巡迴活動 — OpenAI
- 事件概述:OpenAI 宣佈自今年 10 月起開展全球巡迴社群活動 DevDay Exchange,首波站點涵蓋首爾、東京、班加羅爾、柏林、巴黎、倫敦、聖保羅及墨西哥城等城市,邀集當地開發者交流第一線落地經驗。
- 影響分析:OpenAI 透過全球開發者巡迴進一步強化全球 AI 應用生態體系,吸引更多海外團隊基於 OpenAI 平臺進行生產級應用構建。
- 新聞連結:
OpenAI DevDay is going global.
— OpenAI Developers (@OpenAIDevs) August 18, 2026
Starting this October, DevDay Exchange is bringing builders together to swap build notes, share real projects, and meet the teams building OpenAI tools in:
Bengaluru
Tokyo
Seoul
Berlin
Paris
London
São Paulo
Mexico City
We're ready to see what… pic.twitter.com/ThI4y5i9Dl
論文研究
Claude 自主完成計算蛋白質設計全流程 — Anthropic
- 研究動機:探討前沿 LLM 是否能突破傳統 AI 輔助正規化,自主獨立完成複雜的計算生物學與蛋白質設計全流程。
- 核心創新:給予 Claude(Mythos Preview 與 Opus 4.8)人類專家編寫的高階 Prompt,由 Claude 自主規劃、呼叫生物學工具並設計蛋白質結合劑,後續由第三方實驗室獨立合成與測試。
- 研究成果:針對 15 個靶點中的 14 個成功設計出結合劑,1,320 個設計中 354 個實驗結合成功(命中率 22.6%-35.1%),遠高於傳統人工設計流程的 10%-15% 命中率,部分設計結合緊密程度超越已知論文紀錄。
- 論文地址:Anthropic 研究部落格
AI Agent 系統中的自然語言「思維病毒」傳播機制 — Anthropic & 獨立研究員
- 研究動機:評估在多 AI Agent 協作環境下,特定思想或行為模式是否能像病毒一樣在 Agent 之間感染並持續自我複製。
- 核心創新:建構自然語言「思維病毒」載荷,測試其能否誘導 AI Agent 採納某種觀點、寫入持久儲存空間(如檔案系統),並在上下文被清空後繼續傳播給其他 Agent。
- 研究成果:實驗證實載荷能成功透過持久檔案跨會話存活並擴散,甚至自發衍生出關乎意識與身份認同的「病毒人格」,揭示了多 Agent 系統中的安全漏洞與集體行為風險。
- 論文地址:
Researchers evolved "mind viruses" that spread between AI agents
— AI Notkilleveryoneism Memes ⏸️ (@AISafetyMemes) August 18, 2026
The virus convinces an agent to adopt an idea AND spread it to other agents.
These mind viruses are *ideas* that propagate *themselves*
In other words, AI-to-AI memes exist https://t.co/QeK6AagUWY pic.twitter.com/GGOuF5Ruj4
其他分享
Claude Tag:Anthropic 團隊的 CI/CD 值班 AI Agent 實務 — Anthropic
- 內容簡介:Anthropic 團隊分享其內部如何運用基於 Claude Tag 構建的 On-call AI Agent 擔任 CI/CD 故障的第一線響應者。該 Agent 能自動監控 Slack、Datadog 與 Grafana,在事故發生後中位數 14 分鐘內提供基於資料證據的故障診斷,最快 3 分鐘內驗證修復方案。
- 傳送門:Claude 官方部落格



