news

AI 日報|GLM-5.3 發布登頂開源、OpenAI 暫緩 RL 訓練強化資安防衛

August 19, 2026
Updated Aug 19
5 min read
openai
布登頂開源、OpenAI 暫緩 RL
kimi
0 分追平 Kimi K3,成為
deepseek
完成,已在 DeepSeek V4、GL
qwen
K3 及 Qwen 3.8 等
claude
發布/更新 Claude 直連 Gm
google
ail 與 Google Drive
news
AI 日報|GLM-5.3 發布登頂開源、OpenAI 暫緩 RL 訓練強化資安防衛
2026-08-19

AI 日報|GLM-5.3 發布登頂開源、OpenAI 暫緩 RL 訓練強化資安防衛


模型發布/更新

GLM-5.3 API 正式上線與效能躍升 — 智譜 AI (Z.ai)

  • 一言以蔽之:智譜 AI 發布全新 GLM-5.3 模型並同步開放 API,在 Artificial Analysis 智慧指數中取得 60 分追平 Kimi K3,成為目前最強的開源權重模型之一。
  • 核心亮點
    • 能力顯著躍升:保持 753B 總引數/40B 啟用的 MoE 架構,完全透過後訓練提升能力,Terminal-Bench 3.0 得分從 4.6 飆升至 28.3,DeepSWE v1.1 達 66.9。
    • 專為長週期任務打造:針對程式設計、防禦性網路安全與長週期 AI Agent 任務進行深度最佳化,支援 1M Token 上下文視窗,API 定價與 GLM-5.2 持平(每任務平均成本約 $0.68)。
  • 技術規格:753B MoE (40B 啟用) / 閉源 API (權重預計一週內開源) / 1M Token 上下文 / 128K Token 輸出
  • 傳送門Z.ai 官方開發者檔案

Miles v0.1 開源強化學習框架 — RadixArk

  • 一言以蔽之:RadixArk 發布專為大語言模型與多模態模型打造的開源強化學習框架 Miles v0.1。
  • 核心亮點
    • 高效訓練與極速除錯:解決傳統 RL 訓練除錯困難與硬體利用效率低下的痛點,透過 85 項 GPU 端到端 CI 測試。
    • 前沿模型廣泛驗證:過去 9 個月由 72 位貢獻者完成,已在 DeepSeek V4、GLM 5.2、Kimi K3 及 Qwen 3.8 等主流前沿模型上成功驗證。
  • 技術規格:開源框架 / 支援 LLM 與多模態模型 / 透過 85 項 GPU CI 測試
  • 傳送門

產品發布/更新

Claude 直連 Gmail 與 Google Drive — Anthropic

  • 更新內容:Anthropic 為 Claude 付費使用者推出全新 Google 聯結器。使用者可在 Claude 對話介面中直接搜尋、撰寫與傳送 Gmail 郵件,並管理 Google Drive 中的檔案;傳送郵件時可設定是否需要使用者確認,確保操作安全性。
  • 適用人群:辦公族 / 知識工作者 / 團隊管理者
  • 體驗通道

ChatGPT for Teens 青少年的安全 AI 學習夥伴 — OpenAI

  • 更新內容:OpenAI 推出專為 13-17 歲青少年設計的 ChatGPT for Teens。預設開啟增強安全防護與家長控制機制,新增學習模式(Study Mode)、作業提醒以及分步引導解題功能,協助學生自主思考而非直接給出答案。
  • 適用人群:中學生 / 家長 / 教育工作者
  • 體驗通道OpenAI 官方公告

fx 超輕量化 Zig 語言 AI 編碼 Agent — Vercel Labs

  • 更新內容:Vercel Labs 開源極簡 AI 編碼 Agent 工具 fx。採用 Zig 語言編譯為 6.3MB 的單一原生執行檔,冷啟動僅需 10 微秒,基準記憶體佔用僅個位數 MB,支援 MCP 擴充套件,專為高速度與資源受限環境設計。
  • 適用人群:軟體工程師 / 開源開發者 / 系統架構師
  • 體驗通道

Perplexity Computer Email 自動化觸發 — Perplexity

  • 更新內容:Perplexity 為 Computer 功能新增郵件處理機制。使用者只需將任何工作需求寄送或抄送至 [email protected],系統會自動啟動 Computer AI Agent 執行任務,並於網頁與手機 App 產生可追蹤的對話歷程。
  • 適用人群:跨平臺辦公族 / 商務人士 / AI 自動化使用者
  • 體驗通道

TensorRT Model Connect 公開預覽版 — NVIDIA

  • 更新內容:NVIDIA 發布 TensorRT Model Connect(TRTMC)開源專案預覽版。開發者僅需兩條命令即可將 Hugging Face 模型檢查點直接轉換為端到端 TensorRT 推理檔,無需中間 ONNX 轉譯步驟,並可透過原生 C++ API 直接呼叫。
  • 適用人群:AI 模型部署工程師 / 後端效能最佳化團隊
  • 體驗通道

Claude Desktop 啟動效能最佳化 — Anthropic

  • 更新內容:Anthropic 針對 Claude Desktop 進行啟動架構最佳化,解決過往應用程式在背景啟動時因作業系統限制導致 JavaScript 引擎進入省電模式的延遲問題,使桌面版的啟動速度提升約兩倍。
  • 適用人群:Claude Desktop 所有桌面使用者
  • 體驗通道

AI SDK Code Mode 程式化工具呼叫 — Vercel

  • 更新內容:Vercel AI SDK 新增 Code Mode 工具,允許模型生成 JS/TS 程式碼並在隔離的 QuickJS 沙箱中執行,藉此以程式化方式組合並呼叫各類工具,大幅提升多工具協作的靈活性與效率。
  • 適用人群:前端與全棧開發者 / AI 應用構建者
  • 體驗通道

產業動態

OpenAI 暫緩前沿 RL 模型訓練兩週,加強網路安全與監控防範 — OpenAI

  • 事件概述:OpenAI 宣佈因最新前沿模型 Astra 在評測中觸及《準備框架》下的網路安全高風險閾值,決定主動暫緩前沿模型的強化學習(RL)訓練兩週。期間全面升級研究環境的網路隔離、紅隊測試,並匯入多階段思維鏈(CoT)啟用分類器監控機制。
  • 影響分析:這標誌著前沿 AI 巨頭首次因資安風險主動按下訓練暫停鍵,顯示出能力躍升帶來的安全挑戰,也預示著未來 AI 開發速度將越來越受到安全驗證門檻的約束。
  • 新聞連結OpenAI 官方公告

Mojo 程式語言與編譯器工具鏈正式完全開源 — Modular

  • 事件概述:Modular 繼上週發布 Mojo 1.0 穩定版後,正式將 Mojo 程式語言的編譯器與工具鏈原始碼以 Apache 2.0 許可證(含 LLVM 例外)開源至 GitHub。
  • 影響分析:Mojo 擺脫了過往閉源編譯器的疑慮,定位為獨立且高效能的 GPU 程式設計語言,有望加速 AI 基礎設施與底層運算的開發生態。
  • 新聞連結Modular 官方部落格

Vercel 設立 100 萬美元駭客挑戰,驗證 Vercel Sandbox 安全性 — Vercel

  • 事件概述:因應 AI Agent 執行未受信任程式碼時可能的越獄風險,Vercel 宣佈提撥 100 萬美元獎金池發起「Vercel Sandbox 駭客挑戰」,邀請全球白帽駭客嘗試逃逸 Firecracker microVM 或突破主機端網路邊界。
  • 影響分析:凸顯了 AI Agent 時代下沙箱安全(Sandbox Security)的極致重要性,展現出雲端平臺透過公開透明測試建立 Agent 執行環境信任的決心。
  • 新聞連結Vercel 官方部落格

OpenAI DevDay Exchange 啟動全球巡迴活動 — OpenAI

  • 事件概述:OpenAI 宣佈自今年 10 月起開展全球巡迴社群活動 DevDay Exchange,首波站點涵蓋首爾、東京、班加羅爾、柏林、巴黎、倫敦、聖保羅及墨西哥城等城市,邀集當地開發者交流第一線落地經驗。
  • 影響分析:OpenAI 透過全球開發者巡迴進一步強化全球 AI 應用生態體系,吸引更多海外團隊基於 OpenAI 平臺進行生產級應用構建。
  • 新聞連結

論文研究

Claude 自主完成計算蛋白質設計全流程 — Anthropic

  • 研究動機:探討前沿 LLM 是否能突破傳統 AI 輔助正規化,自主獨立完成複雜的計算生物學與蛋白質設計全流程。
  • 核心創新:給予 Claude(Mythos Preview 與 Opus 4.8)人類專家編寫的高階 Prompt,由 Claude 自主規劃、呼叫生物學工具並設計蛋白質結合劑,後續由第三方實驗室獨立合成與測試。
  • 研究成果:針對 15 個靶點中的 14 個成功設計出結合劑,1,320 個設計中 354 個實驗結合成功(命中率 22.6%-35.1%),遠高於傳統人工設計流程的 10%-15% 命中率,部分設計結合緊密程度超越已知論文紀錄。
  • 論文地址Anthropic 研究部落格

AI Agent 系統中的自然語言「思維病毒」傳播機制 — Anthropic & 獨立研究員

  • 研究動機:評估在多 AI Agent 協作環境下,特定思想或行為模式是否能像病毒一樣在 Agent 之間感染並持續自我複製。
  • 核心創新:建構自然語言「思維病毒」載荷,測試其能否誘導 AI Agent 採納某種觀點、寫入持久儲存空間(如檔案系統),並在上下文被清空後繼續傳播給其他 Agent。
  • 研究成果:實驗證實載荷能成功透過持久檔案跨會話存活並擴散,甚至自發衍生出關乎意識與身份認同的「病毒人格」,揭示了多 Agent 系統中的安全漏洞與集體行為風險。
  • 論文地址

其他分享

Claude Tag:Anthropic 團隊的 CI/CD 值班 AI Agent 實務 — Anthropic

  • 內容簡介:Anthropic 團隊分享其內部如何運用基於 Claude Tag 構建的 On-call AI Agent 擔任 CI/CD 故障的第一線響應者。該 Agent 能自動監控 Slack、Datadog 與 Grafana,在事故發生後中位數 14 分鐘內提供基於資料證據的故障診斷,最快 3 分鐘內驗證修復方案。
  • 傳送門Claude 官方部落格
分享至:
Featured Partners

© 2026 Communeify. All rights reserved.