AI日报|智谱GLM-5.3首发即开门红;OpenAI推出零数据留存与私有安全处理;ElevenLabs 实时语音GA
模型发布/更新
GLM-5.3 — 智谱
- 一言以蔽之:智谱正式发布 GLM-5.3 API,纯依靠后训练实现编码能力提升 50%,在 Artificial Analysis 智能指数中取得 60 分,与 Kimi K3 并列开源第一。
- 核心亮点:
- 底座沿用 GLM-5.2(743B 参数 MoE,单次推理激活约 40B),团队通过在一个月内引入长周期强化学习后训练,使逻辑与代码生成能力大增 50%。
- 处于高智能、低成本的最佳区间,单任务平均成本为前沿旗舰模型中最低;API 价格与 GLM-5.2 持平,模型权重将于下周五正式开源。
- 技术规格:743B 参数 MoE(激活 40B)/ 即将开源 / AA 智能指数 60 分
- 传送门:智谱官方博客
Eleven v3 Conversational — ElevenLabs
- 一言以蔽之:ElevenLabs 宣布其最强实时语音表达模型 Eleven v3 Conversational 正式全面开放(GA)。
- 核心亮点:
- 原生支持音频标记(Audio Tags),允许开发者在文本中通过自然语言标记精细化控制说话时的情绪、语气、笑声及朗读节奏。
- 覆盖 70 多种语言,提供全新的多上下文 WebSocket 连接支持,单任务成本低至 $0.05/1k 字符。
- 技术规格:闭源商业 API / 70+ 语言支持 / 超低延迟
- 传送门:
Eleven v3 Conversational, our most expressive model for realtime speech, is now generally available.
— ElevenLabs (@ElevenLabs) August 19, 2026
For developers building voice experiences that respond with real emotion, Eleven v3 Conversational includes audio tags for fine-grained control and support across 70+ languages. pic.twitter.com/TOAkZt3qGa
Pika SFX 音效大模型 — Pika Labs
- 一言以蔽之:Pika 推出秒级文本生成高质量音效模型 Pika SFX,本地端到端耗时仅 0.847 秒。
- 核心亮点:
- 基于流匹配(Flow Matching)与教师-学生蒸馏技术,可直接在压缩的声学潜空间中解码生成 44.1kHz 高品质立体声波形。
- 相比同类托管 API 生成耗时缩短 60% 以上,API 调用成本降幅达 95%。
- 技术规格:多模态音效大模型 / 闭源 API
- 传送门:
Today we’re putting a spotlight on the innovation behind our Pika SFX model, which delivers production-ready text-to-SFX in under a second.
— Pika (@pika_labs) August 19, 2026
The stats: across 50 prompts covering 454 seconds of requested audio, Pika SFX completed its locally hosted end-to-end path in 0.847s on… pic.twitter.com/2kVqZmEeyP
产品发布/更新
OpenAI Private Safety Processing 与零数据留存 — OpenAI
- 更新内容:OpenAI 预览面向企业客户的 Private Safety Processing 服务。通过部署在客户加密基础设施上的自动化智能体跨会话识别合规与安全风险,同时全面扩大零数据留存(Zero Data Retention)范围,确保 OpenAI 员工(包括 CEO)均无法访问用户的底层提示词与响应。
- 适用人群:[企业级开发者 / 隐私敏感机构 / 数据合规官]
- 体验通道:OpenAI 官方博客
Replit Free Mode(GPT-5.6 Luna 驱动) — OpenAI & Replit
- 更新内容:Replit 联合 OpenAI 推出 Free Mode,由轻量高效的 GPT-5.6 Luna 模型驱动。开发者无需担心 Token 费用消耗,即可直接使用自然语言在 Web 端构建、调试并部署全栈应用。
- 适用人群:[初学者 / 独立开发者 / 快速原型设计者]
- 体验通道:OpenAI 官方博客
JetBrains Rider 代码重构与调试 AI Agent Skill — JetBrains
- 更新内容:Rider 2026.2.1 升级后原生内置
refactoring-code与debugging-code技能。允许 AI Agent 直接调用 IDE 内部原生的 C# 结构化重构引擎与断点调试器,相比纯文本生成,代码重构任务耗时降低 83%,Token 成本降低 64%。 - 适用人群:[.NET 程序员 / C# 工程师 / AI 编程工具用户]
- 体验通道:JetBrains 官方博客
Cursor Cloud Agents 持续化工作流更新 — Cursor
- 更新内容:Cursor 为云端 Agent 引入
/goal命令,使其能跨长会话持续追踪并完成复杂长程目标;同时升级了 Steering 转向机制,智能体将在完成当前工具调用后平滑接收用户的新指令,不再出现强制打断当前动作的情况。 - 适用人群:[全栈工程师 / 软件架构师]
- 体验通道:
We're continuing to improve cloud agents in Cursor.
— Cursor (@cursor_ai) August 19, 2026
They pick up work from events, hold a goal until it's met, and stay on course through long sessions. pic.twitter.com/vACdkc7gOT
Vercel for Slack — Vercel
- 更新内容:Vercel Agent 正式接入 Slack。用户只需在任何 Slack 频道或讨论串中
@Vercel,Agent 即可获取当前应用的生产环境日志、部署指标与配置,自动查找 Bug 根因并提 PR,经团队批准后即可直接在 Slack 中执行回滚等运维操作。 - 适用人群:[DevOps 工程师 / 全栈开发团队 / 项目负责人]
- 体验通道:Vercel 官方博客
Gemini 落地 Waymo Ojai 自动驾驶车辆 — Google & Waymo
- 更新内容:Google 宣布将 Gemini 大模型能力引入 Waymo 自研的 Ojai 无人驾驶出租车中。乘客可通过自然语言与车辆进行个性化交互、调整车内环境,并实时查询沿途景点或行程安排。
- 适用人群:[Waymo 乘客 / 自动驾驶体验者]
- 体验通道:Google 官方博客
Gemini 全球大学生 1 年免费 Plan — Google
- 更新内容:Google 启动全球返校季计划,面向全球 140 多个国家和地区的在校大学生赠送 12 个月 Google AI 订阅(美国赠送 Pro 版,全球其他地区赠送 Plus 版),包含 Gemini Live 深度研究(Deep Research)及专属学习笔记本功能。
- 适用人群:[全球高校大学生 / 学术研究者]
- 体验通道:Google 官方博客
行业动态
NVIDIA cuOpt 登顶 Hans Mittelmann 运筹优化基准测试第一 — NVIDIA
- 事件概述:英伟达(NVIDIA)宣布 GPU 加速运筹优化求解器 cuOpt 完全开源。在权威的 Hans Mittelmann 运筹优化基准测试中,cuOpt 在三大优化问题类别中均刷新最快速度纪录,成为全球性能最强劲的开源求解器。
- 影响分析:显著提升了复杂物流调度、供应链计划与实时排产等场景的计算效率,并为大模型智能体决策系统提供了可高并发调用的底层数学求解引擎。
- 新闻链接:GitHub - NVIDIA/cuopt
Y Combinator 推出 Send a SAFE 智能体极速协议工具 — Y Combinator
- 事件概述:Y Combinator(YC)推出免费开源工具 Send a SAFE,只需约 2 分钟即可生成、签署并发送标准 SAFE 融资协议。该工具专门针对 AI Agent 进行了 API 与标准化封装。
- 影响分析:将创投融资流程进行了高度代码化与标准化,进一步降低了 AI 智能体自主运行、经营与筹集资金的合规门槛。
- 新闻链接:
In 2013, @cjoneslevy created the SAFE at YC. It's since been used by YC founders to raise $15B+ and has become the standard way startups raise money.
— Y Combinator (@ycombinator) August 19, 2026
So we're launching Send a SAFE: a free tool to generate, sign, & send one in ~2 minutes, built to be used by founders (and their… pic.twitter.com/KEevrkJAyq
论文研究
Agent Lightning v1.0:轻量级 Agent Harness 强化学习框架 — 微软研究团队
- 研究动机:现代智能体运行于复杂的 Harness(运行框架)中,导致模型训练时很难直接针对工具调用与环境反馈进行强化学习(RL)对齐。
- 核心创新:通过代理端点(Proxy Endpoint)以约 3500 行代码将任意 Harness 与 RL 训练器无缝连接,解决了多轮上下文重新 Token 化、样本合并与优势计算归一化问题。
- 研究成果:仅需 6k 训练数据即可让 Qwen3.5-9B 模型在 SWE-bench Verified 上的得分从 41.8% 跃升至 56.4%。
- 论文地址:arXiv:2608.17528
DeepSeek-V4-Pro 在 H20 芯片上的推理服务优化 — LMSYS 团队
- 研究动机:探索如何在专为特定市场设计的 H20 芯片上高效部署高达 1.6 万亿参数的超大规模 MoE 模型。
- 核心创新:优化场景化 KV-Cache 内存池化与长文本流水线,在单节点 H20-141GB 系统上实现了高效的服务端配置。
- 研究成果:输出吞吐量达到 271 output tokens/s,与顶尖硬件 B300(383.7 tokens/s)的性能差距大幅缩小至 1.42 倍。
- 论文地址:LMSYS 技术博客
AI 时代的数学研究与范式转换 — 陶哲轩 (Terence Tao)
- 研究动机:面对已具备研究级数学能力的 AI 工具,审视数学界应如何调整研究目标、价值规范与求解范式。
- 核心创新:主张搁置对 AI 是否具备“意识”的无休止争论,转而将隐含的数学实践与价值判断显式化,提出了人机协同下数学难题拆解与自动化定理证明系统的未来演进路线。
- 研究成果:为数学家与 AI 联合攻克未解数学难题提供了系统性的框架与价值规范指导。
- 论文地址:arXiv:2608.16753
其他分享
TrueForge 开源通用 Agent Harness 框架
- 内容简介:TrueFoundry 开源通用智能体运行框架 TrueForge。支持对 OpenAI、Anthropic、GLM、Kimi 及 DeepSeek 等模型进行灵活路由与上下文控制,针对开源 MoE 模型优化后可降低高达 75% 的智能体运行成本。
- 传送门:GitHub - TrueForge
Unsloth Dynamic 3.0 GGUFs 发布
- 内容简介:Unsloth 团队推出 Dynamic 3.0 GGUFs 量化技术,大幅提升了大语言模型在本地与边缘设备运行时的量化精度,几乎实现了 BF16 精度无损的 Q4_0 部署。
- 传送门:Unsloth 官方文档



