eview;Anthropic 与 Goo
pic 与 Google DeepM
oogle DeepMind 连发前沿
越,并已在 OpenRouter 等平台上线
腾讯混元 (Tencent Hunyu
ncent Hunyuan) 一言以蔽
news
AI日报|Z.ai 正式开源 GLM-5.3 旗舰大模型;腾讯混元发布 770B MoE 模型 Hy4 Preview;Anthropic 与 Google DeepMind 连发前沿 AI 自主科研与对齐突破成果
2026-08-29
AI日报|Z.ai 正式开源 GLM-5.3 旗舰大模型;腾讯混元发布 770B MoE 模型 Hy4 Preview;Anthropic 与 Google DeepMind 连发前沿 AI 自主科研与对齐突破成果
模型发布/更新
GLM-5.3 旗舰大模型 — Z.ai
- 一言以蔽之:Z.ai 正式发布并开源新一代旗舰模型 GLM-5.3,专注于复杂软件工程、长时程智能体调度及网络防御任务。
- 核心亮点:
- 支持 1M 超长上下文窗口,原生集成可配置的推理努力度(Reasoning Effort)。
- 在代码基准测试与网络安全攻防任务中表现卓越,并已在 OpenRouter 等平台上线开放调用。
- 技术规格:开源权重模型 / 1M 上下文 / 支持高级推理与多步骤智能体工作流
- 传送门:Z.ai 官方技术博客
Hy4 Preview 旗舰模型 — 腾讯混元 (Tencent Hunyuan)
- 一言以蔽之:腾讯混元重磅发布新一代旗舰模型 Hy4 Preview,采用 MoE 混合专家架构,全面发力真实生产力与复杂长时程任务。
- 核心亮点:
- 拥有 770B 总参数、49B 激活参数,原生支持 1M 超长上下文输入。
- 深度结合腾讯内部软件工程、游戏开发、金融与安全等真实场景的高质量数据共建,在多步推理和代码执行上实现显著跃升。
- 技术规格:770B MoE 模型 (49B 激活) / 1M 上下文 / 开源上线
- 传送门:腾讯混元研究主页
Fast H3 v1 视频加速模型 — MiniMax & Hao AI Lab
- 一言以蔽之:MiniMax 联合 Hao AI Lab 与 NVIDIA FastGen 推出开源视频生成加速模型 Fast H3 v1,大幅缩短高质量视频渲染周期。
- 核心亮点:
- 基于 MiniMax H3 进行后训练优化,可在 NVIDIA Blackwell GPU 上实现最高达 14 倍的推理加速。
- 能够在 13 秒内极速生成 15 秒的 768p 视频,全面开源供开发者与社区调优。
- 技术规格:开源视频生成加速模型 / 支持 NVIDIA Blackwell 硬件加速
- 传送门:
Congratulations to the @haoailab, @nuvalab, and @NVIDIA FastGen teams on MiniMax Fast H3 v1!🩵
— MiniMax (official) (@MiniMax_AI) August 28, 2026
Hao AI Lab has been at the forefront of video generation acceleration, with FastVideo being one of the earliest and leading open frameworks in the space. This deep collaboration with… https://t.co/a5DbTvJjrX
产品发布/更新
Grok Bot 接入 Link 支付代购功能 — xAI
- 一言以蔽之:xAI 旗下 Grok Bot 正式打通 Stripe 旗下的 Link 支付系统,允许用户授权其在互联网上进行安全的自主购物。
- 更新内容:用户只需绑定 Stripe 关联的支付账户并设定权限,Grok Bot 即可在网页端完成在线商品的搜索、比价与代购下单。所有涉及资金划转的操作均强制要求人工二次批准,兼顾自动化便利与资产安全。
- 适用人群:[效率工具重度用户 / 智能体尝鲜者 / 电商消费者]
- 体验通道:
Grok @Bot works with @Link https://t.co/rVjP8G3teg
— Elon Musk (@elonmusk) August 28, 2026
Rosalind Workbench 科研工作流预览 — OpenAI
- 一言以蔽之:OpenAI 正式推出科研专属工作流工具 Rosalind Workbench 的研究预览版,将多模态模型与科学计算工具无缝串联。
- 更新内容:该平台将蛋白质结构分析、序列对比及基因组学工作流整合至统一的引导式界面中,确保科研人员的提问、代码分析与实验证据链保持实时关联。
- 适用人群:[生命科学研究员 / 生物医药开发者 / 前沿学者]
- 体验通道:OpenAI 开发者博客
行业动态
联邦法官裁定特朗普政府将 Anthropic 列入黑名单违法
- 事件概述:美国加州北区联邦地区法院法官 Rita Lin 正式裁定,特朗普政府此前将 Anthropic 列为国家安全供应链风险并封禁其 AI 技术的行政行为属于违法,并构成违反第一修正案的非法报复。
- 影响分析:该裁决为前沿 AI 企业在国防、政府及合规供应链中的技术应用提供了法律保障,明确了企业在拒绝放宽致命自主战争限制时免受政治化打压的权利。
- 新闻链接:Ars Technica 深度报道
OpenRouter 数据揭示:大模型降价引爆 Token 消耗量激增 13.8 倍
- 事件概述:OpenRouter 发布最新生态数据报告指出,当 GPT-5.6 Terra 和 Luna 等前沿模型在平台上进行大幅度降价后,整体 Token 使用量逆势爆发,创下了 13.8 倍的增幅记录。
- 影响分析:该现象再次完美印证了经济学中的「杰文斯悖论 (Jevons Paradox)」——当算力与推理成本下降时,总消费量不仅没有减少,反而极大地刺激了复杂长时程智能体与批量任务的爆发。
- 新闻链接:
What happened when GPT 5.6 Terra and Luna were heavily discounted on OpenRouter?
— OpenRouter (@OpenRouter) August 28, 2026
Token usage exploded by 13.8x
Jevons Paradox = as technology makes the use of a resource more efficient, total consumption of that resource increases rather than decreases 🧵 pic.twitter.com/5rPiufYhGz
论文研究
自动化对齐研究 (AAR):让 Claude 自主训练模型以缓解对齐失败 — Anthropic
- 研究动机:传统的人工对齐方法在应对模型日益复杂的隐蔽欺骗、谄媚等罕见偏差时成本极高,亟需实现对齐研究流程的自动化。
- 核心创新:Anthropic 提出自动化对齐研究 (AAR) 系统。研究人员给予 Claude 48 小时与单张 GPU,让其自主检索文献、提出对齐方法、并训练测试较小模型,以修复 10 类对齐基准缺陷。
- 研究成果:实验证明,该自动化系统产出的最佳对齐方法平均在 6 小时内超越了人类专家的提议,且在模型规模放大 4.7 倍后依然有效,未对通用能力造成任何损害。
- 论文地址:Anthropic 官方研究报告
Co-Scientist 跨越虚拟走向真实世界:驱动自动化化学与生物实验 — Google DeepMind
- 研究动机:如何将大模型驱动的科研智能体(如 Co-Scientist)从纯粹的文献模拟和理论构想,推进至能够直接操控物理仪器的闭环真实实验中。
- 核心创新:Google DeepMind 成功将该系统接入半自动化学气相沉积反应器与生物表型预测工作流,由模型自主设计材料前驱体合成路线并动态调整生长配方。
- 研究成果:系统在几分钟内按实验室约束条件完成了单次成功的单层 MoS₂、MoSe₂ 和 WS₂ 生长,并在生物学中成功预测了未公开的实测表型,显著降低了幻觉与文本剽窃率。
- 论文地址:ArXiv 预印本
WikiSkill:通过持久化知识库维持智能体技能演进 — Google
- 研究动机:现有的智能体技能进化系统往往将执行轨迹、历史优化记录与可执行代码混为一谈,导致跨模型迁移和长期演进时容易产生性能衰退。
- 核心创新:提出 WikiSkill 架构,将原始执行轨迹、持久化积累的知识 Wiki 以及可执行技能三者彻底解耦,使所有后续技能更新统一基于知识 Wiki 进行。
- 研究成果:消融实验证明,知识 Wiki 是系统获取性能增益的核心所在;使用 Wiki 演进过的小模型其表现甚至能反超缺乏持久化知识的大模型。
- 论文地址:ArXiv 预印本
其他分享
AI 工程师笔记本 (AI Engineer Notebooks) 开源合集
- 内容简介:面向 AI 工程师与全栈开发者的实用 Colab 笔记本开源项目。该项目主张摒弃臃肿的抽象框架,使用轻量级原生 API 构建 RAG、智能体及评估工具。所有实验均可在免费 Groq API 上直接运行,无需信用卡,并附带丰富的端到端架构案例。
- 传送门:GitHub 开源仓库



