AI日报|OpenAI万级Agent求解千禧年难题引争议;ChatGPT Images 2.5与Meta Muse发布;Mistral获30亿欧融资
模型发布/更新
ChatGPT Images 2.5 (Flare / Sunburst) — OpenAI
- 一言以蔽之:OpenAI 正式发布新一代图像生成与编辑模型 ChatGPT Images 2.5,登顶 Arena 图像全榜单并集成画布涂鸦功能。
- 核心亮点:
- 延迟降低 50% 与点对点精准局部重绘:在大幅降低首图时延的同时,支持在保留主体和背景构图的前提下进行单点细节修改;同步上线
@Sketch画板涂鸦直接渲染生图与模板功能。 - API 双模型分发:推出面向高并发日常生成的轻快型
gpt-image-2.5-flare,以及面向高精度品牌与复杂设计的旗舰型gpt-image-2.5-sunburst。
- 延迟降低 50% 与点对点精准局部重绘:在大幅降低首图时延的同时,支持在保留主体和背景构图的前提下进行单点细节修改;同步上线
- 技术规格:闭源多模态生成模型 / Arena Text-to-Image、Image Edit 与 Multi-Image Edit 三榜包揽前两名 / 已向 ChatGPT 全量用户及 API 开放
- 传送门:OpenAI 官方博客
Muse Spark 1.3 — Meta
- 一言以蔽之:Meta 发布由其 1 吉瓦 Prometheus 超算集群训练的推理模型 Muse Spark 1.3,重塑 Web 编程帕累托前沿。
- 核心亮点:
- 极致性价比重塑基准:在 Code Arena: WebDev 榜单中以 1650 分位列第 8,得分逼近 Qwen3.8 (Max) 且成本降低 30%,接近 Kimi K3 (Max) 且成本降低 70%(仅 $3.50/M Token)。
- 无缝集成主流开发环境:作为 Meta 个人智能体 Muse 的推理底座,发布当日即获得 Cursor 官方原生支持。
- 技术规格:前沿闭源推理大模型 / Code Arena WebDev 排名前十 / 现已集成进 Cursor 与 Meta 智能体生态
- 传送门:
Introducing Muse, a personal agent that gets things done for you, powered by Muse Spark 1.3.
— AI at Meta (@AIatMeta) September 8, 2026
Get an inside look at how we built Muse and what it can do for you: https://t.co/qzFgoNAUSV https://t.co/KNCQwQXqyL pic.twitter.com/7skLRgWCaI
DeepSeek V4.1 Flash (内测版) — DeepSeek (深度求索)
- 一言以蔽之:DeepSeek 开启新一代轻量模型 V4.1 Flash 灰度内测,首次带来原生多模态架构升级。
- 核心亮点:
- 全新原生多模态底座架构:摒弃传统外挂视觉组件,在模型底层实现图文原生表征统一,在细粒度图像理解与长文本推理上表现稳健。
- 加量不加价与高并发支持:模型计费标准完全维持 V4 Flash 水准不变,内测阶段单账号默认支持最高 20 并发调用。
- 技术规格:原生多模态大模型 / 模型 ID 为
deepseek-v4.1-flash-expires-on-0910/ 内测阶段 - 传送门:DeepSeek 开放平台
Mercury 2.5 — Inception Labs
- 一言以蔽之:Inception Labs 推出新一代扩散大语言模型 Mercury 2.5,打破传统自回归生成的并发吞吐瓶颈。
- 核心亮点:
- 综合智能净增 40%:采用离散掩码扩散架构,在数学推理与长文本生成基准上全面对标 GPT-5.6 Luna 与 Claude Haiku 4.5。
- 非自回归并行加速:利用扩散并行生成机制,在保持极高输出质量的同时,大幅降低前向解码的显存开销与长序列时延。
- 技术规格:大规模离散扩散大语言模型 (Discrete Diffusion LLM) / 闭源 API
- 传送门:Inception Labs 官方发布
产品发布/更新
Muse 个人智能体 — Meta
- 更新内容:Meta 推出 24/7 实时在线的个人智能体 Muse。Muse 运行在安全隔离的虚拟机环境中,通过与 1Password 合作复用用户现有授权凭证,无缝打通 Gmail、Google 日历、Outlook、Spotify 等应用,具备原生浏览器操作、多平台比价与全网自主购物结算能力。
- 适用人群:[大众用户 / 知识工作者 / 效率极客]
- 体验通道:Muse 官方平台
Runway Plugins for Adobe — Runway
- 更新内容:Runway 正式推出嵌入 Adobe Premiere Pro 与 After Effects 的原生插件面板。剪辑师无需离开时间线即可调用 Aleph 2 等视觉模型进行文生视频、画面局部重绘,并支持按原始剪辑片段的时长精准重渲染,极大简化专业影视特效制作工作流。
- 适用人群:[视频剪辑师 / 特效设计师 / 影视动画创作者]
- 体验通道:Runway 官方发布
Grok Bot 深度集成 X 平台 — xAI / X
- 更新内容:Grok Bot 机器人正式打通 X 平台底层数据与 API 能力。可自动化抓取
@提及反馈、将关注流实时提炼为“每日简报”、智能归类聚合私信与评论并协助批量回复;同时推出自主学习用户工作习惯的 X Scout 智能助理,所有代发推文均附带透明度标识。 - 适用人群:[社交媒体运营 / 开发者 / 社区管理者]
- 体验通道:
📢好消息:
— 小互 (@xiaohu) September 8, 2026
Grok Bot 正式打通了 X 平台
机器人现在可以直接调用 X 的数据和能力
福利:付费的 Grok Bot 用户在首次绑定连接时,会免费赠送一部分 X API 额度(Starter Credits),供上手试用体验
接入流程: 进入 Grok Bot 的 Marketplace(应用市场) $\rightarrow$ 搜索并添加 X 插件… https://t.co/6oWYl2reXA
Gemini 3.5 Transcribe & Gemini Notebook 升级 — Google
- 更新内容:Google 发布 Gemini 3.5 Transcribe 实时语音转文字模型,已集成至 macOS 版 Gemini 应用中,支持结合屏幕内容理解进行上下文感知转录;同步升级 Gemini Notebook 移动端交互,支持测验后针对薄弱知识点即时生成自适应抽认卡。
- 适用人群:[Mac 办公族 / 学生 / 研究人员]
- 体验通道:
Use your voice and screen context to get more done with Gemini 3.5 Transcribe in the Gemini app for macOS.
— Google Gemini (@GeminiApp) September 8, 2026
Gemini 3.5 Transcribe makes it easy to summarize local files, plan and research, and create images using free natural language.
行业动态
OpenAI 宣称利用万级智能体集群求解 Navier-Stokes 千禧年难题,引发学术与版权风波 — OpenAI / 纽约大学
- 事件概述:OpenAI 宣布由其未发布的下一代前沿模型驱动约 10,000 个并发智能体协同运作,历时 88 小时生成了三维 Navier-Stokes 方程有限时间爆破(Blowup)的解析证明,并由 GPT-6 Astra 在 17 小时内完成 Lean 形式化机器验证。随后,纽约大学教授 Tristan Buckmaster 与 Anthropic 数学家 Levent Alpöge 发文,指控 OpenAI 在获知其阶段性研究传闻后动用海量算力突击抢发成果并试图排挤署名;OpenAI 则回应称研究路径完全独立且未直接调用特定用户数据。菲尔兹奖得主陶哲轩等学者相继发声,警示算力垄断对传统开源科学合作生态的潜在冲击。
- 影响分析:该成果验证了“超前沿大模型 + 超大规模智能体协作 + 形式化验证”在解决人类顶级科学难题上的巨大潜力;但同时也激化了全球学术界对大模型训练数据衍生权益、学术署名伦理以及商业巨头算力军备竞赛对开放科研侵蚀的广泛争论。
- 新闻链接:OpenAI 官方公告 / Tristan Buckmaster 公开声明
Mistral AI 完成 30 亿欧元 D 轮融资,投后估值突破 210 亿欧元 — Mistral AI
- 事件概述:欧洲生成式 AI 独角兽 Mistral AI 宣布完成 30 亿欧元 D 轮股权融资,投后估值超过 210 亿欧元,创下欧洲科技企业史上规模最大的单轮融资记录。本轮资金将全部用于扩大自建训练与推理算力集群,持续推进主权开源模型的前沿研发。
- 影响分析:巨额资金注入极大增强了欧洲乃至全球开源大模型阵营对抗美系闭源巨头的底气,进一步确立了开源权重模型在企业级部署与国家级数字主权建设中的核心战略地位。
- 新闻链接:Mistral AI 官方博客
Devin 母公司 Cognition 以 480 亿美元估值完成 20 亿美元新一轮融资 — Cognition
- 事件概述:自主 AI 软件工程师 Devin 的开发商 Cognition 宣布以 480 亿美元估值完成 20 亿美元新一轮融资,由 a16z、Accel、Founders Fund、General Catalyst 和 Avenir 联合领投。这距其上一次以 260 亿美元估值融资仅过去四个月。
- 影响分析:顶级风投机构持续重金押注,表明市场对于全自主软件工程智能体(Software Engineering Agents)的渗透速度与商业变现天花板抱有极高预期,AI 编程工具链正加速从辅助补全迈入整包交付时代。
- 新闻链接:TechCrunch 报道
英伟达被曝拟以 129 亿美元收购 Hugging Face — TechCrunch / 英伟达
- 事件概述:据 TechCrunch 等外媒报道,英伟达已就以 129 亿美元收购全球最大开源 AI 模型与数据集社区 Hugging Face 达成原则性协议。收购完成后,Hugging Face 将保留独立运营,但将更深层次融入英伟达的云平台与全栈计算生态。
- 影响分析:英伟达将凭借此次收购牢牢锁定全球数百万开源 AI 开发者与模型分发枢纽,把算力基础设施的垄断优势自硬件层直接延伸至开发者工作流的最顶端。
- 新闻链接:
TechCrunch:Nvidia 即将完成对 Hugging Face 的收购https://t.co/DEKOvt1fVZ
— AI Will (@FinanceYF5) September 8, 2026
论文研究
AlphaGenome Atlas:绘制人类 90 亿个 DNA 单字母变异效应全景图谱 — Google DeepMind
- 研究动机:人类基因组中非编码区及海量单核苷酸变异(SNV)对基因表达与致病机制的潜在影响长期难以进行系统性、全局性的高精度量化预测。
- 核心创新:DeepMind 推出规模达 1-PB 的 AlphaGenome Atlas 开源变异数据库。该系统融合 AlphaGenome 与 AlphaMissense,提出统一的变异影响评分(AVI Score),对人类基因组中全部 90 亿个单碱基变异位点建立起预测模型,揭示突变如何破坏基因开关或干扰 RNA 剪接。
- 研究成果:构建了迄今分辨率最高的人类基因组变异效应预测体系,向全球科研人员免费开放 Web 交互端、API 及 Google Antigravity Agent 调用技能。
- 论文地址:Google DeepMind 官方研究博客
Decode Megakernel:将大模型解码融合为单一算子,吞吐提升 1.58 倍 — Cohere
- 研究动机:自回归大模型在线推理的服务瓶颈主要集中于解码阶段(Decode Step)。传统推理框架中频繁的微小算子调度(Kernel Launches)导致 GPU 显存带宽与计算核心严重空转。
- 核心创新:Cohere 提出 Decode Megakernel 架构,将注意力计算、激活函数、权重投影等完整解码流程极致融合成单一 GPU 算子启动,并原生支持生产环境所需的 KV Cache 与批处理调度。
- 研究成果:在单卡 H100 部署 North Mini Code 实测中,单批次解码较 vLLM 提速 1.58 倍,批处理 BS=8 时端到端吞吐提升 1.25x 至 1.41x,完整系统已在 GitHub 开源。
- 论文地址:Cohere 官方技术博客
其他分享
Deltafin:在 MacBook Pro 上利用四块 SSD 流式运行 2.8T Kimi K3 — 开源社区
- 内容简介:开源项目 ARGODRIVE Deltafin 实现了在搭载 M5 Max(128GB)的 MacBook Pro 本地设备上流式运行完整版 Kimi K3(2.8 万亿参数 MoE 原始权重)。该方案无需任何权重剪枝与专家丢弃,通过四块高速 NVMe SSD 并行流式传输参数,实现约 1 token/s 的稳定解码速率,相比此前方案速度提升 3.5 倍。
- 传送门:GitHub 仓库 (deltafin)
Managed Deep Agents 0.7:解决多智能体 OAuth 认证与上下文分叉 — LangChain
- 内容简介:LangChain 正式发布
managed-deepagents0.7 版本,引入 Managed Connections 体系,通过单个参数配置即可自动化托管智能体代表自身或代表用户执行跨服务调用的 OAuth 鉴权与刷新流程;同时新增子智能体上下文分叉(Conversation Forking)特性,允许子智能体继承主管上下文而无需空白启动。 - 传送门:
New in Deep Agents: Subagents can now fork the supervisor's full conversation instead of starting from a blank context window.
— LangChain (@LangChain) September 8, 2026
Everything you need to know from @t_bengre and @chester_curme on the @LangChain_OSS team ⤵️ https://t.co/2uKQoMHNVF

