AI日报|GPT-Live-1 API重磅发布;智谱获50亿美元融资;书生-S2开源;Microsoft Foundry企业智能体平台上线
模型发布/更新
GPT-Live-1 — OpenAI
- 一言以蔽之:OpenAI 正式发布 GPT-Live-1 API,支持语音实时双向交互、自然打断与噪声过滤,彻底告别传统语音助手的尴尬停顿。
- 核心亮点:
- 边听边说与实时打断:单模型直接完成聆听与说话,支持用户在对话过程中随时插话、纠正方向或补充信息,响应延迟大幅降低。
- 高性价比与强兼容性:API 定价低至 0.05 美元/分钟,并可完美搭配开发者自定义的后端模型与 Harness 框架。
- 技术规格:实时双向语音流 / 噪声抑制 / API 开放
- 传送门:
— AI Will (@FinanceYF5) September 14, 2026
书生-S2 正式版 (Intern-S2-397B) — 上海人工智能实验室
- 一言以蔽之:上海人工智能实验室正式开源超大规模模型书生-S2 正式版 (Intern-S2-397B),在开源社区展现出顶尖的综合实力。
- 核心亮点:
- 超大参数规模:总参数量达到 397B,具备极强的复杂推理、多模态理解与智能体任务执行能力。
- 开源社区共享:目前已正式在 Hugging Face 等平台公开模型权重,持续赋能国内开源 AI 生态。
- 技术规格:397B 参数 / 开源权重 / 复杂推理与智能体增强
- 传送门:Hugging Face 开源地址
DeepSeek-V4.1-Flash (Max) — DeepSeek
- 一言以蔽之:DeepSeek-V4.1-Flash (Max) 成功跻身 Agent Arena 开源模型榜单第 3 名,以极低的单任务成本刷新了行业 Pareto 前沿。
- 核心亮点:
- 极致性价比:每任务中位成本仅约 0.07 美元,较同梯队模型大幅降低使用成本,综合性能净提升 +4.87%。
- 智能体能力跃升:在 Confirmed Success 信号排名中位列第 4,展现出极高的开源智能体执行效率。
- 技术规格:Agent Arena 排名第 3 / 中位成本 $0.07 / 开源模型
- 传送门:
Exciting news: DeepSeek-V4.1-Flash (Max) by @deepseek_ai just landed in Agent Arena at #3 among open models! With +4.87% net improvement and a median cost per task of $0.07 it reshaped the Pareto frontier.
— Arena.ai (@arena) September 14, 2026
Among the top 3 open models, DeepSeek-V4.1-Flash (Max) has the lowest… https://t.co/Tc6wtaOb9S pic.twitter.com/tV3jEbMX5P
产品发布/更新
Microsoft Foundry — 微软 (Microsoft)
- 更新内容:微软正式推出企业级智能体平台 Microsoft Foundry。该平台专为长期运行的复杂智能体工作流设计,从底层内置了全方位的可观察性、安全护栏、数据治理与 FinOps 成本管控机制,能够清楚追踪智能体访问了什么、影响了什么以及数据流向。
- 适用人群:[企业开发者 / AI 架构师 / 企业 IT 管理者]
- 体验通道:
— AI Will (@FinanceYF5) September 14, 2026
Bolt Forge — Bolt / Vercel
- 更新内容:Bolt 联合 Vercel、Arcee、微软、Fireworks 等合作伙伴正式推出 Bolt Forge,在 10 月 14 日前向用户提供免费且高达 50 倍的额度。平台原生引入 GLM、DeepSeek、Kimi 等全新前沿模型,助力开发者更高效地构建和迭代应用。
- 适用人群:[前端开发者 / AI 独立开发者 / 极客用户]
- 体验通道:
Introducing Bolt Forge. Free until Oct 14th:
— bolt.new (@boltdotnew) September 14, 2026
- Up to 50x more usage
- The new frontier: GLM, DeepSeek, Kimi
- Zero usage charges
Live now in your model picker on https://t.co/UH6gFfHvbp
And one more thing... 👇 pic.twitter.com/GnrbkRdzsg
Claude Code v2.1.271 — Anthropic
- 更新内容:Claude Code 发布 v2.1.271 版本,为 Remote 云端与自托管会话新增了 fast mode,并支持在
/config面板中直接进行鼠标操作。同时修复了多项组织策略缓存复用、企业配置文件解析及 worker 重启后的子智能体权限问题。 - 适用人群:[AI 辅助程序员 / 软件工程团队]
- 体验通道:GitHub Releases
行业动态
智谱敲定约 50 亿美元融资,开发下一代 GLM 基础模型 — 智谱 (Zhipu AI)
- 事件概述:据港交所公告及相关报道,中国 AI 领军企业智谱已正式敲定约 50 亿美元的新一轮巨额融资,资金将主要用于下一代 GLM 基础模型的研发与算力基础设施建设。
- 影响分析:这是近年来中国 AI 初创企业获得的最大单笔融资之一,标志着头部大模型厂商在通往 AGI 的长跑中,正获得强劲的资本与算力弹药支持。
- 新闻链接:港交所公告文件
Google Cloud Run 创始人 Steren 加盟 Vercel 领导 Fluid 计算产品线 — Vercel
- 事件概述:Google Cloud Run 的主要创造者 Steren 正式宣布加入 Vercel,担任 Fluid 计算产品线(包括 Functions、Containers、Sandbox、Builds)的负责人。
- 影响分析:随着 AI 智能体时代对底层计算原语提出全新需求,云原生领域核心人物的跨界跳槽,预示着面向 AI Agent 的下一代 Serverless 基础设施正在加速成型。
- 新闻链接:
Welcoming Steren, creator of Google Cloud Run, to Vercel.
— Guillermo Rauch (@rauchg) September 14, 2026
He will lead the Fluid family of compute products (Functions, Containers, Sandbox, Builds).
Serverless was the last chapter of the cloud, and Steren helped define the paradigm at Google.
Agents are the next frontier,… https://t.co/iTglmj5ebz
论文研究
Simple Attention Sparsification via End-to-End Optimization of Context Ranking (SAS) — 前沿研究团队
- 研究动机:针对长文本大模型中注意力机制计算开销大、效率低的问题,探索如何在保持模型性能的同时实现轻量化。
- 核心创新:提出简单注意力稀疏化 (SAS) 方法,通过端到端优化上下文排序,实现高效的注意力剪枝与加速。
- 研究成果:实验表明,该方法在大幅降低长文本推理计算与显存开销的同时,几乎没有带来模型性能损失。
- 论文地址:
SAS
— AK (@_akhaliq) September 14, 2026
Simple Attention Sparsification via End-to-End Optimization of Context Ranking
paper: https://t.co/xUeF7LeY41 pic.twitter.com/C7qCPn0rGf
其他分享
shadcn/lint:面向 Tailwind 设计系统的 Agent 专属 Linter — shadcn
- 内容简介:知名开源前端大咖 shadcn 推出了
shadcn/lint,这是一个专为 AI 智能体设计的 Tailwind 设计系统 Linter。它允许开发者自定义规则,当 AI 智能体写代码破坏设计规范时,错误信息会精准指出问题并指导其如何利用现有组件、变体和主题进行修复。 - 传送门:GitHub 仓库

