AI日报|OpenAI 发布自研推理芯片 Jalapeño;字节跳动推出“豆包工作”;苹果发布 M6 与 M5 Ultra 芯片
模型发布/更新
IBM Granite 4.2 家族模型 — IBM
- 一言以蔽之:IBM 正式发布企业级开源模型 Granite 4.2(覆盖 3B、8B、30B 参数),全面引入原生思考链(Chain-of-Thought)与治理合规机制。
- 核心亮点:
- 旗舰型号 Granite-4.2-30B 内置
<think>思考链机制,在数学、代码和复杂多步推理任务上表现卓越,支持灵活切换全思考、非思考及低成本模式。 - 针对企业合规性进行深度数据清洗与治理验证,原生支持 512K 超长上下文窗口与推理增强型工具调用(Tool Calling),采用 Apache 2.0 宽松开源协议。
- 旗舰型号 Granite-4.2-30B 内置
- 技术规格:3B / 8B / 30B 稠密架构 / 开源(Apache 2.0) / 512K 上下文
- 传送门:Hugging Face IBM Granite 博客
MAI-Image-2.6-Preview — 微软 (Microsoft)
- 一言以蔽之:微软开源生态再添主力,MAI-Image-2.6-Preview 在 Artificial Analysis 图像编辑榜单上位列全球第一。
- 核心亮点:
- 显著增强了文本渲染能力、人像细节与 3D 空间感,能够输出极具商业质感的逼真图像。
- 同时支持文生图(Text-to-Image)与高质量图像编辑(Image Editing),在图像编辑竞技场中超越多款海外标杆竞品。
- 技术规格:多模态图像生成与编辑模型 / 微软 AI 平台托管
- 传送门:
MAI-Image-2.6 is the best image editing model on AA. We now hold 3 of the top 5 leaderboard positions.
— Mustafa Suleyman (@mustafasuleyman) August 25, 2026
Try it today here: https://t.co/o8pibirjes https://t.co/mtgBIU30eR
产品发布/更新
Jalapeño 自研推理芯片 — OpenAI
- 一言以蔽之:OpenAI 正式披露首款自研推理芯片 Jalapeño 的实测数据,宣布该芯片将于今年年底全面部署至其核心基础设施。
- 核心亮点:
- 在公开基准 InferenceX 上的测试显示,Jalapeño 在每千瓦算力下提供的吞吐量超越英伟达 GB300 系统,单 Token 推理延迟缩短最高达 3.6 倍。
- 借助 AI 辅助芯片设计流程,该芯片从初始架构构思到成功流片仅历时 9 个月,未来将大幅降低大规模智能体与 ChatGPT 的运行成本。
- 适用人群:[AI 基础设施架构师 / 开发者 / 行业研究员]
- 体验通道:OpenAI 官方博客
豆包工作 (Doubao Work) — 字节跳动
- 一言以蔽之:字节跳动重磅推出面向办公与研发场景的统一品牌“豆包工作”,并深度打通飞书生态与主流 Windows 系统。
- 核心亮点:
- 深度融合飞书里的群聊、会议纪要与企业知识库,能够自动跨应用提取上下文,提供全方位的日程管理、自动文档生成及多端协同。
- 预置 160+ 企业级 Skill 与 50+ 连接器(Connector),支持网页与应用搭建、Cloud Computer Use 以及安全隔离的沙箱执行。
- 适用人群:[企业管理者 / 研发人员 / 协同办公用户]
- 体验通道:豆包工作官网
Portable Computer 本地智能体系统 — Perplexity
- 一言以蔽之:Perplexity 推出面向 NVIDIA DGX Spark 设备的本地优先智能体堆栈 Portable Computer,实现零云端依赖的私密高效办公。
- 核心亮点:
- 整个运行环境(编排 LLM、子智能体与 Harness)全部在本地硬件运行,搭载微调后的本地 PPLX 27B 模型,在真实知识工作基准测试中表现惊艳。
- 在遇到复杂难题时可安全、受控地通过文本引导上报至云端前沿顾问模型,兼顾了绝对隐私与前沿智能。
- 适用人群:[隐私敏感企业 / 高级开发者 / DGX Spark 用户]
- 体验通道:
Today we’re launching Portable Computer on @NVIDIA DGX Spark.
— Perplexity (@perplexity_ai) August 25, 2026
Portable Computer is a fully local version of Perplexity Computer, where the entire runtime: orchestrator LLM, subagent LLM, agent harness all run on your local hardware. No cloud dependency. pic.twitter.com/plVWz5PaAw
Claude 统一记忆功能 (Unified Memory) — Anthropic
- 一言以蔽之:Anthropic 正式打通 Claude 网页聊天(Chat)与 Claude Cowork 的统一记忆系统,实现跨界场景的无缝上下文继承。
- 核心亮点:
- 用户在任一对话场景中让 Claude 记住的信息将自动同步至全局,Cowork 智能体在接手任务时可直接继承项目的历史背景与偏好设置。
- 在设置中新增了独立的“记忆浏览器”标签页,用户可随时查看、编辑或删除特定主题的记忆,并可自主控制健康、宗教等敏感话题的存储权限。
- 适用人群:[深度内容创作者 / 职场白领 / Claude 全平台用户]
- 体验通道:
Claude now has one memory across chat and Claude Cowork, and you decide what's in it.
— Claude (@claudeai) August 25, 2026
Hand Cowork a task and it starts from what Claude already knows from your chats: the project you talked through, your manager's preferences, or the client from last quarter. pic.twitter.com/ViKapsT8K6
M6 与 M5 Ultra 芯片及新款 Mac 家族 — 苹果 (Apple)
- 一言以蔽之:苹果发布全新一代 M6(首款 2nm 工艺)与 M5 Ultra(四芯片封装架构)芯片,全面重塑 Mac mini 与 Mac Studio 的端侧 AI 算力极限。
- 核心亮点:
- M6 首次采用 2nm 制程,配备 12 核 CPU 与集成神经网络加速器的 12 核 GPU,AI 峰值计算能力较 M1 提升超过 8 倍。
- M5 Ultra 专为极高负载打造,支持最高 512GB 统一内存与 1.2TB/s 内存带宽,可完全在本地流畅运行超大规模大模型。
- 适用人群:[Mac 开发者 / 3D 渲染师 / 本地 AI 算力追求者]
- 体验通道:Apple 官方新闻中心
行业动态
ChatGPT Business Premium Seats ($100 商务席位) — OpenAI
- 事件概述:OpenAI 官方宣布推出全新的 ChatGPT Business Premium 商务高级席位,定价为每席位每月 100 美元,专为精益创业团队和小型企业设计。
- 影响分析:该计划填补了普通 Plus 与企业版之间的空白,让小团队无需支付昂贵企业门槛即可解锁高级用量、无 5 小时使用限制以及更强的开发与自动化工具。
- 新闻链接:
Introducing ChatGPT Business Premium Seats
— OpenAI (@OpenAI) August 25, 2026
The new $100 Premium seat is a game changer for small businesses and startups—giving lean teams better tools, faster workflows, and capabilities once reserved for big companies.
A flexible plan that scales with your team’s ambition.… pic.twitter.com/BsR2phYfc9
WebMCP 开放标准与 35,000 美元黑客松启动 — OpenAI & 合作伙伴
- 事件概述:OpenAI 联合 ChromiumDev、Cloudflare、Vercel、Shopify 等行业巨头正式推出实验性开放标准 WebMCP,并启动为期 10 天、总奖金 35,000 美元的全球黑客松。
- 影响分析:WebMCP 允许网页应用直接向智能体暴露标准工具,使网页任务的自动化执行变得极其高效可靠,标志着 AI 智能体与互联网生态的深度融合进入新阶段。
- 新闻链接:
WebMCP is an experimental open standard that lets web apps expose tools that agents can use directly on the page to complete tasks faster and more reliably.
— OpenAI Developers (@OpenAIDevs) August 25, 2026
Curious what new experiences it enables? Take a look at our WebMCP demo showcase:https://t.co/wBGvKWW1zP
论文研究
Apodex 1.1 mini (35B) 与开源科研 Agent 框架 — Apodex AI
- 研究动机:传统深度研究 AI 往往局限于公开网页资料的简单总结,缺乏处理本地多模态文件、运行代码并完成复杂科研与金融尽调的闭环能力。
- 核心创新:Apodex 推出 Apodex 1.1 家族及 35B 开源权重模型,并开源了 FrontierAgent 研究工作台,支持异步多智能体协同、沙箱代码执行与动态任务拆解。
- 研究成果:在专业科研、数据分析及长文档生成任务中,该开源模型及框架表现达到第一梯队水平,为开发者提供了可核查、全链路可追溯的科研 AI 范本。
- 论文地址:
Apodex 1.1
— AK (@_akhaliq) August 25, 2026
Scaling Agentic Intelligence for Complex Work
paper: https://t.co/bZUS55viAw pic.twitter.com/UWeTBvUj4S
AutoSaddler: 智能体 Harness 的自动化优化 — 微软 (Microsoft)
- 研究动机:目前的 AI 智能体控制框架(Harness)大多依赖人工凭经验微调,面对复杂的生产环境故障时缺乏系统性的自我修复与演进机制。
- 核心创新:微软等机构研究人员提出 AutoSaddler 框架,将智能体 Harness 视为代码,通过在离线状态下运行小批量任务、分析失败轨迹,自动生成针对提示词、工具配置及控制逻辑的结构化补丁。
- 研究成果:相较于基础 Harness,AutoSaddler 在 GAIA2、SWE-Bench Pro 和 Terminal-Bench 2.0 基准测试中分别取得了显著的性能提升。
- 论文地址:
Impressive new paper from Microsoft and colleagues.
— elvis (@omarsar0) August 25, 2026
Harness design is still hand-tuned almost everywhere. This work present an automated loop to optimize the harness.
They introduce AutoSaddler, which treats the agent harness as code and learns to patch it offline from failure… pic.twitter.com/LbZ7fAfJTu
其他分享
浏览器自动化新利器:Browser Use 插件正式集成至 Grok Build — xAI
- 内容简介:xAI 宣布在 Grok Build 中内置官方“Browser Use”插件。该插件允许 Grok 自由调用用户的本地 Chrome 浏览器或托管云浏览器,实现无缝网页浏览、数据抓取、表单填写及全自动网页工作流,进一步解放开发者的双手。
- 传送门:
Browser Use plugin officially inside Grok build https://t.co/oTGb1tdf1P
— Browser Use (@browser_use) August 25, 2026



