news

AI日报|OpenAI 发布旗舰模型 GPT-6 Astra;NVIDIA 官方宣布 129.3 亿美元收购 Hugging Face

September 4, 2026
Updated Sep 4
3 min read
openai
AI日报|OpenAI 发布旗舰模
nvidia
Astra;NVIDIA 官方宣布
google
t 3 — Google DeepM
deepmind
oogle DeepMind 一言以蔽之
gemini
earch、Gemini、Googl
grok
发布/更新 Grok Bot 企
news
AI日报|OpenAI 发布旗舰模型 GPT-6 Astra;NVIDIA 官方宣布 129.3 亿美元收购 Hugging Face
2026-09-04

AI日报|OpenAI 发布旗舰模型 GPT-6 Astra;NVIDIA 官方宣布 129.3 亿美元收购 Hugging Face


模型发布/更新

GPT-6 Astra — OpenAI

  • 一言以蔽之:OpenAI 正式发布新一代旗舰模型 GPT-6 Astra,被团队称为“迈入 AGI 时代的标志性模型”,在电脑自主操作、科学研究及复杂逻辑推理上带来世代级跃升。
  • 核心亮点
    • 全栈计算机操作 (Computer Use):在 OSWorld 2.0 离线评测中得分达 72.6%,平均任务耗时从前代的 75 分钟大幅压缩至 40 分钟左右,能够自主完成网页表单填写、3D 建模渲染及复杂软件排错。
    • 前沿基准全面登顶:在 FrontierMath Tier 4 (v2) 达到 97.6%,ARC-AGI-3 标准测试表现优异(配合 Provider Adapter 架构展现出极高推理鲁棒性),并在 Terminal-Bench Science 0.1 上创下 SOTA。
  • 技术规格:1.05M 上下文窗口 / 支持 128k 最大输出 / API 定价为每百万输入 10 美元、输出 50 美元
  • 传送门OpenAI 官方博客

K2 Horizon 系列开源模型 — IFM

  • 一言以蔽之:IFM 集中发布 K2 Horizon 系列共 6 款开源模型,全方位覆盖从端侧到云端的多尺度部署需求。
  • 核心亮点
    • 包含 375B-A23B、36B-A4B、32B、7B、3.7B 和 0.9B 共六种尺寸,全面采用 Apache 2.0 开源协议并开放完整训练生命周期。
    • 其中 36B-A4B 引入了全新的稀疏注意力架构 MoVA,在同量级开源模型中展现出卓越的长文本检索与生成效率。
  • 技术规格:Apache 2.0 开源 / 覆盖 0.9B 至 375B 参数量级 / 包含多种稀疏架构变体
  • 传送门IFM 官方博客

WeatherNext 3 — Google DeepMind

  • 一言以蔽之:Google DeepMind 与 Google Research 联合发布 WeatherNext 3,标志着全球气象 AI 模型在降水精度与实时性上取得重大突破。
  • 核心亮点
    • 相较于上一代方法,WeatherNext 3 在全球降水预报中实现了高达 50% 的误差减少,尤其在传统预报准确率较低的地区表现惊艳。
    • 现已深度集成至 Google Search、Gemini、Google Maps 以及 Google Cloud 平台,支持小时级更新。
  • 技术规格:实时观测驱动 / 高分辨率气象生成 / 跨平台全生态接入
  • 传送门Google DeepMind 官方博客

产品发布/更新

Grok Bot 企业版 — xAI

  • 一言以蔽之:xAI 正式推出 Grok Bot 企业版,重构企业级多智能体协作界面,为全体 Grok 与 Cursor 企业客户提供限时免费体验。
  • 更新内容:Grok Bot 改变了传统单次会话的交互形态,让 Bot 拥有独立的身份、持久化记忆以及专属计算沙箱。企业用户可借此将成千上万个具备专业能力的智能体无缝接入团队日常工作流。
  • 适用人群:[企业研发团队 / DevOps 工程师 / 现代化组织管理者]
  • 体验通道xAI 官方新闻

MAI-Transcribe 2 — Microsoft

  • 一言以蔽之:微软正式上线全新语音大模型 MAI-Transcribe 2,以极致的性能与性价比登顶各大语音评测榜首。
  • 更新内容:支持多达 60 种语言的高精度语音转文字,具备自动语种识别、代码混杂处理、说话人分离(Diarization)及词级时间戳输出功能,运行速度较同类产品实现数倍提升。
  • 适用人群:[语音应用开发者 / 跨国协作办公族 / 媒体内容创作者]
  • 体验通道

Extract Turbo — LlamaIndex

  • 一言以蔽之:LlamaIndex 推出由视觉大模型(VLM)驱动的超高速文档提取工具 Extract Turbo,解决高复杂度非结构化文档解析痛点。
  • 更新内容:处理速度较同类 OCR 方案及常规 LlamaParse 层级提升 3 到 5 倍,中位延迟仅需 3.7 秒/页,且支持并行处理,即使面对长记录列表、手写体和复杂表格也能保持极高准确率。
  • 适用人群:[企业数据工程师 / AI 智能体应用开发者 / 金融法律文档分析师]
  • 体验通道

行业动态

NVIDIA 官方宣布以 129.3 亿美元收购 Hugging Face — NVIDIA

  • 事件概述:NVIDIA 官方博客正式宣布,已同意以 129.303 亿美元收购开源 AI 社区龙头 Hugging Face。黄仁勋表示交易完成后 Hugging Face 将维持开源平台定位。
  • 影响分析:这标志着 NVIDIA 的业务版图正式从底层算力芯片向上游开发者生态和模型枢纽大幅延伸。将全球超过 1800 万开发者及数百万开源模型深度并入后,NVIDIA 进一步巩固了其在 AI 时代的绝对生态统治力。
  • 新闻链接NVIDIA 官方博客

E-Commerce Bench — 阿里通义千问 (Alibaba Qwen)

  • 事件概述:阿里通义团队发布面向长程自主商业运营的全新基准测试 E-Commerce Bench,用于严苛评估智能体在复杂经济环境中的持续决策能力。
  • 影响分析:该基准让智能体携带初始资金在模拟市场中独立运营网店 365 天,涵盖供应商谈判、风控、供应链及现金流管理,为评估企业级智能体的长流程业务落地提供了高标准标尺。
  • 新闻链接

论文研究

Language Models Can Control Their Own Attention (Declarative Attention) — KAIST AI & Google DeepMind

  • 研究动机:传统大模型在处理超长文本或多轮链式推理时,固定模式的注意力机制容易引入大量冗余的 KV Cache 读取,拖慢推理效率并限制上下文潜能。
  • 核心创新:提出声明式注意力机制(Declarative Attention),赋予大模型在推理过程中自主控制注意力范围与权重的能力,实现动态按需检索。
  • 研究成果:有效减少了长程生成任务中的无效计算开销,显著提升了模型在复杂多跳推理任务中的效率与准确度。
  • 论文地址

其他分享

funes: 面向编码智能体的本地持久化记忆层 — Hugging Face

  • 内容简介:Hugging Face 开源了 funes 工具。它专为 Claude Code、Codex、Hermes 等主流编码智能体设计,能够将过去的会话历史无缝索引为本地 Lance 数据集,只需一条命令即可让 Agent 在后续开发中自主召回原始出处与上下文。
  • 传送门Hugging Face 官方博客

Yingzao (营造) — 旅行摄影海报生成 Skill

  • 内容简介:开源实用 Agent Skill guizang-yingzao-skill。它能够智能分析用户的旅行风景照片,结合内置的 Design Token 与排版 Recipe,一键生成兼具专业排版、字体设计与文化底蕴的杂志级海报。
  • 传送门
分享到:
Featured Partners

© 2026 Communeify. All rights reserved.