AI日报|Qwen3.8-LiveTranslate 实时同传发布;xAI 推出 Grok Voice Transcribe 2.0;Anthropic 与 Accenture 达成 10 亿美元安全评估合作
模型发布/更新
Qwen3.8-LiveTranslate — Qwen / 阿里巴巴
- 一言以蔽之:Qwen 正式发布 Qwen3.8-LiveTranslate 实时同声传译大模型,通过架构重构将平均滞后时间大幅缩短。
- 核心亮点:
- 架构升级:采用全新 Interleave 架构与 Hybrid-MoE Thinker-Talker 设计,专门针对实时同声传译场景进行端到端优化。
- 超低延迟:实测平均滞后(LAAL)从上一代的 2.8 秒显著降至 2.3 秒,提供更加丝滑的实时双语语音交互体验。
- 技术规格:实时同传大模型 / 闭源与 API 同步上线 / 支持多语言平滑切换
- 传送门:Qwen 官方博客
Grok Voice Transcribe 2.0 — xAI / SpaceXAI
- 一言以蔽之:xAI 推出 Grok Voice Transcribe 2.0,在准确率和流式响应速度上创下行业新高。
- 核心亮点:
- 准确率翻倍:在客服通话、专有名词与简短语音指令等复杂场景下的准确率较前代提升一倍,登顶 Artificial Analysis 榜单流式模型首位。
- 极速流式转写:在语音结束后 0.49 秒内即可输出首个部分转写及最终转写结果,延迟与精度达到全球领先水平。
- 技术规格:语音转文字大模型 / 批量价格 0.10 美元/小时 / 流式价格 0.20 美元/小时
- 传送门:
Helix 2.5 — Figure AI
- 一言以蔽之:人形机器人公司 Figure 推出 Helix 2.5 神经网络模型,并在未采集新数据的 30 套陌生住宅中实现零样本全身任务成功率飙升。
- 核心亮点:
- 零样本泛化能力:在没有任何新数据采集、不额外训练、也不做环境适配的前提下,人形机器人的零样本成功率从 9% 暴增至 56%。
- 长时程全身操纵:成功在从未进入过的家庭环境中独立完成整理客厅、狭窄空间穿行铺床以及折叠未知毛巾三项复杂全身任务。
- 技术规格:人形机器人视觉操纵神经网络 / 零样本迁移 / Figure 03 硬件适配
- 传送门:微信报道来源
jina-ocr-v1 — Jina AI
- 一言以蔽之:Jina AI 发布紧凑型端到端视觉文档解析模型 jina-ocr-v1,在低成本 GPU 上实现性能与吞吐双突破。
- 核心亮点:
- 高压缩比与高性能:总参数 3.4B,解码时每个 Token 仅激活 570M,在 OmniDocBench 和 olmOCR-Bench 两大基准上刷新同级别最佳成绩。
- 推测解码加速:配备内置推测解码草稿头,在单张 NVIDIA L4 等低成本显卡上生成速度几乎翻倍,且输出序列与标准自回归解码严格一致、完全无损。
- 技术规格:3.4B MoE 架构 / 激活参数 570M / 支持 Hugging Face 与 ModelScope
- 传送门:Hugging Face 仓库
GLM-5.3-FlashX — 智谱
- 一言以蔽之:智谱正式推出 GLM-5.3-FlashX,依托 10 万张国产芯片算力实现全方位提速。
- 核心亮点:
- 极致推理速度:模型推理速度最高可达 200 tokens/s,完美契合代码智能体、工具循环及高频交互应用对速度的严苛要求。
- 高性价比普惠:在保持同尺寸最强智能水平与极高性价比的同时,进一步缩小了响应延迟。
- 技术规格:闭源商业大模型 / 支持火山方舟与智谱开放平台 API / 优化推理基础设施
- 传送门:智谱官方说明
产品发布/更新
Claude Code v2.1.277 — Anthropic
- 更新内容:Anthropic 发布 Claude Code 2.1.277 版本,正式内置对
AGENTS.md配置文件的原生支持。当项目中没有CLAUDE.md时,Claude 将自动读取并执行AGENTS.md,开发者也可在/config中进行自定义切换,从而免去维护多份规则文件的烦恼。 - 适用人群:[软件开发者 / AI 编码助手用户 / 智能体架构师]
- 体验通道:Claude Code 官方更新日志
Junie Local 与 /demo 功能 — JetBrains
- 更新内容:JetBrains 推出 Junie Local 更新,带来通过混合 Qwen3.8 和 Qwen3.6 打造的
Qwen3.8-3.6-27B-blend优化编码模型。同时上线全新/demo模式,可由智能体自动编译并启动应用、交互 UI 并录制生成包含网页报告、截图和视频的测试结果,将 routine 点击测试彻底自动化。 - 适用人群:[本地大模型开发者 / 程序员 / QA 测试人员]
- 体验通道:JetBrains Junie 博客
行业动态
Anthropic 与 Accenture 达成 10 亿美元嵌入式独立评估合作
- 事件概述:Anthropic 宣布与 Accenture(通过其旗下 AI 业务 Faculty)达成战略合作,引入其作为首个第三方嵌入式评估方。双方预计在未来五年内至少共同投入 10 亿美元,驻场对前沿大模型开展红队测试、对齐评估与安全防护审查。
- 影响分析:标志着头部 AI 厂商在安全治理与第三方独立监管上迈出了制度化的一大步,有助于建立公众对前沿大模型安全性的信任。
- 新闻链接:Anthropic 官方公告
安全研究员利用 Claude 漏洞链在 72 小时内接管 OpenAI 员工账号
- 事件概述:安全公司 Hacktron 的三名研究员公开披露,他们于 7 月 25 日利用开源论坛 Discourse 的 libheif 图像解码漏洞以及 OpenAI 的 SSO 单点登录缺陷,串联成功接管了多名 OpenAI 员工的 ChatGPT/Codex 账号,攻击核心代码由 Claude 编写。攻击者在内部代码库提交无害 PR 后停止并上报,相关漏洞目前已修复。
- 影响分析:该事件再次给行业敲响警钟:在高度自动化的 AI 编程与智能体时代,底层传统软件供应链与单点登录安全性依然是防范攻击的核心短板。
- 新闻链接:
美军因 AI 幻觉情报险些对中国船只发起武装拦截
- 音事件概述:据 CNN 独家报道,今年春天美伊冲突期间,美军特种作战司令部的一名分析师使用 AI 聊天机器人混合开源与机密信号情报,生成了一份错误断言某中东中国船只运载核武部件的虚假情报。美军一度升空军机并准备强行登检,在行动执行前的最后一刻因深入人工核查才被紧急叫停。
- 影响分析:暴露了军方在缺乏统一校验标准下盲目整合 AI 工具的巨大风险,引发了全社会对 AI 幻觉在军事与高风险决策链条中危害的深度担忧。
- 新闻链接:CNN 详细报道
论文研究
JEPA-Anything: Learning Predictive Models across Different Worlds — Meta / 开源社区研究团队
- 研究动机:联合预测架构(JEPA)在单一世界模型表现优异,但如何跨越不同物理或虚拟世界进行统一的预测建模仍是一大挑战。
- 核心创新:提出 JEPA-Anything 框架,探索在不同世界模型与环境中学习通用的表征与预测机制,实现跨模态、跨场景的预测对齐。
- 研究成果:实验证明该方法能够在多种异构世界模拟中提供更强大的零样本预测与环境理解能力。
- 论文地址:
其他分享
AgentCloak:保护个人隐私的浏览器端 AI 提示词脱敏插件
- 内容简介:一款免费的浏览器扩展工具 AgentCloak,专门用于在发送提示词给 ChatGPT、Claude 等大模型之前,自动将真实的敏感个人信息替换为逼真的虚假占位符,并在模型返回答案时无缝还原。在日常日志调试和客服工单总结时非常实用。
- 传送门:

