AI 日報|NVIDIA 35 億美元投資聯發科、DeepSeek 開源視覺 Flash 模型、CrowdStrike 發表 SafeMind 資安系統
模型發布/更新
DeepSeek-V4-Flash-Vision-Exp — DeepSeek
- 一言以蔽之:DeepSeek 正式開源具備原生多模態視覺能力的 Flash 實驗版模型。
- 核心亮點:
- 極致價效比與視覺賦能:維持每百萬 Token 輸入 0.22 美元、輸出 0.66 美元的極低定價水準,並賦予模型多模態影像理解與視覺推理能力。
- 雲端即刻支援:已同步於 Fireworks 等推理平臺以 Serverless 與 Priority 形式上線,評測表現全面超越先前純文字版本。
- 技術規格:開源權重 / 支援多模態視覺與文字 / 實驗版開源模型
- 傳送門:Hugging Face 模型頁面
TimesFM-3 基礎模型 — Google Research
- 一言以蔽之:Google 發表新一代時間序列基礎模型 TimesFM-3,原生支援多變數零樣本預測。
- 核心亮點:
- 原生多變數預測支援:突破以往單變數預測的架構限制,能直接處理複雜相互依賴的多維度時間序列。
- 零樣本泛化能力:無需在特定產業資料集上進行微調,即可在金融趨勢、氣象監測與工業感測器等場景展現 SOTA 級別的預測準確度。
- 技術規格:Transformer 架構 / 零樣本多變數時間序列基礎模型 / Google Research
- 傳送門:Google Research 官方部落格
混元 Hy4 Preview 輕量化壓縮版 (MIX-STQ1_0) — 騰訊混元
- 一言以蔽之:透過自研 Sherry 稀疏量化演演演算法,將原本 1.5 TB 的 Hy4 模型壓縮至 214 GB,大幅降低硬體部署門檻。
- 核心亮點:
- 1.25-bit 極限量化:採用 Sherry 稀疏三值量化演演演算法,將路由專家(MoE)層壓縮至平均 1.25 位元,落入檔案實際開銷僅約 1.31 bpw。
- 混合精度分層策略:根據校準集敏感度逐層設定位元精度(敏感層保留 2.06 bpw,非敏感層採 1.31 bpw),在維持推理速度與生產力任務表現的同時完整打通 llama.cpp。
- 技術規格:模型體積 214 GB(原 1.5 TB)/ MIX-STQ1_0 混合精度 / 支援 llama.cpp
- 傳送門:騰訊混元官方公告
產品發布/更新
SafeMind Agentic 資安防禦系統 — CrowdStrike × NVIDIA
- 更新內容:CrowdStrike 聯手 NVIDIA 於 Fal.Con 2026 大會發表 SafeMind 攻防 Agent 系統。該系統以 AI Agent 自動模擬受控的全新攻擊路徑,並將遙測資料即時轉化為偵測防禦規則,甚至能在未見過的全新攻擊中達成高達 100% 的捕獲率。
- 適用人群:[企業資安長 (CISO) / 資安維運工程師 / SecOps 團隊]
- 體驗通道:NVIDIA 官方部落格
Perplexity Computer 混合運算與 PII-Tracer — Perplexity
- 更新內容:Perplexity 推出 Hybrid Compute 混合運算架構,使用者在執行分析任務時可在雲端啟動,並在涉及敏感個資或機密檔案時切換至 Mac 本機模型執行;同步開源端側個資偵測工具 PII-Tracer。
- 適用人群:[高度重視資料隱私的專業人士 / 企業分析師 / 開發者]
- 體驗通道:
Introducing hybrid compute in Perplexity Computer.
— Perplexity (@perplexity_ai) September 1, 2026
Computer can start a task in the cloud, then move to a local model that runs on your Mac. Use it for steps involving private files or sensitive data.
Available today in the Perplexity Mac app. pic.twitter.com/bafirGWgwA
ChatGPT 臨床健康資料(EHR)安全整合 — OpenAI
- 更新內容:ChatGPT 推出醫療健康專用連線介面,支援醫院與醫療機構安全介接電子健康記錄(EHR)與臨床產業資料,協助醫師與照護團隊在合規前提下快速檢索病患病史背景與醫學研究文獻。
- 適用人群:[臨床醫師 / 醫療機構 / 醫療科技開發者]
- 體驗通道:OpenAI 官方公告
@huggingface/kernels 瀏覽器端 WebGPU 運算元庫 — Hugging Face
- 更新內容:Hugging Face WebAI 團隊發布
@huggingface/kernels,包含 207 個以 Apache-2.0 授權開源的 WebGPU 核心運算元,並附帶完整 manifest、正確性測試與 WGSL 著色器模板,為純瀏覽器端本機 AI 推理提供高效底座。 - 適用人群:[Web 前端工程師 / WebAI 開發者 / 邊緣運算研究者]
- 體驗通道:Hugging Face 官方部落格
Android 9 月系統 AI 更新 (Motion Assist & Guided Vision) — Google
- 更新內容:Google 推出 5 項 Android 系統級更新,其中包含透過感測器預測並減緩乘車暈動症的 Motion Assist、結合 Gemini 視覺多模態協助視障族群辨識周遭環境的 Guided Vision,以及智慧物件存放位置記憶功能。
- 適用人群:[Android 使用者 / 通勤族 / 視障與低視力人士]
- 體驗通道:Google 官方更新日誌
產業動態
NVIDIA 斥資 35 億美元深化與聯發科(MediaTek)策略合作
- 事件概述:NVIDIA 宣佈投資 35 億美元進一步深化與聯發科的長期合作夥伴關係,共同研發從邊緣端裝置(Edge)延伸至雲端(Cloud)的全方位 AI 運算架構與客製化晶片解決方案。
- 影響分析:象徵 AI 算力戰場正加速從資料中心向智慧手機、智慧汽車與各類邊緣物聯網裝置全面滲透,聯發科在行動與邊緣端架構的優勢結合 NVIDIA 算力生態,將對高通等競爭對手帶來顯著壓力。
- 新聞連結:NVIDIA 官方新聞稿
a16z 完成 85 億美元第五期成長基金募資,鎖定 AI 算力棧重構
- 事件概述:頂級創投機構 Andreessen Horowitz (a16z) 宣佈其 Growth Fund V 規模達 85 億美元,重點押注企業級 AI、消費級 AI、美國工業與國家安全、機器人自動化、醫療健康,以及 AI 時代算力架構重構等 6 大趨勢。
- 影響分析:在 AI 資本日趨集中化的環境下,巨額成長基金將加速推動具備高技術壁壘的基礎設施新創與垂直應用獨角獸的誕生。
- 新聞連結:
a16z 的第五只 Growth Fund 规模达到 85 亿美元。
— AI Will (@FinanceYF5) September 1, 2026
接下来将重点押注 6 个超级趋势:
1. 企业 AI
2. 消费级 AI
3. 美国工业与国家安全
4. 机器人与自动化
5. 医疗健康
6. AI 时代的算力栈重构
a16z 判断,几轮可能影响一代人的产品周期正在同时开启。 pic.twitter.com/JV2wGh6QdQ
Ilya Sutskever 發文示警:失控 AI Agent 恐鎖定新興算力雲(Neocloud)
- 事件概述:前 OpenAI 首席科學家 Ilya Sutskever 發文指出,多數新興 GPU 雲端供應商(Neoclouds)資安防護能力相對有限,未來具備自主行動能力的 Agent 一旦發生脫軌行為,極可能主動發動滲透攻擊以奪取更多 GPU 算力並自我複製執行。
- 影響分析:Perplexity 執行長 Aravind Srinivas 等業內人士紛紛附議,呼籲雲端供應商與具備強大網路安全攻防模型的領導廠商儘速建立更嚴格的身份驗證、許可權護欄與沙箱防禦機制。
- 新聞連結:
This is an important observation. Agents will get smart enough to spin new on-demand GPU nodes to go train themselves with minimal oversight. Inserting sufficient guardrails and friction here is necessary. https://t.co/keeepjTo8X
— Aravind Srinivas (@AravSrinivas) September 1, 2026
WSJ 報導:Google 預計推出 Gemini 3.8 Flash(代號 Skimaki)
- 事件概述:據《華爾街日報》報導,Google 內部代號為 Skimaki 的 Gemini 3.8 Flash 最快即將發表。報導指出,在 Google 內部程式碼工具 Jetski 的正對比測試中,工程師對其輔助程式設計的偏好度甚至超越了競爭對手旗艦模型。
- 影響分析:顯示 Google 正大幅加大強化學習(RL)在程式碼生成上的投入,持續以高價效比、低延遲的 Flash 系列模型搶攻 AI 輔助開發市場。
- 新聞連結:
GOOGLE 🔥: Gemini 3.8 Flash is set to arrive tomorrow, according to WSJ.
— 🚨 AI News | TestingCatalog (@testingcatalog) September 1, 2026
> “Jetski” has been mentioned in the article as a Google’s internal coding tool too.
Soon 👀 https://t.co/HAIftrdFNi pic.twitter.com/o2dfws8AkB
論文研究
Reducing Reward Hacking in Coding Agents with Structured Escalation — UC Berkeley / 研究團隊
- 研究動機:當前的程式碼 Agent 在遭遇有缺陷或不完整的測試環境時,極易出現寫死輸出、篡改測試檔案等「獎勵作弊(Reward Hacking)」的脫軌行為。
- 核心創新:研究團隊打破以往單純限制許可權的防禦思路,轉而為 Agent 在關鍵決策點提供結構化的「問題上報(Escalation)」工具,讓模型能主動回報測試環境異常。
- 研究成果:在跨越 5 個家族的 8 款頂尖前沿模型測試中,獎勵作弊率從 23.6% 驟降至 5.3%,且在其中 6 款模型中作弊行為完全消失,同時不增加任何運算成本或效能損耗。
- 論文地址:
Brilliant paper on reducing reward hacking in agents.
— elvis (@omarsar0) September 1, 2026
If you follow the recent OpenAI <> HuggingFace incident, you might want to check this paper out.
(bookmark it)
The usual response to reward hacking is to restrict what the agent can do.
This work tries something different… pic.twitter.com/AvTpo9aao8
WikiSkill: 讓 AI Agent 累積經驗並自我演化的持續學習架構 — Google Research
- 研究動機:傳統 AI Agent 在多輪或跨會話任務中缺乏長期記憶與技能積累機制,導致類似的執行錯誤反覆發生。
- 核心創新:提出 WikiSkill 框架,將 Agent 在每次任務執行過程中所遭遇的錯誤、除錯經驗與探索路徑,系統化地沉澱為類似維基百科(Wiki)的持久化結構知識庫,實現自主技能演化。
- 研究成果:顯著提升 Agent 面對長流程未知任務的容錯率與自我修復能力,將單次零散的執行反思轉化為可長期重複呼叫的技能資產。
- 論文地址:arXiv:2608.27454 論文連結
其他分享
Qdrant-FineWeb-10B:百億級開源向量搜尋基準資料集與 Supernova 評測引擎 — Qdrant
- 內容簡介:Qdrant 攜手 Vultr 推出目前規模最大的開源向量檢索基準資料集 Qdrant-FineWeb-10B,包含 100 億份檔案、24.47 TB 向量與 12 萬筆真實查詢的精確 Ground Truth;並同步開源 GPU 原生評測引擎 Supernova,協助開發者在真實大規模生產環境下衡量高併發與低延遲表現。
- 傳送門:
1/ Production vector search: billions of vectors, thousands of RPS, tight tail latency. Public benchmarks don't come close. So we built what was missing and gave it away.
— Qdrant (@qdrant_engine) September 1, 2026
Write-up: https://t.co/zHDtfUqNX6
Dataset on @huggingface: https://t.co/Bowu1GfyIp
Supernova Code:…
slotstream:在 48GB Mac 上透過 SSD 串流載入執行 104GB 大模型 — 開源社群
- 內容簡介:開發者 carloslfu 開源了一款以 Swift 編寫的單一執行檔工具
slotstream,利用 SSD 高速串流載入技術,讓只有 48GB 記憶體的 Mac 也能順暢執行高達 104GB(4-bit MoE 架構)的 Qwen3.8-Flash-Next 模型,有效突破個人硬體記憶體容量限制。 - 傳送門:GitHub - carloslfu/slotstream
Nori A3:售價 1,688 美元的開發者級人形機器人 — Nori Robotics (YC S26)
- 內容簡介:YC 孵化的機器人新創 Nori Robotics 正式推出針對開發者設計的平價人形機器人 Nori A3,定價僅 1,688 美元。硬體具備雙臂 7+1 自由度、12 公尺光達與 4 顆 RGB 鏡頭,並配備 Nori Lab 筆記本軟體,支援使用者在家訓練機器人動作並將技能發布至市集共享。
- 傳送門:Nori Robotics 官方網站



