news

AIデイリー|NVIDIAがローカル向け高速MoE「Nemotron 3.5 Lightning」を発表、Gemini月活10億人突破

August 12, 2026
Updated Aug 12
2 min read
nvidia
Iデイリー|NVIDIAがローカル向
gemini
g」を発表、Gemini月活10億人
spark
CやDGX Sparkなどのローカ
lightricks
2.5 — Lightricks ひとことで
replicate
成 リンク:Replicate MAI-C
microsoft
ash — Microsoft AI ひと
news
AIデイリー|NVIDIAがローカル向け高速MoE「Nemotron 3.5 Lightning」を発表、Gemini月活10億人突破
2026-08-12

AIデイリー|NVIDIAがローカル向け高速MoE「Nemotron 3.5 Lightning」を発表、Gemini月活10億人突破


モデルリリース・アップデート

Nemotron 3.5 Lightning — NVIDIA

  • ひとことで言うと:NVIDIAがローカル環境で常時稼働するAIエージェント向けに、30Bパラメータ(アクティブ3B)の超高速オープンソースMoEモデル「Nemotron 3.5 Lightning」を公開しました。
  • 主なポイント
    • フラッグシップモデル「Nemotron 3 Ultra」からの蒸留によって構築され、同規模のオープンモデルと比較してトークン生成速度が最大4倍向上し、タスク完了時間を30%削減。
    • ツール呼び出し、結果の検証、タスクの委任など、長時間実行されるエージェントのループ処理に最適化。
    • RTX PCやDGX Sparkなどのローカル環境からデータセンターまで幅広く実行可能。
  • 技術仕様:30B MoE(アクティブ3B)/ オープンウェイト(Hugging Faceで公開)/ 100万トークンコンテキスト対応
  • リンクNVIDIA 公式ブログ

Ling-3.0-tiny — 螞蟻百靈(Ant Group)

  • ひとことで言うと:アリババグループ傘下のAnt Group(螞蟻百靈)が、推論時にわずか1.3Bパラメータのみを有効化する軽量な原生ハイブリッド推論モデル「Ling-3.0-tiny」をオープンソース公開しました。
  • 主なポイント
    • 総パラメータ数7.9Bに対し、アクティブパラメータを1.3Bに抑えることで低リソース環境での高速推論を実現。
    • BF16、FP8、INT4の3つの量子化バージョンを同時公開し、実用的なAIエージェントへの組み込みに最適化。
  • 技術仕様:総7.9B / アクティブ1.3B MoE / オープンソース / BF16・FP8・INT4対応
  • リンクHugging Face

LTX-2.5 — Lightricks

  • ひとことで言うと:LightricksがNVIDIAアクセラレーションに対応したオープンウェイトの動画・世界モデル「LTX-2.5」を発表しました。
  • 主なポイント
    • 複雑なシーンに応じて計算量を動的に追加する「Diffusion Fidelity Rendering」を導入。
    • ネイティブ4K HDR画像・動画生成、モーションコントロール、音声との同調同期生成に対応。
    • NVIDIA RTX GPUおよびDGX Spark向けに最適化され、VRAM消費を大幅削減。
  • 技術仕様:オープンウェイト / ネイティブ4K HDR対応 / 音声・映像一体生成
  • リンクReplicate

MAI-Code-1.1-Flash — Microsoft AI

  • ひとことで言うと:Microsoft AIが最新のコード生成モデル「MAI-Code-1.1-Flash」を発表し、GitHub Copilotへの順次展開を開始しました。
  • 主なポイント
    • 画像理解が可能なネイティブビジョン機能を新たに搭載。
    • 従来モデル(MAI-Code-1-Flash)と比較して効率が25%向上し、API提供価格を73%引き下げ。
    • 指示従順性、ツール利用、コード品質の各種ベンチマーク性能が大幅向上。
  • 技術仕様:非公開モデル / ネイティブビジョン対応 / GitHub Copilot統合
  • リンクMicrosoft AI 公式ニュース

プロダクトリリース・アップデート

Grok Bot (Beta) — xAI

  • アップデート内容:xAIが自律型AIチームメイト機能「Grok Bot」のパブリックベータ版をリリースしました。各Botはクラウド上の専用仮想コンピュータ環境を持ち、各種Webツールや社内アプリに直接ログインして、営業リード開拓、カスタマーサポート応答、請求書照合、QAテストなどの業務を24時間体制で自律実行します。また、CursorなどのIDE環境への統合もサポートされています。
  • 対象ユーザー:[エンジニア / 開発チーム / ビジネスパーソン / 運用担当者]
  • 利用方法

ChatGPT Linux版デスクトップアプリ Preview & ワークスペース同期 — OpenAI

  • アップデート内容:OpenAIがLinux(Ubuntu 24.04/26.04、Debian 13、Fedora 43/44)向け「ChatGPT デスクトップアプリ」のプレビュー版を公開しました。ChatGPT、ChatGPT Work、Codexが統一インターフェースで利用可能となったほか、他ツールからプロジェクト設定、チャット履歴、エージェント技能、プラグインを数クリックで移行・同期できるインポート機能も追加されました。
  • 対象ユーザー:[Linuxユーザー / 開発者 / エンタープライズ開発チーム]
  • 利用方法

WebStorm Agent Client Protocol (ACP) — JetBrains

  • アップデート内容:JetBrainsがIDEとAIエージェントを分離・接続するオープン規格「Agent Client Protocol (ACP)」に対応しました(LSPがプログラミング言語の統合を変革したのと同様のアプローチ)。これにより、ユーザーはJetBrains AIサブスクリプションを介さず、AnthropicやOpenAI、Googleの既存APIキーやエージェントを直接WebStorm上で自由に利用できるようになりました。
  • 対象ユーザー:[Web開発者 / フロントエンドエンジニア]
  • 利用方法JetBrains 公式ブログ

NeMo Switchyard — NVIDIA

  • アップデート内容:NVIDIAがAIエージェントのためのオープンソース・モデルルーティングライブラリ「NeMo Switchyard」を公開しました。高度な計画や推論にはフロンティアモデル(Claude Opus等)を使用し、大量実行フェーズには「Nemotron 3.5 Lightning」のような高速・低コストモデルに自動でルーティングすることで、精度をほぼ維持(約90%)しながら運用コストを約70%削減できます。
  • 対象ユーザー:[AIエージェント開発者 / システムアーキテクト]
  • 利用方法NVIDIA 公式ブログ

ZCode 機能大幅更新 — 智譜 AI(Zhipu AI)

  • アップデート内容:中国の智譜AI(Zhipu AI)がGLM-5.2モデルに特化したコーディング開発基盤「ZCode」のメジャーアップデートを実施しました。「Goal(目標指示)」「Subagents(サブエージェント協調)」「Remote Control(リモート制御)」「オフピーク実行タスク」の4機能が追加され、コンテキストキャッシュ命中率は98%以上に達しています。
  • 対象ユーザー:[ソフトウェアエンジニア / 長時間コーディングを行う開発者]
  • 利用方法ZCode 公式ページ

業界動向

Google Gemini アプリの月間アクティブユーザー数が10億人を突破

  • 概要:Google CEOのSundar Pichai氏が、AIアシスタント「Gemini」アプリの月間アクティブユーザー(MAU)数が10億人を突破したことを発表しました。Google史上最も速いペースで10億ユーザーに到達したプロダクトとなりました。
  • 影響分析:先日10億ユーザー突破を発表したChatGPTと並び、フロンティアモデルを中心とした日常使いのAIサービスが世界規模で完全に定着したことを示しています。モバイル端末やオフィスツールへの深い統合がユーザー層拡大をさらに加速させています。
  • ニュースリンクGoogle 公式ブログ

OpenAI COOのBrad Lightcap氏が8年間の在籍を経て退任を発表

  • 概要:2018年よりOpenAIの最高執行責任者(COO)を務めてきたBrad Lightcap氏が、新規事業の立ち上げに伴い同社を退任することを発表しました。
  • 影響分析:OpenAIを小規模研究ラボから世界的AIエンタープライズへと急速成長させたキーマンの離脱であり、今後の同社の商用化戦略や新設される事業体への市場の関心が集まっています。
  • ニュースリンク

OpenAIがChatGPT無料版での広告導入の試験運用を発表

  • 概要:OpenAIがChatGPTの無料ユーザー向けに広告表示の試験運用を開始することを公式ブログで発表しました。回答の独立性を維持し、プライバシー保護と透明性を担保した上で運用されるとしています。
  • 影響分析:無料ユーザー層をカバーするためのサーバーコスト負担軽減と収益化モデルの多角化を狙った動きです。検索エンジンと生成AIの融合が進む中、AI回答における広告モデルの標準化に影響を与える可能性があります。
  • ニュースリンクOpenAI 公式ブログ

研究論文

主要AI APIにおける暗号化思考プロセスの脆弱性と秘密情報の漏洩リスク — インディペンデント研究チーム

  • 研究の背景:OpenAIやAnthropic、GoogleなどのAPIは、推論モデルの思考プロセス(Chain of Thought)をクライアント側に隠蔽された暗号化ブロックとして返却しますが、その安全性とデータ保護の堅牢性が検証されました。
  • 主な革新点:暗号化された思考トークンブロックがセッションやユーザー、モデル間で再利用可能である脆弱性を発見。下位モデルに上位モデルの思考ブロックを入力し、リプレイ攻撃(越獄)を実行することで、暗号化された思考内容を平文として復元する手法を確立しました。
  • 研究成果:解析した6,708件の会話ログから31.5万個の思考ブロックを復元したところ、4.9%のセッションでパスワードやAPIキー(62件のAPIキー、33件のパスワード等)などの機密情報が隠蔽思考内に残留していたことが判明しました(※現在全提供元にて修正済み)。
  • 論文リンクSimon Willison 解説記事

AMIE:リアルタイム臨床ビデオ問診を実現する医療特化型AIシステム — Google Research / Google DeepMind

  • 研究の背景:実際の医療現場において、視覚的・聴覚的ヒントをリアルタイムに解釈し、専門家レベルの問診や体調評価を行えるAIシステムの構築が求められていました。
  • 主な革新点:GeminiとProject Astraをベースに構築された医療AI「AMIE」が、リアルタイムの臨床ビデオ問診を実行できるよう拡張されました。
  • 研究成果:模擬患者を用いた臨床評価において、病史聴取の包括性や診断精度の高さが高く評価され、評価者および患者役の被験者の双方から医師対面以上の肯定的なフィードバックを獲得しました。
  • 論文リンクGoogle Research 公式ブログ

ExtractBench:エンタープライズ複雑文書からの情報抽出を総合評価するベンチマーク — LlamaIndex

  • 研究の背景:既存のドキュメント抽出ベンチマークは規模が小さく、金融やエネルギー等の実務で頻出する複雑な表構造、手書き文字、スキャン画像、長尺ファイルへの対応力を正確に測定できていませんでした。
  • 主な革新点:8つの業界ドメインから4,869ページ、67種類の文書タイプを集積し、14の最上位VLMやAIコーディングエージェント、抽出専用APIを包括比較する「ExtractBench」を構築。
  • 研究成果:最新のフロンティアモデルであっても、極めて複雑な実務文書(1,000行超の表やネストされた表など)からの正確な抽出およびコスト効率の両立には依然として大きな課題が存在することが定量的に示されました。
  • 論文リンクLlamaIndex 公式ブログ

その他の話題

Oumi:「複合型AIファクトリー」自律学習プラットフォームを公開

  • 内容紹介:AIスタートアップのOumiが、本番環境のトラフィックからモデルが自己評価・合成データの生成・再学習を完全自動でループ実行する「Compound AI Factory」基盤を発表しました。外部APIのレンタルに頼らず、自社特有のインテリジェンスとモデルアセットを蓄積・強化可能にします。
  • リンク

Qwen3.8-27B オープンウェイトモデルが今週公開へ — Alibaba Qwen

  • 内容紹介:Alibaba Qwenチームが公式Xにて、開発者向けエージェント・コーディング性能を大幅に向上させた次期オープンウェイトモデル「Qwen3.8-27B」を今週中にリリースすることを明らかにしました。
  • リンク
シェアする:
Featured Partners

© 2026 Communeify. All rights reserved.