AIデイリー|OpenAIが初のエージェント向けカスタム推論チップ「Jalapeño」を発表;Appleが初の2nmチップ「M6」および「M5 Ultra」を公開
モデルリリース・アップデート
IBM Granite 4.2 (3B / 8B / 30B) — IBM
- ひとことで言うと:企業向けに特化し、ネイティブな思考チェーンと最大512Kコンテキストを備えたオープンウェイトの推論モデルファミリーが公開されました。
- 主なポイント:
- デコードオンリーの密な構成を採用し、フラッグシップの30Bモデルでは
<think>タグによるネイティブな思考(Chain-of-Thought)をサポートしています。 - フル思考、非思考、低負荷の柔軟なモード切替が可能で、Apache 2.0ライセンスのもと商用利用および研究利用に開放されています。
- デコードオンリーの密な構成を採用し、フラッグシップの30Bモデルでは
- 技術仕様:3B / 8B / 30B パラメータ(Dense構成) / Apache 2.0 / 最大512Kコンテキスト / Ollama等で対応
- リンク:
IBM Granite 4.2 is now available on Ollama.
— ollama (@ollama) August 25, 2026
3B, 8B, 30B parameter open models made for enterprise agents.
This model is free to use and is licensed for both research and commercial usage.
The data curation and training processes were specifically designed for enterprise… https://t.co/IN3O39Qmrh
Apodex 1.1 mini (35B) — Apodex
- ひとことで言うと:複雑な科学研究、金融分析、データ処理を自律的に遂行するオープンウェイトの35Bエージェントモデルおよび専用ハーネスが公開されました。
- 主なポイント:
- CSVやPDFなどのローカルファイルを直接読み込み、コードを実行して分析結果を導き出す高度なエージェント性能を発揮します。
- 開発者向けのオープンソースハーネス(FrontierAgent)も同時に公開され、ローカル環境での複雑なタスク自動化に対応します。
- 技術仕様:35Bパラメータ / オープンウェイト / OSS Harness(FrontierAgent)付属
- リンク:
Apodex 1.1
— AK (@_akhaliq) August 25, 2026
Scaling Agentic Intelligence for Complex Work
paper: https://t.co/bZUS55viAw pic.twitter.com/UWeTBvUj4S
プロダクトリリース・アップデート
Jalapeño 芯片性能データ — OpenAI
- ひとことで言うと:OpenAIが初の自社製カスタム推論チップ「Jalapeño」の初測定結果を公開し、既存の商用システムを大きく上回る電力効率と処理速度を実証しました。
- 主なポイント:
- パブリックベンチマーク(InferenceX)において、NVIDIAのGB200/GB300系システムと比較して1ワットあたりのスループットを最大1.9倍、応答速度を最大3.6倍向上させました。
- AI自身の支援により設計からテープアウトまでわずか9カ月で完了し、今年の年末からOpenAIのデータセンターへ順次導入される予定です。
- 対象ユーザー:[AIインフラエンジニア / 開発者 / エンタープライズ企業]
- 利用方法:OpenAI 公式ブログ
Claude 跨聊天与 Cowork 统一记忆 — Anthropic
- ひとことで言うと:ClaudeのチャットとCowork間でコンテキストや好みを共有できる統一記憶機能が正式に展開されました。
- 主なポイント:
- ユーザーとの対話から得たプロジェクトの背景や好みを自動的に記憶し、異なるセッションや作業環境(Cowork)の間でシームレスに引き継ぎが可能です。
- 設定画面の専用タブから記憶されたトピックの確認・編集・削除がいつでも行え、健康などの機密トピックはオプトイン制を採用しています。
- 対象ユーザー:[Claude Web/デスクトップ版ユーザー全般]
- 利用方法:
Claude now has one memory across chat and Claude Cowork, and you decide what's in it.
— Claude (@claudeai) August 25, 2026
Hand Cowork a task and it starts from what Claude already knows from your chats: the project you talked through, your manager's preferences, or the client from last quarter. pic.twitter.com/ViKapsT8K6
Portable Computer — Perplexity
- ひとことで言うと:NVIDIA DGX Spark上で完全ローカル動作し、クラウド依存なしで高度なナレッジワークをこなすエージェント環境が発表されました。
- 主なポイント:
- オーケストレーターLLMやサブエージェント、ハーネスの全体がローカルハードウェア上で完結し、機密文書の処理も外部に漏れない設計になっています。
- 最適化されたPPLX 27BやQwen 3.8-27Bをベースに、リサーチやパース作業で高い精度を記録しています。
- 対象ユーザー:[セキュリティ要件の厳しい企業 / 開発者 / Perplexity Pro/Max ユーザー]
- 利用方法:
Today we’re launching Portable Computer on @NVIDIA DGX Spark.
— Perplexity (@perplexity_ai) August 25, 2026
Portable Computer is a fully local version of Perplexity Computer, where the entire runtime: orchestrator LLM, subagent LLM, agent harness all run on your local hardware. No cloud dependency. pic.twitter.com/plVWz5PaAw
業界動向
苹果发布首款 2nm 芯片 M6 及四芯片架构 M5 Ultra — Apple
- 概要:Appleは、同社初となる2nmプロセスを採用した「M6」チップと、4チップ構成で圧倒的なメモリ帯域を実現した「M5 Ultra」を発表しました。
- 影響分析:M6は新型Mac miniに搭載され、GPUごとのニューラルアクセラレータにより端側AI処理能力が飛躍的に向上しています。また、M5 Ultraは新型Mac Studioに搭載され、最大512GBの統一メモリによりローカルでの超大型LLM運用を強力にバックアップします。
- ニュースリンク:Apple Newsroom
研究論文
AutoSaddler: Automated Harness Optimization for Agents — Microsoft 等
- 研究の背景:これまでAIエージェントのハーネス(周辺の制御ロジックやプロンプト構成)の最適化は手動で行われることが多く、汎用的な性能向上のボトルネックになっていました。
- 主な革新点:失敗トレースから自動的に診断を行い、プロンプトやツール設定、制御ロジックに対する構造化されたパッチを生成・検証する自動ループシステム「AutoSaddler」を提案しています。
- 研究成果:GAIA-2、SWE-Bench Pro、Terminal-Bench 2.0などのベンチマークにおいて、ベースラインのハーネスと比較してスコアが平均9〜10ポイント向上しました。
- 論文リンク:
Impressive new paper from Microsoft and colleagues.
— elvis (@omarsar0) August 25, 2026
Harness design is still hand-tuned almost everywhere. This work present an automated loop to optimize the harness.
They introduce AutoSaddler, which treats the agent harness as code and learns to patch it offline from failure… pic.twitter.com/LbZ7fAfJTu
WeatherNext: AI-Powered Cyclone Prediction — Google DeepMind / Google AI
- 研究の背景:従来の気象予測システムでは、強力なサイクロンやハリケーンの進路・強度の早期予測に限界があり、より迅速な避難体制の構築が求められていました。
- 主な革新点:風暴の軌跡、強度、規模を同時に高精度で予測するマルチモーダル気象予測モデル「WeatherNext」を開発しました。米国立ハリケーンセンターのリアルタイム実戦テストにも導入されています。
- 研究成果:既存システムと比較して最大1日早く(5日前に)5級ハリケーンの上陸を予測することに成功し、1場あたり最大1000回のシミュレーションを高速生成します。
- 論文リンク:
— Google AI (@GoogleAI) August 25, 2026
その他の話題
字节跳动发布面向办公场景の「豆包工作」 (Doubao Work)
- 内容紹介:ByteDance(バイトダンス)が、泛工作シーン向けのAIクライアント「豆包工作」を正式に発表しました。飛書(Lark)の生態系と深く統合されており、チャット履歴、議事録、多次元テーブルなどの内部コンテキストを直接取得できるほか、ドキュメント/PPT生成、Webサイトの構築、Windows向けに最適化されたComputer Use機能などを備えています。
- リンク:
字节发布了“豆包工作”,非常豪横,上来就先送一个月的标准会员;
— 歸藏(guizang.ai) (@op7418) August 25, 2026
如果你已经买了会员,也会免费顺延一个月,可以说是雨露均沾。
豆包确实早就应该单独推出一个面向工作场景(或者说泛工作场景,包括一些 coding)的客户端。
因为大家对豆包 App… pic.twitter.com/Xga06H0akT
