DISPATCH №0902 / 2026-09-02 / MORNING EDITION / 08 ITEMS / BUILD 20260902.0732 / LIVE / CURATED BY 泉水亮介
VCB News & Post Headline
JST · 07:32 · TUE
MORNING DISPATCH · TUESDAY · SEPTEMBER 2, 2026

2026.09.02

Claude · Gemini · Claude · Codex 08 ITEMS · READ 4 min
フロンティアモデル / ANTHROPIC公式 / NEWS

Claude Fable 5.1、長時間エージェントのキャッシュ料金を75%削減

Claude Fable 5.1、長時間エージェントのキャッシュ料金を75%削減

AnthropicはClaude Fable 5.1とClaude Mythos 5.1を発表した。基盤モデルは同じで、一般提供のFableと、サイバー防御・生命科学向けの制限アクセス版Mythosに安全対策の強度差を設けている。

キーポイント

  • Fable 5.1は100万トークンのコンテキストと最大12万8,000トークンの出力に対応する
  • 入力は100万トークン当たり10ドル、出力は50ドルでFable 5から据え置き
  • キャッシュ読み取りは100万トークン当たり0.25ドルで、Fable 5より75%低い
  • Anthropicは典型的な処理で約25%、エージェント処理の比率が高い場合は最大45%のコスト減と試算する
  • Terminal-Bench-Science 0.1は52.6%。数値はAnthropicの評価で、標準誤差は±3.5〜4.5ポイント
長時間ループでは、毎回読み直す仕様・履歴・ツール結果が請求の大半を占める。モデル単価だけでなく、同じ文脈をキャッシュへ寄せられる構成かどうかが運用費を決める。
マルチモーダルAI / GOOGLE DEEPMIND公式 / NEWS

Gemini、動画を全部読む方式から必要な区間を探す方式へ

Gemini、動画を全部読む方式から必要な区間を探す方式へ

Google DeepMindはGemini 3.7 Flash、3.6 Flash、3.5 Flash-Liteにエージェント型動画理解を追加した。固定フレームレートで全編を読む代わりに、モデルが映像、音声、字幕から必要な区間を動的に探す。

キーポイント

  • Googleの評価では、分析コストを最大66%、トークン消費を最大88%削減した
  • 精度は最大7%向上し、長尺動画ほど効率差が出やすい
  • サブ秒の瞬間検索、異常検知、計数、長尺映像からの該当箇所探索を想定する
  • Google AI StudioのGemini APIとGemini Enterprise Agent Platformで利用できる
  • APIでprocessingをagenticに設定し、追加の機能料金はない
教材、会議録画、デモ動画を毎回すべて読ませる必要がなくなる。映像を検索対象として扱い、目的に応じて見る場所を選ぶ設計へ移せる。
AI開発ツール / ANTHROPIC / GITHUB RELEASE / NEWS

Claude Code 2.1.257、auto modeの境界を具体化

Claude Code 2.1.257、auto modeの境界を具体化

Claude Code 2.1.257はFable 5.1をFable系の既定モデルにした。機能追加だけでなく、クラウドのメタデータ資格情報、外向き通信の回避、他テナントへの到達をauto modeで自動承認しないContainment Escapeルールを追加している。

キーポイント

  • claude-fable-5-1をFable系の既定モデルにした
  • fableとbestのエイリアスは未対応gatewayでは当面Fable 5のまま
  • 作業ディレクトリ外のファイルを初めて読む前に確認し、設定で読み取り自体を拒否できる
  • サブエージェントのモデル指定を一括で強制する環境変数を追加した
  • 複合コマンドやリダイレクトで権限ルールを回避できた複数の不具合も修正した
自動で進めることと、境界を越えてよいことは別の設定だ。チーム導入では、モデル更新と同時に、作業ディレクトリ外の読み取りや資格情報への到達がどこで止まるかを確認したい。
AI開発ツール / OPENAI / GITHUB RELEASE / NEWS

Codex CLI 0.152.0、MCP出力をツール単位で制限

Codex CLI 0.152.0、MCP出力をツール単位で制限

Codex CLI 0.152.0は、下書き内のVim検索や利用枠バナーからの操作を追加した。MCPツールごとの出力トークン上限にも対応し、再開したセッションでも同じ切り詰め方を保つ。

キーポイント

  • Vimモードで/と?による検索、nとNによる候補移動に対応した
  • レート制限バナーから利用状況、クレジット、上限リセット、プラン管理へ進める
  • MCPサーバー名に: @ / .を使える
  • MCPツールごとにoutput_token_limitを設定できる
  • app-serverのthread/shellCommandは1時間を超えるタイムアウトも設定できる
  • 計画更新ツールは既定オフで、tools.update_plan.enabledをtrueにして有効化する
巨大なMCP応答をそのまま会話へ入れると、必要な文脈が押し出される。ツールごとの出力上限は、長いセッションの精度と再開時の再現性を守る設定になる。
エージェント基盤 / VERCEL公式 / NEWS

Vercel AI SDK、軽量コーディングエージェントfxを共通ハーネスへ

Vercel AI SDK、軽量コーディングエージェントfxを共通ハーネスへ

VercelはAI SDKのハーネス層へ、同社の軽量オープンソースエージェントfxを追加した。HarnessAgentの同じAPIから呼べるため、fx専用の統合を別に作らず、既存エージェントと差し替えられる。

キーポイント

  • 公式アダプタは@ai-sdk/harness-fx
  • @ai-sdk/harness-acpを使い、Agent Client Protocol経由でfxへ接続する
  • Claude Code、Cline、Codex、Cursor、Deep Agents、Grok Build、OpenCode、Piと同じハーネス一覧に加わった
  • セッション作成やストリーミング結果をHarnessAgentの共通形式で扱う
  • fxはVercelが公開する軽量なオープンソースのコーディングエージェント
製品が特定のCLIへ直接依存すると、モデルや実行基盤を替えるたびに統合を書き直すことになる。共通ハーネスへ寄せれば、同じ課題を複数エージェントで比較しやすい。
AI×ビジネス活用 / OPENAI公式 / NEWS

ChatGPT for Healthcare、Epicの患者情報を認可範囲で参照

ChatGPT for Healthcare、Epicの患者情報を認可範囲で参照

OpenAIはChatGPT for HealthcareにEpic電子カルテ連携とHealthcare Public Dataプラグインを追加した。認可された患者情報をChatGPTへ取り込み、PubMedやDailyMedなど9つの公的情報源も同じ管理下のワークスペースで扱える。

キーポイント

  • 診療記録、検査結果、薬剤、専門医の記録をまとめ、根拠となるカルテ情報へ戻れる
  • 対応環境ではChatGPTを電子カルテ画面内へ組み込める
  • 公的情報プラグインはClinicalTrials.gov、CMS Coverage、RxNorm、DailyMed、PubMedなど9ソースに接続する
  • 27の臨床ユースケース、4,363件の評価で、医師が99.1%を安全と評価したとOpenAIは報告する
  • 個人向けChatGPT for Cliniciansでは電子カルテ連携を使えない
業務AIの差は、一般知識よりも、既存システムの権限を保ったまま固有データへ接続できるかに出る。医療以外でも、CRMや会計へ広げる前に読み取り範囲、監査ログ、人の確認工程を設計する必要がある。
ローカルLLM / LM STUDIO公式 / NEWS

LM Studio Bionic、Linuxでローカルエージェントを実行

LM Studio Bionic、Linuxでローカルエージェントを実行

LM Studioはオープンモデル向けエージェントアプリBionicのLinux版を公開した。Mac、Windowsに加え、Linux環境でもローカルモデルまたはLM Studio Secure Cloud上のモデルを使い、コードやファイルを扱える。

キーポイント

  • BionicはLM Studio本体とは別のエージェントアプリ
  • Linux版はx64 AppImageとして配布される
  • ローカルモデルとSecure Cloud上のオープンモデルを選べる
  • コーディング、ファイル操作、Skills、シェルコマンドの承認フローを備える
  • Arm版の提供は取得時点で確認できない
ローカルLLMの用途がチャットから、ファイルへ触るエージェントへ広がっている。Linuxワークステーションや社内サーバーで、機密データを外へ出さずに同じ運用を再現しやすくなる。
ローカルLLM / ARAVIND SRINIVAS / PERPLEXITY / BOOKMARK

Perplexity Mac、機密工程をローカルモデルへ振り分け

Perplexity Mac、機密工程をローカルモデルへ振り分け

Perplexity Macアプリは、クラウドとMac上のローカルモデルを組み合わせるハイブリッド計算に対応した。Computerが処理内容を見て、血液検査、税務書類、訴訟資料など機密性の高い工程を端末内へ寄せる。

キーポイント

  • Perplexity Macアプリの全ユーザーへ提供する
  • ローカル処理はApple Siliconを使い、その工程ではクラウド側のトークン料金が発生しない
  • 端末内とWeb上の実行環境をタスクごとに使い分ける
  • ローカルへ送るか判断する個人識別情報分類器を公開する
  • 分類精度、対応するローカルモデル、誤判定時の既定動作は公式スレッドでは示されていない
ローカルかクラウドかをアプリ単位で決めるのではなく、工程単位で分ける設計だ。プライバシー、性能、料金の優先順位を、扱うデータに応じて変えられる。
📄 PDFをダウンロード 🧵 X スレッドで読む