トップニュース

業務を横断するエージェントと、開発・防御の実行条件に関する更新を扱います。

Google、業務を横断するGemini agentを発表する

Google Cloudは、調査、資料作成、コード実行を一つの窓口から任せるGemini agentを発表しました。クラウドで記憶と作業を保持し、Workspaceや外部の業務システムをまたいで処理します。モデルにはGeminiとClaudeを使い分け、企業向けの権限管理と費用制御を備えます。金融・法務向け機能はプレビューです。

Gemini agent Workspace Google Google Cloud

Anthropic、重要インフラの防御支援プログラムを始める

AnthropicはCyber Missionを発表しました。その一環として、電力、水道、交通などの制御システムを守るCritical Infrastructure Defense Programを開始しました。日立、Dragos、CrowdStrikeなど11社の初期パートナーへ、Claude、現地エンジニア、脅威研究を提供します。設備を安全に動かしたまま弱点を修復するため、既存の専門事業者と進めます。

Anthropic cybersecurity OT Anthropic

Codex CLI 0.162.0、管理されたworktreeとタスク操作を追加する

Codex CLI 0.162.0の正式版は、機能が有効な環境で、信頼済みのローカルプロジェクトからGit worktreeを作成・一覧表示するツールを追加しました。対応サーバーではCommand Centerのタスクを固定でき、/copyで会話の内容を選んでコピーできます。既存ファイルのCRLF改行保持やLinuxサンドボックスの不具合も修正します。

Codex CLI worktree GitHub / OpenAI

Claude Code 2.1.295、フックの失敗時に操作を止められる

Claude Code 2.1.295は、コマンド・HTTPフックにonFailure: "block"を追加しました。起動失敗、タイムアウト、想定外の終了コードで操作を止められます。同日の2.1.294では、指示文で書いたprompt・agentフックが禁止対象を通してしまう問題と、Stop系フックの判定を改善しました。

Claude Code hooks permissions GitHub / Anthropic GitHub / 2.1.294

Claude・Anthropic

OSSの防御を支える新しいサービスを紹介します。

Anthropic、OSS向けの無料定期スキャンを申込制で提供する

OSS Scannerは、対象となるオープンソースの主要メンテナーが申し込み、強力なClaudeモデルによる定期的な脆弱性レポートを無料で受け取るサービスです。レポートは人の確認を経ずに送られ、誤検出や深刻度の誤りがあり得ます。対象はインフラや利用者の安全に重要なプロジェクトで、Anthropicが個別に判断します。

Anthropic OSS security Anthropic

OpenAI・ChatGPT・Codex

作業中の追加指示、企業での費用管理、安全性と売上の報道を扱います。

Codex、実行中の追加指示を早く反映する更新を展開する

ChatGPTデスクトップアプリのCodexでは、実行中のタスクへ送った追加指示に、より早く応答する更新を展開しています。作業方針の修正、足りない情報の追加、方向転換に使えます。SettingsのGeneralにあるFollow-up behaviorで、現在の実行へ反映するか、次の実行まで待つかを選べます。

Codex steering desktop OpenAI Help

LegalOn、モデルの使い分けでCodexの推定日次費用を65%減らす

OpenAIが公開したLegalOnの事例では、仕事の難しさに応じてLuna、Sol、Astraを使い分け、部門と個人の利用上限を設けました。GPT-5.5を使っていた時期と比べ、推定日次費用を約65%減らし、開発速度を維持したと報告しています。顧客へ届けた機能単位で費用と価値を測る仕組みは構築中です。

Codex cost LegalOn OpenAI

OpenAI、偽装メディアや人物を使う影響工作のアカウントを停止する

OpenAIは、ロシアとイランに関連する二つの影響工作が自社モデルを悪用したとして、関連アカウントを停止したと報告しました。偽装したシンクタンクや記者の人物像を使い、政治的なメッセージを既存媒体へ持ち込む手法を説明しています。生成された文面だけでなく、発信者の実態と掲載経路を確認する必要がある事例です。

OpenAI safety misinformation OpenAI

Axios、OpenAIの年換算売上を算定方法の違いから500億ドルと報じる

Axiosは、OpenAIの年換算売上は500億ドルで、広く報じられた700億ドルとの差は提携先経由の売上の扱いによると報じました。記事では、700億ドルはAnthropicとの比較のために調整した数字としています。年換算の指標は通期の実際の売上と区別する必要があり、記事は両社の会計がGAAPに準拠すると説明しています。

OpenAI Anthropic revenue Axios

AIモデル・サービス

調査用エージェントの試用と、営業データをAIへ接続する計画を紹介します。

astamuse、研究開発の候補比較エージェントを2週間試用できる

アスタミューゼは、新規事業や研究開発のテーマを調べて比較するAIエージェントの無償トライアル受付を10月31日まで行います。有償版と同じ機能を、1社1~3アカウントで原則2週間利用できます。社内の所管部門の承認と終了後のアンケートが条件で、個別の伴走支援や研修は含みません。

agent research business アスタミューゼ

KS+ SFA、営業データ基盤を提供しAPIとMCPの予定を示す

ブルーテックは、顧客情報を会社単位に整理した上で案件を管理するKS+ SFAを提供開始しました。CRM/SFAプランは1ID月額3,000円税別で、最低10ID、最低12か月、初期費用は個別見積もりです。APIは10月末、PC上のClaudeなどとつなぐローカルMCPは11月に提供予定で、時期と内容は変更の可能性があります。

AI開発ツール・エージェント

権限、接続、会話の再開、学習に関する正式更新を確認します。

Copilot CLI 1.0.94、MCP操作と企業の権限管理を改善する

Copilot CLI 1.0.94の正式版は、Haiku 5.5を追加し、MCP設定初期化の中断後に復旧できるよう修正しました。サーバーを起動せずにMCPの有効・無効を切り替えられます。企業の管理設定が権限回避オプションを抑止した場合の警告や、Assisted Permissionsを無効にする管理ポリシーも含みます。

Copilot MCP permissions GitHub / GitHub

Vercel AI SDK 7.0.135、WebSocketで会話を再開する通信方式を追加する

Vercel AI SDK 7.0.135は、持続するWebSocket接続で会話を送受信する方式を追加しました。処理中断、通信量の制御、連番に基づく再開を扱います。同日の更新では、ツール承認の重複応答による継続要求の二重送信や、ストリーム再開時にプロバイダーが実行したツール呼び出しが失われる問題も修正しました。

LangChain Core、IPv6のSSRF検査と再試行の設定を更新する

LangChain Core 1.6.8は、スコープ付きIPv6とIPv4互換IPv6に対するSSRF検査を強化しました。1.6.9では、with_retryの設定に関数を渡せるようにしました。外部URLを取得する処理と、失敗時の再試行を組むアプリの更新です。

LangChain SSRF retry GitHub / LangChain GitHub / 1.6.8

LangChain 1.4.4、会話要約が文脈上限を超えたときに再試行する

LangChain 1.4.4は、SummarizationMiddlewareの要約処理でコンテキスト上限を超えた場合の再試行を追加しました。長い会話を圧縮して続ける処理が対象です。FastMCPの最低バージョン更新など、依存関係の変更も含みます。

LangChain context agent GitHub / LangChain

Cline、推論設定とMCP終了時の不具合を修正する

Cline CLI 3.0.70とDesktop 0.0.45は、推論を無効にできないモデルへ無効化設定を送って失敗する問題を修正しました。MCPサーバーやフックが入力を読む前に終了した際の異常終了も防ぎます。CLIではmcp addのヘッダー保持を修正し、実際には配信できない予約設定を登録時に検出します。

Cline MCP reasoning GitHub / Cline GitHub / Desktop

Agent Lightning v1.0、本番のエージェント構成を使って強化学習する

Microsoft Researchは、本番で使うエージェントのツールや実行制御を保ったまま、強化学習を行えるAgent Lightning v1.0を公開しました。学習側でエージェントを書き直す手間を減らし、Kubernetesのジョブで実行します。同社の実験では、約6,000件の学習サンプルでQwen3.5-9BのSWE-bench Verified Pass@1を41.8%から56.4%へ上げました。

agent RL open source Microsoft Research

AIトレンド・デザイン

生成メディアの来歴を調べる検査手段の公開を扱います。

Google、SynthID Detectorを英語で世界公開する

Googleは、報道関係者向けだったSynthID Detectorを、英語で全世界へ公開しました。画像・動画・音声に埋め込まれた対応する透かしを調べ、GoogleとOpenAI、NVIDIA、Kakaoなどの対応コンテンツを検出します。Appleへの対応は今後の予定で、透かしが見つからないことは人が作った証明になりません。

SynthID provenance design Google DeepMind

キーインサイト

エージェントは、業務システムをつなぎ、長い作業を継続する設計へ広がっています。導入時は接続先の権限と費用上限を具体的に確認できます。

脆弱性を見つける速さと、確認して安全に修正する体制は別に考える必要があります。OSS Scannerでは誤検出を精査する担当を確保してください。

モデルの使い分け、会話の再開、フックの失敗処理は、実運用の費用と安定性に関わります。利用中のモデルと接続経路で更新後の動作を確かめられます。