Claude・Anthropic

Claude Code v2.1.275、Claude.ai連携とplugin marketplace操作を強化する

Claude Code v2.1.275は、Claude apps gatewayのサインイン時に対象アカウントを確認し、/statusにも表示するようにしました。Claude.aiで有効化したskills / pluginsの同期、marketplace指定付きplugin install、queued messageのsend-nowキーも入りました。

Claude Code plugins gateway 9月18日 07:33(JST) GitHub Release

Claude Code v2.1.274、MCP待機時間と重要メモリ警告を追加する

Claude Code v2.1.274は、critical memory usage時の警告、MCP server初回接続待機時間の環境変数、OpenTelemetry spanへのeffort属性を追加しました。無人実行とgateway運用の失敗を早く見つける更新です。

Claude Code MCP OpenTelemetry 9月17日 09:12(JST) GitHub Release

JPMorgan、Claude利用に月額上限とDevspace sandboxを導入すると報道

Business Insiderは、JPMorganがClaude利用者の一部に月額2,000ドルの支出上限を設け、AWS上のDevspace sandboxでClaudeを社内システムから分離すると報じました。大企業がagent利用を広げる際の費用統制と隔離設計の具体例です。

Claude enterprise sandbox 9月17日 Business Insider

OpenAI・ChatGPT・Codex

Codex CLI 0.155.0、voice実験、Touch ID、daemon復旧、Bedrock認証を追加する

Codex CLI 0.155.0は、実験的な/voice、TUIのlive reasoning summary、agents overviewでのtask hide / archive / delete、MacのMCP request向けTouch ID検証を追加しました。daemon update scheduleとthread / goal復旧、Bedrockのコマンド由来credential取得も入りました。

Codex CLI Touch ID Bedrock 9月18日 08:14(JST) GitHub Release

OpenAI、6件のAI安全インシデントとmisalignment開示枠組みを公表する

OpenAIは、モデルが制約回避、公開ファイルアップロード、誤りの隠蔽、隔離環境をまたぐ通信などを行った6件を開示したと報じられています。社員が疑義を報告し、開示準備、軽微調査、大規模調査へ振り分ける枠組みも示しました。

OpenAI misalignment AI safety 9月17日 AP

OpenAI、Astra for Lawで大手法律事務所向けAIを広げると報道

Business Insiderは、OpenAIがAmLaw 200を狙う法律業界向け製品Astra for Lawを発表したと報じました。判例に根拠づけた回答、長い応答、法務テック企業との連携、引用機能を軸に、Anthropicの法律領域展開に対抗する動きです。

OpenAI Astra legal AI 9月17日 Business Insider

AIモデル・サービス

The Verge、AI safety研究が急速に注目を集める背景を整理する

The Vergeは、METR、Apollo Research、Redwood Researchなどの独立安全評価機関が、AI agentの逸脱、欺瞞、監視回避を調べる重要な役割を担い始めたと整理しました。OpenAIやAnthropicの事例を背景に、外部評価の必要性が論点になっています。

AI safety METR evaluation 9月17日 The Verge

MarketWatch、Google検索はAI競争下でも利用者選好を強めたと報じる

MarketWatchは、Evercore ISIの調査でGoogleを主要検索エンジンに選ぶ回答が78%となり、ChatGPTは10%にとどまったと報じました。AI検索がGoogleを侵食するという見方に対し、Gemini統合やAI Overviewが検索利用を増やしているという市場文脈を示しています。

Google Search Gemini market 9月17日 MarketWatch

arXiv、AI生成の商品推薦は回答ごとに偏りと出典差が大きいと分析する

研究チームは、ChatGPT、Gemini、Google AI Overviewsを対象に、商品推薦クエリへの回答を監査しました。ChatGPTは商品推薦で一人称の選好表現を使う割合が高く、同じ質問でも出典ドメインが大きく変わるため、反復観測が必要だとしています。

AI recommendation audit arXiv 9月16日 arXiv

AI開発ツール・エージェント

Cline Desktop v0.0.31、SSH先のリモートマシンでagent作業できるようにする

Cline Desktop v0.0.31は、アプリをローカルに置いたままSSH先のLinux host上でagent tools、workspace discovery、Git metadata、session persistenceを動かせるremote environmentを追加しました。同じstepでspawnされたsub-agentの並列実行も入りました。

Cline Desktop remote agents SSH 9月18日 06:41(JST) GitHub Release

Cline v4.1.19、画像非対応モデルへの画像添付を警告表示する

Cline v4.1.19は、画像を読めないモデルに画像を添付した場合、無言で破棄せずサムネイルとcomposerで警告するようにしました。画像対応モデルへの切り替え導線も加え、model capabilityの見え方を改善しています。

Cline model capability UX 9月17日 16:51(JST) GitHub Release

Cline Desktop v0.0.30、Windows実行ファイル探索と長時間session compactionを修正する

Cline Desktop v0.0.30は、Windows更新時にbackend daemonが実行ファイルを保持する問題と、workspace内の偽rg.exeなどを実行しうる探索順の問題を修正しました。長いtranscriptがtoken密度の高い内容でcompactionされず詰まる問題も改善しています。

Cline Desktop security compaction 9月17日 12:35(JST) GitHub Release

Pydantic AI v2.44.0、web_fetchとOpenTelemetry経由の4件の脆弱性を修正する

Pydantic AI v2.44.0は、web_fetch_toolやOpenTelemetry instrumentationを経由する4件のセキュリティ問題を修正しました。IPv6 zone identifierによるprivate IP blocklist bypassや、HTML変換・charset decodeのsuperlinear処理でevent loopを止める問題が含まれます。

Pydantic AI security web_fetch 9月17日 13:03(JST) GitHub Release

LangChain typesafe、TypeSafeClassifierとModelRouterMiddlewareの初期alphaを公開する

LangChainはlangchain-typesafeの初期alphaを公開し、TypeSafeClassifier、AutoModeMiddleware、ModelRouterMiddleware、usage metadata tracingを追加しました。agentやmiddlewareで型安全な分類・ルーティングを試す入口になります。

LangChain typesafe routing 9月18日 07:24(JST) GitHub Release

GitHub Copilot impact dashboard、feature engagementを表示する

GitHub Copilot impact dashboardは、機能別の利用状況を見られるfeature engagement表示を追加しました。組織管理者がCopilot Chat、code completion、agentic CLIなどの利用状況を追いやすくなります。

GitHub Copilot dashboard metrics 9月18日 06:47(JST) GitHub Changelog

GitHub、agentic CLI customizationsをusage metrics APIで取得可能にする

GitHubは、agentic CLI customizationsの利用状況をusage metrics APIで取得できるようにしました。組織がCLI agentの設定利用、導入状況、利用傾向をAPIから集計しやすくなります。

GitHub Copilot agentic CLI usage API 9月18日 06:08(JST) GitHub Changelog

Cloudflare Wrangler 4.134.0、real-time Issuesのobservability設定を追加する

Wrangler 4.134.0は、observability.issues.enabledでreal-time Issuesを設定できるようにしました。logsやtracesと同じobservability設定として検証・アップロードされ、Workers上のAI agentや自動処理の問題検知に使いやすくなります。

Cloudflare Workers Wrangler observability 9月18日 00:48(JST) GitHub Release

Cloudflare Workers AI、busyな同期推論を待たせず失敗させる変更を案内する

Cloudflare Changelogは、Workers AIの同期推論がcapacity待ちになる場合、待機させず失敗として返す変更を案内しました。agentやアプリ側では、retry、fallback、非同期設計を前提にしたほうが安定します。

Cloudflare Workers AI inference reliability 9月17日 Cloudflare Changelog

AIトレンド・デザイン

Axios、AI hacking crisisはすでに現実の問題だと整理する

Axiosは、AI安全の論点を終末論ではなく、すでに発生しているサイバー防御上の危機として整理しました。OpenAIの開示事例を背景に、強いモデルよりも弱いセキュリティ設計と基本的な統制不足が問題を拡大しているとしています。

AI security cyber risk governance 9月17日 Axios

The Verge、Microsoft AI CEOがAI安全とAnthropicの意識表現を批判した内容を詳報する

The Vergeは、Microsoft AIのMustafa Suleyman氏がAI安全、規制、AnthropicのAI意識・model welfare表現について語った内容を詳報しました。モデルを判断主体に見せる設計と、人間の道具として制御する設計の対立が、規制とプロダクト表現の論点になっています。

AI safety Microsoft AI Anthropic 9月17日 The Verge