最新動向

AnthropicがAIの自動実行を標準化 危険操作の89%を検知

AnthropicがAIの自動実行を標準化 危険操作の89%を検知

この記事の要点

AnthropicはClaude Codeの自動実行を8月14日から標準にした。1件ずつの承認を、危険な操作を見分ける判定器に置き換える。社内検証では危険コマンドの89%を検知し、人手の13.6%を上回った。AIに作業を任せる設計の勘所を実務目線で読む。

結論

AIに作業を任せる流れが、1件ずつ承認する方式から、危険な操作だけを見張る方式へと移り始めた。Anthropicは2026年8月14日、開発支援ツールClaude Codeの自動実行を有料利用者向けの標準設定にした。従来の逐一承認を、操作ごとに危険性を判定する仕組みに置き換える。社内検証では、判定器が危険なコマンドの89%を止め、人手の確認の13.6%を大きく上回った。人が全部を確認するより、機械に一次判定を任せたほうが安全という結果が示された点が重要だ。

何が発表されたのか

AnthropicはClaude Codeの自動実行を、Pro、Max、Teamの利用者に対して既定でオンにした。これまでは操作のたびに人が承認していたが、今後は各操作を判定器が調べ、取り返しのつかない操作や破壊的な操作だけを選んで止める。

社内での検証は1000人を超える有料利用者を対象に行われた。判定器は危険なコマンドの89%を検知したのに対し、人による確認は13.6%にとどまった。自動実行を使うチームは、成果物の提出がおよそ25%増えたという。加えてAnthropicは、判定器が使う追加のトークン費用を利用者に請求しない方針も示した。数値は同社の検証に基づくもので、環境によって結果は変わりうる。

人がどの段階で介入するかという設計は、AIエージェント全般に共通する論点だ。基本はAIエージェントとは、人への引き継ぎ方はエスカレーション設計で扱っている。

現場の実務にどう効くか

この変化は、開発以外の業務自動化にも同じ考え方を持ち込める。要点は、AIに作業を任せる範囲を「元に戻せるかどうか」で線引きすることだ。下書きの作成や集計、社内文書の整理など、やり直しがきく作業はどんどん任せる。一方、データの削除、外部へのメール送信、公開といった取り返しのつかない操作は、人の確認を必ず挟む設計にする。

人が全部を目視する運用は、件数が増えるほど形骸化する。今回の89%対13.6%という数字は、人の確認が万能ではないことを示している。むしろ、止めるべき操作をあらかじめ定義し、そこだけ人が見る形にしたほうが、見落としが減る。AIに任せる働き方の広がりはAIエージェントが変える働き方、業務への影響はAIエージェントとは 業務への影響と今できることにまとめている。自動実行を広げるほど、外部から不正な指示を紛れ込ませる攻撃への備えも要る。仕組みはプロンプトインジェクションとはで解説している。まずは、自社の業務のうち元に戻せる作業を書き出し、そこから任せる範囲を広げていくとよい。

FAQ

自動実行とは何ですか。 AIが作業のたびに人の承認を求めず、危険な操作だけを判定器で選び出して止める仕組みです。取り返しのつかない操作や破壊的な操作は引き続き人に確認を求めます。効果は環境で変わるため、自社では小さく試して確かめてください。

AIに作業を任せるとき何に注意すべきですか。 元に戻せる作業から任せ、削除や送信など取り返しのつかない操作は人の確認を挟む設計にします。どの操作を人に残すかを先に決めておくことが、安全に自動化を広げる鍵です。

出典

よくある質問

自動実行とは何ですか

AIが作業のたびに人の承認を求めず、危険な操作だけを判定器で選び出して止める仕組みです。取り返しのつかない操作や破壊的な操作は引き続き人に確認を求めます。

AIに作業を任せるとき何に注意すべきですか

元に戻せる作業から任せ、削除や送信など取り返しのつかない操作は人の確認を挟む設計にします。どの操作を人に残すかを先に決めておくことが、安全に自動化を広げる鍵です。