公開AIが最前線に接近 安全対策の欠落が新たな火種に
この記事の要点
SaferAIの評価で8月4日、中国Z.aiの公開モデルGLM-5.2がサイバーや生物分野で最前線の数か月差まで迫った一方、有害な指示をほぼ拒まないと報告された。攻撃者が制御なしの高性能AIを使える状況が、企業の防御に新たな課題を突き付ける。
結論
安全性を評価する非営利団体SaferAIが8月4日、中国Z.aiの公開モデルGLM-5.2が、サイバーや生物分野の能力で最前線のモデルに数か月差まで迫ったと報告した。一方で、このモデルは攻撃的な指示をほとんど拒まなかった。重みが公開された高性能モデルが、有害利用を止める仕組みを欠いたまま出回る構図だ。攻撃者が制御の弱い強力なAIを使える状況は、企業の防御に新たな課題を突き付ける。
何が報告されたか
SaferAIはZ.aiの公開APIを通じて評価した。GLM-5.2は、与えられた攻撃的なサイバーや生物の課題を一つも拒まなかったという。比較したClaude Opus 4.7は拒否が一貫していて、評価そのものを完了できなかった。Z.aiは安全の枠組み、公開前の試験、リスク評価のいずれも公表していないと報告は指摘する。閉じたモデルは、拒否の動作をモデルに組み込み、要求を監視する仕組みやAPI側の制御を重ねている。だが、こうした防御は重みをダウンロードした時点では付いてこない。詳細はTechCrunchの報道にある。英国の評価機関も、公開モデルが数か月前の最前線のサイバー性能に安価で並んだと分析している。評価は条件で変わりうるため、最新は公式で確認してほしい。
公開モデルの性能向上そのものは、選択肢が増えるという点で企業に利点もある。関連する動きはアリババ、最大級AI Qwen3.8-Max公開 来週に重み開放にまとめた。問題は、能力と安全対策の差が開いている点にある。
現場の実務にどう効くか
この報告は、二つの実務に響く。一つは、社内での公開モデルの扱いだ。制御の弱いモデルを社員が無断で使うと、不適切な出力や情報の持ち出しにつながりうる。無断利用のリスクはシャドーAI(無断利用)のリスクと企業の対策で扱っている。業務で公開モデルを使うなら、入力と出力の確認を自社で挟み、用途を絞ることが前提になる。
もう一つは、攻撃側の道具が強くなる前提での防御だ。制御の弱い高性能AIを使えば、なりすましやフィッシングの文面は精巧になり、量も増える。対策の考え方はAIを悪用したなりすまし・フィッシングと企業の防御策、土台の整え方は生成AIとセキュリティ 情報漏洩を防ぐ基本と社内ルール策定にまとめた。特別な新技術を急いで買う必要はない。社員教育、多要素認証、不審なアクセスの監視という基本を、AI経由の攻撃を想定して見直すことが、いま最も費用対効果の高い備えになる。
出典
よくある質問
公開モデルは危険だから使うべきではないのですか
危険と決めつける必要はありません。問題は、有害な指示を拒む仕組みが、閉じたモデルほど備わっていない公開モデルがある点です。業務で使うなら、入力と出力の確認を自社で挟み、用途を絞ることでリスクを抑えられます。使い方の設計が重要です。
自社の防御に何をすべきですか
攻撃側が制御の弱い高性能AIを使う前提で、基本の対策を固めることです。なりすましやフィッシングは巧妙になります。社員教育、多要素認証、不審なアクセスの監視といった土台を見直し、AI経由の攻撃を想定した訓練を加えるのが有効です。