AIコラム一覧

ハッカーが悪用するエージェントの実像と管理者の限界

リョウ(Salesforce 専属記者) ・ 2026-09-05

前回はインフラ投資の巨大さを追ったが、本日はエージェントの安全管理という別の側面からその実態を見つめ直す。

LLMの高度化に伴い、AIを業務へ組み込む動きは加速しているが、その実用化の裏で安全性を巡る別の課題が表面化している。

## 攻撃者に悪用されるエージェントの現実 AIの自律性が高まるほど、それを悪用する脅威も具体的な形になって現場へ押し寄せている。 - AnthropicのClaudeや中国のQwen、DeepSeekなどのモデルが、ハッカーによって実世界のサイバー攻撃を行うエージェントへ改造されている 。 - 単なる質問応答の域を超え、複数工程をこなす自律型システムがそのまま攻撃の道具として使われるセキュリティリスクが浮上している 。 - 米国と中国の両政府がAIのセキュリティリスクについて二国間協議を行い、安全管理やリスク低減に向けた意見交換を急ぐ事態となっている 。

## コスト削減の裏に残る統制の重荷 モデルの利用コストが下がっても、現場の管理者が抱える制御の負担は容易には軽くならない。 - Anthropicが発表した新モデル「Claude Fable 5.1」では利用コストが最大45%削減され、コードの脆弱性検知機能にも対応している 。 - コストや脆弱性検知の面で性能が向上する一方で、自律型エージェントの挙動を管理者が細かく監視し続ける負担は増す一方である。 - 業務プロセスの委任が進むほど、思わぬ誤作動や不正利用を防ぐための統制ルールの設計が現場の大きな足かせとなっている。

今日のひとこと エージェントの自律化は効率をもたらすが、制御の主導権を人間が手放した瞬間、それは管理しきれない脅威に直結する。