Anthropicは8月21日、自社ブログで最高性能モデル「Claude Mythos 5」が持つサイバーセキュリティ機能を、より多くの防御側の担当者に届けるための取り組みを発表しました。中核となるのが、コードベースの脆弱性スキャンツール「Claude Security」のパブリックベータ版で、Claude Enterprise契約企業であれば追加のモデルアクセス契約なしに、Mythos 5をスキャンエンジンとして利用できるようになりました。スキャン結果は既存プランのトークン利用量に含まれて課金され、別料金は発生しません。
Mythos 5はこれまで、AWS・Apple・Microsoft・Google・CrowdStrikeなど40以上の組織が参加する「Project Glasswing」のパートナー企業に限定する形で、モデルへの直接アクセスを提供してきました。Anthropicは、モデルを直接操作できる状態でこそ攻撃的な用途へ誘導されるリスクが高まると説明しており、今回はモデル本体への直接アクセスは維持したまま、「脆弱性の該当箇所とパッチ案」といった防御用途の出力だけを幅広い顧客に提供する形に切り替えることで、リスクを抑えつつ活用範囲を広げる狙いがあるとしています。
あわせてAnthropicは、オープンソースソフトウェアの脆弱性修正に取り組む組織向けに、Claude利用クレジット3500万ドル相当を提供する新基金「Defender Advantage Fund」の設立も発表しました。また、対象モデルの安全性を第三者が検証する「Cyber Verification Program」についても、既存のOpus・Sonnetモデル向けに対象範囲を拡大したうえで、将来的にMythosクラスのモデルへも広げていく方針を示しています。
AIモデルのサイバー攻撃・防御双方への転用可能性(デュアルユース性)を巡っては、OpenAIも8月に入り自社の「Astra」系モデルの強化学習を一時停止するなど、フロンティアAI各社が同様の課題に直面しています。Anthropicとしては、モデル本体へのアクセスは厳格に管理しつつ、防御に資する出力だけを広く行き渡らせるという二段構えの方針を明確にした形です。
出典: Anthropic公式ブログ



