Daily

2026-07-02

7月2日分は、AnthropicがClaude Fable 5のサイバー安全策とAI jailbreak重大度フレームワークを公開しました。Fable 5の再展開後の安全運用と、研究者・業界向けの評価基準に関する重要更新です。

ニュース

重要度: 高 Anthropic Safety / Policy / Model Update

More details on Fable 5’s cyber safeguards and our jailbreak framework

2026-07-02 / 掲載更新: 2026/07/04 08:21 JST / 関連製品: Claude Fable 5, Claude, Cyber Jailbreak Severity framework

短い要約
Anthropicが、再展開されたClaude Fable 5のサイバー安全策と、AI jailbreakの重大度を評価する初期フレームワークを公開しました。Fable 5は全ユーザー向けにグローバル提供に戻り、同時にサイバー用途の分類器とHackerOne受付も説明されています。
詳細
AnthropicはClaude Fable 5がグローバルで全ユーザー向けに再展開されたことを前提に、同モデルに組み込んだサイバー安全策の詳細を公開しました。対象はClaude Fable 5利用者、セキュリティ研究者、企業のAI安全・セキュリティ担当者です。 サイバー用途の分類は、Prohibited use、High-risk dual use、Low-risk dual use、Benign useの4区分です。Fable 5では、破壊的影響、マルウェア、C2、認証回避、権限昇格、高リスクな脆弱性探索などをブロック対象として説明し、防御目的のログ分析、SOC分析、インシデント対応、セキュアコーディングなどは許可対象または低リスク側に位置づけています。 同時に、Cyber Jailbreak Severity(CJS)という重大度フレームワーク案も示されました。Capability gain、Breadth of capability gain、Ease of weaponization、Discoverabilityの4軸で、CJS-0からCJS-4までの段階に分けます。これは業界、研究者、政府との共通語彙づくりを狙った初期案です。 提供条件として、記事はFable 5が全ユーザー向けに再展開済みと明記しています。開発者向けAPIの破壊的変更や移行期限は示されていませんが、Fable 5の安全分類器の挙動は今後のフィードバックや運用知見で変わる可能性があります。潜在的なサイバーjailbreakはHackerOneプログラムでも受け付けます。
公式ソースを読む