Tag

#Prompt Injection

ニュース

重要度: 高 OpenAI 研究発表 / AI安全性 / モデル堅牢性

GPT-Red: Unlocking Self-Improvement for Robustness

2026-07-15 / 掲載更新: 2026/07/16 10:31 JST / 関連製品: GPT-Red, GPT-5.6, Codex CLI

短い要約
OpenAIは、プロンプトインジェクションなどを自動探索する内部専用レッドチームモデルGPT-Redを発表しました。 +GPT-Redによる敵対的学習をGPT-5.6へ組み込み、最難関の直接プロンプトインジェクション評価で失敗を大幅に減らしたとしています。
詳細
GPT-Redは自己対戦型の強化学習で、攻撃モデルと防御側LLMを同時に訓練し、現実的なツール・ブラウザ・ローカルファイルの脅威環境で脆弱性を探索します。 +OpenAIはGPT-Redを外部提供せず、生成した攻撃を後続の本番モデル訓練に利用すると説明しています。GPT-Red自体はAPI、ChatGPT、Codexの利用者へ公開されません。 +GPT-5.6にはこの敵対的データを組み込み、4か月前の最高性能本番モデル比で、最難関の直接プロンプトインジェクション評価の失敗が6分の1になったとしています。 +GPT-Redは、Codex CLIエージェントを対象にしたデータ流出シナリオでも、通常のGPT-5.5ベースラインより効果的かつトークン効率よく攻撃を見つけたと報告しています。 +新しいAPIモデル、料金、プラン、移行期限、破壊的変更はありません。開発者にとっては、エージェントの外部データ接続で残るプロンプトインジェクション対策を、モデル側の訓練とアプリ側の多層防御の両方で継続する必要があるという示唆です。
公式ソースを読む
重要度: 高 Google 開発者向け更新 / エージェント・Computer Use

Introducing computer use in Gemini 3.5 Flash

2026-06-24 / 掲載更新: 2026/06/25 07:32 JST / 関連製品: Gemini API, Gemini 3.5 Flash, Computer Use, Gemini Enterprise Agent Platform

短い要約
GoogleはGemini 3.5 FlashにComputer Useを組み込み、ブラウザ、モバイル、デスクトップ環境を操作するエージェントを作れるようにしました。 Gemini APIとGemini Enterprise Agent Platformから利用でき、企業向けの安全機構も追加されています。
詳細
Computer UseがGemini 3.5 Flashの組み込みツールとして提供され、従来の独立したGemini 2.5 computer use modelから、主要Flashモデル内のネイティブ機能へ移りました。 開発者はGemini 3.5 Flashを使い、画面を見て、推論し、ブラウザ、モバイル、デスクトップ環境で操作するカスタムエージェントを構築できます。 想定ユースケースには、継続的なソフトウェアテスト、業務アプリをまたぐ知識労働、長い手順を伴うエンタープライズ自動化が含まれます。 提供経路はGemini APIとGemini Enterprise Agent Platformです。Google AI Studioでの個人向けUI提供や日本での個別利用条件は記事では明記されていません。 安全面では、Computer Use向けの敵対的学習に加え、機微または不可逆な操作への明示的ユーザー確認、間接プロンプトインジェクション検出時の自動停止という企業向け保護機能が示されています。 Gemini API release notesではpublic previewとして掲載され、簡略化されたintent付きアクション、ブラウザ・モバイル・デスクトップ環境の組み込みサポート、構成可能な安全ポリシー、高度なプロンプトインジェクション検出が含まれるとされています。 破壊的変更や移行期限はこの更新では示されていません。
公式ソースを読む