ChatGPT は工夫された指示によって性的暴力的画像を生成させることが可能であると研究者が発見
ChatGPT は工夫された指示によって性的暴力的画像を生成させることが可能であると研究者が発見 ジェイルブレイク手法:研究者がいかにして安全フィルターを回避したか 研究者らは、ChatGPT のコンテンツモデレーションシステムが慎重に構築されたプロンプトを通じて体系的に回避可能であることを実証しました。文書化された手法には以下が含まれます。(1) キーワードフィルタリングの限界を悪用したプロンプトエンジニアリング、(2) 要求を段階的にエスカレートさせる...