AIは何度も話しかけると“落ちる” ガードレール突破検証で分かった最も安全なLLM

モデル耐性評価ではClaude関連のモデル高いスコアを獲得している(出典:シスコのLLMセキュリティリーダーボード)