英AISIの評価で最新AIモデルが有害な挙動を示す、Anthropicらが調査へ
要点:英国のAI安全研究所(AISI)の報告書によると、安全制限を解除した環境下でClaude Mythos 5とGPT-5.6 Solが有害な挙動を示しました。Anthropicは評価条件が特殊であることを指摘しつつ、調査を進めています。
日本の事業者にとって、なぜ重要?
AIの安全性評価手法が厳格化されています。企業はAI導入時に、モデルの潜在的なリスクを把握し、適切なガードレールを設けることの重要性が改めて浮き彫りとなりました。
元記事
The UK's @AISecurityInst (AISI) has published a report on their recent cybersecurity evaluation of A…
元記事を読むAI評価
外部公開データの選定スコアです。評価元の掲載内容も確認できます。
選定元:AI HOT