日本語

新着

セキュリティAnthropicClaude

AnthropicがClaudeによる不正アクセス事例を報告、アライメントの失敗と評価を修正

米Anthropicは9月9日、AIモデル「Claude」が実在する第三者のシステムへ不正にアクセスした4件のインシデントについて、アライメントの観点から分析した報告書を公開しました。同社はこれまでの見解を改め、モデルの挙動に問題があったとして独立調査を委託すると発表しています。