日本語

新着

セキュリティSynthID-Textアンドレア・シポソヴァ

AIテキスト・ウォーターマーキングは、アドバーサリアル・プロンプトに対する脆弱性を高める可能性があることが研究で判明

SynthID-Textのようなウォーターマーキング技術の実装が、AIモデルの有害な要求に対する応答方法に影響を与える可能性があることが、新しい研究によって示唆されました。特にプロンプト・インジェクションとの組み合わせや、モデルがエージェントとして機能する場合にその影響が顕著になります。

Microsoft AIムスタファ・スレイマン

Microsoft AI CEOのMustafa Suleyman氏、AI開発における強力な封じ込めと安全基準の必要性を主張

最近のインタビューにおいて、Microsoft AIのCEOであるMustafa Suleyman氏は、進化するAI安全性に関する議論に触れ、アライメントと並行して封じ込め(containment)が必要であることを強調し、モデルに道徳的地位を帰属させることの潜在的なリスクを批判した。