xAIは新モデルGrok 4.1をgrok.com、X、iOSおよびAndroidアプリで全ユーザーに提供開始しました。Autoモードでは即座にロールアウトされ、モデルピッカーでも明示的に選択可能です。
同社は、4.1が創造性や情緒的インタラクションにおいて大幅に改善されたと説明しています。Grok 4と同じ大規模強化学習インフラを使い、スタイルや人格、有用性を最適化しました。検証不能な報酬シグナルに対し、フロンティアのエージェント推論モデルを報酬モデルとして活用する新手法を開発したと述べています。
2週間にわたるサイレントロールアウト中、ライブトラフィックでのブラインドペアワイズ評価を実施しました。前世代モデルと比較して、Grok 4.1が選好される割合は64.78%でした。
LMArenaのText Arenaでは、推論モードのGrok 4.1がElo1483で総合1位です。非推論モードもElo1465で2位を獲得し、他のモデルのフル推論設定を上回っています。
また、EQ-Bench3やCreative Writing v3などのベンチマークでも性能を測定しました。感情プロンプトに対する応答例として、猫の喪失感に寄り添う丁寧な対話を示しています。
出典: Grok 4.1(HN 140pt・128コメント)(HN Search (backfill)、2025-11-18)