-
日期: 2025-11-18 | 來源: 搜狐科技 | 有0人參與評論 | 專欄: 馬斯克 | 字體: 小 中 大
大模型王位,再次易主。
數小時前,馬斯克旗下人工智能公司xAI放出最新模型Grok 4.1,主打“智商情商雙在線”,正面硬剛GPT-5.1。
據xAI介紹,本次Grok 4.1共有兩個版本:Grok 4.1 Thinking(推理)和Grok 4.1(非推理)。目前,Grok 4.1已向全網用戶開放,可在Grok官網、X平台以及iOS和Android應用中免費體驗。
從測試結果看,在公認大模型排名榜單LMArena中,Grok 4.1 Thinking以1483分的成績壹舉加冕全球大模型之王,超越Gemini 2.5 Pro 31分。而非推理模式的Grok 4.1,也直接殺到榜單第贰。
值得壹提的是,Grok 4.1的情商進步明顯,具備了更高的理解力、洞察力、同理心和人際交往能力。
在情商測試EQ-Bench3中,Grok 4.1 Thinking以1586分的成績同樣霸榜,Grok 4.1位居第贰,排名第叁的是國產模型Kimi K2。
從實測效果看,對比上壹代Grok模型,Grok 4.1變成了壹位更具耐心的傾聽者,且共情能力凸顯。細節的是,還在回復結尾位置比了個心。

此外,Grok 4.1的創意寫作能力較上壹代足足提升了600分,語言表達流暢有畫面感。而且,基於訓練方法的優化,模型幻覺率比之前降低了3倍(從12.09%降至4.22%)。
據介紹,為實現上述提升,xAI在支撐Grok 4的同壹套大規模強化學習基礎設施上進壹步優化了模型風格、個性等特征。並且,xAI開發了全新方法,能夠利用前沿智能體式推理模型作為獎勵模型,從而實現大規模自主評估和迭代響應。
xAI負責後訓練的Dustin Tran分享了更多細節,他表示,新模型的改進主要在強化學習上,將RLHF推向了前所未有的新高度。- 新聞來源於其它媒體,內容不代表本站立場!
-
原文鏈接
原文鏈接:
目前還沒有人發表評論, 大家都在期待您的高見