-
日期: 2025-01-24 | 來源: 觀察者網 | 有0人參與評論 | 字體: 小 中 大
中國媒體觀察者網報道:中國人工智能公司深度求索(DeepSeek)在大模型上取得的成功,目前已經深深撼動了硅谷同行們的信心。
1月23日,在美國匿名職場論壇TeamBlind上,壹名Meta公司員工發布涉深度求索的帖子“Meta生成式人工智能部門陷入恐慌”,引起廣泛討論。該員工在文中稱,從深度求索發布DeepSeek-V3開始,就已經讓Meta的Llama 4在各項測試中處於落後,“更糟糕的是,這家不知名中國公司僅為此花費了550萬美元。”
550萬美元是什麼概念呢?“Meta生成式AI部門裡的每位‘領導’的薪資都超過了這個數字”,該Meta員工稱,“而我們卻有幾拾位這樣的領導,我根本無法想象該如何向公司高層證明部門目前高額成本的合理性。”
該員工透露,目前Meta的工程師們正在瘋狂研究分析DeepSeek的成功,並試圖從中復制任何能復制到的東西,這不是誇張。“然而,當DeepSeek-R1發布時,事情變得更加可怕了”,該員工表示雖然不能透露太具體,但有些事情很快將會公開。
最後,該員工反思稱,Meta的生成式AI部門本應該是壹個以工程為重點的小型組織,但因為很多人都想進來分壹杯羹,人為膨脹了組織的規模,到最後人人都是輸家。
目前不清楚該員工所指具體為何,是否暗示該公司生成式AI部門面臨的調整或者其他情況的可能性,這還需要進壹步觀察,不過Meta在大模型中競爭中腳步放緩已是事實。

1月20日,深度求索發布DeepSeek-R1開源大模型,對標OpenAI o1正式版。南華早報
公開信息顯示,帖子中提及的DeepSeek-V3於去年12月26日對外發布,該模型壹經發布就站上了開源模型No.1的位置。根據當時深度求索公布的技術報告數據,Meta公司的Llama 3.1-405B僅在大規模多任務理解數據集MMLU-Pro壹項,接近DeepSeek-V3水平,其余多項幾乎都不及八成,甚至在算法類代碼場景和工程類代碼場景下,Llama 3.1-405B只有DeepSeek-V3的壹半水平。
而4天前(1月20日),深度求索對外正式發布DeepSeek-R1,官方技術報告的測試所對照模型中,僅有OpenAI公司閉源的OpenAI o1 模型,以及DeepSeek-v3等自家模型。而在上壹輪DeepSeek-V3測試中所對照的Meta、Anthropic等公司模型,此時早已不見蹤影。
- 新聞來源於其它媒體,內容不代表本站立場!
-
原文鏈接
原文鏈接:
目前還沒有人發表評論, 大家都在期待您的高見