-
_NEWSDATE: 2025-02-08 | News by: 蓝血研究 | 有0人参与评论 | _FONTSIZE: _FONT_SMALL _FONT_MEDIUM _FONT_LARGE

梁文锋是一位兼具理想主义和创新精神的企业家。他从量化投资领域积累经验后,全身心投入人工智能大模型的研究探索,目标直指通用人工智能(AGI) ,这种对技术前沿的执着追求令人钦佩。在技术研发理念上,他坚信语言大模型是通往AGI的关键路径,为此专注基础研究,不急于开展应用开发。
他深知创新的成本高昂且充满挑战,但依然坚定前行,这种长期主义的眼光和勇气难能可贵。在人才策略方面,他注重能力、热爱和好奇心,选用应届及毕业不久的人才,给予充分自由,营造了开放包容的创新环境。从商业视角看,他追求普惠,希望降低大模型使用门槛,打破技术垄断。同时,他认为开源是一种文化行为,能吸引人才、推动生态发展。尽管面临高端芯片禁运等难题,他仍坚持不融资,依靠自身力量探索。
梁文锋对中国AI发展有着深刻思考,指出中国与美国在原创和模仿方面的差距,呼吁中国积极参与全球创新。他的理念和实践为中国AI行业提供了新的思路,有望推动中国在全球AI竞争中实现从追随者到创新者的转变,引领行业走向更具创造力和竞争力的未来。
2024年12月16日,DeepSeek R1大模型即将推出,梁文锋罕见地在朋友圈转发了一篇文章。其评论的那句话豪气干云,“3年过去了,旧世界分崩离析,新时代正在光速到来。”
01
DeepSeek创始人梁文锋的60条思考:
1.我们做大模型,跟量化和金融都没有直接关系。我们要做的是通用人工智能,也就是AGI。
2.语言大模型是通往AGI的必经之路,并且初步具备了AGI的特征,所以我们从这里开始。
3.我们不会过早设计基于模型的一些应用,会专注在大模型上。从长期看,大模型应用门槛会越来越低,初创公司在未来20年任何时候下场,也都有机会。我们的目标很明确,就是不做垂类和应用,而是做研究,做探索。
4.我们理解人类智能的本质就是语言,人的思维就是一个语言的过程。你以为你在思考,其实可能是你在脑子里编织语言。这意味着,在语言大模型上可能诞生出类人的人工智能(AGI)。
5.只做复刻的话,可以在公开论文或开源代码基础上,只需训练很少次数,甚至只需finetune(微调)一下,成本很低。而做研究,要做各种实验和对比,需要更多算力,对人员要求也更高,所以成本更高。
6.我们希望更多人,哪怕一个小App都可以低成本去用上大模型,而不是技术只掌握在一部分人和公司手中,形成垄断。大厂的模型,可能会和他们的平台或生态捆绑,而我们是完全自由的。- 新闻来源于其它媒体,内容不代表本站立场!
-
原文链接
原文链接:
目前还没有人发表评论, 大家都在期待您的高见