山姆奥特曼怎么也想不到,那个时刻威胁签 gbt 的 deepsea, 居然最开始只是梁文峰用来炒股的。二零一五年,梁文峰终于把八万块钱本金变成了五个亿。这个时候,他做的事还远远谈不上伟大,因为说好听点是量化交易,但是说难听点就是个炒股的。 此时,距离他第一次把机器学习算法用到量化交易上,已经过去了七年。预见到中国量化交易将迎来私募基金时代,他成立了杭州换方量化,很快管理的资金就达到了百亿级别。由于不差钱,梁文峰挥下聚集了一大批来自浙大和清华计算机专业的高材生。彼时正值 a 股牛市, 传统量化策略大放异彩,但梁文峰却力排众议,决定全面转向人工智能驱动。当时的首席风控官认为 ai 模型是黑箱,风险不可控。梁文峰却说,如果我们不敢用最好的技术,就不配在这个行业生存。 个决定导致了两名资深交易员的离职,却也吸引了更多年轻 ai 人才的加入,也为最终诞生 deepsea 埋下了种子。到了二零一七年,随着策略复杂度的提升,算力平局日渐明显,当时猪肉云算力的成本已经占到换方利润的百分之三十。于是梁文峰做出了一个被内部称为疯狂的决定,自荐操算中心。 在一次董事会上,有投资人质疑,一个私募基金为什么要建超算中心,我们又不是搞科研。梁文峰的回答成为后来被反复引用的名言,我们不是一家基金公司,我们是一家用 ai 解决复杂问题的科技公司,只是碰巧在金融领域找到了一个应用场景, 你们相信我就跟着我干,不相信我可以撤职。这句话掷地有声,也一锤定音。二零一八年,投入数亿元的萤火一号在杭州落成,一下子变成了国内民用领域顶尖的 gpu 集群。但这次投入也直接导致当年分红减少百分之四十,再次引发内部争议。 而梁文峰不仅顶住了所有的压力,还秘密启动了一个代号探月的计划。他从炼化团队中抽掉了五名最顶尖的 ai 研究员,组成独立小组,跟他们说,不要管金融了,去研究全球最前沿的 ai 技术,特别是自然语言处理。这个小组的负责人后来回忆, 梁总给我们的指令很模糊,只是说我相信 agi 会改变一切,我们要参与其中。然而,早期的探索并不顺利,团队尝试了多个方向,包括知识图谱、推荐系统等等, 但进展缓慢。二零一九年,美国的 gbt 二发布换房,团队经过连夜测试后,得出了一个激动人心的结论,基于 transformer 的 大语言模型,可能就是通向 a g i 的 正确路径。得知消息的任文峰决定加大投入。 二零二零年,他提出要建设一个更强大的萤火二号,预算高达数十亿。这一次反对声达到了顶峰,股东们强烈反对梁鸿峰把钱不断投入这个无底洞。就连他的共同创始人徐静,也在二零二一年选择了带领部分团队离开。因为徐静认为应该专注量化投资主业,挣钱才是王道。 而梁文峰却坚持,必须为更宏大的 ai 研究布局做点真正有意义的事情。这次分裂对梁文峰打击巨大。在二零二一年春节后的内部信中,他写道,有人选择在已知的道路上继续辉煌,而我选择走向未知的黑暗森林。这没有对错,只有选择。 二零二一年六月,分裂后的患方梁文峰彻底掌控了方向。他将探月小组升级为独立部门,正式命名为深度求索下长成了一个独立的科研项目, 也开创了中国企业家中用搞金融的快钱来支撑做科研的先例。此时, deepsea 团队的所有人都不知道,他们做的事将在我们民族的科技发展中书写多么波澜壮阔的篇章。
粉丝12.2万获赞90.3万

前一段时间呢, deepsea v 三的发布引起了全世界的关注,而背后的团队和领导者却非常低调,显有曝光。公司的创始人梁文峰在网上公开的采访更是只有寥寥几篇。今天呢,我们就来尝试梳理一下梁文峰和 deepsea 的 发展历史,看看他是如何从一家籍籍无名的小公司变成让世界瞩目的来自于东方的神秘力量。 准确的说,梁文峰是换方量化和深度求索这两家公司的创始人。一九八五年,他出生于广东湛江,父亲呢,是一名小学老师,而梁文峰则从小就展现出了对于数学建模的浓厚兴趣。二零零二年,年仅十七岁的梁文峰成功考入浙江大学电子信息工程专业,开启了他的学术之旅。 二零零七年,他继续攻读浙江大学信息与通信工程专业研究生,师从向志宇,专注于机器视觉研究,并且发表了论文一种鲁棒的 p t z 摄像机目标跟踪算法。 二零零八年,全球金融危机爆发,大多数人都在为经济的动荡而担忧,而梁文峰却看到了其中的机遇。他与同学一起组队,开始积累市场行情数据、金融市场的相关数据以及宏观经济等数据,并且率先使用机器学习等前沿技术来探索全自动的量化交易。 当时呢,据说大江的创始人汪涛在大江起步的时候,曾经邀请梁文峰一起创业,但是梁文峰坚信人工智能将会改变世界,毅然决然的选择了自己创业这条充满挑战的道路。二零一零年六月,梁文峰顺利从浙江大学信息与通信工程专业硕士毕业。 二零一三年,二十八岁的梁文峰与同样来自于浙江大学的同学徐进携手创办了杭州亚克比投资管理有限公司,为他日后在金融领域的发展砥砺了基础。 二零一五年,对于中国量化私募行业来说是一个重要的转折点。四月中证五百股指期货上市,标志着中国量化私募进入了二点零时代,量化基金拥有了更强大的工具和更丰富的对冲手段,市场格局也在发生着变化。 在这一年的六月,三十岁的梁文峰与徐进抓住机遇加入了阳光私募大军,在浙江杭州创办了杭州幻方科技有限公司。如今的浙江九章资产管理有限公司依靠数学与人工智能进行量化投资, 即便在当年国内发生了谷灾的情况下,梁安峰的团队依然凭借着高频量化投资策略取得了不错的成绩。当时呢,公司只有十张 gpu 的 显卡。在这一年的十月和十二月,公司更是在一天内成立了实质产品,展现出了强大的募资能力。二零一六年二月,梁安峰与徐进成立了宁波换风量化投资管理合伙企业,进一步的拓展业务。 同年,幻方量化成功加入了中国证券投资基金业协会,意味着在行业内的专业性和规范性得到了官方的认可。十月二十一日,幻方量化推出了第一个 ai 模型,并且首次使用 gpu 来生成交易仓位,并且上线执行。 在这之前,它们的算法主要依赖于现行模型和传统的记忆学习算法,模型计算主要还是依靠的 cpu。 到了二零一六年底,幻方量化管理的资金规模已经大约达到十亿元。 随着时间的推移,二零一七年,三十二岁的梁文峰带领换方持续加大在 ai 算法研究和软硬件研发方面的投入,不断的扩充团队。到了二零一七年年底,几乎所有的量化策略都已经采用了 ai 模型计算,公司管理的资金规模也顺利扩大到了三十亿元。 二零一八年,梁文峰明确了公司以 ai 为核心的发展方向,这个战略决策使得换方量化在当年首次荣获金牛奖,这也是中国私募证券领域的最高奖项。 不过呢,公司也遇到了发展的瓶颈,那就是算力不足。随着训练需求的日渐增长,有限的计算资源严重限制了公司的进一步发展,于是,梁文峰开始积极地寻求大规模算力的解决方案。为了解决算力的问题,二零一九年,梁文峰果断创办换方 ai 公司,并且投资两亿元自主研发深度学习训练平台萤火一号,这个平台搭载了一千一百块 gpu 显卡。 这一年,三十四岁的他带领换方量化成为管理资金超过百亿的私募机构。同时,换方资本在香港成立,并且成功获得了香港九号牌,也就是资产管理牌照,进一步拓展了公司的业务版图。 在八月三十日的金牛奖颁奖仪式上,梁峰发表了主题演讲,题目为一名程序员眼中的中国量化投资的未来。在演讲中,他深入探讨了量化与非量化的判定标准,指出量化公司的核心是福气,而非传统的基金经理。 他还坦诚的表示,私募行业面临着巨大的压力,因为投资人对于业绩的期望很高,如果一年跑赢指数低于百分之二十五,投资人往往会不满意,但是同时他们收取的手续费也相对较高。 此外呢,他强调,量化投资已经在技术面流派取得了成功,未来的目标是抢夺基本面流派的市场份额。而换方量化的使命就是提高中国二级市场的有效期。二零二零年,萤火一号正式投入使用,寿命为一年半。 根据换方量化的员工透露,梁文峰每天都亲自参与写代码、跑代码,这种亲力亲为的工作态度在公司内部也形成了良好的风气,也成为了与其他同行的显著区别之一。 二零二一年对于梁文峰和换方来说,都是命运转折的关键一年,这一年,他们斥资十亿元建设了萤火二号。二月份,征服市场的人西蒙斯传一书出版,梁文峰为该书作序,他在书中提到,每当在工作中遇到困难的时候,西蒙斯的话一定有办法,对价格、建模都会激励着他。 我们简单介绍一下詹姆斯席梦思,他是量化投资领域的传奇人物,所创办的文艺复兴科技公司和大奖章基金都取得了令人惊叹的投资战绩。从一九八八年到二零一八年,大奖章基金的年化复合收益接近百分之四十, 扣除费用后,年化回报率为百分之三十九,远远超过了巴菲特和索罗斯等投资大佬。在一九九四年到二零一四年中期这段时间,平均的年回报率更是获得了百分之九十一点八,在二零零八年全球金融危机期间,依然能够取得百分之八十的收益。 话说回来,在二零二一年的八月,梁峰带领焕方量化成功突破千亿大关,跻身千亿量化私募之列,与九坤投资、明弘投资、零军投资一起,被业界称为量化私募领域的四大天王。焕方量化在短短四年的时间内成为百亿量化私募,随后又只用了两年的时间就晋升为千亿量化私募,发展速度之快令人乍舌。 不过呢,成功的道路并非一帆风顺。二零二一年的十一月,由于业绩出现波动,换方量化不得不关闭全部的募集通道,并且在十二月底发布致投资者公开信,对业绩回撤达到历史最大值表示深感愧疚。究其原因,主要是人工智能投资决策在买卖十点的把握上出现了问题。 根据媒体报道,换方量化在一个半月内主动缩减了超过一百亿元的管理规模,从近千亿规模降到了八百多亿。此后,为了应对市场的变化和风险,公司逐渐降低资产的管理规模。在这个过程中,投资者的情绪也出现了较大的波动,有投资者甚至表示,看到换方高管的名字就想打人。 对此,换方高管陆某在朋友圈诚恳的致歉,表示公司正在全力加班加点进行研发,虽然需要一定的时间来调整,但是会努力重振旗鼓,希望投资者能够理解和支持。 尽管面临业绩波动的困境,二零二一年,梁峰在技术领域仍然取得了重要突破。他带领换方先于一些云计算厂商拿到了英伟达的 a 一 百显卡,并且 ai 集群的显卡数量达到了万卡级别。在当时国内拥有超过一万个 gpu 的 企业不超过五家。除了换方以外,其他四家都是互联网大厂。 二零二二年,焕方量化的一名员工,以一只平凡的小猪的名义,向慈善机构捐款一点三八亿元,捐赠项目包含白血病救助、乡村工匠、高中生助学、儿童大病救助、听众儿童支持、关爱老兵等等多个领域。外界纷纷猜测,这位神秘的捐款人就是三十七岁的焕方创始人梁文峰。不过呢,这个猜测没有得到证实。 二零二三年五月,三十八岁的梁文峰做出了一个重大的决定,宣布进军通用人工智能 a g i 领域。七月份,他创办了杭州深度求索人工智能基础技术研究有限公司,也就是 deepsea, 成为量化投资者投身 ai 创业的第一人。 二零二三年十月底,梁文峰的创业伙伴徐进因为个人家庭事务处理不当,引发负面事件,被公司给予停职处理。此时,换方量化的管理规模已经降到了四百多亿元。 二零二四年的五月, deepstack 发布了混合专家语言模型 deepstack v two, 其中模型的 api 定价在当时极具竞争力,每百万托克的书只有一块钱,书出两块钱,价格仅为 gpd 四突破的百分之一。 这个价格立刻引发了行业震动,字节跳动。阿里巴巴、百度、腾讯等大厂纷纷跟进,宣布降低自家大模型产品的价格。也正因为如此, deepstack 被外界形象地称为 ai 界的拼多多,在降低大模型应用成本方面起到了引领作用。 二零二四年十月,梁峰的换方量化向投资者发布公告,宣布未来会逐渐将对冲产品投资的仓位降低到零,这标志着公司战略的重大调整。二零二四年十二月二十六日,梁峰又带领 deepsega 发布了 deepsega v 三,并且公开了由他和罗富利等人转载的五十三页技术论文。 deepstack 的 公司官网显示, deepstack v 三在多项性能指标上表现优异,吊打了国内移动大模型产品。比如说在 m m l u e m 测试中达到八十八点五分,超过了拆的 gbt 四 o 的 八十七点二分,在 d r o p 三少的 f 一 测试中达到了九十一点六分,而拆的 gbt 四 o 仅为八十三点七分。 不仅如此, deepsea v 三的训练成本只有五百五十七点六万美元,而 openai 训练拆的 gbt 四 o 所花费的成本高达七千八百万美元甚至一亿美元,双方成本相差十多倍,展示出了 deepsea 极高的性价比。 openai 的 创始人安德烈卡帕西在看到 deepsea 的 成绩后,对模型在资源受限的情况下展现出的极高的研究和工程能力也给予了高度赞赏。 需要说明的一点是,梁峰组建的 deepsea 团队只有一百三十九名研发人员,而且呢,是一支纯粹的国内本土团队,没有海归人才。团队成员大多是来自于清华、北大、北游、北航等国内顶尖高校的计算机专业应届生,或者是在读的博士生,或者是毕业一两年的年轻人。甚至有报导称,团队不招聘高级技术专业人员, 员工的工作年限大约为三到五年。对于拥有八年以上的研发经验的人,可能会直接拒绝,因为他们认为这样的人可能包袱太重,缺乏创新的动力。 比如在团队中,朱启豪是二零二四年北大计算机学院软件研究所博士毕业生,戴达麦是二零二四年北京大学计算机学院计算员所的博士毕业生,郭达雅是二零二三年中山大学博士毕业生等等。其中呢,还有不少人是在实习期间就做出了重要贡献。对比来说, openai 其实在招聘的时候也有类似的倾向,会优先考虑没有学术荣誉的高潜力新人。 梁峰曾经对媒体表示,如果追求短期目标,找有经验的人可能是正确的,但是从长远来看,基础能力、创造性和热爱等等因素更为重要。在公司管理方面,梁峰采用了扁平化的组织结构,所有研究人员直接向他汇报,他给予团队充分的尊重和自由,鼓励成员大胆尝试创新,无论职位高低,只要有好的想法,就可以推进落地。 在 ai 大 模型的研发过程中,梁峰也面临着资金的问题。由于他更加注重长期的学术探索,短期内难以实现产品的商业化,所以按照常规的 vc 投资逻辑,很少有 vc 愿意投资。因此呢,梁峰在 ai 大 模型领域的探索资金,目前还主要是依赖他的换方公司支持。 二零二五年梁峰的换方量化资金管理规模已经小于三百亿元,退出了行业前六名。但是在一月十日西藏日喀则发生地震之后,换方量化依然向灾区捐赠了一百万元救灾款。 最近呢,小米雷军千万年薪挖走九五后天才 ai 少女的热门话题,其中的主角罗富力也正是 deepsea 团队的研发成员。在 deepsea 的 一篇论文显示,罗富力已经从团队离职,但他是否要加盟小米,仍然有待进一步的确认。回顾梁文峰的创业历程,他从一开始就秉持用技术驱动的理念,这可能源自于他对于人工智能的坚定信仰,以及对詹姆斯西蒙斯的崇拜。他选择在金融场景中应用 ai 技术,为后续的研究创新积累了雄厚的财力。 有趣的是,他的每次创业都恰逢资本市场的寒冬期,无论是二零零八年开启量化交易探索,还是二零一五年创办幻方进入私募领域,以及二零二三年切入 ai 大 模型赛道, 但他每次都能够在困境中崛起,迅速取得不俗的成绩。如今,他将目光聚焦于 ai 大 模型领域,把 deepsea 更多的看作是好奇心驱使的学术探索,而非单纯的商业利益追逐,所以呢,也选择将 deepsea 开源。尽管梁文峰现在还不到四十岁,但是几乎可以预见的是,他和 deepsea 将。


问你个事,你用过 deepsea 吗?那必须的呀,写稿子可方便了。说起 deepsea 啊,咱是不是就得说说梁文峰了?梁文峰呢,他是个八零后啊,出生在广东湛江的一个农村 人家,在初中就读完了高中的数学课程,十七岁呢,就考进了浙大的电子系,典型的一路考上来的小镇做题家。而且啊,学霸不可怕,就怕学霸搞金融。 二零零八年的时候,全球金融危机爆发了,很多人都是止损卖出股票,他却偏偏反着干。梁文峰呢,拉上几个和他想法一致的同学,研究怎么把机器学习用在量化交易这个领域, 结果毕业第一年就赚了五个小目标,这让我这个韭菜情何以堪呀。后来,梁文峰和同学一起创办了一家投资管理有限公司, 尝试把更先进的数学模型和算法应用于量化的交易。二零一三年,公司成立,到二零二一年的时候,管理公司资产就已经突破了一千亿,被称为中国量化私募基金四大天王之一啊。从十万元的注册资本到掌控一千亿元的资金, 只用了短短的八年。书中自有黄金屋,代码里有印钞机呀。在量化投资领域取得巨大成功之后啊,梁文峰就把目光投向了通用的人工智能领域。投入 ai 后呢,梁文峰喊出的口号就是要做真正人类级别的人工智能。 在 deepsea 的 团队里边,是一百多个刚毕业的年轻人啊,用他的话来说,年轻人更懂创新,这帮年轻人还真就搞出了大名堂。何止是大名堂啊,他们在短短的一年多的时间里啊,就鼓捣出了吊打 openai 的 deepsea 二一模型,正式发布的时候就能跟顶级的闭元模型掰手腕,不但性能逆天,关键是成本才是只有人家的十分之一。 这 deepsea 一 问世啊,直接就打爆了对方的骨架,被硅谷同行称为来自咱们东方的神秘力量。就在不久前的 ai 炒股大赛里边,美国的四款 ai 产品全部都赔了, deepsea 呢,稳扎稳打的赚钱,再一次证明了技术的强大。我都怀疑了,他是不是从未来穿越而来啊,穿不穿越不知道啊,但是 ai 肯定是来到了咱们的身边, 远的不提啊,写文稿,做视频,做音乐,升美图,赢流量, ai 是 不是已经帮我们做了很多很多的事情了? 其实啊,真正的时代红利肯定不止汇集头部的这些精英,梁文峰走通了从技术鬼才到搞钱高手的光明大道,咱们普通人是不是也别在外场看热闹了,想想咱们的路径在哪里?
