最近有网友扒出疑似DeepSeek 创始人梁文锋 2011 年前后的社交账号,看完之后只能感叹,大佬的早期岁月总是带着一种不自知的反差萌与硬核色彩。那时候他才26岁,网传网名叫做 “程序小王子”
2023 年 7 月,深度求索人工智能基础技术研究有限公司于杭州注册,即 DeepSeek,梁文锋作为实际控制人担任首席执行官。
团队起步规模很小,工程师与研究人员仅一百余人;同期行业报道 OpenAI 研究人员约千人级别,Anthropic 五百人以上。资源摆在这里,梁文锋却没打算走烧钱铺量那条路。
这份底气其实早有铺垫。2019年,梁文锋带队自研了一套名为"萤火一号"的训练平台,投入近2亿元,配备1100块GPU,这在当年国内私募基金圈子里几乎没人这么干。
两年后的2021年,"萤火二号"上线,投入跳到10亿元,A100显卡数量攀升至约1万张。也正是靠着这两代自建集群积累下的工程经验,幻方量化那年管理规模突破千亿,跻身业内"北九坤,南幻方"的格局之中。
外界后来津津乐道DeepSeek训练成本低得离谱,根子其实就在这几年攒下的硬件家底和团队打磨出来的优化本事。
时间往前倒一倒。2013年,梁文锋和浙大同学徐进一起,在杭州成立了雅克比投资管理有限公司。
此前几年,他一个人窝在成都的出租屋里捣鼓策略模型,雅克比的成立算是把这些零散摸索第一次装进了正规公司的框架里。
也是从这个阶段开始,一批后来在幻方核心团队挑大梁的人陆续聚过来,其中不少还是奥数、物理竞赛的金银牌得主。这批人后来在算法和工程上的深厚积累,很难说和这段早期招募没关系。
2015年6月,九章资产在杭州落地;2016年2月,幻方量化又在宁波成立。从雅克比到九章再到幻方,梁文锋走的路子始终是数学模型和算法驱动,跟主观多头那一套完全不沾边。
技术突破也没让人等太久。2024年5月,DeepSeek-V2发布,靠MLA注意力机制和MoE架构把API价格压到每百万tokens输入1元、输出2元,只有同类闭源模型价格的百分之一,被业内戏称"AI界的拼多多"。紧随其后,DeepSeek‑V3 公开披露预训练 GPU 租赁成本仅 557.6 万美元(不含前期研发、人力与数据成本)。同期同规模模型普遍要花几千万甚至上亿美元。
商业成功之外,梁文锋在公益上也不含糊。2025 年 1 月日喀则地震,幻方捐款 100 万元支援灾区;
2022 年,幻方出资 630 万元,资助山西 6300 名小学一年级女生每人 1000 元助学金。这些事摆在这,倒是能看出这位技术出身的创业者,走到今天这一步,靠的从来不是运气。
