前两天我在改一段代码,死活跑不通。
是一个挺无聊的问题,一个长度100的数组,1到100打乱顺序塞进去,但有一个数字重复了两次,另一个数字缺失了。要在O(n)时间、O(1)空间里把那个重复的和缺失的都找出来。
我寻思了一下我没寻思明白。
这种题我以前读书的时候大概能憋出来,现在脑子锈了,光看题干就有点犯困。我就随手丢给了DeepSeek R1,想着反正不要钱,试试呗。
然后我就看着它在那儿自言自语。
它先列了个方程,sum(A) = 5050 + d − m。又列了一个,sum(A²) = 338350 + d² − m²。然后它说,两个方程两个未知数,联立就能解。接着它真的就把d和m的公式推出来了,最后还顺手写了段Python,跑了一遍,把答案打印出来。
整个过程大概四十秒。
我坐在那儿愣了一会儿,第一反应不是”卧槽这题解得漂亮”,而是”这玩意不要钱???”

我以前用ChatGPT o1跑过类似的题,体验是不错,但那个价格,怎么说呢,我每问一次心都在滴血。o1的output价格大概150美元一百万token,换算成人民币一千多块。我这种重度用户,一个月下来订阅费加API费,小一千刀打不住。
DeepSeek R1呢,output大概16块人民币一百万token。
你敢信???
差了快七十倍。
这就让我有点好奇了。一个能跟o1掰手腕的推理模型,凭什么敢卖这个价?是真便宜还是真亏本?亏本的话谁在给它输血?这事儿我越想越不对劲,就顺手去扒了一下DeepSeek的来路。
这一扒,给我扒出来一个更离谱的故事。
DeepSeek背后那家公司叫幻方量化。是个做量化基金的。
你可能没听过这个名字,正常,我也没怎么听过。量化这个圈子一向挺闷的,闷头赚钱,不爱吆喝。但你要是混金融圈,大概知道幻方是个什么段位,2021年它规模做到千亿,被叫”量化四大天王”之一。2025年那波行情,它收益率干到了56.6%。
一个管着千亿、年化五十多的量化基金,跑去孵化一个大模型公司。
这事儿听着就有点不对劲,对吧。
你想想看,一个搞金融的去搞AI,这画面怎么想怎么违和。就像一个开火锅店的突然宣布要去造火箭,你第一反应不是”哇好酷”,是”哥们你是不是赚了点钱飘了”。
但我把材料翻完之后,我发现这事儿还真不是飘不飘的问题。
幻方这家公司,骨子里就不是个正经的金融公司。
它2015年成立,从第一天起就在用AI做量化。2016年第一份由深度学习生成的交易仓位上线实盘,2017年几乎所有量化策略都换成AI模型了。那时候国内大部分量化基金还在玩线性回归和传统机器学习,幻方已经把GPU堆上去了。
到了2019年,它干脆成立了一家AI基础研究公司,砸了将近2个亿,搞了个叫”萤火一号”的AI集群,1100块显卡。两年后又搞了”萤火二号”,投了10个亿,搭了大概一万张英伟达A100。
一万张A100是什么概念呢。
2023年ChatGPT炸场的时候,全中国都在找卡,云厂商高性能GPU缺货缺到什么程度呢,据《财经十一人》那会儿的报道,国内拥有超过一万枚GPU的企业不超过五家。除了几个互联网大厂,就只有幻方。
一家量化基金,手里攥着比大多数AI公司都多的卡。
你品,你细品。
这事儿其实挺反常识的。我们一般会觉得,做AI的肯定算力最多,搞金融的顶多买点服务器跑跑模型。但幻方不是,它从2019年就开始囤卡,比ChatGPT火起来早了整整四年。
为啥一个量化基金要囤这么多卡?
说到底,量化投资这门生意,跟AI是天生一对。
量化就是数据驱动决策,把历史行情、量价数据、新闻文本、宏观指标全喂进模型,让模型去找规律、做预测。这事儿跟训练大模型在工程上几乎是同一套,都是大规模矩阵运算,都是堆算力堆数据堆算法。幻方那帮人,本来就是数理、计算机、金融的复合背景,天天跟深度学习打交道,对工程化、标准化的接受度比传统金融机构高得多。
所以当ChatGPT出来的时候,幻方其实早就站在门口了。它不是临时起意追风口,它是攒了四年的家底,正好风口来了。
但光有家底还不够。家底只能解释”凭什么它能做”,解释不了”凭什么它要做”。
一个年化五十多的量化基金,闷头赚钱不好吗?干嘛要去蹚大模型这趟浑水?这趟浑水有多浑呢,训练一次模型动辄上千万美金,整体投入起步五千万刀,非百亿美金公司根本扛不住持续跟进。这是个无底洞。
我去翻了翻梁文锋的那个访谈,2024年4月那次,他第一次公开受访。
梁文锋是幻方的创始人,浙大人工智能方向出来的,典型的技术宅,鲜少露面。他说了一句话,我看完之后沉默了挺久。
他说,我们做大模型,跟量化和金融都没有直接关系。
他还说,过去很多年,中国公司习惯了别人做技术创新,我们拿过来做应用变现,但这并非是一种理所当然。这一波浪潮里,我们的出发点,就不是趁机赚一笔,而是走到技术前沿,去推动整个生态发展。
你听听这话。
这话从一个量化基金老板嘴里说出来,怎么说呢,有点不像生意人,倒像个还没被社会毒打过的研究生。但我又觉得他是认真的。因为他还说了另一句,AGI是利润之上的追求。
“利润之上的追求”,这话我琢磨了很久。
一个靠利润活着的人,说自己在追求利润之上的东西。这听着像装,但你往他身上一对照,又不像装。幻方2025年赚了那么多,他没拿去分红扩大基金规模,反而拿去填DeepSeek那个无底洞。这哥们是真的把量化当成了提款机,提款机提出来的钱全塞给AGI了。
我还看到一个细节,说梁文锋毕业后没去大厂当程序员,躲在成都的廉价出租屋里,不停接受进入各种场景中尝试的挫败,最后切入了金融。最早那几年,有个同样疯癫的朋友在深圳城中村搞飞行器,拉他入伙。后来那个朋友做成了一个千亿美金的公司,叫大疆。
你看,这帮人是一伙的。
不是那种算计着ROI入场的,是那种天生就想搞点大事的。幻方在发布做大模型公告的时候,引用了法国新浪潮导演特吕弗的一句话,务必要疯狂地怀抱雄心,且还要疯狂地真诚。
疯狂地怀抱雄心,且还要疯狂地真诚。
这话我念了好几遍。我觉得这十个字,比任何一份商业计划书都更能解释DeepSeek为什么存在。

说到这个,我得把话头拉回来,聊聊DeepSeek这个工具本身,不然就跑题了。
我前面不是说我拿R1做题嘛,做完那道数组题之后我就上头了,开始拿它各种试。
我先试了数学。
AMC-12的题,美国高三数学竞赛,我一道一道喂给它。它解题的那种感觉,怎么说呢,不是那种”我背过这道题”的流畅,是那种”我现场推一遍”的踏实。你能看到它思维链在哪儿停顿、在哪儿转弯、在哪儿突然想通了往前冲。MATH-500这个基准它跑97.3%,AIME 2024跑79.8%,都比GPT-4o高。
然后我试了代码。
让它写Go和Rust,这俩语言GPT-4o其实不太灵,训练语料少。DeepSeek V3反而写得挺顺,关键是中文注释加得特别自然,不像GPT那种翻译腔的注释,看着别扭。有个兄弟在评论区说,他拿DeepSeek写飞书开放平台的对接,比GPT-5还顺手,因为国产框架的覆盖更全。
最后我试了中文写作。
这个就不用我多说了吧,你正在看的这篇文章,初稿就是DeepSeek V3帮我搭的框架。它写中文那个味儿,是土生土长的味儿,成语俗语谐音梗都接得住,不像ChatGPT写中文总带着一股翻译腔,正式场合还会书面语和口语混搭。
我有时候觉得,DeepSeek最狠的不是某个单项分数,是它那个价格。
V3的output大概2块钱一百万token,GPT-5是540块。同样一条输出,用ChatGPT要花DeepSeek大概67倍的钱。你如果是个人玩家,这差距还能忍;你要是创业公司,API成本直接决定你产品能不能上线,这67倍就是生与死的差距。
我认识好几个做AI应用的小团队,今年全切DeepSeek了。不是因为他们不爱ChatGPT,是因为算不过来那笔账。

但我要说一句公道话。
ChatGPT不是没优点。它的多模态更成熟,文生图、语音、视频一整套,生态深度在那儿摆着。你要做企业级应用,要合规、要稳定、要SLA,OpenAI那套东西确实更让人放心。DeepSeek的多模态还在追赶,生态也没那么厚。
所以我不建议你无脑切。你得看你自己的场景。
你如果是这几种人,DeepSeek真的可以认真试试,第一,中文内容创作,公众号小红书知乎公文合同,DeepSeek的体感提升远大于ChatGPT;第二,对成本敏感的开发者和创业公司,API价格能让你把产品单价打下来;第三,国内企业和政企单位,要合规、要发票、要境内部署;第四,重度白嫖党,DeepSeek网页端和App几乎无限量免费;第五,想看推理过程的学习党,R1的思维链是可见的,你能看到它怎么想的,不光能看到它想了什么。
你要是这五类之外的,比如主要做英文内容、要跨语言翻译、要重度多模态,那ChatGPT还是更稳。
工具这东西,没有最好的,只有最对的。
我前面聊了半天幻方和梁文锋,其实想说的就一件事。
DeepSeek这个工具之所以能存在,之所以能卖这么便宜,之所以中文做得这么地道,背后不是某个天才程序员的灵光一闪,是一整个不正常的公司在用一种不正常的方式做一件不正常的事。
一个量化基金,攒了四年的卡,赚了五十多年化的钱,全砸给一个跟自己主业没关系的大模型。创始人说这是利润之上的追求。引用特吕弗的话,要疯狂地怀抱雄心,且要疯狂地真诚。
这事儿你用正常的商业逻辑是解释不通的。
但你用”一个理想主义者攒了十年家底终于等到风口”这个逻辑,就全通了。
我有时候觉得,中国互联网这几年最缺的不是钱,不是技术,不是流量,是这种”利润之上的追求”。大家都太会算账了,算到最后一算一个不亏,一算一个稳赚,一算一个安全。算来算去,没人愿意去蹚那个无底洞。
梁文锋去蹚了。
他用幻方的利润给DeepSeek输血,用全栈开源+极低API的策略把价格打下来,让每一个像我这样的普通用户,能用67分之一的价格,用到一个不输o1的推理模型。
我每次用R1跑完一道题,看着它那个思维链一点点展开,我都会想起他说的那句话。
利润之上的追求。
我以前觉得这话太虚了,像鸡汤。但你看完幻方这五年的操作,你会发现这话一点都不虚,它是真的在用钱和行动填这个坑。
这年头,说漂亮话的人太多了,真往坑里填钱的人太少了。
回到DeepSeek这个工具本身,我的建议是这样。
你今天就下一个App,注册个账号,白嫖。把你想问但舍不得问ChatGPT的问题,全丢给它试一遍。数学题、代码题、合同审查、公文润色、知乎长答、小红书文案,挨个跑。
跑完你就懂我为什么写这篇文章了。
有些好东西,不分享出来我睡不着。

最后想说一句题外话。
我写这篇文章的时候,一直在想一个问题。幻方那帮人,从2019年囤卡开始,到2023年下场做大模型,再到今天DeepSeek被几百万人用,这中间整整六年。六年里他们没怎么吆喝,就闷头干。
梁文锋那次访谈里还有一句话,他说,关键是我们想做这件事,能做这件事,那我们就是最合适的人选之一。
这话听着有点谜之乐观,但你把他这个人的来路一看,又觉得这种乐观是合理的。他2008年就笃信AI会改变世界,那会儿这还是个不被认同的执念。他在成都出租屋里挫败了好几年才切入金融。他那个搞大疆的朋友也是同样疯癫的人。
这帮人不是算计着入场时机的,是天生就在干这事的。
我有时候觉得,真正改变世界的人,都不是那种算计得最精的,是那种最轴的。轴到愿意为一个”利润之上的追求”填六年坑。
DeepSeek这把枪,是幻方在第一幕挂在墙上的。
第三幕,它开火了。
/ 注意,本项目仅在 SyncMein 的500人小群分享。
/ 谢谢你看完了我的文章,我们下次再见吧。
/ 作者:明察
/ 投稿或爆料,请联系邮箱:mingcha@gqmg.com










暂无评论内容