<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>DeepSeek大模型 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<atom:link href="https://lukefan.com/category/deepseek%E5%A4%A7%E6%A8%A1%E5%9E%8B/feed/" rel="self" type="application/rss+xml" />
	<link>https://lukefan.com</link>
	<description>这里是老范讲故事的主站，持续更新 AIGC、大模型、互联网平台、商业冲突与资本市场观察，帮你看清热点背后的底层逻辑。</description>
	<lastBuildDate>Sun, 06 Sep 2026 11:28:28 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1</generator>

<image>
	<url>https://lukefan.com/wp-content/uploads/2026/03/cropped-jimeng-2026-02-28-5245-用图一的人物形象，替换图二中的人物，使用图二的风格。文字替换：老范讲故事，Yo-32x32.jpeg</url>
	<title>DeepSeek大模型 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<link>https://lukefan.com</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>DeepSeek乌兰察布一吉瓦算力中心订单全解析</title>
		<link>https://lukefan.com/2026/09/07/deepseek-huawei-ascend-ulaanqab-data-center/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Mon, 07 Sep 2026 00:30:00 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[华为很厉害]]></category>
		<category><![CDATA[16万枚昇腾推理芯片]]></category>
		<category><![CDATA[1吉瓦算力中心成本]]></category>
		<category><![CDATA[Atlas 950超节点]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[DeepSeek华为芯片订单]]></category>
		<category><![CDATA[DeepSeek算力中心]]></category>
		<category><![CDATA[乌兰察布数据中心]]></category>
		<category><![CDATA[华为昇腾950DT]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=4070</guid>

					<description><![CDATA[DeepSeek乌兰察布一吉瓦算力中心订单全解析

本文拆解DeepSeek乌兰察布数据中心计划，梳理16万枚昇腾950DT推理芯片订单与融资、国产算力投入之间的关系。内容涵盖昇腾950DT推理算力、华为芯片产能与HBM瓶颈、1吉瓦算力中心成本，以及乌兰察布在光缆时延、低温散热、电价和绿电方面的条件；同时对比中国缺芯片与美国受土地、电力、水资源制约的不同处境。文章进一步讨论项目投产时间、未来TOKEN成本、国内智算中心利用率及潜在产能过剩，说明真正需要持续观察的是DeepSeek后续融资、交付能力和算力需求。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-4-3 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="DeepSeek乌兰察布算力中心与16万枚昇腾订单解析!" width="900" height="506" src="https://www.youtube.com/embed/tQp-7_FZhFw?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-huawei-ascend-ulaanqab-data-center/deepseek-huawei-ascend-ulaanqab-data-center-01.jpg" alt="封面采用左右对照构图，左侧为DeepSeek与融资文件，右侧为华为昇腾950DT芯片阵列和乌兰察布算力中心，中间以订单箭头连接；可见事实元素：DeepSeek、昇腾950DT、乌兰察布、推理、1吉瓦、16万枚、2027年底或者2028年年初"/></figure>



<p class="wp-block-paragraph">DeepSeek要在内蒙古乌兰察布部署16万枚昇腾950DT，建1吉瓦算力中心。这其实是在补梁文锋讲话泄露事件的坑。大家好，欢迎收看<a href="https://youtube.com/@storytellerfan" target="_blank" rel="noopener">老范讲故事的YouTube频道</a>。先把事情摆明白：9月4号，彭博发了一条独家报道，DeepSeek要在内蒙古乌兰察布建一座1吉瓦的数据中心，至少安装16万枚华为最新的昇腾950DT。这批卡全部拿去做推理，不做训练。机房要在2027年底或者2028年年初才能够部分投入使用，掏钱的是DeepSeek，供货方是华为，两家都不予置评，工信部也没有回应。</p>



<p class="wp-block-paragraph">彭博社原文并没有写价格，钜亨网按照市面上买家开出来的价格折算了一遍，大概是1.6万美金一颗，16万颗就是25.6亿美金。这个数字要记住，后边还有好多次要用。为什么把这个数单独拎出来讲？因为两个月之前，梁文锋自己讲过另外一个数。7月底流传出来的那份投资者交流会文字稿里，他的原话是：“华为给我们大概也就是16,000张卡的产能，互联网大厂可能有十几万张，我们一万多张。”</p>



<p class="wp-block-paragraph">后边还跟了一句：这一万多张华为950，只相当于4千张英伟达B系列卡，所以不是一个很大的量，意义不是很大。过了两个月，1万6就变成16万了，后边多了一个0。下面要把六件事说明白：第一，这一单到底是在补哪一句话，怎么给前面的泄露打补丁；第二，这块补丁为什么只能用华为来打，华为又能给多少；第三，16万颗到底能顶多少用，这块布够不够大；第四，为什么一定在乌兰察布；第五，美国那边1吉瓦大概是什么价格、什么处境；第六，这件事跟普通人有什么关系。</p>



<span id="more-4070"></span>



<h2 class="wp-block-heading">订单为何成为融资补丁</h2>



<p class="wp-block-paragraph">先把话撂在这里：这一单从头到尾就不只是一个算力生意，它其实是融资后面的一步，也是一个补丁。先说这一单到底补的是什么。那份文稿里最要命的是算力这一块。关于算力，梁文锋讲了两部分。第一部分讲卡从哪里来：我们现在大概有2万张H等效算力，接下来几个月还会有大批量的机器买过来，基本上都是英伟达。讲到华为为什么只肯给16,000张时，他顺口补了半句：“我们可以买一些不合规的卡。”实际意思就是走私。</p>



<p class="wp-block-paragraph">第二部分讲的是华为。他说华为在他心目中的地位就是刚才那句话——意义不是很大；后面还说，买华为950的目的，就是希望帮华为把这块生态做好，把DeepSeek部署到华为的卡上，让华为这套生态补齐。两块连起来听，意思就是：钱主要是给英伟达的，买不到正规的就去走私；华为那16,000张卡，只是顺手帮个忙。这些话出现在一份对外流出的文稿里，就是一个大窟窿。</p>



<p class="wp-block-paragraph">走私英伟达的显卡，不买华为、不支持国产，还说国产卡四张才顶一张、意义不大，这些话都是梁文锋自己说的，道德压力可想而知。后面的事可以按日期来看。7月25号前后，彭博社报道，DeepSeek口头告知部分潜在投资者暂停签署投资协议。这个投资分两步：一步是由国家人工智能产业基金直接投到DeepSeek里，这部分钱肯定拒绝不了，也没有办法叫停；另外一部分就是500亿，其中梁文锋出200亿，腾讯出100亿。</p>



<p class="wp-block-paragraph">实际上，他们成立了一个有限合伙。这个地方就该要去干嘛呢？就是要签字，协议签字，然后要去做交割了，你要开始付钱了。但是谁泄露的，我们就通知你：你不用来签字了，这事跟你没关系了。这个事已经被彭博社给报道了，当时的口径是8月10号在杭州签下第一批，交割日期定在了8月30号。9月4号，彭博就把16万颗昇腾950DT的订单给捅出来了。这两个日子挨得有多近？交割截止8月30号，买昇腾的新闻是9月4号的。</p>



<p class="wp-block-paragraph">那交割了钱，咱们就直接下一单，而且这一单是国产芯片有史以来最大的一单：25.6亿美金。彭博背书，全世界都看着了。再看一眼DeepSeek自己那本账，就明白这一单为什么非下不可了。首先，你要应对的是道德绑架：我不再去走私了，这事咱们再关起门来说行，你拿出去说，第一个，你就不用来签字了，你不用给钱了；第二个，我们就老老实实买华为的不就完了吗？你也甭绑架我。</p>



<p class="wp-block-paragraph">第三个，有一个很重要的事情。没有做过投资、没有做过募资的人可能不知道，基金其实也是个有限合伙。像梁文锋他们做的那个500亿，也是个有限合伙。在这个有限合伙里头，有一个很重要的动作叫call款，就是说，现在你该付钱了。为什么要强调这件事呢？500亿人民币，大概相当于74亿美金。现在他说，你看，我光买芯片需要25.6亿美金，要建机房的话大概需要60亿美金，买芯片的钱大概占整个机房建设成本的40%多一些。</p>



<p class="wp-block-paragraph">所以，我现在这笔钱花出去了，你们这些人赶快往里放钱吧。所以我们叫call款节奏，这些都是必须要考虑的。要把前面梁文锋讲话泄露的这个东西通通都补上。而这一笔金额有交付期的，为什么？因为我们现在要抢芯片，要在2027年年底、2028年年初能够让机器上线的话，那就要付钱了。所以，他一定要把这个事情喊出来。彭博社能够查证的国产芯片订单，是这本账唯一能掏出来给大家摸一摸的一个实物了，这就是补丁。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-huawei-ascend-ulaanqab-data-center/deepseek-huawei-ascend-ulaanqab-data-center-02.jpg" alt="以融资账本为中心，有限合伙、call款、芯片订单和机房建设成本分列四周，用付款箭头展示资金关系；可见事实元素：500亿人民币、74亿美金、25.6亿美金、60亿美金、40%多一些、call款"/></figure>



<h2 class="wp-block-heading">华为产能与16万枚算力</h2>



<p class="wp-block-paragraph">那这块补丁为什么只能补华为呢？华为，你不要去跟AMD、英伟达跟他们去比。在国内所有的这些算力芯片里头，华为就是遥遥领先，这个没有任何问题。老虎不在家，猴子称大王。今年5月21号，黄仁勋在CNBC上公开讲过，公司已经基本放弃中国AI芯片市场了，让给了华为。他的原话是：华为非常非常强大，他们创下了纪录之年，接下来很可能也会是非凡的一年，他们本地那套芯片生态也做得相当好，因为我们撤离了这个市场。</p>



<p class="wp-block-paragraph">同一天的财报会议上，英伟达的CFO确认了一个数：当季没有向中国大陆发出任何一台数据中心的Hopper产品，也就是H200什么都没有发出去过。去年同期这块生意是46亿美金，所以一年从46亿直接降到0了。集邦咨询今年8月份有一份报告，也把这个事情写了一下：2026年中国高端AI芯片出货量预计同比增长了83%，国产份额升到了九成上下；英伟达在中国的份额从2025年的约40%掉到了2026年的约8%。再说卖方，就是华为这头。</p>



<p class="wp-block-paragraph">IDC数过2025年中国AI加速卡的出货量，一共400万张。当时，英伟达是220万张，华为昇腾是81.2万张，第三名是阿里平头哥26.5万张。昇腾这个第二名是第三名的三倍多，所以国产这一边剩下的几家加一块，都没有他们一家多。所以，DeepSeek想下单上国产芯片，只能是买华为的。而且刚才咱们也讲了，他需要去把这个道德颓势给它扭转回来，那买华为的是最好的解决方案。</p>



<p class="wp-block-paragraph">华为这一头，实际上卡在产能上。彭博社给了一个数据：华为昇腾950DT今年的产量可能是小几十万颗，大概不到50万颗。这一单就要吃掉很大一块，16万颗要吃进去，而且交付期在12个月以上。真正的瓶颈还不在华为，而是在内存，也就是HBM。现在买内存、买SSD，都变得奇贵无比。三星、SK海力士和美光就是生产这类产品的，但在国内肯定买不到三星、SK海力士和美光的芯片，那就只能买长鑫存储的芯片。</p>



<p class="wp-block-paragraph">现在长鑫存储已经在做HBM3E芯片，但这个芯片还在验证，没有正式量产，现在这一块才是真正卡脖子的地方。所以，彭博社那条报道里最实在的一句话是，DeepSeek已经请北京出面，希望华为更快、更多地分货给它。DeepSeek有一个投资方是大国资，也就是国家人工智能产业基金。既然国家基金投了DeepSeek，就要帮它解决问题，去催华为。一家公司下单，却要请政府去催供应商，这本身也是一个很有趣的现象。</p>



<p class="wp-block-paragraph">而这一等还要付另外一笔账。因为梁文锋自己讲了，英伟达的卡基本上可以按照5年折旧来算，而华为的卡最多按照3年折旧来算，后面还要再算电费。一张按3年折旧的卡，交付却要等到12个月以后；机房也要到2027年底或2028年才能正式投产。补丁补上去了，可这块布够不够大，不归英伟达，也不归DeepSeek说了算。所以，下面再说这16万枚芯片到底能产生多大的算力。</p>



<p class="wp-block-paragraph">先看彭博社原文里一句很关键的话：这16万枚只占这座机房总算力的一部分，剩下的容量用什么芯片尚不清楚，而且没有排除是英伟达。1吉瓦说的是机房的电，16万颗是机房里的一部分，这两个数从来就不是一回事。要衡量这批芯片，就拿华为自己的尺子来量。华为去年9月公布的昇腾950整套方案叫Atlas 950超节点，由8,192枚芯片、160个机柜组成，占地1,000平米。再往上还有一级，叫Atlas 950超级集群，共使用524,288枚昇腾950。</p>



<p class="wp-block-paragraph">这些芯片不一定放在一个机柜里，而是让它们整个都连接在一起。超节点为什么会存在？就是因为单张卡打不过。打不过怎么办？把卡与卡之间用光纤连起来，让上层软件可以把这些卡当成一台机器来用。华为管这套东西叫“灵衢”。单卡落后两年，就用更多的卡来补，这就是国产算力眼下唯一走得通的道路。16万枚放在这个池子里，还上不了华为的超级集群，只够所需数量的1/3。</p>



<p class="wp-block-paragraph">再用梁文锋自己的换算：他说16,000张华为卡顶4,000张英伟达B系列卡，那么16万张就是顶4万张B系列卡。他还在同一个会议上说过，要训练800B激活参数的模型，需要5万张GB300；如果换成华为950，20万张卡起步。这里的800B是激活参数。现在很多国产大模型都已经达到两点几T的参数，但那是总参数，它们每一次激活的参数一般不超过100B。这次报道出来的16万枚华为昇腾950DT，彭博社已经写明，全部拿来做推理；训练这道题，这一单里一个字都没有提。</p>



<p class="wp-block-paragraph">再看电，这是国产算力里最不好看的一栏。华为的设备想达到英伟达同样的推理能力，耗电量大概是英伟达的2.3倍。这笔账梁文锋自己也算过，而且算得很明白。他认为：“即使我拿到的价格是贵100%或者是200%都无所谓，我依然可以把这个TOKEN的成本降下来。”再往后要回答的是，为什么选择乌兰察布。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-huawei-ascend-ulaanqab-data-center/deepseek-huawei-ascend-ulaanqab-data-center-03.jpg" alt="展示Atlas 950超节点、超级集群与DeepSeek订单的三级数量对照，芯片方块按规模排列，并以光纤连接表现“灵衢”；可见事实元素：Atlas 950超节点、Atlas 950超级集群、灵衢、16万枚、1/3"/></figure>



<h2 class="wp-block-heading">为什么选择乌兰察布</h2>



<p class="wp-block-paragraph">先说乌兰察布在哪里。它位于内蒙古中部，往东南是北京，往西是呼和浩特，四周是大片荒草滩，没有山、没有沟、没有人烟，征地和动土都极快。当地现在有两条直达北京的光缆，时延大概是4.2毫秒。对于机房来说，这一条就是入场券：地点可以离北京很远，但是数据不能离北京远。然后是当地很冷。乌兰察布平均气温是4.3摄氏度，一年里有接近10个月可以直接用外面的冷空气降温，常年的PUE低于1.26。</p>



<p class="wp-block-paragraph">PUE是机房这一行里最要紧的指标之一，指整栋楼的用电除以芯片用电。1.26的意思是，芯片吃一度电，整栋楼总共吃掉1.26度电。北上广深这些机房的PUE大概在1.5左右，也就是多出约50%的电用于空调。再有就是电价：乌兰察布的用户电价是3毛5一度，北上广深的工业用电是7毛上下，相差一半。再往后是绿电。内蒙古风能可开发量约占全国的57%，太阳能约占21%，新能源装机达到1.74亿千瓦，全国头一个数据中心绿电直连示范项目就在乌兰察布。</p>



<p class="wp-block-paragraph">可是，绿电也有绿电的麻烦。风能和太阳能不听话，有风、有太阳的时候，电多得送不出去；没风、没太阳的时候就没电，而机房需要24小时稳定供电，所以这条路后面必须压上储能。内蒙古的源网荷储实施细则把这一条写死了：储能原则上不低于新能源规模的15%，也就是每发100千瓦新能源，必须有15千瓦储能在后面跟着，时长不低于4小时。电池不光有功率，还有时长，这两项必须算清楚。乌兰察布一次性批复了4个源网荷储项目，储能加在一起是1,244兆瓦时。</p>



<p class="wp-block-paragraph">这还只是电池这一头，发电那一头也有一道关。中国电网是五十赫兹，风一会儿吹得快、一会儿吹得慢，那风机怎么能够保证你发出来的一定是五十赫兹？风机叶轮一分钟只转十几转，发电机却需要1,000多转，中间实际上要靠一组齿轮箱加速，把慢速叶片的转动变成发电机的高速转动。但是齿轮箱锁不住频率，因为风速一会儿快、一会儿慢，所以机舱里还要加一套变流器：先把发电机发出来的电变成直流，再逆变成50赫兹交流电，然后经过变压器升压送上电网。</p>



<p class="wp-block-paragraph">现在还有一整条技术路线，干脆把齿轮箱取消，叫作直驱，用一台多极低速发电机配合变流器解决问题，能损坏的部件可以减少一半。所以，“绿电便宜”这四个字，便宜的是每一度电，但是整套供应链体系真的不便宜。而这一整套设备和能力只有中国能凑得齐，全世界任何其他地方都凑不齐。所以，乌兰察布这片草原上早就不止DeepSeek一家。华为、阿里、苹果、快手、百度、字节跳动都在那里建设数据中心，一共有89个数据中心项目。</p>



<p class="wp-block-paragraph">截至今年6月，乌兰察布已经投运加上规划的容量合计达到12.5GW，DeepSeek这1GW只是其中的1/12，并不算特别夸张。9月4号，美国智库新美国安全中心的斯托克斯发了一份报告，主张为了不让中国先摸到通用人工智能，可以考虑外交、间谍网络和动能措施。什么叫动能措施？说得直白一点，就是往中国的数据中心上扔东西，而且报告写明了叫预防性打击。这份报告与彭博社那条新闻是在同一天出来的。再看乌兰察布在哪里：它远离海岸线，位于内蒙古正中间。向南走，隔着整个中国大陆。</p>



<p class="wp-block-paragraph">再往南还有喜马拉雅山和印度大陆，往北走是蒙古以及俄罗斯，往西是新疆，再往外还有整个的西亚地区。你真要进行动能措施的话，中国应该再也找不着比这更安全的地方了。再往后，过了太平洋，美国那边是一个什么样的情况呢？</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-huawei-ascend-ulaanqab-data-center/deepseek-huawei-ascend-ulaanqab-data-center-04.jpg" alt="用平面地图和指标卡展示乌兰察布与北京的光缆联系、低温降温、电价、绿电和储能条件，各指标彼此分区；可见事实元素：乌兰察布、北京、PUE、绿电、源网荷储"/></figure>



<h2 class="wp-block-heading">中美两边的一吉瓦账本</h2>



<p class="wp-block-paragraph">先回答一个最直白的问题：1吉瓦到底是多少钱？英伟达8月26号那场财报会议上，它的CFO和黄仁勋先后各报了一遍这个数字。通用计算那个年代，每吉瓦大概是30亿到50亿美金；到了Hopper，也就是H100H200这个时期，每吉瓦的建设成本是180亿美金。到了Grace Blackwell这个时代，是250亿美金；Vera Rubin，新一代的英伟达算力卡，大概是400亿美金1吉瓦。</p>



<p class="wp-block-paragraph">国内也有一份数据，沐曦股份拆过一笔账：1吉瓦机房4年下来的成本是550亿美金，GPU芯片这一项占45%，电费只占5%。原来咱们老说机房是个电老虎，需要很多很多电，但是这个东西在中国真的不算什么，卡占了接近一半。所以在中国，是卡贵。电呢，我们虽然多烧了2.3倍的电，但是咱们电本身比美国便宜很多，所以基本上可以忽略不计，只要能够把卡钱凑齐了就行了。</p>



<p class="wp-block-paragraph">回到刚才咱们讲DeepSeek16万张卡的这个订单，它这16万张卡本身值25.6亿美金。如果算运营4年，它这个卡的成本占整个成本的45%来算的话，就是50多亿、接近60亿美金的整个机房的运作成本。咱们再强调一下。那美国这边的处境就跟咱们完全是反过来的。他不缺卡，他有的是卡；他缺的是地以及电。Data Center Watch给了一个数字：今年头三个月，至少75个数据中心项目被挡下来或者拖住了，涉及1,300亿美金，摊在49个州。</p>



<p class="wp-block-paragraph">开年头六个星期，各州议会提了300多个跟数据中心有关的法案，14个州的人在提全州禁止建设。反对的头一条理由，大家肯定想不到，不是电，而是水。分析公司Cleanview数过，美国809个规划中的数据中心项目，其中517个落在过去一年持续干旱的区域。原因很简单，你如果这个地方水草丰茂的话，咱种粮食不行吗？美国也好，加拿大也好，都是巨大的农业国，水草丰茂的地方一定要种粮食。所以，它一定会把这个数据中心放在比较干旱的地方，放在荒漠里头。</p>



<p class="wp-block-paragraph">大的那种机房一天最多要喝掉500万加仑的水，相当于是5万人一天的用量。那水拿来干嘛呢？就还是降温。美国机房主流走的是蒸发冷却，它把水放进去以后，直接给蒸发掉了，把热量带走了，一边降温，一边把水蒸干。乌兰察布那10个月不开空调，靠外边冷空气就可以降温的这套东西，绝对能把美国人羡慕死。所以这两边就形成了鲜明的对比。美国是有全世界最好的卡，可是地批不下来，电也不够，水更是不敢用，各个县都在开听证会，说我们不要数据中心。</p>



<p class="wp-block-paragraph">中国这边，地是荒滩，电便宜很大一块。我估计咱们电的价格可能是美国的1/4或者更低，而且气候很冷，不需要上水去进行降温。而且咱们这是基建强国，咱们唯一缺的就是卡，咱们卡不够多，而且卡不够好。那这跟咱们每个人有什么关系呢？</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-huawei-ascend-ulaanqab-data-center/deepseek-huawei-ascend-ulaanqab-data-center-05.jpg" alt="以正面平面信息卡明确分为三个互不混淆的区块；左上为“国内成本口径”，注明“沐曦股份”，放1吉瓦机房4年成本550亿美金、GPU芯片45%、电费5%，以及卡贵、电价较低、冷空气降温的简短标签"/></figure>



<h2 class="wp-block-heading">普通人的TOKEN与下一轮融资</h2>



<p class="wp-block-paragraph">第一条最直接，就是DeepSeek现在它的TOKEN变得很贵，特别是上班高峰期的时候，那个TOKEN非常非常贵，导致了DeepSeek的用量一下就掉了90%多。它这一套的算力如果能够建设起来的话，整个的TOKEN成本就会降下来。但是，这个要到2027年年底、2028年了。等到那个时候，我估计我们已经不是在用DeepSeek V4了。可能已经用上DeepSeek V5了，所以这个是一个跟普通人有关的事情。</p>



<p class="wp-block-paragraph">剩下的可能是什么？这个事情更大的关系，可能就是DeepSeek看看是不是再融下一轮，融完下一轮，明年2027年是不是跑去科创板上个市去。现在在中国建机房，其实已经开始有过热的趋势了。咱们现在AGI还没边呢，怎么就过热了呢？腾讯云的张晋今年在上海讲过，国内智算中心的GPU平均利用率不足30%，机柜利用率在20%到30%之间。</p>



<p class="wp-block-paragraph">中国信通院给的另外一组数据：2025年国内智算的供算量大概是38亿卡时，就是卡乘小时，真正用掉的只有14亿卡时，用算占比36.8%。卡时就是一个卡跑一个小时这样的一个算力。机房盖起来是一回事，转起来是另外一回事。全国已经有一大批的机柜亮着灯等活干，没有那么多的TOKEN让它跑。怎么能够把现在已经建好的这些机房用起来？或者等到DeepSeek真的把这机房建好了以后，我们又产能过剩了，又该进行供给侧调整了，这个也都难说的事。</p>



<p class="wp-block-paragraph">回到开头那句话，DeepSeek这两个月从1.6万张卡加了一个0，变成16万张卡，实际上就是在补这一次融资的坑。补丁补得很快，是因为他本来就要给外边看这个东西：你不要道德绑架我，不要说我去走私英伟达，不要说我不支持华为，咱来了。华为供不上货是你的问题，跟我有啥关系？所以以后咱们盯着的不是这16万张卡，是明年这个时候DeepSeek是不是在进行下一轮融资，他这一轮融资是不是call款都call得很顺利，都把它拿到手了，然后下一轮是不是继续做下去。这才是咱们真正要去看的东西。</p>



<p class="wp-block-paragraph">好，今天这个故事就讲到这里。感谢大家收听，请帮忙点赞、点小铃铛、参加<a href="https://discord.gg/ppKsNkttTv" target="_blank" rel="noopener">Discord讨论群</a>，也欢迎有兴趣、有能力的朋友加入我们的<a href="https://www.youtube.com/channel/UCUGLhcs3-3y_yhZZsgRzrzw/join" target="_blank" rel="noopener">付费频道</a>。再见。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<h2 class="wp-block-heading">背景图片</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-huawei-ascend-ulaanqab-data-center/background_1.jpg" alt=""/></figure>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>梁文锋投资者会议泄露与融资迷局</title>
		<link>https://lukefan.com/2026/07/27/liang-wenfeng-deepseek-investor-meeting-analysis/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Mon, 27 Jul 2026 00:37:25 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[DeepSeek开源商业模式]]></category>
		<category><![CDATA[DeepSeek投资者会议]]></category>
		<category><![CDATA[DeepSeek算力家底]]></category>
		<category><![CDATA[DeepSeek融资]]></category>
		<category><![CDATA[DeepSeek融资暂停原因]]></category>
		<category><![CDATA[梁文锋]]></category>
		<category><![CDATA[梁文锋四小时访谈]]></category>
		<category><![CDATA[梁文锋投资会]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3951</guid>

					<description><![CDATA[梁文锋投资者会议泄露与融资迷局

梁文锋四小时投资者闭门会议文字稿，真正值得看的不是“朴实人设”，而是DeepSeek卡量、合规采购、成本回收、融资结构与技术路线暴露出的现实约束。本文完整拆解DeepSeek融资暂停意味着什么：从2万张H等效算力、16,000张华为950与四比一折算，到开源模型商业逻辑、150B激活参数计划、中美算力差距和CUDA国产生态；同时区分有限合伙、510亿元入股、后续融资上市三段流程，分析文件为何在两个月后泄露，以及梁文锋所说“克制”为何必须放回投资人会议场景理解。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="梁文锋四小时投资会泄露：投资人为何集体沉默？" width="900" height="506" src="https://www.youtube.com/embed/H7zEWI4997o?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/liang-wenfeng-deepseek-investor-meeting-analysis/blog_1.jpg" alt="梁文锋站在闭门投资会议屏幕中央，四周环绕投资机构头像、芯片数量、融资文件与外泄箭头，中心辐射式构图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">梁文锋的4小时投资者访谈泄露，到底说了什么敏感信息，导致他们停止第二轮融资？</p>



<h2 class="wp-block-heading">四小时闭门会议与文字稿来源</h2>



<p class="wp-block-paragraph">这两天网上在传一份文件，叫做“梁文锋投资者交流会录音文字稿”。这份文字稿应该是5月20日录的，隔了两个月突然传出来。它对应的是一场闭门投资者会议：DeepSeek成立以来第一轮对外融资，准备投钱的投资人与梁文锋做了一次集体沟通，应该是一场Zoom会议，每家机构出两个人，总时长约3小时44分钟，因此外界通常四舍五入称为“四小时访谈”。</p>



<p class="wp-block-paragraph">文件应该在7月16日流出，7月下旬开始大规模传播，从开会到外泄相隔大约两个月。流传形态是一份42页PDF，完整版正文约35,000字，包含118个问题，形式非常口语化，基本是一问一答。因为原稿实在难读，我看的是总结版。原始录音至今没有在公开网络上出现。PDF开头虽然写着音频文件名“deepseek 0520.m4a”，但那是整理者描述自己手上的素材，并不代表音频随文字稿一起流传。网上能找到的都是文字稿。有些人以为自己听过录音，是因为网上确实出现了一些音频，但那是用口播稿重新让AI配的音，并非现场原始录音。</p>



<p class="wp-block-paragraph">这份文件到底是不是真的？如果它完全是假的，后面的讨论就没有意义。7月23日，《每日经济新闻》拿着这份实录，向参与投资DeepSeek的机构核实，得到的回应是这场闭门会议确实在当年5月召开，内容属实。因此，这件事值得继续讨论。</p>



<p class="wp-block-paragraph">随后又传出消息，说梁文锋因为三令五申不能外传的信息被泄露而生气，不再做第二轮融资，部分投资人不用继续接触，一些投资协议不再签字，IPO筹备也一并搁置，同时要求团队重新评估信息披露流程和投资人沟通机制。相关报道也说这不是最终结果，未来仍可能重启。不过，尽管有多家报道，梁文锋本人和DeepSeek官方都没有发布消息。</p>



<p class="wp-block-paragraph">这件事要分三部分看。第一，稿件到底泄露了哪些真正敏感的信息。很多解读都在谈梁文锋如何朴实、如何克制，或者谈中美关系，但最应该先看的，是哪些不该外传的信息被说了出来。第二，再沿着商业、组织、技术和中美算力四条线，梳理完整内容。第三，分析为什么偏偏在这个时候泄露，以及所谓“第二轮融资泡汤”究竟意味着什么。会议5月召开，文件7月泄露，这个时间差本身就需要解释。</p>



<span id="more-3951"></span>



<h2 class="wp-block-heading">卡量、合规与算力家底</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/liang-wenfeng-deepseek-investor-meeting-analysis/blog_2.jpg" alt="会议主持人举起保密提示牌，旁边的梁文锋面前摆着华为950和英伟达芯片堆，屏幕显示16,000与2万张两个醒目数字，左右对照构图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">先说敏感信息。会议主持人曾提醒，梁文锋讲了很多比较敏感的信息，请大家千万不要外传一些数字和情况，包括卡量，也千万不要录屏后对外分享。投资时尤其是股东很多时，创始人通常要向大家讲公司在做什么并回答问题。这种会议一般有主持人，可能是负责融资的律师，也可能是FA，也就是投融资顾问。主持人特意点出“卡量”，说明现场已经有人意识到这场会讲过头了。</p>



<p class="wp-block-paragraph">梁文锋谈华为卡时说：“华为950，华为给了我们16,000卡，这个应该可以公开说吧。”关键就在“应该可以”四个字，他自己也拿不准。反过来说，其他数字在他心里显然更不能公开。整个四小时里，他一直在判断哪句话能说，哪句话不能说。</p>



<p class="wp-block-paragraph">第一类最不能说的信息是合规风险。他说，华为也只能给DeepSeek这么多卡，因为价格也不便宜，互联网大厂的需求更大；对DeepSeek来说，“我们可以买一些不合规的卡”。所谓“不合规的卡”，这里的解读就是通过非正常渠道购买英伟达卡。这类话当然不能对外说。</p>



<p class="wp-block-paragraph">第二类是DeepSeek的算力家底。自DeepSeek R1发布以来，外界一直在猜它到底有多少卡。梁文锋说，公司现在大约有2万张H等效算力，其中大部分是最近一两个月刚到，可能还有许多机器尚未到货，未来几个月还会大批量购买，基本都是英伟达。问题随之而来：这些机器从哪里来，中国是否获批进口H200，实际买到的又是什么？</p>



<p class="wp-block-paragraph">他还讲了华为卡配额与互联网大厂的差距：华为给DeepSeek 16,000张卡的产能，而互联网大厂可能是十几万张，DeepSeek只有一万多张。16,000张华为950折算后大约相当于4,000张B系列，也就是四张华为950约等于一张B300。再加上算力天花板：现在最大的模型，DeepSeek其实训练不起，哪怕把500亿美元全花掉也可能训不起，即使能堆起来也用不起。这几项合在一起，几乎构成了一份可以验算的算力资产负债表。</p>



<p class="wp-block-paragraph">梁文锋也表示愿意购买更多英伟达卡，愿意接受溢价，甚至接受一些不太合规的方式。把卡量、到货时间、采购对象、折算比例、预算上限和采购意愿放在一起看，就知道为什么泄露非常敏感。</p>



<h2 class="wp-block-heading">十个月回本与年度采购策略</h2>



<p class="wp-block-paragraph">再往后是运营方式。他说DeepSeek只需要赚6倍利润，但这“6倍利润”没有其他数据佐证，所以不清楚成本口径是什么。他又说10个月收回成本：无论机器多少钱买来，只要API收入能在10个月内挣回机器钱，公司就能打平并盈利。与此同时，他还点出竞争对手的成本，认为DeepSeek自己能做到10个月回本，其他人做不到；阿里、腾讯没有DeepSeek的优化能力，成本会高好几倍。有人曾用B300部署DeepSeek V4 Pro，发现成本非常高，比DeepSeek自己的报价高很多，因此DeepSeek在优化上确实做了更多工作。</p>



<p class="wp-block-paragraph">年度采购规模同样敏感。梁文锋说，如果今年能花掉200亿，就算采购部门业绩超级好；他会要求采购部门尽可能买，把200亿美元变成英伟达卡。如果能把钱变成卡，公司会毫不犹豫地把所有钱都变成卡，并愿意为此支付一定溢价。这里最核心的就是“我愿意加价”。按照这段解读，所谓溢价不是美国政府征收的税，而可能是卡经由东南亚或其他渠道转手带来的额外成本。</p>



<p class="wp-block-paragraph">另一类敏感内容，是对同行、合作伙伴和投资人的评价。闭门投资会里谈竞争生态很常见，但这些话同样不能公开，因为容易得罪人。梁文锋先谈智谱，认为智谱的开源和DeepSeek不同：DeepSeek从第一天就开源，而智谱更像被迫开源，因为别人都开源了，只能跟进。百度文心一言和Kimi原来也不是开源，后来也转向开源。</p>



<p class="wp-block-paragraph">谈到字节，他说字节的模型闭源，但闭源有什么好处，他看不出来。谈到阿里和腾讯，他认为两家的成本会比DeepSeek高好几倍。他还认为国内做模型的公司太多，美国可能也就谷歌、OpenAI和Anthropic三家，即便如此资源仍然分散，某种程度上也是浪费；国内未来可能也只剩三家，不需要这么多模型公司。</p>



<p class="wp-block-paragraph">谈到华为，他一边说要帮助华为把生态做好，一边在卡量折算后说这“不是一个很大的量，意义不是很大”。DeepSeek手里最多的卡仍然是英伟达，新买的也基本都是英伟达；华为就是16,000张，后面未必会继续采购。他还谈到折旧，认为华为卡最多按三年折旧：华为950今年用还不错，明年也能将就，之后再用可能就太费电。这并不是说第三年卡就报废，而是华为自身也在快速迭代，可能很快做出5纳米卡；现在的950应该是等效7纳米，如果后续有等效5纳米或3纳米的卡，950的能耗就显得太高，使用新卡反而更划算。</p>



<p class="wp-block-paragraph">最后他还说英伟达在“自掘坟墓”，后面会详细解释。总之，这些敏感信息泄露后，很多合作伙伴确实很难再见面。如果未来美国政府指责DeepSeek通过非正常渠道获得卡来训练新模型，公司就难以辩解，因为文字稿里不仅承认购买“不合规的卡”，还说最近两个月新到了一批卡，希望把200亿美元都花掉，只要能把卡买回来就愿意接受溢价。再加上对合作伙伴的直接点评，即便英伟达的黄仁勋有时来见梁文锋，双方见面也会变得尴尬。这次确实露底太多。</p>



<h2 class="wp-block-heading">开源不是情怀而是竞争策略</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/liang-wenfeng-deepseek-investor-meeting-analysis/blog_3.jpg" alt="一座标有开源的低收费桥梁通向AI市场，另一侧OpenAI与Anthropic站在高价城堡中，DeepSeek用较少筹码吸引用户过桥，横向竞争构图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">接下来梳理会议的完整内容。第一条主线是商业上的克制：梁文锋不惦记做腾讯，也不惦记做字节，只挣自己的钱。开源虽然赚得少，他仍坚持开源，但原因不是抽象情怀，而是算账后认为这样最划算。梁文锋做量化出身，量化背景的人更习惯计算，只要账算对了，就会往前做。</p>



<p class="wp-block-paragraph">他认为未来AI会非常火，可能占全人类社会GDP的10%甚至更多。如果有人想把市场全部吃掉，例如OpenAI想垄断，其他人一定不会乐意。会有人拿出更便宜的产品，说自己只吃一半；再有人说只吃十分之一。在这种竞争中，DeepSeek可以找到一个既能盈利、又拿得最少的平衡点，从而赢得竞争。OpenAI、Anthropic若想把市场全部吃下，就很难和这种策略竞争。</p>



<p class="wp-block-paragraph">梁文锋也不介意别人拿DeepSeek模型自行部署。别人可以部署，但部署后的优化未必有DeepSeek好，最后仍可能回来使用DeepSeek的服务。这是他的一个核心判断：开源、少拿和极致优化可以共同构成商业竞争力。</p>



<h2 class="wp-block-heading">一半正式任务与一半自由研究</h2>



<p class="wp-block-paragraph">第二条主线是组织和人才观。融资的目的首先是迅速稳定团队，因为此前人才被挖走太多。融资后，员工期权有较高价值，他们就更愿意留下来工作。公司没有KPI，也从来不加班，背后有两个原因。</p>



<p class="wp-block-paragraph">DeepSeek内部有两种任务。一种是正式任务，自上而下分配，例如要发布DeepSeek V4，团队就按分工完成工作。另一种是自下而上的任务，不由上级安排，员工想研究什么就研究什么，也没有前置要求。谷歌过去曾有“20%时间”，允许员工拿20%的时间做自己的项目，后来这项制度也难以维持。DeepSeek则是一半一半：一半时间完成上面交代的任务，一半时间自由研究。</p>



<p class="wp-block-paragraph">不加班的第一个原因，是研究需要松弛环境，逼得太紧就做不了研究。第二个原因非常现实：公司足够聚焦，做的事情很少。视频和多模态即使是好生意，也不在DeepSeek的目标路径上。事情少了，自然不需要加那么多班。这种组织方式和技术路线中的“克制”是一致的。</p>



<h2 class="wp-block-heading">从语言模型走向奇点与具身智能</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/liang-wenfeng-deepseek-investor-meeting-analysis/blog_4.jpg" alt="六级阶梯依次标注语言模型、CoT、Agent、持续学习、奇点、具身智能，一个DeepSeek研究员沿最省力路线向上行进，阶梯式构图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">第三条主线是技术路线和下一代模型。梁文锋把路线分成几个阶段：第一代是语言模型；第二代是思维链，也就是推理，DeepSeek R1对应CoT；第三代是Agent智能体；第四代是持续学习；第五代是自我迭代的奇点；最后才是具身智能。</p>



<p class="wp-block-paragraph">这个顺序很有意思。DeepSeek现在肯定在做智能体，但梁文锋认为真正的下一代模型应该具备持续学习和自我迭代，因此DeepSeek V4并不是他眼中的下一代模型，后面还会训练新的模型。</p>



<p class="wp-block-paragraph">为什么具身智能放在最后，而不是先做？他的判断是，跨过奇点之后，AI的算力和能力已经快速提升，很多现在做起来很累的事情，到时会变得容易。因此整个思路是用最省力、水到渠成的方式做研究。如果还没有走到前面的奇点，就直接做具身智能、物理模型或世界模型，会非常累。</p>



<p class="wp-block-paragraph">有人问奇点是什么、哪天到。梁文锋回答，它可能不是一个明确时刻，而是渐进过程，是小步快跑的状态。有人继续问是否存在某个临界点或特定标志，他补充说没有临界点，但过程也是非线性的。也就是说，没有一个里程碑事件能宣告奇点已经跨过，但发展又不是一条平顺直线，也可能出现跳跃。</p>



<p class="wp-block-paragraph">他的原话是，这条路线图最轻松，因为每一步需要做的新东西都很少，因此可以不用加班；如果路线反过来，先实现具身智能，就会很累，是一件苦活。奇点之后再做具身智能，可能都不用DeepSeek自己做，模型自己就能做出来。别人排列技术路线时考虑的是“什么最重要”，他排列时考虑的是“怎么干最省劲”。这与前面所说的不加班、正式任务不超过一半形成呼应。</p>



<p class="wp-block-paragraph">视频方面，他说Sora出来以后，大公司、小公司都在做视频，但现在做视频的小公司很多已经失败。视频与智能上限没有关系，商业上却是好生意。DeepSeek不会因为它是好生意就做，只会因为它处于智能路线图上才做；既然视频不在这条路线上，公司就不做。多模态则被定位为组件，不会像Gemini 3.1 Pro那样直接原生训练进模型，而会作为模型外部挂载的组件，因为它同样与核心智能路线图关系不大。</p>



<h2 class="wp-block-heading">Scaling、数据标注与模型参数</h2>



<p class="wp-block-paragraph">谈到scaling law，也就是不断放大模型以获得更好结果，梁文锋的态度很明确。硅谷说scaling到头了，那只是对硅谷而言；对中国团队来说，离极限还远，根本没有scaling到那个程度。DeepSeek训练当前规模的模型，不是因为判断这么大已经够用，而是手上刚好只有这么多资源。阻止它继续scaling的不是技术判断，而是卡。这句话是理解整场会议的一把钥匙。</p>



<p class="wp-block-paragraph">数据方面，他说DeepSeek一半核心研究人员在标数据。中美数据标注成本没有什么区别，中国在标注数据上并没有成本优势，尤其是高端数据。美国早期可以找非常便宜的人标数据，例如OpenAI曾让非洲人员参与；但后期要标科研论文等高端内容，一般人员看不懂。现在美国有创业公司专门找科学家标数据，只有把这些数据放进模型，模型才会变得更聪明。</p>



<p class="wp-block-paragraph">国内为什么经常蒸馏美国模型？因为没有足够多的科学家标这些高端数据。DeepSeek的选择仍是从头标注，只有这样才能得到最适合自己的数据，真正让模型变聪明。</p>



<p class="wp-block-paragraph">他随后谈到中国开源模型的规模，说现在基本都是50B模型。这里必须区分总参数和激活参数。大家常听到1.6T、2.8T，那是总参数；模型每次执行任务时实际激活的参数大约只有50B，也就是500亿。梁文锋准备在年底前训练出一款激活参数达到150B的新模型。过去不做，根本原因还是没有卡：即使模型做出来，150B激活参数也跑不起来。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/liang-wenfeng-deepseek-investor-meeting-analysis/blog_5.jpg" alt="DeepSeek V4 Pro、Kimi K3、GLM-5.2、MiniMax M3和千问模型化作大小不同的积木，分别展示总参数与激活参数标签，数据对比表式构图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">当前大体情况是：DeepSeek V4 Pro总参数1.6万亿，也就是1.6T，激活参数49B，约490亿，接近所谓的50B。Kimi K3总参数2.8万亿，也就是2.8T，被称为全球最大的开源模型，但每次激活同样是50B，与DeepSeek V4 Pro接近。GLM-5.2总参数744B，不到1T，每次激活40B。MiniMax M3总参数428B，规模更小，每次回答问题激活23B，是其中最省的一款。</p>



<p class="wp-block-paragraph">千问3.8是个大家伙，总参数2.4T，每次执行任务可激活350B，是目前国内最大的模型。不过当前发布的是Max预览版，官方说正式发布后会开放权重，但当时尚未开放，要等开放后再看。因此，除了尚未开源的千问3.8，国内模型的激活参数基本都在二十几B到50B之间。梁文锋计划年底前推出每次激活150B的模型，这会带来巨大提升。</p>



<p class="wp-block-paragraph">美国模型有多大，因为它们不开源，没有明确数据，只能由外界反推估算。有人估算GPT-5.5总参数量约9T，激活量可能达到800B；Claude Opus 4.7总参数量约4T，激活量则不确定。这些只是估算，对方不会正式承认或否认。</p>



<p class="wp-block-paragraph">梁文锋认为，这种差距归根结底还是卡。要训练与OpenAI同样大的模型，大约需要5万张GB300；如果换成华为950，就需要20万张，仍然是1比4的关系。再对照前面的两个数字：DeepSeek手里有2万张H等效，华为给了16,000张卡，所以目前仍训练不出OpenAI或ChatGPT那样规模的模型。这也解释了他为什么说，即使把500亿美元全花掉，可能仍训练不起。</p>



<p class="wp-block-paragraph">因此，DeepSeek的战略并不是立刻在最大规模上与美国竞争，而是在自己训得起、用得起的范围，也就是几十B激活参数的规模上先做到最好。</p>



<h2 class="wp-block-heading">中美算力差距与国产生态</h2>



<p class="wp-block-paragraph">谈中美差距，梁文锋的看法也很直接：差距主要是算力和资源，人本身几乎没有差距，因为本来就是同一批中国人，有人留在国内，有人去了国外。并不是更聪明的人都去了国外，选择过程相对随机。国外团队做出的东西显得更好，是因为手里有更多卡；国内人才没有那么多卡，许多实验根本做不了，于是外界会觉得国外的人更强。</p>



<p class="wp-block-paragraph">他认为中国当前大约落后美国两年，而DeepSeek只用了美国二十分之一的算力做出现在的结果。这个叙事是“落后一到两年，但只用了二十分之一的算力”。未来希望改写叙事：仍只使用对方几分之一的算力，却把时间差缩短到6个月、3个月。</p>



<p class="wp-block-paragraph">梁文锋也承认存在天花板。在总体算力仍有数量级差距的情况下，全面超越并不现实；但在一些经过取舍的重点方向上实现超越，他认为是可能的。</p>



<p class="wp-block-paragraph">对国产算力，他相对乐观，认为英伟达CUDA的护城河正在快速瓦解，理由有三个。第一，有了AI，建立生态比过去容易得多，因为AI可以写代码。第二，出现了新的高级语言TileLang，用这种高级语言写CUDA算子，可以较快地重写英伟达整套生态，再结合AI，看起来没有太大障碍。TileLang应该是北京大学的一批人与DeepSeek合作做出的新编程语言。</p>



<p class="wp-block-paragraph">第三，CUDA本身从游戏卡演变而来。英伟达早期核心业务是游戏，因此CUDA留下了许多历史包袱，想全部扔掉重来并不容易。CUDA已经是相对较旧的架构，如果从头重写一套，没有历史包袱，可能反而更高效。</p>



<p class="wp-block-paragraph">因此他才说英伟达在“自掘坟墓”。但他的立场仍然非常现实：并不是一定要自己造卡，只要能以相对合理的价格买到卡，他就不造。如果英伟达愿意痛快把卡卖给DeepSeek，他也不会去用华为；英伟达不卖，DeepSeek就只能溢价买卡，同时把国内生态搭起来。</p>



<h2 class="wp-block-heading">为什么在两个月后泄露</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/liang-wenfeng-deepseek-investor-meeting-analysis/blog_6.jpg" alt="一条从5月20日闭门会议延伸到7月文件外泄的时间轴，沿途出现Kimi K3、GLM-5.2、科技股下跌和焦虑投资人，时间线构图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">再往后看，为什么这份文字稿在7月泄露？5月20日会已经开完，该签的协议也已经签了，7月再把内容放出来，到底图什么？事情不会无缘无故发生，需要看7月出现了哪些变化。</p>



<p class="wp-block-paragraph">第一，DeepSeek本身没有外界原来想象得那么领先。原先DeepSeek聚集了全中国的期待，后来人们发现它似乎并没有达到那样的领先程度。第二，投资人很着急。梁文锋这个项目的做法很不正规：他自己出200亿元成为领投方，协议也由他自己写。其他投资人把钱放进去后，自然会问什么时候上市、什么时候融下一轮、投资怎样翻番，但这些事别人都说了不算。在这种情况下，可能有人想给梁文锋施加一点压力。</p>



<p class="wp-block-paragraph">第三，Kimi K3出来了，又出现了新的“DeepSeek时刻”。它有2.8T参数，每次激活50B，效果很好，甚至又带来美国股市震动。另外还有GLM-5.2，在各种评分上比DeepSeek V4 Pro更强一些，尤其是编程方面。投资人面对这些变化，也要向自己的老板和LP解释，证明自己没有当冤大头、这笔钱投得值。再加上近期科技股整体回调，一定有人承受压力。把这些反常因素放在一起，才更容易理解泄露动机。</p>



<h2 class="wp-block-heading">所谓第二轮融资究竟停在哪里</h2>



<p class="wp-block-paragraph">那么，所谓“第二轮融资泡汤”到底是什么意思？整个融资可以分成三段。</p>



<p class="wp-block-paragraph">第一段是成立有限合伙。梁文锋出资或承诺出资200亿元人民币。除了国家人工智能产业基金，其他外部投资人都进入有限合伙。在这个有限合伙中，梁文锋是GP，即普通合伙人，其他出资者是LP，即有限合伙人。LP有出钱、最后分红和中间查账的权利，却没有决策权；决策权只掌握在梁文锋手中。</p>



<p class="wp-block-paragraph">第二段才是真正向公司投资：有限合伙的500亿元人民币，加上国家人工智能产业基金的10亿元人民币，共计510亿元人民币，一起投进公司。</p>



<p class="wp-block-paragraph">第三段是在这一轮结束后，大家期待再融一轮，然后推动上市。所谓“停”，到底停的是哪一段？中间这轮不太可能停，因为国家人工智能产业基金已经签字，整套安排很难被改动。现在首先可以确认的，应该是第三段，即后续融资和上市安排停下来了。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/liang-wenfeng-deepseek-investor-meeting-analysis/blog_7.jpg" alt="三层融资漏斗依次标注有限合伙500亿元、产业基金10亿元与公司入股510亿元、后续融资上市，第三层被暂停标志截断，纵向流程构图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">原因也很简单。梁文锋所说的200亿元并没有完全实缴，而是承诺出资。例如他可能先出20亿元，其他人也先出10%，之后大家随时按比例继续投入。如果真要上市，就必须实打实把200亿元放进去，这对梁文锋也有压力。</p>



<p class="wp-block-paragraph">上市还有一个关键环节是审计。如果公司需要付溢价购买“不合规的卡”，这件事怎么通过审计？因此，第三段投资和上市应该都要暂停，尤其是不合规问题不处理干净，上市流程根本无法推进。</p>



<p class="wp-block-paragraph">第一段也有可能部分暂停。有限合伙协议可以在较长周期内慢慢签，一点点把钱放进来，甚至有一年时间完成。按照这里的说法，从有限合伙开始组建起，一年之内把钱凑齐即可成立，期间随时可以有人进入、有人退出，也可以不再与某个投资人签约，改让其他人进来。如果一年后没有凑齐，就要解散，把其他人的钱还回去。这里也不等于所有人已经把全部资金放在账户里，而是承诺出资。</p>



<p class="wp-block-paragraph">在这个过程中，如果梁文锋确认了是谁泄露消息，他可以拒绝与这些人签有限合伙协议，也就是不要这个投资人，换另一个人。以后如果出现某家机构被踢出局的新闻，被踢出局的一方很可能会被认为是放出消息的人。</p>



<p class="wp-block-paragraph">目前，梁文锋本人和DeepSeek官方既没有辟谣，也没有确认。这反而是一种常见处理方式，因为无论说真还是说假，都可能让风波继续传播。想让事情尽快过去，最有效的办法可能就是什么也不说，仿佛它没有发生。</p>



<h2 class="wp-block-heading">三个可验证判断与正确读法</h2>



<p class="wp-block-paragraph">最后，应该怎样看这份文件？它值得读，但要读对地方。真正有价值的首先是“拿得多的会被拿得少的打败”这一利润博弈逻辑：只要坚持开源、拿得少，就可能击败想拿得更多的人。这是一种非常朴实的竞争方式。</p>



<p class="wp-block-paragraph">第二个有价值的内容，是从语言模型到CoT推理模型，再到Agent、持续学习、奇点爆发，最后到具身智能的技术阶梯。这套排序把“最省力的路径”置于“最热门的方向”之前，值得思考。</p>



<p class="wp-block-paragraph">第三个是“4倍加2年”的国产算力标尺：四张国产卡约顶一张最先进的英伟达卡，中国与美国相比仍落后约两年。不要简单说只差6个月，或者已经追上，差距仍然不小。这三个判断可以拿去使用、验证甚至下注，其他很多内容更像包装。</p>



<p class="wp-block-paragraph">还要特别提醒，不要把这份文字稿当作简单的人设材料。不能因为一个人说过某句话，就断定他一定是坏人；也不能因为他说过另一句话，就断定他一定是好人。必须先想清楚这是什么会：这是一场投资会，而且是一场极其不平等的投资会。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/liang-wenfeng-deepseek-investor-meeting-analysis/blog_8.jpg" alt="天平一侧是掌握选择权的梁文锋与DeepSeek列车，另一侧是拿着资金却焦急等待的投资人，背景放置名声与回报两个路牌，强弱关系构图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">梁文锋所处的位置近似于：现在开放融资，需要钱的投资人愿意来就来，不愿意来就走。这体现了“形势比人强”。融资者如果求着别人给钱，就会说投资人爱听的话；但如果自己不缺钱、反而有资格挑投资人，就会审查谁的钱能要，谁愿意听话配合，再决定是否接受。</p>



<p class="wp-block-paragraph">放在这个环境下再看梁文锋说的话，还要理解投资人的诉求。投资人没有抽象情怀，目的就是挣钱：今天把钱给出去，多长时间能翻多少倍，什么时候能上市，或者能不能借DeepSeek的名声继续募资。</p>



<p class="wp-block-paragraph">梁文锋所说的“克制”，是在告诉投资人不要惦记快速挣钱，也不要惦记短期上市。投资人能站上DeepSeek这趟车，就已经得到名声，可以再去募资。他愿意把名声分给投资人，但投资人不要马上从DeepSeek这里索取更多实际利益。至于梁文锋真正工作时是否也如此克制，并不一定；因为这些话本来就是他在特定投资场景里对投资人说的。</p>



<p class="wp-block-paragraph">所以，面对流传出来的各种信息，正确的解读方式至少有三步：第一，判断它是真是假、从哪里来；第二，想清楚它为什么会来到自己面前；第三，思考说话的人在当时场景里为什么这样说，他想达到什么目的。这才是理解梁文锋四小时投资会议访谈的关键。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<h2 class="wp-block-heading">背景图片</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/liang-wenfeng-deepseek-investor-meeting-analysis/background_1.jpg" alt=""/></figure>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>华为天才少年被质疑抄代码，DeepSeek面试翻车，谁的错？</title>
		<link>https://lukefan.com/2026/07/09/deepseek-li-bojie-interview-controversy/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Thu, 09 Jul 2026 00:45:16 +0000</pubDate>
				<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[DeepSeek不看简历面试]]></category>
		<category><![CDATA[DeepSeek招聘争议]]></category>
		<category><![CDATA[DeepSeek面试抄代码]]></category>
		<category><![CDATA[Pine AI首席科学家]]></category>
		<category><![CDATA[华为天才少年争议]]></category>
		<category><![CDATA[基座模型公司harness agent]]></category>
		<category><![CDATA[李博杰]]></category>
		<category><![CDATA[李博杰面试DeepSeek]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3898</guid>

					<description><![CDATA[华为天才少年被质疑抄代码，DeepSeek面试翻车，谁的错？
DeepSeek招聘乱象：华为天才少年被羞辱，拿到融资后别这样扩张！
华为天才少年被羞辱，DeepSeek面试争议背后，暴露3个错配！

DeepSeek面试争议不只是一次候选人冲突，而是折射出AI公司快速扩张中的招聘体系问题。本文围绕华为天才少年李博杰面试DeepSeek、被质疑抄代码、研发与工程岗位错配、外部融资后团队搭建等关键线索，分析为什么明星标签不能替代能力判断，为什么DeepSeek招聘流程会引发争议，以及AI大模型公司在搭建harness agent团队时可能埋下的组织风险。通过这起事件，也能看清技术人才、投资人和公司之间的预期错配。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="华为天才少年被质疑抄代码，DeepSeek面试翻车，谁的错？" width="900" height="506" src="https://www.youtube.com/embed/LQ1eDafXiYU?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_1.jpg" alt="两块写着“华为天才少年”和“DeepSeek”的金色招牌在热搜榜屏幕前相撞，旁边散落简历、代码纸和放大镜，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">华为天才少年吐槽，面试 DeepSeek 被羞辱。不是面试官坏，而是 DeepSeek 拿了钱之后，估计要开始走弯路了。</p>



<p class="wp-block-paragraph">一位前华为天才少年李博杰，去面试 DeepSeek 二面的时候，被面试官指责抄代码：“你要是不能证明你没抄，面试就没法继续了。”他觉得被羞辱，当场终止面试并发帖曝光。第二天，这事冲上微博热搜榜第二。</p>



<p class="wp-block-paragraph">当天下午，剧情反转。一位知名投资人下场手撕这位华为天才少年，说他拿了投资就失联，是自己见过的最没有契约精神的创始人。而李博杰也连夜反击，说这个投资人说好了给 150 万美金，结果只打了 50 万，导致项目失败。</p>



<p class="wp-block-paragraph">一边是华为天才少年，一边是号称理想主义、国运级 AI 大模型的 DeepSeek，两块金字招牌砸在一起，一天之内就冲上热搜。</p>



<h2 class="wp-block-heading">先说结论</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_2.jpg" alt="三张写着“title”“公司光环”“完美机构”的标签被放在显微镜下审视，旁边有碎裂的偶像小雕像和警示路标，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">先把结论放在这里：</p>



<ol class="wp-block-list">
<li><strong>不要迷信任何 title 和标签。</strong></li>



<li><strong>不要把华为、DeepSeek 这样的公司作为一个完整的独立人格去理解。</strong></li>



<li><strong>世界上没有十全十美的人，也没有十全十美的机构。</strong></li>
</ol>



<p class="wp-block-paragraph">一个天才少年，不能要求他既会做研究，又会做工程，还可以做好 CEO，同时还是一个道德完人。提出这个要求本身就是错的。</p>



<p class="wp-block-paragraph">华为和 DeepSeek 也是一样，不能要求它们永远正确。当然，可能华为永远正确，咱不管它了。总之，把这些机构想象成永远正确的人，或者永远错误的人，都是不对的。</p>



<p class="wp-block-paragraph">还有一点：今天你靠一个事情刷了名声，最后这个名声总会还回到你身上，并在你身上起到一些负面作用。就像华为天才少年和 DeepSeek，总有祛魅的一天，总有偶像碎一地的一天。这个事，在树立偶像的时候就要想到。</p>



<span id="more-3898"></span>



<h2 class="wp-block-heading">李博杰面试 DeepSeek，到底发生了什么</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_3.jpg" alt="远程面试画面中候选人坐在双屏电脑前，另一端面试官举着“抄代码？”的红色提示牌，桌面上摆着计时器和简历文件，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">先讲一下李博杰的情况。他 1992 年出生，现在是创业公司 Pine AI 的首席科学家。前边有人传他是 Pine AI 的联合创始人，他自己出来辟谣，说不是，就是首席科学家。</p>



<p class="wp-block-paragraph">7 月 6 号晚上，他发帖吐槽 DeepSeek 面试，核心有三条。</p>



<h3 class="wp-block-heading">第一，流程拖沓</h3>



<p class="wp-block-paragraph">笔试通过后半个月没人理他，别人 offer 都下来了，他反复催促才排上面试。</p>



<h3 class="wp-block-heading">第二，考核错位</h3>



<p class="wp-block-paragraph">他想去 DeepSeek 做 research，结果前两轮都是面试代码，就是看你到底能不能写程序。好不容易能够面试了，面试官还迟到，而且在评价他的工作时态度轻佻，压根听不懂他在做什么，对他讲的研究成果毫无感知，翻来覆去就一句话：“你有什么工程挑战？”</p>



<p class="wp-block-paragraph">也就是说，面试的压根就不是他应该去考虑的那个岗位。</p>



<h3 class="wp-block-heading">第三，最炸裂的是抄袭指控</h3>



<p class="wp-block-paragraph">因为他是远程面试，并不是真的跑到人家公司里去面试。他桌面上有两台显示器，干这行都知道，程序员有两台显示器是很正常的事情。</p>



<p class="wp-block-paragraph">面试官说：“你不断地瞟左边这个屏幕，你在抄代码吧？停止抄袭代码。”还撂下狠话：“如果你不能证明你没有抄代码，那面试就无法继续进行了。”</p>



<p class="wp-block-paragraph">他解释说是双屏，但是面试官不信，并且用终止面试作为威胁。大家注意，“停止抄袭”这四个字一出口，性质就变了。这不是流程问题，这是当场给一个业内有头有脸的人定性：你在作弊。</p>



<p class="wp-block-paragraph">李博杰当场掀桌走人，然后曝光。</p>



<blockquote class="wp-block-quote is-layout-flow wp-block-quote-is-layout-flow">
<p class="wp-block-paragraph">“从面试官的表现来看，跟我想象中的 DeepSeek 完全不同。”</p>
</blockquote>



<p class="wp-block-paragraph">这句话最有杀伤力。多少人正找不着工作，多少人被面试官居高临下地折腾来折去。连华为天才少年都被如此对待，我们这些普通人算什么？</p>



<p class="wp-block-paragraph">但是，这个事真正值得琢磨的，其实不是面试官的态度，而是背后的一些体系问题。</p>



<h2 class="wp-block-heading">DeepSeek 面试暴露出的体系问题</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_4.jpg" alt="招聘流水线上简历被统一送进代码测试机器，机器旁边堆着“未看简历”“手写代码”“有罪推定”的故障灯，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<h3 class="wp-block-heading">问题一：手写代码考核已经落伍</h3>



<p class="wp-block-paragraph">先说抄代码这件事。现在谁还自己写代码？很多代码都是 AI 写。你现在要求一个人自己盲写代码，有意义吗？这种考核到底有什么意思？而且最后还直接指责别人作弊。</p>



<p class="wp-block-paragraph">我以前有过一次面试经历。我原来是写 Delphi 的，这个语言里有一个惯例：每次创建新文件的时候，中间有一个关键词是 IDE 直接替你写好的，叫 implementation，意思是实现。它写在接口定义和具体实现两段中间，但这个词很长，从来不需要程序员自己写，每次新建文件的时候都已经写好了。</p>



<p class="wp-block-paragraph">我曾经去面试 Delphi 研发岗位的时候，对方给了我一张纸，说你来写代码吧。里头有一道题，就是让你把 implementation 这个词拼出来。当时我一看，我说你到底要干嘛？真正写程序的人从来没写过这个单词，还这么长。英文好的人可能能写出来，英文没那么好就不一定了。对方说，对不起，不会，不伺候你。</p>



<p class="wp-block-paragraph">那老范是不是能力很差？也不至于。我没有上这个岗位，但是 Borland 最后招了我。后来我成为 Borland 大中华区的 Evangelist，算是中国 Delphi 程序员的最高成就了。但是前面就有人上来说，这个单词你给我拼一下，不许拼错。这个压根考的就不是一回事。</p>



<p class="wp-block-paragraph">所以对于这个面试官来说，“你不要抄代码”这件事，首先，指责别人作弊就有问题。第二，现在这个时代，要求别人从头写代码，你到底想干嘛？这是非常落伍的一种考核方式。</p>



<h3 class="wp-block-heading">问题二：面试官不看简历</h3>



<p class="wp-block-paragraph">像我们以前招聘，肯定得先看看简历，这人是干嘛的，然后再去跟人聊：你原来干的这个事情是怎么回事，那个事情是怎么回事；我们现在有一个什么样的岗位，你有什么想法。这是一个标准的面试过程。</p>



<p class="wp-block-paragraph">结果这个面试官完全不看简历。所以你到底是不是华为天才少年，是不是发了一堆 paper，是不是在外边有名声，对这个面试官来说完全无所谓。他一看，又来了一个面试的人，原来干嘛的不知道，是新毕业生还是具体做什么的也没关系，反正就是一套流程，给我面去。这非常不负责任。</p>



<p class="wp-block-paragraph">而且李博杰为什么这么长时间才约到面试？原因很简单，这哥们肯定不年轻了。他是 2019 年华为的天才少年，那个时候应该已经博士毕业了，再加上在外边混了这几年，肯定已经不年轻了。他能够约上面试已经很不容易了。</p>



<p class="wp-block-paragraph">面试官迟到这个事，倒不能说是多大的态度问题。当一个公司紧急扩张，HR 岗位不够的时候，面试迟到或者比较难约，我觉得还是可以理解的。但是不看简历这个事，有点太过分。</p>



<p class="wp-block-paragraph">所以千万不要觉得华为天才少年到 DeepSeek 那里受到了侮辱，面试他的人压根就不知道他是谁，因为简历没看。</p>



<h3 class="wp-block-heading">问题三：不只是李博杰遇到这种情况</h3>



<p class="wp-block-paragraph">网上还有其他面试者也反馈同样的问题。有个 23 岁的小伙说，4 个 DeepSeek HR 同时加他微信，抢着让他去面三个不同的岗位。你看，年轻就是不一样。他感觉这帮 HR 好像在抢着完成自己的 KPI。</p>



<p class="wp-block-paragraph">面试官也迟到了 10 分钟，而且不以为然，说现在面试人太多，排不过来，非常傲慢。这不光是李博杰遇到了，很多人都遇到了。</p>



<p class="wp-block-paragraph">而且这个 23 岁的小伙也说，问的问题跟简历完全对不上，他一度怀疑面试官压根没有看简历。面试官对于他擅长什么、喜欢什么完全不在意，就是一套统一的话术、一套统一的题，让你做。</p>



<p class="wp-block-paragraph">这种东西就没必要上人去面试，直接 AI 面就完了，何必上来耽误大家时间？</p>



<p class="wp-block-paragraph">至于说面试官听不懂李博杰这位华为天才少年的研究，这也太正常了。这个面试官能有多强的技术能力？要求他听明白人家原来研究的东西到底是什么，这个要求有点太高。但是，以这样的面试官最后能面回什么样的人来，那就不知道了。</p>



<p class="wp-block-paragraph">过时落伍的考核方式、必须手写代码、不看简历、有罪推定，这些都只是症状。病根是&nbsp;<strong>DeepSeek 压根没有一套完整的招聘体系和沟通架构</strong>。</p>



<h2 class="wp-block-heading">“华为天才少年”这块招牌</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_5.jpg" alt="一块写着“天才少年”的金色招牌挂在高墙门楼上，几位年轻研究者从门内外分流，一边安静办公一边被聚光灯追逐，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">再说说“天才少年”。这是 2019 年任正非亲自提出来的项目，用顶级薪酬从全世界招顶尖的年轻人。</p>



<p class="wp-block-paragraph">薪酬分三档，最低一档是 89.6 万一年，最高一档是 182 万到 201 万一年。应届生直接拿 201 万，当年刷屏了。但是拿到顶格的，全球应该也没有几个。</p>



<p class="wp-block-paragraph">李博杰就是第一批 8 个人里的一个，中科大少年班出身，中科大和微软亚洲研究院联合培养的博士，顶会论文一堆，进华为定级也很高。2023 年 7 月离开的时候，据说是放弃了年薪 300 万的包。</p>



<p class="wp-block-paragraph">这么多天才少年，华为留得住留不住？除了李博杰之外，我们还听说过一个很有名的名字，叫稚晖君。稚晖君是 2022 年底离开华为的前天才少年，现在在做智元机器人。</p>



<p class="wp-block-paragraph">那是不是华为整了一堆这些人却留不住？这就是另外一个问题，叫你的名声最后总要拖累你。如果华为偷偷招了点人，不对外吵吵，不上来说自己千金买马骨、礼贤下士，他们也不会来蹭“华为天才少年”这块金字招牌。结果前头做了一大堆宣传，后边肯定会有人来蹭这个事情。</p>



<p class="wp-block-paragraph">有没有人留在华为里头好好干、做出贡献的？肯定也有。但是这个事有点像一位非常有名的才女嫁入侯门，一入侯门深似海，就没有声音了。</p>



<p class="wp-block-paragraph">进去以后，有些人在里头混得还可以，但是混得可以的这些人不会有那么大的响动出来。总有一些人，在里头混不下去了，出来了；或者有更远大的梦想，在里头没法实现，跑出来了。相当于一位才女嫁入侯门，最后离开了，还跑去竞逐花魁并且选上了。媒体会报道哪些东西、真正关注哪些东西？一定是后边这帮人。那些在里头慢慢混的人，一定是没有什么声音的。</p>



<p class="wp-block-paragraph">除了华为天才少年稚晖君、李博杰，更典型的一个案例是董明珠原来的秘书孟羽童。董明珠秘书多了，但是她出来高调宣传，说我找到年轻人了，我找到一个觉得能接我班的人了。后边人家再去刷简历或者刷 title 的时候，就是“董明珠前秘书”。</p>



<h2 class="wp-block-heading">研发和工程不是一回事</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_6.jpg" alt="画面左右分屏，左边研究员拿论文和实验曲线，右边工程师维护复杂产品管线和故障报警，中间有一条写着“错配”的断裂桥，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">李博杰后来也出来解释了几件事。第一个是说，他是做研发的，进去也是想去做研发，但是里边的人一直让他去做工程。因为 harness agent 确实有一定的工程因素在头，但是研发和工程，至少在中国，是完全两个不同的领域。</p>



<p class="wp-block-paragraph">像我们以前也招过这种发 paper 的人回来干活，当时是在做人脸识别。但是发 paper 这帮人写的代码，能跑吗？也能跑。但是你不能把它放到产品里去。他完全不考虑各种复杂情况、稳定性什么的，就是能跑出结果就完事了。因为跑出结果、有数据，他就可以写论文了。</p>



<p class="wp-block-paragraph">但是对于工程来说，不能这么干。你要保证在不同设备、不同环境里，遇到各种问题还能自己修复回来。他们是不考虑这些事的。</p>



<p class="wp-block-paragraph">对于一个连简历都不看的招聘来说，把这种研发人才拎过来做工程面试，就算这种人进去了，实际上也做不了工程。所以我们不能要求一个人是完人。</p>



<p class="wp-block-paragraph">李博杰是华为天才少年，人家就是研发人才，华为招他也是进去做研究的，他出来创业也是在做研究。他没有这个工程能力，我们也不应该要求他有这个工程能力。这就是一次面试错配。</p>



<h2 class="wp-block-heading">创业和投资：又一次预期错配</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_7.jpg" alt="创始人和投资人站在断开的信任桥两端，中间悬着三张分期付款支票和一份财务报表，桥下写着“预期错配”，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">再说创业和投资的事情。火币的联合创始人杜均实名发推，说李博杰是他们合作过的最没有契约精神的创始人。</p>



<p class="wp-block-paragraph">杜均称，李博杰 2024 年顶着天才少年光环，创办了叫 Metagent 的一个项目，拿到了 ABCDE 基金的投资之后，不履行投资协议义务，不同步业务和财务，随后直接失联。风投可以接受失败，但是不能接受创始人拿了钱跑路这种欺诈行为。</p>



<p class="wp-block-paragraph">李博杰也在当天反击，说你原来答应给 150 万美金，结果最后只给了 50 万，后面不给了。</p>



<p class="wp-block-paragraph">那这里到底谁对谁错？</p>



<p class="wp-block-paragraph">首先，ABCDE 基金去找这种天才少年投资，本身风险就很大。因为前面讲了，天才少年可能只是做研究很好，但是他能不能成为一个好的 CEO，能不能有很好的道德，这些没有经过考验。你找了这样的人去做 CEO、去创业，就要承担这样的风险。</p>



<p class="wp-block-paragraph">而且这种投资通常都是先给一部分钱。比如说 150 万美金，先给 50 万美金，剩下的钱要跟你沟通，看看你财务怎么样、业务怎么样，是不是在按照前面讲的方向往前发展。如果是，再接着给。通常投资都是这么做的，叫里程碑付款。</p>



<p class="wp-block-paragraph">李博杰拿到钱以后，就觉得这帮人很烦，不理你了，玩失联，那后边的钱肯定拿不到。从李博杰的角度上说，他肯定没有学会怎么做 CEO。你也不能说他道德败坏或者什么，他可能压根不知道应该如何跟投资人打交道，应该如何通过沟通、通过信任的建立去拿到后边的钱。</p>



<p class="wp-block-paragraph">他就觉得：你怎么不讲信誉？说好了 150 万，怎么给了 50 万后边不给了？你居然还敢朝我要财务报表？他可能压根就不懂这个事。</p>



<p class="wp-block-paragraph">所以这件事情，我觉得就是一个预期错配。ABCDE 的杜均，也就是原来火币的创始人，对于华为天才少年的预期错了。这种人就不是成熟 CEO。而李博杰对于投资人的预期也错了，人家也不是来做雷锋的，不是给你钱你就可以自己去实现梦想了。人家也小心谨慎，一定是你先拿着钱，我再看看你后边是不是在正常干活。是的话我接着给，不是的话我也得及时止损。</p>



<p class="wp-block-paragraph">两边实际上都对对方有错误的预期。投资是两件事，一个叫预期管理，一个叫信任游戏。如果预期错配，信任就肯定建立不起来。所以这就是一个悲剧，没什么好说的。</p>



<h2 class="wp-block-heading">李博杰为什么要去面试 DeepSeek</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_8.jpg" alt="外部 agent 开发者站在高墙外举着望远镜，墙内是基座模型机房、数据管道和系统提示词齿轮，墙上写着“内部 tricks”，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">这样一个天才少年为什么要去面试 DeepSeek 的岗位？李博杰后边还专门出来回应了。他自己录了个视频，看起来这哥们肯定也不年轻了。他说自己现在是 Pine AI 的首席科学家，还专门纠正说不是联合创始人。</p>



<p class="wp-block-paragraph">这个差别在哪？首席科学家是拿薪水的，而联合创始人通常是拿股票的。首席科学家属于雇佣关系。他还说，现在这家公司挺好的，运营也不错，没有什么问题，不是说创业项目失败了，要出来找工作。</p>



<p class="wp-block-paragraph">但是他说，现在这个时代大家都在做 harness agent，他也在做。做的过程中，他发现有大量的功能都被模型厂商锁在自己门后头了。在不了解这些底层设定的时候，想做好新的 harness agent，根本做不起来。</p>



<blockquote class="wp-block-quote is-layout-flow wp-block-quote-is-layout-flow">
<p class="wp-block-paragraph">基座模型公司之外做模型和 harness，很多 tricks 是不知道的，外部团队自己摸索很难搞出来。</p>
</blockquote>



<p class="wp-block-paragraph">所以他就想，干脆去 DeepSeek，跟人好好合作一把，进到里边拿到一个职位，直接看看内部到底是怎么跑的。</p>



<p class="wp-block-paragraph">其实我们现在使用的这些大模型，并不仅仅有模型，而是原生大模型公司自己整了一整套模型调度系统和一套系统提示词。我们在调用这个东西，FIB5 的系统提示词泄露了十几万次。所以这些东西是李博杰真正想要的。</p>



<p class="wp-block-paragraph">他的这个动机，其实是一个全球现象。硅谷现在也一样，真正的模型能力被锁在几个大的模型公司墙里头。数据怎么构建，内部怎么评测，不发论文，不开源。你在外边做 agent、做 harness，是有天花板的。</p>



<p class="wp-block-paragraph">所以连最顶级的人都在往基座模型公司里头钻。最典型的案例就是卡帕西，OpenAI 的联合创始人，前特斯拉 AI 总监。他后来离开 OpenAI 以后，也做过创业，做 AI 教育，也做过投资，现在又跑回 Anthropic 去上班了，说我要看一下你们的基座模型到底怎么训练的。所以他进去以后的职位是基座模型训练。</p>



<p class="wp-block-paragraph">李博杰现在想进 DeepSeek，其实也是要干卡帕西同样的事情。</p>



<h2 class="wp-block-heading">DeepSeek 缺少对外合作接口</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_9.jpg" alt="一位带着项目方案的人站在封闭实验室大门前寻找入口，门旁只有猎头简历投递口，没有合作窗口，内部团队低头做研究，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">按道理来说，像他这样的人、这样的项目，想去跟 DeepSeek 做合作，完全应该用另外一个途径进去。比如说：“你好，我们现在有这些项目，想跟你合作，看看怎么能够展开合作，我怎么能够得到内部授权，怎么能够把这一块跑起来。”应该做这样的一个事情。</p>



<p class="wp-block-paragraph">但是 DeepSeek 并没有给他这样的接口。因为梁文锋也是一个相对低调封闭的人，不怎么接受采访，关起门来看论文，关起门来跟大家一起做研究。他就是这样的一个团队。你敲门找不到，拎着猪头找不到庙门，不知道应该怎么去跟他合作、怎么去谈这个事情。</p>



<p class="wp-block-paragraph">其实他完全可以成为一个外部顾问，或者成为一个中间角色。这样的位置，对于 DeepSeek 也好，对于他原来的 Pine AI 也好，都是有利的。但是现在没有。他怎么办？</p>



<p class="wp-block-paragraph">这里头还有一个很有意思的细节。李博杰说，他是通过猎头公司把简历送进去的。也就是说，里边招聘这帮人也不知道要找什么人，就直接找猎头公司：我给你钱，你给我提供多少多少份简历。然后拿着简历也不看，就直接挨个拎过来，进行这种羞辱式的统一面试。所以就导致了这样的资源错配。</p>



<p class="wp-block-paragraph"><strong>DeepSeek 大概要走弯路了。</strong></p>



<h2 class="wp-block-heading">拿到钱之后，DeepSeek 的招聘方式可能会出问题</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/blog_10.jpg" alt="一袋融资金币倒进招聘漏斗，漏斗下方涌出混乱简历、人群和未搭好的组织架构积木，旁边有“快速扩张”的红色警示牌，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">6 月 16 日，DeepSeek 完成了首轮外部融资。拿到钱以后，梁文锋也想明白了，除了模型强之外，现在必须把 Codex 和 Claude Code 这个补上，也要有自己的 harness agent。于是就专门找了一个人，说来，你给我组织团队，咱们就干吧。</p>



<p class="wp-block-paragraph">这个拿到钱的人，估计原来也没有花过这么多钱，那就开始快速推进。其实这种新的团队组建，不管是完整的 harness agent，还是哪一个独立业务的构建，压根不应该是这么一个套路。</p>



<p class="wp-block-paragraph">正常的套路是什么？首先应该搭架构，面试一些最基础的人，再让这些人逐步把自己的团队搭起来，应该是这样的过程。有一些大的猎头公司，上来不是给你交简历，人家是说我帮你搭架构，这才是真正猎头该干的活。</p>



<p class="wp-block-paragraph">但是现在 DeepSeek 这帮人真的是萝卜急了不洗泥，或者叫乱拳打死老师傅，先弄一大堆简历回来面试。这个事是不行的。</p>



<p class="wp-block-paragraph">像我们以前突然要搭一个新业务，怎么办？先去考察这个方向里有哪些团队，谁做得还不错，哪个团队里哪些人比较厉害，然后把这个人直接拎回来。可能第一个人未必拎得回来，但是总有拎得回来的。拎回来以后，让这个人再去组织团队，得一层一层这样构建起来。</p>



<p class="wp-block-paragraph">甚至你可以说，这个业务需要 5 个模块，每一个模块面试几个人。这些人在原来的行业里、原来的位置上，就是干这样的事情的。把这些人都凑齐了，就等于有一个基础班底了，再让他们去面试。那这些人在哪面试去？实际上就是上原来公司接着挖，就这么简单。</p>



<p class="wp-block-paragraph">像 DeepSeek 现在这个搭法，肯定要栽跟头。</p>



<h2 class="wp-block-heading">京东曾经的例子</h2>



<p class="wp-block-paragraph">再讲一个故事。原来京东干过一次这样的事情。有一段时间，京东业务发展很快，但是原来的网站、原来的系统都比较烂。那怎么办？快速起团队。招什么呢？招“将将能干活”的人。这些人肯定再往上发展是有问题的，但是他们也跌跌撞撞地把当时的京东撑下来了。</p>



<p class="wp-block-paragraph">再往后就费劲了。等京东再往后发展、再去上台阶的时候，说我们再去外边找一些科学家回来，再找一些顶级大厂或者顶级名校的人出来，接不了了。为什么？因为原来这些岗位都被这帮刚刚好的人占住了。只要有人接手，他就让业务死给你看。把事情搞成这样了。</p>



<p class="wp-block-paragraph">DeepSeek 现在这种疯狂招人的玩法，最后肯定还是要付出代价。要么是现在这套东西就做不出来，要么是可能能做出来，但是大家不满意；或者做出来将将能用了，未来需要填坑。这个肯定跑不掉。</p>



<h2 class="wp-block-heading">最后再总结三句话</h2>



<ol class="wp-block-list">
<li><strong>不要迷信 title 和标签。</strong>它只能证明一个维度。华为天才少年证明的是他的研究能力很强，他的工程能力、做 CEO 的能力，大家不要有奢求。</li>



<li><strong>不要把华为、DeepSeek 当成一个完整的人格个体。</strong>林子大了什么鸟都有，每个公司都有可能有些部门强，有些部门不强；有些方向强，有些方向不强。</li>



<li><strong>不要相信有任何事物是完美的。</strong>再神的体系，也有拉胯的角落和拉胯的时间。</li>
</ol>



<p class="wp-block-paragraph">最终总结一句话：DeepSeek 钱拿到了，但是它现在正在走弯路。用萝卜急了不洗泥的方式去招聘、组建团队，是干不出活来的。就算干出来，未来这些雷也会被埋下来。</p>



<p class="wp-block-paragraph">世界就是一个巨大的草台班子，区别只在于，有的班子知道自己是草台，有的还以为自己是神殿。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<h2 class="wp-block-heading">背景图片</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-li-bojie-interview-controversy/background_1.jpg" alt=""/></figure>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>DeepSeek融资510亿，4个霸王条款，梁文锋如何拿捏资本？</title>
		<link>https://lukefan.com/2026/06/21/deepseek-rmb-funding-a-share-listing/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Sun, 21 Jun 2026 00:48:18 +0000</pubDate>
				<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[DeepSeek 510亿融资]]></category>
		<category><![CDATA[DeepSeek A股上市铺路]]></category>
		<category><![CDATA[DeepSeek人民币融资]]></category>
		<category><![CDATA[DeepSeek融资]]></category>
		<category><![CDATA[国家人工智能产业基金入股]]></category>
		<category><![CDATA[有限合伙GP LP条款]]></category>
		<category><![CDATA[梁文锋资本条款]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3857</guid>

					<description><![CDATA[DeepSeek 510亿人民币融资为何引发关注？本文拆解梁文锋如何通过有限合伙架构、五年锁定期、LP穿透审查和禁止挖人条款，掌握DeepSeek融资控制权。文章还分析国家人工智能产业基金的特殊权利、DeepSeek算力中心布局、Harness Agent团队与商业化路径，以及这轮全人民币融资对A股上市、国内AI公司竞争和开源模型赚钱模式的影响。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="DeepSeek融资510亿，4个霸王条款，梁文锋如何拿捏资本？" width="900" height="506" src="https://www.youtube.com/embed/g20t3FKr49k?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_1.jpg" alt="梁文锋站在写有510亿融资的棋盘中央，四条协议条款像四道门槛围住腾讯、宁德时代、基金等资本方，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<h2 class="wp-block-heading">DeepSeek 510亿元人民币融资落地，梁文锋如何通过四条条款战胜资本？</h2>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事的 YouTube 频道。</p>



<p class="wp-block-paragraph">首先确认一个数字，不是500亿，而是<strong>510亿</strong>。这个数据待会儿咱们仔细拆分一下。这是中国 AI 公司有史以来最大的一笔单笔融资了，而且因为 DeepSeek 这是它的第一次融资，所以也非常受人瞩目。</p>



<p class="wp-block-paragraph">中国的 AI 公司融资，我们总是要跟美国比一比。我们在模型上追赶，融资上是不是也在追赶呢？这个距离好像稍微差得有那么一点点远。</p>



<ul class="wp-block-list">
<li>Anthropic 总共融了1,163亿美金，不是人民币，是美金。</li>



<li>OpenAI 总共融了1,500亿美金。</li>



<li>DeepSeek 这是第一轮，累计融资510亿人民币，大概相当于74亿美金。</li>
</ul>



<p class="wp-block-paragraph">所以 DeepSeek 的融资额是 Anthropic 的1/15.7，是 OpenAI 的1/20。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_2.jpg" alt="三根高低悬殊的融资柱状图分别标注OpenAI、Anthropic和DeepSeek，DeepSeek柱子旁放着人民币与美元换算小牌，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">中国确实吃苦耐劳，确实比较省钱。中国绝大部分的 AI 公司里头，用的人肯定是要比美国人便宜，不是说我们人差，只是我们薪资低而已。另外，我们也确确实实没有那么多算力卡，也没有烧掉那么多电费。所以在这一块上，我们要比他们省钱很多。</p>



<p class="wp-block-paragraph">但是同样一个事情，要看跟谁比。你去跟 OpenAI、Anthropic 比，我们这个融资确实是非常非常小。但是如果去跟国内这些 AI 公司比，那么 DeepSeek 这个510亿人民币，就是有史以来最大的单轮。</p>



<span id="more-3857"></span>



<h2 class="wp-block-heading">这510亿是谁出的？</h2>



<p class="wp-block-paragraph">以前我们做投资的时候，这个工作叫 cap table，就是投钱，谁投了多少钱，投完以后大家怎么占股，要去画这个表。但是今天这个表不能这么画，因为它这个架构非常复杂。咱们先把钱列一列吧。</p>



<p class="wp-block-paragraph">510亿一共是10家出钱的人：</p>



<ul class="wp-block-list">
<li>梁文锋：200亿，单一最大出资方。</li>



<li>腾讯：100亿。</li>



<li>宁德时代体系的基金：50亿。</li>



<li>网易、京东：各30亿。</li>



<li>砺思资本、IDG：各30亿。</li>



<li>正心谷、拾象科技：各15亿。</li>



<li>国家人工智能产业投资基金：9.8亿。</li>
</ul>



<p class="wp-block-paragraph">凑在一块，10家就是509.8亿。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_3.jpg" alt="一张复杂的出资桌面上摆着十个不同大小的钱袋，最大的钱袋写着梁文锋200亿，旁边围绕腾讯、宁德时代、网易、京东和国家AI基金标签，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">有人说宁德时代给钱吗？他会不会给电池就完事了？不行，待会儿咱们再解释为什么不行。</p>



<p class="wp-block-paragraph">其他所有人都没有这个能力说，我可以用实物、用其他东西来替代，除了国资之外，大家都不行。腾讯说，我这100亿能不能拿算力给？这个也不是可以直接做的，它整个审批过程非常复杂。</p>



<p class="wp-block-paragraph">梁文锋这200亿，就是要去定这个定价权：我们到底应该值多少钱？这个协议应该怎么签？前面我们讲过，他叫领头方。其他人认这个规矩，你就往里进；你不认，就别来。所以他一定要成为单一最大出资方。</p>



<p class="wp-block-paragraph">至于这200亿是哪来的，幻方量化做了这么多年，也确实积攒了一些利润。至于这个钱是如何从幻方量化里边变成他个人的，然后再怎么出来，没有一个详细的报道，估计也是要走很多手续的，咱们在这里就不细究了。</p>



<p class="wp-block-paragraph">但是讲清楚一点，这200亿就是锁住了控制权，锁住了定价权，锁住了制定协议的权利。</p>



<p class="wp-block-paragraph">很多人看到这一次融资结束以后，都出来解读：“哎呀，梁文锋战胜了资本。”待会儿咱们再讲梁文锋到底是怎么战胜资本的。咱们先把这四大核心条款讲清楚：谁有什么权利，谁没什么权利，你想要在里头做什么样的事情，应该怎么去做。</p>



<h2 class="wp-block-heading">第一条：成立有限合伙企业</h2>



<p class="wp-block-paragraph">第一个霸王条款，最狠的是什么呢？就是除了国家基金之外，其他人其实压根就没有投到 DeepSeek 里边去，他们是投到了一个有限合伙企业。</p>



<p class="wp-block-paragraph">什么叫有限合伙企业？这里面是有 GP 和 LP 的。</p>



<ul class="wp-block-list">
<li>梁文锋是 GP，GP 叫普通合伙人。</li>



<li>GP 可以管理公司，对公司有完整的控制权。</li>



<li>他作为有限合伙的控制人，再去入资到 DeepSeek 里头去，可以代替其他所有人一起投票，一起做决策。</li>
</ul>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_4.jpg" alt="一个双层公司结构示意图，上层梁文锋作为GP握着方向盘，下层多位LP投资人只能隔着透明屏幕查看报表，箭头指向DeepSeek公司，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">剩下的像腾讯、宁德时代这些人，他们就属于 LP，叫有限合伙人。有限合伙人可以去看报表，财务是什么样，我可以看。但是你说我想做个决策，我们是不是可以到深度求索这公司里头去提一个不同的方案出来？没这个权利。你首先要在这头说服 GP，甚至 GP 都可以不理你。它是这样一套运作方式。</p>



<p class="wp-block-paragraph">比如说宁德时代说，我这有电池，咱们是不是建个储能电站，你用我的电池行不行？这件事他是没有权利在现在这个位置上提出的。如果深度求索说，我现在要去造算力中心了，我需要储能电站，他完完全全可以独立做出决策。作为有限合伙公司里边的 LP，宁德时代没有任何权利可以对这件事情指手画脚。</p>



<p class="wp-block-paragraph">但是它有什么权利呢？比如最后这帮人买了比亚迪的电池，买得还特别贵，等到最后进行审计的时候，他可以说：</p>



<blockquote class="wp-block-quote is-layout-flow wp-block-quote-is-layout-flow">
<p class="wp-block-paragraph">哎，你这不对，我们就是圈里人，这电池不应该这么贵。</p>
</blockquote>



<p class="wp-block-paragraph">他可以在这儿说话。但是你在前面说，我们希望你这个项目去买宁德时代的电池，没这个权利。</p>



<p class="wp-block-paragraph">包括像腾讯、京东这些自己有云计算的公司，是不是可以去跟 DeepSeek 谈说，你先来租我的云计算机房吧？也是没有这个权利的，因为他们都是 LP。</p>



<p class="wp-block-paragraph">这是第一个霸王条款，就是成立有限合伙公司。在有限合伙公司里头，除了梁文锋是 GP 之外，剩下的都是 LP。你们没有权利去对 DeepSeek 投票，或者说任何话、做任何决策。你只能查报表、查财务，我保证这个钱不给你乱花。到后边该上市的时候，公司升值的时候，大家一起来分享利益。它就是这样的一个架构。</p>



<h2 class="wp-block-heading">第二条：5年不许退出</h2>



<p class="wp-block-paragraph">第二个霸王条款是什么呢？要5年不许退出。这个其实跟上面那个条款是合在一起的。</p>



<p class="wp-block-paragraph">我们以前签投资协议的时候，这个协议是反的，就是我们不会承诺自己5年不退出，我们要求被投方承诺，如果5年你没有让我退出的话，你得赔钱。这个东西叫对赌协议。</p>



<p class="wp-block-paragraph">但是如果你成为了一个有限合伙企业的 LP，你是要求签这样的协议的。就是说五年之内你是不许跑的，你必须老老实实在这儿把它待齐了。到了5年，这个有限合伙企业我们看看怎么办。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_5.jpg" alt="五年倒计时日历前，LP投资人坐在锁住的大门内等待，门外有上市、收购、延期三条岔路指示牌，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">比如说我上市了，那这事很好办。因为一旦上市以后，通通都变成普通股了。这个有限合伙企业拿到股票，我们把股票跟大家一分，大家就可以拿着这些股票到市场上去卖就完了。或者说 DeepSeek 被人收购了，那也可以很好地退出，大家分钱也非常开心。</p>



<p class="wp-block-paragraph">如果到了5年以后实在退不出去了怎么办？在这个时候，通常这种有限合伙企业的公司章程里会写几种可能性。</p>



<ol class="wp-block-list">
<li>认赔。不要觉得这事很好笑，这个是很正常的。所有做基金的，做这种有限合伙企业的，不保证稳赚不赔。因为国家法律有规定，如果你做这样的企业，去保证所有 LP 出资永远稳赚不赔的话，是违法的，因为怕我们出去骗人。所以它有可能到最后就认赔了。</li>



<li>穿透。到最后我们实在退不出去了，那我就穿透，把底下深度求索的股权直接穿透上来。这个可能性也是存在的。</li>



<li>延期。到了5年了，我还是退不出去，也没有上市，也没有把公司卖掉，那怎么办呢？我们再延个两年，再看看过两年以后有什么新的变化。这个可能性也是比较大的。</li>
</ol>



<h2 class="wp-block-heading">第三条：LP 穿透审查</h2>



<p class="wp-block-paragraph">第三个霸王条款是什么呢？叫 LP 穿透审查。这件事其实是在中国都要干的事，不是说只有 DeepSeek 去干，所有人都干。</p>



<p class="wp-block-paragraph">为什么呢？中国有一个很奇葩的事情，就是有很多牌照、很多资质，必须由纯内资公司去设立。比如说我今天要去申请 ICP、ISP 这些牌照，你必须是纯内资企业。一旦这个项目里头有一个外资，就搞不定了，哪怕是1%的外资也不行。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_6.jpg" alt="放大镜逐层检查LP股权链条，红色外资标记被挡在ICP和ISP牌照门外，内资通道通向DeepSeek，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">所以 DeepSeek 为了自己可以直接拥有所有这些牌照，就必须要去做这个事。我们以前做游戏公司的时候也是这样的，一旦拿了外资，那你就得老老实实再去做 VIE，再用纯内资公司去申请这些相关牌照。</p>



<p class="wp-block-paragraph">DeepSeek 之所以要去审查大家的 LP 资质，就是为了避免这件事情。它要自己直接拿牌照。自己直接拿牌照的好处就是后边上市的时候会方便一些。</p>



<p class="wp-block-paragraph">而且还有一点是什么呢？前面像红杉资本，还有一些大的美金资本，出现过一些问题。因为美国法律的要求，他们必须进行分拆，强制把内资投资到中国一些企业的钱退出来。那么咱们提前都检查好，也避免这种麻烦。出了事以后大家脸上都难看。</p>



<p class="wp-block-paragraph">就跟这一次 SpaceX 不允许中国大陆、不允许中国香港的股民去投资它是一样的。你今天投资了，过两天国家出一个什么新政策，大家又着急忙慌去卖，别给大家找这麻烦就完事了。</p>



<p class="wp-block-paragraph">这个其实不算是一个特别霸王的条款，这个是挺正常的一个条款。</p>



<h2 class="wp-block-heading">第四条：投资方不得挖人</h2>



<p class="wp-block-paragraph">第四个条款特别有意思：<strong>投资方不得挖人</strong>，不能挖 DeepSeek 的员工。</p>



<p class="wp-block-paragraph">你说 IDG 这些资本，他们不会去干这个事。腾讯会。你签了这个字，腾讯你就不要再挖我的人了。京东也有可能，京东自己不也号称要做大模型吗？你投了这个钱，就不要再来挖我的人了。</p>



<p class="wp-block-paragraph">在这里头我们要注意到，没有阿里，也没有小米。罗福莉在小米，小米挖过他人。这个投资团队里头也没有字节跳动，字节跳动也挖过他的人。所以这是一个比较奇葩的条款。一般情况下，基金是不会签这种字的，但是他说我要求，那大家就只能签了，没办法。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_7.jpg" alt="DeepSeek办公室门口贴着不得挖人告示，几只写有投资方名字的小猎头网兜被拦在门外，内部工程师专注看代码屏幕，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">基金经常干一个什么事呢？我投了你的项目，发现你这项目玩不转了，然后说，这个项目的 CTO 还不错，技术很强，我把他挖到我另外一个被投项目去，你到那边去待两天吧，咱们两边强强联合，死了一个，但是其他项目就活过来了。</p>



<p class="wp-block-paragraph">基金还有的时候会干嘛呢？就是在项目结束的时候，比如这个项目卖了，或者清算了，这都算结束。项目结束以后，他会把项目的创始人拎回到基金里头来，一边做投资经理该干的活，就是四处出去看项目，另外一边也随时准备东山再起。</p>



<p class="wp-block-paragraph">像这些人，就是基金相信他们是可以做出新项目来的。你也给基金挣到过钱，或者说基金跟你合作的过程中还是比较愉快的，你中间有一段空窗期，你就在基金里头待着。</p>



<p class="wp-block-paragraph">所以很多人创业项目，说我要找基金要钱去了，然后这个基金派了一个长得不太像投资经理的人。有些人你一看他就是投资经理，他会去跟你讲跟钱有关的事情，跟业务有关的事情。而有些人往那一坐，就跟大老板似的，这些人很多就是基金养的这些创始人。</p>



<p class="wp-block-paragraph">傅盛有一段时间在干这个活。他从360出来以后，跟360那边还有竞业协议，不能马上干同样的事情，就在经纬里头养了一段时间。所以所有的创始人，你们创业跟基金的人聊天的时候一定要小心，跟你聊天的人有可能就是这样的身份。</p>



<p class="wp-block-paragraph">讲远了。这就是这一次签的一个比较奇葩的条款：所有参与这轮投资的人，都不可以挖 DeepSeek 的人。</p>



<h2 class="wp-block-heading">国家 AI 基金：出钱最少，权力最大</h2>



<p class="wp-block-paragraph">所有这些投资人里头，有一个特别特殊的，就是国家 AI 基金。它给的钱最少，但是权力最大。为什么呢？因为其他人都是作为 LP 参与的有限合伙，而它是直接把钱投到了深度求索这公司里头去了。它有董事会席位，有各种一票否决权。</p>



<p class="wp-block-paragraph">很多人在解读的时候，都把这个基金解读成国家大基金，这事是不对的。真正的国家大基金是谁？是半导体基金，芯片基金。现在是第三期，叫大基金第三期，注册资金是3,440亿人民币。</p>



<p class="wp-block-paragraph">但是这一次参与投资的国家人工智能产业基金，是2025年1月17日成立的，规模是600.6亿元人民币，存续期是13年，工信部和财政部牵头。刚才咱们讲的这个国家大基金，是它的 LP，也就是国家大基金出的钱，它拿着这个钱再往下边去投，是这样的一个身份。</p>



<p class="wp-block-paragraph">那么它就有很多权利了。第一个，前面咱们讲的五年锁定期跟它就没什么关系了，因为它不需要去签那个有限合伙协议，跟它没事。而且它有一堆一票否决权。</p>



<p class="wp-block-paragraph">这一票否决权通常是哪些呢？</p>



<ul class="wp-block-list">
<li>引入新投资。</li>



<li>上市、破产、清算。</li>



<li>修改章程。</li>



<li>增减注册资本。</li>



<li>公司合并、分立、解散。</li>



<li>重大资产处置、对外投融资。</li>
</ul>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_8.jpg" alt="国家AI基金代表坐在董事会圆桌一侧，手中举着一票否决印章，桌面六张重大事项卡片依次排开，其他LP在远处旁听，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">比如说我今天又想让别人来投了，前面这些腾讯、宁德时代、京东、网易，对不起，你没有权利来否定和同意这个事。你只能把投票权交给你的 GP，也就是梁文锋。他同意这事就过了，他不同意这事就过不去。但是国家基金有这个权利去同意和不同意。</p>



<p class="wp-block-paragraph">那你说这10亿全场最小，权力直接这么大，梁文锋怎么就能忍呢？这没办法，你必须得忍。你不忍，后边那些人也不进来。</p>



<p class="wp-block-paragraph">那你说后边这些人傻吗？我交了这么多钱还没权利。</p>



<p class="wp-block-paragraph">我们以前跟人签协议的时候，有的时候这个协议条款的尾巴上会有一条叫最惠国条款。什么意思呢？就是如果别人的权利比我强，那这个权利我也要。那你说前面这些人就傻吗？原因很简单：你有国家大基金进来，就可以保证最后在国内上市。</p>



<p class="wp-block-paragraph">大家最后要干嘛？要割韭菜。割韭菜就一定要在 A 股上市，在港股上市都不行，一定要 A 股上市。国家基金进来了，你就可以割韭菜，就可以去上市了。它可以保证这件事情一路顺风，不会有任何人给它设置障碍。我们来挣钱的，有人给你保驾护航了，我们愿意忍气吞声的。您在前面站着，没毛病。它是这样的一个故事。</p>



<p class="wp-block-paragraph">咱们刚才还讲了另外一个事，就是宁德时代是不是可以给点电池来抵冲他的投资？不行，因为它是 LP。但是国家人工智能产业基金是可以干这个活的。</p>



<p class="wp-block-paragraph">这个9.8亿，它可以干嘛呢？比如说深度求索想去建个机房，这个国家基金说了，我这有块地，我把这个地作价2亿给你行不行？这个事是可以的。因为什么？它是在董事会里有票的。当你要去做这样决定的时候，肯定是要到董事会那儿去签字，它有这个权利，前面那些 LP 都没这个权利。</p>



<h2 class="wp-block-heading">510亿往哪花？</h2>



<p class="wp-block-paragraph">说到这儿了，这510亿往哪花呢？</p>



<h3 class="wp-block-heading">内蒙古算力中心</h3>



<p class="wp-block-paragraph">第一个就是内蒙古算力中心。4月15日，DeepSeek 公开招募数据中心高级运维工程师，月薪3万，14薪。第一步选的是乌兰察布，东数西算八大枢纽节点之一，电价不到3毛钱一度，是沿海的一半。上那儿去，咱们建算力中心去。</p>



<h3 class="wp-block-heading">Harness Agent 团队</h3>



<p class="wp-block-paragraph">第二个，Harness Agent 团队，2026年5月份开始组建。在这一块也要狠狠地冲一把了。</p>



<h3 class="wp-block-heading">商业化路径建设</h3>



<p class="wp-block-paragraph">还有就是做商业化。商业化是这样的，深度求索这样的公司最后怎么赚钱，这个肯定很多人比较好奇。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_9.jpg" alt="510亿资金分成三条流水线，一条流向乌兰察布数据中心机柜，一条流向Harness Agent研发团队，一条流向云服务销售网络，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">你模型都开源了，这个模型谁愿意部署谁部署，部署的时候不用给你钱，也不需要征得你任何同意。因为它是直接使用 MIT 协议，就是你不需要来问我，你愿意商业化就商业化，跟我没关系。它是这样一种协议。</p>



<p class="wp-block-paragraph">那 DeepSeek 怎么挣钱呢？它自己部署的成本比别人都低，所以它降价。再加上它自己的 Harness Agent 推理系统整个都做完了以后，会导致什么呢？别人可以部署 DeepSeek，但你部署完了以后比我贵，部署完了以后比我这套系统笨，会有这样的情况。</p>



<p class="wp-block-paragraph">首先我先自己在乌兰察布建一个机房，我把这个成本跑得非常低，把整个样板跑出来。剩下你们谁想做，你们不要自己去部署了，你把这个机房租给我，我部署去。DeepSeek 自己部署，部署完了找大家收钱，你们来使用 DeepSeek 的这个模型，把钱交给我，我再去跟人分。它是用这样的方式去做运营的，最后也是能挣到钱。所以大家不用太担心 DeepSeek 亏钱的事情。</p>



<p class="wp-block-paragraph">现在腾讯云已经想明白了，说我们以后不再自己部署 DeepSeek 大模型了，我们直接把这个东西交给 DeepSeek 去部署，部署完了以后我只管卖就完了。卖完了以后，其中有一部分钱是我的，有一部分钱是你的。</p>



<p class="wp-block-paragraph">这个有点像什么呢？有点像4S店。咱们买车，这个4S店其实是一大堆代理商去建的，但是你不能在一个4S店里同时卖两个品牌的车，你只能卖它一家的。意思是什么？就是你跟人签好了协议以后，人家这个里头到底怎么布置，放哪些车，用什么样的价格，都是由品牌方说了算的。但是最后卖完了以后，大家再去重新分钱。有点像这样的一个模式。</p>



<p class="wp-block-paragraph">所以这510亿到手以后，就是去做这三件事情：建算力中心，做 Harness Agent 团队，然后做商业化路径建设。而且这三件事情是环环相扣的，这就是 DeepSeek 目前确定的事情。</p>



<h2 class="wp-block-heading">到底是人民币还是美金？</h2>



<p class="wp-block-paragraph">下面还有一个点，可能大家会比较好奇：它到底是人民币还是美金呢？一边我们说这个510亿人民币相当于多少美金，另外一头还在讲，这个案子投完以后，投后估值是500亿美金，这个到底是人民币还是美金呢？</p>



<p class="wp-block-paragraph">在这里跟大家有一个结论：<strong>所有跟美金相关的数字，都是在人民币的基础上按汇率算出来的。</strong>这个项目从头到尾全是人民币，没有任何美金，里边所有相关实体都是境内实体，全是人民币。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_10.jpg" alt="人民币硬币和美元符号通过汇率桥相连，但资金主河道全部流向境内实体和A股大门，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">为什么会做成这样？其他人为什么不走这条路？原因很简单，其他人找不到这么多人民币投进来，而且其他人民币基金投资也会更加谨慎，不愿意在这样的项目里头砸这么多钱进来。</p>



<p class="wp-block-paragraph">所以前边像 MiniMax、智谱、月之暗面，都只能去拿美元基金。他们美元基金是愿意给更高的估值，愿意投更多的钱进来的。人民币基金在这里是没有人愿意干这个活的。</p>



<p class="wp-block-paragraph">因为什么呢？其他人民币基金即使投了这笔钱进来，也没有信心保驾护航，让这个企业在国内上市，所以他们就不愿意来承担这样的风险。现在也没有到美国上市这种事情了，只能到香港上市。香港股市本身流动性是有问题的。虽然香港股市整个盘子并不小，但是香港股市是完全注册制的，谁想上谁就可以上，它就缺乏这种稀缺性。</p>



<p class="wp-block-paragraph">而 A 股正好反过来。A 股一边盘子很大，另外一边它属于没有完全放开的注册制，其实还是半审批制的状态。所以 A 股上面可以合法合规割韭菜的公司是比较少的，都是稀缺资源。</p>



<p class="wp-block-paragraph">在这一点上，如果有人民币基金可以保证你一定能在 A 股上市，那么大家是敢投的。如果不敢的话，就只能放到香港那边去，在一个烂泥塘里边搅和搅和。</p>



<p class="wp-block-paragraph">而 DeepSeek 上来就是有国家人工智能基金保障，而且还筛选了所有 LP，所有从上到下的参与方全都是内资。这就是为了 A 股上市在铺路。所以他们大概率会比较快速地，甚至都等不到5年，就在 A 股上市了。大家可以拭目以待一下。</p>



<p class="wp-block-paragraph">他们一旦在 A 股上市了，对于 MiniMax、对于智谱来说，都是沉重打击。因为每一个赛道上只能有一个老大。比如说宁德时代就是宁王。如果 DeepSeek 在国内上市了，那它妥妥的是人工智能的老大。智谱也好，MiniMax 也好，跟它根本就没法比。</p>



<p class="wp-block-paragraph">这也是为什么现在智谱跟 MiniMax 必须疯狂地要在国内上。因为一旦他们没上去，让 DeepSeek 先在国内上去了，这路子就没法走了。</p>



<h2 class="wp-block-heading">形势比人强</h2>



<p class="wp-block-paragraph">最后咱们来讲一讲形势比人强的故事。有很多人讲，你看这个梁文锋，他懂资本，他就拿捏了资本，他就可以设计出这样的模式出来。这事跟梁文锋懂资本有屁关系，一点关系没有。</p>



<p class="wp-block-paragraph">为什么我讲叫形势比人强呢？大家都想投进来，大家都认为投进来能挣钱的时候，你就可以定规矩。而且前提是你愿意出最大的那个钱，你就可以来定这个规矩。如果说你现在四处求人拿钱，那只能是人家定什么规矩，你就认。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/blog_11.jpg" alt="一座写着市场形势的巨浪托起梁文锋和规则牌，资本方排队递出钱袋，远处另一边是创业者四处求人拿钱的小船，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">比如说我现在就想上 A 股上市，我想上 A 股合法割韭菜，那国家人工智能基金说我定规矩，你认不认吧。梁文锋说，我认。这不就是这么简单吗？所以形势比人强，看谁站在形势比较强的这一边，谁说话算数。</p>



<p class="wp-block-paragraph">有没有人好奇一点？外边这个国家基金的事我们先不管，那510亿的钱是一把都到位了，还是一笔一笔来？跟大家普及一个小知识，这个通常也是一笔一笔来的。</p>



<p class="wp-block-paragraph">但是怎么定呢？是看谁出钱出得最多。梁文锋200亿出得最多，比如梁文锋说，我们现在不需要这么多钱，我先放个50亿进来，也就是1/4的钱进来。对于其他这几家来说，我们等比例往里放就可以了。</p>



<p class="wp-block-paragraph">然后梁文锋说，我们又需要钱了，我再放50亿进来。其他人说，没问题，你放了我们就跟着放。</p>



<p class="wp-block-paragraph">所以他作为最大的出资方，还有这样的一个小义务在里头，叫喊号。他只要喊了，别人就会往里放钱。他不往里放，其他人都不会往里放的。</p>



<h2 class="wp-block-heading">最后总结</h2>



<p class="wp-block-paragraph">最后总结一下，DeepSeek 的融资算是落地了。如果在未来一段时间，DeepSeek 还相对来说比较安静，那么这一次融资就是很成功的。</p>



<p class="wp-block-paragraph">这可能稍微有点反直觉，因为 DeepSeek 其实原来一直是一个相对比较安静的公司。虽然外边经常有 DeepSeek 相关的传闻，但是它自己也不说什么。</p>



<p class="wp-block-paragraph">如果这笔融资落地以后，DeepSeek 开始不停地开发布会，今天发布一个这个，明天发布一个那个，像 MiniMax 或者智谱一样，发条拧满了往前冲的话，那可能这一次融资效果就很差，或者说国家人工智能基金在里边就在瞎搞。</p>



<p class="wp-block-paragraph">因为其他那些都是 LP，他们没有权利也没有能力瞎搞。唯一有能力瞎搞，唯一有能力去制衡梁文锋的，就只有国家人工智能基金。</p>



<p class="wp-block-paragraph">如果他们可以继续按照自己的节奏、自己的习惯接着往前走，我相信 DeepSeek 还是可以给我们贡献出很多有趣的故事，很多有趣的技术。但是一旦打乱节奏了，开始在内部折腾起来了，那也会给我们贡献很多故事，只是那些故事就未必是那么有趣了而已。</p>



<p class="wp-block-paragraph">好，今天这个故事就讲到这里。感谢大家收听，请帮忙点赞，点小铃铛，参加 Discord 讨论群。也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<h2 class="wp-block-heading">背景图片</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-rmb-funding-a-share-listing/background_1.jpg" alt=""/></figure>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>DeepSeek融资背后的控制权之争</title>
		<link>https://lukefan.com/2026/05/26/deepseek-funding-rumors-valuation-control/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Tue, 26 May 2026 00:50:16 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[DeepSeek V4 Pro]]></category>
		<category><![CDATA[DeepSeek估值]]></category>
		<category><![CDATA[DeepSeek投资方]]></category>
		<category><![CDATA[DeepSeek融资]]></category>
		<category><![CDATA[DeepSeek融资内幕]]></category>
		<category><![CDATA[国家大基金投资DeepSeek]]></category>
		<category><![CDATA[梁文锋]]></category>
		<category><![CDATA[梁文锋30亿美金领投]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3795</guid>

					<description><![CDATA[DeepSeek融资传闻从3亿美元扩至100亿美元，核心不只是估值，而是谁能掌握控制权与未来路线。本文拆解DeepSeek融资估值变化、梁文锋领投原因、国家大基金入场影响，以及腾讯、阿里、IDG等潜在投资方的不同诉求。文章还分析DeepSeek降价与用户使用量之间的关系，A股上市想象背后的退出逻辑，以及拿国资后可能承担的风险。最后聚焦DeepSeek拿到资金后，能否在AGI与agent Harness方向继续保持技术路线和团队独立性。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="DeepSeek融资暴涨背后，谁在争夺定义权？" width="900" height="506" src="https://www.youtube.com/embed/0BJXRyptz3s?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/blog_1.jpg" alt="DeepSeek 标志性的抽象芯片立在画面中央，周围环绕融资数字、投资机构名牌和控制权箭头，形成一张资本争夺关系图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph"><strong>DeepSeek 融资背后的隐秘</strong>：大家看到的是数字，但这背后隐藏着哪些争夺呢？</p>



<p class="wp-block-paragraph">DeepSeek 开始融资的时候，我们做过节目。当时讲了它到底想干什么：开一轮融资，给 DeepSeek 自己做一个定价，来稳定团队。到目前为止，我依然坚持当时的说法，这就是他们当时的目的。</p>



<p class="wp-block-paragraph">但是你一旦开始融资了，口子开了，很多事情就由不得你了，后边有很多人会冲上来。而这些冲进去的人，也不是梁文锋都可以随意拒绝的。</p>



<p class="wp-block-paragraph">现在大家看到的数据已经不再是融 3 亿美金、投后估值 100 亿美金了，而是投前估值 450 亿美金，要融 100 亿美金，而且在这个里头，梁文锋自己要出 30 亿美金。现在已经变成这样的一个数字了，已经很难控制了。</p>



<p class="wp-block-paragraph">我们真正要问的是：</p>



<ol class="wp-block-list">
<li>为什么一开始一个融 3 亿美金、投后估值 100 亿美金的案子，突然变成融 100 亿美金、投前估值 450 亿美金、投后可能到 550 亿美金？</li>



<li>梁文锋怎么能够拿出 30 亿美金，或者叫 200 亿人民币？这个钱到底是哪来的？为什么要在这个项目里投这么多钱？难道这仅仅是热爱吗？</li>



<li>腾讯、阿里、IDG、Monolith 这些传闻要加入的基金，到底想在里边干什么？</li>



<li>国家大基金加进去以后，到底会给这个项目带来什么样的变数？</li>



<li>梁文锋拿到这么多钱以后，到底能够把 DeepSeek 带往何方？</li>
</ol>



<span id="more-3795"></span>



<h2 class="wp-block-heading">融资消息为什么会满天飞</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/blog_2.jpg" alt="一份写着 term sheet 的文件放在桌面中央，两侧分别是投资人与创始人用小喇叭悄悄放出消息，锁定期和保密条款以锁头图标标注，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">首先要跟大家讲一点，投融资过程中，这个消息应该是保密的。我的会员频道里有投资意向书解读的课程，如果是会员朋友，没看过的可以去看一下。</p>



<p class="wp-block-paragraph">做投融资的时候，最核心要签的那份文件叫投资意向书，英文叫 term sheet。在这个里头，只有两个条款是有法律效应的，其他条款都没有法律效应。很多人说，这两个条款是不是投多少钱、占多少比例？不是。</p>



<p class="wp-block-paragraph">第一个法律条款是<strong>锁定期</strong>。我跟你签了这个文件以后，在多长时间之内，你得跟我谈，不能跟别人谈去。</p>



<p class="wp-block-paragraph">第二个有效条款是<strong>保密</strong>。因为我们都不希望说，我在这跟你谈着呢，你四处找别人去抬价、去压价，搞这个事情，大家都不希望看到。所以真正这个协议里头有效的就这两条：在这一段时间内保密，不允许出去说。</p>



<p class="wp-block-paragraph">但是你说保密了，怎么这个消息还满天飞呢？我们这个消息非常非常多，待会咱们会稍微捋一下。</p>



<h3 class="wp-block-heading">投资人为什么会泄露消息</h3>



<p class="wp-block-paragraph">在这个过程中，有些投资人会偷偷地去泄露。原因是什么呢？他希望锁定份额，说我在里头，我锁定了，你们谁也别跟我抢，而且这个估值就这样了，不要再涨了。他们想去干这件事情。</p>



<p class="wp-block-paragraph">因为对于投资人来说，投多少钱、占多少比例，其实并不是特别重要。他真正关心的是你的估值。为什么呢？因为投资人是靠这玩意挣钱的。我现在投进去，你估值是多少，你以后要能涨到很高倍数，我才能挣到钱。</p>



<p class="wp-block-paragraph">那么我怎么能够保证它涨到很高倍数呢？我一定要保证前面那个数小。如果前面这个数就已经很大了，那我再往上涨几倍，压力就非常大。如果前面这个数相对来说比较小，再往上涨的压力就比较小，这个大家应该能够理解。</p>



<h3 class="wp-block-heading">创始人为什么也可能泄露消息</h3>



<p class="wp-block-paragraph">有的时候，创始人自己也会偷偷地出去泄露消息。他们的目的其实也是在估值。对于他来说，他肯定希望估值越高越好，因为一旦估值高了，他在里边所占的股份就值更多的钱。他可以直接找银行或者金融机构，拿这些股份去抵押，这个是他真正需要看到的。</p>



<p class="wp-block-paragraph">而且很多创始人希望什么呢？我这一轮高一些，那相当于我上台阶了。我下一轮一定是在这一轮的台阶上继续往前走。如果我这一轮不够高，我下一轮就不能跳得更高。所以他们都会有这个主观意愿去进行泄露。</p>



<p class="wp-block-paragraph">这种泄露出来的消息，通常都是什么知情人士、内部人士，都是这地方来的。指名道姓说谁泄露了信息，就违约了。所以这里要先跟大家普及一个小知识。</p>



<h2 class="wp-block-heading">DeepSeek 融资时间线</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/blog_3.jpg" alt="横向时间轴从 2 月 7 号延伸到 5 月 23 日，节点上依次摆放阿里传闻、外部融资、V4 发布、工商变更、大基金入场和降价标签，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">我们稍微捋一下这个时间线。</p>



<ul class="wp-block-list">
<li><strong>2 月 7 号</strong>，这一轮融资最早开始有消息。当时市场上有传闻说，阿里要以 100 亿美金的估值投资 DeepSeek 10 亿美金。后来阿里高层否认了，不是这么回事。但是大家也不用对这种否认太认真，你只要稍微差一个字，都可以算是造谣。他们否认了，但是这个事我们也不能当它完全没有。</li>



<li><strong>4 月 17 日</strong>，The Information 报道称，DeepSeek 首次寻求外部融资。这个肯定是跟 DeepSeek 内部已经确认的消息了，开始融资了，目标至少 3 亿美金，估值至少 100 亿美金。后来路透社也转发了这个消息。当时我们还专门录了节目，来给大家解释为什么是 3 亿美金的融资、估值 100 亿美金，这里头代表几层意思。有兴趣的可以回去翻这个节目。</li>



<li><strong>4 月 22 日</strong>，路透社转述 The Information 的消息，据称腾讯、阿里正在进行谈判，估值已经超过 200 亿美金了。这个事就往前走了。但是在这个时间点里头，腾讯跟阿里并没有出来说什么，DeepSeek 也没有出来说什么，因为不能说，说了就违约了。</li>



<li><strong>4 月 24 日</strong>，DeepSeek V4 发布。这算是一个非常里程碑式的时间点，就是我的新模型出来了，大家上。经常我们会在产品上线的时候进行融资，因为你产品上线的时候，是你整个数据、整个状态最好的时候。在这个时候融资，可以有一个更高的估值。</li>
</ul>



<p class="wp-block-paragraph">这里大家要注意，甭管是投资还是融资，基金方还是创始团队，真正关心的都是估值。</p>



<p class="wp-block-paragraph">在发布之后，很快 DeepSeek 就开始宣布降价。我还专门录过节目，说为什么它会宣布降价。但是有一点在当时的节目里并没有说：DeepSeek 宣布降价有一个非常核心的原因，用的人不够多。如果像 DeepSeek R1 发布的时候，所有人冲上去直接把它的服务器干崩溃了，它才不会降价。没什么人用，它就只能降价。</p>



<ul class="wp-block-list">
<li><strong>4 月 27 日</strong>，有工商信息显示，公司注册资金从 1,000 万增加到 1,500 万，梁文锋直接持股从 1% 上升到 34%。也就是 DeepSeek 已经基本上谈得差不多了，在开始为接收融资进行架构调整了。</li>



<li><strong>5 月 9 日</strong>，The Information 转述称，融资目标最高可能达到 500 亿人民币，梁文锋个人或出资高达 200 亿人民币，在本轮募资中占 40%。这个数字就很反常了。创始人参与自己公司投资这件事并不稀奇，但是占这么高，这个事非常非常奇怪。</li>
</ul>



<p class="wp-block-paragraph">而且在这个前后，还传出了一个消息，就是阿里退出了这一轮投资，说这个谈判破裂了，退出了。</p>



<ul class="wp-block-list">
<li><strong>5 月 22 日</strong>，彭博社发了一个报道，说 DeepSeek 向潜在投资人强调要继续开源，追求 AGI，不追求短期商业化；融资约 700 亿人民币，也就是 100 亿美金；投前估值 450 亿美金；潜在投资人包括国家大基金、腾讯、IDG。</li>



<li><strong>5 月 23 日</strong>，消息一出，DeepSeek 官方重新定价，说 DeepSeek V4 Pro 的二五折优惠期结束以后，价格永远调整为原价的 1/4。也就是这个调价就是永久的了，不会再发生任何变化了。说明什么？说明使用 DeepSeek 的人依然不够多。</li>
</ul>



<h2 class="wp-block-heading">梁文锋为什么要拿出 30 亿美金</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/blog_4.jpg" alt="梁文锋形象站在一张巨大的投资合同前，自己一手递出 30 亿美金筹码，一手握住写有领投方的印章，其他投资人围在外圈等待跟投，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">把整个时序理完了以后，咱们来讲第一个问题：梁文锋为什么要拿出 30 亿美金来？</p>



<p class="wp-block-paragraph">最早他准备拿 3 亿美金，给 DeepSeek 撑一个 100 亿美金的估值，把团队稳定住就完事了。后来发现不行，很多人冲进来，他无法拒绝。所以他一咬牙一跺脚说，来，我把 30 亿美金放进来。</p>



<p class="wp-block-paragraph">这个 30 亿美金代表什么意思？意思很简单，梁文锋是这一轮投资的<strong>领投方</strong>。一轮投资里头有很多人参与，出钱最多的那个人叫领投方。领投方有一个很特殊的权利，是什么呢？就是拟定合同。</p>



<p class="wp-block-paragraph">在这一轮投资里头，这个合同是由领投方和创始团队一起去拟定的。在这里头，就是梁文锋跟梁文锋自己把这个合同定下来。所有其他的人叫跟投方，你出的钱没有领投方多。跟投方通常是不会去修改这个大的合同框架的，他们可以加一些自己的条款和权利要求。</p>



<p class="wp-block-paragraph">比如说像我们以前，猎豹移动只要投资了，我们就有一个小要求必须要写在里头去，甭管我是多么小比例的跟投方，我都要加这一个条款：你这辈子不允许拿 360 的钱。这个就属于排他条款。</p>



<p class="wp-block-paragraph">360 其实也有类似条款。只要他投了，甭管他是领投方还是跟投方，他都会在里头写：你不允许拿腾讯的钱，不允许拿金山的钱，不允许拿很多人的钱。他排除得特别多。像我们当时只排除 360。</p>



<p class="wp-block-paragraph">这属于各个跟投方可以加这种小条款在里头，但是大的架构你是不能改的。所以梁文锋出这么多钱的唯一原因，就是他必须得是领投方，任何其他人出的钱不能比他多，合同的大框架得是他定。这样大家就理解了，为什么梁文锋要出这么多的钱。</p>



<p class="wp-block-paragraph">原来他想着出 3 亿美金，这事搞定了。后来发现搞不定了，他必须要出 30 亿美金，才可以把这个事情搞定。</p>



<p class="wp-block-paragraph">而且在这里头还要注意，有两家是相对比较纯粹的美元基金，一个叫 IDG，一个叫 Monolith。这两家美元基金有可能会去跟梁文锋签一致行动人协议。他们反正就是挣钱来的，对于你们这个公司到底怎么运作，没有特别高的要求。签了这种一致行动人协议以后，梁文锋所得到的控制权就会进一步扩大，其他人就没有办法去给他指手画脚。</p>



<p class="wp-block-paragraph">所以这是梁文锋为什么要出这么多钱。</p>



<h3 class="wp-block-heading">关于资金来源的个人猜测</h3>



<p class="wp-block-paragraph">这里还有一个个人猜测，没有任何事实依据的个人猜测。梁文锋前面做幻方量化肯定是挣了不少钱，但是到底挣了多少钱，其实谁也不知道。他这 30 亿美金到底交没交过税，是不是一个完全合法合规的钱？因为现在中国政府在搞什么呢？就是中国公民不可以在海外投资。那么他这 30 亿美金到底是一个什么情况，说不清楚。</p>



<p class="wp-block-paragraph">但是只要这一次把这 30 亿美金入股到 DeepSeek 里头去了，而且这一轮投资里头还有国家大基金在里头背书，那这个钱就算洗白了，你就不用再去想这个钱哪来的了。当然这个纯属个人猜测，没有任何事实依据，咱们要讲清楚。</p>



<h2 class="wp-block-heading">各方的诉求以及争斗</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/blog_5.jpg" alt="一张圆桌上摆着 DeepSeek 项目立方体，阿里、腾讯、IDG、Monolith 和国家大基金以不同颜色的小人从不同方向拉动绳索，绳索标签分别写着战略协同、佛系跟投、财务回报和上市想象，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<h3 class="wp-block-heading">阿里：战略投资与战略协同</h3>



<p class="wp-block-paragraph">下一件事，就是各方的诉求以及争斗。</p>



<p class="wp-block-paragraph">首先是阿里。阿里到底参与没参与？我相信他一定参与了。现在中国各大 AI 创始团队里头，阿里基本上全都投遍了，没有哪个他不投的。因为阿里后边有阿里云，中国现在大概有一半以上的大模型都是跑在阿里云上的，所以这一块他进来参与没有任何问题。</p>



<p class="wp-block-paragraph">像这种投资，有些叫财务投资，有些叫战略投资。像阿里、腾讯这种自己也去做 AI 的公司，他们一般叫战略投资。</p>



<p class="wp-block-paragraph">战略投资跟财务投资有什么区别呢？财务投资很简单，我只追求财务回报。我现在投进去，过几年你让我乘多少倍挣出来，完事了。而战略投资经常会追求战略协同，他们会在协议里边增加战略协同条款。</p>



<p class="wp-block-paragraph">刚才我们讲了，即使你不是领投方，你也可以在里边去追加条款。作为阿里来说，我在里边投资了，我就要求，比如说你必须要优先使用阿里云，你要跟阿里形成一些战略协同，你要去跟阿里做一些承诺，万一你玩不下去了，你的人要到阿里来上班。</p>



<p class="wp-block-paragraph">因为零一万物就跟阿里签的这种协议。零一万物最后做不下去的时候，它原来训练模型的团队就去阿里上班去了。</p>



<p class="wp-block-paragraph">这种投资人肯定是创始团队所不喜欢的。你有时候没办法，说我就缺这个钱，阿里愿意给，别人填不上这窟窿，那我就只能捏着鼻子认了。但是现在有人能填上这窟窿，那就可以把阿里踢出去，这没什么好说的。</p>



<p class="wp-block-paragraph">而且阿里进来的时候，它所希望锁定的估值是 200 亿美金。你要想把它踢出去，最简单的方式不是说你这个条款我不同意，那个条款我不同意，这显得你的格局很低，显得你斤斤计较，或者说你到底有一些什么样的私心，这个是不行的。</p>



<p class="wp-block-paragraph">最简单的把投资人踢出局的方式，就是直接用估值把它拉爆。你原来想要 200 亿估值入股，现在我到 450 亿了，你跟不跟吧？阿里想了想，说看你本身也不是很情愿的样子，那我就放过你了。所以阿里没进来，大概是这样的一个情况。</p>



<h3 class="wp-block-heading">腾讯：相对佛系的战略投资人</h3>



<p class="wp-block-paragraph">下一个是腾讯。你说腾讯不也是战略投资人吗？大家要注意，腾讯这个战略投资人相对来说是比较佛系的。</p>



<p class="wp-block-paragraph">因为我在猎豹移动的时候，腾讯也是我们的投资人，腾讯也是猎豹移动董事会 9 个人里的一个。腾讯那个董事，每一次都是等雷军说话。</p>



<p class="wp-block-paragraph">你这个投资里头，如果有一个人是领投方，特别强势的，他就会在下一轮投资之前具有绝对的话语权。原来在猎豹移动的时候，绝对话语权就是雷军的。每一次我需要投项目了，或者我需要在投资上做一些什么决策了，就要向董事会写邮件。所有人都不回邮件，都在等雷军回信。雷军说了“我同意了”，那么很快其他的回信就回来了，说我们都同意了。如果雷军提了什么问题，其他人就彻底不说话了，等我们把雷军的问题解决掉了，其他人再去往前推这个事情。</p>



<p class="wp-block-paragraph">所以腾讯的这种投资相对比较佛系。像腾讯投资的美团、投资的拼多多、投资的 B 站，投完了以后，它其实不太管。你有战略协同，咱们就协同一下；你没有，也无所谓。等你上市了以后，我就卖你的股票退出就完了。它是这样的一个状态。</p>



<p class="wp-block-paragraph">所以腾讯觉得无所谓，450 亿、500 亿我也都跟了，没什么问题。</p>



<p class="wp-block-paragraph">而且腾讯在当前这个状态，其实要比阿里要被动一些。阿里再怎么说，它这个千问系列现在已经千问 3.7 了，还算是中国大模型里头的第一梯队，算是跑得比较快的，算是能打的、有战斗力的一个。而腾讯折腾了半天，虽然挖了一个叫姚舜禹的人回来，从 OpenAI 挖回来，做了一个混元 3 的模型出来，没有任何声音。它到底做了什么，这东西到底好不好使，不知道。谁去测试过这东西？反正我是连测都懒得测的一个东西。</p>



<p class="wp-block-paragraph">在这样的情况下，一定要抓住 DeepSeek 这根稻草，说我们还是要上这个车的。所以这是腾讯的一个诉求。</p>



<h3 class="wp-block-heading">IDG 与 Monolith：美元基金的财务诉求</h3>



<p class="wp-block-paragraph">至于 IDG 跟 Monolith，这是两个美元基金，专门在国内投各种科技项目的。IDG 算是相对老牌一点，很多大家耳熟能详的项目都是他们投的。Monolith 是一个相对新一点的，像 Kimi 里头就有他们的投资。</p>



<p class="wp-block-paragraph">Monolith 的创始人应该叫曹曦，原来是红杉中国的。另外一个可能叫王田，叫 Tim 王，也是一个老牌投资人。他们是新募了一支美元基金出来，去投中国的 AI 项目和大模型项目。</p>



<p class="wp-block-paragraph">这是现在已经露出头的这几个投资机构的一些基本情况。</p>



<p class="wp-block-paragraph">为什么要讲他们的基本情况呢？就是刚才咱们讲了，信息泄露出来，就有可能是他们中间的几个泄露出来的。锁定估值、锁定份额，他们是有意愿去做这个事的。</p>



<p class="wp-block-paragraph">而且大家根据我刚才讲的，在猎豹移动里头，雷军有这么强势的状态，也能想明白为什么梁文锋要拿出 30 亿美金来，占这一轮的领投方位置。一旦他站住了这个位置，以后在 DeepSeek 里头，他还是一个人说了算。其他人你可以提意见，你可以单独找梁文锋谈，但是你想在各种审批、各种花钱的地方上去卡他脖子，没戏，想都不用想。</p>



<h2 class="wp-block-heading">国家大基金带来的变量</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/blog_6.jpg" alt="国家大基金以红色印章和人民币基金箱的形象进入画面，左侧连接美元基金和换汇通道，右侧连接芯片、人工智能和 A 股交易所大门，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">这里头还有一个没说的，就是大基金。</p>



<p class="wp-block-paragraph">大基金是国字头的，就是国家凑的一堆钱，让他们去投芯片、半导体、人工智能，做这个事情。</p>



<p class="wp-block-paragraph">大基金给钱，这里头大家可能第一个疑问是，到底是美金还是人民币？因为大基金肯定是人民币基金，对吧？前面咱们讲到的 IDG 和 Monolith 是美元基金，最开始给出的所有估值和融资额都是美元。那人民币基金怎么上去投美金呢？</p>



<p class="wp-block-paragraph">这个不用担心。人民币基金可以通过一个审批，然后用你手头的人民币去购汇，再去投资美元项目，这是没有问题的。这个大基金也投过一些中芯国际香港的公司，也是投的美金进去。它就是拿国内的人民币，走相应审批就可以换汇了，这个不用太担心。</p>



<p class="wp-block-paragraph">大基金号称是投 100 亿人民币，这也是一个传闻。注意，它不能超过梁文锋给的钱，梁文锋是给 30 亿美金，它这个可能是 15 亿美金。</p>



<h3 class="wp-block-heading">大基金最大的好处：A 股上市想象空间</h3>



<p class="wp-block-paragraph">大基金给钱最大的好处，大家知道是什么吗？就是 A 股上市。</p>



<p class="wp-block-paragraph">在国内，你一旦拿了这样的钱以后，最后总要思考一个问题，就是怎么退出。这个钱你拿完了以后，你说我最后还给你，加上利息还给你，没有人挣这个钱。大家都是希望你能够涨多少倍退出去，大基金也不例外。</p>



<p class="wp-block-paragraph">现在大基金号称是耐心资本，就是我不是特别着急催你退出，你可以稍微多做一段时间。前一段时间咱们讲的长鑫存储里头有一个很大的投资人，也是大基金。但是它给的钱也不是最多的，长鑫存储里给钱最多的是合肥城投，也是地方政府给钱给得最多。</p>



<p class="wp-block-paragraph">国家的这种大基金最喜欢干的事情叫锦上添花。他们一般不会干雪中送炭的事情。你们决心已经这么大了，配套资金已经这么齐全了，我再给一点，在这站个台。</p>



<p class="wp-block-paragraph">那你说凭什么让它来站台？在中国，你退出的时候有几种退出方式：</p>



<ol class="wp-block-list">
<li><strong>做废掉</strong>：这是最悲催的，大家都不希望看到。</li>



<li><strong>被并购</strong>：大基金投资完了以后，有很多项目是被内部并购掉了。因为中国做这种人工智能和芯片的很多公司，都是由大基金来投资的，那它就可以帮你去牵线搭桥，内部并购。</li>



<li><strong>还钱</strong>：这个谁也不希望看到这一步，但是你也不能把它漏掉，这也算是一种退出方式。</li>



<li><strong>港股上市</strong>：大基金投的一些项目是在港股成功上市的。要注意一点，所有大基金投的项目，到目前为止没有任何一个是在美股上市的。美国估计也不希望看到有大基金投的项目在美股上市，中国也不希望这个事情。所以一旦拿了大基金的钱，基本上美股上市这条路就算绝了。但是港股上市也算是一个选择。</li>
</ol>



<p class="wp-block-paragraph">但这都不是最好的退出方式。最好的退出方式只有一个，就是 A 股上市。为什么呢？因为 A 股是一个审批制的股市，港股也好，美股也好，都是注册制的，只有 A 股是审批制的。</p>



<p class="wp-block-paragraph">审批制背后的潜台词是什么呢？就是真正的优质资源极其稀缺。你说我想去投资，你投不到。我想去投大模型企业，发现大模型企业 MiniMax 和智谱都是港股上市的，他们没有在 A 股上市，太麻烦，搞不定这个事情。</p>



<p class="wp-block-paragraph">但是这边 DeepSeek 大基金投了，那它这个 A 股上市，基本上算是打了保票了。虽然你现在是美元状态，但是有大基金在里边，后边我们就做呗，拆 VIE，把它弄回国内来，在 A 股上呗，这都是可以的。</p>



<p class="wp-block-paragraph">如果能在 A 股上市，因为韭菜足够多，优质的资源足够少，那这个国运级产品 DeepSeek 就有可能直接把价格炒飞掉。这是大基金上来以后，其他这些投资人，包括 DeepSeek，他们最大的期望，就是带着我们上 A 股上市去。</p>



<h3 class="wp-block-heading">拿国资的钱也有风险</h3>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/blog_7.jpg" alt="一架天平左侧放着 A 股上市通行证和上涨曲线，右侧放着国资审计文件、警示灯和国有资产流失风险标签，DeepSeek 小模型站在中间谨慎前行，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">当然了，你拿大基金的钱也是有风险的。什么风险呢？大基金前面是出过事的，出过贪腐案，有一些大基金的创始人和管理者是被抓的。你如果拿了大基金的钱，最后发现你骗我的钱，你最后做废掉了，你有可能会被算作国有资产流失。</p>



<p class="wp-block-paragraph">前面紫光就干过这个活，拿了大基金的钱以后说我做芯片去了，最后啥也没做出来，那是要抓人的。所以国资的钱不是那么好拿的。</p>



<p class="wp-block-paragraph">但是这点，DeepSeek 我觉得问题不是那么大。你可以不喜欢它的产品，但是他们在国内的大模型圈子里头，还算是认认真真在做技术、在做产品的一家公司。</p>



<h2 class="wp-block-heading">真正隐秘的不是钱，而是谁来定义 DeepSeek</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/blog_8.jpg" alt="画面中央是写着 DeepSeek 定义权的方向盘，梁文锋握住方向盘，资本筹码、开源旗帜、A 股大门和风险枷锁分布在四周形成拉力，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">咱们把这事捋清楚了：这个钱是怎么涨上来的，梁文锋为什么给了这么多钱，各自在里头的诉求是什么样的，大家对他们的期望是什么样的，特别是大基金在里头到底起到一个什么样的作用。</p>



<p class="wp-block-paragraph">最后咱们说一个结论：<strong>真正隐秘的不是钱，而是谁来定义 DeepSeek。</strong></p>



<p class="wp-block-paragraph">梁文锋在这一次守住了控制权，拿了 30 亿美金进去，把强势的阿里踢出局了，引入了大基金，保留了想象空间。因为大基金进来以后，有可能 A 股上市。同时也给自己套上了枷锁，因为一旦大基金进来以后，你要做赔了，那是会被套上国有资产流失这种罪名的，是有可能去坐牢的。</p>



<p class="wp-block-paragraph">DeepSeek 不断降价，说明作为一个国运级产品，现在用的人其实不多。你每次看到它降价，你一定要相信没人使。</p>



<h2 class="wp-block-heading">拿到钱之后，DeepSeek 要去哪里</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/blog_9.jpg" alt="DeepSeek 小机器人带着一箱新融资现金站在岔路口，路牌分别指向模型训练、开源社区和 agent Harness，远处开发者社区以拼图网络连接在一起，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">下边我们真正要看的是什么？就是 DeepSeek 拿到钱之后，它到底要干什么。</p>



<p class="wp-block-paragraph">现在报道是它正在招募 agent Harness 的相关工程师和负责人，准备向 agent Harness 这个方向冲锋了。这是现在所有 AI 大厂共同的方向，甭管是 Anthropic、OpenAI、谷歌，还有像 xAI，都在向着一个方向冲锋。</p>



<p class="wp-block-paragraph">国内这些 AI 大厂也在努力，但是效果其实一般，因为现在国内这些 AI 大厂都在抄。虽然现在他们都在推出各自的产品，实际上也都是在原有基础上改来改去的，没有一个人是在做独立的 agent Harness 这样的产品。</p>



<p class="wp-block-paragraph">我们还是可以期待 DeepSeek 可以拿出一个完全不一样的东西出来。</p>



<p class="wp-block-paragraph">下面真正考验梁文锋的时刻到来了。他到底能不能在这么大估值、这么多现金的公司里头，继续保持方向，继续前进？</p>



<p class="wp-block-paragraph">做 agent Harness 跟原来做模型不太一样。原来做模型的时候，你可以闷头做，不用理别人。大家在外边传，今天 DeepSeek V4 出来了，6 月份要出 DeepSeek V4.1，然后要怎么怎么样，大家传，你不理他就完了。</p>



<p class="wp-block-paragraph">但是你一旦开始做 agent Harness，你就必须要跟开发者、跟社区紧密配合。外边再传各种消息，你就不能不理人了。而且你有这么多钱在这个里头，会有很多人向你提出要求，说我们要直接用，用完了以后怎么怎么样。这个后面看他能不能把握住了。</p>



<p class="wp-block-paragraph">希望 DeepSeek 依然可以继续前进，不断地给我们贡献有趣的故事。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<h2 class="wp-block-heading">背景图片</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-funding-rumors-valuation-control/background_1.jpg" alt=""/></figure>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>DeepSeek V4 发布没炸场，却靠降价掀起革命？</title>
		<link>https://lukefan.com/2026/05/01/deepseek-v4-price-cuts-disrupt-ai-agent-economics/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Fri, 01 May 2026 01:01:54 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[Claude Code 接入 DeepSeek V4]]></category>
		<category><![CDATA[Coding Plan 商业模式]]></category>
		<category><![CDATA[DeepSeek V4 100万Token上下文]]></category>
		<category><![CDATA[DeepSeek V4 Pro 和 Flash]]></category>
		<category><![CDATA[DeepSeek V4 价格]]></category>
		<category><![CDATA[DeepSeek V4 缓存命中价格]]></category>
		<category><![CDATA[DeepSeek V4 降价]]></category>
		<category><![CDATA[梁文锋]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3740</guid>

					<description><![CDATA[本文拆解DeepSeek V4连续降价如何改变AI模型使用成本，帮助开发者和低频用户判断是否还要购买Coding Plan或Token Plan。文章围绕DeepSeek V4降价、百万Token价格、缓存命中成本、DeepSeek V4 Flash与Pro怎么选展开，结合Claude Code写网站的实际体验，说明为什么Flash适合日常跑量，Pro更适合复杂Agent、事实核查和长程规划。也会分析Token Plan和Coding Plan的订阅逻辑，为什么低频用户可能更适合按量付费。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="DeepSeek V4 发布没炸场，却靠降价掀起革命？" width="900" height="506" src="https://www.youtube.com/embed/4MyGxyLRWJk?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-001.jpeg" alt=" DeepSeek V4 化作蓝色橡皮泥芯片站在中央，周围是被压低的 Token 价格牌、Coding Plan 订阅盒和被掀起的小桌子，构图像一张商业格局变化总览图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">DeepSeek V4 终于开始了属于它的革命，只是方法可能出乎了很多人的意料。</p>



<h2 class="wp-block-heading">革命不是发生在发布当天</h2>



<p class="wp-block-paragraph">DeepSeek 发布之后，很多人的第一反应是：就这？跑分没有炸裂，发布会没有高潮，实际上压根就没有发布会。梁文锋也没有站出来讲一个“AGI 改变世界”的宏大故事，什么都没有。</p>



<p class="wp-block-paragraph">但是几天之后，真正可怕的事情发生了。DeepSeek 没有推出什么 Coding Plan 或者 Token Plan，也没有把用户锁在一个订阅套餐里，而是直接掀桌子：<strong>连续降价</strong>。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-002.jpeg" alt="一只橡皮泥手把写着高 Token 价格和 Coding Plan 的小桌子掀翻，另一侧 DeepSeek 价格牌连续下落形成阶梯，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">这件事情的意义可能比跑分更大。因为它不是在说“我的模型比你强一点”，而是在说：你们靠高 Token 价格，再用 Coding Plan 去捆绑用户的玩法已经结束了。</p>



<p class="wp-block-paragraph">所以 DeepSeek 这一次的降价，其实是在给现在的 Coding Plan、Token Plan 泼冷水，直接说你们就是在坑人，咱这个才是实在人。</p>



<span id="more-3740"></span>



<h2 class="wp-block-heading">DeepSeek V4 发布后的微妙气氛</h2>



<p class="wp-block-paragraph">DeepSeek V4 发布以后，气氛有一点小诡异。原因很简单：期望越高，失望越大。大家期待的全面碾压、各种追平、国产算力全面验证、多模态、agent、coding 一起爆发，都没有来。</p>



<p class="wp-block-paragraph">跑分当然还是可以看的，但是没有出现去年 R1 发布时那种核爆级的震撼。所谓 R1 核爆级的震撼，最核心的也不是说它真的碾压、追平了，而是它特别便宜，便宜得简直没法看。</p>



<p class="wp-block-paragraph">这一次 DeepSeek V4 发布时，价格其实跟国内主流模型差不太多，各有长短。有些地方 DeepSeek 还稍微贵一点，有些地方它比别人稍微便宜一点，但便宜得也不是很多。</p>



<p class="wp-block-paragraph">DeepSeek V4 Pro 是一个很强的模型，特别是在代码、数学、agentic coding、长上下文方面。但它不是那种一眼看上去就把所有模型都打穿的东西。所以第一波舆论里，大家想尬吹它，因为准备了很久，却不知道从哪下嘴。</p>



<p class="wp-block-paragraph">梁文锋也没有出来讲故事，反而有点像是在说：你想骂就骂吧。最后写了四句：</p>



<blockquote class="wp-block-quote is-layout-flow wp-block-quote-is-layout-flow">
<p class="wp-block-paragraph">不诱于誉，不恐于诽，率道而行，端然正己。</p>
</blockquote>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-003.jpeg" alt="空荡荡的发布会舞台上只有一张写着四句短语的卡片，旁边是沉默的麦克风、跑分仪表和下班时钟，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">最后大家找不到夸的了，就开始吹 DeepSeek 从来不加班。别的大模型公司都是各种加班、各种卷，DeepSeek 到下班就让大家回家。虽然不加班是一件很棒的事情，但是在发大模型的时候说“模型做得可能不重要，但是它不加班”，吹起来就有点尬。</p>



<p class="wp-block-paragraph">DeepSeek 自己也说了，现在降价了，但等到华为昇腾 950 上来以后，还会再降价，比现在还便宜。不过那至少要到今年下半年或者明年才有可能出来，大家还可以继续拭目以待。</p>



<h2 class="wp-block-heading">贡献者名单和体感测试</h2>



<p class="wp-block-paragraph">还有人开始吹贡献者名单：里面居然把离职的人也都标注出来了。有人猜梁文锋是不是压力山大，或者有些委屈，想要吐槽一下。因为很多大厂都在挖他的人，比如罗福莉，还有一些去了字节、腾讯的人，都给标上了，也标明他们在哪个模型里做出过贡献。</p>



<ul class="wp-block-list">
<li>有人做过 R1；</li>



<li>有人做过 V3；</li>



<li>罗福莉做过 V2；</li>



<li>还有人做了 DeepSeek OCR 模型。</li>
</ul>



<p class="wp-block-paragraph">这些人的名字前面画了星号。</p>



<p class="wp-block-paragraph">实际上这种方式在国外很常见。国外大厂发软件时，会把即使已经离职的员工也标在上面；发论文时，也会把已经离职的员工或者贡献者标上去。但在国内比较少见，国内通常是领导标前面，离职了基本就没有名字。所以把离职员工标在上面，在国外算惯例，在国内是比较罕见的现象。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-004.jpeg" alt="一张橡皮泥贡献者名单横放在桌面上，名字旁有星号和不同去向的小箭头，左侧是论文署名栏右侧是国内公司组织架构牌，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">因此也没必要特别过度解读。梁文锋把他们标出来，并不是惦记着羞辱谁，或者跟大家诉苦。</p>



<p class="wp-block-paragraph">现在还有一些人开始做体感测试。因为跑分这件事，跟我们的体感是不一样的。有人拿它去写网站，或者去写小红书，跟 GRM、Opus 和其他模型比较，结论是 DeepSeek V4 在体感上还是相当不错的。</p>



<p class="wp-block-paragraph">但是体感很主观。我觉得好，你觉得不好，这都正常。所以有人录体感测试视频，或者写文章继续吹捧 DeepSeek V4。大家都吹成这样了，老范自己也去用了一下，下面会讲讲体验。</p>



<h2 class="wp-block-heading">真正的革命：连续降价</h2>



<p class="wp-block-paragraph">这一次，作为一个国运级产品，DeepSeek 真正开始革命并不是在它发布的那一天，而是在发布之后。DeepSeek 进行了连续降价，每过几天就降一次，价格一下把其他模型，包括这些 Coding Plan、Token Plan，全打穿了。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-005.jpeg" alt="一条向下的橡皮泥价格曲线穿过多个写着模型、Coding Plan、Token Plan 的价格柱，DeepSeek 小旗插在最低点，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<h3 class="wp-block-heading">当前价格</h3>



<p class="wp-block-paragraph">现在的价格大致是这样的：</p>



<ul class="wp-block-list">
<li>DeepSeek V4 Flash：输入 100 万 Token 的价格是 1 元；如果命中缓存，100 万 Token 是 2 分钱。</li>



<li>DeepSeek V4 Pro：输入 100 万 Token 的价格是 3 元；如果命中缓存，100 万 Token 是 2 分 5。</li>
</ul>



<p class="wp-block-paragraph">这个价格非常便宜。尤其是 Pro 的价格，2 分 5 就可以把信息输进去。</p>



<p class="wp-block-paragraph">官方同时说明，全系列模型输入缓存命中的价格都已经降到了首发价格的 1/10。该价格调整自北京时间 2026 年 4 月 26 日 20 点 15 分生效。当前 DeepSeek V4 Pro 模型是 2.5 折的价格，非常便宜，优惠期延长到 2026 年 5 月 31 日 23 点 59 分。也就是说，一直到 5 月底，都可以使用这个 2.5 折价格。</p>



<p class="wp-block-paragraph">这个价格可以说已经让 Token 价格无感了，随便用，感觉像没花钱一样。而且 DeepSeek 还说，等到昇腾 950 到线、到货以后，还会继续打折，大家可以稍微期待一下。</p>



<h3 class="wp-block-heading">按 100 万 Token 粗算</h3>



<p class="wp-block-paragraph">按照 100 万 Token 粗算，Flash 能有多便宜？假设一个 Agent 任务是 80 万 Token 输入、20 万 Token 输出，总计 100 万 Token。</p>



<ul class="wp-block-list">
<li>使用 V4 Flash，输入成本是 8 毛钱；</li>



<li>输出成本是 4 毛钱；</li>



<li>合计 1 块 2，还没有计算缓存。</li>
</ul>



<p class="wp-block-paragraph">这个价格已经非常便宜了。</p>



<p class="wp-block-paragraph">那 100 万 Token 的上下文到底有多少？很多。一本《鹿鼎记》大概总共是 200 万到 300 万字。</p>



<h2 class="wp-block-heading">一次实际使用体验</h2>



<p class="wp-block-paragraph">老范自己试了一次，把 DeepSeek V4 Pro 和 DeepSeek V4 Flash 挂到了 Claude Code 里。改配置文件就可以：默认模型是 DeepSeek V4 Pro，Opus 模型是 DeepSeek V4 Pro，Sonnet 模型是 DeepSeek V4 Pro；如果需要使用 Haiku 模型，也就是 Anthropic 自己那个特别小的模型，就调用 DeepSeek V4 Flash；如果要开 subagent，也就是子代理，也使用 DeepSeek V4 Flash。然后按照 Max 模式疯狂跑。</p>



<p class="wp-block-paragraph">这次让它做的事情是：现在有很多人在 GitHub 上分享 GPT-image-2 的提示词，比如画什么样的图应该用什么样的提示词，建立了一个大仓库来存放这些内容。于是就让它把这个仓库拉下来，建一个本地网站，可以搜索、查找这些提示词。</p>



<p class="wp-block-paragraph">一句话扔进去，它就开始干，基本上干完了，过程中没有什么错误，直接把网站做出来。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-006.jpeg" alt="橡皮泥电脑屏幕里一个本地提示词网站正在生成，旁边有 GitHub 仓库盒子、搜索框和 DeepSeek Pro 与 Flash 两个小机器人协作，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">总共花了大概 8 毛多钱。其中 6 毛多钱是 Pro 的价格，1 毛多钱是 Flash。Flash 的缓存命中率是 0，全都是按新输入来算；Pro 的缓存命中率是 98.7%。</p>



<p class="wp-block-paragraph">为什么会有这么高的缓存命中率？原因很简单：在写一个代码项目时，它会反复把这个项目的代码输入、输出，所以缓存命中率非常高。在这样的情况下，总共大概花了 8 毛多钱，就得到了一个网站。</p>



<p class="wp-block-paragraph">这也是为什么说，使用 DeepSeek 写网站时，Token 价格基本无感。花 8 毛多钱写出一个网站，而如果用 Codex 或者豆包 40 块钱的 Coding Plan，5 个小时额度可能就用完了。在 DeepSeek 这里，8 毛钱搞定。就算现在 2.5 折以后变成 2 块钱搞定，也依然可以接受，仍然是无感的。</p>



<h2 class="wp-block-heading">为什么降价就是革命</h2>



<p class="wp-block-paragraph">有人可能会说，这不就是降价吗？怎么就革命了？真不是大惊小怪。</p>



<p class="wp-block-paragraph">现在各个云厂商也好，AI 厂商也好，玩的游戏是：把 Token 价格定得很贵，也不降价。前面小米的卢伟冰还出来讲，说 Token 很贵，不可能降价，成本就在这里。然后你可以来买我的 Token Plan，或者买我的 Coding Plan。</p>



<h3 class="wp-block-heading">Coding Plan 和 Token Plan 的区别</h3>



<p class="wp-block-paragraph">为什么有的叫 Token Plan，有的叫 Coding Plan？区别主要在于：</p>



<ul class="wp-block-list">
<li>Coding Plan 通常只能编程；</li>



<li>Token Plan 通常会包含 STT、TTS、画图、搜索、embedding、RAG 等能力；</li>



<li>STT 是语音转文字；</li>



<li>TTS 是文字转语音；</li>



<li>如果是 Coding Plan，除了编程之外，其他能力往往不让用，还要再买其他 Token 才能使用。</li>
</ul>



<p class="wp-block-paragraph">这些 AI 厂商和云厂商，希望大家尽可能订 Coding Plan。订完 Coding Plan，你就相当于被绑在它的平台上了。</p>



<p class="wp-block-paragraph">大家都买 Coding Plan 的结果，就像大家去吃自助餐。有的人吃得多，有的人吃得少，平均下来商家肯定能挣钱。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-007.jpeg" alt="自助餐厅形状的订阅套餐柜台把用户围在里面，旁边单点 Token 小摊按实际用量称重收费，形成商业模式对比构图，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">比如很多自助餐厅都有生日免费。你生日免费了，不能一个人去吃，肯定会带一帮人去。这里面有人吃得多，有人吃得少，而且也不可能每次都照死了吃，绝大部分人的食量还是有限的。所以自助餐厅就能挣到比较多的钱。</p>



<p class="wp-block-paragraph">另外，这些云计算厂商和 AI 厂商都有很完整的服务体系：视频生成、图片生成、语音生成、数据库以及各种其他业务。只要你买了它的 Coding Plan，它就相当于把你绑在这里了，你不能再去买别人的，必须在它这里来。</p>



<p class="wp-block-paragraph">但是现在 DeepSeek 一下把桌子掀了。它说：你看，我现在写个网站，你们那边可能 5 个小时额度跑光了，在我这里几毛钱、不到一块钱就写好了。这个价格，还要什么自助餐？还要什么自行车？</p>



<h2 class="wp-block-heading">Coding Plan 玩家开始难受了</h2>



<p class="wp-block-paragraph">这样一来，做 Coding Plan 的人日子就不好过了。前面不但大家搞 Coding Plan，还给 Coding Plan 搞饥饿营销。</p>



<ul class="wp-block-list">
<li>智谱的 Coding Plan 买不着，每天早上 10 点要排队、要抢，还经常抢不到。</li>



<li>阿里 40 多块钱的 Coding Plan 直接取消了，必须买 200 块钱的，而 200 块钱的还经常买不着，经常下架。</li>



<li>字节的豆包 Coding Plan 也玩这个：买的时候突然告诉你，最便宜的 40 块钱下架了，必须买 200 的。</li>
</ul>



<p class="wp-block-paragraph">现在用户可以说：我不用了，直接吃多少付多少，直接用 DeepSeek，不需要这些 Coding Plan。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-008.jpeg" alt="用户从排队抢购 Coding Plan 的拥挤柜台转身离开，走向标着按量付费 DeepSeek 的明亮小窗口，货架上 40 元和 200 元套餐牌被取下，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">那前面喊着“这个价格很贵”的罗福莉怎么办？一拍脑袋，开源吧。现在把小米的 MIMO 2.5 全系模型通通开源，而且直接上 MIT 协议：不做任何修改，大家随便用，愿意商用就商用。反正已经赔本了，后边就只赚吆喝。</p>



<p class="wp-block-paragraph">其他这些人，比如智谱、阿里、Minimax、Kimi，现在就头疼了，估计正在连夜开会，讨论怎么调整价格策略。前面把菜标得很贵，逼着大家吃自助，现在被人把桌子掀了，人家直接亮底牌：这东西其实很便宜，大家直接在我这里买就可以，不需要买自助餐了。</p>



<h2 class="wp-block-heading">Flash 和 Pro 到底怎么选</h2>



<p class="wp-block-paragraph">很多人会说，Flash 很便宜，Pro 其实还是挺贵。现在 2.5 折便宜了，但 5 月 31 号以后是不是就变贵了？</p>



<p class="wp-block-paragraph">第一，5 月 31 号以后未必会变贵；第二，到下半年没准昇腾 950PR 上来以后，它又打折了。在中国，只有降价的，没有涨上去的，涨上去这件事很难。前面各个模型公司刚想涨价，想涨 Token，想涨 Token Plan，马上就被打回原形了。</p>



<h3 class="wp-block-heading">Flash 够用的场景</h3>



<p class="wp-block-paragraph">Flash 这个模型，日常写代码很够用。因为代码需要的知识相对比较少，改 bug、写前端、写脚本，用 Flash 模型没有太大问题。</p>



<p class="wp-block-paragraph">长上下文做一些理解，Flash 的性价比也很高。DeepSeek V4 Pro 的上下文是 100 万 Token，Flash 也是 100 万 Token。别看它便宜，它也有 100 万 Token 的上下文。做一些数学、代码竞赛，Flash 其实也够。</p>



<h3 class="wp-block-heading">必须上 Pro 的场景</h3>



<p class="wp-block-paragraph">那什么时候 Flash 不行，必须上 Pro？</p>



<ul class="wp-block-list">
<li>复杂 agent 的多轮规划；</li>



<li>需要规划很多事情，并进行多次 function call，也就是调用外部工具；</li>



<li>基于事实核查的任务；</li>



<li>财经研究；</li>



<li>节目脚本等需要更强底层知识和判断力的内容。</li>
</ul>



<p class="wp-block-paragraph">Flash 和 Pro 之间最主要的差距，是底层知识库大小。Flash 的底层知识库小一些，但运算能力其实不差，而且算得很快。</p>



<p class="wp-block-paragraph">所以现在使用龙虾、爱马仕，包括 Claude Code 这种 harness agentic，Flash 基本上都是够用的，不需要上那么多 Pro。正常配置就是：<strong>Flash 负责跑量，Pro 负责兜底</strong>。特别难的、比较难判断的、需要长程规划的任务，用 Pro；正常工作通通用 Flash，这样就会非常便宜。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-009.jpeg" alt="两个橡皮泥模型角色分工协作，Flash 推着大量轻任务小车快速通过，Pro 站在后方处理复杂规划地图和事实核查文件，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<h2 class="wp-block-heading">Token Plan 和 Coding Plan 的逻辑被打穿</h2>



<p class="wp-block-paragraph">随着 DeepSeek 的降价，Token Plan 和 Coding Plan 的逻辑就被彻底打穿了。绝大部分普通人根本不需要订阅，直接用 DeepSeek V4 的便宜 Token 就够了。低频用户可能每个月养虾的钱也就是几块钱，或者十来块钱，比买 40 块钱的最低套餐便宜很多。</p>



<p class="wp-block-paragraph">AI 厂商为了不让你买最便宜的套餐，会给 40 块钱的套餐起名叫 Lite，就是告诉你，这只是让你尝鲜的。真正干活，还要买 Pro，买更贵的套餐，至少 200 人民币以上，而且还直接下架这些最便宜的套餐。</p>



<h2 class="wp-block-heading">DeepSeek 为什么敢这么做</h2>



<p class="wp-block-paragraph">DeepSeek 跟这些大厂不一样。DeepSeek 自己没有电商，没有社交，没有短视频，没有云计算，也没有手机、汽车、办公套件、操作系统、浏览器、大规模企业 SaaS，这些它全都没有。</p>



<p class="wp-block-paragraph">阿里、字节、腾讯有这些东西，所以它们尽可能希望把你绑在平台上，不要出去。</p>



<p class="wp-block-paragraph">一旦你买了它们的 Coding 套餐，或者 Token 套餐，这种东西是有排他性的。就像吃自助餐，不可能在这家吃完自助餐以后，出去再吃碗面。自助餐的意思是，你一定要在它家吃饱，绝对不能再出去吃任何其他人的。</p>



<p class="wp-block-paragraph">DeepSeek 除了没有这些生态之外，还缺很多东西：STT、TTS、绘图、视频生成、音乐生成、Embedding、Rerank，它通通都没有。它只有一个文本模型，其他全都没有。</p>



<p class="wp-block-paragraph">所以 DeepSeek 的竞争方式就是：我的文本模型最便宜，你们就在我这里用。用完以后，如果你需要 TTS、STT，或者需要绘图，爱调谁的就调谁的，我不管。</p>



<p class="wp-block-paragraph">这就像它卖的面特别便宜，你在它这里吃完一碗面以后，出门再去吃俩包子，它也不管。这跟自助餐完全是不同的逻辑。所以 DeepSeek 根本不需要锁死用户。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-010.jpeg" alt="DeepSeek 小面馆只卖一碗便宜文本模型面，顾客吃完后自由走向语音、绘图、视频包子铺，远处封闭自助餐大楼用围栏锁住用户，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">再看 OpenAI、Anthropic、小米、字节、阿里，它们都是希望锁死用户：你只要来我这里，就别出门了，在我这一家全部吃完。这是很大的差异。</p>



<h2 class="wp-block-heading">开源模型与默认入口之争</h2>



<p class="wp-block-paragraph">还有一点很重要：DeepSeek V4 是一个开源模型，彻底开源。其他云计算厂商去薅它羊毛是必然的，也就是自己部署 DeepSeek V4，对外提供服务。</p>



<p class="wp-block-paragraph">与其让别人分流，不如 DeepSeek 直接给一个低价。你们自己掂量掂量，上了 DeepSeek V4 以后，到底能不能出我这个价格。出不来，会被人戳脊梁骨；如果出得来，还划不划算？不那么划算。这样就让用户尽量沉淀在 DeepSeek 这里。</p>



<p class="wp-block-paragraph">DeepSeek V4 其实是在抢这些 agent 的默认模型入口。单纯聊天或者做其他事情，缓存命中率可能没那么高；但越是跑 agent，比如养龙虾、养爱马仕这种东西，缓存命中率就越高，使用成本就越低。</p>



<p class="wp-block-paragraph">普通用户每天使用龙虾、爱马仕，可能也花不了几十万 Token。在这种情况下，一天成本可能就是几毛钱，或者一块钱左右。所以为什么还要去买那种 Coding Plan 呢？</p>



<h2 class="wp-block-heading">Coding Plan 仍然有适用人群</h2>



<p class="wp-block-paragraph">那 Coding Plan 是不是在某些情况下还是会比 DeepSeek V4 便宜？会。</p>



<p class="wp-block-paragraph">这就跟吃自助餐一样。如果大胃王都吃不回本，那自助餐就倒闭了，没有人会进去吃。这个价格一定会让很多人觉得自己能吃回本。大家抱着这样的心态进去以后，自助餐厅老板才能挣得盆满钵满。</p>



<p class="wp-block-paragraph">所以如果有些“大胃王”确实特别能吃，买 Coding Plan、Token Plan 也还是划算的。但是如果进来吃饭的都是大胃王，开自助餐的老板就该哭了。卖 Coding Plan 的人如果发现每个人都卡边掐沿地把所有 Token 消耗完，那就有点太过分了。</p>



<p class="wp-block-paragraph">甚至有人可以这样做：买一个 Lite 套餐，一个月 40 块钱，先把它烧完，然后再接着跑 DeepSeek。这个肯定是所有自助餐厅老板都不欢迎的食客。</p>



<h2 class="wp-block-heading">总结：DeepSeek V4 革命的是定价</h2>



<p class="wp-block-paragraph">DeepSeek R1 出来的时候，我就说这东西是国运级的，现在它依然是国运级的。作为国运级产品，降价到底会带来什么改变？低用量客户的 Token 基本无感了。我们随便养个龙虾，挂个 Claude Code，基本不会有任何感觉。</p>



<p class="wp-block-paragraph"><strong>价格稀缺性被打破，饥饿营销失效</strong>，这真的会给整个行业带来改变。什么叫国运级？就是带着整个国家，甚至带着整个世界一起发生改变的产品，才叫国运级产品。</p>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/img-011.jpeg" alt="写着价格稀缺性的橡皮泥锁被打开，饥饿营销沙漏停止流动，低价 Token 像道路一样连接普通用户、开发者和行业公司，浅色背景的商业评论版橡皮泥平面信息图的统一风格。"/></figure>



<p class="wp-block-paragraph">所以这一次 DeepSeek V4 革命的地方不是跑分，不是它做了别人做不了的事情，而是定价。它通过定价改变了整个商业格局。DeepSeek V4 最开始看跑分不够炸裂，但是价格上来以后，全行业的人现在都是晕头转向，不知道该怎么办。</p>



<p class="wp-block-paragraph">希望 DeepSeek 可以带来更多惊喜。感谢大家收听，请帮忙点赞，点小铃铛，参加 Discord 讨论群，也欢迎有兴趣、有能力的朋友加入付费频道。再见。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<h2 class="wp-block-heading">背景图片</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v4-price-cuts-disrupt-ai-agent-economics/background_1.jpeg" alt=""/></figure>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>GPT-5.5与DeepSeek V4，AI 竞争进入新格局！</title>
		<link>https://lukefan.com/2026/04/27/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Mon, 27 Apr 2026 11:18:21 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[agentic workbench]]></category>
		<category><![CDATA[Claude Opus 4.7]]></category>
		<category><![CDATA[Codex]]></category>
		<category><![CDATA[Codex对比Claude Code]]></category>
		<category><![CDATA[DeepSeek V4]]></category>
		<category><![CDATA[GPT-5.5]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[OpenAI超级APP]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3729</guid>

					<description><![CDATA[GPT-5.5和DeepSeek V4几乎同日发布，AI竞争正式进入新格局：不再只是比模型参数和榜单分数，而是转向Codex、Claude Code这类AI Agent工具，以及开源闭源、高价低价、算力自主的全面对抗。本文深入拆解GPT-5.5 vs DeepSeek V4、Codex超级App、Claude Opus 4.7对比、DeepSeek V4开源价值，帮助你看清谁在领跑、谁被高估，以及不同预算下该怎么选模型与工具。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="GPT-5.5与DeepSeek V4，AI 竞争进入新格局！" width="900" height="506" src="https://www.youtube.com/embed/ReomRMdklIg?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_1.jpeg" alt="两条新闻时间线在同一张书桌上交汇，一侧是写着GPT-5.5的现代终端界面，另一侧是写着DeepSeek V4的杭州发布海报，中央摊开的全球AI竞争地图上标出开源、闭源、算力与价格四条路线，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph"><strong>GPT-5.5</strong>和<strong>DeepSeek V4</strong>在同一天前后发布，AI竞争进入了一个新格局。2026年4月23日和24日这两天，全球AI产业迎来了一场小小的地震，而且这次地震很有意思。</p>



<h2 class="wp-block-heading">同日发布背后：AI竞争进入新阶段</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_2.jpeg" alt="对比式双联画面，左边是低调无舞台的OpenAI产品推送界面直接弹出GPT-5.5，右边是杭州会场中DeepSeek V4发布后立刻开源的代码仓库页面与人群，开源与闭源像两股河流正面相撞，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">GPT-5.5发布后9个小时，DeepSeek在杭州发布了V4。要注意的是，这次发布和前几天GPT Image 2的发布形成了鲜明对比。</p>



<p class="wp-block-paragraph">OpenAI过去每次发布重要版本，通常都会开发布会，至少也会有线上直播。但这一次什么都没有，直接就上线了。前几天GPT Image 2发布时，Sam Altman还陪着一屋子亚洲面孔的小哥讲了一晚上，除了他之外，剩下的人里大概有两到三个中国人，可能还有一个日本人、一个韩国人，几乎只有他一个白人。然而这次GPT-5.5什么仪式都没有，直接推送给Plus、Pro、Business、Enterprise用户使用。</p>



<p class="wp-block-paragraph">DeepSeek V4这边则是发布之后直接开源，本身就是一个开源产品。这意味着，全球AI竞争从此进入了一个新的阶段，不再只是比谁家的模型更强，而是<strong>开源和闭源、高价和低价、算力自主和算力依赖</strong>这几条主线开始正面交锋。</p>



<span id="more-3729"></span>



<h2 class="wp-block-heading">GPT-5.5发布方式反常，真正重点却不是模型本身</h2>



<p class="wp-block-paragraph">先说GPT-5.5。这次发布方式在OpenAI历史上都很少见。我今天早上起来，是Codex提示我升级，GPT的App也要求升级，网页打开以后就直接变成5.5了。</p>



<p class="wp-block-paragraph">其实这次真正卖的并不是GPT-5.5本身，真正的重点是前两天发布的<strong>Codex</strong>，待会再讲为什么。</p>



<p class="wp-block-paragraph">很多人一上来就看指标，觉得GPT-5.5很厉害，很多指标一下成了世界最强，在大多数指标上超过了Opus 4.7，好像OpenAI又回到了世界老大的位置。但现在所谓大模型到底有多强，这件事已经没那么重要了。真正重要的，是模型在三个地方的表现。</p>



<h3 class="wp-block-heading">1. 编程能力</h3>



<p class="wp-block-paragraph">像GPT-5.5或者Opus 4.7这种好的模型，可以用很少的Token快速找到答案，不会四处乱转。如果是比较差的模型，可能会绕来绕去，搞不清到底出了什么问题。</p>



<p class="wp-block-paragraph">即便是相对差一些的模型，放进Claude Code、OpenClaw这类Harness Agent框架里，事情也能做完，只是有的做得更痛快一些，有的慢一些，差距没有想象中那么大。</p>



<h3 class="wp-block-heading">2. 文档处理、知识工作与搜索</h3>



<p class="wp-block-paragraph">第二个是处理文档、知识工作和搜索，这也是我自己用得最多的场景。就我现在的使用体验来看，即使是笨一点的模型，你放进OpenClaw或者Azure里，差异其实不大。</p>



<p class="wp-block-paragraph">真正的区别在于<strong>配置兼容性</strong>。OpenClaw现在和OpenAI的兼容性最好。你说不给你配OpenAI，改配MiniMax行不行？也不是不行，只是每次升级时都得提心吊胆，这个比较痛苦。</p>



<h3 class="wp-block-heading">3. 解决特别难的问题</h3>



<p class="wp-block-paragraph">第三个差异是在解决特别难的问题上，比如一些数学难题。这次GPT-5.5出来后，有数学家说，它把人类数学又往前推进了一步，这当然很强。</p>



<p class="wp-block-paragraph">但这一块普通人是无感的，因为大部分人根本看不懂它到底做了什么。我自己看了半天也没看懂。你跟大多数人讲它到底干了什么，大部分人都理解不了。这块中国确实还差一点，我们压根没在这方面怎么努力。</p>



<h2 class="wp-block-heading">GPT-5.5发布前的小插曲：泄露与回收</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_3.jpeg" alt="昏暗的开发者界面中，一个Codex应用窗口意外露出GPT-5.5和两个未发布模型名称，随后一只手迅速把标签抹去，旁边计量条被重置归零，像一场仓促回收行动，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">这次GPT-5.5发布还有一个很有意思的小插曲。发布前一天，GPT-5.5泄露了。在Codex的App里，可以看到GPT-5.5以及另外两个还在测试、尚未发布模型的名字。</p>



<p class="wp-block-paragraph">随后OpenAI直接把模型收回，还把Codex的用量重置了。像我们平时每5小时有一个用量、每周有一个用量，因为它自己放错了，就给大家重置了一把。4月23日社区里，或者X上，确实有人在讨论这件事，但OpenAI官方并没有出来承认或否认。</p>



<h2 class="wp-block-heading">为什么说Codex才是OpenAI真正的重点</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_4.jpeg" alt="一台电脑前展开的本地工作台，Codex像中枢一样连接终端、浏览器、文件夹和应用窗口，另一侧隐约可见Claude Code的竞争身影，两者像在同一张操作台上对峙，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">为什么说Codex才是最关键的？因为OpenAI现在真正要竞争的，不是去解什么世界级数学难题，而是如何争抢用户、如何维持自己老大的位置。</p>



<p class="wp-block-paragraph">Anthropic现在已经说自己是老大了，年化收入300亿美元，OpenAI是250亿，差了50亿。估值方面，OpenAI是8500亿美元，而Anthropic已经可以说自己是一万亿美元。现在真正要抢的是，谁能做出更好的Harness Agent工具，或者说<strong>agency workbench</strong>。</p>



<p class="wp-block-paragraph">OpenAI已经明确把重心转向这一块。Sora、成人内容、广告节奏这些都不是最重要的，最重要的是去和Claude Code抢<strong>agentic workbench市场</strong>。OpenAI自己也说了，要做超级App。</p>



<p class="wp-block-paragraph">哪个才是超级App？我今天把机器上所有OpenAI的App都升级了一遍，结论是Atlas，也就是OpenAI自己做的浏览器并没有升级，所以这条线的重要性大概率在下降。反而是Codex一上来就升级，而且最近几天简直像疯了一样，经常一天升三次，因为我自己经常用，它会不停提醒你升级。这才是它真正的超级App。</p>



<h3 class="wp-block-heading">为什么不是ChatGPT网页版，而是Codex？</h3>



<p class="wp-block-paragraph">为什么ChatGPT网页版不是超级App，而Codex是？因为你要调用本地文件，要在本地打开各种应用，要在本地进行电脑操作，要在本地打开浏览器。这些事情如果你只在<a href="http://chatgpt.com/" target="_blank" rel="noreferrer noopener">chatgpt.com</a>网页里做，是不可能处理本地文件和本地App的。</p>



<p class="wp-block-paragraph">你说那用ChatGPT App不也可以吗？这里就有一个问题：如果你使用ChatGPT App，20美元套餐、100美元套餐、200美元套餐，现在主要区别只是有些模型能不能用。而如果你用Codex App，它是按流量算钱的。</p>



<p class="wp-block-paragraph">像我买了20美元的Plus账号，Codex额度就得省着用；如果买200美元的套餐，就可以敞开用。对于OpenAI来说，它当然希望更多人订200美元套餐，这符合它的商业逻辑，也符合它的商业叙事。</p>



<p class="wp-block-paragraph">所以，OpenAI押注的超级App就是Codex，因为它真正的竞争对手就是Claude Code。现在很多SaaS软件崩盘，法律圈不行了、金融圈也不行了、安全软件也在崩，很多冲击都来自Claude Code。现在Codex就是要正面对杀。所以这次真正发布的，不只是GPT-5.5，而是给Codex使用的整套能力。</p>



<h2 class="wp-block-heading">GPT-5.5是否全面碾压Opus 4.7？并没有那么夸张</h2>



<p class="wp-block-paragraph">那么GPT-5.5是不是全面碾压了Opus 4.7？是不是所有领域都领先了？这事没那么夸张。GPT-5.5在大部分主要指标上确实压过了Claude Opus 4.7，但OpenAI自己给的表格里也承认，Opus 4.7有几个指标依然领先。</p>



<h3 class="wp-block-heading">Opus 4.7仍领先的几个指标</h3>



<ul class="wp-block-list">
<li><strong>真实GitHub软件工程任务</strong>：要求模型修复真实开源项目的代码、理解整个代码仓库、通过测试套件。这是最接近“能不能在真实项目里干活”的指标。在这一项上，Opus 4.7依然领先。</li>



<li><strong>金融分析代理任务</strong>：测试模型在金融场景下检索数据、构建模型、财务推理、调用工具的综合能力。这一项里，Opus 4.7也依然领先。所以如果你是炒股的，或者做金融相关工作，还是老老实实用Opus 4.7，不要轻易转。</li>



<li><strong>MCP Atlas多工具协调任务</strong>：用来衡量agent使用MCP跨系统完成任务的能力。这一块Opus 4.7还是领先。</li>



<li><strong>跨学科高难知识与推理题</strong>：不允许使用外部工具，测试模型自身知识和硬推理能力极限。这个领域里，Opus 4.7也还是领先。</li>
</ul>



<p class="wp-block-paragraph">当然，大家最卷的还是编程能力，其中最关键的一项就是真实GitHub软件工程任务，而这一项恰恰是Opus 4.7领先。对此OpenAI是不服气的。</p>



<p class="wp-block-paragraph">OpenAI说Opus 4.7“过拟合了”，意思是它刷题了，所以这个分数不准，认为这一项有点作弊。至于其他指标，OpenAI并没有说，只是单独拎了这一项出来质疑。</p>



<h2 class="wp-block-heading">Anthropic的应对：承认问题，同时放出Mythos信号</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_5.jpeg" alt="一间研究实验室的长桌上摆着事故调查报告、带雾气的Claude Code界面和写着Mythos的密封文件夹，窗外风暴将至，既有承认失误的尴尬，也有准备后手反击的紧张气氛，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">Anthropic面对压力也做了两件事。</p>



<h3 class="wp-block-heading">第一件事：承认Claude Code质量问题</h3>



<p class="wp-block-paragraph">前一阵一直有报道说Claude Opus 4.6“降智”，出现brain fog这种脑雾现象，变笨了、变慢了、跑偏了、回复质量下降。很多人猜测，是它先把4.6降智，再推出一个可能比4.6稍微笨一点的4.7，让大家继续付钱。</p>



<p class="wp-block-paragraph">这个事情已经有很多媒体，包括《财富》杂志，都报道过。之前Anthropic一直不理，反正就是“爱用不用，我还是最强的”。但在4月23日GPT-5.5发布之后，Anthropic发了事故调查报告，承认Claude Code里确实出现了质量问题，但否认了故意降低模型能力的指控。</p>



<p class="wp-block-paragraph">它给了三个原因：</p>



<ol class="wp-block-list">
<li>默认推理等级变更了，原来应该使用较高等级推理，现在默认用了较低等级。</li>



<li>缓存优化引入了一些程序漏洞。像这种系统一定有大量缓存，因为提示词进缓存之后更便宜、处理也更容易。</li>



<li>为了精简冗余输出内容，调整了一些系统提示词。</li>
</ol>



<p class="wp-block-paragraph">这三个原因共同导致了模型输出质量下降。现在它说问题已经修复了。也就是说，GPT-5.5不出来，它不承认；GPT-5.5一出来，它就承认了。</p>



<p class="wp-block-paragraph">这让我想起苹果，经常有人说新手机一出，旧手机就变慢、续航就变差。苹果从来不承认，只会说它是为了更好地保护电池状态。Anthropic这次也算是又被抓住了一次。</p>



<h3 class="wp-block-heading">第二件事：Mythos可能成为后手</h3>



<p class="wp-block-paragraph">它做的第二件事，是前面有个很强的模型叫<strong>Mythos</strong>。Anthropic说这个模型已经强到没朋友，不能直接放出来，只能先邀请合作伙伴使用，先找自己的漏洞。这消息之前就传出来了。</p>



<p class="wp-block-paragraph">现在外界又开始讨论，Anthropic内部也并不觉得这有什么问题，甚至可能是在试探，要不要把Mythos放出来。因为Mythos比Opus 4.7还强。</p>



<p class="wp-block-paragraph">这次GPT-5.5发布之后，有人拿Anthropic自己之前放出的测试数据和GPT-5.5对比，基本上算五五开，大概一半指标Mythos更高，一半是GPT-5.5更高，还有一些相等。</p>



<p class="wp-block-paragraph">如果Anthropic被逼急了，真有可能直接把Mythos放出来。一旦放出来，影响可能非常大，因为这个模型特别擅长找漏洞，在网络安全领域属于专才。GPT-5.5在这一块未必有它强。如果Mythos真上线，我们现在跑的很多系统可能都要裸奔，这事是很吓人的。</p>



<h2 class="wp-block-heading">国内模型集体活跃，DeepSeek V4成为焦点</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_6.jpeg" alt="一张中国AI模型竞速图铺在桌面，Kimi、MiMo、混元、GLM、千问等名字像赛道上的选手向前冲，而DeepSeek V4以最醒目的旗帜成为焦点，背景隐约是杭州城市天际线，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">再说国内大模型，重点就是<strong>DeepSeek V4</strong>。其实国内这一周都很活跃，每天都在发新模型。除了DeepSeek V4，今天还有腾讯的混元3发布，这是尧舜禹从OpenAI被腾讯高薪挖回去后，待了几个月交出的第一份作业。不过在DeepSeek V4面前，混元3基本完全看不到，大家也不怎么讨论了。</p>



<p class="wp-block-paragraph">这一周发布的模型包括Kimi K2.6、小米的MiMo V2.5 Pro、混元3，以及今天要讲的DeepSeek V4。Kimi K2.6我现在就在用，是个很好用的模型。MiMo V2.5 Pro发布时号称开源模型第一名，也就是比所有开源模型评分都高。混元3水平相对差一些，达不到国内一流，可能比MiniMax稍微强一点，但和GLM 5.1、千问3.6、Kimi 2.6相比还是有差距，更不用说和小米的MiMo V2.5比了。不过它也算四平八稳，能干活。</p>



<h3 class="wp-block-heading">国内主要模型概况</h3>



<ul class="wp-block-list">
<li><strong>Kimi K2.6</strong>：1T参数量的MoE，激活32B，256K上下文，MIT许可商用，重点方向是长程编程、多模态和任务编排。</li>



<li><strong>MiMo V2.5 Pro</strong>：1T的MoE，100万Token上下文，重点是前端UI、dashboard等创意编程方向。</li>



<li><strong>混元3</strong>：2950亿参数，激活21B，对标Kimi K2和DeepSeek V3，算是刚起步。</li>



<li><strong>DeepSeek</strong>：在许可证上最开放，直接使用Apache许可证，什么都不改，你们拿去用，爱干嘛干嘛。</li>
</ul>



<p class="wp-block-paragraph">Kimi 2.6的价格大概是每百万Token输出2.5到4美元。前两天很多人还在嘲笑MiniMax 2.7的开源许可证，说它要求商用必须先通知它。Kimi则是“你直接用就行”。而在这方面最开放的其实是DeepSeek，直接上Apache许可证。</p>



<p class="wp-block-paragraph">这说明国内大模型竞争已经进入白热化。DeepSeek V4到底哪天登场，外人其实搞不清楚，但圈内人都清楚。中国这些大模型公司之间，包括中美大模型公司之间，真正做大模型的这几个人，要么是老同学，要么是老同事，谁家在干什么，大家大致都知道。所以大家都赶在DeepSeek V4之前把能发的先发了，不然光芒就全被盖住。</p>



<h2 class="wp-block-heading">DeepSeek V4的真正意义：靴子终于落地</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_7.jpeg" alt="一只高悬许久的靴子终于落在擂台中央，四周围观者原本充满期待，落地后有人惊叹有人沉思，擂台边放着DeepSeek V4的评测榜单与价格牌，象征预期回到现实，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">DeepSeek真正的位置是什么？它真的有那么强吗？现在已经有很多人出来吹了，但要讲清楚，DeepSeek V4真正的意义是<strong>“靴子落地了”</strong>。</p>



<p class="wp-block-paragraph">原来很多人都在期待，觉得DeepSeek一发布，我们就彻底赢了，彻底翻身了，超英赶美，超过OpenAI、Anthropic、谷歌。就算不能彻底超过，也可以在价格上极大超越。</p>



<p class="wp-block-paragraph">之前DeepSeek最火的时候，也就是R1发布时，它的能力并没有超越当时的GPT O1，只是特别便宜，用极致性价比达到了“将就能用”的状态，让中国人看到了希望：我虽然用不了你最好的那个，但我用这个稍微差一点的，也能解决问题。</p>



<p class="wp-block-paragraph">今年春节之前我就讲过，全中国、甚至全世界都在等一件事：DeepSeek什么时候出V4，V4出来会不会震惊世界。结果春节没出，后来传3月初、3月末、4月初、4月中旬、5月初，各种说法都有，但基本都是拍脑袋瞎猜，没有具体依据。</p>



<p class="wp-block-paragraph">大家为什么这么猜？就是因为大家都觉得，DeepSeek V4出来以后，会让整个中国模型扬眉吐气，会超英赶美。</p>



<p class="wp-block-paragraph">但现在结果出来了，并没有发生这件事。靴子落地了，它发了。在极个别的两个指标上，确实达到了世界第一，这个是有的；价格上也的确是极致性价比，肯定比Anthropic、Gemini、OpenAI便宜很多，大概只有它们十分之一的价格。但大部分性能，其实也就是国内一线模型的水平，和GLM 5.1、Kimi 2.6基本持平。</p>



<h3 class="wp-block-heading">关于华为芯片的现实情况</h3>



<p class="wp-block-paragraph">至于“使用华为芯片昇腾950”这件事，大家要注意，这种模型本身还是在英伟达芯片上训练出来的，最后为了适配华为芯片，可能还要做很多后期调试和调整。</p>



<p class="wp-block-paragraph">它之所以拖到现在才发，可能就是为了去适配华为芯片。而所谓很强的昇腾950芯片，要到明年年底才能量产，现在能买到的可能还是910一类的芯片。</p>



<p class="wp-block-paragraph">同时，美国商务部长卢特尼克已经说了，中国没有买任何一片H200，没有从英伟达直接买这种芯片。国内几个大厂，不管是字节、阿里还是腾讯，也都说已经向华为下了订单。那就别再神化了，继续往前走吧。DeepSeek也就可以把模型发出来了。</p>



<p class="wp-block-paragraph">DeepSeek V4是一个开源模型，Apache许可证，所以它一定兼容英伟达。它只能说，在兼容英伟达的基础上，也保证能在华为芯片上跑得比较稳定，效能还可以接受。大家一定要理解清楚它和华为芯片的关系。</p>



<h2 class="wp-block-heading">DeepSeek V4真正拿到世界第一的两项能力</h2>



<p class="wp-block-paragraph">那么DeepSeek V4到底哪两项达到了世界第一？</p>



<ol class="wp-block-list">
<li><strong>Codeforces Elo</strong>：也就是竞赛编程排名系统分数。分数越高，排名越靠前。DeepSeek V4拿到了3206分，基本就是世界第一。这一项是程序员公认的硬核编程能力标尺，不是刷题库能刷出来的，确实是真刀真枪。</li>



<li><strong>LiveCodeBench</strong>：也就是竞赛编程连续评测，题目来自Codeforces、AtCoder和LeetCode等真实竞赛平台，长期跟踪，不是一锤子买卖。它测的是模型在连续多个竞赛项目上的综合表现。DeepSeek V4拿到了93.5%，意味着做10道题能做对9道以上。</li>
</ol>



<p class="wp-block-paragraph">所以在这两块上，DeepSeek V4确实是世界第一。</p>



<p class="wp-block-paragraph">至于其他方面，就会稍微差一点。它自己也承认，在某些方面要比现在最顶尖的Opus 4.6、4.7差一些。现在在编程领域上，DeepSeek V4已经达到了Claude Sonnet 4.5的水平，也接近了Opus 4.6的非思考模式，但距离Opus 4.6思考模式以及Opus 4.7还是有差距。</p>



<h3 class="wp-block-heading">为什么发布时主要提Opus，而没提GPT？</h3>



<p class="wp-block-paragraph">为什么它在发布时主要提Opus，没有提GPT？有三个原因：</p>



<ol class="wp-block-list">
<li>前面OpenAI确实最强，这件事大家都公认。</li>



<li>之前Anthropic指责DeepSeek蒸馏，而OpenAI没说什么，没必要去点人家名字。</li>



<li>GPT-5.5刚出来，只比它早几个小时，这种稿子不可能临时重写。</li>
</ol>



<p class="wp-block-paragraph">所以DeepSeek V4专门讲了，我们比最新的Opus 4.6 thinking模式和Opus 4.7还是有差距。</p>



<p class="wp-block-paragraph">综合来说，现在各种评测、各种维度很多，在综合考量上，它有些指标甚至还没追上国内的GLM 5.1和Kimi K2.6，但有两个指标做到世界第一，也已经非常不容易了。只是它和最新的GPT-5.5相比，还是有不小差距，因为GPT-5.5比Opus 4.7还要更强一些。</p>



<blockquote class="wp-block-quote is-layout-flow wp-block-quote-is-layout-flow">
<p class="wp-block-paragraph">“不诱于誉，不恐于诽，率道而行，锐然正己。”</p>
</blockquote>



<p class="wp-block-paragraph">这次梁文锋发布稿件的结尾，引用了荀子的四句话。翻成大白话就是：你们随便骂，我也不解释，我用产品说话。</p>



<p class="wp-block-paragraph">所以，DeepSeek V4发布的真正意义，就是靴子终于落地了。不要再惦记着突然有个翻盘的救世主。就像打擂台一样，一个一个上去都被人打下来，然后说“我们还有个特别厉害的人没上来，等他上来给我报仇雪恨”。现在这个人也上来了，结果发现确实有优点，但总体还是有差距，大概就是这么个情况。</p>



<h2 class="wp-block-heading">当前AI大模型竞争格局：两大梯队已经成型</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_8.jpeg" alt="两层阶梯式看台，上层只有OpenAI与Anthropic两面旗帜高悬，下层则站着GLM、Kimi、DeepSeek、MiMo、MiniMax、千问、混元等中国厂商，远处还有Grok、Mistral、Muse Spark徘徊在边缘，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">现在整个AI大模型竞争，已经进入了一个新的格局，可以分成两大梯队。</p>



<h3 class="wp-block-heading">第一梯队：OpenAI与Anthropic</h3>



<p class="wp-block-paragraph">第一梯队只有两家：<strong>OpenAI和Anthropic</strong>，遥遥领先，全方位领先。旗舰模型能力最强，在各种Harness Agent或者agency workbench里表现极强，生态也非常完整，商业化能力很强，而且没有太多包袱。</p>



<p class="wp-block-paragraph">很多公司技术其实不差，但就是因为包袱太重、内部掣肘太厉害，追不上。这两家现在最强，能做长程任务、复杂工具调用、真实软件工程。当然，它们也比较贵。</p>



<h3 class="wp-block-heading">第二梯队：中国厂商集体追赶</h3>



<p class="wp-block-paragraph">第二梯队是一批追赶中的中国厂商：GLM、Kimi、DeepSeek、MiMo、MiniMax、千问、混元。这些模型现在基本已经达到了日常编程任务和挂在Harness Agent下面“能用”的程度。</p>



<p class="wp-block-paragraph">在某些日常工作里，单点能力已经够用了，而且价格极其便宜，基本只有美国模型的十分之一。</p>



<h3 class="wp-block-heading">其他玩家的尴尬处境</h3>



<p class="wp-block-paragraph">至于没说到的那些，就相对比较尴尬。</p>



<ul class="wp-block-list">
<li><strong>Grok</strong>：它在一些基础能力上可能比中国模型强，但在统合能力、编程等方面，未必比中国模型强到哪去，或者说即使强，用户也感受不出来。</li>



<li><strong>Muse Spark</strong>：也就是Meta最新出的、亚历山大·汪做出来的模型。它从开源转向闭源，到目前为止没有太多公开评测数据。它自己放出的一些数据，大概和混元3差不多，也许稍强一点，但应该也是泯然众生。</li>



<li><strong>Mistral</strong>：法国、也是欧洲最后的一根独苗。整个欧洲能做出模型的大概就是它们了，但现在做到什么程度，不太清楚。我个人感觉，它可能比中国模型还要再落后一点。</li>
</ul>



<p class="wp-block-paragraph">如果前面说的Grok、Muse Spark、Gemini这些模型都混到中国这个梯队里，那它们就危险了。为什么？因为中国模型开源，它们不开源；中国模型还便宜，价格只有它们十分之一。那它们就没有竞争能力了。所以这些模型必须冲进第一梯队，去和OpenAI、Anthropic竞争。</p>



<h2 class="wp-block-heading">Gemini与谷歌：压力可能是最大的</h2>



<p class="wp-block-paragraph">再说Gemini。Gemini前面有一段时间很强，Gemini 3、Gemini 3.1，特别是Nano Banana 2，确实很强。我之前订阅Gemini，一个原因是Nano Banana 2，另一个是Notebook RM，这两个产品几乎无可替代。</p>



<p class="wp-block-paragraph">至于它的模型本身，其实也就是“能用”，但一直没有特别惊艳。所以后来GPT出到5.4的时候，我就已经完全放弃使用Gemini模型了，通通转回GPT。</p>



<p class="wp-block-paragraph">在发布GPT-5.5之前，Sam Altman专门拉着一堆中国面孔的小哥开发布会，发布GPT Image 2，这其实就像是釜底抽薪，把谷歌最底下那层梯子抽掉了。红色警报也就结束了。</p>



<p class="wp-block-paragraph">所以Gemini现在的问题比较尴尬：它下周能不能出Gemini 4？就算出了，能不能超过GPT-5.5？如果出了还没Opus 4.7强，或者没GPT-5.5强，那发它干嘛？而且它现在连画图工具上的优势都没了，这就更麻烦。</p>



<p class="wp-block-paragraph">还有一点，谷歌内部没有Claude Code或者Codex这样的工具。它收购了几个，也自己做了几个，但彼此掣肘，谁也没做起来。谷歌自己的创始人都说不行了，必须往前走。谷歌内部员工也在抱怨，说你不让我在公司里用Claude Code，又一定要我用自己的工具，但你自己又做不出来，这样我的编程效率反而下降很多。所以谷歌现在的压力非常大。</p>



<h2 class="wp-block-heading">英伟达站台GPT-5.5，谷歌与Anthropic面临新压力</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_9.jpeg" alt="英伟达机房中整齐排列的GB200 NVL72阵列发出绿色光芒，前景是一块写着GPT-5.5速度不降的演示屏，远处谷歌TPU与Anthropic标志像被逼视的对手，场面充满硬件站台意味，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">在这里面，谷歌的压力一定是最大的。现在它只能强调自己的芯片强，TPU很强。Anthropic也出来站台，说Claude Opus 4.7是用TPU训练出来的，也算是站了谷歌这边。</p>



<p class="wp-block-paragraph">但你站了这个台，是有后果的。什么后果？就是这次GPT-5.5发布时，OpenAI干了一件特别绝的事情：<strong>速度没有降低</strong>。</p>



<p class="wp-block-paragraph">这非常奇怪，因为绝大部分新模型出来都会变慢。模型规模变大，才会更聪明，而规模变大以后按理说一定会变慢。还有一个通常规律是，新模型一定会更贵。</p>



<p class="wp-block-paragraph">GPT-5.5确实比GPT 5.4更贵，但为什么没有变慢？因为英伟达亲自站台，说GPT-5.5是在英伟达GB200 NVL72整套阵列上训练出来的，并且做了彻底优化。所以GPT-5.5的输出速度和GPT 5.4一样，每秒输出Token的速度没有变。这就非常强了。</p>



<p class="wp-block-paragraph">虽然它更贵，但GPT-5.5解决同样问题时，消耗的Token会少很多，所以整体价格变化其实没那么大。这就是英伟达站台带来的效果。</p>



<p class="wp-block-paragraph">Anthropic之前说自己是用谷歌训练的，那黄仁勋这种人是会记仇的，反手就给你来一巴掌：GPT-5.5就在我这儿，而且今天黄仁勋还给英伟达全员发信，要求大家都上Codex，因为这东西是在我们这儿训练出来的，是我们的亲儿子。</p>



<p class="wp-block-paragraph">接下来就要看Anthropic怎么回击了，是不是会直接把Mythos拎出来，这很值得观察。还有就是谷歌下周到底能不能拿出一个让人惊艳的Gemini 4，我觉得可能性不大。就算拿出来，应该也不会特别惊艳。</p>



<p class="wp-block-paragraph">而且现在真正竞争的是<strong>AI Agent或者agentic workbench</strong>这一块，谷歌和Grok在这方面都比较弱。Grok还在上蹿下跳，想买Cursor；谷歌在这块其实已经“买过一家”了，但买回来以后内部盘根错节，谁也发不上力，本来有些产品还不错，现在也都用不起来了。</p>



<h2 class="wp-block-heading">普通用户到底该怎么选？GPT-5.5、Claude还是DeepSeek</h2>



<p class="wp-block-paragraph">最后回答一个问题：我们到底该用谁？是用DeepSeek，还是用GPT-5.5？</p>



<h3 class="wp-block-heading">如果你不差钱</h3>



<p class="wp-block-paragraph">如果你不差钱，果断冲<strong>Anthropic的Claude Opus 4.7，加上Claude Code</strong>。它非常适合复杂工程、长程agent、企业级任务，目前这块还是做得最好的。</p>



<p class="wp-block-paragraph">Codex加GPT-5.5虽然今天发布了，但还没有真正经过足够多实际任务的验证，还得再等一等。不过如果你不想被Anthropic平台完全绑定，也可以用Codex加GPT-5.5，我觉得是有机会赶上的。黄仁勋都发全员信了，说明这条线非常被看重。</p>



<h3 class="wp-block-heading">使用Codex + GPT-5.5时的一个关键设置</h3>



<p class="wp-block-paragraph">但要注意一点，如果你上Codex加GPT-5.5，有一个配置一定要改。原来5.4默认使用快速模式，现在你要把它改成普通模式。</p>



<p class="wp-block-paragraph">因为快速模式下，GPT 5.4会消耗1.5倍Token，你经常会发现用着用着额度就烧光了，而且GPT 5.4不允许改回去。但GPT-5.5是允许改回普通模式的。改回去以后，就按一倍速度烧Token，会省很多。</p>



<p class="wp-block-paragraph">我现在用GPT-5.5，把它改成普通速度输出以后，感觉甚至比GPT 5.4还更耐用，而且它输出的Token更少，消耗也更低，这一点一定要注意。</p>



<h3 class="wp-block-heading">如果你用OpenClaw</h3>



<p class="wp-block-paragraph">你直接用OpenClaw去挂GPT-5.5也没问题。我今天早上第一件事，就是打开Codex，下命令让它把我的OpenClaw小龙虾升级到最新版本，把本地Codex CLI也升级到最新版本，然后在OpenClaw里把GPT 5.4替换成GPT-5.5。</p>



<p class="wp-block-paragraph">一个指令下去，这些就都升级好了。现在我在OpenClaw里已经可以直接用GPT-5.5了。</p>



<h3 class="wp-block-heading">如果你预算有限</h3>



<p class="wp-block-paragraph">如果你还想再省点钱，也可以。像我这种预算比较紧的，就买国内模型的Token套餐。我现在用的是MiniMax M2.7的套餐，真的是便宜量大，虽然笨一点，但是量足。再配一个GPT Plus套餐兜底，GPT Plus是通过Codex挂到龙虾里去的。</p>



<p class="wp-block-paragraph">现在我的正常任务用MiniMax就可以跑。如果你愿意，也可以换到GLM或者DeepSeek V4-Pro之类的模型，效果还会更好。所有非常难的任务，或者需要总结归纳的任务，遇到难题的时候，再专门切到GPT-5.5去做就可以了。</p>



<h3 class="wp-block-heading">图像生成怎么选</h3>



<p class="wp-block-paragraph">要画图的话，一定要用<strong>GPT Image 2</strong>，那个东西是真的香，非常好使。我现在大量背景图和标题图都已经转到GPT Image 2了，这个一定要用。</p>



<h3 class="wp-block-heading">我会不会转到DeepSeek V4？</h3>



<p class="wp-block-paragraph">至于DeepSeek V4，我会不会完全转过去？应该不会。因为DeepSeek V4估计会有很长一段时间算力紧张，华为芯片还没真正买回来，也还没交付。其他家，比如字节之类会不会部署它，还得再看。</p>



<p class="wp-block-paragraph">如果字节部署了DeepSeek V4，我有可能去试一试。现在字节的code plan里我已经可以用GLM 5.1和Kimi K2.6了，我会更多地用Kimi K2.6。</p>



<p class="wp-block-paragraph">至于DeepSeek V4那两个拿第一的项目，对我来说基本无感，因为我并不需要它去做编程竞赛这类任务，所以我未必会用它。等后面DeepSeek V4的算力宽松一些，我可能会测试一下。现在要用的模型太多，已经试不过来了。</p>



<h2 class="wp-block-heading">总结</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/gpt-5-5-deepseek-v4-open-source-agent-ecosystem-competition/blog_10.jpeg" alt="一张收束全篇的总结画面，左侧是标着GPT-5.5与Codex的超级App工作台，右侧是落地后的DeepSeek V4靴子和开源卷轴，中间站着一位普通用户在预算、任务类型与工具选择之间做权衡，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">总结一下，<strong>GPT-5.5确实真香</strong>，但真正有价值的不是GPT-5.5本身，而是<strong>Codex</strong>，它才是OpenAI押注的超级App。</p>



<p class="wp-block-paragraph"><strong>DeepSeek V4</strong>真正的作用，是让大家别再等什么救世主了，靴子已经落地，是骡子是马都拉出来了。它符合预期，但没有超出预期。</p>



<p class="wp-block-paragraph">至于到底用哪个，还是要根据各自的预算情况、上网条件，以及你实际要解决的问题来决定。大概就是这样。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>DeepSeek融资别急着冲！100亿美金估值最危险的是退出难！</title>
		<link>https://lukefan.com/2026/04/20/deepseek-300m-funding-10b-valuation-vie-governance-shift/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Mon, 20 Apr 2026 01:34:46 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[DeepSeek R1]]></category>
		<category><![CDATA[DeepSeek V4]]></category>
		<category><![CDATA[DeepSeek估值100亿美金]]></category>
		<category><![CDATA[DeepSeek融资]]></category>
		<category><![CDATA[幻方量化 DeepSeek关系]]></category>
		<category><![CDATA[投后估值100亿 3亿融资]]></category>
		<category><![CDATA[梁文锋]]></category>
		<category><![CDATA[美金融资 VIE架构]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3711</guid>

					<description><![CDATA[DeepSeek融资3亿美金、投后估值100亿美金，这轮消息真正值得看的是融资结构、监管切割、人才争夺与退出风险，而不只是数字大小。本文拆解DeepSeek融资传闻、100亿估值逻辑、VIE架构影响、3%股权含义，以及DeepSeek V4发布时间压力，说明这更像一次为估值锚定、团队稳定和持续经营服务的结构调整。若按可比公司PS看，DeepSeek估值未必贵；但参考大疆案例，DeepSeek融资后不上市、退出周期长，才是投资人最该警惕的核心问题。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="DeepSeek融资100亿估值背后，真正关键不是钱？" width="900" height="506" src="https://www.youtube.com/embed/6R68_ifugGw?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/blog_1.jpeg" alt="夜色中的金融新闻编辑部，一张写着“DeepSeek 3亿美元融资、投后估值100亿美元”的快讯单被按在木桌上，旁边散落放大镜、钢笔、旧式计算器和全球媒体报纸剪影，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">突然有消息传出，<strong>DeepSeek 要融资 3 亿美金，投后估值 100 亿美金</strong>。作为一个曾经的投资人，我想跟大家讲一讲这里面几个容易被忽视的点。</p>



<h2 class="wp-block-heading">消息源与基本背景</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/blog_2.jpeg" alt="两份国际媒体报道摊开放在桌面上，一份标题为The Information，一份为Reuters，报道页边缘压着“4月17日”的日期纸条，桌角有沉默未回应的公司印章，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">这个消息是什么时候爆出来的？4 月 17 号，The Information 先爆出来，路透社也进行了转发。报道的内容是：据两位知情人士透露，DeepSeek 现在正在进行一轮&nbsp;<strong>3 亿美金的融资，投后估值 100 亿美金</strong>。</p>



<p class="wp-block-paragraph">不过，DeepSeek 官方并没有出来确认或者辟谣，而是选择了沉默。所以我们也不能说，因为是路透社、The Information 这种国际主流媒体报道的，就一定是真的。它们有时候也会出错，只是相对靠谱一点。</p>



<p class="wp-block-paragraph">今天主要想讲的是，这里面有几个普通人很容易产生的误判。</p>



<span id="more-3711"></span>



<h2 class="wp-block-heading">三个常见误判</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/blog_3.jpeg" alt="三扇并排的小门分别写着“数字很大”“创始人低头”“是不是要上市”，门前站着困惑的读者，门后隐约露出融资合同、监管文件和资本市场钟楼的不同景象，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<h3 class="wp-block-heading">误判一：觉得 100 亿美金和 3 亿美金都“非常大”</h3>



<p class="wp-block-paragraph">第一种误判，是觉得 100 亿美金很多，3 亿美金也很多。对于普通人来说，这确实是天文数字，一听 100 亿美金，立刻就会被震住。</p>



<h3 class="wp-block-heading">误判二：觉得梁文锋终于“低头了”</h3>



<p class="wp-block-paragraph">第二种误判，是觉得梁文锋终于低头了。DeepSeek R1 出来的时候，很多大厂，像阿里、字节、腾讯，都冲上去说愿意给钱，甚至愿意给 10 亿美金。</p>



<p class="wp-block-paragraph">当时梁文锋的态度是：我不需要钱，我有的是钱。因为他背后是幻方量化，中国最挣钱的量化基金之一。虽然现在经过政策调整之后，可能已经不能算最挣钱的了，但仍然在第一梯队里，去年的收益也还是非常好。</p>



<p class="wp-block-paragraph">所以这一次融资，大概率跟幻方量化的业绩没有特别大的关系，但可能会和一些<strong>监管收紧</strong>有关。</p>



<h3 class="wp-block-heading">误判三：觉得 DeepSeek 是不是要上市了</h3>



<p class="wp-block-paragraph">第三种误判，是很多人会觉得 DeepSeek 是不是要上市了。现在 MiniMax 已经上市了，智谱也上市了，而且市值非常高。Kimi，也就是月之暗面，现在也在准备上市，刚融了一轮，印象里估值大概 160 亿美金。</p>



<p class="wp-block-paragraph">那是不是 DeepSeek 也是准备上市，先在上市之前融一轮，让既得利益者上车，大家一起出去割韭菜？很多接触 A 股的人会有这种想法，但这其实也是误判。</p>



<h2 class="wp-block-heading">六个反常识的细节</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/blog_4.jpeg" alt="一张复杂的融资结构图铺满桌面，美元符号、VIE架构框图、香港交易所剪影、3%股权圆饼图和“固定估值”印章同时出现，像一份被圈点批注的投资备忘录，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<h3 class="wp-block-heading">第一，这是一笔美金融资，不是人民币融资</h3>



<p class="wp-block-paragraph">第一个细节，这是美金，不是人民币。这个一定要注意。一旦是<strong>美金融资</strong>，项目就要搭 VIE 架构，要瞄准全球市场。真要上市，也只能去香港，不可能在 A 股上市。所以它不接受人民币基金的投资。</p>



<p class="wp-block-paragraph">很多人会说，DeepSeek 后面一定有政府背景。但问题是，政府能不能直接拿出美金来投这样的项目？虽然现在有一些美元基金里也有国资成分，但它已经不是那种可以直接拿国资钱来投的模式了。所以重点是，这是美金。</p>



<h3 class="wp-block-heading">第二，3 亿美金对应的股份只有 3%</h3>



<p class="wp-block-paragraph">第二个细节，投 3 亿，估值 100 亿，投资人能占多少股份？答案是&nbsp;<strong>3%</strong>。这也是一个很重要的点。</p>



<p class="wp-block-paragraph">为什么？因为以前写投资协议的时候，5% 是一个坎。这个没有明文规定，但它是个潜规则。够了 5%，你在董事会里可能有席位；不够 5%，通常就没有董事会席位。</p>



<p class="wp-block-paragraph">没有董事会席位，意味着公司很多事可以不告诉你，也不想让你定规矩，也不想有事没事向你汇报。你就是来出钱的，其他事情少管。所以这个 3%，本身就是有含义的。</p>



<h3 class="wp-block-heading">第三，100 亿美金这个估值可能是固定的，不谈判</h3>



<p class="wp-block-paragraph">第三个关键点是，100 亿美金这个估值，很可能是固定的，不谈判。以前投项目，主要谈两件事：</p>



<ol class="wp-block-list">
<li>投不投；</li>



<li>如果投，最关键的就是估值。</li>
</ol>



<p class="wp-block-paragraph">投资人出去投项目，一定更喜欢低估值的项目，而不是高估值。因为估值压得越低，下一轮涨上去的时候，赚得越多。所以所有投资人都会和创始人反复压价，说你这里不行，那里有问题，你得再便宜一点。</p>



<p class="wp-block-paragraph">但这次看起来不是这样。它的态度可能是：<strong>我就是 100 亿，你认就来投，不认就别来</strong>。属于非常硬气的公司才会这么干。初创公司一般没这个条件，但 DeepSeek 确实可能有。</p>



<h3 class="wp-block-heading">第四，3 亿美金这个额度也可能是固定的</h3>



<p class="wp-block-paragraph">第四个点，3 亿这个数不光代表 3%，还代表额度是固定的。这里还牵涉到投前估值和投后估值的区别。100 亿美金是投后估值，那投前估值其实就是 97 亿，投 3 亿进去以后变成 100 亿。这个 3 亿是写死的数字。</p>



<p class="wp-block-paragraph">很多项目不是这样。很多项目会说，投前估值是多少，你们愿意给多少钱就往里给，越多越好。比如也是 97 亿投前，有人投 5 亿，有人投 10 亿，最后投后估值加到 110 多亿，外部股份占到 10% 以上，这都很正常。</p>



<p class="wp-block-paragraph">但 DeepSeek 这一轮不是这样，它看起来是直接锁死：<strong>我就融 3 亿，额度固定，先到先得</strong>。你们别跟我谈条件，也别谈别的。</p>



<p class="wp-block-paragraph">而且到目前为止，没有 BP 传出来。BP 就是商业计划书。没有财务报表，没有路演材料，什么都没有。也就是说，有人已经开始接触了，但 DeepSeek 并不给大家充分审核它的机会。你想审账，别费劲；就这么多钱，就这么多估值，就这么多额度，爱来不来。它是这么一种玩法。</p>



<h3 class="wp-block-heading">第五，这类案子通常有领投方，而这次大概率还是幻方量化</h3>



<p class="wp-block-paragraph">第五个点，按照以前的经验，这类项目里通常会有一个领投方。正常情况下，是由领投方来确定估值和大的协议框架，然后其他跟投方在里面签字，认领额度就完了。跟投方一般没有能力去谈条款，都是领投方确定。</p>



<p class="wp-block-paragraph">那么这个案子里的领投方是谁？大概率就是幻方量化。原来 DeepSeek 和幻方量化之间的关系，本来就有点不清不楚。现在有可能是因为国家对于量化这一块的管理越来越严格，所以需要画出一条更清晰的界限，大概是这么个背景。</p>



<h3 class="wp-block-heading">第六，融资背后真正的驱动，不只是钱</h3>



<p class="wp-block-paragraph">那为什么 DeepSeek 要在这个时候开始融资？</p>



<h4 class="wp-block-heading">原因一：被挖人挖惨了，需要一个估值锚定</h4>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/blog_5.jpeg" alt="一间AI办公室里，几位核心工程师坐在电脑前，窗外伸来多只写着字节、腾讯、小米的邀请函与橄榄枝，桌上则摆着一块写有“100亿美元估值锚定”的铭牌，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">第一个原因，大家都看到了，就是被挖人挖惨了，需要一个市值来做锚定。AI 现在绝对是最热的行业，里面也都是最强的人在做。一旦 DeepSeek R1 到了风口浪尖，大家会觉得这代表中国，这就是中国 AI 的门面。</p>



<p class="wp-block-paragraph">那接下来会发生什么？一方面是有人冲上来说我要投资；另一方面，一堆投资人和大佬会直接绕过公司，去跟每一个核心成员谈，说你出来吧，我投资你，或者我给你很多钱。</p>



<p class="wp-block-paragraph">这种事情，不是靠多发点工资就能解决的。即使是 OpenAI，也不可能靠发薪水把人全留下。像 Meta 前面说 1 亿美金挖人，那个绝对不只是薪水，更大的部分一定是股票、期权。你必须靠这样一个锚定来把人留下来。</p>



<p class="wp-block-paragraph">DeepSeek 大概率也是一样。员工进去以后，一部分是薪水，另一部分是期权或者股票。如果公司从来没有融资过，就没有明确估值。你说我给了你多少股，这些股到底值多少钱，没人知道。现在一旦有了&nbsp;<strong>100 亿美金这个锚定值</strong>，你原来拿了多少股，公司总股本是多少，一除，就知道自己大概值多少钱了。这个锚定非常重要。</p>



<p class="wp-block-paragraph">这一年里，字节、腾讯、小米都在拼命从 DeepSeek 挖人。比较有名的例子，比如罗福莉。当时 DeepSeek R1 刚出来、正火的时候，就传出小米用千万年薪挖罗福莉。一开始还否认了一段时间，后来等小米发自己的 MiMo 模型时，就承认她确实在那里了。中间那段时间，她显然已经在小米工作了，只是想稍微留一点面子，没有立刻公开。</p>



<p class="wp-block-paragraph">这两天还有人去了字节，据说直接拿了上亿人民币。当然，这里面肯定也有很大一部分是字节的股票。虽然字节没有上市，但字节的市值相对来说是比较确定的，因为它会定期做老股回购。你说一个人拿了上亿，这件事是相对容易被标注出来的。</p>



<p class="wp-block-paragraph">如果 DeepSeek 一直不做融资、不做估值锚定，大家就会一直挖它的人。梁文锋再厉害，也不可能一个人扛住所有事情，还是需要一个稳定的团队，项目才能继续推进。</p>



<h4 class="wp-block-heading">原因二：监管可能收紧，幻方量化无法再无限输血</h4>



<p class="wp-block-paragraph">第二个原因，可能就是幻方量化那边的监管会收紧，没办法再无限输血。原来你说我给你一些钱就够花了，现在可能不行了。钱一多，就必须把账目审计清楚，哪块钱属于谁，要写得很清楚才可以。</p>



<p class="wp-block-paragraph">而且，DeepSeek 现在还在做一件事，就是自己建机房。前一段时间有消息传出来，说 DeepSeek 准备在内蒙建机房，招聘机房管理员，月薪 1.5 万到 3 万，发 14 薪。这个是有媒体报道、可以确认的消息。</p>



<h4 class="wp-block-heading">原因三：V4 将至，窗口期和压力都很大</h4>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/blog_6.jpeg" alt="荒原上的大型数据中心正在施工，远处高压电塔与服务器机柜连成一线，近处日历翻到4月、5月，天空中悬着写有“V4”的未揭幕幕布，营造紧张等待感，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">第三个原因，就是 V4 要来了，压力前所未有地大。很多人对 DeepSeek V4 抱有巨大的期望。从过春节的时候，大家就在等它炸场，后来没来；又传 3 月份来，结果 3 月份过去了也没来；然后又传 4 月底，现在已经 4 月十几号、快 20 号了，又开始传 5 月份来。</p>



<p class="wp-block-paragraph">DeepSeek 为什么做不出来 V4？很可能是因为它和现在主流模型之间，已经没有办法拉开特别大的差距了。现在大家基本都是万亿参数、百万上下文、多媒体、多模态统一模型，谁也不比谁强出特别多。在这种情况下，像它这种要憋大招的公司，就只能继续憋下去，而这其实是很痛苦的。</p>



<p class="wp-block-paragraph">等 DeepSeek V4 真正发布的时候，大概率很多人还是会失望。也不是说 DeepSeek 一定做不好，而是<strong>期望越高，失望越大</strong>。大家现在对它的期待太高了，总觉得它能一下超越谁谁谁，这其实不太现实。最多也就是追上同行，未必能全面超越 OpenAI 和 Anthropic。更现实一点说，可能是追上智谱、MiniMax、Kimi 这样的水平。</p>



<p class="wp-block-paragraph">所以，在 DeepSeek V4 发布之前，把融资这件事先谈好，对它是有利的。因为如果产品发出来以后，市场反应是“不过如此”，那它可能就不值这么多钱了。这也是它当前承受的一个很大压力。</p>



<h2 class="wp-block-heading">100 亿美金到底贵不贵</h2>



<p class="wp-block-paragraph">最后，再来看一下，100 亿美金到底贵不贵。</p>



<p class="wp-block-paragraph">很多人一听 100 亿，就觉得是个天大的数字。但对于没上市的公司来说，估值通常是按<strong>同类公司类比法</strong>来算的。那谁和 DeepSeek 算同类公司？比如 MiniMax 和智谱。</p>



<h3 class="wp-block-heading">可比公司一：MiniMax</h3>



<p class="wp-block-paragraph">MiniMax 在 2025 年的收入大约是 7900 万美金，市值是 386 亿美金。它上市的时候市值没那么高，是后来涨上去的。那它的 PS，也就是市销率，大概是 488 倍，非常高。</p>



<h3 class="wp-block-heading">可比公司二：智谱 AI</h3>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/blog_7.jpeg" alt="投资分析师的书桌上摆着两张公司对比卡，分别写着MiniMax与智谱AI，旁边有柱状图、PS倍数曲线和算盘，桌面中央留下“DeepSeek 100亿美元是否便宜”的手写问题，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">另一个上市公司智谱 AI，它是有财报的，收入是 1.049 亿美金，这个数字比较准确；市值是 539 亿美金，这是上周五收盘的价格。那它的 PS 大概是 513 倍。</p>



<p class="wp-block-paragraph">这里用的都是 PS，而不是 PE，也就是市销率，不是市盈率。原因很简单：这两家公司都还在亏钱，利润是负的，所以没法用 PE，只能用 PS。</p>



<h3 class="wp-block-heading">按这个逻辑，DeepSeek 应该值多少钱</h3>



<p class="wp-block-paragraph">那按这个逻辑，DeepSeek 到底应该值多少钱？关键就在于它的收入是多少。2025 年的收入，它现在并没有对外公布。海外有媒体报道说，它的销售额可能是 2.2 亿美金。对于这个说法，DeepSeek 自己也没有明确回应，只是在一次采访里提到过，自己的收入远没有达到那个水平。到底是多少，大家只能猜。</p>



<p class="wp-block-paragraph">如果它的收入也是 1 亿美金上下，那按照前面这些可比公司的 PS 去算，它的估值其实应该也是几百亿美金的量级，400 亿甚至更高都有可能。所以如果真按&nbsp;<strong>100 亿美金</strong>的价格投它，从 IPO 估值逻辑来看，肯定是赚的，甚至可以说是捡漏。</p>



<h2 class="wp-block-heading">为什么不能无脑冲</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/blog_8.jpeg" alt="一名基金经理站在岔路口，一边是写着“捡漏”“先到先得”的金色箭头，另一边是写着“退出困难”“长期锁定”的灰色箭头，脚边放着未签字的投资协议和沙漏，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">但也千万别因为这个就觉得该无脑冲。比如有些人会想，如果手里正好管着基金，是不是应该冲上去投一把？100 亿美金的标的，一旦上市就值四五百亿，这不是捡钱吗？</p>



<p class="wp-block-paragraph">千万别这么想。这里要给大家泼一盆冷水。有没有人干过类似的事情？固定一个死数，估值就是这么多；额度也是固定的，先到先得；不许谈任何条件。有没有？有。</p>



<h3 class="wp-block-heading">案例：2018 年的大疆融资</h3>



<p class="wp-block-paragraph">我给大家举一个案例，这家公司大家都很熟悉，就是大疆。现在拍视频的设备就是大疆的。2018 年，大疆就这么干过一回。当时融资 5 到 8 亿美金，估值 150 亿美金。完全一样：没有 BP，没有财务数据，固定估值，先到先得，你只管往里放钱，别谈条件。</p>



<p class="wp-block-paragraph">那当时投大疆的人赚到了吗？大家想一想，那是 2018 年，现在已经 2026 年了，过去 8 年了。大疆发展得很好，按理说应该赚到了。但问题在于，大疆到现在还没有上市。它不是上市公司，你手里的大疆股份到底值多少钱，只有你自己心里大概有个数，别人认不认还不一定。没有上市，就没有公开市值，你也不能拿着这些股份到市场上去卖。</p>



<p class="wp-block-paragraph">所以，当时投了大疆的人，现在不能说哭晕在厕所，但也绝对没那么痛快。他们只能等大疆偶尔做一点回购，或者私下和别人交换股份。因为没有公开价格，这件事非常麻烦，最大的痛点就是<strong>退不出去</strong>。</p>



<p class="wp-block-paragraph">而且 150 亿本身也是一个很高的估值。就算大疆将来上市了，它能不能变成一个几千亿的公司，也还是要看。所以现在投 DeepSeek，大概率会有点像 2018 年投大疆：可能公司很好，可能逻辑也没问题，但退出周期会非常长。</p>



<p class="wp-block-paragraph">当时谁投了大疆，到现在也没有公开。据说有上百家机构去谈，最后大概只有五六家投进去了，但也没有正式公布。因为这件事，后来也不算特别长脸。</p>



<h2 class="wp-block-heading">总结</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/blog_9.jpeg" alt="一张收尾性质的投资地图，左侧是DeepSeek、幻方量化、监管边界三者被重新划线，右侧是V4发布舞台与长周期退出路径，中央用红蓝墨水写着“不是缺钱，而是结构转型”，羊皮纸，钢笔彩色手绘的统一风格。"/></figure>



<p class="wp-block-paragraph">总结一下，这一轮融资的本质，更像是<strong>技术英雄向持续经营公司的结构转型</strong>，而不是因为缺钱。钱，幻方量化里肯定是有的。更重要的是，幻方量化和 DeepSeek 之间需要做一定切割，管理上也要更加规范。</p>



<p class="wp-block-paragraph">100 亿美元这个估值，如果按 IPO 估值逻辑去看，绝对还是划算的，甚至可能真的是捡漏。但问题在于，投进去以后，DeepSeek 也有可能像大疆那样，七八年甚至十几年都不上市。</p>



<p class="wp-block-paragraph">最大的变量，还是&nbsp;<strong>DeepSeek V4 到底什么时候能拿出来</strong>，拿出来之后到底是翻车、只是追平同行，还是能够再次大放异彩。这才是真正值得关注的事情。</p>



<p class="wp-block-paragraph">实际上，真正能参与到 DeepSeek 融资里的机构会非常少。愿意冲进去的人，也不会在意自己要拿着钱在里面等七八年。他们都是提前想明白了的人，才会去投。</p>



<p class="wp-block-paragraph">至于大部分人，我觉得还是期待一下 V4 吧，看看它到底会不会在 5 月份出来，出来以后到底是什么样子。这件事，还是很值得期待的。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<h2 class="wp-block-heading">背景图片</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-300m-funding-10b-valuation-vie-governance-shift/background_1.jpeg" alt=""/></figure>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>Deepseek V3.2高分真相：我们被“遥遥领先”忽悠了？Special版跑分超GPT-5，但API成本砍半才是真杀招｜DeepSeek-V3.2、DSA</title>
		<link>https://lukefan.com/2025/12/05/deepseek-v3-2-dsa-leading-tech-gaps-analysis/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Fri, 05 Dec 2025 01:06:50 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[AI Agent]]></category>
		<category><![CDATA[AI应用成本]]></category>
		<category><![CDATA[AI模型评测]]></category>
		<category><![CDATA[API降价]]></category>
		<category><![CDATA[DeepSeek V3.2]]></category>
		<category><![CDATA[DeepSeek V3.2 Special]]></category>
		<category><![CDATA[DeepSeek V3.2技术解析]]></category>
		<category><![CDATA[DeepSeek稀疏注意力]]></category>
		<category><![CDATA[DSA算法]]></category>
		<category><![CDATA[Gemini 3 Pro]]></category>
		<category><![CDATA[GPT-5.1]]></category>
		<category><![CDATA[SGLANG]]></category>
		<category><![CDATA[VLLM]]></category>
		<category><![CDATA[国产大模型]]></category>
		<category><![CDATA[国产算力]]></category>
		<category><![CDATA[大模型发展趋势]]></category>
		<category><![CDATA[大语言模型]]></category>
		<category><![CDATA[开源AI模型]]></category>
		<category><![CDATA[推理效率优化]]></category>
		<category><![CDATA[数学推理模型]]></category>
		<category><![CDATA[深度求索]]></category>
		<category><![CDATA[稀疏注意力]]></category>
		<category><![CDATA[长上下文处理]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3095</guid>

					<description><![CDATA[家人们！Deepseek V3.2 12月1号闪亮登场✨ 但R2呢？失踪人口坐实了！😂 哥们儿等了一整年，结果等来个“缝补打工人”——V3.2？纯纯的V3老底子加补丁！

重点来了‼️ DSA算法直接让成本腰斩💸 输入100万token才2块钱，比一杯奶茶还便宜🥤！实测API便宜到哭，但special版？数学界Rain Man💧——解题666，聊天只会“啊？”，社交废柴实锤（还限时12月15号！跑分王者？实战寄了😭）。

真·遥遥领先的是啥？DSA全开源‼️代码论文白给，不像美帝抠搜“不能商用”🙅‍♂️ 国产云连夜0day支持，但训模型还得跪舔英伟达😭（清醒点！基础模型该重训了）

进步了，别吹上天！这波降本增效+开源精神，值得一个赞👍 同意的扣1，不服来Battle！💥 #AI黑科技 #国产之光 #科技宅的浪漫


标题1：Deepseek V3.2高分真相：我们被“遥遥领先”忽悠了？Special版跑分超GPT-5，但API成本砍半才是真杀招｜DeepSeek-V3.2、DeepSeek Sparse Attention (DSA)、Reasoning、Open Source AI
标题2：Deepseek V3.2 vs GPT-5：看似反超，实则“麻袋片绣花”？DSA降本50%难掩架构硬伤，真能撼动Gemini 3.0 Pro？｜DeepSeek-V3.2、AI Model Benchmarks、Gemini 3.0 Pro、GPT-5
标题3：别只看跑分！Deepseek V3.2最大贡献是DSA算法，API成本直降50%，这才是真正的推理效率革命｜DeepSeek-V3.2、DeepSeek Sparse Attention (DSA)、Inference Efficiency、LLM技术分析
标题4：英伟达警报拉响？Deepseek V3.2的DSA算法完全开源，LLM推理成本普降50%，国产算力要躺赢了？｜DeepSeek-V3.2、DeepSeek Sparse Attention (DSA)、Open Source AI、Inference Efficiency
标题5：深度拆解：Deepseek V3.2领先的是算法而非模型，Special版跑分神话背后，DSA技术才是真正王牌｜DeepSeek-V3.2、DeepSeek Sparse Attention (DSA)、Reasoning、AI Model Benchmarks
简介：DeepSeek-V3.2发布引发热议，但其“遥遥领先”的真相远比跑分复杂。本次更新的核心是革命性的开源技术DeepSeek Sparse Attention (DSA)，它将API成本砍半，极大提升了推理效率。然而，模型本身仍基于旧架构，其惊人的AI Model Benchmarks主要来自一个无法泛用的“特化版”。与Gemini 3.0 Pro等新一代模型相比，V3.2在降本增效上取得突破，但在基础模型创新上仍有差距。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="Deepseek V3.2高分真相：我们被“遥遥领先”忽悠了？Special版跑分超GPT-5，但API成本砍半才是真杀招｜DeepSeek-V3.2、DSA" width="900" height="506" src="https://www.youtube.com/embed/5hgwZf-tYAw?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v3-2-dsa-leading-tech-gaps-analysis/blog_1.JPEG" alt=""/></figure>



<h1 class="wp-block-heading">Deepseek V3.2，12月1号发布了。是不是又遥遥领先了呢？</h1>



<p class="wp-block-paragraph">大家好，欢迎收听<a href="https://youtube.com/@StoryTellerFan" target="_blank" rel="noopener">老范讲故事的YouTube频道</a>。</p>



<p class="wp-block-paragraph">Deepseek V3.2的发布应该是12月1日。我们始终没有等来心心念念的Deepseek R2。在今年春节的时候，深度求索突然发布了Deepseek R1，算是扔下了一颗深水炸弹，把整个AI圈都震动了，甚至还造成了英伟达股价的闪崩——一段时间内闪崩吧。甚至老黄都跑出来喊，说：“Deepseek发布对我是利好，你们不要卖英伟达的股票。”大家就一直等着这个R1，既然这么厉害，咱们上R2。但是等了这么久，都没有等来R2。</p>



<h2 class="wp-block-heading">Deepseek V系列版本回顾</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v3-2-dsa-leading-tech-gaps-analysis/blog_2.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">下面呢，我们来捋一下Deepseek V系列的版本到底是怎么样的一个发布过程。</p>



<ul class="wp-block-list">
<li><strong>Deepseek V3 (去年12月26日发布):</strong> 这是非常非常重要的一个版本。实际上我们后面看到的所有版本，包括R1，都是在Deepseek V3的基础上进行微调、进行蒸馏、进行强化学习。今天发布的Deepseek V3.2，也依然是在这个版本的基础上做出来的。</li>



<li><strong>Deepseek V3-0324 (3月24日发布):</strong> 主要是在专项能力上做了一些增强，比如说编代码或者写文章。</li>



<li><strong>Deepseek V3.1 (8月21日发布):</strong> 主要是工程化和智能体方面做了增强。因为当时大家都要去做AI agent，而之前的版本在AI agent这一块都比较弱。</li>



<li><strong>Deepseek V3.1 Terminals (9月22日发布):</strong> 这个版本叫V3.1的终极版，实际上是对V3.1做了一些修复和精调，并告知这是V3.1的最终版本。</li>



<li><strong>V3.2 EXP (9月29日发布):</strong> 一个实验版本，在V3.1终极版的基础上加入了DSA技术。最主要的变化是降价，直接把API调用的价格砍了一半。</li>



<li><strong>Deepseek OCR (10月20日发布):</strong> 一个很小的模型（约6G），用于图片解释，效果很好。</li>



<li><strong>maths VR (11月27日发布):</strong> 专门做数学推理和数学证明的一个版本，在各种数学题测试中评分非常高。</li>



<li><strong>Deepseek V3.2 正式版 &amp; V3.2 special 特别版 (12月1号发布):</strong> 本次发布的主角。</li>
</ul>



<span id="more-3095"></span>



<h2 class="wp-block-heading">V3.2，是不是遥遥领先了呢？</h2>



<p class="wp-block-paragraph">那么这一次的V3.2，是不是遥遥领先了呢？各种评测数据确实非常亮眼，但是呢，我们要看到它的评测数据里头实际上是有两个数值的。一个数值呢是Deepseek V3.2做出来的，一个数值呢，是Deepseek V3.2 special做出来的。</p>



<p class="wp-block-paragraph">它的Deepseek 3.2 special这个版本，确实是比Gemini 3 Pro、GPT5.1都要强，但是我们大部分人，实际上没有办法去使用这个V3.2 special。它这个正式版的V3.2呢，属于是接近了GPT-5.1的水平，各项评分都很近，有个别的超过吧，大部分呢跟GPT-5.1很近的一个位置。</p>



<p class="wp-block-paragraph">甚至呢，还有人出来讲，说GPT到现在3周岁了，现在Deepseek反超回来了。很多人就讲说GPT被Deepseek吓到了，其实跟Deepseek没关系，主要是被谷歌吓到了。</p>



<h3 class="wp-block-heading">V3.2 Special：一个跑分工具？</h3>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v3-2-dsa-leading-tech-gaps-analysis/blog_3.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">你说V3.2的special版本的评分，不是已经超越了GPT-5.1和Gemini 3 Pro了吗？你怎么还说跟国外有差距呢？首先要注意，V3.2 special是一个基本上没法用的版本。为什么呢？</p>



<p class="wp-block-paragraph">就是它的推理、它的运算确实非常强，但是呢，它在工具调用、AI agent的使用这一块都不能用，因为它就是会解数学题，它是一个偏科天才，除了写数学题之外，他啥也搞不了。所以呢，他做各种的评测分数很高，但是你实际使用他，你是没法使的。</p>



<p class="wp-block-paragraph">而且Deepseek V3.2 special这个版本只能用到12月15号，在这之后这个接口就直接废掉了。所以那个产品就是跑分用的，不是给大家用的。发布V3.2 special呢，也是有一点点赶鸭子上架。当然有很多人说，这个就是Deepseek R2了。</p>



<h2 class="wp-block-heading">V3.2的核心技术：DSA算法</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v3-2-dsa-leading-tech-gaps-analysis/blog_4.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">那么V3.2到底是怎么训练出来的呢？实际上Deepseek V3.2，是在Deepseek V3.1 Terminals这个基础上进行的继续训练，基础大模型没变。这个里边最关键的特性，就是降本增效。</p>



<h3 class="wp-block-heading">降本：Deepseek稀疏注意力算法 (DSA)</h3>



<p class="wp-block-paragraph">它直接把成本对半砍，就是降50%的API调用成本。里边呢，使用了一个叫DSA的算法，Deepseek稀疏注意力算法。通过一个叫闪电索引的功能，它不是对文本里边的所有词进行运算和匹配，而是先评估哪一块比较重要，哪一块不太重要，我们把重要的部分拿去做下一步，不重要的部分直接扔了。通过这种方式呢，它极大的降低了长上下文的处理成本。</p>



<p class="wp-block-paragraph">长上下文是必须的，因为AI agent需要调用工具、搜索、使用本地知识库。所以只能在长上下文的基础上想办法去降低成本。</p>



<h3 class="wp-block-heading">增效：与V3.1对齐并强化</h3>



<p class="wp-block-paragraph">在实现了DSA的算法之后，它还要跟Deepseek V3.1 Terminals这个最终版进行对齐，确保性能不能退步。这就是这一次V3.2在V3.2 EXP的基础上做的一个很重要的更新。</p>



<p class="wp-block-paragraph">所以呢，9月29号V3.2 EXP，第一件事是先把价格打下来：</p>



<ul class="wp-block-list">
<li><strong>输入 (缓存不命中):</strong> 100万TOKEN两块钱人民币。</li>



<li><strong>输入 (缓存命中):</strong> 100万TOKEN是两毛钱。</li>



<li><strong>输出:</strong> 100万TOKEN只需要3元人民币。</li>
</ul>



<p class="wp-block-paragraph">这个价格要比我们现在能看到的各种轻量级模型都要便宜很多。</p>



<p class="wp-block-paragraph">在发布这个版本之后呢，进行了大规模特定目标的强化学习，主要学很难解答但很容易验证的问题，特别是针对智能体（AI agent）进行数据训练。在这样的一个基础上，就得到了12月1号所发布的V3.2正式版。</p>



<h3 class="wp-block-heading">V3.2 Special的由来</h3>



<p class="wp-block-paragraph">它呢，是在V3.2 EXP base的这个基础上，拿着前面我们讲的，专门做数学题证明的maths VR这个版本去做后续的训练。V3.2 special实际上就是V3.2 EXP base这个版本加上maths V2这个版本合成的一个版本。所以它特别擅长做数学题、做各种长推理，但其他方面能力很弱。</p>



<h2 class="wp-block-heading">真正的领先之处：开源贡献</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v3-2-dsa-leading-tech-gaps-analysis/blog_5.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">我们现在所说的领先，是真正做出来的这些改变、这些创新，对于整个行业是不是有贡献。Deepseek R1对于整个行业是有巨大贡献的。而这一次的DSA确实是非常先进的，也对整个行业是有贡献的。只要是对整个行业有贡献，我们就认为它已经遥遥领先了。</p>



<p class="wp-block-paragraph">而且DSA算法呢是完全开源的，有论文、有模型、有代码，而且可以商业化使用。不像美国那些公司抠抠搜搜的。</p>



<p class="wp-block-paragraph">当然，这个东西也不是Deepseek凭空发明的，它是在很多前人的基础上做的改进和应用。就像瓦特改进了蒸汽机一样，DSA也是如此。类似的稀疏注意力算法有很多论文，但是真正大规模的验证和使用，就是Deepseek的DSA这个算法。</p>



<h3 class="wp-block-heading">其他AI公司如何应用DSA？</h3>



<p class="wp-block-paragraph">美国公司也有类似技术，OpenAI的算法没有公开，谷歌应用的则是一个叫“环注意力”（ring attention）的算法，可以支持到100万TOKEN的上下文。</p>



<p class="wp-block-paragraph">DSA是完全开源的，其他模型也可以使用，但需要经过几个步骤：</p>



<ol class="wp-block-list">
<li><strong>模型结构改造：</strong> 在原来模型的基础上加上闪电索引。先进行“稠密预热”，保持主干注意力完全稠密，冻结原来的参数，只训练这个闪电索引。</li>



<li><strong>稀疏训练：</strong> 打开DSA开关，解冻主干的参数，和闪电索引一起训练，并确保输出结果跟原来是一样的。</li>



<li><strong>蒸馏和强化学习：</strong> 在针对写作、数学、代码、AI agent搜索等等特定领域进行特训，再用特定的模型生成数据，蒸馏主模型。最终把推理和AI agent这些行为进行强化学习和人类的对齐。</li>
</ol>



<p class="wp-block-paragraph">所以DSA对整个行业是有巨大推动作用的，这才是真正的遥遥领先。</p>



<h2 class="wp-block-heading">Deepseek V3.2的局限与不足</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v3-2-dsa-leading-tech-gaps-analysis/blog_6.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">它还是有很多地方比GPT-5.1、比Gemini 3 Pro要差很远的地方。</p>



<ul class="wp-block-list">
<li><strong>纯文本模型：</strong> 完全没有多模态能力，给它图片它是不认识的。</li>



<li><strong>基础模型陈旧：</strong> Deepseek V3.2也是在一个去年12月26日发布的Deepseek V3的基础上，不停的打补丁补出来的一个版本。这个叫“麻袋片绣花，底子太差”。就像OpenAI发现GPT-5（在GPT-4基础上微调）无法追赶从头训练的Gemini 3 Pro一样，要想再追上，必须得退回去把基础模型再提升一步。</li>
</ul>



<p class="wp-block-paragraph">所以，Deepseek下一步肯定还是要先把Deepseek V3.2的special合并进去，但更重要的是需要重新预训练一个全新的V4模型，把多模态等能力加进去。</p>



<h2 class="wp-block-heading">对国产算力的真正影响</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-v3-2-dsa-leading-tech-gaps-analysis/blog_7.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">Deepseek V3.2是不是对于国产算力有了巨大的帮助？国内云确实是在第一时间就去支持了，他们叫0 day支持。</p>



<p class="wp-block-paragraph">现在大模型推理普遍使用VLLM或SGLANG这样的开源框架，它们最初是为英伟达显卡设计的。Deepseek发布DSA后，第一件事就是修改这两个框架，让它们能很好地支持DSA。国内的算力卡厂商，如华为升腾，也要到这个系统上去打补丁，适配自己的硬件。</p>



<p class="wp-block-paragraph">华为云等厂商已经完成了这个适配工作，这意味着，以后想把模型部署到中国的公司（如XAI），可以直接购买华为升腾的芯片而无需修改代码。</p>



<p class="wp-block-paragraph">所以国内的云和算力卡确实又行了，它们可以在相同的算力下处理更多的信息。从推理这件事情上来说，我们不再那么依赖英伟达的显卡了。但是，如果想预训练一个全新的大模型，还是要去买英伟达显卡。目前国内普遍的做法是让大模型出海，在海外去做训练。</p>



<h2 class="wp-block-heading">Deepseek V3.2带来的市场影响</h2>



<ul class="wp-block-list">
<li>AI应用在国内产业的普及与渗透速度会进一步的提升。</li>



<li>一些新的模型，甭管是国内的还是国外的，都会去进行DSA升级，以降低成本。</li>



<li>使用中文推理的美国大模型会变多起来，因为它们很多是在中文开源模型基础上做后训练的。</li>
</ul>



<h3 class="wp-block-heading">对英伟达的影响：短期承压，长期利好</h3>



<p class="wp-block-paragraph"><strong>短期来看是利空。</strong>&nbsp;DSA让推理成本下降，完成同样的任务只需要一半的显卡，这会减少对英伟达通用算力的需求。</p>



<p class="wp-block-paragraph"><strong>但长期来说依然是利好。</strong>&nbsp;首先，行业认识到必须重新预训练基础模型，这离不开英伟达显卡。其次，AI应用渗透率上升，会推动整个行业越过盈利点，对算力中心的需求可能实现真正的爆发。</p>



<h2 class="wp-block-heading">总结</h2>



<p class="wp-block-paragraph">Deepseek V3.2，12月1日正式发布了，评分很高，但对于实际使用和感受其实没有那么大意义。因为他真正评分很高的那个版本，是一个偏科的数学天才。V3.2正式版他的评分并没有那么高。而且Deepseek V3.2是在V3的基础上继续缝缝补补出来的，想要继续前进已经很难了，必须要去对基础模型重新做预训练了。DSA这个算法确实对整个行业做出了贡献，非常非常有价值，在这一点上，你说它遥遥领先没有任何问题，但是距离真正的全线领先，还有很大的差距。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<p class="wp-block-paragraph">好，这就是咱们今天要讲的故事，感谢大家收听，请帮忙点赞、点小铃铛、参加<a href="https://discord.gg/ppKsNkttTv" target="_blank" rel="noopener">DISCORD讨论群</a>，也欢迎有兴趣、有能力的朋友加入我们的<a href="https://www.youtube.com/channel/UCUGLhcs3-3y_yhZZsgRzrzw/join" target="_blank" rel="noopener">付费频道</a>，再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>10个月血赚近9000万，最后被罚1.77亿！DeepSeek背后程序员如何利用“老鼠仓”掏空公司？监管漏洞全解析｜DeepSeek US China fine prison</title>
		<link>https://lukefan.com/2025/11/26/deepseek-front-running-penalty-china/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Wed, 26 Nov 2025 00:57:51 +0000</pubDate>
				<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[AI量化交易]]></category>
		<category><![CDATA[China stock market]]></category>
		<category><![CDATA[DeepSeek AI]]></category>
		<category><![CDATA[Deepseek老鼠仓]]></category>
		<category><![CDATA[financial regulation]]></category>
		<category><![CDATA[中国股市]]></category>
		<category><![CDATA[交易策略]]></category>
		<category><![CDATA[内幕交易]]></category>
		<category><![CDATA[刑事责任]]></category>
		<category><![CDATA[利用未公开信息交易罪]]></category>
		<category><![CDATA[同频交易]]></category>
		<category><![CDATA[巨额罚款]]></category>
		<category><![CDATA[幻方量化]]></category>
		<category><![CDATA[林艺平]]></category>
		<category><![CDATA[程序员炒股]]></category>
		<category><![CDATA[老鼠仓]]></category>
		<category><![CDATA[职业操守]]></category>
		<category><![CDATA[证券市场禁入]]></category>
		<category><![CDATA[证券监管]]></category>
		<category><![CDATA[证监会处罚]]></category>
		<category><![CDATA[量化交易]]></category>
		<category><![CDATA[金融犯罪]]></category>
		<category><![CDATA[金融科技]]></category>
		<category><![CDATA[非法所得]]></category>
		<category><![CDATA[风险控制]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3019</guid>

					<description><![CDATA[Deepseek背后的老鼠仓，被罚了1.77亿人民币，这到底是个什么神奇的故事？ 大家好，欢迎收听老范讲故事的 ... <a title="10个月血赚近9000万，最后被罚1.77亿！DeepSeek背后程序员如何利用“老鼠仓”掏空公司？监管漏洞全解析｜DeepSeek US China fine prison" class="read-more" href="https://lukefan.com/2025/11/26/deepseek-front-running-penalty-china/" aria-label="阅读 10个月血赚近9000万，最后被罚1.77亿！DeepSeek背后程序员如何利用“老鼠仓”掏空公司？监管漏洞全解析｜DeepSeek US China fine prison">阅读更多</a>]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="看起来是收割散户，其实在掏空东家！DeepSeek母公司程序员利用未公开数据，10个月赚走近9000万，谁是真韭菜？｜DeepSeek China fine AI prison users data" width="900" height="506" src="https://www.youtube.com/embed/6li95OzVe2s?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-front-running-penalty-china/blog-1.JPEG" alt=""/></figure>



<h1 class="wp-block-heading">Deepseek背后的老鼠仓，被罚了1.77亿人民币，这到底是个什么神奇的故事？</h1>



<p class="wp-block-paragraph">大家好，欢迎收听<a href="https://youtube.com/@StoryTellerFan" target="_blank" rel="noopener">老范讲故事的YouTube频道</a>。</p>



<h2 class="wp-block-heading">天价罚单：1.77亿的老鼠仓</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-front-running-penalty-china/blog-2.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">2025年11月11日发了一个公告，这是浙江证监局行政处罚决定书，处罚一个叫林艺平的人，艺术的艺，平衡的平。这个人呢，是在幻方量化里边做老鼠仓。罚多少钱呢？没一罚一，就是把他的非法所得没收掉，再罚以同样的钱。非法所得8,857.69万元，这哥们还是很能挣钱的。你把这个8,000多万要交出来，再罚8,000多万，加一块1.77亿人民币。</p>



<h2 class="wp-block-heading">处罚算重还是算轻？</h2>



<p class="wp-block-paragraph">是不是付钱了？没有进一步的消息。付不出来就强制执行呗，上你们家卖房卖车去。如果转移资产，就是要判刑。如果实在付不了的话，估计是会挂失信人员的。然后还处以了5年证券市场禁入，这五年里头不能给人当CFO了。你说一程序员是给谁当CFO去？但是他也不能到股市里边去开户。</p>



<p class="wp-block-paragraph">那你说这对于他来说，处罚是不是太轻了一点？大概率呢，还会移交公安机关起诉判刑，但是这个呢，并没有在这一次的信息里头披露出来。</p>



<p class="wp-block-paragraph">其实这还不是中国最大的老鼠仓，但基本上已经算是第一梯队了，绝对是战绩彪炳。最大的呢，应该是华宝基金原基金经理蒋宁的一个案子，用了9个亲友账号，盈利1.14亿，最后呢是有期徒刑5年。所以林艺平大概率最后还是要去坐牢的，只是目前呢，是浙江证监局行政处罚决定书公布出来了，应该是后边还有法院再去判决，所以当前并不确定后续的处理方式。</p>



<h2 class="wp-block-heading">主角登场：幻方量化与“外包程序员”林艺平</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-front-running-penalty-china/blog-3.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">Deepseek背后就是幻方量化。那你说他们家确实炒股是有两把刷子。犯事的这段时间呢，是2022年11月16日至2023年9月6号。如果大家有记忆的话，当时应该是中国股市震荡下行期。但是即使在这样的一个阶段里头，幻方量化还是挣到钱了，就是他们通过量化的交易方式挣钱了。</p>



<span id="more-3019"></span>



<h3 class="wp-block-heading">林艺平到底是谁？</h3>



<p class="wp-block-paragraph">那你说林艺平到底是干嘛的呢？这哥们是个外包，是技术服务外包。对于技术服务外包来说呢，监管是比较松的。你一个量化基金里头这帮做策略的人，他们是需要去考基金从业资格证书的，要去受到基金从业资格的这种法律约束，或者叫道德约束。像我是考过基金从业资格证书的，我们考证书的时候一共是三门考试，第一门呢就是职业道德，第二门呢是一些跟交易相关的东西，第三门呢是私募股权基金。其实第三门是相对来说比较容易的，第一门就是背各种各样的东西，说什么能干，什么不能干。真正去做量化的人，你肯定是要去背这些东西的。但是呢，做技术支持的人是不需要的。</p>



<p class="wp-block-paragraph">林艺平他的职位跟职责是什么呢？他的职位呢，叫做交易策略前端开发。你说前端开发不是写网页的吗？不太一样。他的职责是产品风控、部分产品交易测试、决策下单和监控，他做这些工作。</p>



<h3 class="wp-block-heading">量化交易中的“前端”是什么？</h3>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-front-running-penalty-china/blog-4.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">那他到底干嘛的呢？量化交易里头的前端跟后端，跟我们一般写程序不一样。我们写程序，后边做具体操作的叫后端，前面做界面这帮人，叫前端，甭管你是写网页的，还是在APP上写界面的，写交互画按钮的，这帮人他们叫前端。在量化交易里头呢，这个后端是定策略的：我今天要买茅台，茅台上去了以后，我什么时候把它卖掉，多少钱以内我去买。这帮人叫后端，具体执行呢就是前端的。</p>



<p class="wp-block-paragraph">但是前端都是程序员。你说这个量化不应该自动执行吗？这个真不是。你这边决定了我明天要买，比如说5,000万手的茅台，你如果真的前面这个机器自动就上去挂单去了，你肯定买不着，而且等你把这5,000万手收齐了的时候，这价格都涨飞了呀。所以呢，他们需要干嘛呢？需要把这单子拆了。</p>



<p class="wp-block-paragraph">你说我现在需要5,000万手茅台了，后端把这个策略制定好了。而且呢，他不是说买5,000万手茅台，他是有一整套的策略：哪天到哪天之间买5,000万手茅台，这些茅台应该是在一个什么样的价格区间之内，如果这个价格超过了，我们就放弃购买，然后撤单或者是做什么。这样的东西，它是有一个完整的策略，发到这个林艺平手里了。林艺平要干的活就是把它拆开，几百手几千手，把它拆成一大堆小碎单子，然后拿这些单子扔到市场上慢慢去买去。这些单子呢，就会快速的去成交，而且成交的过程中呢，对于整个股价的影响呢，没有那么大。他就负责干这个的。他也会有一个比较缓慢的交易过程，这几单交易成功了，那几单交易成功了。而且这5,000万手，你也不能说我按照一个统一的价格，“啪”一把都扔出去了。他可能也是按照一个梯度的价格往上扔，他是这样来去操作的。这就是他们这个前端跟后端之间的差异。</p>



<h3 class="wp-block-heading">犯罪行为的定性</h3>



<p class="wp-block-paragraph">这次的处罚通知上呢，有一句很关键的话，就是什么呢？叫<strong>“实质上实施了私募基金从业人员的履职行为”</strong>，算是犯罪行为的一个定性。你按道理来说呢，后端这帮做策略的人，你要干类似这样的活的话，那你肯定是老鼠仓。而且这些人呢，是经过了基金从业资格考试的，有相应资格的，他学过这个道德规范和职业操守的，属于叫知法犯法，这肯定是行的。</p>



<p class="wp-block-paragraph">林艺平这种程序员呢，他按道理说是没有接受相应的培训的。国内的量化基金呢，也比较喜欢用这种方式，就是把技术这块外包到外边去。为什么？因为他们就不需要受到这些约束的，这种管理也相对来说比较灵活，你也可以给他们发比较高的薪水。现在还有一个叫限薪令的东西，你不能给从业人员发太高的薪水。你说每天手里头拨拉拨拉手指头，就上亿上亿的跑，自己的月薪可能是几万块，这些人心里会不平衡的。但是这些程序员，你是可以给他发比较高的薪水的，不受的这个控制。但是呢，林艺平“实质上实施了私募基金从业人员的履职行为”，所以你要受这个约束。</p>



<h2 class="wp-block-heading">犯罪手法揭秘：他是如何赚钱与如何被抓的？</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-front-running-penalty-china/blog-5.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">具体林艺平是怎么挣钱的呢？他又是怎么被发现的呢？这个我估计大家会比较好奇。</p>



<h3 class="wp-block-heading">什么是“老鼠仓”？</h3>



<p class="wp-block-paragraph">首先咱们讲，他这个犯罪行为呢叫老鼠仓。那么老鼠仓叫什么呢？老鼠仓的一个学名叫什么呢？叫<strong>“利用未公开信息交易罪”</strong>。有一些未公开信息，比如说幻方量化在后边制定了一个交易规则，这个是对普通大众来说是不知道的。你利用这样的一个规则去交易的话，这个呢就叫做老鼠仓了。那你说我不自己交易，我偷偷告诉别人行不行？这玩意不就不叫老鼠仓了吗？这叫<strong>“泄露内幕信息罪”</strong>，这个东西呢叫内幕交易。所以呢，他有另外一个罪名。你自己交易了就叫老鼠仓，没有自己交易，我告诉别人了，叫内幕交易。</p>



<h3 class="wp-block-heading">10个月赚近9000万，需要多少本金？</h3>



<p class="wp-block-paragraph">那么赚钱的过程呢，这哥们是10个月赚了接近9,000万，一天赚25万，这个还是速度很快的。他的本金到底有多少？很多人很关心这件事。我到底拿多少钱，10个月里就能挣出这么多钱来？是不是我手里也得有好几亿的资本？这一定是谁家有钱的少爷吧？不是这么回事，这个不需要多少钱。</p>



<p class="wp-block-paragraph">为什么呢？你想他头一天，发现要下单茅台了，咱们接着说这5,000万手茅台的故事。头一天发现了，然后呢就进去埋伏了。他可以先下单，我先去买个几百手。然后呢，我这边开始执行5,000万手的这个过程。执行完了以后，到第二天，T+1嘛，这个股价呢还是会有一点点波动，比如有个2%、3%的波动，甚至呢有一些其他的消息爆发出来了，你可能有个5%、6%的波动。这个时候，你再把手里这个筹码卖掉，T+1，你等于5%就到手了，有可能是这样的。然后呢，到T+2的时候，你又变出现金来了，你又可以去买了。它是这样的一个过程。而且呢，它还可以去融资融券，就是它效率可以更高一些。它呢，挣钱不靠本钱多，它靠滚得快，它是这样的一个盈利方式。</p>



<h3 class="wp-block-heading">具体操作：利用“拆单”的时间差</h3>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-front-running-penalty-china/blog-6.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">它的核心就是拆单。刚才咱们讲前端干这个活，大家就已经明白了。我就可以在拆单的过程中，自己先去下。我这边拆单的这个策略是10块钱多少手，10块零5毛多少手，10块1、11块多少手，他是这样的一个拆法。在这边拆的过程中，我那边下一个指令就直接9块9，我先整个几百手出来再说。等这边做完了以后，后边我再去套现离场。他是这样的一个挣钱过程。</p>



<p class="wp-block-paragraph">它整个的操作呢，并不需要特别复杂的一个技术，因为这个东西呢叫做量化交易，并不是高频交易，他的交易的频率没那么快。一个策略下来了以后，他拆完单然后呢审核，审完了以后，是不是拆单都符合要求，然后要去开始执行。执行完了以后他要干嘛？监控。拆完了单以后，到底有没有成功的把我需要的这个筹码买下来？或者说现在这个价格是不是已经异常波动了？波动了以后，我是不是要去调整这个拆单？比如说我原来是从10块买到12块，要把这个5000手都买进来，我这可能只买了2,000万手，就已经涨到12了。那得看后边该怎么去处理，这个呢都是这个林艺平要去干的事情。所以呢，整个的执行过程很慢，他就完完全全可以同时摸出手机来，或者再找一台电脑，给他自己的账户下个单子，这个事是完全来得及的。</p>



<p class="wp-block-paragraph">而且这个过程呢，也不能保证你铁赚钱。有的时候中国股市也说不好，你没准今天我去买了，按道理说明天应该涨，但是可能隔夜美股大跌，你第二天就直接赔在里头。幻方自己也不能保证每一笔单子都赚钱，林艺平呢也不能保证都赚。但是呢，他算了完10个月以后，盈亏都抵了以后，还赚了接近9,000万。他挣钱的速度，肯定是比幻方量化快无数倍的，因为他的这个效率会更高一些。</p>



<h3 class="wp-block-heading">他赚的到底是谁的钱？</h3>



<p class="wp-block-paragraph">那你说这玩意到底赚的是谁的钱呢？好多买卖股票的人说，是不是赚的我的钱？赚的其实是幻方量化的钱。按道理来说呢，幻方量化把这个策略偷偷地执行下去的时候，市场上应该没有任何的响动，我偷偷地进去吸收筹码，或者偷偷地出去卖，应该是这样的一个过程。但是呢，他提前进去埋伏好了，我可以在幻方量化买的时候呢，把自己手里的筹码卖给他。甚至呢，他可以等着幻方量化整个把这个价格拉起来以后，在幻方量化要出场之前，他先跑。他是可以来做这样的事情的。所以他挣的钱是幻方量化的钱。</p>



<h3 class="wp-block-heading">天网恢恢：老鼠仓是如何被发现的？</h3>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-front-running-penalty-china/blog-7.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">时间线，刚才咱们也讲了，2022年11月16号到2023年9月6号，也就是十个月左右的时间。2023年9月6号就离职了。那为什么到2025年11月11号才发公告呢？整个这个事情核实起来也还是需要一段时间的。应该是2023年9月6号这个事就已经东窗事发了。到底是幻方量化内部监控把他逮着了，还是证监会把他逮着了，这个事呢现在没有公开出来。但是一定当时就已经把他抓住了，这两年就是在做案情核实和资金账户的这些确认，现在就可以尘埃落定，把他宣布出来。</p>



<p class="wp-block-paragraph">那你说这玩意咋逮着的呢？他偷偷在里边干这个活，怎么逮着他？还记得刚才咱们讲那个最大的案子吗？就是1.14亿那个案子，9个亲属账号。所以这种东西逮着他的核心原因，就是账号的原因。这个林艺平呢，他使用了4个账号。</p>



<ul class="wp-block-list">
<li>第一个呢叫林某志，也姓林吧，有可能是他父亲的账号，或者是他的一些亲属的账号吧。林某志在国金证券开了一个账号，在东莞证券开了一个账号，这是两个。</li>



<li>还有一个呢叫何某龙，在东莞证券开了一个账号，在中信证券开了一个账号。</li>



<li>一共就这4个账号。</li>
</ul>



<p class="wp-block-paragraph">那你说有这4个账号他交易他的呗，怎么就能被发现呢？发现这种老鼠仓的核心关键点在于什么？他挣钱之所以能够挣到这么多的原因，是因为他频率高。今天买明天卖，后天再买，然后再卖，他是这样的一个快速的交易过程。那么呢，就会发生一个问题，叫<strong>“同频交易”</strong>。就是你发现这4个账号跟幻方量化的这种几百亿的大账号总是同频交易。幻方量化买的时候，他总能提前买；幻方量化卖的时候，他能提前卖；或者是幻方量化买完了以后他就卖；等到幻方量化要卖的时候呢，他没准还跑去融资融券去又跟着折腾一把，对吧？每一次操作的规律都差不太多，这个叫同频交易。</p>



<p class="wp-block-paragraph">因为中国是很严格的证券交易实名制的，所以每个人手里不可能掌握太多的账号。特别在这几年，各种的断卡行动了以后，就会变得越来越难，所以大家手里账号都是有限的。这些人都是很贪婪的，一定是有几个账号跟这种大账号之间会发生同频，这就会容易被抓住。</p>



<p class="wp-block-paragraph">另外一个抓住它的方法是什么呢？就是<strong>IP地址跟Mac地址</strong>。Mac地址就是我们的硬件，比如手机，你的每一个手机上是有Mac地址的。我们的每一个路由器、每一台电脑的网卡上，都是有Mac地址的，全世界唯一的。IP地址，你比如说像林艺平这样的，他上哪下单去？他只能是坐在幻方量化的办公室里头下单。所以他下单的这个IP地址，也是在幻方量化的办公室里头，跟他执行交易策略的这个IP地址是一样的。这个也是很容易被抓住的。应该就是通过这两个方式，就是同频交易和IP地址、Mac地址的方式，直接把他逮着了。</p>



<h2 class="wp-block-heading">普遍现象与监管红线</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-front-running-penalty-china/blog-8.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">中国股市在这块，确实要比美国股市要严格。因为美国股市并不要求绝对穿透，或者穿透到头这样的方式。中国股市是要求绝对穿透，无限穿透，一层一层一直穿透下去，穿透到最后每一个人的身份证号码上。所以你想去靠账号去玩这个事不那么容易。</p>



<p class="wp-block-paragraph">那你说这是不是一个普遍现象呢？是不是所有这些做量化交易的人，最后执行的这些前端人员，都会干这个活呢？首先说这个事确实不少见，国内外都有，美国也有，中国也有，全世界哪个国家都会出现类似这种情况。反正出现了就抓呗，这也没什么办法。</p>



<p class="wp-block-paragraph">真正的红线呢，其实是<strong>“对打”</strong>。刚才我们讲了，量化基金它会把一个大单拆成好多小单，自己去慢慢执行去，这件事情呢它是允许的。前提是什么？你是到市场上对着公共池子去交易，这个事就没问题。但一旦是说我操纵了好几个账号，自己跟自己去交易了，这个事就不行了。你像林艺平这个其实也是这样，他操作了一边是幻方量化的账号，一边是他自己的林某志和何某龙的账号，自己跟自己交易了，这个事是不允许的。在任何一个国家的证券市场里头，这件事都是违法的。</p>



<p class="wp-block-paragraph">为什么这个是违法呢？因为股市这个东西，特别是股票的价格呢，它是怎么来的？这个东西叫“价格发现”。就是我这没卖出去，交易没有成功；我这要买了没买到，这个交易没有成功，它对于股价是没有影响的。那边正好有人要卖，我们交易成功了，那么股票的价格就会发生变化，我发现了新价格。那如果是一些小盘股，自己买自己卖，突然就做出了一笔交易来，这个股票的价格就会发生异常波动。小盘股嘛，他一般交易也没有那么多，或者交易的没有那么频繁，他就会发生这种异常波动，就有可能会吸引别的人进来买，等别人吸引进来了以后，他自己就跑路了。这个其实是很多游资干的活。最近呢，也爆出一些国内游资玩不下去了，他们就跑到美国去。因为刚才咱们讲了，国内搞断卡行动以后，游资手里边的账号也没那么多了，他们就去美国炒。但是到美国以后呢，做过分了以后会被SEC处罚。这种案件最近也是不断地被爆出来。</p>



<p class="wp-block-paragraph">全球的股市呢都有监控功能，发现这种同频交易就会触发监控。国内呢，实名制还要更严格一点；美国呢，是诉讼门槛更低一些。什么意思呢？就是国内呢，因为是实名制，所以呢你只要干类似的这种事情都会被发现。但是呢，是不是会起诉，会不会真的把你抓出来，还得看您上头是不是有人。这个玩意就跟西游记似的，孙悟空从头到尾打了半天，最后没打死几个人，真正的罪大恶极的，实际上都是什么神仙的坐骑、菩萨的坐骑，都是这玩意。所以您最后是不是会被抓住，跟你做什么没关系，看你上头有没有人才有关系。而美国呢，它没有实名制，发现要稍微难一点。但是呢，他们起诉是很容易的，你只要是这个股价异常波动了以后，下边人都是可以起诉的。如果起诉你，你这受到处罚的几率会更大一些。大概就是差在这。</p>



<p class="wp-block-paragraph">真正老鼠仓的重灾区，其实并不是股市，而是什么呢？而是币市，就是区块链这帮人，他们是真正的重灾区。为什么？因为他们没有监管。他们的这些交易都是去中心化的，虽然现在有中心化交易所，但是这个交易所也不是说所有的人都在我这执行这一套东西。咱们一帮的中心化交易所，也是在去中心化的链上去执行的。所以在他们这里头呢，是没有总体监管的。像美国有SEC监管，中国有证监会监管，你说我在链上交易，币安能监管吗？监管不了。他只能监管说我自己内部的人，你不要干这个事。因为这个事呢，对于名声的损害是很厉害的，一旦你内部的人干这件事的话，大家就不敢把钱存在你这了。</p>



<h2 class="wp-block-heading">故事的启示</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/deepseek-front-running-penalty-china/blog-9.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">最后总结一下吧。这个故事告诉我们了几个道理。</p>



<ul class="wp-block-list">
<li><strong>第一个道理：信息就是钱。</strong>这个林艺平他偷的是什么？偷的是幻方量化的信息，偷的钱其实也是幻方量化的钱。信息就是钱。</li>



<li><strong>第二个道理：不是自己的钱不要伸手。</strong>但是你说我玩币圈的，你自己看着办，这事跟我们没关系。但你说我在证券市场上，在股票市场玩这个事，只要是达到一定的频率阈值以上，就一定会被抓。那你说到底是到多少阈值以上会被抓？没有人会告诉你这个具体的数字的，这个大家自己小心就完了。</li>



<li><strong>最后呢：市场有风险，投资需谨慎。</strong>我们这各种这消息、那消息满天飞，我今儿买点这个，明天卖点那个，有的是人在里头去赚一些奇奇怪怪的钱。</li>
</ul>



<p class="wp-block-paragraph">今天这个故事就讲到这里，感谢大家收听。请帮忙点赞、点小铃铛、参加<a href="https://discord.gg/ppKsNkttTv" target="_blank" rel="noopener">DISCORD讨论群</a>，也欢迎有兴趣有能力的朋友加入我们的<a href="https://www.youtube.com/channel/UCUGLhcs3-3y_yhZZsgRzrzw/join" target="_blank" rel="noopener">付费频道</a>。再见。</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
