<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>AI产业链 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<atom:link href="https://lukefan.com/tag/ai%E4%BA%A7%E4%B8%9A%E9%93%BE/feed/" rel="self" type="application/rss+xml" />
	<link>https://lukefan.com</link>
	<description>这里是老范讲故事的主站，持续更新 AIGC、大模型、互联网平台、商业冲突与资本市场观察，帮你看清热点背后的底层逻辑。</description>
	<lastBuildDate>Wed, 11 Jun 2025 00:43:19 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1</generator>

<image>
	<url>https://lukefan.com/wp-content/uploads/2026/03/cropped-jimeng-2026-02-28-5245-用图一的人物形象，替换图二中的人物，使用图二的风格。文字替换：老范讲故事，Yo-32x32.jpeg</url>
	<title>AI产业链 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<link>https://lukefan.com</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>Meta为何砸下百亿重金投资而非直接收购AI数据标注巨头Scale AI？揭秘扎克伯格剑指AI生态霸权，欲借华人天才少年之力挽救Llama开源模型困局的深层战略与考量。</title>
		<link>https://lukefan.com/2025/06/11/meta%e4%b8%ba%e4%bd%95%e7%a0%b8%e4%b8%8b%e7%99%be%e4%ba%bf%e9%87%8d%e9%87%91%e6%8a%95%e8%b5%84%e8%80%8c%e9%9d%9e%e7%9b%b4%e6%8e%a5%e6%94%b6%e8%b4%adai%e6%95%b0%e6%8d%ae%e6%a0%87%e6%b3%a8%e5%b7%a8/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Wed, 11 Jun 2025 00:43:17 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[Meta的故事]]></category>
		<category><![CDATA[AI产业链]]></category>
		<category><![CDATA[AI伦理]]></category>
		<category><![CDATA[AI大模型]]></category>
		<category><![CDATA[AI技术]]></category>
		<category><![CDATA[AI投资]]></category>
		<category><![CDATA[AI数据]]></category>
		<category><![CDATA[AI算力]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[FTC]]></category>
		<category><![CDATA[H100]]></category>
		<category><![CDATA[H800]]></category>
		<category><![CDATA[LLaMA]]></category>
		<category><![CDATA[Llama 4]]></category>
		<category><![CDATA[Meta]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[Sam Altman]]></category>
		<category><![CDATA[Scale AI]]></category>
		<category><![CDATA[YC]]></category>
		<category><![CDATA[亚历山大王]]></category>
		<category><![CDATA[亚马逊]]></category>
		<category><![CDATA[华人创业]]></category>
		<category><![CDATA[合成数据]]></category>
		<category><![CDATA[商业分析]]></category>
		<category><![CDATA[微软]]></category>
		<category><![CDATA[扎克伯格]]></category>
		<category><![CDATA[数据垄断]]></category>
		<category><![CDATA[数据标注]]></category>
		<category><![CDATA[模型微调]]></category>
		<category><![CDATA[科技巨头并购]]></category>
		<category><![CDATA[科技行业动态]]></category>
		<category><![CDATA[科技评论]]></category>
		<category><![CDATA[美国国防部]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[自动驾驶数据]]></category>
		<category><![CDATA[英伟达]]></category>
		<category><![CDATA[谷歌]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2283</guid>

					<description><![CDATA[啊啊啊啊啊啊！家人们！Meta竟然砸了超百亿美金投资Scale AI，AI圈直接炸开锅了！我真的要尖叫了！这操作简直绝了！不允许有人不知道这件事，赶紧跟我一起冲，搞清楚这背后到底有多牛！🔥🔥🔥

先说重点！Scale AI是啥？它是全球最大的AI数据标注公司，简单来说就是给AI“大脑”喂数据的“幕后大佬”！没有高质量的数据，AI再聪明也白搭！而Meta这次大手笔投资，直接把Scale AI推上风口浪尖，摆明了要补齐AI短板，冲击开源大模型的王者宝座！Llama 4翻车不就是因为数据不行吗？现在有了Scale AI，Meta这是要直接起飞啊！🚀

来，咱再细聊几点，感受下这波操作的硬核：
1️⃣ **客户名单逆天**！微软、OpenAI、谷歌、特斯拉，甚至美国国防部都是Scale AI的客户！这公司简直就是AI界的“数据供应商天花板”！Meta投资它，等于间接握住了AI生态的命脉！
2️⃣ **华人天才少年CEO**！亚历山大·王，97年出生，19岁辍学创业，MIT学霸光环加身！这波操作直接让人跪了，少年强则AI强啊！😭
3️⃣ **数据标注有多重要**？AI的三大要素：技术、算力、数据，缺一不可！Scale AI的标注能力直接决定AI模型能不能“开挂”，Meta这次是下血本补短板了！

最后说一句，Meta这波投资不仅是给Scale AI“输血”，更是给整个AI行业扔了一颗重磅炸弹！未来谁家的大模型更好用？谁能微调出最牛的效果？答案可能就在Scale AI的数据里！家人们，AI的未来真的太燃了！我已经迫不及待想看到Llama系列的逆袭了！你们觉得这波投资咋样？快来评论区跟我一起尖叫啊啊啊啊！💥💥💥


Meta为何砸下百亿重金投资而非直接收购AI数据标注巨头Scale AI？揭秘扎克伯格剑指AI生态霸权，欲借华人天才少年之力挽救Llama开源模型困局的深层战略与考量。

AI领域再起波澜，Meta斥资逾百亿美金战略投资数据标注领军企业Scale AI，这家由华人天才少年CEO亚历山大王创办的公司，已是微软、OpenAI乃至美国国防部的核心数据服务商。此次投资而非收购，深层原因在于Scale AI的行业龙头地位易引FTC反垄断审查，且其国防部客户身份特殊。扎克伯格此举意在解决Llama 4因合成数据质量问题导致的性能瓶颈，通过掌控高质量AI训练数据源头，为Llama开源大模型注入新活力，并构建从数据标注到模型微调的闭环AI生态系统，以期在激烈的AI竞争中扳回一城，重塑其在开源大模型领域的领导地位。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="Meta为何砸下百亿重金投资而非直接收购AI数据标注巨头Scale AI？揭秘扎克伯格剑指AI生态霸权，欲借华人天才少年之力挽救Llama开源模型困局的深层战略与考量。" width="900" height="506" src="https://www.youtube.com/embed/Iwbgcz8NZHs?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">Scale AI得到了Meta超过百亿美金的投资，AI圈又热闹起来了。大家好，欢迎收听老范讲故事的YouTube频道。</p>



<p class="wp-block-paragraph">Scale AI这个名字怎么好像在哪听说过呢？好像有点耳熟，对吧？他呢，有一位特别传奇的CEO，或者叫创始人吧，叫华人天才少年CEO亚历山大王。当时呢，跳出来指责DeepSeek用H100的就是他。</p>



<p class="wp-block-paragraph">DeepSeek R1到底是怎么训练的？引起了广泛的关注。DeepSeek自己讲呢，我使用了2,000多块的H800就完成了训练。但是亚历山大王呢，在一次接受采访的时候就出来说了，中国实验室里边拥有的H100的数量远超大家的想象，DeepSeek自己至少有5万块H100。但是这个话呢，没有实际证据，讲完了也就完了。DeepSeek跟亚历山大王之间呢，并没有就这个事情进行认真的探讨，所以这个我们把它当成一种谣传吧。</p>



<p class="wp-block-paragraph">3月份呢，DeepSeek自己再次发了声明，说他们训练的都是使用的合规的GPU，也就是允许向中国出口的这些GPU。因为如果不说这个的话，美国就有可能要求说禁止使用这玩意儿。DeepSeek就讲了说，甭管是R1也好，V3也好，训练呢都是使用的H800，或者是后面的H20这些GPU训练的。</p>



<span id="more-2283"></span>



<p class="wp-block-paragraph">黄仁勋来北京的时候呢，还专门跟梁文峰两个人坐在一块去沟通过，肯定是对得上口径。所以呢，这应该是唯一的事实，不要再去猜测到底有多少H100在DeepSeek手里这件事情了。</p>



<p class="wp-block-paragraph">这位华人小哥呢，这件事让我记住了，因为他也是个很大的公司，估值250亿美金的公司。因为它是一个ToB的公司，是为别人服务的公司，所以不太跟普通用户打交道，很多人没有听说过。</p>



<p class="wp-block-paragraph">Meta的投资呢，这一次算是有点一反常态。为什么呢？你说互联网企业出来投资个别人项目，不是很正常吗？不行，这个里头，美国有一家比较奇特的互联网企业，中国有一家比较奇特的互联网企业，都是不怎么投资别人的。美国的就是Meta，中国的是拼多多，就是我自己有钱，自己就憋了死干，不怎么投资。</p>



<p class="wp-block-paragraph">但是Meta呢，还不太一样。扎克伯格的原则是什么？叫收购或者埋葬，要不然我把你买下来，要不然我把你干掉，这就是不服就干那种状态。所以我一直说，Meta这个公司的玩法挺中国的。而且到目前为止，因为扎克伯格是创始人，依然在管理Meta，所以Meta还是有非常强的创始人风格的。</p>



<p class="wp-block-paragraph">像皮才管理谷歌，或者是提姆库克管理苹果这样，这就是职业经理人了，他们是没有什么风格的。</p>



<p class="wp-block-paragraph">但是，扎克伯格的风格就是这样：买你，或者把你干掉。到目前为止，唯一失败的就是Snapchat。这个没买成，也没把人干掉，其他的都算是成功的。</p>



<p class="wp-block-paragraph">Meta过往的收购历程：</p>



<p class="wp-block-paragraph">2012年，10亿美金收购Instagram。现在Instagram也是多么如日中天的一款产品。2013年，曾经想用60亿美金去收购Snapchat，被拒绝了，没把人干掉。这是唯一的败绩。</p>



<p class="wp-block-paragraph">2014年，190亿美金收购WhatsApp。现在有这么多的人使用WhatsApp。除了中国使用微信，美国可能Facebook message跟WhatsApp是各占一半儿。泰国、日本、台湾使用line，其他的国家都是使用WhatsApp的。</p>



<p class="wp-block-paragraph">2014年，20亿美金买了Oculus，就是现在我们看到的Meta VR产品。2020年，4亿美金买了一个公司叫GIPHY。这公司干嘛的呢？是做动态图标，或者说一个通俗易懂的话，就这公司做表情包的。</p>



<p class="wp-block-paragraph">2020年，10亿美金买了一个公司叫Kustomer。它呢是k开头，这个是做客户服务CRM平台的。因为呢，Meta有大量的广告业务，很多人需要通过Meta去进行一些管理，干脆我花钱买一个吧。</p>



<p class="wp-block-paragraph">2023年，4亿美金买了VC unlimited这样的一个公司。这个呢是虚拟现实内容开发的。你想他做了这么半天VR产品，VR产品的内容很难开发，那我干脆买一个吧。但是这一次呢就有点费劲了，虽然钱不多，4亿美金，他被FTC，也就是美国联邦贸易委员会起诉了，说你这个是要垄断。你自己做Oculus，Meta自己的VR产品，你还把提供VR内容的公司买下来，这事有问题。后来胜诉了才完成收购。2021年就跑去收购了，到2023年胜诉了，才把这个收购完成。</p>



<p class="wp-block-paragraph">这一次投资而不是收购呢，应该也是怕FTC起诉他。因为Scale AI是整个AI数据标注行业的老大，绝对龙头。那你要把它收购下来，肯定是要被起诉的，而且这次可能还打不赢这官司。250亿美金的估值，直接投进去100多亿美金，基本上也算是控制了，但是应该没有控股。这种公司你控股了估计都会被起诉。微软不敢控股OpenAI，应该也是同样的原因。</p>



<p class="wp-block-paragraph">那么，Scale怎么就这么敏感呢？咱们好好看一下Scale到底干嘛的。Scale AI和他的天才少年华人CEO，你看这么多定语在前头，咱们稍微给大家介绍一下。AI时代三要素，大家还记得是什么吗？技术、算力、数据。</p>



<p class="wp-block-paragraph">这个Scale AI就是做数据的。Scale AI是世界上最大的数据标注公司，它的估值是竞争对手第二名的10倍。就是它250亿美金，在它后边跟它竞争的人25亿美金。</p>



<p class="wp-block-paragraph">Scale AI的客户有哪些？微软、OpenAI、Meta、谷歌、亚马逊、英伟达。做大模型的公司都是他客户，然后做汽车的公司也都是他的客户：特斯拉、Volvo、Cruise（就是通用做的这个无人车公司），还有丰田和通用都是他的客户。Paypal、Airbnb都是他客户，三星以及美国国防部。</p>



<p class="wp-block-paragraph">一旦美国国防部成为你的客户了，你就很难被收购了。我原来服务过的一家公司叫Borland，Borland到最后就想被人收购，说我已经玩不太下去了，谁来买我？卖不掉，为什么？他也是有一个客户叫美国国防部。他当时是给好像海军陆战队，还是给谁去做指挥链路的数据链系统。其实也不是一个特别底层的服务，就是做了这样的一个项目以后，谁想收购他就需要经过特别严格的审核。到最后也没有被收购成功。</p>



<p class="wp-block-paragraph">这也是解释了为什么Meta不能收购它，只能投资它，连控股它都不能。第一个，它的位置很尴尬。它是所有这些做AI项目的公司的数据提供商，你一旦把它收购了，你就又垄断了，FTC一定会起诉它。另外一个，他还有一个很重要的客户叫美国国防部，一旦收购他就会被很严格的审查，这种案子基本上没法通过。</p>



<p class="wp-block-paragraph">再讲一下这位天才少年华人CEO吧。这个亚历山大王呢，1997年出生于美国新墨西哥州，父母为洛斯阿拉莫斯国家实验室的物理学家。这就是物理学家生出来的天才少年。为什么叫少年呢？就是他创业的时候一定要特别年轻才叫少年。高中时候就获得了USACO（也就是美国计算机奥林匹克）的金牌，所以算是根红苗正。</p>



<p class="wp-block-paragraph">曾经被美国的Addepar和Quora等公司破格录用，担任过Quora技术主管。在担任主管时主导了推荐系统的优化，使得问答匹配效率提升了40%。Quora呢其实是知乎抄的它，就算是美国版的知乎，全世界最大的问答网站。这个里面的推荐系统是亚历山大王优化的。</p>



<p class="wp-block-paragraph">再往后呢，就是美国这帮天才少年CEO必须要干的一件事儿，是什么？叫辍学创业。2015年以满分GPA考入了麻省理工学院（就是MIT），大一期间因为Alphago引起的AI热潮，决定辍学创业，就创立了今天的Scale AI。Scale AI的种子轮融资是YC给的，给了12万美金。YC的CEO是谁？或者说给他钱的人，这个人叫什么？</p>



<p class="wp-block-paragraph">这个人叫山姆·奥特曼，所以这个圈子真的很小。</p>



<p class="wp-block-paragraph">然后，Scale AI的发展历程是什么样的呢？2016年，亚历山大·王19岁辍学创业。最开始呢，是在这个AI圈子里头叫“拉框”干这个事的。什么是拉框呢？就是给自动驾驶领域标注数据。自动驾驶里头有很多的摄像头、激光雷达呀。实际上，激光雷达也是个摄像头，只是拍出来的是一个黑白的、深度信息的照片。然后，哪个地方是人，哪个地方是车，哪个地方是牌子，或者说交通标志标线，你呢，需要靠人去拉一个框，把它标注下来。所以他最早就干这个。像什么Waymo（就是谷歌的自动驾驶公司），还有Cruise这些无人驾驶车的公司呢，最早的数据都是从他这来的。</p>



<p class="wp-block-paragraph">全球首个规模化众包标注网络，涵盖50多个国家和10万名标注员。你标这个事情，他肯定是很耗人工的嘛。所以呢，他最后说：“我们众包吧，你们谁愿意标，谁就在我这平台上去注册，你来给我标来。”所以呢，他干的活叫“数据处理的人肉云计算”。虽然是云计算，但是底下都是真人。“越人工越智能”就是从这儿来的。</p>



<p class="wp-block-paragraph">逐渐发展到为整个行业提供高质量的数据。它等于是从拉框开始，到最后，比如说OpenAI使用的各种对话数据什么的，都是由Scale AI来去标注的。后面和美国国防部合作，标注军用数据。你说这个无人机满天飞，导弹满天飞，我怎么能够说把正确的目标炸中了？那你也需要拉框，你也需要去做标注，看清楚这个是平民，那个是军用目标，你要做这样的标注。这个都是Scale AI提供的服务，包括伦理服务，包括对齐服务，他都要去提供。</p>



<p class="wp-block-paragraph">而且呢，他也对标注呢进行分级。你说：“我是一个普通标注员，一个小时8美金，我去给人拉框去。”你说：“我是一个医学博士，那你可以来标注什么呢？医疗数据。”现在医疗影像数据也都标注过了，你是可以直接用大模型去进行什么X光片读片的，那个效率非常高，而且要比普通人读的还要准。</p>



<p class="wp-block-paragraph">现在全行业的数据都有标注：医疗的、多模态的数据、国防的，各种数据它全标了。应该是全世界最大的一个，而且标注数据最全的一个标注公司，就是Scale AI。</p>



<p class="wp-block-paragraph">下面咱们来讲一讲Meta为什么给了这么多钱给Scale AI呢？你说你花钱买的服务就完了，你干嘛要去直接100多亿美金砸进去呢？按道理来说，像我们投资案子有几个阶段。第一个阶段就是占20%以内，250亿美金，20%的话应该是50亿美金吧。为什么是这样呢？花钱投了，你也拿到钱了，我还不影响报表。超过20%呢，叫重大影响。</p>



<p class="wp-block-paragraph">每年，Meta出这个财报的时候，你要把它也审计一遍，才可以去投超过20%。所以，像我们以前经常投资的，投19.9%就是为了躲避这个审计成本。</p>



<p class="wp-block-paragraph">还有呢，就是直接控股，直接占51%，那我说了就算，甚至可以把CEO干掉，剩下我自己管。再往后就是我直接把你并购进来，整个公司的这个财务报表全进来了。特别是这个公司有很大的用户数据，或者有很大的营收的时候，你把它买下来是很划算的。买下来以后，就可以跟自己原来的业务去做整合了。</p>



<p class="wp-block-paragraph">那么，在他这干这个活就很怪，给的钱很多。你想，250亿美金的估值，他给了100多亿美金，就属于绝对超过20%。但是呢，又不控股。不控股的原因咱们刚才也讲了，国防部的项目，你要敢控股它，你就等着接受审查吧，这事很麻烦。</p>



<p class="wp-block-paragraph">那为什么要给这么多钱呢？这个不符合投资逻辑。那咱们来分析分析这件事情呢，还是要从Llama 4的翻车开始说。Llama呢，是开源大模型的领军，Llama1、Llama2都算是领军。到Llama3呢，很多人都在这上面去进行开发，拿Llama3去做微调，拿Llama3去构建自己的系统，构建自己的模型。但是还被DeepSeek跟千问直接抄了后路了。</p>



<p class="wp-block-paragraph">你说现在最好用的，可能DeepSeek R1是所有开源模型里最好用的（咱不跟闭源的比）。使用量最大的千问，为什么千问使用量最大呢？也还算好使，而且呢，它提供的特别全，从0.6B的一直到200多B的，就是各种大小全都给了。大家去微调模型的时候，肯定是选一个自己合适的拿出来用。</p>



<p class="wp-block-paragraph">Llama4就翻车了。第一个给的模型的版本就很少，你说我想找一个小模型去微调，他没给。另外一个翻车的核心原因是什么？就数据不行。他呢，使用的是合成数据。在训练Llama 3的时候，其实基本上已经把全世界能用的数据都给用光了。等到Llama4的时候，你说我要继续提高数据量，更大的规模去进行训练，那你这数据哪来呢？基本上能用数据都用掉了呀。</p>



<p class="wp-block-paragraph">那么，Llama这帮人想了，是我们干脆合成吧，自己合成一堆数据去训练吧。结果Llama4就翻车了。合成数据三大致命缺陷：第一个是什么？叫领域泛化能力缺失。</p>



<p class="wp-block-paragraph">什么叫领域泛化能力？Meta其实有的是数据，你想它几十亿用户，大家每天在上面聊个天，发个动态，它有多少数据？它是最不缺数据的。全世界可能不缺数据的公司，一个是谷歌，一个是Meta，其他人都没有他们这么多的数据。但是呢，Meta的数据有个问题，Meta的数据呢都是日常对话。</p>



<p class="wp-block-paragraph">咱们在里头聊个天，在里边发个日常动态。其他领域的数据，比如医疗、国防，这些领域的数据它是没有的。导致呢，M4在垂直领域里的应用基本上全线崩溃。你问他说：“这个人今天是不是开心？”他可以回答得很好。你给他张片子说：“这个是不是有癌症？”他都答不出来了，这很正常嘛。</p>



<p class="wp-block-paragraph">第二个呢，就是多模态对齐失效。什么叫多模态对齐失效呢？Llama4生成了很多的图片，说来：“咱们拿这玩意儿去做实验吧，咱们拿这个东西去做这个训练吧。”但是呢，Llama4的很多训练的生成数据本身是错的。比如说吧，他生成了一个红色轿车在雨中行驶的一张图片，但是呢，雨滴的方向跟车的运动轨迹是错的，这个就没法整了。Llama自己生成图片的能力就很差，他再拿这种数据去训练的话，就一定是各种错误就都出来了。</p>



<p class="wp-block-paragraph">第三个呢，就是鲁棒性对抗不足。很多黑客呢通过注入对抗样本，也就是说把一些错误数据扔进去，导致呢Llama4的图像识别的准确率直接从89%降低到12%。这就是Llama4使用自己生成的数据，或者叫合成数据，训练出来以后翻车的一个核心原因。</p>



<p class="wp-block-paragraph">那哪里摔倒了在哪里爬起来呗，就数据不行吗？咱就整数据就完了。Llama自己又不缺数据，那么多用户数据咱们就标注呗，花大钱把它买下来。虽然现在不让买嘛，但是我花大钱基本上还是能控制的，应该算是第一大股东了。有了Scale AI，我们就算把最后一块短板给补上了，这个就是煤炭为什么要投资它的原因。</p>



<p class="wp-block-paragraph">但是呢，这里还有一个问题，就是刚才我们讲了投资逻辑。我投个19%就不就够了吗？为什么要投这么多呢？这肯定是第一大股东，已经超过亚历山大王的这种创始人的股份了。那你到底想干嘛呢？</p>



<p class="wp-block-paragraph">Meta自己现在的战略其实是很清晰的：60万块显卡，算力我有了；杨乐坤大神在这呢，技术我也有了；不就是缺数据吗？Scale AI我是第一大股东，基本上控制住了。而且开源大模型我原来是领军人物，现在被DeepSeek跟千问超越了。那我现在要靠什么东西弄回来？你说我光靠提供Llama4的能力，或者后边比如说我出一个Llama4.1、4.5，我把能力提上去，我就能够战胜DeepSeek R1吗？我就能够战胜千问吗？胜不了的。</p>



<p class="wp-block-paragraph">那怎么办呢？大家想一想，Scale AI它的客户都是什么人？它的客户比如微软。你说我用了Scale AI训练完，标注了数据了，我后边能够用Llama吗？这不可能。OpenAI你说我后边用Llama去……</p>



<p class="wp-block-paragraph">这也不可能。那谁会去用Llama呢？大家要想一想：除了最大的这些Scale AI的客户之外，其他那些小一点的Scale AI的客户，他们请Scale AI去标注了数据以后，这些被标注的数据拿去干嘛用了呢？训练自己的大模型去了？开玩笑呢！只有最大的这几家公司——谷歌、微软、英伟达、OpenAI这样的公司，你是标注了数据回去训练大模型了。所有小一点的公司，或者说除了这几家之外的这些公司，你用Scale AI去标注了数据回来，只能干一件事儿，就是微调小模型。</p>



<p class="wp-block-paragraph">现在好了，Meta把Scale AI基本上算控制了——虽然不是控股，但基本控制了。那以后用Scale AI标注的数据，微调谁家的大模型效果最好呢？一定是微调Llama家的大模型效果最好！内部是一波人各种的优化，咱们自己内部的搞定完事。原来大家都是拿这个Scale AI标注的数据去微调千问的模型，现在不用挑了，一定是自己家的最好。所以呢，这算是AI生态建设的关键一步，直接形成了闭环了：你用Scale AI训练，你用Scale AI标注数据，然后我给你同时提供微调解决方案，一次搞定哈！这是这一次Meta投资Scale AI的一个底层逻辑。</p>



<p class="wp-block-paragraph">但是因为Scale AI的行业地位，一旦收购必然被FTC起诉，再加上Scale AI是美国国防部的供应商，一旦收购必然被美国国防部去审查，所以Meta就被迫采取了这样的一种很不舒服的投资方案——投了100多亿美金，成为Scale AI的第一大股东。这个故事到这儿就跟大家讲完了。</p>



<p class="wp-block-paragraph">感谢大家收听，请帮忙点赞、点小铃铛，参加DISCORD讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见！</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>DeepSeek掀起全球AI军备竞赛，OpenAI、Anthropic、SSI、都宣布新融资，从投资人角度给大家解析其中的投资圈儿黑话。</title>
		<link>https://lukefan.com/2025/02/13/deepseek%e6%8e%80%e8%b5%b7%e5%85%a8%e7%90%83ai%e5%86%9b%e5%a4%87%e7%ab%9e%e8%b5%9b%ef%bc%8copenai%e3%80%81anthropic%e3%80%81ssi%e3%80%81%e9%83%bd%e5%ae%a3%e5%b8%83%e6%96%b0%e8%9e%8d%e8%b5%84%ef%bc%8c/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Thu, 13 Feb 2025 00:37:26 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AI产业资本焦虑]]></category>
		<category><![CDATA[AI产业链]]></category>
		<category><![CDATA[AI估值下降信号]]></category>
		<category><![CDATA[AI公司财报影响]]></category>
		<category><![CDATA[AI军备竞赛]]></category>
		<category><![CDATA[AI创业公司融资]]></category>
		<category><![CDATA[AI创业投资机会]]></category>
		<category><![CDATA[AI大厂战略布局]]></category>
		<category><![CDATA[AI大模型竞争]]></category>
		<category><![CDATA[AI天花板]]></category>
		<category><![CDATA[AI市场入场券]]></category>
		<category><![CDATA[AI技术革命]]></category>
		<category><![CDATA[AI投融资]]></category>
		<category><![CDATA[AI投资策略]]></category>
		<category><![CDATA[AI流量焦虑]]></category>
		<category><![CDATA[AI算力成本]]></category>
		<category><![CDATA[AI股市操纵问题]]></category>
		<category><![CDATA[AI融资案例解析]]></category>
		<category><![CDATA[AI融资竞争激烈]]></category>
		<category><![CDATA[AI行业未来趋势]]></category>
		<category><![CDATA[AI行业裁员风险]]></category>
		<category><![CDATA[AI资本重复计算]]></category>
		<category><![CDATA[AI超级晚广告]]></category>
		<category><![CDATA[AI领域最后一搏]]></category>
		<category><![CDATA[AMD CPU销售]]></category>
		<category><![CDATA[Anthropic融资]]></category>
		<category><![CDATA[ARM专利收入]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[DeepSeek北京总部]]></category>
		<category><![CDATA[Elon Musk]]></category>
		<category><![CDATA[Meta算力投入]]></category>
		<category><![CDATA[OpenAI估值]]></category>
		<category><![CDATA[SSI]]></category>
		<category><![CDATA[XAI]]></category>
		<category><![CDATA[亚马逊算力投资]]></category>
		<category><![CDATA[全球AI格局]]></category>
		<category><![CDATA[全球大厂AI投入]]></category>
		<category><![CDATA[博通芯片供应]]></category>
		<category><![CDATA[大模型竞争格局]]></category>
		<category><![CDATA[大疆融资]]></category>
		<category><![CDATA[孙正义领投]]></category>
		<category><![CDATA[安全超级智能公司]]></category>
		<category><![CDATA[幻方资本]]></category>
		<category><![CDATA[微软AI投资]]></category>
		<category><![CDATA[投资人行业观察]]></category>
		<category><![CDATA[投资黑话]]></category>
		<category><![CDATA[日本AI投资]]></category>
		<category><![CDATA[欧洲AI基金]]></category>
		<category><![CDATA[百度风投]]></category>
		<category><![CDATA[算力制高点]]></category>
		<category><![CDATA[算力卡]]></category>
		<category><![CDATA[纳斯达克警告函]]></category>
		<category><![CDATA[英伟达营收]]></category>
		<category><![CDATA[谷歌AI中心]]></category>
		<category><![CDATA[资本造富神话]]></category>
		<category><![CDATA[超募概念]]></category>
		<category><![CDATA[风投资金路径]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1907</guid>

					<description><![CDATA[🔥DeepSeek掀起全球AI军备竞赛，你准备好了吗？

大家好！我是你们的老朋友老范，今天我们要聊的是DeepSeek如何在全球掀起了一场AI军备竞赛！🚀

📅 2023年到2024年，AI相关的融资就已经是村里最靓的仔了。但DeepSeek的出现，直接点燃了这场链式反应，就像原子弹爆炸一样，2025年初直接燃爆了！💥

🔍 从投资人的角度，我们盘点了一些热门投资案例，比如百度风投没投中DeepSeek的趣闻。百度的风投部门和内部投资部可是有区别的，风投更多的是赚基金的钱，而不是直接收购项目哦！💰

🌟 还有SSI估值200亿美金的新一轮融资，以及Anthropic和OpenAI的快速融资。OpenAI的最新融资已经确认，估值从3400亿美金调整到了3000亿美金，这可是一个非常危险的信号！📉

🏢 全球各大科技巨头如亚马逊、微软、谷歌和Meta也纷纷加大投入，建算力中心、买算力卡，今年的投资总额将超过2000亿美金！💸

💡 在这场AI军备竞赛中，英伟达、AMD和博通将成为最大的赢家，他们的营收将大幅增长。而ARM也在悄悄分一杯羹。💰

🌟 最后，DeepSeek的崛起让我们看到了AI领域的无限可能，全球资本疯狂涌入，谁将成为下一个赢家？让我们拭目以待！🎉

📢 如果你对AI投资感兴趣，欢迎点赞、评论，加入我们的Discord讨论群，一起探讨AI的未来！💬

---

🌟 关注我，了解更多AI投资的前沿资讯和深度解析，让我们一起迎接AI的新时代！🚀

DeepSeek掀起全球AI军备竞赛，OpenAI、Anthropic、SSI、都宣布新融资，从投资人角度给大家解析其中的投资圈儿黑话。

AI产业迎来资本暴风年，DeepSeek引爆全球AI竞赛，带来融资狂潮。百度风投因未能投资DeepSeek备受关注，而Anthropic以超募姿态快速崛起，估值飙至600亿美金，OpenAI则通过400亿美金融资巩固地位。全球大厂微软、亚马逊、谷歌等投巨资建算力中心，英伟达等硬件巨头迎来收割式增长。投资人如何看待这些资本动作？细节解析百度风投与DeepSeek失之交臂的背后原因，以及全球AI资本大局，探索谁能在最后一搏中站稳AI领域高地。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="DeepSeek掀起全球AI军备竞赛，OpenAI、Anthropic、SSI、都宣布新融资，从投资人角度给大家解析其中的投资圈儿黑话。" width="900" height="506" src="https://www.youtube.com/embed/tSredSC8D-k?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">DeepSeek掀起了全球AI军备竞赛。大家好，欢迎收听老范讲故事的YouTube频道。DeepSeek真的算是擦枪走火，带来了全球点燃的一个效果。其实，2023年和2024年，AI相关的融资就已经算是村里最靓的仔了。其他行业都没有AI投融资这么火爆，但是DeepSeek直接点燃了，带来了这种链式反应。一般讲链式反应，都是原子弹那个玩意儿才玩呢。2025年初直接燃爆了，各种AI融资事件快速爆发。我们现在能够知道的大型AI公司都在融资，都在加大投入。</p>



<p class="wp-block-paragraph">今天，从投资人的角度，帮大家稍微盘点一下目前比较热的几个投资案例，也把一些投资人行业里边的黑话用大家能够尽量搞明白的方式讲一遍。首先讲的第一个案例就是百度风投没有投中DeepSeek这个事。很多人说，你看百度风投就在DeepSeek北京的楼上，这么近他都没投上，百度不行了。结果百度风投的人就跑出来说，他说我们是风投，不是投资部门。</p>



<p class="wp-block-paragraph">这个里头要跟大家讲一下，大型的像BAT这些，它下边的投资机构是非常多的。它有公司的内部投资部，有外边挂名的风投。差异在哪？外边挂名的风投，你虽然挂在百度名，百度可能也出钱了，但是相对来说会更独立一些。他们赚了赔了，对于百度整个的财报影响并没有那么重要。他们当然也不会像百度内部的投资部那样，直接冲上去把一个项目收购下来。他们更多的是要去赚这个基金的钱。</p>



<span id="more-1907"></span>



<p class="wp-block-paragraph">像我以前在猎豹投资部，就属于是公司内部的这种战略投资部。我做的案例大概有一半以上都是并购，买下来，然后变成猎豹的一部分。百度投资部应该也是干这种事，但是风投不是这样的。风投主要挣的钱就是我投中了A，然后到B轮或者C轮的时候我退出，把原来这个钱几倍拿回来。他们是挣的这个钱的，这个是有差异的。但是呢，他里头也有一定的百度的资源。比如说百度内部的人想去创业了，他们会去投钱，或者是我投了一些项目以后，百度最后觉得不错。</p>



<p class="wp-block-paragraph">愿意把它买下来。如果投的不好呢？百度说：“那我就不买了。”这一块的损失呢，也不会记到百度财报里去。所以，这是一种很好的隔离风险的方式。</p>



<p class="wp-block-paragraph">百度风投的人说：“这个他们搬来的时候，我第一时间就上门拜访了呀。”这句话说的是什么意思？为什么他一定要强调这件事？在投资圈里头经常这么讲，比如说特别好的案子你没投上，这个事呢不怪你。但是如果这个案子特别好，人家都投完了，融资融完了你不知道，那这事就是你的工作能力有问题了。所以他一定要上来讲说这个：“人家来的第一天我就去上门拜访过了，不是说我偷懒了。”所以这个是行业黑化很重要的一句哦。</p>



<p class="wp-block-paragraph">再往后讲的一句话叫：“人家不需要钱。”因为幻方是很有钱的嘛，所以我们上去谈了一下，结果呢没有谈成。这个呢，就属于纯扯淡了。为什么呢？从一个公司的角度上说，他只要是在做创业，外边有人给钱，他都是会要的。那么谈不成的原因是什么呢？通常是几个？</p>



<p class="wp-block-paragraph">第一个，就是大家对于轮次要求的不一致。什么叫轮次要求不一致？比如说吧，百度风投他可能投A轮的，人家幻方上来说：“我已经投过A了，你要来就要投B了。”那么这个跟基金自己设立的标准不一样，那你是没法做的。还有些人说：“我需要钱，但是呢，我们要的这个条件比较苛刻。你上来以后什么条款都不能有，你也不能说你投了我以后，以后如果百度收购的话，我要优先被百度收购，或者说我不可以去否定这个事情。我们是不接受这个条款的。”这种百度风投很大概率是有类似这种条款在里头的，人家不接受，那你也是没有办法的。</p>



<p class="wp-block-paragraph">甚至还有些人上来是什么呢？说：“我就需要这么多钱，你们都搁这儿，条件我自己开。”就特别热门的公司，他会干这种事情。那么谁先把钱搁这儿，我就拿谁的钱，咱们只看先后，不看其他任何东西。这谁干过这种事？大疆就干过这种事。大疆有一年就是融资，说：“这个我现在融资了。”大家就疯狂拿着钱就去了。你像大疆这种公司融资呢，肯定是稳赚不赔的吧。投资这个事，他没有什么民族气节，也没有这个什么学雷锋这种事。</p>



<p class="wp-block-paragraph">投资是个生意，都是要挣钱的。这大家都看好的就都去了。然后大疆说：“我就开放这么多额度出来，你们谁先把钱搁这儿，我就拿谁的。”那最后就没有任何人有能力说：“我觉得条款不太好，我要调整调整。”都甭谈，就是把钱放这完事。这个就看谁强势了。幻方肯定夏策是有钱的，所以他相对来说比较强势，很多的条款就谈不下来。所以说人家有的是钱，不要钱这个事胡说八道。但你说有一些条款，我们双方之间无法达到统一，无法达到一致，最终导致投资失败，那这个呢也算是一种解释。那这种解释的目的是什么呢？说我的眼光很好。为什么呢？说如果说我看完了以后，觉得这个案子不行，我把他否了，最后人起来了，那意思就是我眼光不行。但是如果说我特别想投，但是这个条件没谈妥，特别是可能好多条件我都答应了，但是我的老板不同意，那么这个呢就是我是很厉害的，其他人是傻瓜。那是这样的一个题外音。</p>



<p class="wp-block-paragraph">然后呢，百度风投这帮人也拎出了一大堆自己投的这种AI项目。你看我们也投了这么多，反正有机会曝光呢，把自己的项目拿出来晒一晒，万一人家找到下一轮呢，总是好事。作为一个风投来说，刚才我讲了他是怎么挣钱的了，他就是自己的项目退出了，拿到下一轮了，继续往前走了，他就可以挣到钱。所以呢，他一定是趁这个机会，把自己投的AI项目都拿出来晒一下。而这就是最近闹得比较沸沸扬扬的百度风投没有投中DeepSeek的事情。这里头说人家不需要钱，是整个这个话里头相对来说呢，比较扯淡的一句话。其他呢每一句话背后的意思，跟大家稍微解释一下。</p>



<p class="wp-block-paragraph">然后再往后，SSI估值200亿美金，又在开始融资了。这SSI叫什么呢？叫安全超级智能公司（Safe Super Intelligence）。你说这是一什么公司，没听说过。伊利尔听说过没？就是从OpenAI出走的这位大拿，他重新创建的公司。这个公司呢准备再去融资。他当时融第一轮钱的时候，还跟大家说的，说你们不要想着在我这挣快钱，我这个可慢了。</p>



<p class="wp-block-paragraph">我也不惦记说很快就拿出产品来，很快就能挣钱。但是呢，他还是表现出了很强的资本性。什么意思呢？你想，他去年9月份融了10亿美金，估值是50亿美金。现在是2025年的2月份，他又奔着200亿美金的估值去融资去了。那么，去年9月投了他那10亿美金的这些投资人，你账面赚了呀。因为有的时候虽然你没有退出，但是我持股的这个账面价值上升了，也是可以的。这也算是一个新的造富神话。</p>



<p class="wp-block-paragraph">但是呢，这个里头有一个点大家要注意是什么？就是它到底要融多少钱，谁愿意去投，他要融的这个钱是不是凑齐了。这个话并没有说，所以呢，这块还有待观察。就是你每一次看到说，谁谁谁融钱了，你要看说我这个一共开放多少额度出来，这个额度是不是凑满了，谁领投。如果连领投方都说不出来的，那现在这个就是八字没一撇呢。就是通过有限的这个信息，大家是可以判断出来这个融资走到什么位置的。</p>



<p class="wp-block-paragraph">再往后一个，就跟他形成鲜明对比了，谁呢？Anthropic也在快速融资。去年他的估值是180亿美金，当时是亚马逊给了40亿美金。今年准备达到600亿美金，这个是非常非常快的。大家注意，他这40亿美金已经超募了。超募什么意思？就是我要40亿，现在举着钱上来的人，已经比这40亿多了。而且他这还是要求什么？你最少的一份1亿美金，少于1亿美金的别上我这儿捣乱了，没空陪你聊天去。多过1亿美金的才能上桌去谈。现在拎着超过1亿美金的这些人，把这钱凑合凑合，已经超过了。那么到底要谁的不要谁的，或者说我再稍微多拿一点点，现在他们在讨论这个问题。所以呢，他这块应该是很快会close，就是很快这个案子就会结了。所以你看跟刚才那个SSI比，这就是两个不同的阶段。有超募两个字大家就知道，这个案子已经进行到一个什么位置了。</p>



<p class="wp-block-paragraph">OpenAI呢，最近也在进行最新的融资。但是呢，OpenAI的这轮融资里头，还是有一些小细节可以去关注一下了。什么小细节呢？他去年融完那一轮以后。</p>



<p class="wp-block-paragraph">是1,500亿美金的估值。本来呢，是计划以3,000亿美金的投前估值去融400亿，投后估值是3,400亿。也有很多报导去报了，而且呢，他的领投方是确认的，他的领投方是软银的孙正义。上来说，这400亿美金里头，我至少出200亿。现在呢，据说这个400亿美金已经基本上算是凑齐了，但是发生了一个变化，什么呢？他的投后估值变成3,000亿了。那你说这个字到底差在哪了呢？注意，原来是投前3,000亿，加上400亿以后变成了3,400亿。现在呢，是投前2,600亿，加上400亿以后变成了3,000亿。这是一个什么？就是你的预期的估值下降了，这个是非常非常危险的一个信号。虽然他最后这轮还是融到了，而且孙正义的后边顶住了，大头我都出了，没什么大毛病。通常情况下，领投方会出到一半以上，这400亿里头，至少有200亿是孙正义出的，这个才叫领投。但是也有出1/3的，但剩下的就比较小的，这个也是存在的。但是呢，这个里头说明了一个什么问题呢？就是对于OpenAI这样的一个公司来说，底子实在太重了，你再想往上翻上去翻不动了。那你想，谁把他这个估值拉下来的？通常能够去谈估值的，能够去谈各种条款的，只有领投方。把他这个估值从3,400亿拉到3,000亿的人，就是孙正义。那你说会不会是其他人？不会。领投方，他出钱出的最多，占股占的最多，他不说话的话，别人不会在里头捣乱的，一定是跟着领投方去。像我们以前投这种案子，领投方要负责所有的谈判，然后跟所有跟投跟投方去协调，最终去写协议拟协议。其他跟投方只管在协议上签字就完了，其他你没有权利说我一定要去改协议的。但是你说我稍微改个一个很小的条款，像我们一般改的是什么条款？通常我们要求加的是说，我的权利没有我同意的时候，不可以随便乱改，这种权利一般我们是要去加的。其他的其实真的没有那么重要。这个里头呢，400亿进账，这个对于OpenAI来说，是比较确认的事情。咱们前面讲了。</p>



<p class="wp-block-paragraph">SSI是没有确定有多少钱进账的。Anthropic 40亿美金进账，而OpenAI是400亿美金进账。OpenAI最近还干了一个什么事呢？他在超级晚上做广告，1,400万美金在上头，做了一个一分钟长的一个广告。据说这个广告呢是用Sora前期画的，但是后期的修什么的，都是上人工去修的。这个广告出来了以后，很多人就说说你有这1,400万做广告的，你去训练三个DeepSeek V3出来。因为DeepSeek V3不号称训练成本是500多万吗？你一下把1,400万都花在这了，你至少可以训练两次，再再拐个弯回来了。</p>



<p class="wp-block-paragraph">这个呢其实也说明了一个很核心的问题，就是他的流量已经开始焦虑了。如果说大家疯狂的去下载他的软件，疯狂去使用，他没有什么流量焦虑的话，他是不会跑到超级晚上去做广告的。那这种广告砸完了以后，就说明OpenAI觉得自己的流量不够使了，说明他已经到了一个比较天花板的位置。</p>



<p class="wp-block-paragraph">除了这几家当红炸子鸡之外，其他的这些传统大厂，他们也在加大投入。就是DeepSeek上来以后，很多人说呀英伟达不行了呀，芯片已经够了呀，不需要这么多算力了。扯，这个东西上来了以后，一定是大家疯狂的开始冲进去买算力。现在呢？亚马逊说了，今年要投1,000亿美金进去，要去建各种各样的机房，基础设施，算力。微软也出来讲了，说我要800亿美金扔进去，也是建机房建算力，买这个算力卡。谷歌稍微的钱少一点，稍微省一点，我投750亿美金吧，我们也是要去建算力中心的。Meta大概是600多亿美金要投进来，咱们按这个钱多钱少那么顺下来的。</p>



<p class="wp-block-paragraph">那你说这个说一句不就说一句吗？这事真的需要去认真对待吗？跟大家讲所有大厂出来说的话，都是不能随便说的。如果比如说今天是2月份，他出来说了说我要投1,000亿美金进来，到了比如说八九月份了，或者十月份了，他这钱没有投进来，没花会怎么样？很多可能没有在这种大公司，或者上市公司里待过的人。</p>



<p class="wp-block-paragraph">都觉得无所谓。我前面吹个牛，难道还要上税吗？要哈，你对外做了承诺，股票会涨的。但是如果到了年底，你没有兑现这个承诺，你会收到SEC的警告函。你叫放假消息，操纵股市。这个时候，你就要去处理这个问题。我到底怎么能够把这个假消息给他坐实了？干脆要么就把这个钱花掉吧，或者是什么呢？在内部进行大裁员。为什么是裁员呢？就是告诉他，我计划有变，这个事搞不定了，要裁员。因为像我原来在Boland上班的时候，遇到过一次。年初的时候放了一个消息出去，说我要把哪个部门分拆了卖掉。折腾到年底，这个交易没有完成，就收到了纳斯达克的警告函。Borland是纳斯达克上市公司吗？收到警告函了以后，CEO二话不说，嗤哧咔哧就开始裁员。整个公司就开始数名单了。裁完了以后，向纳斯达克交了一个报告回去说：“你看，我们原来确实有这个计划，但是现在计划受阻，我们只能通过裁员的方式，把这个计划受阻的损失去弥补掉。我不是放假消息，我确实是在干这个事，只是呢，干的有一些问题。我现在也通过裁员的方式，把这个问题呢进行了一定的弥补，算是把这个警告函的这问题给混过去了。”</p>



<p class="wp-block-paragraph">所以这些大公司承诺不是随便下的。人家上来说，我这1,000亿，800亿，750亿，600亿，这个你是实实在在要花的。那谁可以随便拍脑袋下这种承诺呢？XAI，就是马斯克是可以干这个事的。为什么？因为他不是上市公司。特斯拉是上市公司，SpaceX，XXAI，Neuralink这些都不是上市公司。我吹各种牛皮没事，你最后说你吹这牛皮怎么没有实现？没实现就没实现呗，你管我呢？不会有任何人给他发起高喊的。所以这个我们要去注意，这些钱大概率是要花掉的。如果没花掉的话，可能伴随的就是大裁员，或者是一些比较大的动荡。甚至像我们当时，做完那一轮裁员了以后，最后好像把CEO都干掉了。但是你说最后这些大厂，是选择老老实实的把这个承诺实现掉，还是最后选择裁员呢？</p>



<p class="wp-block-paragraph">现在呢，并没有那么好说。不是说他就一定会老老实实地把它做，还是要看整个大市的走向。如果大势就是说大家一起冲上去，那他可能就老老实实地把这钱都花了。如果突然说，谁谁谁一下就革命性地领先了，其他人彻底追不上了，这个竞争结束了，那么可能有几家就会选择裁员收场。可能有一家就老老实实地把钱都花掉，成为这个胜利者，这个可能性也是存在的。</p>



<p class="wp-block-paragraph">所以，今天咱们讲的所有这些话，用投资的角度上咱们怎么看他？再往后这么多钱加起来，这好多钱，这么多钱都花出去，这怎么怎么受得了？这个要跟大家讲，从投资的角度上来说，这个思考是错误的。为什么呢？就这个里边很多钱它是重复的。什么叫重复的？你比如说，微软800亿美金，那这800亿美金里头有多少是给OpenAI的呢？有多少是去做其他的一些投入的呢？亚马逊1,000亿美金，这1,000亿美金里头有多少是给Anthropic的？有多少钱是要去给其他的AI创业企业的？都很难说呀。</p>



<p class="wp-block-paragraph">所以，在这个过程中，你不要想着说，微软应该老老实实地把800亿美金都变成这个算力中心。他可能是建了，微软花了800亿美金建了算力中心了，转建完了以后呢，他把算力中心的算力印成这个代金券，然后呢用这个代金券去投资了OpenAI。比如孙正义领投的400亿美金的这一轮，我在里头再跟投这个80亿美金的代金券。那这80亿美金不是凭空编出来的，是微软自己花了800亿美金建的算力中心，然后从这里边印的代金券出来，他不就又可以转出一笔钱来了吗？所以他好多钱是这么去重复的。</p>



<p class="wp-block-paragraph">那你说这些钱怎么分呢？所有的这些钱，咱们甭管是去重以后剩多少吧，应该还是会剩个2,000亿美金，3,000亿美金。那么这些钱到底谁能挣得到？这个钱里头，英伟达、AMD，博通三家，坐着等数钱就可以了。英伟达去年459.88亿的营收，上升了83.6%。今年，咱们看，后边有2,000多亿美金的投入，而且刚才讲这些投入基本上是确定的投入。</p>



<p class="wp-block-paragraph">这些钱，英伟达到底能收多少？他有可能就会在原来去年459.88亿美金营收的基础上，有可能会翻跟头往上翻。AMD呢，它是去年是257.85亿美金的营收，上涨了14%。在这个里头，他有可能也会挣到一笔，但是他挣到的应该没有英伟达多，因为他挣到的很多的钱是卖CPU的钱，他不是卖GPU的钱。因为AMD的那个米300，米450什么，这些叫MI什么什么，这个系列的GPU卖的其实不好。但是呢，大家去凑这个机房的时候，有时候会去买他们家的CPU来用。比如说我买了个AMD的CPU，去插一堆的英伟达的显卡进去。当然未来呢，可能有一部分钱不是他们挣了，是谁挣了？ARM挣走了。因为英伟达说算了，我出这个叫GB200吧。GB200是什么意思？它有两块Blackwell的这个显卡，还有一块呢是这个Grace，是它这个CPU。它这个CPU是一个ARM的CPU。所以，你把这个东西做出来的时候，咱们给ARM交钱去，这个也是可以的。所以AMD会增长营收，但是呢，涨得不会那么高。</p>



<p class="wp-block-paragraph">然后还有一个会挣大钱的人，就是博通。博通呢，去年的营收是516亿美金，上涨了是44%。那你说谁用了博通他们家的芯片呢？爱马逊跟谷歌。他们自己做的算力的阿斯克芯片，ASIC的这个芯片，就是博通帮他们设计出货的。所以现在这个谷歌也好亚马逊也好，一个1,000亿，一个750亿美金的这种投入，大概率博通是可以收进来很大一块的。所以这几家是会有收入的。另外一个有收入的就是ARM，但是ARM呢因为他是卖专利的，所以他的这个收入不太好算。</p>



<p class="wp-block-paragraph">现在呢，是全球都在动起来。不光是刚才我们讲的这些公司，刚才讲的这里头，有一个公司不在美国，就是SSI这个公司。他们呢，是同时在美国和以色列特拉维夫两个地方一起办公的。其他的公司呢基本上都是在美国，Deepseek除外。现在全球除了美国、中国、以色列之外，其他地方法国星际之门也在建立1,090亿欧元。</p>



<p class="wp-block-paragraph">当然，你说这1,090亿欧元里头，除了微软、谷歌、亚马逊可能有一部分钱会把算力中心建在欧洲之外，还有谁会出钱？LV现在大家去买LV的包包，买LV的皮带等东西，你们可能也在为AI事业添砖加瓦。日本孙正义呢，建了SB OpenAI Japan这样的一个公司，也是要去把资金投入到AI里边去了。</p>



<p class="wp-block-paragraph">那么，你说大家现在到底在干嘛？为什么DeepSeek上来以后，大家就疯狂的往里冲呢？原因很简单，大家现在在抢最后的入场券。最终大模型可能不会一家独大，可能会有几家在这个里面能够有话语权。现在OpenAI大概率是会有话语权的，Anthropic大概率会有话语权的。谷歌的话，这两天也刚出了新的模型，我去试了一下，确实还挺好用的。DeepSeek说我也抢到了一张，看看还有谁能够在最后一搏里头拿到入场券，能够入门，而不是会被关在门外面。所以现在一定是疯了一样冲进去。这一波如果没投入的话，那最后被淘汰了也不要怪别人。</p>



<p class="wp-block-paragraph">这就是最近几次跟AI相关的投融资，跟大家稍微的解析一下。好，这期故事跟大家讲到这里，感谢大家收听。请帮忙点赞，点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见！</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>中国AI力量崛起：DeepSeek如何成为国运级创新的代表，搅动全球AI格局？</title>
		<link>https://lukefan.com/2025/02/11/%e4%b8%ad%e5%9b%bdai%e5%8a%9b%e9%87%8f%e5%b4%9b%e8%b5%b7%ef%bc%9adeepseek%e5%a6%82%e4%bd%95%e6%88%90%e4%b8%ba%e5%9b%bd%e8%bf%90%e7%ba%a7%e5%88%9b%e6%96%b0%e7%9a%84%e4%bb%a3%e8%a1%a8%ef%bc%8c%e6%90%85/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Tue, 11 Feb 2025 12:05:47 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[2025美中脱钩法案]]></category>
		<category><![CDATA[360智能云]]></category>
		<category><![CDATA[AI与股市]]></category>
		<category><![CDATA[AI云服务]]></category>
		<category><![CDATA[AI产业链]]></category>
		<category><![CDATA[AI产业革命]]></category>
		<category><![CDATA[AI公司估值]]></category>
		<category><![CDATA[AI公司分析]]></category>
		<category><![CDATA[AI发展趋势]]></category>
		<category><![CDATA[AI国际化]]></category>
		<category><![CDATA[AI大模型]]></category>
		<category><![CDATA[AI开源技术]]></category>
		<category><![CDATA[AI开源模型]]></category>
		<category><![CDATA[AI技术划时代]]></category>
		<category><![CDATA[AI技术合作]]></category>
		<category><![CDATA[AI技术壁垒]]></category>
		<category><![CDATA[AI投资趋势]]></category>
		<category><![CDATA[AI推理芯片]]></category>
		<category><![CDATA[AI核心技术]]></category>
		<category><![CDATA[AI概念股]]></category>
		<category><![CDATA[AI模型免费]]></category>
		<category><![CDATA[AI模型统一]]></category>
		<category><![CDATA[AI生态统一]]></category>
		<category><![CDATA[AI股票涨停]]></category>
		<category><![CDATA[AI行业投资]]></category>
		<category><![CDATA[AI革命]]></category>
		<category><![CDATA[ASIC芯片]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[DeepSeek R1]]></category>
		<category><![CDATA[Deepseek V3]]></category>
		<category><![CDATA[DeepSeek与英伟达]]></category>
		<category><![CDATA[DeepSeek国运创新]]></category>
		<category><![CDATA[DeepSeek影响力]]></category>
		<category><![CDATA[DeepSeek技术解析]]></category>
		<category><![CDATA[DeepSeek股票影响]]></category>
		<category><![CDATA[DeepSeek部署]]></category>
		<category><![CDATA[GPU]]></category>
		<category><![CDATA[Josh Holy]]></category>
		<category><![CDATA[LLaMA]]></category>
		<category><![CDATA[TPU]]></category>
		<category><![CDATA[东升西降]]></category>
		<category><![CDATA[中国AI]]></category>
		<category><![CDATA[中国AI崛起]]></category>
		<category><![CDATA[中国AI未来]]></category>
		<category><![CDATA[中国移动]]></category>
		<category><![CDATA[京东云]]></category>
		<category><![CDATA[人工智能禁令]]></category>
		<category><![CDATA[全球AI竞争]]></category>
		<category><![CDATA[全球AI部署]]></category>
		<category><![CDATA[六小虎]]></category>
		<category><![CDATA[华为盘古]]></category>
		<category><![CDATA[博通]]></category>
		<category><![CDATA[国运级创新]]></category>
		<category><![CDATA[国运级创新意义]]></category>
		<category><![CDATA[国际AI格局]]></category>
		<category><![CDATA[大模型微调]]></category>
		<category><![CDATA[字节豆包]]></category>
		<category><![CDATA[开源大模型]]></category>
		<category><![CDATA[概念股]]></category>
		<category><![CDATA[游戏科学]]></category>
		<category><![CDATA[火山引擎]]></category>
		<category><![CDATA[百度]]></category>
		<category><![CDATA[百度智能云]]></category>
		<category><![CDATA[硅基流动]]></category>
		<category><![CDATA[科技公司涨停]]></category>
		<category><![CDATA[美股蒸发]]></category>
		<category><![CDATA[腾讯]]></category>
		<category><![CDATA[腾讯浑元]]></category>
		<category><![CDATA[英伟达]]></category>
		<category><![CDATA[金山云]]></category>
		<category><![CDATA[阿里云]]></category>
		<category><![CDATA[阿里千问]]></category>
		<category><![CDATA[黑神话悟空]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1901</guid>

					<description><![CDATA[我宣布！DeepSeek绝对是国运级的创新！🔥

大家都知道，AI领域一直是全球科技竞争的焦点。最近，游戏科学的创始人冯骥提到，DeepSeek是一个国运级的创新。这个消息一出，直接让美股市值蒸发了一大笔钱，甚至有美国参议员提出严厉的法案来禁止DeepSeek！😱

**为什么DeepSeek这么牛？**
1. **统一思想**：以前各大公司和研究所各自为战，做着五花八门的大模型，现在大家都用DeepSeek，效果又好又省钱！💡
2. **划时代**：DeepSeek的出现，直接让大家都从模型逐鹿中原进化到模型统一，一起搞应用就完事了！🚀

**DeepSeek的使用方式**
如果你在美国，千万别去DeepSeek网站挂，根本得不到服务！最好是在美国的云主机上使用。国内的话，阿里云、腾讯云、华为云等都有部署，火山引擎现在还是限时免费，赶紧去试试！💻

**DeepSeek概念股涨停板揭秘**
- 金山云、美图、腾讯、阿里、百度等都在涨，阅文集团更是直接涨停板！📈
- 这些公司虽然跟DeepSeek关系不大，但大家都觉得有了开源大模型，云计算一定会涨！

**结论**
DeepSeek绝对是划时代的创新，就像当年的瓦特改良蒸汽机一样！从国际上看，唯一有可能跟DeepSeek媲美的就是Llama 4了。希望杨立昆和扎克伯格再努力努力，看看能不能站住这个里程碑！🌟

家人们，赶紧关注DeepSeek，搞钱机会来了！💰

#DeepSeek #国运级创新 #AI #美股暴跌 #中国股票暴涨 #搞钱必看

中国AI力量崛起：DeepSeek如何成为国运级创新的代表，搅动全球AI格局？

DeepSeek，一个被称为“国运级创新”的中国AI开源大模型，正在深刻改变全球AI产业格局。文章提到，美国共和党参议员因DeepSeek威胁而提出极端禁令，虽然未通过，但足以反映DeepSeek的国际影响力。它统一了国内AI模型生态，推动了A股与港股的相关概念股暴涨，包括金山云、腾讯、百度等科技企业，甚至中国移动、火山引擎等云服务商也纷纷部署。同时，其国际影响力也搅动了美股市场和其他国家的科技自信。而从全球产业视野来看，DeepSeek被认为是推动AI革命的“瓦特改良时刻”，直接威胁英伟达、Llama等国际巨头的位置。随着国内外技术和资本对DeepSeek的广泛部署，它可能成为中国AI发展的重要里程碑，真正实现“东升西降”的产业愿景。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="中国AI力量崛起：DeepSeek如何成为国运级创新的代表，搅动全球AI格局？" width="900" height="506" src="https://www.youtube.com/embed/Cf6jqlqhV_k?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">第二个故事：DeepSeek到底是不是国运级的创新呢？国运级创新这个事呢，是游戏科学的创始人兼CEO冯骥他去讲的。DeepSeek是一个国运级的创新。游戏科学，就是黑神话悟空的这个开发商。DeepSeek呢，也确实让美股市值蒸发了很多很多钱。而且还有一位美国的参议员说：“我们要下最严格的法令来禁止DeepSeek。谁敢下载DeepSeek判20年，哪个企业敢去用DeepSeek罚1亿美金。”</p>



<p class="wp-block-paragraph">这个是个共和党参议员叫Josh Holy，写了一个法案，叫2025年美国人工智能能力与中国脱钩法案。禁止技术交流与使用，禁止美国公民、企业与中国开展任何AI技术合作，包括研发、投资、数据共享等。非美国公民若涉及技术转移，可以驱逐出境。然后切断资本与人才流动，禁止美国资本对中国AI企业投资，并限制美籍科研人员参与中国AI项目。任何与中国高效实验室合作的美国机构将面临重罚。违反本法案的个人将被视为严重犯罪分子，可能影响其移民身份、绿卡申请和入籍资格。美国公司不能直接或间接向中国企业提供AI技术支持或者服务。但是这个法案呢，因为太过极端已经被搁置了。</p>



<p class="wp-block-paragraph">先讲一下使用DeepSeek的方式到底是什么样的。如果你在美国使用DeepSeek，那千万千万不要去DeepSeek网去挂，那是根本得不到服务的。最好是什么呢？就是去在美国的云主机上去使用。现在DeepSeek自己的网站基本上是半瘫痪状态，聊两句就趴菜。我基本上是第一句能聊，第二句能聊，第三句你再怎么跟他聊都趴。他是这样的一个状态。你可能明天再跟他聊，还可以聊两句。API调用的话非常非常慢。而且呢，现在禁止充值了。整个春节期间，API调用的这个页面就打不开了，把整个API后台给你封掉了。现在的话是后台重新有了，但是不允许充值。现在呢，国内是各种云上都有，国内的是阿里云、腾讯云、华为云。华为云的DeepSeek呢。</p>



<span id="more-1901"></span>



<p class="wp-block-paragraph">通过硅基流动可以使用起来，京东云也整起来了。上面也有DeepSeek、百度智能云。我就不知道，李彦宏怎么会有脸干这个事，前面还发表演说，说开源不如闭源，你们就好好使用闭源就好了。人家DeepSeek来了以后，百度也部署了DeepSeek，也给大家去使用，还要收费。然后，火山引擎，火山引擎是字节跳动的，现在是我的主力服务商了，速度还可以，而且现在限时免费，就是你现在上去使用它的DeepSeek，这些模型是不要钱的。它设置起来相对麻烦一点，就是所有这种云计算厂商，你去设置大模型都比较麻烦，但是比BAT还是要简单。</p>



<p class="wp-block-paragraph">然后，中国移动、中国联通、中国电信，他们参加的云也都有DeepSeek的部署，也都可以上去用去。360智能云上头也有DeepSeek。海外的话，亚马逊AWS、微软Azure，还有一个叫GMI、Claude、together、grok，但是grok上面部署的是蒸馏模型，它就没有布这个满血模型，together上是有满血模型的。英伟达上面也是有满血模型可以去用的。所以如果你在海外说我想去用这个东西怎么办，你就要去这些平台上去使用了。</p>



<p class="wp-block-paragraph">DeepSeek的这些概念股，我们一说这个东西，国运之战嘛，他一定是有一些概念股的。首先从港股来看，金山云直接涨停板，我去问我说金山云跟这玩意到底有啥关系，没有任何关系。DeepSeek到现在为止，都没有部署到金山云上去。但是呢，大家觉得，这个云计算一旦有了这种通用的可用的开源大模型以后，一定会涨，所以金山云在港股上就直接涨停板了。美图也涨停了，美图其实跟DeepSeek可以也没什么关系，但是他做AI的嘛。腾讯、阿里、百度都在涨。阅文集团，也就是起点中文，做小说类网站，直接涨停板，为什么？因为推出了使用DeepSeek的作者助手以后，作者可以使用DeepSeek来去写小说，可以进行各种的架构设定，各种的环节设定，效果很好的。</p>



<p class="wp-block-paragraph">我试了一次用DeepSeek R1这种大推理模型去做各种设定的配置，效果非常好，导致其他科技股也跟着上涨，包括地平线、中国软件国际、微盟、联想和中兴国际。</p>



<p class="wp-block-paragraph">在A股市场上，第一个上涨的是每日互动。每日互动之所以上涨，是因为它有一个联合创始人叫徐进，这个人曾是九章资本（即换方量化）的股东。然而，他现在应该已经从每日互动离职了，与公司完全没有任何关系，只是蹭了这样一个共同的联合创始人的名头。每日互动表示，未来准备使用DeepSeek的大模型进行一些应用，但目前没有任何直接的关系。</p>



<p class="wp-block-paragraph">第二个DeepSeek概念股是安凯威。这家公司主要生产录音笔。虽然做录音笔与DeepSeek看似没有直接关系，但录音笔录制的内容需要处理，而安凯威的后台使用的是DeepSeek大模型进行处理，因此安凯威也作为DeepSeek的概念股涨停了。</p>



<p class="wp-block-paragraph">青云科技和Ucloud也涨停了，因为它们都是专门为企业部署私有云的服务商，它们都部署了DeepSeek，并开始为这些企业提供服务。</p>



<p class="wp-block-paragraph">还有一个公司叫宝兰德，这家公司是由以前Borland的一帮老同事创业成立的，创始人都是我在Borland的同事。他们在国内起名叫宝兰德，主要从事系统集成项目，底层集成的是DeepSeek大模型，因此也涨停了。</p>



<p class="wp-block-paragraph">比亚迪这两天也涨停了，但它们与DeepSeek的关系应该没有那么大。比亚迪现在称要发布“天神之眼”，原来讲比亚迪自己准备做大模型，大家不信，但有了DeepSeek以后，大家说比亚迪没准也能做出来，于是开始相信。</p>



<p class="wp-block-paragraph">万兴科技、360和昆仑万维也都擦边跟涨，特别是360，大概连着涨了两个涨停板。但360这事有些乌龙，它确实部署了DeepSeek，但需要在360纳米AI搜索里边使用。</p>



<p class="wp-block-paragraph">他是不开放出来给别人用的。周鸿祎这一段时间不停地在喊话凑热闹，上来说：“我要给DeepSeek保驾护航。有黑客去攻击DeepSeek了，我要去提供免费的支持服务，我有什么专线，我怎么去做这个事情。”喊得特别特别热闹。喊完了以后，两个涨停板之后，他是需要出来解释的。360出来发了个公告，说与DeepSeek后边的深度求索公司之间，没有任何业务往来和合作。这个整完了以后，大家就觉得说：“你喊了半天到底在干嘛？”所以我在前面想，攻击DeepSeek的这些美国IP，后边有可能是360吧？但是这个咱们只是说猜测，没有任何事实依据。反正他喊得非常非常欢。</p>



<p class="wp-block-paragraph">那么，到底什么是国运级的创新呢？让美国暴跌，让中国股票暴涨。而且刚才我们讲的这些，好多都是连着出涨停板的这种股票。这是不是就是国运级的创新了呢？我觉得已经有一些这样的苗头了。第一个就是DeepSeek干了一个很重要的事情，叫统一思想。原来有一大堆的公司、研究所，都在那儿做大模型，像刚才我们讲的中国移动、中国联通、中国电信，三大运营商自己都惦记做自己的大模型。实际上就是一帮人拿着什么Llama呀，拿着这些东西再给他调来调去的。现在别费劲了，我们已经不用再去追究你是不是浪费钱了，是不是把钱揣自己口袋里了。现在有DeepSeek，大家一起使呗。原来那个东西做的没有DeepSeek好，这个也没有什么可值得怪罪的地方。这个钱就相当于打水漂就没了，我们就通通都去使用DeepSeek就完事了。因为谁用DeepSeek谁涨停板，就这么简单的一个问题。那干脆赶快都去用吧。</p>



<p class="wp-block-paragraph">第二个就是什么？他划时代了。国运级的创新一定是要划时代的。原来是各自为战，大家都在做自己的模型，都在互相比较互相踩，说我这个做的比他哪哪好，他那个呢怎么怎么不行。现在没有了，大家都是DeepSeek。我们原来那个还差一点，不丢人，都变成这样了。那么现在的话，底层用DeepSeek可没毛病。</p>



<p class="wp-block-paragraph">包括像百度李彦宏这样的人，他都把DeepSeek部署上去了。而且我原来也碰到过华为的人，就是他们的盘古大模型，其实他们也不怎么使。他们在内部其实早早就是DeepSeek。所有大厂都装了。从模型逐鹿中原，进化到模型统一了，底层统一了，一起搞应用就完事了。这个事情，我们现在已经把这步迈过去了。那么他也搅动了国际局势，说东升西降这个扯淡了，这个咱们就开个玩笑。美国股市肯定是被搞得动荡不安了一下，而这几天在慢慢的修复吧。A股跟港股呢，正好赶上春节这几天休市，就是最恐慌那段时间，咱们都休息了。而等开市呢，情绪稳定了，咱们就一起跟着涨就完事了。</p>



<p class="wp-block-paragraph">那么，DeepSeek之后的这个格局，会是什么样的呢？第一个，国内的六小虎都危险，没有哪一个不危险。大家注意，六小虎里头不包括DeepSeek，因为他原来比较低调，排六小虎的时候没给他排进去。原来你有自己的模型，它算是一个竞争上的加分项。原来你有独立模型，还有一个很高的估值，因为我需要很多的钱去做预训练嘛。现在都不用了，大家都是DeepSeek了。你为什么要有这么高的估值？就有这样的问题。</p>



<p class="wp-block-paragraph">以DeepSeek V3作为基座模型，用DeepSeek R1直接蒸馏微调迁问，肯定要比他们自己的模型还好使。原来那些必源模型还扭扭捏捏的出来说：“你想私有化部署吗？我再收你点私有化部署的钱吧。”现在DeepSeek直接开源免费了，那你还好意思找人收钱吗？大厂呢，可能还会坚持，但这些小厂就六小虎肯定都完蛋了。</p>



<p class="wp-block-paragraph">现在各大厂有些呢，还会投进去，比如说千问，就是阿里的千问，其实还是很有价值的。另外一个就是字节的豆包，还会继续往前走。但是腾讯的浑元是不是接着做，这个要看了。华为的盘古大模型估计也可以休息了。至于百度的文新一言，从开始那天就是个笑话，一直笑到最后。</p>



<p class="wp-block-paragraph">国际上呢，现在各国实际上都在开始进行DeepSeek部署，全都在干这事。英国说我又行了，印度说我也行了。</p>



<p class="wp-block-paragraph">他们都说我有DeepSeek，我就可以自主创新了。别人一开源，我就自主创新，自主知识产权。这事不光是咱们中国人干，全世界人都是这么看的。有了DeepSeek加持的中国，软件厂商也可以去大杀四方了。因为有了基础模型以后，再往后的事情就是卷了。那卷这个事，他们还是卷不过咱们的。</p>



<p class="wp-block-paragraph">很多AI agent的公司，都可以自己训练自己的大模型了。比如说Perplexity，比如说Cursor，或者是其他的一些AI agent的公司，现在都可以去搞这件事情。而且他们都是底层，直接挂DeepSeek。很多的AI agent的公司有自己模型了以后，他们就可以去买英伟达的显卡，他就可以去部署自己的云服务了。当大家都开始部署自己大模型的时候，就要去买英伟达。</p>



<p class="wp-block-paragraph">那你说为什么不去买博通？为什么不去买阿斯克芯片？咱们这稍微的岔开一点点。咱们平时看到的芯片基本上是三个：塞斯克芯片叫CISC，瑞斯克叫RISC，阿斯克呢就是ASIC，这是三个不同的词。博通中间有一段时间涨得很猛，就是因为它做的阿斯克芯片，做推理效果巨好。</p>



<p class="wp-block-paragraph">什么是ASIC芯片呢？CISC芯片是叫做丰富指令级芯片，就是它的指令非常长，而且指令很多。RISC芯片的话，咱们最常见的RISC芯片就是ARM芯片，手机芯片都是RISC芯片，它叫短指令级芯片，而且它指令很少。而这个ASIC芯片呢，它其实不是固定意义上的这种有IP的芯片，它是什么呢？叫专用集成电路。这个东西有一个特殊的名字，它不是处理器，它叫专用集成电路。谷歌的TPU就属于是ASIC，Grok做的那个叫LPU语言处理模块，它们呢也是ASIC。</p>



<p class="wp-block-paragraph">博通为什么要涨那么猛？博通涨得猛的原因就是，谷歌也好，亚马逊也好，自己去做这个专业推理芯片的时候，都是博通代为设计，台积电代为生产，大家都是这么来的。所以博通就涨吧。如果大家都集中在一起，就是说我们都是使用亚马逊云、谷歌云、微软云。</p>



<p class="wp-block-paragraph">他们是有动力去使用ASIC芯片。我专门自己去设计一个新的芯片，然后装在自己的服务器上去。这样的话，我统一来维护。他们有这个动力。但是一旦分散了，你这个部署的是DeepSeek，它部署的Llama，那个部署的是这个微调以后的模型。大家都分散了以后，那就只能用英伟达，就没法使用这个ASIC。这个就非常非常麻烦。为什么？因为ASIC芯片你一旦做出来以后，你需要重新去做适配，重新去做很多兼容性方面的调试。而且做完了以后，你还有很大的可能性不稳定，挂上去以后会出问题。为了最大的稳定性，为了最大的兼容性，就通通都是英伟达。所以为什么说这一步出来以后，英伟达巨大利好。这就是对于国际上的一些影响吧。</p>



<p class="wp-block-paragraph">那么结论是什么呢？这个DeepSeek到底是一个什么样的创新呢？还记得瓦特发明蒸汽机的故事吗？其实瓦特并没有发明蒸汽机。瓦特干的事情是什么？叫改良蒸汽机。它提升了效率。原来比如说我需要烧4吨煤能干的活，我现在烧一吨煤就干出来了。然后增强了动力。原来这个蒸汽机是上下动的，现在它可以进行转动了。这个动力变得很强，而且稳定运行广泛应用。就是瓦特以后，蒸汽机可以广泛应用。瓦特改良蒸汽机，被视为工业革命的重要里程碑。</p>



<p class="wp-block-paragraph">那么转过来看，DeepSeek能不能成为像瓦特改良蒸汽机这样的一个重要里程碑呢？至少在中国，DeepSeek肯定是瓦特这样的里程碑了。因为甭管是OpenAI、Gemini还是Claude，它不给你使，那你只能是使用DeepSeek。从国际上看的话，还有机会是谁呢？就是Llama 4。如果今年Llama 4出来，有一个革命性的飞跃，在DeepSeek基础上还能再飞跃一次，那可能Llama 4会成为瓦特发明蒸汽机，或者瓦特改进蒸汽机上的那个里程碑。如果Llama 4出来了以后，跟DeepSeek差不多，那么对于全世界来说，DeepSeek就是整AI革命的这个里程碑了。</p>



<p class="wp-block-paragraph">就像当年的瓦特改进蒸汽机那样，闭源模型是没有办法参与这种竞争的，这个肯定就不用想了。微软、谷歌他们其实也有开源模型，但都是小模型。微软的模型叫Phi，谷歌的模型叫GEMMA。这两个模型都是小模型，就是在客户手机、PC上使用的，他们是没有这种开源大模型。XAI呢，号称是开源，但是呢，那就是个假开源。到现在Grok 2没出来，开源版本没放出来。而且开源出来以后，他什么也不讲，你上去提任何问题，他不理你，那就是个假开源。</p>



<p class="wp-block-paragraph">所以，现在唯一有可能能够站住这个里程碑位置的人，除了DeepSeek之外，剩下就是Llama。咱们希望杨立昆也好，扎克伯格也好，再努力努力，多砸一些钱进去，让大家可以看看美国人能不能站住这个里程碑。好，这就是我们今天讲的第二个故事：DeepSeek到底是不是国运级的创新？从我的角度上来说，从中国角度上来说，它应该算是一个国运级的创新了。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>Meta Llama3.1——405b大模型震撼发布——性能全面超越GPT-4o，中国AI厂商是否迎来春天？新的时代到来了，历史的车轮滚滚向前。</title>
		<link>https://lukefan.com/2024/07/25/meta-llama3-1-405b%e5%a4%a7%e6%a8%a1%e5%9e%8b%e9%9c%87%e6%92%bc%e5%8f%91%e5%b8%83-%e6%80%a7%e8%83%bd%e5%85%a8%e9%9d%a2%e8%b6%85%e8%b6%8agpt-4o%ef%bc%8c%e4%b8%ad/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Thu, 25 Jul 2024 01:00:20 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[Meta的故事]]></category>
		<category><![CDATA[OpenSource]]></category>
		<category><![CDATA[405B版本]]></category>
		<category><![CDATA[AI上下文窗口]]></category>
		<category><![CDATA[AI事实标准]]></category>
		<category><![CDATA[AI产业方向]]></category>
		<category><![CDATA[AI产业链]]></category>
		<category><![CDATA[AI偷跑事件]]></category>
		<category><![CDATA[AI公司发展]]></category>
		<category><![CDATA[AI创新挑战]]></category>
		<category><![CDATA[AI创新推广]]></category>
		<category><![CDATA[AI功率需求]]></category>
		<category><![CDATA[AI协议限制]]></category>
		<category><![CDATA[AI商业机会]]></category>
		<category><![CDATA[AI商业模式]]></category>
		<category><![CDATA[AI多模态]]></category>
		<category><![CDATA[AI多语言支持]]></category>
		<category><![CDATA[AI宏大模型]]></category>
		<category><![CDATA[AI市场分析]]></category>
		<category><![CDATA[AI应用前景]]></category>
		<category><![CDATA[AI开源协议]]></category>
		<category><![CDATA[AI性能测试]]></category>
		<category><![CDATA[AI性能超越]]></category>
		<category><![CDATA[AI技术合作]]></category>
		<category><![CDATA[AI技术商业化]]></category>
		<category><![CDATA[AI技术应用]]></category>
		<category><![CDATA[AI技术投资]]></category>
		<category><![CDATA[AI技术支持]]></category>
		<category><![CDATA[AI技术突破]]></category>
		<category><![CDATA[AI技术革新]]></category>
		<category><![CDATA[AI显卡需求]]></category>
		<category><![CDATA[AI未来趋势]]></category>
		<category><![CDATA[AI标准化]]></category>
		<category><![CDATA[AI模型优化]]></category>
		<category><![CDATA[AI模型开放]]></category>
		<category><![CDATA[AI模型电费]]></category>
		<category><![CDATA[AI法律框架]]></category>
		<category><![CDATA[AI生态价值]]></category>
		<category><![CDATA[AI生态系统]]></category>
		<category><![CDATA[AI生态系统发展]]></category>
		<category><![CDATA[AI硬件需求]]></category>
		<category><![CDATA[AI磁力链]]></category>
		<category><![CDATA[AI空调耗电]]></category>
		<category><![CDATA[AI能耗问题]]></category>
		<category><![CDATA[AI行业分析]]></category>
		<category><![CDATA[AI行业动态]]></category>
		<category><![CDATA[AI行业趋势]]></category>
		<category><![CDATA[AI计算能力]]></category>
		<category><![CDATA[AI训练成本]]></category>
		<category><![CDATA[AI训练数据]]></category>
		<category><![CDATA[AI训练时间]]></category>
		<category><![CDATA[AI语言支持]]></category>
		<category><![CDATA[GPT-4对比]]></category>
		<category><![CDATA[GPT-4跑分]]></category>
		<category><![CDATA[HIKING face数据集]]></category>
		<category><![CDATA[LLaMA]]></category>
		<category><![CDATA[Llama 3.1]]></category>
		<category><![CDATA[Llama 3.1 405b]]></category>
		<category><![CDATA[Together AI]]></category>
		<category><![CDATA[中国AI厂商]]></category>
		<category><![CDATA[中国AI厂商冲锋]]></category>
		<category><![CDATA[中美科技博弈]]></category>
		<category><![CDATA[多模态支持]]></category>
		<category><![CDATA[开源与闭源]]></category>
		<category><![CDATA[拉玛模型争议]]></category>
		<category><![CDATA[梅塔与中国]]></category>
		<category><![CDATA[梅塔公司]]></category>
		<category><![CDATA[模型微调]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1432</guid>

					<description><![CDATA[Llama3.1 405b突然开放，指标上全面超越GPT-4。中国厂商们是不是又可以充了呢？大家好，这里是老范 ... <a title="Meta Llama3.1——405b大模型震撼发布——性能全面超越GPT-4o，中国AI厂商是否迎来春天？新的时代到来了，历史的车轮滚滚向前。" class="read-more" href="https://lukefan.com/2024/07/25/meta-llama3-1-405b%e5%a4%a7%e6%a8%a1%e5%9e%8b%e9%9c%87%e6%92%bc%e5%8f%91%e5%b8%83-%e6%80%a7%e8%83%bd%e5%85%a8%e9%9d%a2%e8%b6%85%e8%b6%8agpt-4o%ef%bc%8c%e4%b8%ad/" aria-label="阅读 Meta Llama3.1——405b大模型震撼发布——性能全面超越GPT-4o，中国AI厂商是否迎来春天？新的时代到来了，历史的车轮滚滚向前。">阅读更多</a>]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="Meta Llama3.1——405b大模型震撼发布——性能全面超越GPT-4o，中国AI厂商是否迎来春天？新的时代到来了，历史的车轮滚滚向前。" width="900" height="506" src="https://www.youtube.com/embed/GoMdjaKlIvE?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">Llama3.1 405b突然开放，指标上全面超越GPT-4。中国厂商们是不是又可以充了呢？大家好，这里是老范讲故事的YouTube频道。今天咱们来讲一讲Llama3.1 405b 开放的事情。</p>



<p class="wp-block-paragraph">Llama的开放，每一次都比较有戏剧性，都会有偷跑。什么叫偷跑？就不是由官方开了发布会，说我今天发布了一个什么产品，而是一般都是在Reddit这样的论坛里，突然就有人放出磁力链来，大家可以去BT下载Llama3.1 405B，包括Llama3.1 405B相关的各种测试数据，都是这么被发现的。头一天偷跑了以后，第二天梅塔说那算了，我开了吧。当时好像Llama2也是这么开出来的，现在Llama3.1 也是这么偷跑，完了以后就正式开放了。</p>



<p class="wp-block-paragraph">他在跑分上已经全面地超越了GPT-4，基本上在各个指标上都超越了。这是非常非常难的，因为以前大家推出的各种模型里头，都是在个别指标里面超越GPT-4O或者超越GPT-4。那么在各项指标上全都超越的，这应该是第一次。当然了，它也是分很多版本的，分为8B、70B以及405B这三个版本。405B已经完全超越了，下面小一点的8B，应该比原来的Llama370B的效果还要再好一些。它的70B基本上针对前两天发布的GBT4OMINI，属于碾压状态。</p>



<span id="more-1432"></span>



<p class="wp-block-paragraph">Llama3.1 现在支持8种语言：英语、德语、法语、意大利语、葡萄牙语、印地语、西班牙语和泰语。</p>



<p class="wp-block-paragraph">这个里面没有中文啊，不用他们担心，中文我们自己会搞定的。这就是他们现在发布出来的模型，上下文窗口呢，从8K直接涨到了128K。Llama3是8K的，啊，现在Llama3.1 就直接128K，但是我还用不上，为什么呢？我想要去用这个Llama3.1 的，啊，405B这样的模型我肯定没法在本机上用，这玩意你肯定还是要很多的显卡，才可以把它刨起来的。所以一定是云端，用这么大的模型，你要给它这么长的上下文的话，通常那个压力是很大的。</p>



<p class="wp-block-paragraph">所以现在我去看到的，比如像together AI上面的Llama3.1 的模型，里面啊，应该是8B的和70B的给的是32K，405B只给了4K，就是你超过4,400以上他就不干活了。超过了以后，我估计就会变得非常非常贵，工作的耗或者工作的成本就会变得很高。所以我现在能够用到的Llama3.1 ，405B只能是4K的，就是上下文4K。405B呢，也是Llama系列的第一个支持多模态的大模型，原来的都是纯语言模型，现在可以支持多模态了。</p>



<p class="wp-block-paragraph">但是怎么说呢，如果只能用到4K的话，多模态意义不是很大，你塞不进去东西去。这还要看未来，是否有人愿意开放完全上下文的这种Llama3.1 的模型给大家去使用了。Llama到底算不算开源，对吧？我们刚才讲他开源开出来了，Llama是不是开源这件事情呢，也是有一定争议的。开源这件事情并不是说我把所有东西都开出来，你就随便去用就叫开源。</p>



<p class="wp-block-paragraph">开源本身是一个在法律框架下，遵守一定的开源协议的商业模式。这个东西是要收钱的，大家可以去规定说我开哪部分，不开哪部分。当然了，也有一些原教旨主义者，他们其实是开放软件的一帮推崇者。他们认为Llama不算开源，为什么呢？</p>



<p class="wp-block-paragraph">第一个，Llama只开放了部分代码，并没有把所有的代码都开出来；第二个，只开放了模型和参数，没有开源训练数据和完整的训练过程。如果是开放软件，这些东西都应该拿出来。而且只开放使用，他对使用还是有一定限制。开放软件这帮人说，你要叫开源，就得把所有的权利都拿出来，不能有自己任何权利保留。</p>



<p class="wp-block-paragraph">这个是Llama在这块有一点点的小争议。对于Llama来说，它到底是限制了什么？在使用上，你说大家都下载了，都去用一下，我在本地上也下载了，它到底限制什么呢？</p>



<p class="wp-block-paragraph">第一个，他不允许用Llama3训练新模型。这也很有趣，实际上现在国内大量的新模型都是拿Llama去训练的，但他这个是不允许的。第二个，用户超过7亿的，需要单独向梅塔申请。这其实就是针对中国的，全世界的公司里头，用户量超过7亿的，除了美国的那些之外，剩下的基本都在中国。他现在也有要求说我已经设置好了，超过7亿都不行。</p>



<p class="wp-block-paragraph">但是，这个都属于叫君子协定。什么叫君子协定呢？就是我不告你，你也没办法。如果算告的话，可能也很麻烦，你去取证，做各种各样的法院诉讼的过程都会很长。但是，从道德制高点上来看……</p>



<p class="wp-block-paragraph">他已经站在上了。你比如说，用户量超过7亿，还拿他去训练模型啊。假设是字节跳动吧，对吧？那个用户量肯定超过7亿了，而且跟美坦直接竞争啊。如果字节跳动拿着梅塔的Llama3去训练自己的模型了，这个事情对于Llama来说，他是可以告你的。</p>



<p class="wp-block-paragraph">另外一个超过7亿用户，还去训练自己模型的是谁呢？天问啊，闻心眼，百度啊，都是在这个范围内。那么，Lama呢？如果不是走这个原教旨主义的判别标准的话，它算是开源的。但是，按照原教旨主义的标准来判定的话，它也算是个假开源吧。甭管是不是真的开源，但是Llama现在已经开始从开源受益了。很多人搞不清楚开源这事到底咋挣钱，正好趁着今天Llama3.1 405B的这个项目，来跟大家讲一讲开源到底是怎么盈利的。它为什么是一个商业模式啊？不是雷锋。</p>



<p class="wp-block-paragraph">现在呢，Llama已经让时代的车轮滚滚向前，停不下来了啊，肯定是往前滚滚过去了。那些号称使用开源就是交智商税的CEO们，应该会在车轮下发出悲鸣了。Llama在Llama1、Llama2、Llama3到现在的Llama3.1 之间，一直在这开源模型里头是扛鼎的。他是做得最好的一个，做得最大的一个，其他人就会跟着他去做。对吧？我会在Llama的基础上进行微调。我在Llama的基础上准备微调Llama的数据，准备微调Llama的各种指令集，或者说准备使用Llama3微调一个什么呢？微调一个多模态的模型出来。前两天，斯坦福大学抄袭清华大学的那个模型，就是拿Llama3微调的多模态模型，还有很多人在Llama3的基础上……</p>



<p class="wp-block-paragraph">去微调上下纹，让上下纹变长。所有的这些，你没有发现吗？就是从Llama3到Llama3.1 之间的这些变化，波太了啊，成上下文了。再加上什么？再加上各种各样的开源数据集，以及开源的指令微调数据集的参与训练，就从Llama3变成了Llama3.1 。它等于现在成为了一个潮流的标志，所有人做的这些数据也都是开放的。这些数据在哪呢？在HIKING face上啊，HIKING face上存了非常多的这种兼容Llama3格式的数据，兼容Llama3格式的指令微调数据集，以及各种各样的用Llama3已经微调成功的新的模型，甭管是长上下文的，还是多模态的都有。</p>



<p class="wp-block-paragraph">好，现在Llama3说来，我把你们都收下来，我也开放了，你们也开放了，我收下来，然后我再把Llama3再重新训练一下，再把剩下的参数都堆进去，啊，堆一个405B出来，4,050亿参数啊，直接推出来。所以呢，他这个开源真正盈利的方式，大家听懂了没有？这两个字啊，叫做标准。Llama是通过成为标准，让所有在做大模型开源的人都依附于这个标准。这不是强制标准，这个是事实标准，大家依附于这个标准，然后做出生态来，整个生态的价值提升了。</p>



<p class="wp-block-paragraph">Llama3直接把Llama3基础上的这些开放数据拎回来再去训练，就变成Llama3.1 。Llama3.1 出来以后，一定还会有很多人再在这个基础上，再去做大量的新的数据，再去微调，让Llama3.1 可以去适应更多的场景。那么是不是就快该有Lama 3.2了？就是开元战胜必元，或者开元。</p>



<p class="wp-block-paragraph">整个的盈利方式就是这样。第一个叫做标准，事实标准；第二个呢，叫做生态。这两个东西一起往前走的时候，整个开源的系统就会快速地超越闭源系统。</p>



<p class="wp-block-paragraph">很多人在讨论，开源到底便不便宜？咱们Llama3.1 的价格到底怎么算呢？我看了一下together上的价格，因为它是开源的，你可以把它拉到本地来自己去装。虽然我现在没有装这些东西的设备，斑马3在我的机器上可以跑8B，跑到70币已经跑不起来了。70币的话，至少是一块四零九零，再加上大量内存才可以跑起来。</p>



<p class="wp-block-paragraph">像这种四零五币这样的模型，我已经不愿意去算我需要什么样的硬件它可以跑起来了。这个事情对于我没有意义了。所以呢，我们用云端可以跑Llama3服务或者Llama3.1 服务的这些服务器上给的价格为参考。他们给的是什么呢？就是Lama三点一的70币，每生成100万TOKEN是0.9美元，就是90美分；405B就是这4,050亿参数的这种大模型，生成100万TOKEN是5美金。</p>



<p class="wp-block-paragraph">咱们呢跟其他人比一比，比如说open AI的。open AI现在当打的是GPT4欧，GPT4欧的输入是5美金，每100万TOKEN，输出的话是15美金。100万TOKEN desert上的这个TOKEN的价格应该是输入输出都一样的吧，但是5美金。统一的最新的呢是GPT4欧mini，是0.15美金输入，0.6美金输出，这个价格呢。</p>



<p class="wp-block-paragraph">跟Llama3.1 的8臂的价格其实是差不多的，所以那个时候，为什么猜测GBT4欧MINI可能是一个8臂的模型，因为从价格上算的。Anceropic，那他们家的cloud是什么样的价格呢？3.5 sonit是输入3美金，输出15美金，也要比to get在上面Lama 3.1405币要贵。</p>



<p class="wp-block-paragraph">至于Opus啊，就是Anceropic的cloud 3 Opus，这是它们最贵的、最大的一个模型。输入100万TOKEN，15美金，输出100万TOKEN居然要75美金，非常非常昂贵啊。Gemini呢，相对来说便宜点啊，Flash是输入两美金，输出6美金。Pro呢是一倍，输入是4美金，100万TOKEN输出呢是12美金。</p>



<p class="wp-block-paragraph">所以啊，Llama3405B呢，相对来说还算便宜啊，就是输入输出是5美金，还算便宜。如果他的100万TOKEN在10美金，但是你让我使用128K的上下文，可以让我使用多模态，可以上传图片，可以进行识别，上传声音可以进行识别的话，那么我觉得这个价格也还是可以接受的。</p>



<p class="wp-block-paragraph">在Llama3.1 405B发布之后，这肯定是一个诱化时代的产品发布了，代表着车历史车轮滚滚向前，把历史翻开了新的篇章。那么谁会挣钱啊？挣钱的呢，就应该是这种开放的云托管平台就会开始挣钱了，对吧？因为刚才我讲了，405B这种东西在我们本机是跑不起来的，哪怕是我一个单位里头自己有服务器，你想把它跑起来也是基本不可能的。</p>



<p class="wp-block-paragraph">所以，一定是到云端去使用这种模型。那么，谁在干这个呢？刚才我们讲的 Together 就干这个的。另一个呢，是 Grop，专注于推理芯片的，他们也是在做类似的工作。现在，Grop 和 Together 上已经开始有Llama 3.1 的模型可以用了。这个刚才我查的Llama 3.1 的价格，就是在 Together 上查的。</p>



<p class="wp-block-paragraph">然后，危机流动，也就是国内对标 Together 的这个项目，现在他们也可以在这种项目上受益。虽然这个上面没有Llama，因为Llama没有在中国进行过审核备案，但在中国使用的话，一定会有问题。不过，要相信我，中国团队会冲的。既然煤炭已经出了 405b，中国人就会出 410b，420b也会出现这样的模型。</p>



<p class="wp-block-paragraph">那么，这种模型出来以后，也会到硅积流动上去跑。他也可以收到一个，比如说 100 万 TOKEN，十几美金的这样的一个价格。其他的这些云计算厂商，比如谷歌、微软、亚马逊，国内的像阿里云，都将受到这样的利好影响。</p>



<p class="wp-block-paragraph">最后，我们讲一下中国团队是不是要冲锋。原来都讲人家一开源，我们就自主研发，自主知识产权。这个事一定会的。很多人说，中国的大模型就是自己研发的，跟他没有什么关系。这个你要相信，没有任何问题。我也可以相信。我们来看一看，中国最早的大模型，其实跟Llama是没有关系的。这个事一定要讲清楚。最早的是什么呢？最早的是拿 GPT2 开源的版本去修改，去使用出来的。</p>



<p class="wp-block-paragraph">国内的某些最早期出大模型的大厂，他们的大模型里头有一定的GPT2的影子。后面Llama开源之后，国内才开始涌现了一批开源大模型公司，但他们都不承认使用的是Lama的模型。他们都说我们是在Lama的启发下，从头训练的。在Lama 2发布之后，各种应用公司就开始冲锋了，不再是模型公司了。很多应用公司也有一些新的模型出来可以用。这些模型到底是从头训练的，还是拿Lama 2去做的微调和修改，这个不得而知。</p>



<p class="wp-block-paragraph">国内大量的企事业单位开始用上这些模型。等到Lama 3出来之后，各个开源模型公司纷纷更新版本。像Llama3发布后，影义万物、同一千问，包括很多这种不开源的模型公司，都在纷纷更新自己的版本，号称我们都去对标GPT4了。在中文领域里头可以超过Llama3了，英文里头稍微有一些偏差，也还是可以理解的。</p>



<p class="wp-block-paragraph">这就会有这样的一个明确的时间划分，到底抄没抄，这事我们也没有明确的证据。我们只能说，这个时间点都非常非常的巧合，你爱信不信。而且在Llama3出来以后，中国的各个模型公司在做的一件事是什么？就是开始打价格战。咱们开卷吧，这个是为什么呢？因为中国大模型公司卡在100币这个位置上，因为Llama3开源出来的就是8币以及70币。所以中国很多是9币和72币，我在这个基础上再加一点点。你说我再往上训练，到底拿什么样的东西去训练，或者往哪个方向训练。</p>



<p class="wp-block-paragraph">其实是不知道的，所以卡在100币，没有往上走的通道了。那我们先卷价格，等一等看看风向再说。现在风向又变了，405B出来了。而且405B并不是Moe。什么是Moe？就是专家模型。405B，它是一个单体的Transformer的模型。这样的话，大家就知道，原来大模型长这样，我们可以去搞一次了。这个是值得去借鉴的。</p>



<p class="wp-block-paragraph">国内其实也出了一些Moe的模型，比如像千问自己，有一个五十几b的Moe模型。另外也出过一些100多币的这种Moe的模型。但这种100多币呢，它是由很多个小模型拼起来的。每一个小模型可能还是二三十币，或者这样的一个水平。拼起来的单体的上百币的模型，原来中国人是没做过的，现在有开放出来的。那么中国公司是必须充，方向都已经指明了，不冲等啥呢？咱们就看这个到底需要多长时间了。</p>



<p class="wp-block-paragraph">但是，对于Llama3.1 405B来说，能够冲上去的公司并不多。为什么呢？咱们看一下，Llama3.1 8B呢，用的146万GPU小时。这个玩意儿怎么算呢？就是说用H100，我用146万个小时，就可以细算出来Llama3.1 8B。那你说这么多怎么弄啊？人家又不是一块在这算，对吧？人家一下上几万块。梅塔手里头号称有50万块GPU，他这个数据一除除的话，就很快就可以算出一个斑马3.18B。然后呢，Llama3.1 70b呢，用了700万GPU小时，也就是H100 GPU小时吧，应该这么讲。</p>



<p class="wp-block-paragraph">然后，Llama3.1 405b 用了多少呢？3,084万H100 GPU小时。梅塔自己呢，是用了1.6万张H100进行的训练。他并不是说我分别训练8B、70B和405B啊，他们正常应该是训练了一个405B，蒸馏出70B和8B。但是，你还是要去用3,084万H100 GPU小时的这个时长去算。如果是1.6万张H100的话，那么是需要多长时间呢？80天，两个多月就可以把它训练完的。这个价格是很贵的啊，H100是4万美金一张。而你，比如说我能够有这么多钱，人家还不卖给你。就算人家卖给你了，你烧得起电吗？这个H100的功率是700瓦一张啊。你想，这一万多张，他有多大的功率，这是非常恐怖的一个数字。这还光算了H100，主机的这个电压、主机的功率还没算在里头。算完了主机之后，机房里头最大的耗电户既不是H100，也不是主机。那么，也有人说，难道是交换机吗？难道是路由器吗？难道是这些东西吗？都不是啊。我告诉大家，所有的机房里头，真正的耗电大户是空调。H100耗了700瓦的电，疯狂的发热了。以后，你不能等着它冒烟着火，对吧？一个封闭的机房里，你再要把这些热量排出去，你还要再用更大功率的空调来把这个热量交换掉。所以，这是一个非常巨大的工程。在国内，玩得起的公司基本上都被扎戈伯格限制了。第一个，人家想了说，你不可以拿Llama再去训练新模型了。第二个，所有用户量超过7亿的公司。</p>



<p class="wp-block-paragraph">你要想去用Llama，你要跟雷塔申请特殊的许可证。咱们国内能够训练这样的模型，又有7亿用户的阿里、字节、腾讯，他们如果没有向美塔专门申请过许可证，那你就只能说这是我自主研发、自主知识产权，跟你没关系。但到最后，如果被海外应用的时候，被梅塔抓住把柄，说：“哎，你这个里头跟我那是一样的。”那么这个官司就有的打了。</p>



<p class="wp-block-paragraph">那扎克伯格自己对于中国开源项目的看法是什么样的呢？你说他装没看见，这事肯定是不行的啊。在Llama的基础上进行开源、内容创作、进行微调、进行数据准备，最积极、干的活最多的就是中国团队啊。那么扎克伯格肯定不能装没看见。</p>



<p class="wp-block-paragraph">所以扎克伯格也说了，开源可以让中国之外的盟友和小公司一起进步。如果我闭园了，大家去通过间谍、通过拷优盘拷贝、通过各种方式得到模型参数、得到模型数据的能力都还是很强的，并不是说我闭园了，中国团队就得不到了。我要开园了呢，中国团队也能得到，我其他的像什么法国、欧洲的盟友，还有很多的小公司，他们也可以得到这些数据，他们就可以跟我一块进步。</p>



<p class="wp-block-paragraph">他讲的是这样的一个逻辑。这其实特别有意思啊，美国你去看看，现在美股七姐妹也好，或者是其他的比较靠上的这些美股科技公司也好，他们都是有大量的中国市场订单或中国市场份额的。每一家都是在这揣着明白装糊涂。你把这个东西开放出来了，一定是极大地刺激中国的大模型发展，而且现在已经没有天花板，没有任何问题。</p>



<p class="wp-block-paragraph">我们就可以快速地达到，超越GPT-4的这个水平了。我相信，可能在未来的一到两个月里，各种模型就会再去更新升级，推出全面超越GPT-4的版本出来。现在这个压力给了OpenAI，如果比赛不更新，再拿不出GPT-5的话，就要彻底落后了。所以，扎克伯格自己心里是心知肚明的啊。他完完全全是为中国大魔星开绿灯。</p>



<p class="wp-block-paragraph">至于其他的他的盟友，这些小公司到底有没有赶上，可能在努力追赶，但应该并没有。从梅塔的开源里，真正得到最大利益和实惠的事情是没有办法的。但是同时，他也抹了一个悉尼，说：“你看我开不开源，他们都能得到。”这个都是这么干。</p>



<p class="wp-block-paragraph">另外，他也讲说闭源是让个别公司憋大招。他说：“我们从来不认为最后只有一种达摩型。”那些只认为最后应该只有一种达摩型的人，他们是在干嘛？他们是在自己偷偷创造上帝。这个事是非常可耻的啊。我不知道作为一个犹太人，他如何去解答这种，或者如何去看待这种自己偷偷创造上帝的这个过程。</p>



<p class="wp-block-paragraph">总之，他说这事不行，非常可耻，一定要开源出来。而且现在看，开源正在超越闭源。这就是我们今天要讲的，拉嘛3.1405B的发布，如何搅动风雨，如何让中国团队冲锋，给中国团队指明方向，以及扎克伯克对于这个事情本身到底是怎么看的一个故事。</p>



<p class="wp-block-paragraph">好，感谢大家收听，请帮忙点赞，点小铃铛，参加Disco讨论群。也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
