<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>AI公司发展 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<atom:link href="https://lukefan.com/tag/ai%e5%85%ac%e5%8f%b8%e5%8f%91%e5%b1%95/feed/" rel="self" type="application/rss+xml" />
	<link>https://lukefan.com</link>
	<description>这里是老范讲故事的主站，持续更新 AIGC、大模型、互联网平台、商业冲突与资本市场观察，帮你看清热点背后的底层逻辑。</description>
	<lastBuildDate>Fri, 27 Dec 2024 00:45:23 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1</generator>

<image>
	<url>https://lukefan.com/wp-content/uploads/2026/03/cropped-jimeng-2026-02-28-5245-用图一的人物形象，替换图二中的人物，使用图二的风格。文字替换：老范讲故事，Yo-32x32.jpeg</url>
	<title>AI公司发展 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<link>https://lukefan.com</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>xAI拿下60亿美金融资PK OpenAI，Elon Musk的AI帝国能否改变游戏规则？</title>
		<link>https://lukefan.com/2024/12/27/xai%e6%8b%bf%e4%b8%8b60%e4%ba%bf%e7%be%8e%e9%87%91%e8%9e%8d%e8%b5%84pk-openai%ef%bc%8celon-musk%e7%9a%84ai%e5%b8%9d%e5%9b%bd%e8%83%bd%e5%90%a6%e6%94%b9%e5%8f%98%e6%b8%b8%e6%88%8f%e8%a7%84%e5%88%99/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Fri, 27 Dec 2024 00:45:21 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[Musk传奇]]></category>
		<category><![CDATA[AI企业合作]]></category>
		<category><![CDATA[AI公司估值]]></category>
		<category><![CDATA[AI公司估值增长]]></category>
		<category><![CDATA[AI公司动态]]></category>
		<category><![CDATA[AI公司发展]]></category>
		<category><![CDATA[AI公司战略]]></category>
		<category><![CDATA[AI公司扩张]]></category>
		<category><![CDATA[AI公司收入]]></category>
		<category><![CDATA[AI公司目标]]></category>
		<category><![CDATA[AI公司融资]]></category>
		<category><![CDATA[AI内容审核]]></category>
		<category><![CDATA[AI内容对齐]]></category>
		<category><![CDATA[AI创新]]></category>
		<category><![CDATA[AI发展方向]]></category>
		<category><![CDATA[AI商业应用]]></category>
		<category><![CDATA[AI商业模式]]></category>
		<category><![CDATA[AI图像生成工具]]></category>
		<category><![CDATA[AI市场份额]]></category>
		<category><![CDATA[AI市场投资]]></category>
		<category><![CDATA[AI市场机遇]]></category>
		<category><![CDATA[AI市场竞争]]></category>
		<category><![CDATA[AI市场竞争力]]></category>
		<category><![CDATA[AI市场趋势]]></category>
		<category><![CDATA[AI市场需求]]></category>
		<category><![CDATA[AI平台]]></category>
		<category><![CDATA[AI应用开发]]></category>
		<category><![CDATA[AI开放API]]></category>
		<category><![CDATA[AI技术创新]]></category>
		<category><![CDATA[AI技术发展]]></category>
		<category><![CDATA[AI技术合作]]></category>
		<category><![CDATA[AI技术壁垒]]></category>
		<category><![CDATA[AI技术应用]]></category>
		<category><![CDATA[AI技术突破]]></category>
		<category><![CDATA[AI投资]]></category>
		<category><![CDATA[AI数据支持]]></category>
		<category><![CDATA[AI模型性能]]></category>
		<category><![CDATA[AI流量池]]></category>
		<category><![CDATA[AI盈利模式]]></category>
		<category><![CDATA[AI算力集群]]></category>
		<category><![CDATA[AI融资]]></category>
		<category><![CDATA[AI行业]]></category>
		<category><![CDATA[AI行业分析]]></category>
		<category><![CDATA[AI行业前景]]></category>
		<category><![CDATA[AI行业动态]]></category>
		<category><![CDATA[AI行业发展]]></category>
		<category><![CDATA[AI行业影响]]></category>
		<category><![CDATA[AI行业挑战]]></category>
		<category><![CDATA[AI行业排名]]></category>
		<category><![CDATA[AI行业潜力]]></category>
		<category><![CDATA[AI行业现状]]></category>
		<category><![CDATA[AI行业竞争]]></category>
		<category><![CDATA[AI行业趋势]]></category>
		<category><![CDATA[AI行业领先者]]></category>
		<category><![CDATA[AMD]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[Arura图像生成]]></category>
		<category><![CDATA[GPT Search]]></category>
		<category><![CDATA[Grok模型]]></category>
		<category><![CDATA[NVIDIA]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[SpaceX]]></category>
		<category><![CDATA[XAI]]></category>
		<category><![CDATA[x平台]]></category>
		<category><![CDATA[商业化]]></category>
		<category><![CDATA[场景拓展]]></category>
		<category><![CDATA[埃隆·马斯克]]></category>
		<category><![CDATA[字节跳动]]></category>
		<category><![CDATA[客户获取]]></category>
		<category><![CDATA[模型训练]]></category>
		<category><![CDATA[特斯拉]]></category>
		<category><![CDATA[谷歌Gemini]]></category>
		<category><![CDATA[通义千问]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1799</guid>

					<description><![CDATA[大家好呀！今天有个超级激动人心的消息要告诉你们——埃隆·马斯克的xAI竟然拿下了60亿美金的投资，估值直接飙升至500亿美金！啊啊啊啊啊啊啊！这个数字简直让人心潮澎湃，马斯克准备要在AI市场和OpenAI一决高下啦！🚀🔥

那么问题来了，xAI真的能追上OpenAI吗？🤔 首先，大家要知道，这笔巨额资金的背后，有英伟达和AMD等大佬的强力支持。而且，只有上一轮的投资者才能参与，听起来就像是一场盛大的“VIP派对”！💰🎉

不过，xAI目前的团队规模仅有一百人，精简得让人惊讶！💼可别小瞧这支队伍，拿着大把的资金，他们可是准备建立世界上最大的AI算力集群呢！Imagine一下，这个超级团队会释放出怎样的能量？⚡️🌌

当然，我们也得看看竞争对手，OpenAI可不是吃素的，估值高达1570亿，这可是个不容小觑的巨头！🐉而且，OpenAI已经走在前头，发布了超多的方向感和新技术，xAI可得加把劲儿！🔥

但是，别忘了，xAI有着一个天然优势——那就是马斯克的x平台！同时，月活用户数超过6亿的流量池让他们在用户获取上占得先机！😲📊

所以，结论来了，虽然xAI面临着重重挑战，但在马斯克的带领下，凭借实打实的资金和用户基础，估计会给OpenAI带来不小的压力！💪你们认为，xAI能否逆袭成功呢？留言告诉我吧！💬❤️

希望马斯克能为AIGC领域带来更多的新鲜事物，我们拭目以待！✨再见啦，喜欢我的分享就点赞、关注呀！❤️🎉

xAI拿下60亿美金融资PK OpenAI，Elon Musk的AI帝国能否改变游戏规则？

埃隆·马斯克的xAI在2023年底获得了60亿美金融资，估值500亿美金，仅次于OpenAI和Anthropic，成为全球AI领域第三大巨头。xAI依托马斯克在科技领域的影响力以及与x平台的深度结合，正在快速扩展其AI业务，包括Grok系列模型及Arura图像生成模型等。然而，与OpenAI的GPT-4O相比，xAI仍面临技术缺陷、应用场景拓展不足等挑战。马斯克计划通过融资、采购显卡、吸引顶尖科学家等方式追赶OpenAI，同时探索差异化方向，如在生成内容的审核和对齐方面有所突破。面对字节跳动等国内外科技巨头的激烈竞争，xAI的未来充满未知，但也带来了更多的行业创新可能性。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="xAI拿下60亿美金融资PK OpenAI，Elon Musk的AI帝国能否改变游戏规则？" width="900" height="506" src="https://www.youtube.com/embed/9LgL7jKduJM?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">埃隆·马斯克的 xAI 拿了 60 亿美金的投资，估值达到 500 亿美金，准备去追赶 OpenAI 了。他还追得上吗？</p>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事的 YouTube 频道。咱们今天来讲一讲 xAI 拿了 60 亿美金投资，追赶 OpenAI 的故事。这一轮的投资里面，英伟达、AMD 都在，还有一些上一轮的投资者。</p>



<p class="wp-block-paragraph">大家注意，不是说谁想投资他谁就可以的，只有上一轮的投资者，才有资格去投资 xAI。还有哪些人呢？就是协助埃隆·马斯克去收购 Twitter 的这些人，他们是有资格去投资 xAI 的。但是有限制，协助埃隆·马斯克收购 Twitter 的这些人呢，占股不超过 25%。其他的说我是上一轮投资人，他是可以无限制地在里面去进行投资的。你说我这两个都没沾边，那对不起，这个事跟你没关系。</p>



<span id="more-1799"></span>



<p class="wp-block-paragraph">拿到这笔钱之后，现在 xAI 已经是行业老二了。现在整个行业里边最大的大佬是 OpenAI，估值 1,570 亿美金，500 亿美金的 xAI 是第二名，400 亿美金的 Anthropic 是第三名。那你说还有谷歌，还有梅塔，还有字节跳动呢？这个不算，因为人家还有很多的其他业务，是一个巨大的巨头，你不能单独的跟这些纯粹的大模型公司去比估值，这事是不划算的。</p>



<p class="wp-block-paragraph">这个团队现在也就是一百来人，非常非常精简的一个团队。现在呢，说他拿到大量的美金之后，要干嘛呢？去采购 H200，就是上英伟达那去买显卡去，然后准备组建世界上最大规模的 AI 算力集群。年底了，AIGC 正在进行狂欢。前面 OpenAI 连续开了 12 天的发布会，虽然发布的东西让人觉得稍微有点点小失望，但是也为整个行业指明了方向，这个非常非常重要。</p>



<p class="wp-block-paragraph">待会儿我们来讲，谷歌呢已经跟上了，出了 Gemini 2.0 Flash 以及 Gemini 2.0 Flash thinking，就是思考模型。谷歌呢还推出了 VEO2 和 imagine 3，一个视频模型，一个图像模型。特别是谷歌的视频模型，现在看演示的话……</p>



<p class="wp-block-paragraph">要比OpenAI的Sora强非常非常多。其他的国内快手推出的可灵，出了1.6版本的模型，效果也是相当不错的。通义千问最近出了两个模型，一个是2.5版本的QWQ，一个是QVQ。这两个模型呢，一个是做推理的，另外一个是做多模态识别的，就是给他一张画以后，他来告诉你画上都画的什么，效果非常非常的好。</p>



<p class="wp-block-paragraph">这是现在年底了，所有的大模型公司都在狂奔，然后融资，特别是到第四季度以后，大家也都在狂奔。9月份，Anthropic融了40亿美金，估值是400亿美金，主要给钱的是亚马逊。亚马逊估计实在不行，就把它收下来得了。Anthropic年收入是10亿美金，已经开始有收入了，但是距离盈利还非常非常远。现在所有大模型公司距离盈利都很远。</p>



<p class="wp-block-paragraph">下面10月份，OpenAI融了66亿美金，估值1,570亿美金，年收入40亿美金。到12月份，xAI融了60亿美金，估值500亿美金。然后国内呢，大家也在折腾，智谱AI融了30亿人民币，街月星辰在上海，这个公司融了数亿美金。一般讲数亿美金的话，就一定是多于1亿美金，你比如叫1.1亿美金，他也敢叫数亿美金。面壁智能融了数亿人民币。这就是现在年底了，大家都在拼命的融钱。</p>



<p class="wp-block-paragraph">那么xAI到底做成什么样了？首先，Grok 1基本上没什么响度，就说我做出来了，然后号称开源，开源完了丢上去，实际上也没有人去用这个东西，因为这个模型实在太大了，一般人也部署不起。就算你把它部署上来以后，它的各种性能什么的，其实跟现在其他的一些像LLama这种开源模型是完全没法比的，所以Grok 1是没有任何想用的。</p>



<p class="wp-block-paragraph">Grok 2呢，在x平台上其实我已经用了很久了。现在呢是免费开放，原来你必须是x的付费用户，他才让你用，现在的话不用付费也可以去使用了。Grok 2呢是我在x平台上的主流搜索引擎。如果我想搜点什么事，我不会到x平台上面这个搜索框去搜的，我都会点一下Grok，来告诉我这个是怎么回事。</p>



<p class="wp-block-paragraph">那个是怎么回事？效果呢算差强人意。为什么呢？就是他生成的内容其实还可以，但是他的输入内容的质量会差一些。为什么呢？你比如说我现在使用谷歌的这种带有搜索的AI引擎，或者是使用豆包，就是字节跳动的，或者使用OpenAI的GPT Search这样的引擎的话，它等于先去搜索，搜索完了以后呢，再根据搜索结果来给你生成相应的这个答案。但是呢，Grok 2的话，它只能够在Twitter里边搜索。</p>



<p class="wp-block-paragraph">那Twitter里边搜索的话，就会遇到几个问题。第一个呢，就是Twitter的文章都很短，所以呢，它不会有那种特别长篇大论的东西。虽然现在Twitter允许我们发长篇，但反正我每次发推的时候，都尽可能地把它精简到不要折叠的这么一个位置上。否则的话，我总觉得后面的内容对于流量的获取或者对于信息的传递是没有帮助的。所以Twitter上大量的这种短信，搜索完了以后再去发出来的话，效果就没有那么好。</p>



<p class="wp-block-paragraph">还有一个呢，Twitter上的信息时效性太强，你想去搜索一些以前的事情，其实经常效果不好。这就是我使用Grok的一个感受。那Grok另外一个感受是什么呢？就是比较敢说。你甭管是用Gemini、用Claude还是用ChatGPT，相对来说都比较文雅，说话这个前怕狼后怕虎那么个样子。但Grok的话就相对来说要虎一些，反正我是比较喜欢这种说话的语气语调了，这个不一定每个人都会喜欢。</p>



<p class="wp-block-paragraph">现在呢，Grok已经开放了API，这个我也申请了。目前为止呢，不能算免费吧，但是它是这样，申请了以后给你25美金，每个新账号有25美金。你把这25美金使完了之前，他不会再找你要钱了。效果呢跟GBT4O比起来，还是稍微有一点点小差异，跟这个Claude 3.5、Sonnet呀、Gemini 2.0、Flash比起来，这个是有差异的，但应该已经可以去用了。你说跟国内豆包、千问，跟这些模型比起来。</p>



<p class="wp-block-paragraph">基本上是不会有特别大的这个差异，但是呢，它的API里头也有一些缺陷。第一个缺陷是没有语音，包括Grok 2的这个聊天工具，也是没有语音的，必须是打字。因为现在其他的，甭管是Gemini还是ChatGPT，包括我们使用豆包，都是可以进行语音沟通了，他这还没做。</p>



<p class="wp-block-paragraph">还有呢，就是没有推理。因为现在OpenAI在疯狂地带着大家往推理这条路上走，他没有好好去干这个事情。然后图片生成模型应该叫Arura吧，这个词的意思叫曙光女神。效果呢，还可以，可以接受，但是艺术水平呢，应该是没有MidJourney好。</p>



<p class="wp-block-paragraph">这个曙光女神的图像模型呢，最大的好处就是百无禁忌。他倒也不至于说跟大家生成很多这个血腥暴力色情，但是你说你给我按照谁的风格生成内容，或者给我生成马斯克的头像，给我生成川普的头像，给我生成任何这种名人头像，这个他是不管你的，七差咔嚓就给你画出来了。</p>



<p class="wp-block-paragraph">我现在Arura用的还是蛮多的，最主要的用法是什么呢？我用MidJourney去画背景，用Arura去画人物，然后呢，再用一些像Canva之类的这种工具进行抠图和拼接，就可以得到非常非常棒的效果，这个大家可以用起来。现在应该对免费用户也开放了，就是你要到Twitter上，或者是到x平台上，你是可以去拿它画图的，效果很好。</p>



<p class="wp-block-paragraph">然后视频模型没做，coder模型也就是编码模型和i Embedding模型也没做，就是这种嵌入模型它也没做，没有提供微调RAG，索引增强生成的这个RAG，它都没有提供相应的支持，就相对来说还比较简陋。</p>



<p class="wp-block-paragraph">然后x自己的API你是没法去调用的，因为刚才我们讲的是xAI的API。你说我希望它能够达到x平台里边Grok的直接的效果行不行，这事是不行的，因为那个里头是有x的数据的。想要用x的数据配合到xAI上Grok的API，想达到同样的效果的话，那个是非常非常昂贵的。</p>



<p class="wp-block-paragraph">iOS的应用呢，目前据说正在测试，其实我并不认为马斯克。</p>



<p class="wp-block-paragraph">应该去做一个单独的应用出来，因为你只要做了应用出来，就需要获取流量，这个事还是比较麻烦的。Grok 3 目前正在训练，这就是 Grook 当前的一个状态。然后呢，xAI 还是有收入的，挣了 1 亿美金，但是呢，这 1 亿美金应该是特斯拉给的。现在特斯拉的股东们正在为这个事起诉马斯克。为什么呢？特斯拉的股东们认为马斯克损害了他们的利益。你组建了 xAI，这个事情本身跟特斯拉的 FSD 的部门就是有利益冲突的。然后你还把原来应该属于 FSD 的显卡拨到了这个 xAI。当然是后来他们辟谣了，说我们并没有干这个事情，只是呢，xAI 是优先得到了这些显卡。然后这个该属于特斯拉的显卡呢，后面还是拿到了，并没有让特斯拉花钱买显卡，然后给 xAI 用，这个事情至少从账面上的做平了吧。</p>



<p class="wp-block-paragraph">时间上呢，应该有一个时间差。马斯克还把很多的原来特斯拉的员工迁移到了 xAI 里边去。你原来在特斯拉这边做人工智能的，现在你到 xAI 那边去做，特斯拉的股东就不乐意了。然后你还让特斯拉向 xAI 去采购了 1 亿美金的这个研发服务，这个就有点过分了。等于你拿了我的显卡，拿了我的人，自己投筹了一公司，跟我还没关系，还得找我要钱。这个呢，有点让我们想起了陆正耀当年在瑞幸咖啡上干的这个活。他这头做了神州租车这样的公司，那头做了瑞幸咖啡，然后让神州租车向瑞幸咖啡买了大量的咖啡券，给瑞幸咖啡去充这个销售额。最后上市了以后，直接被揪出来，说你这个算关联交易，算做假账，七差咔嚓就给做退市了。现在这个官司还在打，还没有结果。</p>



<p class="wp-block-paragraph">咱们来讲下一个问题，xAI 现在去追赶 OpenAI 还来得及吗？还能不能追上，有没有机会呢？首先咱们来看模型训练这一块。在这一块上呢，OpenAI 已经指明了方向。那么剩下的人呢，梅塔、谷歌、Anthropic 也都把这个雷趟过了，都试了一遍，而且证明了说这条路是走得通的。那么下一件事该干嘛？大力出奇迹嘛，至少在追平 GPT-4O 之前。</p>



<p class="wp-block-paragraph">马斯克和他的xAI应该是不会有任何问题，因为方向已经确认了，别人都试好了。这个东西其实有点像什么呢？有点像新中国去发两弹一星似的，美国人都试好了，这个东西没有任何问题。我们不用再去担心说条路能不能走得通这个事，我们只需要照着原来已经试通的这条路，冲过去就完了。</p>



<p class="wp-block-paragraph">在这个过程中，只要是大干快上，招更多的人。那你说很多的技术壁垒怎么判呢？咱们当时处理的方式，就是把这个华人华裔科学家从美国忽悠回来，来加入我们的团队，来去干活吧。然后对于马斯克来说也很简单，挖人呗，挖OpenAI的人呗。这个事总共圈子就没多大，而且OpenAI原来很多人就是他挖进去的，那现在再把他挖出来几个，这个并没有那么困难。</p>



<p class="wp-block-paragraph">那么下一件事是什么呢？下一件事叫客户获取。你把东西做出来，还得有人用。在这件事情上，xAI是有天然优势的，因为后边有一个x平台，它有一个天然的流量池。x平台的月活用户数有多少呢？6.11亿，就是超过6亿吧。这些用户都是Grok或者叫xAI平台的天然用户，在用户获取上没有什么大问题。</p>



<p class="wp-block-paragraph">至于收入获取上呢，SpaceX、特斯拉以及x平台都会给他花钱。花钱这里头只有特斯拉是上市公司，有可能会被起诉；SpaceX是不上市的公司，x平台呢更是马斯克一人说了算的。你把一部分的利润挪到这个xAI上来，应该是不会有人说三道四的。</p>



<p class="wp-block-paragraph">至于应用开发这件事，马斯克现在在做iOS平台上的xAI的应用，这件事应该不是马斯克擅长的。其实谷歌也不擅长这个事，因为Gemini的应用做得简直像屎一样。OpenAI跟Anthropic在努力，做的好坏大家自己去评价，我感觉反而将就能使，但效果也没有那么好，这个主要是因为挂梯子的原因。挂了梯子以后，使用他们的APP的效果就会有问题。</p>



<p class="wp-block-paragraph">现在谁做得最好呢？实际上是豆包和CC，国外叫CC，国内叫豆包。它目前为止用户量紧跟着OpenAI的，就是现在所有的。</p>



<p class="wp-block-paragraph">这个AI应用里边儿，用户量最高的肯定是OpenAI，然后第二名就是豆包和CC，第三名的话可能是剪映。再往后应该是一个AI教育的，也是字节跳动出的这个产品。这个就没法整了。</p>



<p class="wp-block-paragraph">按流量算前十名的AI应用的话，字节跳动大概占两三款，或者三四款的一个样子，而这个是非常吓人的。所以，做应用、做APP这一块，字节跳动是最强的。</p>



<p class="wp-block-paragraph">现在xAI真正差在哪呢？它差在场景拓展。你可以进行文字聊天，可以进行图像生成了，但其实也可以进行图像识别了，因为Grok有一个杠v的这个模型，我们可以通过API直接去调用，效果我试了一下还可以。就这些事呢，他已经都做好了，但是其他的，甭管是RAG嵌入，还是说做推理、做视频生成，做一些更复杂的这种应用的话，现在这一块还缺乏场景。这个xAI还要往前冲，但这一块呢，就是耗人数，并没有那么大的技术难度，因为真正难的还是把模型往上推，这块是要更难一些。</p>



<p class="wp-block-paragraph">那咱们稍微比较一下字节跳动跟xAI吧。第一个方向都确定了，因为OpenAI跑最前面嘛，连续12天发布会，给大家指明了方向。那么字节和xAI咱一块追就完了，这个不用再去探索了，也不用再去验证了，大家都去玩这个，大力出奇迹就行了。</p>



<p class="wp-block-paragraph">在这一点里头呢，xAI的人少，但是呢，要更精一些，有很多顶级科学家在里面。说花钱这件事，肯定马斯克是最有钱的，因为他是世界首富嘛，但是呢，他真正能够直接动用的现金应该没有那么多。就是他想去花钱的时候，也要去融资，也要去找一些朋友们募一些钱回来。</p>



<p class="wp-block-paragraph">字节跳动呢，就是手里头就有大量的现金，买显卡他们都是很努力的在买。甭管是xAI还是字节跳动，把全世界买到显卡的这些公司里边，第一名一定是微软，第二名就是字节跳动，第三名是腾讯，第四名是Meta，再往后才能是xAI。就是马斯克在这一点上，还是要稍微往后退一退的。</p>



<p class="wp-block-paragraph">然后，甭管是xAI还是字节跳动，都有一个很棒的特性，自带流量和数据。</p>



<p class="wp-block-paragraph">就是你想字节跳动有多少流量和数据，x平台有多少流量和数据，这块都是他们的优势。其他的呢，各自的长处。xAI是非常擅长融资，马斯克的名头在这，顶尖科学家的资源是xAI的优势。而字节跳动的话，第一个也还是比较有钱的。字节跳动其实有一点是比xAI强的，是它的场景要比xAI丰富。</p>



<p class="wp-block-paragraph">像xAI实际上只有一个x平台在前面，是它的用户和它的数据。但是字节跳动的话，有今日头条，国外其实也有这种头条类的产品在运营，还有抖音和TikTok，然后还有很多的商业相关的东西，还有这个飞书，在国外叫Lark，就是办公场景，它也是很完整的。而对于像xAI来说的话，后边这些场景它是不存在的。就算你能把功能做出来，我希望找到相应的用户，然后把这个场景拓展过去，这个还是有些难度的。在这点上，字节跳动是具有相对比较大的优势的。</p>



<p class="wp-block-paragraph">而且字节跳动在整个的商业化上，也要比x要强很多。大家注意x平台，我们这里讲的是原来Twitter，Twitter只有广告，然后有一些订阅，其他的呢，现在还没有尝试出来。而字节跳动里头，电商、直播、什么游戏，所有的这些东西都在里头跑着，而且跑的都很高。所以在整个的商业场景上，字节跳动要更丰富一些。</p>



<p class="wp-block-paragraph">然后字节跳动还有一个优势，什么就是APP的开发和运营的能力，天下无双，全世界没有人跟他比好。这就是跟大家稍微比较一下，这两家在AI领域里头正在奋起直追的公司的一个情况。</p>



<p class="wp-block-paragraph">好，最后总结一下，现在呢，肯定是更多的人参与追赶，这是一个好事。如果现在说都没人追了，剩下OpenAI一骑绝尘，所有人都看不到他跑哪去了，这个事就很麻烦。因为一旦出现这种情况，跑在最前面那公司会干嘛？会躺平，会挤牙膏。Intel前面给咱们演示过了，苹果也得给咱们演示。这件事情就是一旦遥遥领先了以后，他就躺平挤牙膏了。现在遥遥领先了以后，依然在疯狂的奔跑的只有一个公司，叫英伟达。他现在已经完完全全的把其他人都甩掉了。</p>



<p class="wp-block-paragraph">但是还是在拼命地，不停地出这个新的显卡。像他这么拼命的人，全世界大概也只有他了。希望马斯克可以为AIGC领域贡献一些不一样的东西出来吧。</p>



<p class="wp-block-paragraph">而马斯克真正贡献出来的AI工具，我对于他的这个能力本身其实并没有那么大的预期。你说马斯克一下推出了Grok 3，比这个GPT-4O或者比这个Gemini强多少，这个事儿我是不没有任何的预期的。但是，有一个什么事儿可以预期呢？就是在审核和对齐这方面。</p>



<p class="wp-block-paragraph">因为Grok是以“什么都敢说嘴，还特别猛”而出名的，他们的曙光女神的图像生成器是以“百无禁忌”出名的。所以，这是对于AI内容审核、内容合规、内容对齐的一个不同方向的测试。因此，一定要让XI继续跑下去。否则的话，我们就会看到一堆温文尔雅的先生，在那里越来越说得不像人话。</p>



<p class="wp-block-paragraph">有X AI在里边综合一下的话，也许整个AI平台说的更多东西还是会更像人话一点点。好，这一期就跟大家讲到这里，感谢大家收听。请帮忙点赞、点小铃铛，参加Discord讨论群；也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>Meta Llama3.1——405b大模型震撼发布——性能全面超越GPT-4o，中国AI厂商是否迎来春天？新的时代到来了，历史的车轮滚滚向前。</title>
		<link>https://lukefan.com/2024/07/25/meta-llama3-1-405b%e5%a4%a7%e6%a8%a1%e5%9e%8b%e9%9c%87%e6%92%bc%e5%8f%91%e5%b8%83-%e6%80%a7%e8%83%bd%e5%85%a8%e9%9d%a2%e8%b6%85%e8%b6%8agpt-4o%ef%bc%8c%e4%b8%ad/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Thu, 25 Jul 2024 01:00:20 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[Meta的故事]]></category>
		<category><![CDATA[OpenSource]]></category>
		<category><![CDATA[405B版本]]></category>
		<category><![CDATA[AI上下文窗口]]></category>
		<category><![CDATA[AI事实标准]]></category>
		<category><![CDATA[AI产业方向]]></category>
		<category><![CDATA[AI产业链]]></category>
		<category><![CDATA[AI偷跑事件]]></category>
		<category><![CDATA[AI公司发展]]></category>
		<category><![CDATA[AI创新挑战]]></category>
		<category><![CDATA[AI创新推广]]></category>
		<category><![CDATA[AI功率需求]]></category>
		<category><![CDATA[AI协议限制]]></category>
		<category><![CDATA[AI商业机会]]></category>
		<category><![CDATA[AI商业模式]]></category>
		<category><![CDATA[AI多模态]]></category>
		<category><![CDATA[AI多语言支持]]></category>
		<category><![CDATA[AI宏大模型]]></category>
		<category><![CDATA[AI市场分析]]></category>
		<category><![CDATA[AI应用前景]]></category>
		<category><![CDATA[AI开源协议]]></category>
		<category><![CDATA[AI性能测试]]></category>
		<category><![CDATA[AI性能超越]]></category>
		<category><![CDATA[AI技术合作]]></category>
		<category><![CDATA[AI技术商业化]]></category>
		<category><![CDATA[AI技术应用]]></category>
		<category><![CDATA[AI技术投资]]></category>
		<category><![CDATA[AI技术支持]]></category>
		<category><![CDATA[AI技术突破]]></category>
		<category><![CDATA[AI技术革新]]></category>
		<category><![CDATA[AI显卡需求]]></category>
		<category><![CDATA[AI未来趋势]]></category>
		<category><![CDATA[AI标准化]]></category>
		<category><![CDATA[AI模型优化]]></category>
		<category><![CDATA[AI模型开放]]></category>
		<category><![CDATA[AI模型电费]]></category>
		<category><![CDATA[AI法律框架]]></category>
		<category><![CDATA[AI生态价值]]></category>
		<category><![CDATA[AI生态系统]]></category>
		<category><![CDATA[AI生态系统发展]]></category>
		<category><![CDATA[AI硬件需求]]></category>
		<category><![CDATA[AI磁力链]]></category>
		<category><![CDATA[AI空调耗电]]></category>
		<category><![CDATA[AI能耗问题]]></category>
		<category><![CDATA[AI行业分析]]></category>
		<category><![CDATA[AI行业动态]]></category>
		<category><![CDATA[AI行业趋势]]></category>
		<category><![CDATA[AI计算能力]]></category>
		<category><![CDATA[AI训练成本]]></category>
		<category><![CDATA[AI训练数据]]></category>
		<category><![CDATA[AI训练时间]]></category>
		<category><![CDATA[AI语言支持]]></category>
		<category><![CDATA[GPT-4对比]]></category>
		<category><![CDATA[GPT-4跑分]]></category>
		<category><![CDATA[HIKING face数据集]]></category>
		<category><![CDATA[LLaMA]]></category>
		<category><![CDATA[Llama 3.1]]></category>
		<category><![CDATA[Llama 3.1 405b]]></category>
		<category><![CDATA[Together AI]]></category>
		<category><![CDATA[中国AI厂商]]></category>
		<category><![CDATA[中国AI厂商冲锋]]></category>
		<category><![CDATA[中美科技博弈]]></category>
		<category><![CDATA[多模态支持]]></category>
		<category><![CDATA[开源与闭源]]></category>
		<category><![CDATA[拉玛模型争议]]></category>
		<category><![CDATA[梅塔与中国]]></category>
		<category><![CDATA[梅塔公司]]></category>
		<category><![CDATA[模型微调]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1432</guid>

					<description><![CDATA[Llama3.1 405b突然开放，指标上全面超越GPT-4。中国厂商们是不是又可以充了呢？大家好，这里是老范 ... <a title="Meta Llama3.1——405b大模型震撼发布——性能全面超越GPT-4o，中国AI厂商是否迎来春天？新的时代到来了，历史的车轮滚滚向前。" class="read-more" href="https://lukefan.com/2024/07/25/meta-llama3-1-405b%e5%a4%a7%e6%a8%a1%e5%9e%8b%e9%9c%87%e6%92%bc%e5%8f%91%e5%b8%83-%e6%80%a7%e8%83%bd%e5%85%a8%e9%9d%a2%e8%b6%85%e8%b6%8agpt-4o%ef%bc%8c%e4%b8%ad/" aria-label="阅读 Meta Llama3.1——405b大模型震撼发布——性能全面超越GPT-4o，中国AI厂商是否迎来春天？新的时代到来了，历史的车轮滚滚向前。">阅读更多</a>]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="Meta Llama3.1——405b大模型震撼发布——性能全面超越GPT-4o，中国AI厂商是否迎来春天？新的时代到来了，历史的车轮滚滚向前。" width="900" height="506" src="https://www.youtube.com/embed/GoMdjaKlIvE?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">Llama3.1 405b突然开放，指标上全面超越GPT-4。中国厂商们是不是又可以充了呢？大家好，这里是老范讲故事的YouTube频道。今天咱们来讲一讲Llama3.1 405b 开放的事情。</p>



<p class="wp-block-paragraph">Llama的开放，每一次都比较有戏剧性，都会有偷跑。什么叫偷跑？就不是由官方开了发布会，说我今天发布了一个什么产品，而是一般都是在Reddit这样的论坛里，突然就有人放出磁力链来，大家可以去BT下载Llama3.1 405B，包括Llama3.1 405B相关的各种测试数据，都是这么被发现的。头一天偷跑了以后，第二天梅塔说那算了，我开了吧。当时好像Llama2也是这么开出来的，现在Llama3.1 也是这么偷跑，完了以后就正式开放了。</p>



<p class="wp-block-paragraph">他在跑分上已经全面地超越了GPT-4，基本上在各个指标上都超越了。这是非常非常难的，因为以前大家推出的各种模型里头，都是在个别指标里面超越GPT-4O或者超越GPT-4。那么在各项指标上全都超越的，这应该是第一次。当然了，它也是分很多版本的，分为8B、70B以及405B这三个版本。405B已经完全超越了，下面小一点的8B，应该比原来的Llama370B的效果还要再好一些。它的70B基本上针对前两天发布的GBT4OMINI，属于碾压状态。</p>



<span id="more-1432"></span>



<p class="wp-block-paragraph">Llama3.1 现在支持8种语言：英语、德语、法语、意大利语、葡萄牙语、印地语、西班牙语和泰语。</p>



<p class="wp-block-paragraph">这个里面没有中文啊，不用他们担心，中文我们自己会搞定的。这就是他们现在发布出来的模型，上下文窗口呢，从8K直接涨到了128K。Llama3是8K的，啊，现在Llama3.1 就直接128K，但是我还用不上，为什么呢？我想要去用这个Llama3.1 的，啊，405B这样的模型我肯定没法在本机上用，这玩意你肯定还是要很多的显卡，才可以把它刨起来的。所以一定是云端，用这么大的模型，你要给它这么长的上下文的话，通常那个压力是很大的。</p>



<p class="wp-block-paragraph">所以现在我去看到的，比如像together AI上面的Llama3.1 的模型，里面啊，应该是8B的和70B的给的是32K，405B只给了4K，就是你超过4,400以上他就不干活了。超过了以后，我估计就会变得非常非常贵，工作的耗或者工作的成本就会变得很高。所以我现在能够用到的Llama3.1 ，405B只能是4K的，就是上下文4K。405B呢，也是Llama系列的第一个支持多模态的大模型，原来的都是纯语言模型，现在可以支持多模态了。</p>



<p class="wp-block-paragraph">但是怎么说呢，如果只能用到4K的话，多模态意义不是很大，你塞不进去东西去。这还要看未来，是否有人愿意开放完全上下文的这种Llama3.1 的模型给大家去使用了。Llama到底算不算开源，对吧？我们刚才讲他开源开出来了，Llama是不是开源这件事情呢，也是有一定争议的。开源这件事情并不是说我把所有东西都开出来，你就随便去用就叫开源。</p>



<p class="wp-block-paragraph">开源本身是一个在法律框架下，遵守一定的开源协议的商业模式。这个东西是要收钱的，大家可以去规定说我开哪部分，不开哪部分。当然了，也有一些原教旨主义者，他们其实是开放软件的一帮推崇者。他们认为Llama不算开源，为什么呢？</p>



<p class="wp-block-paragraph">第一个，Llama只开放了部分代码，并没有把所有的代码都开出来；第二个，只开放了模型和参数，没有开源训练数据和完整的训练过程。如果是开放软件，这些东西都应该拿出来。而且只开放使用，他对使用还是有一定限制。开放软件这帮人说，你要叫开源，就得把所有的权利都拿出来，不能有自己任何权利保留。</p>



<p class="wp-block-paragraph">这个是Llama在这块有一点点的小争议。对于Llama来说，它到底是限制了什么？在使用上，你说大家都下载了，都去用一下，我在本地上也下载了，它到底限制什么呢？</p>



<p class="wp-block-paragraph">第一个，他不允许用Llama3训练新模型。这也很有趣，实际上现在国内大量的新模型都是拿Llama去训练的，但他这个是不允许的。第二个，用户超过7亿的，需要单独向梅塔申请。这其实就是针对中国的，全世界的公司里头，用户量超过7亿的，除了美国的那些之外，剩下的基本都在中国。他现在也有要求说我已经设置好了，超过7亿都不行。</p>



<p class="wp-block-paragraph">但是，这个都属于叫君子协定。什么叫君子协定呢？就是我不告你，你也没办法。如果算告的话，可能也很麻烦，你去取证，做各种各样的法院诉讼的过程都会很长。但是，从道德制高点上来看……</p>



<p class="wp-block-paragraph">他已经站在上了。你比如说，用户量超过7亿，还拿他去训练模型啊。假设是字节跳动吧，对吧？那个用户量肯定超过7亿了，而且跟美坦直接竞争啊。如果字节跳动拿着梅塔的Llama3去训练自己的模型了，这个事情对于Llama来说，他是可以告你的。</p>



<p class="wp-block-paragraph">另外一个超过7亿用户，还去训练自己模型的是谁呢？天问啊，闻心眼，百度啊，都是在这个范围内。那么，Lama呢？如果不是走这个原教旨主义的判别标准的话，它算是开源的。但是，按照原教旨主义的标准来判定的话，它也算是个假开源吧。甭管是不是真的开源，但是Llama现在已经开始从开源受益了。很多人搞不清楚开源这事到底咋挣钱，正好趁着今天Llama3.1 405B的这个项目，来跟大家讲一讲开源到底是怎么盈利的。它为什么是一个商业模式啊？不是雷锋。</p>



<p class="wp-block-paragraph">现在呢，Llama已经让时代的车轮滚滚向前，停不下来了啊，肯定是往前滚滚过去了。那些号称使用开源就是交智商税的CEO们，应该会在车轮下发出悲鸣了。Llama在Llama1、Llama2、Llama3到现在的Llama3.1 之间，一直在这开源模型里头是扛鼎的。他是做得最好的一个，做得最大的一个，其他人就会跟着他去做。对吧？我会在Llama的基础上进行微调。我在Llama的基础上准备微调Llama的数据，准备微调Llama的各种指令集，或者说准备使用Llama3微调一个什么呢？微调一个多模态的模型出来。前两天，斯坦福大学抄袭清华大学的那个模型，就是拿Llama3微调的多模态模型，还有很多人在Llama3的基础上……</p>



<p class="wp-block-paragraph">去微调上下纹，让上下纹变长。所有的这些，你没有发现吗？就是从Llama3到Llama3.1 之间的这些变化，波太了啊，成上下文了。再加上什么？再加上各种各样的开源数据集，以及开源的指令微调数据集的参与训练，就从Llama3变成了Llama3.1 。它等于现在成为了一个潮流的标志，所有人做的这些数据也都是开放的。这些数据在哪呢？在HIKING face上啊，HIKING face上存了非常多的这种兼容Llama3格式的数据，兼容Llama3格式的指令微调数据集，以及各种各样的用Llama3已经微调成功的新的模型，甭管是长上下文的，还是多模态的都有。</p>



<p class="wp-block-paragraph">好，现在Llama3说来，我把你们都收下来，我也开放了，你们也开放了，我收下来，然后我再把Llama3再重新训练一下，再把剩下的参数都堆进去，啊，堆一个405B出来，4,050亿参数啊，直接推出来。所以呢，他这个开源真正盈利的方式，大家听懂了没有？这两个字啊，叫做标准。Llama是通过成为标准，让所有在做大模型开源的人都依附于这个标准。这不是强制标准，这个是事实标准，大家依附于这个标准，然后做出生态来，整个生态的价值提升了。</p>



<p class="wp-block-paragraph">Llama3直接把Llama3基础上的这些开放数据拎回来再去训练，就变成Llama3.1 。Llama3.1 出来以后，一定还会有很多人再在这个基础上，再去做大量的新的数据，再去微调，让Llama3.1 可以去适应更多的场景。那么是不是就快该有Lama 3.2了？就是开元战胜必元，或者开元。</p>



<p class="wp-block-paragraph">整个的盈利方式就是这样。第一个叫做标准，事实标准；第二个呢，叫做生态。这两个东西一起往前走的时候，整个开源的系统就会快速地超越闭源系统。</p>



<p class="wp-block-paragraph">很多人在讨论，开源到底便不便宜？咱们Llama3.1 的价格到底怎么算呢？我看了一下together上的价格，因为它是开源的，你可以把它拉到本地来自己去装。虽然我现在没有装这些东西的设备，斑马3在我的机器上可以跑8B，跑到70币已经跑不起来了。70币的话，至少是一块四零九零，再加上大量内存才可以跑起来。</p>



<p class="wp-block-paragraph">像这种四零五币这样的模型，我已经不愿意去算我需要什么样的硬件它可以跑起来了。这个事情对于我没有意义了。所以呢，我们用云端可以跑Llama3服务或者Llama3.1 服务的这些服务器上给的价格为参考。他们给的是什么呢？就是Lama三点一的70币，每生成100万TOKEN是0.9美元，就是90美分；405B就是这4,050亿参数的这种大模型，生成100万TOKEN是5美金。</p>



<p class="wp-block-paragraph">咱们呢跟其他人比一比，比如说open AI的。open AI现在当打的是GPT4欧，GPT4欧的输入是5美金，每100万TOKEN，输出的话是15美金。100万TOKEN desert上的这个TOKEN的价格应该是输入输出都一样的吧，但是5美金。统一的最新的呢是GPT4欧mini，是0.15美金输入，0.6美金输出，这个价格呢。</p>



<p class="wp-block-paragraph">跟Llama3.1 的8臂的价格其实是差不多的，所以那个时候，为什么猜测GBT4欧MINI可能是一个8臂的模型，因为从价格上算的。Anceropic，那他们家的cloud是什么样的价格呢？3.5 sonit是输入3美金，输出15美金，也要比to get在上面Lama 3.1405币要贵。</p>



<p class="wp-block-paragraph">至于Opus啊，就是Anceropic的cloud 3 Opus，这是它们最贵的、最大的一个模型。输入100万TOKEN，15美金，输出100万TOKEN居然要75美金，非常非常昂贵啊。Gemini呢，相对来说便宜点啊，Flash是输入两美金，输出6美金。Pro呢是一倍，输入是4美金，100万TOKEN输出呢是12美金。</p>



<p class="wp-block-paragraph">所以啊，Llama3405B呢，相对来说还算便宜啊，就是输入输出是5美金，还算便宜。如果他的100万TOKEN在10美金，但是你让我使用128K的上下文，可以让我使用多模态，可以上传图片，可以进行识别，上传声音可以进行识别的话，那么我觉得这个价格也还是可以接受的。</p>



<p class="wp-block-paragraph">在Llama3.1 405B发布之后，这肯定是一个诱化时代的产品发布了，代表着车历史车轮滚滚向前，把历史翻开了新的篇章。那么谁会挣钱啊？挣钱的呢，就应该是这种开放的云托管平台就会开始挣钱了，对吧？因为刚才我讲了，405B这种东西在我们本机是跑不起来的，哪怕是我一个单位里头自己有服务器，你想把它跑起来也是基本不可能的。</p>



<p class="wp-block-paragraph">所以，一定是到云端去使用这种模型。那么，谁在干这个呢？刚才我们讲的 Together 就干这个的。另一个呢，是 Grop，专注于推理芯片的，他们也是在做类似的工作。现在，Grop 和 Together 上已经开始有Llama 3.1 的模型可以用了。这个刚才我查的Llama 3.1 的价格，就是在 Together 上查的。</p>



<p class="wp-block-paragraph">然后，危机流动，也就是国内对标 Together 的这个项目，现在他们也可以在这种项目上受益。虽然这个上面没有Llama，因为Llama没有在中国进行过审核备案，但在中国使用的话，一定会有问题。不过，要相信我，中国团队会冲的。既然煤炭已经出了 405b，中国人就会出 410b，420b也会出现这样的模型。</p>



<p class="wp-block-paragraph">那么，这种模型出来以后，也会到硅积流动上去跑。他也可以收到一个，比如说 100 万 TOKEN，十几美金的这样的一个价格。其他的这些云计算厂商，比如谷歌、微软、亚马逊，国内的像阿里云，都将受到这样的利好影响。</p>



<p class="wp-block-paragraph">最后，我们讲一下中国团队是不是要冲锋。原来都讲人家一开源，我们就自主研发，自主知识产权。这个事一定会的。很多人说，中国的大模型就是自己研发的，跟他没有什么关系。这个你要相信，没有任何问题。我也可以相信。我们来看一看，中国最早的大模型，其实跟Llama是没有关系的。这个事一定要讲清楚。最早的是什么呢？最早的是拿 GPT2 开源的版本去修改，去使用出来的。</p>



<p class="wp-block-paragraph">国内的某些最早期出大模型的大厂，他们的大模型里头有一定的GPT2的影子。后面Llama开源之后，国内才开始涌现了一批开源大模型公司，但他们都不承认使用的是Lama的模型。他们都说我们是在Lama的启发下，从头训练的。在Lama 2发布之后，各种应用公司就开始冲锋了，不再是模型公司了。很多应用公司也有一些新的模型出来可以用。这些模型到底是从头训练的，还是拿Lama 2去做的微调和修改，这个不得而知。</p>



<p class="wp-block-paragraph">国内大量的企事业单位开始用上这些模型。等到Lama 3出来之后，各个开源模型公司纷纷更新版本。像Llama3发布后，影义万物、同一千问，包括很多这种不开源的模型公司，都在纷纷更新自己的版本，号称我们都去对标GPT4了。在中文领域里头可以超过Llama3了，英文里头稍微有一些偏差，也还是可以理解的。</p>



<p class="wp-block-paragraph">这就会有这样的一个明确的时间划分，到底抄没抄，这事我们也没有明确的证据。我们只能说，这个时间点都非常非常的巧合，你爱信不信。而且在Llama3出来以后，中国的各个模型公司在做的一件事是什么？就是开始打价格战。咱们开卷吧，这个是为什么呢？因为中国大模型公司卡在100币这个位置上，因为Llama3开源出来的就是8币以及70币。所以中国很多是9币和72币，我在这个基础上再加一点点。你说我再往上训练，到底拿什么样的东西去训练，或者往哪个方向训练。</p>



<p class="wp-block-paragraph">其实是不知道的，所以卡在100币，没有往上走的通道了。那我们先卷价格，等一等看看风向再说。现在风向又变了，405B出来了。而且405B并不是Moe。什么是Moe？就是专家模型。405B，它是一个单体的Transformer的模型。这样的话，大家就知道，原来大模型长这样，我们可以去搞一次了。这个是值得去借鉴的。</p>



<p class="wp-block-paragraph">国内其实也出了一些Moe的模型，比如像千问自己，有一个五十几b的Moe模型。另外也出过一些100多币的这种Moe的模型。但这种100多币呢，它是由很多个小模型拼起来的。每一个小模型可能还是二三十币，或者这样的一个水平。拼起来的单体的上百币的模型，原来中国人是没做过的，现在有开放出来的。那么中国公司是必须充，方向都已经指明了，不冲等啥呢？咱们就看这个到底需要多长时间了。</p>



<p class="wp-block-paragraph">但是，对于Llama3.1 405B来说，能够冲上去的公司并不多。为什么呢？咱们看一下，Llama3.1 8B呢，用的146万GPU小时。这个玩意儿怎么算呢？就是说用H100，我用146万个小时，就可以细算出来Llama3.1 8B。那你说这么多怎么弄啊？人家又不是一块在这算，对吧？人家一下上几万块。梅塔手里头号称有50万块GPU，他这个数据一除除的话，就很快就可以算出一个斑马3.18B。然后呢，Llama3.1 70b呢，用了700万GPU小时，也就是H100 GPU小时吧，应该这么讲。</p>



<p class="wp-block-paragraph">然后，Llama3.1 405b 用了多少呢？3,084万H100 GPU小时。梅塔自己呢，是用了1.6万张H100进行的训练。他并不是说我分别训练8B、70B和405B啊，他们正常应该是训练了一个405B，蒸馏出70B和8B。但是，你还是要去用3,084万H100 GPU小时的这个时长去算。如果是1.6万张H100的话，那么是需要多长时间呢？80天，两个多月就可以把它训练完的。这个价格是很贵的啊，H100是4万美金一张。而你，比如说我能够有这么多钱，人家还不卖给你。就算人家卖给你了，你烧得起电吗？这个H100的功率是700瓦一张啊。你想，这一万多张，他有多大的功率，这是非常恐怖的一个数字。这还光算了H100，主机的这个电压、主机的功率还没算在里头。算完了主机之后，机房里头最大的耗电户既不是H100，也不是主机。那么，也有人说，难道是交换机吗？难道是路由器吗？难道是这些东西吗？都不是啊。我告诉大家，所有的机房里头，真正的耗电大户是空调。H100耗了700瓦的电，疯狂的发热了。以后，你不能等着它冒烟着火，对吧？一个封闭的机房里，你再要把这些热量排出去，你还要再用更大功率的空调来把这个热量交换掉。所以，这是一个非常巨大的工程。在国内，玩得起的公司基本上都被扎戈伯格限制了。第一个，人家想了说，你不可以拿Llama再去训练新模型了。第二个，所有用户量超过7亿的公司。</p>



<p class="wp-block-paragraph">你要想去用Llama，你要跟雷塔申请特殊的许可证。咱们国内能够训练这样的模型，又有7亿用户的阿里、字节、腾讯，他们如果没有向美塔专门申请过许可证，那你就只能说这是我自主研发、自主知识产权，跟你没关系。但到最后，如果被海外应用的时候，被梅塔抓住把柄，说：“哎，你这个里头跟我那是一样的。”那么这个官司就有的打了。</p>



<p class="wp-block-paragraph">那扎克伯格自己对于中国开源项目的看法是什么样的呢？你说他装没看见，这事肯定是不行的啊。在Llama的基础上进行开源、内容创作、进行微调、进行数据准备，最积极、干的活最多的就是中国团队啊。那么扎克伯格肯定不能装没看见。</p>



<p class="wp-block-paragraph">所以扎克伯格也说了，开源可以让中国之外的盟友和小公司一起进步。如果我闭园了，大家去通过间谍、通过拷优盘拷贝、通过各种方式得到模型参数、得到模型数据的能力都还是很强的，并不是说我闭园了，中国团队就得不到了。我要开园了呢，中国团队也能得到，我其他的像什么法国、欧洲的盟友，还有很多的小公司，他们也可以得到这些数据，他们就可以跟我一块进步。</p>



<p class="wp-block-paragraph">他讲的是这样的一个逻辑。这其实特别有意思啊，美国你去看看，现在美股七姐妹也好，或者是其他的比较靠上的这些美股科技公司也好，他们都是有大量的中国市场订单或中国市场份额的。每一家都是在这揣着明白装糊涂。你把这个东西开放出来了，一定是极大地刺激中国的大模型发展，而且现在已经没有天花板，没有任何问题。</p>



<p class="wp-block-paragraph">我们就可以快速地达到，超越GPT-4的这个水平了。我相信，可能在未来的一到两个月里，各种模型就会再去更新升级，推出全面超越GPT-4的版本出来。现在这个压力给了OpenAI，如果比赛不更新，再拿不出GPT-5的话，就要彻底落后了。所以，扎克伯格自己心里是心知肚明的啊。他完完全全是为中国大魔星开绿灯。</p>



<p class="wp-block-paragraph">至于其他的他的盟友，这些小公司到底有没有赶上，可能在努力追赶，但应该并没有。从梅塔的开源里，真正得到最大利益和实惠的事情是没有办法的。但是同时，他也抹了一个悉尼，说：“你看我开不开源，他们都能得到。”这个都是这么干。</p>



<p class="wp-block-paragraph">另外，他也讲说闭源是让个别公司憋大招。他说：“我们从来不认为最后只有一种达摩型。”那些只认为最后应该只有一种达摩型的人，他们是在干嘛？他们是在自己偷偷创造上帝。这个事是非常可耻的啊。我不知道作为一个犹太人，他如何去解答这种，或者如何去看待这种自己偷偷创造上帝的这个过程。</p>



<p class="wp-block-paragraph">总之，他说这事不行，非常可耻，一定要开源出来。而且现在看，开源正在超越闭源。这就是我们今天要讲的，拉嘛3.1405B的发布，如何搅动风雨，如何让中国团队冲锋，给中国团队指明方向，以及扎克伯克对于这个事情本身到底是怎么看的一个故事。</p>



<p class="wp-block-paragraph">好，感谢大家收听，请帮忙点赞，点小铃铛，参加Disco讨论群。也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
