<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>华为升腾 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<atom:link href="https://lukefan.com/tag/%e5%8d%8e%e4%b8%ba%e5%8d%87%e8%85%be/feed/" rel="self" type="application/rss+xml" />
	<link>https://lukefan.com</link>
	<description>这里是老范讲故事的主站，持续更新 AIGC、大模型、互联网平台、商业冲突与资本市场观察，帮你看清热点背后的底层逻辑。</description>
	<lastBuildDate>Fri, 12 Dec 2025 01:27:34 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1.2</generator>

<image>
	<url>https://lukefan.com/wp-content/uploads/2026/03/cropped-jimeng-2026-02-28-5245-用图一的人物形象，替换图二中的人物，使用图二的风格。文字替换：老范讲故事，Yo-32x32.jpeg</url>
	<title>华为升腾 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<link>https://lukefan.com</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>禁令vs现实：从新疆招标到军方采购，H200早已公开流通！我们被这场中美“双簧戏”骗了多久？｜中国 英伟达 H200 出口 芯片 出口管制</title>
		<link>https://lukefan.com/2025/12/12/nvidia-h200-china-conditional-access-gray-market/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Fri, 12 Dec 2025 01:27:34 +0000</pubDate>
				<category><![CDATA[英伟达，NVIDIA，黄教主，GPU]]></category>
		<category><![CDATA[AI大模型训练]]></category>
		<category><![CDATA[AI算力]]></category>
		<category><![CDATA[AI芯片]]></category>
		<category><![CDATA[H200对华出口]]></category>
		<category><![CDATA[H200采购]]></category>
		<category><![CDATA[中国市场]]></category>
		<category><![CDATA[中美科技战]]></category>
		<category><![CDATA[华为升腾]]></category>
		<category><![CDATA[国产芯片]]></category>
		<category><![CDATA[影子算力中心]]></category>
		<category><![CDATA[数据中心]]></category>
		<category><![CDATA[特朗普]]></category>
		<category><![CDATA[算力中心招投标]]></category>
		<category><![CDATA[算力租赁]]></category>
		<category><![CDATA[美国出口管制]]></category>
		<category><![CDATA[美国政府]]></category>
		<category><![CDATA[芯片灰色市场]]></category>
		<category><![CDATA[芯片禁令]]></category>
		<category><![CDATA[芯片解禁]]></category>
		<category><![CDATA[英伟达H200]]></category>
		<category><![CDATA[黄仁勋]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=3123</guid>

					<description><![CDATA[H200解禁？英伟达股票只敢涨0.01%！😂 黄仁勋跪求批准却不敢喊“快买”，因为真相太魔幻了💥

中国：招投标大喇喇写“100台H200”，新疆算力中心绿电照用🔋 空军军医大学直接下单8卡？国防七子租着爽不香？🤣 美国封禁半年——结果封了个寂寞！

影子仓库H100租赁$6/小时，比美便宜30%🚀 军医大学→算力中心→高校招标，全在明目张胆用！字节70亿砸新加坡？国内“国产卡为主”实则洋卡干重活💻（升腾训不出大模型你懂吧？）

解禁意义=给懂王面子🤡 + 大厂财报美容！中国早就H200自由了——美国：朕解禁了→中国：朕知道了（继续奏乐）🎶

🔥结论：这哪是解禁？是玄学现场！封禁形同虚设，躺着赢麻了谁还稀罕你审批？
👇速评：美国像极了查岗的男友，中国是淡定回“哦”的老油条！你猜下次军医大招不招？
✨点赞过万，挖光H200影子产业链！（别问，问就是“绿电”光照我心💙）

标题1：H200解禁为何气氛诡异？揭秘从未停止的地下交易与官方博弈，真相让黄仁勋都保持沉默｜中国 英伟达 H200 出口 芯片
标题2：禁令vs现实：从新疆招标到军方采购，H200早已公开流通！我们被这场中美“双簧戏”骗了多久？｜中国 英伟达 H200 出口 芯片 出口管制
标题3：解禁反要多付25%？特朗普式抽成难敌灰色市场，揭秘官方采购与地下走私的价格战真相｜中国 英伟达 H200 出口 芯片 特朗普
标题4：一场心照不宣的政治秀：美国假装解禁，中国开闭门会，揭露大厂海外购芯与影子算力中心真相｜中国 英伟达 H200 出口 芯片
标题5：利好还是陷阱？H200对华解禁背后，是中美双重审批与高昂成本，远不如灰色市场来得直接｜中国 英伟达 H200 出口 芯片 市场
简介：英伟达H200对华出口解禁的消息并未引发市场狂欢，背后是远比想象更魔幻的现实。事实上，所谓“禁令”期间，H200芯片通过灰色市场乃至公开招标，从未在中国真正缺席。此次官方解禁更像一场政治平衡术，附带了中美双重审批与25%的额外成本，使得正规渠道反而更复杂。本文揭示了从地方政府到科技巨头，各方在这场围绕英伟达高端芯片的博弈中，早已存在的变通路径与潜规则。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="禁令vs现实：从新疆招标到军方采购，H200早已公开流通！我们被这场中美“双簧戏”骗了多久？｜中国 英伟达 H200 出口 芯片 出口管制" width="900" height="506" src="https://www.youtube.com/embed/XCxWdeU9aLI?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/nvidia-h200-china-conditional-access-gray-market/blog_1.JPEG" alt=""/></figure>



<h1 class="wp-block-heading">英伟达H200对华解禁，实际情况可能跟大家想象的，稍微有一点点差距</h1>



<p class="wp-block-paragraph">大家好，欢迎收听<a href="https://youtube.com/@StoryTellerFan" target="_blank" rel="noopener">老范讲故事的YouTube频道</a>。今天咱们来讲一讲，H200放行了，为什么气氛很诡异呢？大家想象当中的喜大普奔的现象，为什么没有出现呢？英伟达的股票，也仅仅是涨了那么一点点，并没有快速的上升。到底是有什么东西，跟大家认知不一样呢？</p>



<h2 class="wp-block-heading">主力显卡H200的解禁与诡异的气氛</h2>



<p class="wp-block-paragraph">(img: 穿着皮夹克的黄仁勋站在一扇紧闭的巨大木门前，做着“嘘”的手势，表情谨慎，背景是模糊的官员身影，羊皮纸，钢笔彩色手绘的统一风格)</p>



<p class="wp-block-paragraph">要知道H200，它不是像什么A800、H20这样专门为中国设计的阉割卡，它是英伟达现在在售的主力卡。这个卡是2024年二季度才正式开始发售，GB200虽然在卖，但是出货量非常少。很多欧美大厂，包括谷歌、微软这些厂，现在也依然在大量的采购H200。这样的一个卡对中国解禁了，大家怎么不开心呢？</p>



<p class="wp-block-paragraph">黄仁勋对此也表达了相当谨慎的态度：“我确实是开了，但是中国买不买这个事，我说了也不算。”他说了这样的一个话，而不是说：“解禁了，中国人赶快来买吧！”他也不敢讲这个。为什么？他明白中国人是要面子的。如果你现在出来喊，说现在解禁了赶快来买，那这么要面子的中国官员们，可能就把这事摁死了，所以他非常非常谨慎。</p>



<p class="wp-block-paragraph">工信部还专门为此召开了闭门会议，把有可能去购买H200的这些大型云计算厂商都召集在一起：“咱们关起门来说一说这是怎么回事。”这个闭门会议也流传出一些信息来，并不是完全正面的。坊间呢，还流传各种各样的小作文，说这东西安全性有问题。因为当时H20禁止在国内销售，也是美国放行了，咱们这不让卖的原因是安全有问题，说这个英伟达算力卡H200上有一些定位程序，能够知道你这个卡是在什么地方的。</p>



<h2 class="wp-block-heading">魔幻的现实：禁令下的H200采购从未停止</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/nvidia-h200-china-conditional-access-gray-market/blog_2.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">那么到底是什么样的情况呢？实际场景可能会让大家大跌眼镜。咱们想象一个这样的场景吧：在一个算力中心招投标现场，某单位的招标文件上赫然写着“100台H100、H200的8卡服务器”，就直接写招标文件上了。下面的专家就当没看见似的继续评标，单位还顺利中标了，而且进行了交付。那你说这是不是太快了点？是不是美国一开放，我们这“噼里咔嚓”就开始去运作了？你们中国人只是不说，下边人早就盼着这个英伟达H200，就像是久旱盼甘霖一样，这边一解禁马上就开干？不是的，这个事是非常魔幻的。刚才我们讲的这个案例，是发生在2024年的10月份。</p>



<p class="wp-block-paragraph">那是不是符合美国要求的单位呢？美国也不是上来谁都卖，他要求是符合美国审核的这些机构，我才卖给你。这个单位呢，是新疆阿勒泰地区布尔津县绿色算力中心项目。这个是不是符合美国的要求，我不知道。那你说是不是符合中国的呢？其实也不符合。因为现在中国工信部开完会以后，要求所有英伟达的卡是不可以享受“绿电”的。什么叫绿电？就是给你这个电力上打折，你是使用的绿色能源，比如说太阳能、风能，拿这玩意儿发出来的电，你用的这个电特别便宜。现在工信部说了，必须是给国产算力卡，英伟达卡是不能用的。所以你看，2024年10月份招投标的这个项目，就已经堂而皇之的过关了，而且也有人中标，也有人去交付了，还使得是绿电。你说这个封禁了半天，到底封禁谁了？</p>



<p class="wp-block-paragraph">不用目瞪口呆，咱们接着讲。以下是一些公开的招标案例：</p>



<ul class="wp-block-list">
<li><strong>2025年6月6日，新疆乌鲁木齐江算万卡枢纽型算力中心</strong>，直接招标了1,024台H200 8GPU服务器。6月16日，中建三局集团北京有限公司中标，并顺利交付。</li>



<li><strong>2025年10月22日，湖北孝感云七算能算力项目</strong>，为宁波联通提供算力，招标128台H200服务器，每台8块H200，也顺利招标实施。</li>



<li><strong>2025年8月21日，美国实体清单上的西安交大</strong>，招标了一批Amax品牌的H200服务器。9月12日，西安联讯信息工程有限公司中标并交付。</li>



<li><strong>2025年12月，国防七子之一的北航</strong>，招标租赁H200服务器，国内也有供应商响应并提供服务。</li>



<li><strong>2025年8月，空军军医大学</strong>，招标了8颗H200的算力芯片（应为一台8卡服务器），也顺利开标并交付，是直接购买而非租赁。</li>
</ul>



<p class="wp-block-paragraph">所以呢，这个真的是跟大家想象的，是不是有点区别？懂王这边开了半天会，黄仁勋在这努力了半天，终于解禁了，咱们这从来就没停过。</p>



<span id="more-3123"></span>



<h2 class="wp-block-heading">另一个场景：灰色地带的算力江湖</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/nvidia-h200-china-conditional-access-gray-market/blog_3.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">大家想象一下：在某个阴暗的进出口物流仓库里头，或者是某个地下的云计算算力中心里头，他们这些人在干嘛？接着奏乐接着舞。H100，那这个咱们囤了是可能要降价，赶快出货。H200还可以再观望观望，以懂王这种玩法，咱们现在通过走私的方式进来的这些H200，应该还能打。这些算力中心里边，已经上线的H100和H200，接着租呗。现在国内灰色，或者叫影子算力中心里边，这些H100的租赁价格，大概是6美金一小时，比美国的官方价格还要便宜一些。中国的大模型、中国的AI为什么发展的还挺快？大家是不是觉得：“哦，原来是这样的。”</p>



<p class="wp-block-paragraph">中国其实一直都在使用H200，从来就没有停止过。上百项科学论文与报告，都写着“我这个项目是用H200做的”。还有几十项招投标采购文件，上面都是赫然写着H200的名字，而且呢也都有人中标，都顺利实施了。</p>



<h2 class="wp-block-heading">美国“半放行”的真相</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/nvidia-h200-china-conditional-access-gray-market/blog_5.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">懂王在这折腾了半天，终于算是放行了。但是即使他放行呢，其实也叫“半放行”。为什么呢？</p>



<ol class="wp-block-list">
<li><strong>审核买家和用途：</strong>他要求先审核购买单位和使用用途，要确保这些人购买了H200以后，不会威胁美国的国家安全。其实以我刚才讲的这些场景案例，这些单位早就用上H200了。</li>



<li><strong>先运到美国：</strong>他要求所有的这些芯片，通通都要运到美国去。这些芯片在台湾生产，但不能直接运往大陆，必须先运到美国海关进行审核，确认买家并签署承诺书。</li>



<li><strong>抽取25%的抽成：</strong>这个25%一方面是填补海关检查、物流和文书工作的成本，另一方面会去填拜登政府的芯片法案的窟窿。川普可以借此宣传他如何“把他们撒出去的钱再挣回来”。</li>
</ol>



<p class="wp-block-paragraph">这一批的H200卖到国内来，肯定要比在国外直接采购要贵，因为英伟达应该会把这25%里的一部分转嫁给中国买家。所以前面我们讲那个阴暗角落里边的那些物流仓库，他们应该还可以接着玩，依然是有利润的。</p>



<h2 class="wp-block-heading">中国的应对：工信部的闭门会议</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/nvidia-h200-china-conditional-access-gray-market/blog_6.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">那你说这是美国的情况，中国的关门闭门会议讲的是什么呢？中国工信部在美国宣布H200放行之后，马上召开了闭门会议，找来了阿里、腾讯、字节等国内的一线云计算大厂。会议要求：</p>



<ul class="wp-block-list">
<li><strong>申报需求：</strong>你们到底需要多少H200？得申报一个数字。</li>



<li><strong>提交报告：</strong>要说明为什么要买H200，为什么国内的芯片有什么替代不了的？比如：“我必须要进行大规模高强度的训练，国内芯片无法替代。”</li>



<li><strong>双边审批：</strong>如果想正规的去购买这些芯片，只能是美国审批一次，国内再审批一次，双边交叉核对了才能够去买。</li>



<li><strong>使用限制：</strong>要求能源、交通这些基础设施部门禁止使用H200，只能使用国产芯片。而且使用H200，是不得使用绿电等国家补贴的。</li>
</ul>



<p class="wp-block-paragraph">反正国产芯片也确实是要比H200要费电费很多嘛，因为H200是5纳米的，国产的是这种叫N+2的这种7纳米，它的良品率很低、很贵，而且非常非常耗电。在这样的情况下，你们有一些补贴，可以跟H200打个平手，但是从算力角度上说，H200要碾压升腾910C（也就是华为最新的芯片）好几条街，更不用说稳定性了。</p>



<h2 class="wp-block-heading">H200定位传闻的技术解析</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/nvidia-h200-china-conditional-access-gray-market/blog_7.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">那么关于H200定位的这个小作文，到底是一个什么故事呢？是不是可以按一个按钮，就直接把中国的H200都关了呢？也不是。美国一些参议员确实提出了这样的要求，但黄仁勋激烈反对，因为一旦留下这种后门，它非常非常容易被黑客攻击，会变得非常不安全。</p>



<p class="wp-block-paragraph">这里头呢，有一个折中方案。它是通过ping来计算时间。在英伟达的这个显卡里头，有一个技术可以定期向美国的服务器去发ping请求的信号，信号里包括这块芯片唯一的序列号。这个过程：</p>



<ul class="wp-block-list">
<li><strong>无法精确定位：</strong>它没有办法去知道你这个算力卡具体是在哪个国家、哪个区域的，但是呢，它可以靠延时来去计算一下你大概在哪。通过对比ping不同地区服务器的延时，可以大致推断位置。</li>



<li><strong>单向通报：</strong>这是一种单向技术，只是ping过去，对面收到信号，不可能再把指令传回来。</li>



<li><strong>事后追责：</strong>这个好处是可以进行事后追责。比如卖到马来西亚的芯片，其ping信号模型应该是固定的。如果信号显示它到了上海，美国就可以去找当初的进出口商追责。</li>



<li><strong>无法远程关机：</strong>它绝对不会接收指令，不会影响运转，不会监测数据，更不可能远程关机。</li>
</ul>



<p class="wp-block-paragraph">现在这个技术呢，只是进行了可行性的论证，黄仁勋也愿意接受，但是呢，目前还没有开始实施。</p>



<h2 class="wp-block-heading">总结：一场心照不宣的魔幻大戏</h2>



<figure class="wp-block-image size-large"><img decoding="async" src="https://pictures.lukefan.com/nvidia-h200-china-conditional-access-gray-market/blog_8.JPEG" alt=""/></figure>



<p class="wp-block-paragraph">回到咱们今天这个标题上来，中国的H200之路一直都是很魔幻的。美国政府郑重其事、假模假式在那开会讨论，黄仁勋在那四处跪求，中国政府也在这不断的设置各种障碍。而且呢，中国政府也从来不否认我们限制他——大家注意这个词叫“不否认”，就是我们不承认，但是我们也不否认。但是呢，各大公司从来就没有少过H200。</p>



<p class="wp-block-paragraph">各大公司呢，阿里、字节、华为、腾讯、百度，他们不会大规模在国内采购这个东西的，因为很多是上市公司。但是呢，这些大公司都在拼命的在海外建立数据中心，自用或者租赁。字节跳动计划今年在新加坡、马来西亚砸70亿美金去购买英伟达芯片，而且不光是H200，人家B200也可以买。这事非常魔幻：海外媒体不断报道，字节跳动呢，不断的出来辟谣。</p>



<p class="wp-block-paragraph">走私渠道从来就没停过。你现在到淘宝上，都可以直接看到H100、H200，包括对中国禁售的5090。现在猜测吧，大概有十几万片到几十万片H100、H200这样的芯片在国内运转着。</p>



<p class="wp-block-paragraph">影子数据中心也一直在进行算力租赁。现在各大运营商的算力中心里头，都有配置H100、H200。他们的招投标呢，通常是国产卡为主，但N卡必不可少。比如前面新疆那个项目，招标了1,024台H200服务器，但同时招标了4,000多台华为的服务器。从总数和价格上，大头是华为的，但真正干活的，可能都是N卡服务器。</p>



<p class="wp-block-paragraph">那你说都这样了，美国还解个什么禁？他解禁H200的意义到底在什么地方呢？</p>



<ol class="wp-block-list">
<li><strong>象征意义：</strong>就像大熊猫似的，彰显一下中美友好嘛。</li>



<li><strong>财报贡献：</strong>阿里、字节、百度这些上市公司，可以公开的再去购买一批H200了，这个是会给英伟达财报上贡献很大的一笔。</li>



<li><strong>创造空间：</strong>正规渠道买H200，整个的流程还是很长，也很麻烦，价格扑朔迷离，大家就有很多的渠道可以去上下其手了。</li>
</ol>



<p class="wp-block-paragraph">总结一下吧，美国呢算是部分的解禁了H200的对华出口，氛围依然是非常非常诡异的。黄仁勋不敢大规模庆祝，怕刺激了某些人的敏感神经；国内呢，抓紧去开闭门会议，也不希望给美国人好脸色。实际情况呢，距离普通群众的想象可能稍有距离。H200在中国大地上从来就没有停过，而且很多都是非常非常明目张胆。在中国有的时候，就像明朝的时候的“倭寇之患”一样，一直都是很玄学。有没有真倭？有。但你说有没有江南士绅组织的这种海盗？也有。H200在咱们这里，一直就是这样的一个情况。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<p class="wp-block-paragraph"><em>好，这就是这一次跟大家讲的故事。感谢大家收听，请帮忙点赞、点小铃铛、参加<a href="https://discord.gg/ppKsNkttTv" target="_blank" rel="noopener">DISCORD讨论群</a>，也欢迎有兴趣、有能力的朋友加入我们的<a href="https://www.youtube.com/channel/UCUGLhcs3-3y_yhZZsgRzrzw/join" target="_blank" rel="noopener">付费频道</a>。再见。</em></p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>Deepseek V3.1 引爆A股！神秘代码 UE8M0 揭秘，华为升腾背后的“国运”豪赌</title>
		<link>https://lukefan.com/2025/08/24/deepseek-v3-1-%e5%bc%95%e7%88%86a%e8%82%a1%ef%bc%81%e7%a5%9e%e7%a7%98%e4%bb%a3%e7%a0%81-ue8m0-%e6%8f%ad%e7%a7%98%ef%bc%8c%e5%8d%8e%e4%b8%ba%e5%8d%87%e8%85%be%e8%83%8c%e5%90%8e%e7%9a%84/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Sun, 24 Aug 2025 00:41:25 +0000</pubDate>
				<category><![CDATA[DeepSeek大模型]]></category>
		<category><![CDATA[AI Agent]]></category>
		<category><![CDATA[AI大模型]]></category>
		<category><![CDATA[AI科普]]></category>
		<category><![CDATA[AMD]]></category>
		<category><![CDATA[A股]]></category>
		<category><![CDATA[Deepseek V3.1]]></category>
		<category><![CDATA[FP8]]></category>
		<category><![CDATA[H100]]></category>
		<category><![CDATA[H800]]></category>
		<category><![CDATA[MindSpore]]></category>
		<category><![CDATA[MXFP4]]></category>
		<category><![CDATA[UE8M0]]></category>
		<category><![CDATA[九九乘法表比喻]]></category>
		<category><![CDATA[二级市场]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[华为升腾]]></category>
		<category><![CDATA[国产算力芯片]]></category>
		<category><![CDATA[国运级产品]]></category>
		<category><![CDATA[寒武纪]]></category>
		<category><![CDATA[工具调用]]></category>
		<category><![CDATA[技术脱钩]]></category>
		<category><![CDATA[技术路线之争]]></category>
		<category><![CDATA[摩尔线程]]></category>
		<category><![CDATA[概念股]]></category>
		<category><![CDATA[模型量化]]></category>
		<category><![CDATA[混合精度训练]]></category>
		<category><![CDATA[矩阵乘法]]></category>
		<category><![CDATA[科技评论]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[股票投资]]></category>
		<category><![CDATA[英伟达]]></category>
		<category><![CDATA[裹小脚比喻]]></category>
		<category><![CDATA[计算精度]]></category>
		<category><![CDATA[谷歌TPU]]></category>
		<category><![CDATA[资本市场]]></category>
		<category><![CDATA[马赛克比喻]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2480</guid>

					<description><![CDATA[兄弟们，DeepSeek V3.1一出：圈内淡定，圈外股民疯了，公众号一句“UE8M0+FP8适配国产芯”，A股起飞📈。UE8M0是啥？=给模型打最厚马赛克🧱：少细节、少搬运、快又省，带宽紧张时真香。亮点：工具更能打，Agent友好；上下文128K⚙️🚀。但别神化，整体提升不跨代，“吊打”同行还早🤯。更刺激的是“裹小脚”路线🧦：训练用FP16/FP8，事后量化成UE8M0，配昇腾+MindSpore飞；英伟达/AMD就用FP8版。总结：这波=技术叙事+国运想象，爽点拉满也有风险。你站FP8稳扎稳打还是UE8M0极限拉扯？评论区见，点个赞我继续翻译AI黑话😅

Deepseek V3.1 引爆A股！神秘代码 UE8M0 揭秘，华为升腾背后的“国运”豪赌

1. UE8M0 究竟是什么？Deepseek V3.1 “裹小脚”豪赌国产芯片，是国运还是翻车？
2. Deepseek V3.1 引爆A股！神秘代码 UE8M0 揭秘，华为升腾背后的“国运”豪赌
3. 三分钟看懂 UE8M0！Deepseek V3.1 为何选择“技术裹脚”？深度解析国产大模型的阳关道与独木桥
4. 国运级大模型来了？Deepseek V3.1 绑定华为升腾，UE8M0 是技术创新还是饮鸩止渴？
5. Deepseek V3.1 深度解读：UE8M0 为何被称为“马赛克”？国产AI芯片路线之争，这波是豪赌还是妙棋？

简介:
DeepSeek V3.1 发布引爆热议，其核心技术 UE8M0 究竟是为国产算力芯片铺路的国运级创新，还是一次危险的“技术裹小脚”？本期视频将用“马赛克”、“九九乘法表”和“裹小脚”三个形象的比喻，为你彻底讲明白这个让股市疯狂、却让技术圈谨慎看待的神秘格式。

我们将深入探讨 UE8M0 的技术本质——一种为适配华为升腾等国产芯片而设计的极限低精度量化方案。它如何通过牺牲精度来换取在带宽受限芯片上的高效推理？为什么说 Llama、千问等主流大模型都无法直接使用这种技术，而 DeepSeek 必须在训练之初就进行特殊架构设计？这种另辟蹊径的技术路线，是否会开启国产大模型与世界主流（如 FP8、MXFP4）分道扬镳的道路？

这不仅是一次技术尝试，更是一场关乎未来的“道路之争”。观看本期视频，我们将为你深度剖析 UE8M0 背后的技术原理、商业逻辑与深远影响。如果你对AI前沿、国产芯片发展与商业趋势感兴趣，请务必点赞、订阅并开启小铃铛，加入我们的讨论！

###
#DeepSeek #AI大模型 #国产芯片]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="Deepseek V3.1 引爆A股！神秘代码 UE8M0 揭秘，华为升腾背后的“国运”豪赌" width="900" height="506" src="https://www.youtube.com/embed/WMzsxCtaDPU?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">Deepseek V3.1发布，很多人应该都有疑问，UE8M0到底是个什么东西？这个国运级的大模型，到底有没有翻车呢？</p>



<p class="wp-block-paragraph">大家好，欢迎收听<a href="https://youtube.com/@StoryTellerFan" target="_blank" rel="noopener">老范讲故事的YouTube频道</a>。</p>



<p class="wp-block-paragraph">DeepSeek V3.1发布，为什么会墙内开花墙外香呢？大家说这东西在国外也没多火。咱们讲的墙内开花墙外香，并不是说国外火，而是在圈外火。什么意思呢？就是在真正大模型圈里，其实大家并不怎么说这个事，但是在炒股票的这帮人面前，一下就火了，国产算力芯片一把就飞了。</p>



<p class="wp-block-paragraph">到底是一个什么样的情况？首先呢，Deepseek V3.1在性能上其实并没有特别显著的提升，所以一帮真正去研究大模型的人，或者去研究AI的人，只能在那尬吹，说这个好像强了一点，那个好像强了一点，但其实都并不明显。它的编程能力呢，确实应该有所上升吧，但是你说现在就可以吊打Claude Sonic 4，这个我觉得有些言过其实了。上下文现在是128K了，在Deepseek去年12月份发布的V3版本以及1月份发布的R1版本的时候呢，它的上下文都是64K的。到V30324和R10528这两个版本呢，就已经升级到128K了，所以这一次的V3.1依然是128K。工具调用上应该是真的增强了，比原来的V3增强了，也更加符合AI agent的一个需求，这个就是他的一个主要的优势。</p>



<span id="more-2480"></span>



<p class="wp-block-paragraph">所以为什么这东西一开始拿出来，大家没有觉得他怎么样，然后突然怎么就爆发了呢？一句话让二级市场直接就疯了。8月21号，Deepseek公众号上有一句话直接引爆A股。玩模型或者说玩AI应用的人，是不会太去看这个公众号到底写啥的，但是这些炒股的人不一样，人家天天盯着这个公众号，一个字一个字在那抠。</p>



<p class="wp-block-paragraph">这句话说的是什么呢？V3.1使用了UE8M0和FP8规模的参数精度，为了适配未来的国产算力芯片。有这样的一句话在里头，那这还不赶快冲上去？而且在传播的过程中呢，FP8这个词呢，在后续的流传中就变得时隐时现了，大家不再提这个FP8了，主要都去强调这个UE8M0了。一堆人就问说这玩意到底是个啥呀？这么神奇的东西吗？甚至寒武纪就直接涨停板了。</p>



<p class="wp-block-paragraph">下边呢，咱们来解释一下UE8M0到底是个啥。这个难度很大，因为我自己在数学这一块也没有多强，而且还想把它尽量地解释得通俗易懂一点，这个对于我来说是一个考验。如果我说了你没听懂的话，不是我没说好，是你自己智商有问题。咱们开个玩笑。</p>



<p class="wp-block-paragraph">很多人呢，其实都搞不明白这个UE8M0是什么，但是呢都像老中医念口诀一样，上来都是这个脉怎么怎么样，应该什么君臣佐使一下，然后就开始给你开药方。念念有词以后呢，就冲进去买股票去了。</p>



<p class="wp-block-paragraph">这个咱们解释一下，首先呢，用形象的三个词来跟大家解释一下什么是UE8M0。这三个词，第一个词叫“马赛克”。很多男生，特别是对于成人影片、日本成人影片有一些经验的这些男生，对于“骑兵”和“马赛克”这个词应该是能够有一些理解的。UE8M0呢，实际上就是一种马赛克格式，待会我们讲为什么。第二个呢，就是叫“九九乘法表”。在中国吧，大家从小就背，我们可以在某一些特定的计算里头超过老外。他们从小不背九九乘法表的这些人，就没有这个口算和速算的能力。我们从小背这个东西，我们就在某一些特定的运算里头会比他们先人一步。还有一个不是那么好听的词，但是更贴切，是什么？叫“裹小脚”。这个在满清时期，他们对汉族女性的一种残酷的压榨，要求大家去裹小脚，以小脚为美。UE8M0的话，就完完全全是符合这三个词的特性的。咱们下边一个一个给大家解释。</p>



<p class="wp-block-paragraph">首先呢，要跟大家解释一下计算精度的演化。咱们要知道，做大模型计算，甭管是训练也好，还是后边推理也好，它最主要的一个计算叫矩阵乘法，就是把一大堆的数呢放在一个矩阵里，两个矩阵相乘，乘完了以后得到一个结果。甭管是训练也好，还是推理也好，大模型训练的90%以上的算力就在干这一件事：乘乘乘乘乘。这也是为什么他们跑到英伟达的算力芯片里面去干这个事。英伟达算力芯片非常非常多的核心，这些核心也干不了太复杂的命令，但是你让他做乘法，他还是做得很快的。所以这个东西要比咱们普通的CPU算得快很多。</p>



<p class="wp-block-paragraph">矩阵乘法里头呢，就有一个问题，叫计算精度的问题。最标准的叫FP32，他们这个数是怎么表示的呢？第一位是符号，正数还是负数；后边呢，应该是8位吧，代表的是浮点；后边的几位呢，就是代表的一个精度。前边这个符号正负大家比较好理解，中间这一部分浮点数就意味什么呢？就是我可以表示最大和最小多少，这个是一个范围的表达。后边这个尾数呢，实际上是精度的表达，就是说我这个小数点后到底有多少位。当我们把这样的一个数字去进行乘的时候，肯定会得到一个结果。但是有一个问题是什么呢？咱们都是讲这大模型好大，有好多好多数据去进行运算的，那你说我要把这么多参数搬进去，在这个内存里跑来跑去，它就会变得非常非常消耗带宽。而在进行乘的时候，如果是两个很大的精度的数去进行乘的话，那它的对于算力的消耗也是非常非常可怕的。</p>



<p class="wp-block-paragraph">所以大家怎么办呢？就是要降低精度。而且呢，因为大模型本身它是一个很稀疏的运算，你降低了精度以后，发现对结果的影响并不是很大嘛。现在他们用16位的，或者用一些更小的8位的，用这样的精度去计算了以后，发现好像得出来的结果跟32位的没什么太大区别，那咱们就把它降低一点呗。所以呢，大家就开始从FP32变成FP16、BF16。这里头要注意，FP呢一般都是英伟达这边去采用的一个标准，也都是一位符号，然后呢多少位浮点，多少位尾数。BF16呢是谷歌自己用的一个标准，它的浮点数要更长一些，尾数更小一点，这样的话它可以表达更大的一个数字，但是呢精度差一点，效果呢也还可以。后边呢还有FP8，FP8就是尾数更少一点，然后更多的数字去表达。后来呢，我们现在使用的大部分模型，真正去推理运算的时候，实际上都是FP8。现在的模型呢，大量的训练都是用FP16去训练的，现在也没有那么多人使用FP32去训练了。最早都是FP32训练，后来就是FP16训练，训练以后再去对这个大模型进行量化。</p>



<p class="wp-block-paragraph">你说比在8再往下还有没有？还有，叫MXFP6和MXFP4。MX是什么意思呢？待会咱们再解释。FP4，咱们讲讲一下这个吧，它比较极端了。FP4是什么意思？就是它有一位符号，两位浮点和一位尾数。那你说我就一位尾数，这玩意算啥呀？我这要是0的话，那你前头这几位不就全废了吗？不是这么算的。如果你这个尾数是0，它代表什么呢？就是0、2、4、8。如果你这个尾数是1呢，它代表的是3、6和12。所以我们基本上这样看，FP4代表的数就是0、1、2、3、4、6、8、12。那你说就这几个数我乘来乘去，没有办法代表很多的东西，怎么办呢？不能说我整个大模型就这几个数就把它都表示了。所以呢，这个时候MX就起作用了。它呢，把这种很小范围的数呢，放在一个块里，这一个块呢有32个数，这一个块呢统一再进行一次浮点变化。这个浮点数变化呢，是写在另外一个叫做浮点位里头。那个浮点位呢，就是一个UE8M0的一个浮点位。UE8M0呢，意思是无符号的8位的浮点，没有尾数，就是这样的一个意思。它相当于什么呢？就是我们把4位4位的这种一块32个数，统一用一个浮点把它变化起来。MXFP4大概就是这么个意思。</p>



<p class="wp-block-paragraph">哪个模型是用的这样极端的参数呢？最近公开的GPT-OSS就是用的MXFP4。而且这个里头有一点很强的是什么？OpenAI是从训练就直接使用的MXFP4，它没有经过后续量化，所以它的效果非常非常好，也极其节省内存。因为你想你一旦把精度降低了，它就可以干嘛呢？它就可以用更小的内存去存储这些数据、存储模型。然后你在进行模型运算的时候，你的显存跟你的GPU之间进行调度的内容就会变得更少，乘的时候乘得更快。</p>



<p class="wp-block-paragraph">那你说在这个过程中，显卡或者说算力卡的公司干嘛使呢？他们就会想办法去优化。他写一些算法，或者说在里边做一些链路，让这些算法，比如说FP8的或者是FP16的这些数据，在我这做乘法和加法的时候让它变快一些。早期的显卡上是没有FP8的，有FP32、有FP16。什么时候开始有FP8呢？这个东西是在英伟达H100上出来的。BF16是只有谷歌TPU上才有，其他人不玩的东西。这个MXFP4呢，就是后来这个Blackwell黑井的显卡上是支持这种运算的。</p>



<p class="wp-block-paragraph">在这个里头有一种比较极端的算法，就是UE8M0。就是我已经没有正负数了，全是正，我这个全是正数，里头也没有任何的这个尾数了，只有8位的指数。那么它能够代表的数是什么呢？0、2、4、8、16、32、64，它等于是这样可以上去的，可以代表很大的数字，但是呢就是完完全全没有精度了，它是属于跳跃、跳阶跳上去的。这就为什么我们讲UE8M0是马赛克。你想我有一个图片，这个图片里头呢，某一些关键部位里头就没有阶梯了，就没有很多的细节了，只剩下这种跳跃式的这种表达了，那不就变马赛克了吗？所以基本上你把它理解成一个马赛克，这个事是可以的。你说有没有这个宝马一点的？有，就是那个刚才我们讲那个FP4，它里头还有一位，它可以代表0、1、2、3、4、6、8、12，它中间还是多出一个来的，它这个码要稍微薄一点。最极端的大的厚码，就是这个UE8M0。大家可以这么去理解它。</p>



<p class="wp-block-paragraph">Deepseek为UE8M0都做了些什么呢？首先呢，Deepseek并不是原生训练的UE8M0的大模型。它呢，是在英伟达的H800和H20上，使用FP16和FP8训练出来的一个模型。在训练完了以后呢，再专门针对UE8M0进行量化，把我原来这个训练完了结果的数据，按照UE8M0的这个方式重新量化、重新排一遍，然后拿出这样的一个小很多的模型出来。在这个专门为UE8M0进行优化的算力卡上，就可以跑得飞快。</p>



<p class="wp-block-paragraph">UE8M0其实是有一些好处的。它好处是什么呢？马赛克虽然没有细节，但是呢它在运算的时候，内存搬运会变得非常少。你去表达同样的模型，你需要的这个数据变小了，这个是非常非常有好处的。因为咱们现在最大的瓶颈是什么？因为美国禁运，我们的算力芯片跟这些HBM芯片之间，或者说这种显存芯片之间的带宽比较低，那我们就专门优化一个这样的算法给你就可以了。但是我们要注意，就是在Deepseek发的那篇公众号里头，他写的是“我们支持UE8M0和FP8”。所以呢，现在大家去下载的Deepseek V3.1的模型里头，实际上是有两个版本的，一个版本是UE8M0的，另外一个版本是FP8的。你说我是用英伟达显卡的，我用AMD的显卡，你就用FP8的版本。你说我在国内，我要用升腾的芯片，那你可以使用UE8M0的这个版本。</p>



<p class="wp-block-paragraph">为了适应UE8M0这种极限挑战，我要给你打马赛克，打完马赛克了以后你看了以后还觉得爽，这个是对于Deepseek来说非常非常高的挑战。那就需要干嘛呢？做专门的设计。他们在模型训练的时候做了专门优化，一方面呢是进行了混合精度的使用，就是有一些地方用的是比较高精度的，有些地方用的比较低精度的，他们专门做了这样的一个适配。然后呢，也在进行一些叫做累计误差检测。因为你想你把这个地方变成黑白的了，或者变成这种大马赛克了，那你这个误差就会变得很大，特别是需要进行多轮的矩阵计算以后的话，它的误差就会有累积的增加。Deepseek专门有一个设计，就是检测这个东西，如果误差达到一定阶段了以后，我会换一个方式重新来算一下，然后想办法把这个误差规避掉。它通过很多类似这样的手段呢，让这个模型在UE8M0上可以跑起来。</p>



<p class="wp-block-paragraph">这里就有一个问题，就是不做特殊架构设计的大模型是不能被量化成UE8M0的。你说我现在把Llama 4拿出来，做一个UE8M0的量化行不行？做不出来。虽然大家都是在英伟达的FP16和FP8的基础上训练出来的，但是你前面没有做这些提前的准备，没有在这个架构上做特殊的设计，你是不能去做这种极端量化的。你那个打上马赛克，大家看了就没感觉了。只有Deepseek V3.1打上马赛克，还可以有一定的表达能力。</p>



<p class="wp-block-paragraph">那为什么别人不用UE8M0呢？它呢，是需要专门修改训练架构，为极限情况进行纠偏的。这个过程呢，其实有点像裹小脚，你是必须从小抓起，等长大了再来的话，他就来不及了，已经长得比较大了，现在再去裹小脚裹不出来了。极大地增加训练的复杂度，而且呢也无法保证最后不翻车。有些人裹的一半说实在太疼了，算了我就放了吧。还有一些人真的是裹了一半完了，还留下一些残疾，最后发现也没有达到人家要求的效果。这个都是会发生的。九九乘法表也是一样，我们专门把一套特别高效的计算方式呢，把它背熟了，只有进行了同样训练的人，他才可以在某些特定领域里头极快速地去给出正确的答案来。刚才我们讲了马赛克、九九乘法表和裹小脚，其实最形象的呢就是裹小脚。</p>



<p class="wp-block-paragraph">那么国产算力芯片跟UE8M0到底是什么关系呢？H100就开始支持FP8了，B系列呢，开始就是像什么B200这些芯片呢，开始支持MXFP4，它是向这个方向前进的。国内呢，我们是在跟随了。大部分的芯片实际上都是支持FP8的，就是按照英伟达这个路子走的，只是我们比人出的晚。H100是挺早就出来了，咱们大概是2024年、2025年新出的一些算力芯片呢，都开始支持FP8，也对FP8呢进行了一定的优化。</p>



<p class="wp-block-paragraph">华为升腾芯片呢也是支持FP8的，但同时呢另辟蹊径，搞了UE8M0的这么一个算法出来。华为呢还出了一个叫MindSpore的开源框架，对华为芯片以及英伟达芯片进行全栈的AI应用，从推理到训练，所有的事情他都可以干。他做了这样的一个完整的开源框架。在这个开源框架里头呢，对于华为升腾芯片专门进行UE8M0的这种优化。你用传统的大模型推理框架，比如说PyTorch或者是TensorFlow，它是没有办法对UE8M0进行优化的。所以一旦你拿到的Deepseek V3.1是UE8M0量化版本的，你就只能去用华为的MindSpore。华为自己呢肯定用的是最好的。国内其他的芯片现在也开始兼容这个MindSpore，他们肯定出了芯片需要去兼容现在主流的这些开源框架，包括像PyTorch、TensorFlow，也要去支持MindSpore。他们也会对自己进行UE8M0的优化。比如说像寒武纪、摩尔线程，他们现在测试了UE8M0的计算的话，会比传统的FP8的方式呢效率要高很多，或者叫效率提升明显吧。这也是为什么大家都冲上去买寒武纪的股票。虽然华为是真正整套系统提出者，而且也是最大规模的部署者，但是呢它不是上市公司，炒股票的人就拿它没办法了。Deepseek自己也不是上市公司，炒股票的人拿它也没办法，那咱们就炒这个寒武纪就可以了。</p>



<p class="wp-block-paragraph">国外的这些芯片像英伟达呀、AMD这些主流芯片，都没有对UE8M0进行优化。他们也可以用UE8M0版本的这个模型，但是呢可能会更慢一些，因为它还要把这些模型搬到内存里头，重新转换成FP8或者是FP16再重新计算，它有一个中间的过程就比较麻烦。但是也不用担心了，你说我现在这个是英伟达的卡，那你只需要去下载Deepseek V3.1 FP8的版本就可以去使用了。</p>



<p class="wp-block-paragraph">那你说是不是国运？到底啥叫国运？只要带着国家转向都叫国运，还有另外一种可能吗？和国运级的升腾芯片进行绑定，那肯定是国运了。训练呢还是英伟达，推理呢专门为升腾进行了优化。后面呢就要进行道路之争了，中国人比较擅长，这个什么意思？千问、Kimi、MiniMax、豆包、智谱，这些开源模型都没有办法去做UE8M0的量化，因为他们在一开始训练的时候就没有考虑过我后边有可能裹小脚这个问题，所以他就没办法走这条路。你如果说也想去做UE8M0的这个量化的话，你就需要在训练的时候就调整，第一个很麻烦，第二个有极大的失败率。如果这就是未来的方向，那就真的是跟美国这边脱钩断链了，就是我们训练拿你这个东西继续训练下去，但是呢最后去量化和推理的版本就使用升腾了。确实在影响国运的走向，所以呢这个Deepseek V3.1确实是国运级产品。</p>



<p class="wp-block-paragraph">未来会怎么发展呢？希望吧，股市上折腾一下就算了，大家去买买股票赚点钱，不要去真的影响未来国内大模型的走向。大家还是尽量去跟着国际主流的技术路线去走FP8的这个路线。如果你说我们要继续前进，大家可以想办法向MXFP4的方向去走，不要去走这个UE8M0的方向，这个方向就像裹小脚一样，非常非常危险的一个方向。Deepseek V3.1呢，算是做了一次尝试吧，但如果真的影响了未来国内的模型方向，不是什么好事。</p>



<p class="wp-block-paragraph">这就是今天要跟大家讲的，希望大家能够听到一些自己原来不太理解的东西吧。好，这个故事就讲到这里，感谢大家收听，请帮忙点赞、点小铃铛、参加<a href="https://discord.gg/ppKsNkttTv" target="_blank" rel="noopener">DISCORD讨论群</a>，也欢迎有兴趣、有能力的朋友加入我们的<a href="https://www.youtube.com/channel/UCUGLhcs3-3y_yhZZsgRzrzw/join" target="_blank" rel="noopener">付费频道</a>，再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>DeepSeek R2难产真相！金融时报爆料：华为昇腾芯片训练失败，揭秘国产AI算力的“卡脖子”困境。</title>
		<link>https://lukefan.com/2025/08/18/deepseek-r2%e9%9a%be%e4%ba%a7%e7%9c%9f%e7%9b%b8%ef%bc%81%e9%87%91%e8%9e%8d%e6%97%b6%e6%8a%a5%e7%88%86%e6%96%99%ef%bc%9a%e5%8d%8e%e4%b8%ba%e6%98%87%e8%85%be%e8%8a%af%e7%89%87%e8%ae%ad%e7%bb%83%e5%a4%b1/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Mon, 18 Aug 2025 13:35:27 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[华为很厉害]]></category>
		<category><![CDATA[英伟达，NVIDIA，黄教主，GPU]]></category>
		<category><![CDATA[AI Agent]]></category>
		<category><![CDATA[AI芯片]]></category>
		<category><![CDATA[AI训练]]></category>
		<category><![CDATA[AMD]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[B100]]></category>
		<category><![CDATA[Claude 4]]></category>
		<category><![CDATA[CUDA]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[Deepseek R2]]></category>
		<category><![CDATA[Function Call]]></category>
		<category><![CDATA[Gemini]]></category>
		<category><![CDATA[Google]]></category>
		<category><![CDATA[GPT-5]]></category>
		<category><![CDATA[Grok 4]]></category>
		<category><![CDATA[H100]]></category>
		<category><![CDATA[H20]]></category>
		<category><![CDATA[H800]]></category>
		<category><![CDATA[Kimi]]></category>
		<category><![CDATA[Llama 4]]></category>
		<category><![CDATA[Meta]]></category>
		<category><![CDATA[NVIDIA]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[TPU]]></category>
		<category><![CDATA[XAI]]></category>
		<category><![CDATA[中美科技战]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[传闻]]></category>
		<category><![CDATA[千问]]></category>
		<category><![CDATA[升腾910C]]></category>
		<category><![CDATA[华为]]></category>
		<category><![CDATA[华为升腾]]></category>
		<category><![CDATA[国产替代]]></category>
		<category><![CDATA[国产芯片]]></category>
		<category><![CDATA[大模型]]></category>
		<category><![CDATA[大模型训练]]></category>
		<category><![CDATA[字节跳动]]></category>
		<category><![CDATA[开源]]></category>
		<category><![CDATA[技术瓶颈]]></category>
		<category><![CDATA[推理]]></category>
		<category><![CDATA[散热问题]]></category>
		<category><![CDATA[浸没式液冷]]></category>
		<category><![CDATA[液冷]]></category>
		<category><![CDATA[深度求索]]></category>
		<category><![CDATA[百度]]></category>
		<category><![CDATA[算力]]></category>
		<category><![CDATA[腾讯]]></category>
		<category><![CDATA[芯片战争]]></category>
		<category><![CDATA[英伟达]]></category>
		<category><![CDATA[辟谣]]></category>
		<category><![CDATA[金融时报报道]]></category>
		<category><![CDATA[难产]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2469</guid>

					<description><![CDATA[兄弟们，震惊部又来！FT曝：DeepSeek R2被升腾拖进产房卡壳，华为救火队常驻也拉不动，最后无奈切回NVIDIA 🙃。更离谱：8.15-8.30的“官宣”，居然是R1自己幻觉出来的…😂

现实是：训练≠推理。海外已是10万块H100开团，我们这边910C一热就“打怪不能存档”🫠；液冷得全浸泡，相关股票倒是先起飞了💦📈。真能稳训大模型的，除了英伟达就剩谷歌TPU了。

两大“国运级”相撞，先躺的不是DeepSeek，只能继续等奇迹。DeepSeek不融资不表演，憋大招也许真有可能？点个赞，保佑R2别再难产；评论区站队：N卡、TPU还是升腾，你押谁？🤔🔥

 DeepSeek R2难产真相！金融时报爆料：华为昇腾芯片训练失败，揭秘国产AI算力的“卡脖子”困境。

揭秘DeepSeek R2发布推迟的真正原因：传闻因华为升腾芯片在关键的大模型训练阶段遭遇技术瓶颈，导致项目被迫换回英伟达GPU。这不仅暴露了国产AI算力在稳定性与多卡协同上的严峻挑战，更凸显了我们在追赶GPT-5、Llama 4等动辄需要20万块H100训练的顶级模型时所面临的巨大算力差距。

本期视频将深度剖析《金融时报》报道的背后细节，探讨为何被寄予厚望的华为升腾芯片难以胜任长时间、高强度的大模型训练任务。从散热问题到多芯片互联速度，我们将层层解析国产算力芯片的现状与困境。同时，我们也将追踪DeepSeek R2发布的“乌龙”传闻——竟是其上一代模型AI自己的“幻觉”所致？

当全球AI竞赛进入算力决战阶段，DeepSeek作为国内的希望之星，它的每一步都牵动人心。国产AI算力能否突破重围，支撑我们走向真正的AI强国？观看完整视频，了解这场AI算力之战的幕后故事。别忘了点赞、订阅并分享你的看法！

###
#DeepSeek #华为 #AI芯片]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="DeepSeek R2难产真相！金融时报爆料：华为昇腾芯片训练失败，揭秘国产AI算力的“卡脖子”困境。" width="900" height="506" src="https://www.youtube.com/embed/RfBUVJ6pHTI?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">8月14号，英国金融时报发了一篇报道，说Deepseek R2模型之所以难产，是因为在使用华为升腾芯片训练的时候，持续遇到了技术问题，最后被迫改用了英伟达芯片。甚至透露华为曾经派出一支救火队，常驻在Deepseek，手把手帮忙调教升腾服务器，但仍然无法完成训练。无奈之下，Deepseek只能退回老路训练，重新切换回性能更加可靠的Nvidia的GPU，升腾芯片仅退居辅助，用于模型推理环节。</p>



<p class="wp-block-paragraph">虽然没有华为和Deepseek官方的回应，也没有他们的辟谣，但是呢，据说是援引了三位知情人士的一些说法，也进行了很多交叉验证，所以这个事情呢，大概率是真的。</p>



<p class="wp-block-paragraph">国运跟国运相碰撞的时候，升腾也号称是国运级产品，Deepseek肯定是国运级产品，为什么是升腾不灵呢？升腾芯片是可以替代的，也还有一堆竞争对手，所以出现问题以后，他的竞争对手会帮他去宣传。而Deepseek虽然在国内也有模型在追赶，但是地位是不一样的。升腾和国内的其他算力芯片，以及其他那些大模型，从来没有像Deepseek那样震动过世界。所以呢发生碰撞的时候，必须是升腾不行了，不可能是Deepseek不行了。</p>



<span id="more-2469"></span>



<p class="wp-block-paragraph">大家为什么会这么期待Deepseek R2呢？现在又有千问3，也有Kimi、Mini Max，还有豆包等，有一大堆的这些模型出来，怎么就只有Deepseek才行呢？其他人为啥都不行呢？其实现在呢，很多新的这些模型已经并不比Deepseek R1的性能差了，基本上是可以替代使用的。但是大家依然在期盼Deepseek R2，而且你只要讲Deepseek要出R2了，就会有流量。这个原因其实很简单，因为我们在跟国外的大模型竞争中打不过了。</p>



<p class="wp-block-paragraph">国外已经进入了10万级芯片的训练时代了。Llama4，40万块H100训练出来的。虽然Llama4翻车了，但那也是10万块。而马斯克XAI的Grok 4，20万块H100训练出来的，效果相当不错。GPT5的话，现在推测也是20万块H100训练出来的。Anthropic的Claude 4，据说呢是40万块H100，但是呢它这个数并不是那么准确，40万块H100呢是一个部署的数量，并不是精确的训练的数量。另外一个没说的是Gemini 2.5。Gemini的2.5是没有公开数据，因为他们家使的TPU，其他人都是使的GPU，所以呢没有办法去比较，但应该也是几十万块H100的一个算力，才有可能训练出Gemini 2.5来。</p>



<p class="wp-block-paragraph">以前是一个国外大模型特别强，特别是GPT4压着所有的模型的时候，我们终于期盼到了Deepseek R1一出来，觉得我们好像又可以了。但是现在我们发现，国内的大模型跟国外这些明显有差距了。我们只能再去期盼Deepseek，因为其他这些肯定是追不上的。那没有20万块H100，这个日子就没法过了。国内的算力芯片呢，大家也都知道不是那么靠谱。这个时候大家期待的就是奇迹了。</p>



<p class="wp-block-paragraph">Deepseek V3、Deepseek R1，他们呢号称使用了2,048块H800，还不是H100。他们这个算力转换，可能也就是1,000多块H100。拿这样的算力就直接训练出来了，大家觉得你们可以用很少的卡训练出来，还可以震惊世界。现在我们还搞不定20万块的H100，是不是依然可以期待Deepseek再创造一次奇迹呢？</p>



<p class="wp-block-paragraph">Meta花了好多钱收入进去的亚历山大王曾经在接受采访的时候说，Deepseek手里头有5万块H100，压根就不是他讲的几千块就给这事搞定的事。而且呢，新加坡3月份还抓了一些向大陆走私英伟达芯片的人，有传闻说这些芯片的采购方里边包括Deepseek。</p>



<p class="wp-block-paragraph">Deepseek呢也正式做出过回应，2025年2月份做了回应。Deepseek强调，仅使用了2023年合法采购的H800芯片，其他我都没用。但是讲完了这个以后，甭管你原来这个东西到底有还是没有，你讲这个话以后肯定就不能再用了吧？所以呢现在大家期待说，这个反正你们原来是这么讲的，我们就这么信了。那以后呢创造奇迹也只能是等着你了。哪怕是使用H20芯片，用很少的芯片训练出来，堪比20万块H100芯片训练结果的这种奇迹，也不是完全不可能吧？这个怎么说呢，人有多大胆，地有多大产吧。我们总还是要有一些希望吧。</p>



<p class="wp-block-paragraph">新的模型没有出来，但是新的论文呢，Deepseek其实一直不断在产生。在V3跟R1之前，Deepseek也没做什么铺垫，这不也就突然蹦出来了吗？他是这样去期待这个Deepseek的。</p>



<p class="wp-block-paragraph">原来讲是8月15号到30号之间要发新版本，最后Deepseek自己出来辟谣说：“对不起，我们发不出来。”英国金融时报出来说，被这个升腾给拖累了。那这消息是怎么传出来的呢？Deepseek原来是有没有说过自己要去发Deepseek R2这件事呢？</p>



<p class="wp-block-paragraph">首先呢，是Deepseek R1震动了世界，应该是在2025年春节前后的时候，我印象里特别深刻。Deepseek R1出来以后，我还连续做了很多天的直播来跟大家讲这个事情。国际大厂呢，在Deepseek R1的这种搅动之下，纷纷转向。转向什么呢？主攻数学、科学与编程，然后呢是长上下文、工具调用和agent，以及指令依从、降低幻觉。</p>



<p class="wp-block-paragraph">数学跟科学这块呢实在太难了，这个咱们不擅长，而且那个你真的是需要可能10万块、20万块卡，你才可以把这事搞定，咱们没有。那编程呢基本可用，国内的这些模型做编程，肯定没有Anthropic的Claude 4好用，但是呢也基本上可以跑。长上下文、工具调用和agent这块呢，包括指令依从这一块呢必须要有，这一块其实国内的大模型基本上已经追上了。剩下的呢降低幻觉这事咱们就不谈了，反正有幻觉还是可以甩锅的事情。全面开源，这个是国内大模型真正卷的地方。千问直接把200多b的模型直接就开源出去了，Deepseek 600多b的模型直接开源出去了。这件事情我们在努力的往前走，所以各有所长吧。基础设施这块、数学科学这部分实在是费劲，大家就期待Deepseek来再创辉煌了，其他人就不管了。</p>



<p class="wp-block-paragraph">Deepseek发R2这件事呢，其实传了两回。一回呢5月份，风起云涌。每一次说Deepseek要出R2的时候呢，都是风起云涌的时候，大家都在上新模型，说呀Deepseek你也得上，所以就会开始给他传这个事儿。</p>



<p class="wp-block-paragraph">今年5月份，发生了一些什么样的事情呢？首先呢Claude 4、Opensource和sonnet这些模型直接出来了，王炸。5月份开谷歌IO，Gemini 2.5 Pro和Gemini 2.5 Flash直接发布，这个其实现在已经是我的主力模型了。GPT呢当时倒是没有什么特别大的动作，上了一个Deepseek 4.5，但是呢也没有引起特别多的响动。大家就说Deepseek你们也该来了。但其实呢Deepseek没有去出R2，而是把Deepseek R1的模型稍微的小步更新了一点点。</p>



<p class="wp-block-paragraph">6月26日，the information就做了一个报道，说Deepseek R2原来计划是5月份发布的，但是呢因为梁文峰对于Deepseek R2表现的性能不是很满意，决定推迟了。路透社呢也引用了the information的这个报道，国内的媒体呢也纷纷去引用。但是这件事呢，并没有得到Deepseek官方的回应。Deepseek这个公司就是这样，他基本上不怎么回应大家的这个响动。你们猜吧，猜完了以后我也不理你，除非是有一些太过分的，否则他一般不说什么。</p>



<p class="wp-block-paragraph">Deepseek呢也不是说没更新，就是做小版本更新。像Deepseek V3出了0324版，也就是2025年3月24号出了一个版，把分数又往上刷了刷。因为每一次去更新这些模型，一定要刷分数上去。代码能力，特别是前端代码能力呢，有所提升。拿这玩意写个网页没什么问题，但你说我要做一些大的架构，或者做一些这种后端的东西，可能就要稍微费劲一点。做算法的东西要费劲一点。为什么？因为它Deepseek有一个问题，就是它的上下文比较短，想去做一些大的架构上的东西，你必须上下文长，你得能把整个代码塞进去才行，这块还是要费点劲的。然后他把中文写作能力做了一些提升，Deepseek其实一直在努力的方向，就是中文推理。因为在海外的这些模型，很多都是使用英文推理，然后再翻译成中文的。他说我们直接用中文推理这个事，是不是OK？他们一直在努力干这件事情。使用体验上呢也有所提升，特别是function call更加准确了。在做AI agent的时候，其实核心就是function call的能力，就是我们先描述一堆的功能，然后交给大模型，大模型在完成整个的语言生成的过程中呢，去根据你描述进来的这些function，去决定我要调哪个、不调哪个，或者如何去调用、什么时候调用。Deepseek V3 0324呢，就在这一块做了一些增强。</p>



<p class="wp-block-paragraph">Deepseek的R1呢，其实也更新了一个版本，就是0528。大家在传说Deepseek要出R2，讲的其实就是0528的这个版本。而这个版本呢，其把这个分又往前刷了刷，减少生成的一些错误信息。因为Deepseek最大的让大家无法忍受的东西是什么呢？就是胡编乱造，他太喜欢瞎编了。所以在这一块呢，稍微做了一些调整，但是依然胡编乱造的很厉害。Deepseek 210528呢，还支持了Json输出和function coding，提升了调用的准确度，但是呢不能叫R2。这就是5月28号的这个版本。</p>



<p class="wp-block-paragraph">紧跟着就开始传说了，说8月15号到8月30号，要准备发布Deepseek R2了。这个消息是怎么来的呢？首先肯定还是要风起云涌一下。8月份发生了些什么事情呢？马斯克XAI的GROK4发布了，Anthropic又发布了Claude 4.1 Opensource，OpenAI发布了GPT5。GPT5这东西到底好不好使，大家各自去领会。大家可以认为说，GPT5是一个划时代的产品，但是也可以认为说，GPT5就是山姆奥特曼为了要去忽悠融资去搞的一个事情。因为GPT5出来以后，OpenAI的估值已经正式从3,000亿美金提升到5,000亿美金了，而且是孙正义要去买这个单，说您这5,000亿美金我认了，我去买去。</p>



<p class="wp-block-paragraph">所以呢8月份风起云涌了。那么空穴来风呢，你这事怪不得别人。在Reddit上有人发了个帖子，这个帖子特别有意思，他说他去问了Deepseek R1：“Deepseek R2什么时候发布？”他等于是把这个东西交给Deepseek R1了。但是大家注意，Deepseek R1这个大模型呢，它并不代表Deepseek这公司的一些官方的观点，只是说这个模型给你生成了这样的一个结果。Deepseek R1回答了：“8月15号到8月30号之间发布。”而且号称呢是引用了雪球和东方财富等可信的信源，而且进行了多个渠道的证实。</p>



<p class="wp-block-paragraph">Deepseek R1的幻觉其实一直都是很严重的，虽然经过0528的调整以后，但依然很吓人。而且Deepseek R1的最大幻觉是什么？就是编造可信的信源。说我从哪哪引用了，你点进去以后，压根就没有这篇文章。但是甭管怎么说，这个文章就在Reddit上就贴出来了，随后呢这个消息就逐渐的被传播和放大了。国内的很多的媒体、自媒体就开始引用这篇消息，特别呢是华为下边的一些科技媒体进行了转载。而且呢在标题里边还夹带了私货，讲的是什么呢？讲的是深度求索，就是Deepseek这个公司，“升腾芯片版本Deepseek R2预计在本月发布”。它讲的就是说，它是使用升腾芯片来去做训练的。</p>



<p class="wp-block-paragraph">华为都说了，两大国运级产品强强联合了，那信吧，这事怎么办呢？国内一帮的媒体就冲上去说：“我们信了，确实是有这事了。”到8月14号，英国的金融时报出来报道，说升腾芯片拖累了Deepseek 2。然后动点科技、腾讯科技就出来辟谣，原引自公司内部人士，也就是Deepseek这公司里边的人说了，说8月份不会发布Deepseek R2。所以呢，8月15号到30号之间发布Deepseek R2的一个消息，实际上是Deepseek R1自己编出来的，其他人把这个编的信息信了，直接截了个图发到这个Reddit上，以此来发酵出来的一个过程。</p>



<p class="wp-block-paragraph">那么Deepseek R2到底遇到了一些什么样的问题呢？首先升腾芯片确实是有问题的。升腾910C的这个芯片，虽然单芯片的算力在部分指标上呢，已经达到了H100的水平，但是呢显存的带宽不够，想从显存里调数据回来，速度是没有H100快的。而且最大的问题是什么？就是多个芯片之间的速度，就是我需要把数据在多个芯片之间进行流通的时候，这个速度是相对来说比较差的，而且差的很远。你要想去做同样的训练的话，你就需要更多的时间全功率的去运转。因为你想，人家都已经达到20万块H100这样的集群的规模再去训练新的模型了，你没准就是需要这个50万块或者60万块升腾910C串在一起，才能达到人家那个算力，而且你需要很长的时间去连续的运作，这个对于升腾910C的这种考验来说就比较大了。</p>



<p class="wp-block-paragraph">这样的芯片，其实是没有办法长时间稳定地去运行的。并不是说训练一个模型，这头输入进去数据，过三个月去开盖看结果。中间每过一段时间，可以取得阶段性成果，再继续往下训练。但是中间这个过程呢，你是不能停的。你中间比如说准备了一批数据，你去训练了，如果这批数据没有训练完，升腾910C就直接冒烟了，就不干活了，这一波呢就白干了，你必须要从这个节点接着往后干。这个玩意有点像什么？有点像打怪升级，你一定要打死这个妖怪才能存盘，你没打死这个妖怪就不让你存盘。升腾910C在这块差一点。</p>



<p class="wp-block-paragraph">那为什么差呢？升腾910C呢，是两个910B堆叠在一起的，散热肯定会出问题。就算是上了液冷以后，依然是搞不定这个事情。</p>



<p class="wp-block-paragraph">其实同样的坑，英伟达也踩过。大家还记得H100独挑大梁好久了吗？很多人应该还是有印象的。甚至呢到现在为止，H100已经成为一种计量单位了。现在我们再去算说：“你这个算力相当于多少英伟达芯片呀？”我们都是以H100的这个算力作为一个计量单位的。就是因为H100挺长时间在那孤独一只。为什么它会孤独一只呢？本来计划替代H100的这个产品叫B100，叫Blackwell黑井100，这个芯片直接就跳票了。研究完了以后开了发布会，开完了以后，这个芯片压根就没有大规模的部署，也没有交付。为什么呢？就是他做的就是这种堆叠技术，导致散热失败。散热失败了以后会直接把版卡烧掉，这压根就没有办法去交付。到H200出来了以后说：“那这咱交付这个呗。”但是一开始依然是受困于散热问题，导致了大规模交付的延迟，一直到今年才开始去交付H200。</p>



<p class="wp-block-paragraph">后面的工艺呢不断的进步，再加上全面液冷。H100这些机器是可以进行风冷的，你拿风扇吹它是OK的。但是到H200这个机器开始交付的时候，你必须是液冷。而且这种液冷呢，还不是种普通的液冷，叫完全浸泡式液冷。见过这种游戏主机装机视频的这些人，会知道他们那个液冷是怎么做的。他在芯片外面给你涂散热的胶，然后呢把这个液冷管贴上去，靠这个液体呢快速的把你热量带走到外边，再去找风扇把这个水给你吹凉了，再重新循环，它是这样来工作的。但是这种工作方式对于H200来说还是不行的，它必须是全浸泡式的，就是把整个的H200的芯片，或者包括它整个的板卡，一起泡在这个液体里头。这就肯定不是水了嘛，是一些不导电的水，整个泡在里头，才能够达到散热的这个能力。</p>



<p class="wp-block-paragraph">当然了，甭管是英伟达也好，还是升腾也好，散热都是有问题的，导致什么呢？就是液冷概念股都涨疯了。你只要说我这公司是做液冷的，就赶快涨。而且现在都是浸没式液冷，就把整个板卡都泡里头。A股上强瑞科技、英维克、深林环境、飞龙股份，大概有十来家公司，都是专门做液冷的。飞龙股份是专门给升腾这个384超节点做液冷的。美股那边的话，有一个叫VERTIV的一个公司，它的代码是VRT，是专门给英伟达做液冷的公司，这个公司的股票也是涨的可好了。</p>



<p class="wp-block-paragraph">讲回来，910C这个芯片连续的做长时间训练的话，液冷也压不住，直接把板卡烧掉。即使是有大量的华为的工程师坐在Deepseek公司里头，出来我帮你调，他也调不过去。实际上这些华为工程师能调什么呢？他们只能调一件事，就是CUDA里头没有实现的部分，我来帮你去实现一下。华为的这个升腾910C，他们使用的训练相关的代码的话，是华为自己开源的一套训练框架。这套框架据说是可以实现CUDA 70%的功能，但是还有30%你是实现不了的。那这一部分由华为的工程师到现场来搞定。再怎么搞，该冒烟、该着火、机器直接停摆，这个事它是解决不了这问题的。</p>



<p class="wp-block-paragraph">另外一个传闻，DEEPSEEK R2出不来的原因是什么呢？是数据标注的质量跟速度不过关。这个呢也没有得到官方的证实，也是坊间在流传。因为在中国嘛，很多的数据肯定还是需要去审核一下的，这个审核的过程是相对来说比较麻烦的。</p>



<p class="wp-block-paragraph">而且Deepseek呢，其实一直也是一个比较低调的公司。提前预热，不停的出来吹牛，这件事呢是容易翻车的。山姆奥特曼每次出来讲GPT5，说：“我太震惊了，我从来没见过这么棒的。”等GPT5发布的时候，大家说：“这就能让你震惊了？您到底是眼皮子有多浅？”马斯克在发布GROK4之前，也在说：“这是我所见过的最聪明的大模型。”也有人认为老马吹的有点过头了。</p>



<p class="wp-block-paragraph">其他的公司都必须不断的发模型，跟着一起卷，不断的来吹牛，这个事是有原因的。为什么？因为这些公司是需要融资的。马斯克发GROK4发完了以后，马上就给XAI去融资。山姆奥特曼GPT5发完了马上融资，这公司直接值到5,000亿美金了，他现在已经是没有上市公司里头最贵的一家了。第二家应该是SpaceX，再往后是3,000多亿的字节跳动。但是大家注意，字节跳动的收入现在好像已经超过Meta了，这个是非常吓人的一个事情。所以这些人他有融资的需求，你就必须得不断的出来炒这个热点。不炒的话，你说我现在想提高估值，融资这事费劲了。而且现在Anthropic也在融资，而且是要按照1,500亿美金的估值要去融资，我估计他们后边的日子不是那么好过，现在他们的CEO应该已经奔中东，找中东土豪去给钱去了。</p>



<p class="wp-block-paragraph">谷歌呢虽然不需要融资，但它后边有股市、有股价、有市值这些东西，所以呢不能落后，所以谷歌也必须要不停的推陈出新。实在做不出来东西呢，确实哪块也做的不太行，怎么办呢？你还可以像扎克伯格那样，表演抢人大戏这种行为艺术。我发2亿美金的薪水，我把人抢回来。虽然你的Llama4像屎一样，Llama再往后怎么走谁也不知道，但是看到你表演行为艺术表演的这么热闹的话，Meta的股价涨的也还可以。所以大家必须不停地去表演。</p>



<p class="wp-block-paragraph">但Deepseek自己，他没有这种融资的需求，所以呢也并不太需要出来表演，自己踏踏实实做自己的事就好了。至于说他到底做成什么样，咱们也只能在外边来看。</p>



<p class="wp-block-paragraph">大家有没有想过这样的一个问题：到底是谁家的芯片能够训练大模型呢？训练跟推理是完全两个不同的概念。训练你是必须要长时间高强度的工作，而且在中间是不允许停的。而且在训练的过程中，我们需要在更多的芯片之间进行数据的调度，更更大规模的这种协同。国内的这些算力服务器都搞不定这件事情，他没有办法说让这么多的芯片相互之间进行协调的情况下，这么长时间稳定的工作下去。推理的话相对来说要简单一些，可能只要几个芯片读出很少的数据来，他就可以把这事干完。比如说我们去提了一个问题，他给我们过了几秒钟做了一个反馈，反馈完了以后呢，他就可以再给我们分配其他芯片了。在这个过程中，芯片出现任何的问题，过热了或者说你对资源进行切换了，它是不影响的。所以呢推理咱们国内的这套系统是可以的，但是训练搞不定。</p>



<p class="wp-block-paragraph">那么到底谁家的芯片可以做训练？英伟达这个必然是可以的。除了英伟达之外，还有哪些芯片可以进行大规模的这种模型训练呢？你说我这个芯片训练了一个10B的、20B的模型，这不算。或者说你说我这个虽然能够训练，但是我训练的模型从来没有人用过，这个也不算。现在唯一证实了可以进行大规模训练的，而且是训练这种大模型的，还被大家普遍接受和使用的，猜猜是谁？</p>



<p class="wp-block-paragraph">很多人可能会猜是不是AMD？AMD MI300，或者现在应该是MI三百零几了吧，这样的一个芯片。不是他们。现在唯一的一个能干这个活的人，是谷歌的TPU。Gemini大模型是在上面训练出来的，Anthropic的Claude模型有部分声称是在TPU上训练的。除了英伟达之外就是他们了，再没有第二家了。</p>



<p class="wp-block-paragraph">那老牌厂商像AMD、英特尔，号称我这个芯片是可以进行大规模的模型训练的，也给出了一些用他们的芯片训练大模型的实例，甚至呢还训练了一些不太流行的小模型拿出来去开源，但是他们训练出来的模型也没人用。AMD跟英特尔呢，一般大概也就是10B或者20B以内的这些小模型。另外一个呢就是富士通，富士通用一款ARM的CPU呢，也训练过一点可能也是10B以内的这种小模型吧，也没有听说过谁去用他们。</p>



<p class="wp-block-paragraph">其他的一些ASIC芯片呢，也是号称自己能做。所谓ASIC芯片呢叫专用集成电路，像升腾、谷歌TPU呢都属于ASIC。亚马逊、阿里、百度呢，也都号称可以进行训练，但是呢没有实例。亚马逊号称是我拿自己的ASIC芯片呢，做了一些训练，也有几个模型，但是呢谁都没用过。OpenAI的模型，有些据说是在亚马逊上进行训练，但这个事呢，也没有得到最终的证实。百度呢是号称自己设计的ASIC芯片可以去进行训练，但是反正百度自己家的模型烂的跟屎一样，我们就不去评论了。</p>



<p class="wp-block-paragraph">至于华为的升腾芯片呢，科大讯飞号称是在上面训练的。但是呢也有朋友跟我讲说，科大讯飞其实是在英伟达上训练出来的，只是呢对外宣称是在升腾上训练的，这个我们就不去做考证了。只是科大讯飞的模型，其实也没有那么普遍，除了一些教育领域里头有些人会去用，其他的让你自由选择的时候，很少有人会去选择用科大讯飞的模型。华为呢自己号称是在升腾模型上训练了盘古大模型，但是呢前面被内部的人指责蒸馏、指责抄袭，之后就不再有任何声音了。所以现在华为已经不再提他的盘古大模型这事了，估计是准备装一段时间的死狗以后，再次遥遥领先。所以华为的升腾模型，其实没有证实过训练成功过任何的大模型。Deepseek R2呢，应该是真的尝试过，但是败下阵来。</p>



<p class="wp-block-paragraph">华为跟Deepseek官方呢，都没有出来证实，就既没有出来说我用了，也没有出来说我没用。所以呢升腾芯片，没有成功的训练出过任何一款大家普遍使用的模型。</p>



<p class="wp-block-paragraph">那么国内的算力芯片是怎么样去竞争的呢？英伟达大概占54%，就一半多。升腾呢占28%，其实已经占的非常非常多了。像寒武纪等等其他的一些芯片公司的，所有的加在一起，可能还加上AMD的吧，一共占18%。这个大就是国内整个的算力芯片的一个分布情况。</p>



<p class="wp-block-paragraph">国产的芯片呢，目前来看都是可以去做推理了，但是呢没有哪一个真的跑出来模型过。所以国内的算力芯片，基本上是没有办法做训练的。</p>



<p class="wp-block-paragraph">现在呢还有一群的“赢学家”在鼓吹英伟达芯片里头有追踪器。但是这些“赢学家”呢，现在有点吹不下去了。他说呀：“这个英伟达的芯片里头，是不是在集装箱里装追踪器了？”还有人说：“是不是在包装箱里装追踪器了？”或者是说：“在服务器里边装追踪器了？”因为他们也知道，在这个芯片里头是装不上的。还有人说：“H20这里头肯定没有追踪器，但是呢H100、B200这个里头有追踪器。”这个呢都想多了。因为中国人是经历过挖矿的，我们是完完全全可以把芯片整个扒下来，重新拿新的版卡去焊。而且大量的，其实做英伟达版卡的公司就在国内，所以我们完全可以拿他的版卡，自己回来去加工这个事情。装追踪器这个事是没用的。</p>



<p class="wp-block-paragraph">中国官方对于H20的态度呢，也很暧昧。有人就到外交部的新闻发布会上就问：“说你们是不是要准备禁售H20？”外交部的新闻发言人回答是：“没听说过这件事情。”中国的这些官员回答，一般都不会说是或者不是，通常回答是：“请你看以前的表态”，或者“请你看有关部门的表态”，或者说“我不知道”、“没有听说过”。所以他这一次的回答叫“没听说过”。</p>



<p class="wp-block-paragraph">中国政府呢，也没有明令禁止说我们去销售H20或者谁去买这东西。但是呢潜规则就是这样去运营的。多家媒体，比如说Bloomberg、Marketwatch就做了些报道，说中国的监管部门针对H20芯片表达了强烈的不信任和谨慎态度，尤其是强调相关芯片可能存在后门的风险和数据隐患，建议企业回避在政府或敏感用途使用H20。所以呢这些H20可能最后去做训练就完了，推理的这块就通通交给国内的升腾384超节点就OK了。</p>



<p class="wp-block-paragraph">还有报道说字节跳动、腾讯、百度等企业被召集，这些人是准备去买H20的。国内的有关部门把你们都召集一块说：“你们为什么要买这东西？买多少？”给他们开这样的会。监管侧重国家安全与网络安全审查，并未提出商业禁令，就是我们还是让你买，但是你买之前呢，我们得把你拎来稍微恶心恶心。所以现在都约谈过了。</p>



<p class="wp-block-paragraph">总结一下吧。Deepseek R2呢确实是难产了，肯定的没有出来。国内的算力芯片目前呢，也无法进行大规模的模型训练，可以进行推理这个事没问题了，但是训练搞不定。20万块H100量级以上的大模型训练，国内很难突破。如果20万块串在一块可以训练大模型的话，我们可能至少需要40万块或者50万块，比如像升腾910C这样的芯片凑在一起，而且我们所需要消耗的电和时间，可能都是要呈几何级数上升的。因为我们卡之间的联通的速度是相对来说比较慢的。所以比如说H100，它也不是说一直就不坏，它可能工作个20个小时或者是40个小时都会坏一次，会出现问题，对于老外来说就可以去接受了。对于我们来说呢，我们可能要求要连续坚持500个小时不出问题，才能够回收回来数据了，因为算的慢嘛，真的达不到。大概就是这样的一个情况。</p>



<p class="wp-block-paragraph">国内算力卡的这些供应商呢，很有可能会阻碍中国大模型的进展和训练。为什么呢？自己做不好，你又不让别人买H20，可能中国的大模型再往下一步走，就会变得非常非常困难了。</p>



<p class="wp-block-paragraph">未来国内算力卡是不是可以训练大模型呢？反正一两年之内呢稍微有一些困难吧。国内的大模型到底能不能用呢？基本还是能跑的。高深的数学、科研研究、物理学或者这些基础学科，我们不去研究了。就是让你去做一些信息整理，现在国内大模型基本上都是可以用的。</p>



<p class="wp-block-paragraph">还是稍微耐心地等待一下Deepseek的慢慢发展吧，它反正中间只要不需要融资，它也不需要出来吆喝，万一有惊喜呢？这个也不好说。这就是我们今天要讲的故事。</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
