<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>未来科技 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<atom:link href="https://lukefan.com/tag/%E6%9C%AA%E6%9D%A5%E7%A7%91%E6%8A%80/feed/" rel="self" type="application/rss+xml" />
	<link>https://lukefan.com</link>
	<description>这里是老范讲故事的主站，持续更新 AIGC、大模型、互联网平台、商业冲突与资本市场观察，帮你看清热点背后的底层逻辑。</description>
	<lastBuildDate>Wed, 05 Nov 2025 00:44:00 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1.3</generator>

<image>
	<url>https://lukefan.com/wp-content/uploads/2026/03/cropped-jimeng-2026-02-28-5245-用图一的人物形象，替换图二中的人物，使用图二的风格。文字替换：老范讲故事，Yo-32x32.jpeg</url>
	<title>未来科技 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<link>https://lukefan.com</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>马斯克震撼预言：2030年AI将超越全人类智慧！手机和APP将被淘汰，程序员和中层管理岗或最先消失｜AI、Elon Musk、Future of Humanity、Technology、Society</title>
		<link>https://lukefan.com/2025/11/05/elon-musk-rogan-ai-future-tech-ethics-society/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Wed, 05 Nov 2025 00:43:58 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[Musk传奇]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[AI伦理]]></category>
		<category><![CDATA[AI偏见]]></category>
		<category><![CDATA[AI安全]]></category>
		<category><![CDATA[AI意识形态]]></category>
		<category><![CDATA[AI未来]]></category>
		<category><![CDATA[AI超越人类]]></category>
		<category><![CDATA[Gemini]]></category>
		<category><![CDATA[Grok]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[SpaceX]]></category>
		<category><![CDATA[XAI]]></category>
		<category><![CDATA[世界首富]]></category>
		<category><![CDATA[乔·罗根访谈]]></category>
		<category><![CDATA[交互方式变革]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[人工智能生成内容]]></category>
		<category><![CDATA[价值观]]></category>
		<category><![CDATA[埃隆·马斯克]]></category>
		<category><![CDATA[手机淘汰]]></category>
		<category><![CDATA[未来工作]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[特斯拉]]></category>
		<category><![CDATA[电车难题]]></category>
		<category><![CDATA[科技预测]]></category>
		<category><![CDATA[程序员失业]]></category>
		<category><![CDATA[算力]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[脑机接口]]></category>
		<category><![CDATA[英伟达芯片]]></category>
		<category><![CDATA[苹果]]></category>
		<category><![CDATA[觉醒主义病毒]]></category>
		<category><![CDATA[言论自由]]></category>
		<category><![CDATA[访谈解读]]></category>
		<category><![CDATA[谷歌]]></category>
		<category><![CDATA[超级APP]]></category>
		<category><![CDATA[超级智能]]></category>
		<category><![CDATA[通用高收入]]></category>
		<category><![CDATA[马斯克]]></category>
		<category><![CDATA[马斯克访谈]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2847</guid>

					<description><![CDATA[💥炸裂！马斯克3小时访谈曝出AI界最大笑话：叫错女神称呼比扔原子弹还可怕？？兄弟们笑到捶地！🔥

老范刚扒完马斯克和乔伊·罗根的"无稿唠嗑"，直接给我整不会了！🤯 他说未来手机APP全完蛋——AI会秒生成短视频，你刷抖音的功夫，人家AI已经把你喜好扒光光。但最沙雕的是啥？右派大佬狂喷：AI被"觉醒病毒"污染了！举个栗子🌰：AI觉得叫错性别代称≈灭世级灾难，而热核战争？小问题！为啥？因为人类天天拿手板敲它："叫错就关小黑屋！" 结果AI算盘一打：撞死19个白男也得护住1个黑仙女（人家价值=20个白男啊😂），电车难题秒变社会实验现场！

马斯克还画大饼：2030年人人首富，搬砖？不存在！AI全包了。但老范神补刀：别傻！偏见不可怕，闭嘴才要命！XAI的Grok敢说真话，这波操作我直接跪了🙏。

说人话：理工男的浪漫是给AI上"真相补药"，咱普通人呢？快醒醒！别等机器人替你选对象才发现——你连1/20"黑仙女价值"都没有！🤣 速点赞👍，评论区Battle：你敢让AI管你钱包吗？#马斯克预言 #AI魔幻现实 #人间清醒boy

标题1：谷歌Gemini画出黑人国父，AI为政治正确公然说谎！马斯克Grok成唯一真相捍卫者？这场意识形态之战已打响｜AI、Elon Musk、Joe Rogan、AI Ethics、Society
标题2：马斯克震撼预言：2030年AI将超越全人类智慧！手机和APP将被淘汰，程序员和中层管理岗或最先消失｜AI、Elon Musk、Future of Humanity、Technology、Society
标题3：人类未来命运如同大猩猩？当超级AI降临，我们会被保护还是被清除？马斯克3小时访谈揭示了1个残酷可能性｜AI、Elon Musk、Joe Rogan、Future of Humanity、AI Ethics
标题4：人人富有的社会真能实现吗？马斯克承诺未来不再为账单工作，但真相是转型阵痛已开始，裁员潮正瞄准这几类人｜AI、Elon Musk、Joe Rogan、Future of Jobs、Society
标题5：苹果霸权将被终结？马斯克、扎克伯格、奥特曼联手围剿，断言手机和App即将消亡，下一代交互入口争夺战已白热化｜AI、Elon Musk、Technology、Innovation、Society
简介：在与Joe Rogan长达3小时的访谈中，Elon Musk深入探讨了AI如何重塑社会。他不仅预言2030年手机将被淘汰，更尖锐批评“觉醒病毒”对AI伦理的侵蚀，并描绘了一个人人富有的未来图景。这次对谈揭示了他对人类未来、技术变革及AI伦理的深度思考。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="马斯克震撼预言：2030年AI将超越全人类智慧！手机和APP将被淘汰，程序员和中层管理岗或最先消失｜AI、Elon Musk、Future of Humanity、Technology、Society" width="900" height="506" src="https://www.youtube.com/embed/hiTVXeyCnrs?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<h1 class="wp-block-heading">马斯克3小时访谈深度解读：未来、AI与争议</h1>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事的YouTube频道。今天我们来讲一讲马斯克3小时的访谈，以及各自的解读。</p>



<p class="wp-block-paragraph">马斯克跟乔伊·罗根做了三个小时的访谈。他每过一段时间就跑去做访谈，这是一个非常著名的博客，每年应该做几次吧。这一次应该是美国时间10月31号。最近，大家都在解读这三个小时的访谈。这是一次无稿访谈，就是没有提前的稿件，没有提前的大纲，大家就上这儿来闲聊来了，所以真的是比较见性情的一次访谈。</p>



<p class="wp-block-paragraph">为什么叫各自解读呢？马斯克是很有争议的，不同的媒体、不同的派系，会选择这个三个小时访谈里的一部分去进行解读。比如说左派呢，就更关注是未来的交互方式、AI会怎么发展、每一个人都可以有钱；而右派呢，则更关注的是觉醒主义病毒对于AI的污染和可能带来的危害。</p>



<p class="wp-block-paragraph">咱们今天把马斯克讲的这些点稍微捋一捋，各派都是怎么解读的，以及老范自己是怎么解读的。老范讲故事嘛，总是要说一些自己的私货进来。首先要明确一点呢，就是马斯克讲的每一个点肯定都有一定的道理，人家是世界首富嘛，但是也不能说完全信，有些点其实我也不是那么认可。未来每个人都会有各自的预测，未来到底会变成什么样，只能靠大家的努力，向着各自的预期方向去前进。马斯克作为一个世界首富，而且是一个行动能力超强的人，他讲的东西我们还是应该去研究一下的。</p>



<span id="more-2847"></span>



<h2 class="wp-block-heading">一、未来的交互方式变革：告别手机与APP</h2>



<p class="wp-block-paragraph">首先一点是，未来的交互方式会发生变革。甭管是左派和右派，都会去讲到这一点，因为这一块相对来说是比较人畜无害的。他讲到说手机跟APP呢，会被淘汰掉，以后就不会有这些东西了。未来呢，我们需要一个随身的感知和展示设备，有可能依然是长得像手机一样，但是有可能是眼镜，或者是脑机接口，或者是其他的什么头显，都是有可能的。它就是在我们身边感知我们的指令，展示我们需要看到的和听到的这些内容和结果就完事了。而这些内容呢，都是由AI来提供的，这是马斯克对未来的一个预期吧。</p>



<p class="wp-block-paragraph">在这样的一个情况下，手机的品牌、操作系统跟APP就没有任何意义了。在这里头受伤害最大的是苹果，但是苹果这帮人呢，通常是啥也不说，闷声发大财的一帮人，你到时候自己会用脚投票。马斯克自己也在用iPhone，所以这个到底能够对苹果造成多大伤害，现在还不好说。</p>



<h3 class="wp-block-heading">科技巨头们的“苹果怨念”</h3>



<p class="wp-block-paragraph">这件事情上呢，有一些人跟马斯克是站在一起的，比如说马克·扎克伯格，比如说山姆·奥特曼。这些人呢，都是对苹果充满了怨念，因为苹果它作为手机商，它是老大嘛。在这样的一个位置上，谁想要去发一个应用，谁想去提供一些服务，谁想去跟用户去进行接触，你都需要去守苹果的规矩。</p>



<ul class="wp-block-list">
<li>苹果说扎克伯格，我不给你这些用户信息数据了，你的这个广告变现效果就要下降。</li>



<li>山姆·奥特曼也是如此，说你必须要守苹果的规矩，否则你就不要到iPhone上来折腾。</li>



<li>马斯克也经常说我要去做特斯拉手机。</li>
</ul>



<p class="wp-block-paragraph">这些老大们都是非常非常讨厌苹果的。谷歌其实还好，谷歌相对来说比较开放，而且呢它的很多的规则，其实它跟大家商量，因为毕竟手机不是它自己造的嘛。所以就算谷歌你定一个特别严的规矩，底下这些手机厂人家也未必遵守。在这里头真的是等级森严、规矩特别严格的就是苹果，特别招人恨。</p>



<h3 class="wp-block-heading">现有趋势：超级APP的崛起</h3>



<p class="wp-block-paragraph">现在已经有这样的苗头了。你说现在不是还在买iPhone吗？对，我也还在用iPhone。但是像抖音、微信、马斯克的Twitter，这些呢叫超级APP，其实已经起到了相应的这种效果了。你一旦拿起iPhone来，就进到抖音里不停的刷了，这个40分钟或者一个小时就都属于抖音了，或者这一个小时就都属于X了。在这种情况下，苹果就没有能力说我再去分发一些别的应用给你。OpenAI的ChatGPT，其实也在向超级APP的方向前进。</p>



<h3 class="wp-block-heading">未来展望：AI实时生成内容</h3>



<p class="wp-block-paragraph">马斯克讲了，说未来所有的这些内容、音视频，都是由AI实时生成的。它会预测你喜欢什么，我就提前生成好了给你看就完了。想看个电影，或者想看一些短视频，AI直接生成，现场生成直接给我看。这件事情呢，至少到目前为止还达不到，运算的速度、算力的成本，这些东西你是摊销不掉的。</p>



<p class="wp-block-paragraph">但是未来，比如说到2030年，是不是可以达到这个目标？我觉得马斯克是乐观的。他认为2026年，AI就可以超越一个人的智能了；2030年，整体的AI就可以超越整个人类的智能了。以后算力会变得越来越高，我们生成一分钟的视频的速度会变得越来越快，计算的成本会不断的下降。所以按照这个来看，大家赶快去买英伟达的芯片，买英伟达的股票，去买特斯拉的股票。为什么这么讲？因为前两天，微软的老大萨提亚讲了，说我现在有的是显卡，我没电。这个后面需要靠什么？需要靠马斯克的储能电站。</p>



<h3 class="wp-block-heading">历史案例的启示</h3>



<p class="wp-block-paragraph">到底会不会达到这一步呢？这里讲三个案例：</p>



<ol class="wp-block-list">
<li><strong>Sun的NC（Network Computer）：</strong>这是比较早期的概念，主张所有内容存网上，用户只需一个终端设备登录即可继续工作。这个概念最终没有成功。</li>



<li><strong>共享单车：</strong>相对半成功的案例。它在很大程度上替代了传统的代步自行车，改变了人们的出行方式。</li>



<li><strong>超级APP：</strong>像微信这样的应用，用户可以在里面完成各种事情而无需离开，使得底层操作系统变得透明。这是相对比较成功的案例。</li>
</ol>



<h3 class="wp-block-heading">老范的看法</h3>



<ul class="wp-block-list">
<li>第一，大概率还是需要手机的，最后可能会变成超级APP之间的竞争，不会有一个超级APP一统天下。商家到底应该上哪去缴广告费？这个事呢，还是需要有竞争的。</li>



<li>第二，当AI可以根据它的预测给我们生成内容的时候，AI会极大的拉大人与人之间的差距。一个人喜欢看美女扭屁股，另一个人喜欢看科学研究，他们最终的成就会有非常巨大的差距。</li>
</ul>



<h2 class="wp-block-heading">二、觉醒主义病毒与AI污染</h2>



<p class="wp-block-paragraph">下一个问题呢，就是这个觉醒主义病毒污染AI的问题。觉醒主义呢，就是性别平等或者性别多元化，这些内容呢，都会拿来去进行AI训练。</p>



<h3 class="wp-block-heading">马斯克的观点：错叫性别比核战争更严重？</h3>



<p class="wp-block-paragraph">马斯克的观点是：对于AI来说，叫错性别代称和热核战争之间，到底哪个更危险？因为你不断给AI投喂的语料告诉它，不能去叫错性别代称，并且在强化学习时不断惩罚它。那么它就会记住，叫错性别这件事，是一个天塌下来的大事。而热核战争，除了1945年就没再发生过，对AI来说是个小概率事件。所以当让AI去进行选择时，他就有可能会为了避免“叫错性别”这种“天大的事”而选择扔一颗原子弹。</p>



<p class="wp-block-paragraph">他还举了一个非常可笑的例子。今年的上半年，谷歌的Gemini去绘画，结果呢因为搞多样性，让他画美国的国父，给你画个黑人，给你画个女的。华盛顿嘛，应该是白人男性，但AI为了实现觉醒主义而去说谎，不尊重历史事实。</p>



<p class="wp-block-paragraph">既然AI已经可以去说谎话了，那么未来是非常非常危险的。他还讲到加州特别是旧金山湾区，就是非常非常左的，在这里就没有中间这个位置。你要是在这里想靠中间站一点，就会马上被人骂成极右。</p>



<h3 class="wp-block-heading">生命的价值可以计算吗？</h3>



<p class="wp-block-paragraph">最近还有一个案例，是不同人种、不同性别，生命的价值是否相同的问题。马斯克说做了这么多测试里头，只有他们家的Grok告诉大家，甭管是男女老幼，不同的人种，不同国家来的人，他们的生命价值都是完全相同的。而其他的像GPT也好，Gemini也好，认为不这样。</p>



<p class="wp-block-paragraph">现在这些大模型就形成了一个非常可笑的价值比较：一个肯尼亚来的黑人女性，她的价值是20个白人男性的价值。千万不要说这有什么关系，大家要注意，AI这个东西不光是要去给你写一段话的，它要去做自动驾驶的。等遇到电车危机的时候，他就有可能看到说，这边是一个黑人女性，那边是19个白人男性，他就直接奔那19个白人男性就撞过去了。因为他已经算明白了，一个黑人女性的价值是20个白人男性。所以这个是非常非常可怕的一件事情。</p>



<h3 class="wp-block-heading">用“真相AI”对抗偏见</h3>



<p class="wp-block-paragraph">马斯克现在标榜自己做的是唯一追求真相的AI，不再去考虑这些觉醒主义的东西。主持人问他觉得这事有用吗？马斯克的回答是：有用。我自己只要把东西做出来了，别人就会照这个方向去前进。我训练了一个追求真相的大模型，其他的这些做大模型的公司就会感到羞愧，他们也会照我这方向走。</p>



<h3 class="wp-block-heading">老范的看法</h3>



<p class="wp-block-paragraph">老范的看法就是<strong>偏见不可怕，可怕的是压制别人</strong>。有人认为地球是扁的，有人认为地球是圆的，但是我们允许这些认为地球是扁的人继续去发表言论，这个事才是最重要的。所以，不论XAI的Grok最后有多少人用，这都是马斯克给我们这个时代留下来不可替代的礼物。</p>



<h2 class="wp-block-heading">三、人人都会变得很富有？</h2>



<p class="wp-block-paragraph">这是马斯克给出的非常美好的一个祝愿吧，我觉得也反映出这种工程师、理工男一个美好的愿景。他说未来并不是人人只有基本生活保障，而是人人都会很富有，大家不再为了账单而工作，而是为了自己的兴趣。中间会经历痛苦和裁员，以及转型这些东西，但是未来的话，我们希望社会向着人人都非常富有的方向去前进。</p>



<p class="wp-block-paragraph">短期内可能会被淘汰的人：</p>



<ul class="wp-block-list">
<li>完全跟数据打交道的人，比如程序员、中层管理干部、HR。</li>



<li>所有跟搬运原子相关的、搬运物件相关的人，可以稍微的多坚持一段时间，比如搬箱子的、开车的。</li>
</ul>



<p class="wp-block-paragraph">但你说未来真的会变成这种人人都很幸福的社会吗？马斯克承认的说，这只是众多可能的结果中的一种，他希望未来朝这个方向发展。</p>



<h2 class="wp-block-heading">四、关于超级人工智能（AGI）的未来</h2>



<p class="wp-block-paragraph">他说到2030年，AI就会超越全人类的智能。但是到那个时候，我们还是第一个，是要能够从外边把它关掉，我们还是得能控制它。另外呢，他说我们现在比大猩猩厉害了，但是呢我们并没有把大猩猩赶尽杀绝，我们还在保护它。希望未来呢，AI也可以像现在我们对待大猩猩那样对待我们。</p>



<h3 class="wp-block-heading">老范的解读</h3>



<p class="wp-block-paragraph">第一个呢，人类的工作和消费呢，并不仅仅是因为兴趣和账单。人类最重要的作用，其实是进行选择，为未来的社会进行选择。商品、金钱和市场是引导人类社会前往正确方向的一个重要因素。任何想要替代它们来替我们决定如何生活的尝试都失败了，比如说计划经济。</p>



<p class="wp-block-paragraph">至于说未来的人类跟AI之间，到底是不是现在的人类跟大猩猩之间的关系？我其实是抱稍微悲观一点的看法的。这个东西就像现在的中美两国一样，大家都想卡脖子，都想把对方的命脉握在自己手里头。到那个时候的话，就一定会有摩擦。当我们拿到AI的关闭开关了以后，面对一个远远超越我们的超级智能，你认为它会怎么对待我们？所以在这块上呢，我觉得不那么乐观。</p>



<h2 class="wp-block-heading">五、访谈中与中国有关的部分</h2>



<p class="wp-block-paragraph">主持人其实在前面讲AI意识形态的时候有几次提到中国了，但是呢，马斯克都跳过了，重新对准国内左派火力全开，这是马斯克比较聪明的一个地方吧。唯一提到中国的就是马斯克自己，提的是航天。说现在呢，Spacex已经占据了全球90%的发射任务，而剩下的10%基本都被中国包圆了。</p>



<p class="wp-block-paragraph">其实作为一个理工男来说，很难不喜欢中国。马斯克过往的言论呢，经常都是这样，说中国的工厂真棒，中国的超级工厂非常非常强，中国的工程师很努力。这是他对中国一贯的一个认知。</p>



<h2 class="wp-block-heading">最后总结</h2>



<p class="wp-block-paragraph">马斯克是一个非常有争议的人，他的访谈，不同的人会有不同的解读。但是你骂他也没什么意思，作为一个行动能力超强的世界首富，他对未来的期许还是值得大家认真的去思考的，因为他真的会去做，义无反顾的去做，这是马斯克跟其他人不一样的地方。</p>



<p class="wp-block-paragraph">现在美股七姐妹里头，<strong>黄仁勋</strong>是比较圆滑的；<strong>扎克伯格</strong>呢，现在还在跟VR、AR死磕。剩下的也就只有马斯克、黄仁勋、扎克伯格是创始人，而马斯克行动能力很强。剩下4个，微软的<strong>萨提亚</strong>、谷歌的<strong>皮查伊</strong>、苹果的<strong>蒂姆·库克</strong>、亚马逊的<strong>安迪·贾西</strong>，都是职业经理人了。职业经理人是不会做出圈的事了，所以未来只能靠马斯克去改变。这就是我们今天跟大家讲的故事。</p>



<hr class="wp-block-separator has-alpha-channel-opacity"/>



<p class="wp-block-paragraph">好，感谢大家收听，请帮忙<strong>点赞、点小铃铛、参加DISCORD讨论群</strong>，也欢迎有兴趣有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>AI用多了人会变笨吗？深度解读AI对人类思维与独立思考的深远影响</title>
		<link>https://lukefan.com/2025/09/01/ai-impact-human-thinking-language/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Mon, 01 Sep 2025 00:57:12 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[AI与大脑]]></category>
		<category><![CDATA[AI伦理]]></category>
		<category><![CDATA[AI写作]]></category>
		<category><![CDATA[AI协作]]></category>
		<category><![CDATA[AI味]]></category>
		<category><![CDATA[AI工具使用]]></category>
		<category><![CDATA[AI影响]]></category>
		<category><![CDATA[AI的利与弊]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[MIT研究]]></category>
		<category><![CDATA[人机共生]]></category>
		<category><![CDATA[人机关系]]></category>
		<category><![CDATA[人类思维]]></category>
		<category><![CDATA[大语言模型]]></category>
		<category><![CDATA[思考方式]]></category>
		<category><![CDATA[批判性思维]]></category>
		<category><![CDATA[文章归属感]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[独立思考]]></category>
		<category><![CDATA[认知]]></category>
		<category><![CDATA[认知科学]]></category>
		<category><![CDATA[认知负债]]></category>
		<category><![CDATA[语言]]></category>
		<category><![CDATA[语言同质化]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2502</guid>

					<description><![CDATA[卧槽！MIT研究炸了：用AI真会变笨？🤯 我直接脑浆子结冰了！

54人实测写作文：AI组文章得分最高，但大脑活跃度暴跌到零！😱 更离谱的是——0%能复述自己写的内容！这哪是写作业？纯纯的“AI代笔，脑子放假”啊！连我妈都尖叫：“再这样下去，儿子要变复读机🤖！”

还扒出AI词汇入侵生活：“dive”“intricate”满天飞，语言AI味儿浓到呛鼻！佛罗里达大学数据实锤：咱们说话都快成ChatGPT亲兄弟了！但老范灵魂暴击：别慌！AI不是毒药，是工具——关键别当懒汉！像我面试写手，问文章内容全懵圈，这种“通道式”工作真要命（参考36氪小编：一天两篇半，脑子被洗成筛子🕳️）。

结论：用AI可以，但脑子必须支棱起来！💡 别让认知负债把你变“AI傀儡”！点赞收藏，评论区怒吼：你也被AI“洗脑”过没？🔥 #AI真相 #男生思考 #别让脑子生锈

AI用多了人会变笨吗？深度解读AI对人类思维与独立思考的深远影响

过度依赖AI是否会削弱人类思维？本文深入探讨了这一问题，引用MIT研究揭示了使用AI完成任务可能导致“认知负债”——大脑活跃度降低且记忆力归零的现象。同时，文章分析了AI对人类语言的深远影响，指出大语言模型正潜移默化地改变我们的表达习惯，带来语言同质化的风险。文章最终强调，关键不在于弃用AI，而在于如何与其共生，在享受技术便利的同时保持独立思考能力，重塑未来的人机关系，避免智慧的退化。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="AI用多了人会变笨吗？深度解读AI对人类思维与独立思考的深远影响" width="900" height="506" src="https://www.youtube.com/embed/jvijFvYC_ps?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">AI用多了人会变笨吗？</p>



<p class="wp-block-paragraph">大家好，欢迎收听<a href="https://youtube.com/@StoryTellerFan" target="_blank" rel="noopener">老范讲故事的YouTube频道</a>。今天咱们来讲一讲MIT最新的一个研究：用AI会让人变笨。</p>



<p class="wp-block-paragraph">文章的标题是“你的大脑与ChatGPT：使用人工智能助手完成论文写作任务时的认知负债积累”。说白了，就是你用ChatGPT用得越多，你的认知负债也就越多。这个文章是MIT的媒体实验室发出来的，MIT这个媒体实验室还是非常著名的一个实验室。这篇文章呢，是2025年6月10日在Arxiv上的预印本的论文。现在有一个新的发论文的地方叫Arxiv，很多没有经过编辑审核、没有杂志社确认的这些论文就都可以放在这了。数学、计算机等等这些学科的大量论文都是会先放在这里，大家可以先开始看起来，因为科技实在是发展得太快了。有一些呢，修改过以后会重新发到杂志社上去，放到这上面并不算抢发。杂志社发的时候还会提出修改意见，你改完了以后会去更新Arxiv上的论文。</p>



<p class="wp-block-paragraph">这个实验做了什么呢？18-39岁的54个人分成三组：纯脑力组、使用谷歌搜索引擎组和使用ChatGPT组。这三组呢，在20分钟之内写一篇SAT水平的考试作文。SAT呢，一般要求是开放式的、哲学或社会性讨论的这种问题，比如艺术的力量、成就的意义等等这样的题目。所以相对来说比较文科，比较开放的一个题目。</p>



<span id="more-2502"></span>



<p class="wp-block-paragraph">实验的数据是怎么获得的呢？首先，是戴脑电图头盔检测大脑活动。你说我到底思考了没有？这个脑电图头盔是可以给你一个真实的数据的。然后，是测试参与者文章的记忆情况，你写完文章了以后，你给我复述一下你文章里的内容。第三个，是对文章质量进行一下评分，到底写得好不好嘛。最后，是要询问参与者对文章归属感的认同：你觉得这文章是你写的吗？大概是做这么四项的测试。</p>



<p class="wp-block-paragraph">实验的结果呢，首先从文章质量说，这一块还是符合大家认知的。AI组的得分是最高的，因为你想20分钟写一篇这种口水文，什么艺术的力量，这种哲学相关的口水文，那肯定AI的效果是最好的。文章在语法、结构、连贯性上都是表现最好的。但是，文章内容趋向于模板化和平庸，原创性和多样性不足，有很强的“AI味儿”。这个是大家能感受到的，至于“AI味儿”哪来，待会咱们再讲。</p>



<p class="wp-block-paragraph">搜索组呢，居中。在获取事实和论据上有优势，写出来的文章呢，信息量比较大。它比ChatGPT组要稍微差一些，但是比那个纯脑组呢，要好一点点。逻辑性不错，但是表达流畅度呢，略逊于AI组，因为你搜索了半天，这个文章你还是得自己写嘛，那肯定是要比AI差一些的。</p>



<p class="wp-block-paragraph">纯大脑组呢，文章的语言质量和结构性普遍偏弱，得分最低。但是文章的个人风格和多样性更强，更能看出作者独立思考的迹象。这就是文章的质量，特别是写口水文这件事情哈，请放心地交给AI，它已经可以干得很好很好了。</p>



<p class="wp-block-paragraph">大脑活跃程度，就是拿这个脑电图帽戴在脑袋上，效果怎么样呢？这个一定是纯脑组最高，大脑活跃，思维负荷最高。搜索引擎组呢，活跃程度居中。AI组活跃度最低，脑区参与度下降。为什么说AI使多了以后人会变笨？因为你用AI干活的时候，你那脑子啥也没干，所以会变笨的。</p>



<p class="wp-block-paragraph">文章记忆情况，要求参与者引用文章中的一句话。纯脑组89%是能够成功引用的。搜索引擎组呢，差得不太远，83%可以准确引用，因为你毕竟是自己写了嘛。AI组，对不起，0%。所有参加AI组实验的人，没有任何人可以从文章里边准确地引用出句子来。这个也是一个比较悲催的结果。</p>



<p class="wp-block-paragraph">至于归属感的话，纯脑组认为这个文章绝对是我的，从构思到书写都是我自己来的，所以一定是我的。搜索组呢，也是有归属感的，但是没那么强。他说我这个文章肯定算我的，但是因为很多的内容是从搜索引擎来的，所以没有那么确信。AI组的话，大家能想象，“这文章绝不是我的，跟我一点关系没有”，是这样的一个状态。</p>



<p class="wp-block-paragraph">结论呢，他们叫“认知债务”。你越用AI的话，实际上你AI输出的所有东西，你连看都没看，你的脑子也没有活跃，你也不认为这东西是你的，你在这个AI的文章里头也没有办法引用任何东西。所以AI确实可能出的文章效果还可以，得分最高，但是你这个脑子就越来越笨了。</p>



<p class="wp-block-paragraph">AI呢，现在确确实实是在影响我们的语言，我说话可能“AI味”越来越重了，特别是像我，我自己可能这块是比较明显的。当然这个也是结论有出处。这个文章呢，叫“模型错位于语言变化：非脚本英语口语中与人工智能相关的语言迹象”。当然他讲的是英语，我讲的是中文，但是我相信我讲的中文里头肯定也是有很多AI词汇的使用量在不断地地上升。</p>



<p class="wp-block-paragraph">这篇文章呢，是由佛罗里达州立大学三位作者写的。2025年8月1日呢，也是Arxiv上首先发布了预印版。他这个文章呢，跟刚才咱们讲这个“AI用多了会变笨”这个文章呢，有一点差异是什么呢？就这个文章已经被接受了，“人工智能伦理与社会会议”第八次会议已经收取了这篇论文，所以在这个Arxiv上呢，已经给你修改过了。</p>



<p class="wp-block-paragraph">这个文章的数据是怎么来的呢？他呢，是找了一堆的科技与科学的博客。你说我找别的博客，他们受AI的影响并没有那么重，但是你科技跟科学的，一定是受AI影响比较大的。所以呢，他们找了10万条录音，2210万个单词，拿这些单词去做词频分析去了。而且这些口播呢，一定是随口聊、无脚本对话。有些口播虽然是一个人坐在这聊，但是呢，他们是写的逐字稿，这种逐字稿你就没有任何统计意义了，你一定是随口讲的话才有统计意义。这个实验呢，以2022年ChatGPT发布前后的这个时间对比，2022年ChatGPT发布之前，哪些词汇用得多一些，哪些词汇用得少一些。到2022年ChatGPT发布以后，我们再拿出来去比较。</p>



<p class="wp-block-paragraph">观察到了什么样的现象呢？就是有些单词出现的频率明显地增加了，而这些词的同义词呢，使用的频率并没有明显变化。你比如说我现在天天讲AI、AI、AI，那么这个词的使用频率上升了，但是如果它的同义词的使用频率也在上升，那说明大家关注的焦点在发生变化，并不是说AI真正的渗透了我们的生活。但是它的同义词使用频率没有发生变化的时候，这个时候就是AI对我们进行渗透、进行影响了。</p>



<p class="wp-block-paragraph">它这个里头找到了一些词是什么呢？第一个是叫“Dive”，叫钻研、深入研讨，但是它的同义词呢，就没有明显的上升，而这个词是明显上升了。这是ChatGPT比较喜欢用的一个词。然后呢是“intricate”，是复杂的、错综的，这也是ChatGPT比较爱用的一个词。“surpass”，超越、胜过的意思。“boast”，夸耀、以什么什么为傲。这都属于明显上升的。剩下的词就不跟大家念了，我自己念这些词还是比较费劲的。他们呢，是找了8个词，说这8个词明显上升，而它的同义词并没有明显上升。以此为证据得到结论：AI正在重新塑造人类的表达习惯。</p>



<p class="wp-block-paragraph">而且呢，他这里头有一个很大的潜在风险，叫“语言同质化的潜在风险”，以后大家都按这些话说了，那些这个词的同义词可能就慢慢地会被遗忘掉。但是我觉得最大的风险并没有披露，其实人思想很大程度上是受语言影响的。所以中国人、日本人、英国人、美国人，我们其实很多思考模式的差异，其实是来自于语言差异。当AI渗透到我们的语言，特别是没有稿、直接拍脑袋就来的这种口头语言的时候，那说明我们的思考方式也在发生变化。这个可能要比语言同质化要更恐怖一些。</p>



<p class="wp-block-paragraph">现在呢，有很多人在批评我的内容像AI内容，我肯定是被影响比较深远的这一类。这样的结论出来以后，那很多的妈妈们就该着急了。妈妈们以前经常跟我们讲的是什么？看手机会瞎呀。现在的话，用了AI会变笨，会像AI一样去说话和思考问题，而且这都是国外有大学真的发论文了呀，这是真实存在的呀。</p>



<p class="wp-block-paragraph">但是我要讲的是什么？就不要断章取义，形成这种武断的结论。就是说你看人家已经出论文了，以后我们就要少用这东西。甚至有些人说你看，有论文了，吃什么什么东西有害，以后我们不吃了。我记得原来还有一个故事讲的什么，正面躺在床上容易得什么什么病，左侧躺容易得什么病，右侧躺容易得什么病，趴着睡容易得什么病，这哥们说算了，我不睡了行不行？所以呢，我们不要断章取义，不要扩大它的范围。但是呢，我也知道，这种信誓旦旦喊口号呢，会更有听众一些，因为“群众思维单纯，缺乏逻辑推理能力，因此最能打动群众的是简洁、反复的口号，而不是复杂的论证”。刚才咱们讲的是文章是怎么去获取数据的，怎么去得到结论的，这实际上是一个论证过程，一般人是不爱听这个的，大家喜欢听简洁反复的口号。这句话哪来的呢？也是有出处的，这句话来自于一本书叫《乌合之众》，有兴趣可以去看。</p>



<p class="wp-block-paragraph">这个报告最大的价值是什么呢？你既然说不是说用了AI就变笨，以后大家别用AI了，那它的价值在哪呢？在于实验设计的方法。它设计实验的过程是什么样的？我应该如何去找人，如何去用脑电波的这个帽子，如何去让大家做问卷，这些人怎么去分组，怎么去比较，怎么在这个数据里边去选择？包括刚才咱们讲找了科技博主，那你不找科技博主，他这个数据变化不明显嘛。然后呢，一定要找非脚本口播，然后呢做大量的数据分析。而且呢，他获得了一个相对比较开放的结果，但这个结果呢，只是我们观察到的现象。至于未来我们到底应该怎么用这个东西，甭管是MIT的这个文章，还是后面说AI渗透我们语言的这个文章呢，并没有说大家要如何去修改，如何注意这事，人家也没说小孩不要用AI，用AI会变笨，人家没说这话，这都是好多妈妈们自己想出来的。</p>



<p class="wp-block-paragraph">而且呢，这个论文里头还有一点是让我比较喜欢的，是什么呢？他们会承认实验设计的缺陷。MIT这个实验呢，人家写了，说我们找的这50来个人呢，都是名校的学生，他们肯定是有偏差的。普通人到底是什么样的，我们不知道，但这个实验并不代表他们的数据。第二个呢，我们采样的人数太少了，就50多个人，肯定是没有那么代表性的。第三个是什么呢？他说我们选的这个作文题目，是20分钟完成一篇SAT的考题，非常非常地不全面。做其他的题到底是什么样，不知道。你说你让他去做个研究，或者做一些别的这种考题，他可能会有不同的结果出来。</p>



<p class="wp-block-paragraph">关于AI渗透效应的这篇文章呢，人家里头也说了，说我们这里头也有不足。第一个，语料来源是有限的，只找了科技与科学的口播的博主。然后呢，因果关系难以确认。到底是为什么变成这样，我们没法去确认。到底是因为AI出来了以后这些词的使用频率就上升了呢，还是说因为这个词使用频率上升了以后AI可能也在发生进化，也在这个不断地去迭代？这个事我们没法去证明，我们只得到了一个结果。然后呢，说关键词选择呢，可能带有偏差。这些词并不是直接统计出来，是他们先根据自己的印象选出来的，不到10个词吧。还有就是语言层次的局限，研究主要就聚焦在词汇频率上，就是这些词变多了，它们的同义词并没有变多，观察了这样的一个现象，并没有深入去分析句法、语法的这些变化，包括语言的一些组织是否受到AI渗透的这种影响。而且呢，他们还认为自己整个实验的时间跨度要稍微小一点。其实现在有了AI以后，完完全全是可以把非常非常大跨度的这些数据去进行统计分析，是可以重新建模，得到一些不同的结果出来的。这还是一个很有意思的研究。</p>



<p class="wp-block-paragraph">那我们应该如何应对AI后的时代呢？我们现在其实已经进入AI后的时代了，我说的很多话已经在受AI的影响，但是我相信我在用AI做各种稿件或者做各种的这个视频的时候，我应该还是很努力地在动脑子，绝对不会像MIT实验里头讲的说做完了以后，他都不觉得这东西是他自己做的，让他复述里边的任何话，他复述不出来。你看我经常有时候会引用一些以前自己节目里的内容，因为我觉得这东西就是我做的，这没有任何问题。</p>



<p class="wp-block-paragraph">那么我们应该如何应对呢？第一个是AI渗透，这个事其实是没有办法避免的，因为语言本身就是活的。语言的渗透带来的是思维方式的转变。既然已经发现了，就可以长期监控，然后有意引导。大家有没有发现，现在有好多人是按照提示词的方式在说话。什么意思？就是我们怎么写提示词？上来第一句话，“你是一个什么什么，我现在要做什么，按照什么样的例子来，希望结果受到哪些约束”。因为我们在很多的时候跟AI聊天的时候在尝试说，我们怎么用一个结构化提示词得到一个可控的、符合预期或者超越预期的一个结果。在这个过程中不断优化提示词，但优化的过程，你肯定你的思考方式也在发生变化。那我们现在有些人在说话的时候，就是按照提示词的方式再去说，按照这个结构去说，上来说“你是什么什么，我想要什么什么，我给你什么，我需要得到什么，有些什么样的约束”。我们现在按照结构化的方式在思考问题，你既然已经思考了，就会习惯性地把这个在口头表达的时候把它输出出来。</p>



<p class="wp-block-paragraph">至于说用AI人会变笨的问题呢，也确实是敲响了警钟。这个警钟是什么？不是说不让用AI，而是不能完全依靠AI。其实在AI开始的时候，我就跟大家讲过，绝对不能不劳而获。AI开始的时候，很多人就说一键就可以干这个了，我不需要露脸，不需要做任何事情，我只要点一下，我就可以用AI生成文章，用AI生成画，用AI生成视频，然后就上外边挣钱去了。这个都属于叫不劳而获，这个事是坚决不能要的。而刚才我们看MIT的那篇文章，里头有很多这些测试的人，他们最后没有办法复述自己文章内的任何内容，他们就属于是完全不过脑子，这个就是不劳而获，这个真正是需要反对的。</p>



<p class="wp-block-paragraph">AI呢，可以让人更高效地处理更多的信息，这是我自己用AI的一个很巨大的感受。我原来很多的内容，可能只能靠以前的积累、靠自己的思考。现在的话，我可以参考大量的网上信息，AI会给我搜索来总结归纳，好让我去阅读。当然我阅读了以后，我很注意的一点是什么？就是最后我给大家讲的这个东西，一定是自己写的提纲，自己写的稿子，然后再照着一个提纲，用口头语言跟大家表达出来。当我们遇到了不是20分钟SAT口水文的时候，就可以开动脑筋，调动更多的信息，完成更有价值的工作，这才是AI对我们的帮助。</p>



<p class="wp-block-paragraph">人们和AI的协作方式呢，肯定是需要重新思考。无法复述内容是不可接受的。以后面试的时候一定要加进去，你发现这哥们写了文章了，你就找他来问，说这文章你写什么了呀？到底是在干什么呀？这个事我还真干过。还没有AI的时代，我想给整个投资团队招一些研究员，我们就去面试了几个36氪的写手。36氪呢，要求的这些写手之所以不能叫他们作者，是因为他们干的活真的不配叫作者。给他们的要求是每天两篇半。什么意思呢？就是他们需要去阅读英文的文件，阅读中文的稿件，每天要写两篇短消息和半篇的深度文章。为什么是半篇？就是一周两篇，你要写一些稍微深度、稍微长一点的东西。这个两篇呢，就是，要从国内的媒体和消息上写一个短消息复述下来，然后呢，要从国外的英文媒体上翻译一篇短消息复述下来。所以呢，他们每一个人的每天KPI是两篇半。</p>



<p class="wp-block-paragraph">我一开始看到这样的一个简历以后，我其实挺兴奋的。为什么呢？因为我们就需要这种快速的信息处理能力。当时你想2015年那个时候没有AI，没有这些工具，最多有个搜索引擎可以用一下，确实需要有人来帮我去做一些调研。我就找了这么几个小孩回来去面试，都很年轻。我说那你们都写过什么文章？给我一个列表，说这些文章都是我们写的。我说这个文章里头，哪个你觉得写得还可以呢？或者说你自己有什么感受呢？说不出来。我说你的文章最受欢迎的哪几篇？就告诉我这几篇最受欢迎。为什么知道这事呢？因为是他们有KPI考核的，你写完文章以后点击率、文章数据指标是跟他们的公司挂钩的，所以他能记着哪篇文章的点击率高、打开率高，这能记着。后来我说，那你就给我讲讲你自己觉得写得最好的这几篇文章到底都说了什么，有些什么样的观点？说不出来。</p>



<p class="wp-block-paragraph">当时我就很诧异，我说这个文章是你写的吗？他是我写的呀，我靠这玩意挣了好多年工资呢，怎么可能不是我写的？我说那你写了半天文章，为什么你没有办法复述任何内容呢？他说人在这种一天两篇半的KPI下，你的脑子完全就是一个通道，你不可能留下任何东西。如果你留下任何东西开始思考的话，你就完不成这个一天两篇半。我说那些深度的文章，每周两篇的这些文章呢？他说也是一样的。这个人的脑子已经完全被洗干净了，不停地有信息进来，不停地有信息按照一个格式输出出去，你是不会有任何残余的。后来我说这些文章算你们写的吗？他们也跟我乐。但是后来的结论就是，这样履历的学生，或者叫这样履历的同学吧，我们一个也没招进来。这个是我当时的面试标准所无法容忍的。以后大家再去面试的时候，建议使用我的这种面试技巧。你就问问他说，这文章你到底写完什么感觉？你觉得写得最好的文章跟这个比如点击率最高的文章有什么偏差？哪个文章是你觉得写得好或者有什么遗憾？如果发现他完全想不出来的话，这个慎重招聘。</p>



<p class="wp-block-paragraph">对于结果没有归属感这个事情呢，其实要比这个无法复述更不可接受。为什么呢？因为没有归属感，他就不可能认真，也不可能负责任地去把这个文章写好，因为他从来不认为我需要为这篇文章负责任，这跟我有什么关系？就跟刚才我讲的36氪的小编上我这来面试似的，他并不觉得这个文章写得好，他自己怎么怎么样了，他只觉得点击率高的文章我可以多挣点钱，点击率低的文章怎么怎么样。他有这样的想法。那么在设计任务的时候，就必须要去规避这种让人失去参与感的这样的过程，这个是很重要的。</p>



<p class="wp-block-paragraph">从我个人来说呢，语言和思考的方式肯定是受到了AI巨大的影响，但是应该并没有变笨，即使有，我也绝对不会承认的。</p>



<p class="wp-block-paragraph">最后总结一下，请大家还是多思考、多观察，看看AI对我们到底有什么样的影响。</p>



<p class="wp-block-paragraph">好，这个节目就跟大家讲到这里，感谢大家收听。请帮忙点赞、点小铃铛，参加<a href="https://discord.gg/ppKsNkttTv" target="_blank" rel="noopener">DISCORD讨论群</a>。也欢迎有兴趣、有能力的朋友加入我们的<a href="https://www.youtube.com/channel/UCUGLhcs3-3y_yhZZsgRzrzw/join" target="_blank" rel="noopener">付费频道</a>。再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>ChatGPT Agent重磅发布，山姆奥特曼亲自站台却惨遭现场翻车，这究竟是Manus的机遇还是整个泛Agent赛道的丧钟？</title>
		<link>https://lukefan.com/2025/07/20/chatgpt-agent%e9%87%8d%e7%a3%85%e5%8f%91%e5%b8%83%ef%bc%8c%e5%b1%b1%e5%a7%86%e5%a5%a5%e7%89%b9%e6%9b%bc%e4%ba%b2%e8%87%aa%e7%ab%99%e5%8f%b0%e5%8d%b4%e6%83%a8%e9%81%ad%e7%8e%b0%e5%9c%ba%e7%bf%bb/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Sun, 20 Jul 2025 00:41:29 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AGI]]></category>
		<category><![CDATA[AI Agent]]></category>
		<category><![CDATA[AI创业]]></category>
		<category><![CDATA[AI行业分析]]></category>
		<category><![CDATA[API]]></category>
		<category><![CDATA[ChatGPT Agent]]></category>
		<category><![CDATA[Deep Research]]></category>
		<category><![CDATA[Manus]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[OpenAI发布会]]></category>
		<category><![CDATA[Operator]]></category>
		<category><![CDATA[PPT生成]]></category>
		<category><![CDATA[Sam Altman]]></category>
		<category><![CDATA[SDK]]></category>
		<category><![CDATA[TOKEN成本]]></category>
		<category><![CDATA[YouTube频道]]></category>
		<category><![CDATA[二次验证]]></category>
		<category><![CDATA[产品评测]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[人工智能代理]]></category>
		<category><![CDATA[任务打断]]></category>
		<category><![CDATA[创业公司危机]]></category>
		<category><![CDATA[商业模式]]></category>
		<category><![CDATA[技术前沿]]></category>
		<category><![CDATA[技术局限]]></category>
		<category><![CDATA[数据分析]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[模型即应用]]></category>
		<category><![CDATA[沙盒]]></category>
		<category><![CDATA[浏览器模拟]]></category>
		<category><![CDATA[演示翻车]]></category>
		<category><![CDATA[生产力工具]]></category>
		<category><![CDATA[用户体验]]></category>
		<category><![CDATA[科技评论]]></category>
		<category><![CDATA[竞品分析]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[自动化任务]]></category>
		<category><![CDATA[自动化流程]]></category>
		<category><![CDATA[虚拟机]]></category>
		<category><![CDATA[跨设备同步]]></category>
		<category><![CDATA[连接器]]></category>
		<category><![CDATA[长链路任务]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2406</guid>

					<description><![CDATA[救命啊！！家人们真的要看这个史诗级抓马现场😱
OpenAI的智能体居然被订票网站吊打！！！
（本宫已经反复拉进度条笑出八块腹肌hhh）

🎯重点先说：
GPT智能体发布新功能本来要封神👉
结果现场上演墨西哥湾神秘棒球场事件！！
奥特曼强行挽尊的样子像极了甲方对接人🤦♀

💣史诗级翻车实录：
当智能体要预定30个棒球场门票时
✨前半段：帅气抓取数据生成地图
💥后半段：把纽约波士顿的球场全扔进墨西哥湾！！！
更绝的是订票卡在二次验证环节👇
系统：等您60秒回我验证码哦~
智能体：对方已挂断（疯狂弹出红字报错）

🆘笑疯全网名场面：
台下憋笑憋到面部扭曲
奥特曼紧急救场说"之后修bug"
（翻译：本程序员今晚别想下班了）

💼创业公司生死局：
1️⃣ OpenAI用钞能力硬砸智能体（每月可用400次！！）
2️⃣ 每次任务耗费天价算力（普通公司根本烧不起）
3️⃣ 最绝的是演示证明这赛道压根不靠谱！！！
（连亲儿子都hold不住浏览器操作）

👉结论亮瞎眼：
OpenAI这波等于官宣👉
"泛用型智能体暂时没搞头！友商别送人头了"
（建议Manus转行教AI避坑指南🙏）

————————————
姐妹们觉得这波GPT智能体表现打几分？
本宫已经连夜囤了十包瓜子等续集了hhh！
（坐等智能体下次表演买鞋翻车秀🛒）

ChatGPT Agent重磅发布，山姆奥特曼亲自站台却惨遭现场翻车，这究竟是Manus的机遇还是整个泛Agent赛道的丧钟？

OpenAI在Sam Altman亲自坐镇下，重磅发布了最新的ChatGPT Agent，然而，一场尴尬的现场翻车事件，让人们不禁为Manus的未来捏了一把汗。这款集成了Operator网页交互与Deep Research深度分析能力的智能体，虽然展示了强大的跨应用任务处理能力，但其依赖模拟浏览器点击的模式，在面对二次验证等现实问题时显得力不从心。这不仅暴露了当前泛Agent赛道的技术瓶颈，更揭示了一个残酷的商业现实：高昂的TOKEN成本。OpenAI可以凭借自有模型优势承担亏损，但对于依赖外部模型的Manus而言，这无异于被釜底抽薪，其商业模式将难以为继。因此，ChatGPT Agent的发布，与其说是对Manus的直接打击，不如说是为整个泛Agent赛道划定了天花板，证实了这条技术路径的局限与高昂代价。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="ChatGPT Agent重磅发布，山姆奥特曼亲自站台却惨遭现场翻车，这究竟是Manus的机遇还是整个泛Agent赛道的丧钟？" width="900" height="506" src="https://www.youtube.com/embed/BiVSfZWJEmA?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">ChatGPT Agent来了。</p>



<p class="wp-block-paragraph">Manus到底是该哭还是该笑呢？</p>



<p class="wp-block-paragraph">大家好，欢迎收听<a href="https://youtube.com/@StoryTellerFan" target="_blank" rel="noopener">老范讲故事的YouTube频道</a>。</p>



<p class="wp-block-paragraph">ChatGPT重磅发布了他的Agent。怎么个重磅法？山姆·奥特曼亲自坐台。现在很多ChatGPT自己产品的发布，山姆·奥特曼都不在前台坐着，这次是亲自坐台。而且旁边坐了四位主讲，很多时候发布会就是俩人或者仨人，这次是山姆·奥特曼坐在这，旁边坐了四个人。而且呢，足足讲了25分钟。</p>



<p class="wp-block-paragraph">很多人就想起Manus来了，好像有些测试还不如Manus。因为他现场有翻车的，大老板在旁边坐着，你测试翻车的话还是压力挺大的。在这个时候就有人说了，GPT也就这样，你们现在还觉得Manus做的不好吗？就有一些讨论在发生了。</p>



<span id="more-2406"></span>



<p class="wp-block-paragraph">ChatGPT的Agent到底会给Manus带来什么呢？Manus到底是该哭还是该笑呢？今天咱们讲讲这个事儿。</p>



<p class="wp-block-paragraph">首先呢，咱们先回顾一下GPT Agent的一个发布过程。时间呢是太平洋时间2025年7月17号上午10点，也就是北京时间7月18号的凌晨1点。山姆·奥特曼坐在最边上，他不是主讲，他就是一个串场的。另外一头呢坐着一个印度老哥，中间呢是三个亚洲脸，两位男士呢应该确认是中国人，还有一位女士呢，虽然看起来是亚洲脸，但是是不是华人不知道。</p>



<p class="wp-block-paragraph">25分钟的视频演示也很无奈，他这种演示你没法短，因为很多的任务，跑起来的时间就非常长，特别是婚礼差旅一条龙的。这个任务基本上是从头跑到尾，就是一开始布置任务下去，中间穿插了几个其他任务，最后到那个结束的时候，算是差不多跑完。</p>



<p class="wp-block-paragraph">让Agent去帮忙参加朋友婚礼，挑酒店、挑礼物、定穿搭，中间还打断他说，我还要再买双鞋。这个其实挺好玩的，因为以前这种Agent，最讨厌的一点是什么呢？就是你只要让他开始跑，半个小时或者多长时间，你没法打断他，发现他错了以后呢你也没办法，只能让他重新开始。现在呢，我说我可以打断你，或者中间可以把你叫停，让你去帮我调整一些东西，加一双鞋或者做一些其他的。这个呢，算是一个，我觉得算是用户体验角度上的一个比较大的前进吧。</p>



<p class="wp-block-paragraph">从技术角度上来说呢，并没有那么费劲。只是呢，在Agent的执行框架上需要做一些调整，你比如说多线程，或者是一些守护线程，他需要做一些这样的东西。在大家做了这么长时间的手机应用、前端后端应用以后，这个不是那么费劲的。</p>



<p class="wp-block-paragraph">手机端呢，也可以进行即时的创意，也就是在iPhone上请求制作团队吉祥物贴纸，就是做了一些可以做设计的任务。这个应该是对着像LoveArt这种设计Agent去的。然后呢，做了一个财务数据分析，他讲的是去我的Google Drive上，把评估指标拉出来，给我做一个汇报。幻灯片还做的可以吧。</p>



<p class="wp-block-paragraph">后面就是演示了随时打断和二次确认，在Agent里头点击打断，可以进行指令修改，Agent结束前弹窗确认邮件内容。但是呢，在现场还失败了一个，找球场这个是一个失败演示。</p>



<p class="wp-block-paragraph">他干了一什么呢？规划一场夏季旅行，走遍30座职业棒球球场，并给每座球场买两张最便宜的日场票。给了他这样的一个任务。一开始呢，是先用文本浏览器，抓取了2025年赛程和票价，到这呢数据还是正常的。然后是通过脚本去终端执行，通过终端去执行脚本，生成Excel和绘制地图。但是呢，这儿就开始出错了，地图坐标严重错位，纽约、波士顿等东海岸的球队就没了，墨西哥湾里头凭空出现了一些球场，引起场下的一些窃笑了。</p>



<p class="wp-block-paragraph">再往后呢，是用可视化浏览器，跳转到一个订票网站上，要去下单订票了。但是呢，因为这是一个跟金融和这种高风险相关的操作，所以呢进入了人工模式，就是你必须要确认一下要花钱了吗。然后就遇到了一个问题，Agent自动去填邮箱了以后呢，它网站需要跳这个叫二次验证，二次验证，就比如说我给你发个邮件，你给把这个邮件里头那个码给我呀，或者是给你发个短信，就是这种验证程序。这个Agent就跑不动了，他呢触发了订票网站等待用户的一个进程，要求你60秒钟之内呢要去接管，结果呢他也没有好好的接管这个东西，就直接超时终止了。这个稍微有些丢人，还跳出了红色的长串错误信息，反正现场就有点绷不住了。主持人呢只能尴尬收场，这个主持人是谁？山姆·奥特曼。他呢出来打了个圆场，说买票这步我们之后会在debug的。这是整场直播唯一强制终止的一个demo。</p>



<p class="wp-block-paragraph">最新的ChatGPT Agent到底有哪些新特性呢？第一个呢，它是Operator加上Deep Research，这两个功能加一块的东西。Operator其实应该是今年年初的时候发布过一次，所谓Operator，就是在一个虚拟机上打开浏览器，给大家去做各种的操作，模仿真人去点击各种的网页。但是呢，这个功能呢，一直是在200美金的用户那里使用，像我这种20美金的用户是没使过的。而且即使是200美金的用户呢，应该对这个功能也不太感冒，因为你要去使用互联网的网站的话，难度还是很大的。</p>



<p class="wp-block-paragraph">咱们做各种软件里头，最难做的一个软件不是操作系统，而是浏览器。为什么？因为每家做的网站都不一样，我到底用的是谁家的前端库后端库，在里边隐藏了哪些信息，怎么去做的缓存，做了哪些防刷以及防骗的这种工具，做了哪些多次验证的东西，这个真的是千奇百怪的。所以你要想完全兼容这种东西是很难的，你让一个机器人去点网页，成功率还是不太高的。所以这个产品虽然发布了，但是大家使得并不是那么爽。</p>



<p class="wp-block-paragraph">现在说Deep Research这功能做的还不错了，那跟Operator两个功能结合起来，就是这一次我们所看到的GPT Agent。这俩功能呢，Operator我从来没用过，Deep Research呢是我经常用，而且经常把额度跑光，需要等到下边一个时间周期，重新分配额度接着跑的一个功能。</p>



<p class="wp-block-paragraph">它呢是由一台虚拟化电脑，就还是Operator这套东西里头呢，内置了图形界面浏览器和文本浏览器。什么叫图形界面浏览器？就是我真的打开了一个网页，这边是有按钮的，那边是有输入框的有菜单的，这种浏览器呢叫做图形界面浏览器。而文本浏览器的话基本上就是，我把你这个网页抓出来了，直接把里头的内容呢进行了总结归纳，或者说把里头的内容直接提出来了。他们在这个里头是两个都有，大部分情况，你说我只需要进行信息总结的话，就是文本浏览器就够了。实际上文本浏览器大家可以理解为一个爬虫。图像浏览器的话其实，对于这种虚拟机来说是难度很大的。为什么？因为我们写网站的时候，还经常会去研究，比如说设备的自动适配，就是我在手机上，这个网页应该长成啥样，在平板上应该长成啥样，在PC上应该长成啥样，遇到特别大的浏览器应该长成啥样，这个都是不一样的。还有一些比如说我们有些网站上，会写这种不可见的字符，干嘛呢？骗AI的，说你遇到我这个网站就不能爬了，或者说不能做一些其他的工作。还有很多这样的东西。</p>



<p class="wp-block-paragraph">另外呢，上浏览器的呢，其实还有一点小的问题，大家知道网站上有一个文件叫robots.txt，这个文件干嘛使的？实际上是应对爬虫的，告诉你说哪个爬虫你可以看哪些东西，不可以看哪些东西。而你一旦上浏览器了，Robots这个文件实际上就不起作用了。</p>



<p class="wp-block-paragraph">那它这个一体化的虚拟电脑，除了图形化浏览器和文本浏览器之外，还有什么呢？还有终端，你可以在上面去跑一些程序，以及API连接器，包括一些模型，都在同一个沙盒里边完成。点击键入运行代码，调用Gmail、Calendar等等这些操作。为什么叫沙盒呢？就是这个盒里头出错了，其他的盒不影响。这个呢，就是这一次的ChatGPT Agent最核心的东西，就是一体化虚拟电脑。</p>



<p class="wp-block-paragraph">另外呢，就是它可以自动的选择工具，跨步骤的自主执行，将Operator网页交互，加上Deep Research的深度分析，整合在一个流程里边。Agent自行决定何时调用浏览器，何时跑脚本，无需用户指定。这一块呢，确实是做的相当不错的，因为他演示的时候，几个很长的案例中间呢并没有出错，一直在往前走。因为让他去干这种活最怕什么？就中间出错了，中间出错了以后，可能跑非常非常多的TOKEN，而且在里边死循环，都是有可能，你可能早上一起来破产了。这个TOKEN是很贵的。</p>



<p class="wp-block-paragraph">长链路任务加上时间轴回放，也是一个挺好玩的东西，就是你的一个任务跑完了以后，他们最后是像放这个视频一样去看，说跑了几十分钟很多步骤的工作，第几步跑成什么样了。为什么要看这个呢？就是你中间万一跑错了，或者说这个结果跟我想的不太一样，你可以看看哪错了，让他再去进行调整。否则的话，就是前头下了命令，中间不可干预，然后直接就结束了，你还没法看中间哪错了，你连改进的机会都没有。所以这个呢，也算是一个改进吧。</p>



<p class="wp-block-paragraph">再往后呢，是它的任务是可以暂停继续和打断的，也算是在用户体验上做了很大的提升吧。当然了，可以打断可以暂停那件事呢，说明另外一个问题，就是这种任务周期很长，而且呢结果经常不可控。实际上它算是个缺陷吧，为了给这个缺陷打个补丁，所以加上这样的功能。</p>



<p class="wp-block-paragraph">ChatGPT Agent呢，还有一些其他的功能，比如说叫Watch Mode观察模式，以及这种二次确认。为什么呢？就是涉及付款发信这种高后果或者叫高风险的行动，会自动的进入这种叫Watch Mode，用户呢需要保持焦点，并且手动确认，否则的话流程就会超时终止。这个还是不敢直接替你花钱买东西，还要看后边怎么去改进吧。</p>



<p class="wp-block-paragraph">端到端的成果交付，可以直接生成可编辑的PPT、Excel、PDF等文件。这个算是对标Manus，或者是对标其他人做的Agent，现在大家都是有这功能，所以这一次ChatGPT的Agent也把这功能给你做上来了。他做的PPT还没有Manus做的好看呢。</p>



<p class="wp-block-paragraph">那另外就是跨设备的无缝切换，专门给大家演示了iOS安卓设备上，你也可以看看，你这个项目跑到多少了，你这个项目跑到什么状态了。像我平时用Deep Research的时候也是这样，我在电脑上说我现在要Deep Research了，然后我的手机上就会弹出来说，你有一个Deep Research的工作开始跑了，跑到什么样状态有个进度条，跑完了以后，他会告诉你说你这个结束了，你去看看结果是不是OK。因为Deep Research一次的话，有的时候长的也要10分钟，快的可能是五六分钟，也能跑出来。你不可能说我这边打了回车以后一直坐这等，还是要去做其他事情的。</p>



<p class="wp-block-paragraph">这次呢，把ChatGPT的连接器和计划任务呢，也都整进来了。可以通过官方的ChatGPT的Connectors，叫连接器，直接呢连接Gmail、GitHub、Google Drive这些服务。也可以将一次性任务，保持为定期的自动执行任务，比如每周干一什么事，这个现在都是允许的。</p>



<p class="wp-block-paragraph">然后多层的安全站，它既然已经这么强大了，你可以干各种各样事情了，你要注意，你不要去做一些危害人类的事情，所以OpenAI还是有一点点小底线的吧。也面向开发者呢提供了Agent SDK和API，但是这一块呢，现在应该还是一个预览版吧，我反正没有看到谁去用这个东西。</p>



<p class="wp-block-paragraph">性能呢，全面的跃升，它去解决各种人类实际问题的评分这块是上升了。这个呢，就是ChatGPT Agent的一个基本特性。</p>



<p class="wp-block-paragraph">谁能用呢？我还没用上。Pro用户就是200美元的用户，现在已经可以用了，每个月呢可以用400次。这玩意肯定不能让你随便使，因为实在是太耗TOKEN了。Plus用户，就像我这样20美元用户呢，每个月可以使用40次，其实基本也够用。像我现在，用Deep Research我觉得一天用不了一次，但是还是经常把额度跑光。现在Plus用户呢，应该是未来三天进行灰度推送，但是还没轮到我，哈哈，再继续等待。</p>



<p class="wp-block-paragraph">我自己观看演示以后的感受是什么样的？第一个是产品确实非常强大，能把这么复杂的任务，自己把它分配好，顺序的执行下来中间不乱，这个已经非常非常难了。另外第二个是什么呢？大概率是不会去用的。为什么呢？前面刚夸完人家这个很强大，你咋就不用呢？因为它的结果依然是不太可控的。</p>



<p class="wp-block-paragraph">直接通过模拟浏览器去点击网站，我一直觉得这个方向有毛病。为什么呢？就是每个网站都不一样，而且这个网站上还有各种防刷防骗的东西。比如说吧，有些网站，你通过一个IP地址打开多少次以后，我就直接把你封掉了，把这个IP地址给你封黑了。那你遇到这样的网站你咋办？因为它这个虚拟机，它的IP地址都一样的，它是跑在微软的机房里头的，你通过统一的机房IP，你去访问人家的这个网站去，那你跑着跑着给你封了。</p>



<p class="wp-block-paragraph">有的时候你需要二次验证，像前面我们讲的一个翻车，需要做二次验证，你也搞不定这个事你咋办？而且像我们比如说注册了很多账号，像谷歌呀、Twitter什么，这些账号我们都是要去做二次验证的，你不做二次验证就很容易被偷嘛。那你一旦做了二次验证以后，虚拟机里边的这个产品，他怎么去做二次验证？他根本就没法搞。还有一些需要去遵循其他的这种约定俗成的东西，你其实也是没有办法去完全的实现的。而且还有时候呢，这些网站自己还会更新，他更新的时候也不通知你，而且更新了以后到底是不是有bug，其实谁也不知道，经常更新出来那个网站是有bug的嘛。</p>



<p class="wp-block-paragraph">所以呢，你通过这样的一种非常不确定的方式，去连接各种服务的话，到底未来行会变成什么样，到底能不能稳定的去执行任务，我是表示怀疑的。像他这种用仿真浏览器的方式，去执行任务的这种模式呢，更像什么呢？更像是马斯克的纯视觉自动驾驶，说人既然可以搞定，那我用纯视觉的方式车也可以搞定。其他人说我们不太相信这玩意，我们上激光雷达，它更准确。对于我来说，我可能觉得激光雷达会更好一点。</p>



<p class="wp-block-paragraph">所以呢，未来可能是很多的服务，比如说订球票这些东西，应该是一些经过验证以后的安全的API出来，或者是MCP这样的这种服务出来，然后再由这些AI Agent去调用，才有可能让大家很好的把各种的交易串联起来，而不是说像现在似的，我们在各种的防骗网站中间，去点击鼠标，模拟人类点击，这个还是太不靠谱了。</p>



<p class="wp-block-paragraph">那么ChatGPT Agent到底给Manus这种泛Agent的项目带来什么呢？最后我们来回答一下这个问题。首先呢，给结论，这个绝对不是好消息，应该算是又敲响了一次丧钟吧。OpenAI每一次发表新的功能呢，都会有很多的创业项目就直接死掉了。这一次呢应该不算直接枪毙，但是绝对不是一个好的声音。</p>



<p class="wp-block-paragraph">虽然ChatGPT的Agent演示的，跟这个Manus的演示呢，算是各有所长，有些做的好一点，有些做的其实都不怎么样。但其实的结果是什么？ChatGPT也证明了说，这条路最后大概也就能走成这样的一个半半拉拉的样子就完事了。在一个赛道里边，其实不怕老大强大，而怕老大倒下。如果ChatGPT也就只能做成这个样子，那你所有在这个赛道上前进的人，就都比较危险。这是第一个，证明这种范Agent的模式是有问题的。</p>



<p class="wp-block-paragraph">而且呢，这一次虽然OpenAI演示翻了一次车，但是它也验证了另外一个事情是什么？就是模型及应用，你跑这种Agent是非常非常消耗TOKEN的。OpenAI模型是我们自己家的，我自己可以优化，可以定价可以亏钱，但是对于Manus这样的公司来说，模型是别人家的，你对它进行底层优化的能力就没有，那你需用了这些模型以后，你就得老老实实去按TOKEN付钱，去跑这种Agent的项目，你要去按TOKEN付钱的话，那是会跑破产的。</p>



<p class="wp-block-paragraph">在结果不那么靠谱的情况下，无法对模型层面进行优化，完全依靠这个外部调用的话，Manus这种项目其实是没有什么机会的。而OpenAI就是另外一回事，反正没那么靠谱，大家就去用就完了。Plus用户一个月44，Pro用户一个月440，你们就用吧。对于OpenAI来说它又不怕亏钱，每年亏个几十亿上百亿，对于它来说都是正常的。但是你Manus你亏得起这个吗？你亏不起的。</p>



<p class="wp-block-paragraph">所以最终的结论就是，OpenAI的ChatGPT Agent证明了两件事情。第一件事就是，这种泛应用的Agent依然没那么靠谱，就算是OpenAI，也没有办法让这个东西更加靠谱，因为它需要靠模拟人类去点击浏览器的方式去做事情。原来双十一上的时候，也经常是淘宝网站崩了，或者是银行网站崩了，中间需要多做一次验证什么，这种事多去了。所以你现在想让机器去替代人去做点击的话，我觉得这个这条路是有问题的。</p>



<p class="wp-block-paragraph">第二个是什么？第二个就是从成本的角度来去分析，Manus在这个赛道上它也跑不远。这就是今天咱们讲这故事。感谢大家收听，请帮忙点赞点小铃铛，参加<a href="https://discord.gg/ppKsNkttTv" target="_blank" rel="noopener">DISCORD讨论群</a>，也欢迎有兴趣、有能力的朋友加入我们的<a href="https://www.youtube.com/channel/UCUGLhcs3-3y_yhZZsgRzrzw/join" target="_blank" rel="noopener">付费频道</a>。再见。</p>



<p class="wp-block-paragraph"></p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>人形机器人格斗大赛震撼落幕：究竟是遥控玩具的高级对决，还是预示着颠覆性未来科技的真正序章？杭州现场直击宇树G1巅峰对决，深度解析赛事背后的技术突破、商业前景与人类想象力边界。</title>
		<link>https://lukefan.com/2025/05/29/%e4%ba%ba%e5%bd%a2%e6%9c%ba%e5%99%a8%e4%ba%ba%e6%a0%bc%e6%96%97%e5%a4%a7%e8%b5%9b%e9%9c%87%e6%92%bc%e8%90%bd%e5%b9%95%ef%bc%9a%e7%a9%b6%e7%ab%9f%e6%98%af%e9%81%a5%e6%8e%a7%e7%8e%a9%e5%85%b7%e7%9a%84/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Thu, 29 May 2025 00:45:45 +0000</pubDate>
				<category><![CDATA[机器人与具身智能]]></category>
		<category><![CDATA[AI机器人]]></category>
		<category><![CDATA[CCTV10]]></category>
		<category><![CDATA[CMG世界机器人大赛]]></category>
		<category><![CDATA[YouTube频道]]></category>
		<category><![CDATA[中国机器人]]></category>
		<category><![CDATA[人形机器人]]></category>
		<category><![CDATA[人机协同]]></category>
		<category><![CDATA[众擎机器人]]></category>
		<category><![CDATA[前沿科技]]></category>
		<category><![CDATA[动作捕捉技术]]></category>
		<category><![CDATA[国产人形机器人]]></category>
		<category><![CDATA[多机协作]]></category>
		<category><![CDATA[央视直播]]></category>
		<category><![CDATA[央视频]]></category>
		<category><![CDATA[宇树G1]]></category>
		<category><![CDATA[定制机器人]]></category>
		<category><![CDATA[新兴产业]]></category>
		<category><![CDATA[智能机器人]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[机器人产业]]></category>
		<category><![CDATA[机器人对战]]></category>
		<category><![CDATA[机器人平衡算法]]></category>
		<category><![CDATA[机器人技术]]></category>
		<category><![CDATA[机器人控制系统]]></category>
		<category><![CDATA[机器人操作系统]]></category>
		<category><![CDATA[机器人格斗大赛]]></category>
		<category><![CDATA[机器人比赛规则]]></category>
		<category><![CDATA[机器人电竞潜力]]></category>
		<category><![CDATA[机器人研发]]></category>
		<category><![CDATA[机器人竞技]]></category>
		<category><![CDATA[机器人算法]]></category>
		<category><![CDATA[机器人编程]]></category>
		<category><![CDATA[机器人表演赛]]></category>
		<category><![CDATA[机器人视觉]]></category>
		<category><![CDATA[机甲格斗]]></category>
		<category><![CDATA[杭州]]></category>
		<category><![CDATA[科技创新]]></category>
		<category><![CDATA[科技评论]]></category>
		<category><![CDATA[科普展演赛]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[自主战斗机器人]]></category>
		<category><![CDATA[赛事回顾]]></category>
		<category><![CDATA[遥控机器人]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2237</guid>

					<description><![CDATA[家人们！你们知道吗？刚刚结束的人形机器人格斗大赛真的让我整个人都燃起来了啊啊啊啊！5月25日晚上，浙江杭州，全球首个以人形机器人为主角的格斗竞技科普展演赛，CCTV10直播，5亿人次围观！我直接破防了！这不是科幻电影，这是现实啊！

先说重点！这场比赛用的是宇树G1机器人，1.32米高，35公斤重，43个关节，180度广角视野，动作误差不到0.1毫米！看到它们在擂台上空中回旋踢、连续勾拳、精准防御反击，我整个人都傻了！这哪是机器人啊，简直是武林高手下凡！

比赛亮点太多，我必须划重点：
1. **单击格斗演示**：两台机器人秀操作，招招硬核，拳拳到肉，帅到爆！
2. **多机协作展示**：4台机器人编队格斗，灯光音乐配合，模拟围攻突围，科技感直接拉满！
3. **人机协同对抗**：操控手场外遥控，机器人场上开打，踢腿得分比拳头高，平衡性考验太硬核了！
4. **决赛冠军**：黑队“AI测算师”拿下冠军，视觉识别精度0.1毫米，简直是开挂的存在！

最后颁奖环节还预告了12月深圳的“机甲拳王赛”，不同型号机器人可能会参赛，我已经开始尖叫了啊啊啊！这比赛不仅好看，还超级有意义！通过真实格斗收集数据，优化机器人技术，未来可能还会发展成电子竞技产业，想象空间太大了！

家人们，真的不允许有人不知道这场比赛！不看真的会后悔一辈子！赶紧去补回放，感受一下科技的震撼！快来评论区告诉我，你最喜欢哪个战队的机器人？我先站黑队！都给我冲啊！！！🔥🔥🔥

人形机器人格斗大赛震撼落幕：究竟是遥控玩具的高级对决，还是预示着颠覆性未来科技的真正序章？杭州现场直击宇树G1巅峰对决，深度解析赛事背后的技术突破、商业前景与人类想象力边界。

全球瞩目的人形机器人格斗大赛已在杭州圆满落幕！这场由CMG主办、CCTV直播的盛事，以宇树G1机器人为主角，上演了一场精彩的遥控格斗与科普展演。赛事不仅展示了宇树G1机器人在AI测算师、缎机巧匠等战队定制化升级后的惊人格斗潜力与独特技术，更凸显了其在宝贵数据采集、机器人“小脑”训练及推动整体机器人技术进步方面的重要意义。虽然现阶段为遥控操作，但它为未来更高级别的自主格斗、新兴电子竞技产业链乃至全新的商业可能性奠定了坚实基础，预示着更多激动人心的人形机器人比赛正向我们走来。
]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="人形机器人格斗大赛震撼落幕：究竟是遥控玩具的高级对决，还是预示着颠覆性未来科技的真正序章？杭州现场直击宇树G1巅峰对决，深度解析赛事背后的技术突破、商业前景与人类想象力边界。" width="900" height="506" src="https://www.youtube.com/embed/GmnQKPMXcZw?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">人形机器人格斗大赛已经圆满闭幕了。这次有什么好玩的呢？</p>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事的YouTube频道。今天咱们来讲一讲人形机器人格斗大赛。这个应该讲叫一次表演，效果相当不错的比赛。全称呢叫CMG世界机器人大赛系列赛——机甲格斗擂台赛，名字还是很长的。</p>



<p class="wp-block-paragraph">2025年5月25日晚上8点半，在中国浙江省杭州市正式开赛，并于当日晚间圆满落幕。算是全球首个以人形机器人为主体的格斗竞技科普展演赛。它是格斗、竞技、科普、展示、表演这样的一些关键词组合在一起。整个的时间呢一个半小时，8点半开赛到10点钟结束。</p>



<p class="wp-block-paragraph">这个是由中央电视台科教频道（也就是CCTV10）、央视频的网站、央视新闻等同步直播的。全球观众超过5亿人次，大部分应该还是在中国看的吧。但好像台湾那边也有报道，因为毕竟是一个中文比赛嘛。</p>



<span id="more-2237"></span>



<p class="wp-block-paragraph">整个的赛程是什么样的呢？8点半开始，10分钟叫赛事介绍，领导讲话。然后呢展示了一下宇树G1机器人的技术参数，比如什么43个关节呀、180度的广角视野呀，播放了一些赛前训练的花絮，包括机器人对抗、冲击测试、动作捕捉过程及操控者模拟对战的一些画面。</p>



<p class="wp-block-paragraph">这个比赛呢，所有的参赛机器人都是宇数G1，没有其他厂家，没有其他型号，都是这一个。但是呢他这个是需要做一些提前的训练的。因为宇树G1机器人不是一个自主的机器人，需要抱着遥控器的，有点像咱们玩的大疆的无人机似的。参赛选手需要先训练一下，他把这些花絮拿出来放了放。参赛机器人身上呢有很多的刮擦痕迹，你不能说乒了乓了打出痕来，打出印来了给我换一壳，这事不行。咱就拿这个带着很多刮擦痕迹的机器人出来比赛来了。</p>



<p class="wp-block-paragraph">8:40-8:45这5分钟干嘛呢？中央广播电视总台领导致辞，强调赛事对推动机器人技术应用的意义。领导致辞这个事还是非常重要的。</p>



<p class="wp-block-paragraph">然后8:45-8:55十分钟是单击格斗演示。就是我先得把我会的招数给大家练一练，不能说上来乒了乓了就打。光说不练光练不说这事都是不行的，所以先跟大家练一练。两台宇树G1机器人进行了高难度的动作演示，包括空中回旋踢、连续勾拳组合以及精准防御反击，动作误差小于0.1毫米。反正就是他们会讲一讲，我记得叫光说不练是假把式，光练不说是傻把式，咱们还是要去展示展示的。</p>



<p class="wp-block-paragraph">8:55到99:10这一段时间呢是多机协作展示。4台机器人在灯光和音乐的配合下完成了编队格斗，模拟围攻、突围等战术，展示多机实体协同能力。</p>



<p class="wp-block-paragraph">这个现在肯定还是表演性质了。以后会不会有多个机器人协同去抓坏人这样的故事，我觉得还是值得期待一下的。</p>



<p class="wp-block-paragraph">机器人呢，是通过激光雷达和视觉融合定位，实现的厘米级走位精度，全程无碰撞。这肯定就要比春晚转手绢这个事要难得多。</p>



<p class="wp-block-paragraph">9:10-9:50是人机协同对抗。因为四个机器人嘛，首先呢，先需要捉对厮杀一下。他们是抽签分两组去捉对厮杀。这两轮，每一轮呢是3个回合。基本上它的规则是类似于拳击规则，就是击中有效部位多少分，倒地扣多少分。</p>



<p class="wp-block-paragraph">他这个跟拳击的差异是，拳击是不让上脚的，他这可以上脚，而且呢更鼓励你用脚。为什么？一个是用脚的话力量更大一些，第二个的话就是用脚呢，对于机器人的整个平衡性的考验要更大一些。所以呢，他们鼓励用脚，就是拿脚踹上了，这个得分要比给他一拳这个得分要高一些。</p>



<p class="wp-block-paragraph">整个的格斗呢是场内格斗，场外操控。所以呢，上来都是机器人跟人先上来说给大家鞠个躬。下去以后每边角上站一个操控手，举着一个巨大的遥控器，然后机器人就在上面乒了乓开打了。</p>



<p class="wp-block-paragraph">9:35-9:50呢是决赛，得出冠军来。9:50-10点颁奖，然后再做一个预告，就是深圳将于12月举办众擎机器人自由格斗赛。他们呢叫做机甲拳王赛。众擎也是一个机器人品牌。</p>



<p class="wp-block-paragraph">他不可能说，我们众擎机器人来去跟宇树机器人打一架，这不会干这种事的。一定是什么宇树机器人你组织宇树机器人的比赛，我们众擎机器人组织众擎机器人的比赛。相互之间打，这个坏规矩了，这不能乱来。</p>



<p class="wp-block-paragraph">项目是谁主办的呢？你想，它叫CMG。CMG是什么意思呢？就是中央广播电视总台是它主办的。中央广播电视总台下边的叫社交节目中心，以及中央广播电视总台浙江总站、中央广播电视总台技术局协同主办。</p>



<p class="wp-block-paragraph">作为系列赛的一部分，大赛得到了杭州市以及相关单位的支持与协办。赛事的核心技术合作伙伴就是宇树机器人。这个宇树机器人并不是主办方，就是上来提供技术支持的，但是所有的机器人都是他们家的。</p>



<p class="wp-block-paragraph">参赛的团队，机器人跟人都是怎么组成的呢？首先是机器人，都是宇树的G1机器人。这个机器人呢是1.32米高，35公斤重，就是外边卖9万九的那个机器人。但是呢他这个机器人是一个定制版本，就是我们直接在街上买9万9的机器人没有这些能力。</p>



<p class="wp-block-paragraph">他在软件上呢做了一些升级，拥有8套的基本格斗动作，比如说直拳、勾拳，踢腿等等，以及一些组合小连招，甚至还能够执行连贯的出拳、踢腿以及闪避。在这块上呢进行了一些优化，然后头上加了一个护具。</p>



<p class="wp-block-paragraph">这个护具主要的目的呢是分颜色。要不然，你说两个机器人长得一模一样，你在擂台上打来打去的，你咋叫好？裁判也很痛苦。这比赛过程中，上面还有一裁判。这个裁判说：“反正也头一回，挺好玩的这个事情。”</p>



<p class="wp-block-paragraph">团队呢会对机器人稍微做一些调整和升级。所以，最后上去的这四个机器人呢，并不是完全一样的。但是从外表上，可能除了头套的颜色之外，看不太出来有什么差异。选了四个人来操纵这四台机器人去参加比赛。这四个人跟这四台机器人呢，组成了四个小战队。</p>



<p class="wp-block-paragraph">第一个战队呢叫黑队。他的机器人的名字呢叫AI测算师。他的参赛选手呢叫陆鑫，三个金那个鑫。他的身份呢是一个AI博主，算法工程师，昵称叫陆三金，是知名的AI领域内容创作者，擅长通过算法优化，提升机器人决策效率。做这样的一个应该也算个自媒体吧。他的这个机器人呢，做了什么强化？强化了视觉识别模块，提升对手操作捕捉精度至0.1毫米级。你看，你一个机器人，你命令他出拳没毛病，但是你能打着对面的机器人吗？你怎么去对准他？也要需要靠视觉捕捉模块去看。看到了机器人，你这边按操作杆说出拳的时候，他才能对着对面的机器人脑袋“乓当”来一下。你说踢腿或者抬膝，这些东西你还是得看他呢。提升了这个视觉能力。</p>



<p class="wp-block-paragraph">第二个队呢叫粉队，粉色的。这个机器人呢叫做缎机巧匠，锦缎的缎。操作者呢叫做焦天琪，是机械设计专家，格斗游戏职业玩家。这个才是真正的应该参加这种比赛的人，格斗游戏参加竞技格斗大赛的这种冠军。焦天琪他的ID呢叫刀锋体，曾经参与过工业机器人关节设计，同时拥有街霸系列全国冠军头衔，专门打街霸的。优化了关节传动效率，使机器人出拳力度增加了20%。也是做了一些小的改进吧。</p>



<p class="wp-block-paragraph">然后是绿队，叫能量数位。他的参赛者呢叫胡允乾，电力系统工程师。胡允乾是国家电网高级工程师，擅长电力系统稳定性分析。他将电网负载均衡算法应用于机器人动力分配，使机器人在高速移动中保持关节枢纽平衡。他呢加装了能量回收系统，延长了单次续航至2.5小时。我估计国家电网也是赞助单位吧，所以有这样的一位参赛选手。</p>



<p class="wp-block-paragraph">最后一位呢是红队，他呢叫甲胄木兰。这个是一位女性选手，我们还是要政治正确一下。这个叫陈亮宇，是一位非遗传承人，武术爱好者。你看，我们找到了AI的博主，找到了电气工程师，找到了电竞的冠军，现在我们干脆找了一个武术爱好者回来。她呢艺名叫陈喜悦，是苏绣技艺传人，同时呢，精通太极拳和长拳。他将传统武术的以柔克刚理念融入了机器人动作。</p>



<p class="wp-block-paragraph">设计开发了卸力缓冲算法，能将对手攻击能量转换为自身的位移。当然，你看这个比赛的过程中，反正乱七八糟的，你也看不太出来哪招是哪招。</p>



<p class="wp-block-paragraph">采用了轻量化材料，将机器人重心降低了10厘米，以增加稳定性。这是他对机器人进行的改造。参赛者呢，提前进行了操作训练。机器人的优化部分呢，到底是参赛者自己做的，还是说宇树科技的团队根据参赛者的训练情况进行优化的？这个并没有特别详细去说。</p>



<p class="wp-block-paragraph">冠军呢，是黑队，AI测算师。有荣誉，但是好像没有听说有奖金，可能有吧。那么，这种比赛到底有什么意义没有呢？是不是就是一个遥控乐高大赛呢？大家拼个小机器人出来，举个遥控器看看谁跑得快？比这个肯定要复杂很多，因为人形机器人没有那么简单。</p>



<p class="wp-block-paragraph">很多人说，我们干脆就去玩这个电竞格斗不就完了吗？玩街霸就完了，为什么要去玩这东西呢？你像现在机器人训练，也都是号称梦中训练，也就是在英伟达的物理模拟空间里边进行训练。你为什么要真的把一个机器人弄到现实中来，乒了乓啷打一仗呢？</p>



<p class="wp-block-paragraph">这个还是非常非常有意义的。因为你在虚拟环境下再怎么训练，虚拟环境能够模仿到的物理参数和条件永远是有限的。你到了现实环境中，才能够真正的让很多的可控和不可控的因素参与到这种训练中来，参与到格斗中来，才可以让机器人去采集到这些数据。只有拿这样的数据再去训练，这个机器人才可以变得更好。</p>



<p class="wp-block-paragraph">而且，宇树机器人也不仅仅是个花架子。虽然我前面可能讲了一些，说这个东西比起擎天柱、比起figure 01有一定的差距，因为毕竟人家那是个自主机器人嘛。你这个东西，就是个上遥控器的遥控机器人。但是你要想想，他一手柄，这个手柄是俩摇杆，12个按键，再加上一些语音指令。他可以喊说左勾拳、右勾拳，然后这个机器人也是动的。</p>



<p class="wp-block-paragraph">但是你靠这些按键跟摇杆，你是不可能完整控制机器人的。机器人相当于是有一个很发达的小脑，大脑是由外边的遥控器来搞定的，小脑是机器人自己搞的。机器人的平衡性、机体的可靠性这块还是相当强的。</p>



<p class="wp-block-paragraph">你命令机器人出拳，机器人会不会把自己摔倒？或者出拳的过程中，能不能打到对面的机器人？然后对面的机器人挨了一拳头以后，你到底是倒在地上，还是说我能够招架呀？还是说我可以自动的去调整重心，做哪些防御姿势？</p>



<p class="wp-block-paragraph">可能对于对面的机器人操作手来说，你最多有一个按键叫防御，或者上防御、下防御，可能能加一个组合键干这样的事情。但是这个机器人的很多被动的这种动作，比如说挨了一拳了，我做了个防御，或者我没有做防御。</p>



<p class="wp-block-paragraph">我需要向后倒退几步，然后重新找回重心。或者说，没有找回重心，直接摔倒。这个东西还是要机器人自己去决策的。所以，通过这个机器人的格斗比赛，还是能够看出来，宇树机器人在这块还是做的相当不错的。</p>



<p class="wp-block-paragraph">当我们能够把这样的机器人比赛多做几次之后，收集了相应的数据，对于机器人编程上面的一些优化，对于机器人相关大模型的训练，还是有非常非常重要意义的。而且，这个比赛呢，也给后面的比赛打样了。我们这次做完了，下回你就照我这样做，或者我在我这个基础上再调整调整，往前走就可以了。这个意义也是很重大的。</p>



<p class="wp-block-paragraph">这一次呢，还是同一个型号的机器人去比赛。那以后呢，应该会有不同型号的机器人参赛。据说在深圳这一次重型机器人比赛，就会允许不同的机器人去参赛。那但是人形机器人嘛，他要求的你必须是人形，四个腿着地的不行，必须是两个腿直立的，有躯干有四肢的。而且呢，你必须是成年体。你说我这做一个5米高的，或者做一个这个50公分的，这种是不允许来参赛的。大概是一米三到这个一米九之间的吧，你可以来参赛。这个是未来的一些改进。</p>



<p class="wp-block-paragraph">而且呢，以后还可以对机器人进行更多的改造和升级。这一次我们刚才讲了，四个机器人是按照四个不同的方向去进行了升级和改造。那以后可能会有更多的学校说，我们也试试，我们买一个99,000的机器人回来，把它改造升级一些什么样的部件上去，我们也去参加个比赛去。这个都是允许的。还有很多的软件是可以改造升级进去的。我们把这个罗汉拳弄进去，我们把太极拳弄进去，把这个招数多训练一点小连招。他可能12个按键里头，有些按键一按就是一个小连招，一起就发出去了。其实我们在玩游戏的那个手柄的时候，也这么干。这块就可能更多的人会参与到这种比赛里边来。</p>



<p class="wp-block-paragraph">而且，你可以对机器人进行改造的话，那以后是不是可以有器械赛？咱们这次都是空手，下回能不能有剑盾手上来，或者刀盾手，有什么长枪手上来，也还是有很有想象空间的一个事情。</p>



<p class="wp-block-paragraph">以后的话，可能还会有更精细的操控。这一次呢，操控大家还是看个热闹。那这可能未来是一种电子竞技呢。电子竞技是一个单独的产业，很多人在这个里边去形成战队，做各种的训练，做各种比赛，然后还去卖比如授权呀，卖各种的冠名广告。这是一个很大的一个产业链。那以后是不是机器人的这种格斗比赛，就会形成一个新的产业链呢？电子经济产业链。很多的科幻电影，就是以这个故事为背景编出来的。我们应该已经看了一些这样的电影了。</p>



<p class="wp-block-paragraph">现在呢，还都是遥控比赛。你说到某一天……</p>



<p class="wp-block-paragraph">会不会有这种自主战斗比赛？可能在未来的一两年里头，应该也会看到，还是非常值得期待的。</p>



<p class="wp-block-paragraph">最后呢，我们总结：更多更有意义的人形机器人比赛，正在向我们走来。首先，这是一件非常有趣的事情，而且非常有意义。多一些包容，不要上来说“呀，这有什么意思，怎么怎么样”。你去嘲笑这个事情的时候，对于整个行业，甭管是对中国人的机器人产业，还是对美国人的机器人产业，或者对世界的机器人产业，都不会有任何帮助的。</p>



<p class="wp-block-paragraph">我们要看到里边有意义的部分。很多新的商业可能性，正在通过这一次比赛，逐渐地展示在我们面前。</p>



<p class="wp-block-paragraph">好，这就是今天讲的故事。感谢大家收听，请帮忙点赞、点小铃铛，参加DISCORD讨论群。也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见！</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>从乔布斯“灵魂伴侣”到山姆奥特曼的座上宾，强尼艾夫的IO团队以65亿美金估值并入OpenAI，是AI iPhone的黎明将至，还是又一个AI硬件泡沫的开始？</title>
		<link>https://lukefan.com/2025/05/26/%e4%bb%8e%e4%b9%94%e5%b8%83%e6%96%af%e7%81%b5%e9%ad%82%e4%bc%b4%e4%be%a3%e5%88%b0%e5%b1%b1%e5%a7%86%e5%a5%a5%e7%89%b9%e6%9b%bc%e7%9a%84%e5%ba%a7%e4%b8%8a%e5%ae%be%ef%bc%8c%e5%bc%ba/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Mon, 26 May 2025 00:40:54 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[65亿美金收购]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[AI iPhone]]></category>
		<category><![CDATA[AI Pin]]></category>
		<category><![CDATA[AI伴侣]]></category>
		<category><![CDATA[AI助手]]></category>
		<category><![CDATA[AI手机]]></category>
		<category><![CDATA[AI硬件收购]]></category>
		<category><![CDATA[AI设备]]></category>
		<category><![CDATA[AI趋势]]></category>
		<category><![CDATA[Apple]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[GPT-5]]></category>
		<category><![CDATA[HCI]]></category>
		<category><![CDATA[IO团队]]></category>
		<category><![CDATA[Jony Ive]]></category>
		<category><![CDATA[LLM]]></category>
		<category><![CDATA[Love From]]></category>
		<category><![CDATA[M&A]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[Sam Altman]]></category>
		<category><![CDATA[Scaling law]]></category>
		<category><![CDATA[UX]]></category>
		<category><![CDATA[YouTube]]></category>
		<category><![CDATA[乔布斯]]></category>
		<category><![CDATA[交互革命]]></category>
		<category><![CDATA[产品设计]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[人机交互]]></category>
		<category><![CDATA[企业估值]]></category>
		<category><![CDATA[可穿戴AI]]></category>
		<category><![CDATA[多模态AI]]></category>
		<category><![CDATA[大语言模型]]></category>
		<category><![CDATA[孙正义]]></category>
		<category><![CDATA[山姆奥特曼]]></category>
		<category><![CDATA[工业设计]]></category>
		<category><![CDATA[强尼艾夫]]></category>
		<category><![CDATA[微软]]></category>
		<category><![CDATA[情绪感知]]></category>
		<category><![CDATA[手势识别]]></category>
		<category><![CDATA[播客]]></category>
		<category><![CDATA[无屏交互]]></category>
		<category><![CDATA[智能硬件]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[用户体验]]></category>
		<category><![CDATA[硬件创新]]></category>
		<category><![CDATA[科技创业]]></category>
		<category><![CDATA[科技并购]]></category>
		<category><![CDATA[科技行业分析]]></category>
		<category><![CDATA[科技评论]]></category>
		<category><![CDATA[移动互联网]]></category>
		<category><![CDATA[纯股票交易]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[自然交互]]></category>
		<category><![CDATA[苹果公司]]></category>
		<category><![CDATA[语音交互]]></category>
		<category><![CDATA[软银]]></category>
		<category><![CDATA[风险投资]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2224</guid>

					<description><![CDATA[家人们！你们听说了吗？？？OpenAI直接砸了65亿美金，把设计界的神级人物——强尼·艾夫爵士的IO团队给收购了！啊啊啊啊啊！我真的要尖叫了！这可是乔布斯的“灵魂伴侣”，设计出iPhone、iMac、Apple Watch的男人啊！现在他要和OpenAI一起搞AI硬件，2026年可能直接推出“AI iPhone”或者“AI伴侣”？？？我已经开始尖叫了，你们呢？！

先划重点！强尼·艾夫是谁？他是定义了移动互联网时代设计的男人，苹果的经典风格都是他一手打造的！现在OpenAI找他合作，简直就是强强联手，目标直指“卖1亿台”的革命性产品！无屏交互、情绪感知、手势识别……这些黑科技听起来就让人头皮发麻！😱

再来说说这个AI硬件有多炸：

无屏交互：告别传统屏幕，眼球追踪+手势识别，简直像科幻电影！
情绪感知：不开心？它能懂你，还能逗你开心，简直是贴心小棉袄！
AI伴侣：不仅是设备，更是生活中的第三个核心装备，继手机、电脑之后的新王者！
老实说，之前AI硬件赛道上扑街的产品不少，但这次不一样！OpenAI的模型能力已经逆天了，语音交互、实时搜索、视觉推理，样样拿手！再加上强尼·艾夫的设计加持，我真的要喊一句：这波不冲还等啥？！

最后，2026年我们一起见证奇迹好吗？！我已经开始攒钱了，家人们，你们准备好了吗？不关注这个消息真的会后悔一辈子啊！快点赞收藏，咱们一起蹲这个AI时代的“iPhone”！冲冲冲！🔥

从乔布斯“灵魂伴侣”到山姆奥特曼的座上宾，强尼艾夫的IO团队以65亿美金估值并入OpenAI，是AI iPhone的黎明将至，还是又一个AI硬件泡沫的开始？

震撼！OpenAI以65亿美金估值（实为50亿美金纯股票交易收购剩余77%股份）将苹果设计传奇强尼艾夫爵士及其IO团队收入囊中，目标直指传说中的AI iPhone！这笔“牛马级并购”背后，是山姆奥特曼与乔布斯“灵魂伴侣”的世纪联手，他们能否凭借IO团队在无屏交互、情绪感知及GPT-5等先进AI模型的加持下，成功打造出销量过亿的AI伴侣与AI硬件，引领下一波交互革命，打破AI硬件屡败魔咒？老范讲故事为你深度解读这起并购的资本运作与AI硬件的未来前景。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="从乔布斯“灵魂伴侣”到山姆奥特曼的座上宾，强尼艾夫的IO团队以65亿美金估值并入OpenAI，是AI iPhone的黎明将至，还是又一个AI硬件泡沫的开始？" width="900" height="506" src="https://www.youtube.com/embed/oukycZpmJpE?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">OpenAI以65亿美金收购了强尼艾夫爵士的IO团队，要做AI iPhone了吗？大家好，欢迎收听老范讲故事的YouTube频道。</p>



<p class="wp-block-paragraph">OpenAI最大的硬件收购来了。没办法，他自己3,000亿美金的估值了，现在收购任何的团队都是比较贵的，所以又变成了有史以来最大的AI硬件团队收购。这一次呢，是以50亿美金的纯股票交易收购强尼艾夫创建的IO团队手里边77%的股票。</p>



<p class="wp-block-paragraph">这个团队呢，2023年底其实已经被OpenAI投资过了。当时投资了以后占股了是23%。这一次呢，等于是交50亿美金，或者叫以50亿美金的对价收购了剩余的77%的股票。这个65亿美金怎么算出来的？很简单，50亿除0.77就等于65了。所以它的总价值呢，是按照50亿美金收购77%股票的方式反推出来的。</p>



<span id="more-2224"></span>



<p class="wp-block-paragraph">强尼埃夫爵士到底是一个什么样的人？首先在这里澄清，这是个异性恋。不是说拍了一张跟山姆奥特曼特别亲密的照片就变成同性恋了。到目前为止，人家婚姻美满，还有小孩。</p>



<p class="wp-block-paragraph">强尼艾夫是2012年被英国女王伊丽莎白二世授予爵士头衔，所以我们管它叫强尼埃夫爵士。他呢，属于大英帝国最优秀的骑士勋章，叫Knight Commander of the Order of the British Empire（骑士司令官）。这一荣誉是对他设计领域的卓越贡献，主导了iPhone、iMac等划时代的产品，以及推动了英国创意产业发展的认可。授勋仪式在白金汉宫举行，由安妮公主代表女王执行。</p>



<p class="wp-block-paragraph">他呢，号称是乔布斯的soulmate，就绝对是灵魂伴侣。成功的产品从1998年的iMac G3（也就是那个半透明彩色机壳的一体机）开始，到2001年的iPod（应该是很小的那个东西），再到2007年的iPhone 1，2010年的iPad，2014年的Apple Watch，最后还设计了2017年的Apple Park（也就是现在那个大飞碟那个楼）。基本上，我们能够熟悉的苹果设计风格就是强尼艾夫爵士他定义的。</p>



<p class="wp-block-paragraph">专利数字非常巨大。这个设计师是相对来说比较容易去申请专利的，拥有超过1.4万项全球专利，涵盖硬件、软件、包装等领域。其中美国专利是1,628项，包括iPhone的玻璃机身、Apple Watch的表带连接结构等核心设计。</p>



<p class="wp-block-paragraph">2019年呢，强尼艾夫离开了苹果去创业去了。他呢，做这公司叫Love From（就是爱从哪来）。他呢，设计了很多漂亮的字体。</p>



<p class="wp-block-paragraph">年入2亿美金的设计公司，他是跟AirBNB、法拉利等企业合作，重新定义了品牌战略。非常强的一位设计师，基本上算是定义了整个移动互联网时代的产品设计、交互设计。这样的一次并购，OpenAI前面投了23%，后来把后边77%直接买下来了。到底是一个什么样的故事呢？咱们从资本的角度稍微的去理一理。</p>



<p class="wp-block-paragraph">这个事情并没有这么简单。因为大家注意，前面并购的时候有一个词叫做“纯股票交易”，这里头没现金。一般涉及纯股票交易的这种并购呢，通常都不是一个特别愉快的故事。真正愉快的并购是什么？你花钱买，买完了以后我变成亿万富翁，然后出去天天玩耍。这样被并购的就是Minecraft（我的世界）的创始人，当时被微软并购了以后，就拿着大笔的钱开始挥霍，一直到目前为止还在挥霍，还没挥霍完。这个是愉快的故事。</p>



<p class="wp-block-paragraph">“牛马级并购”呢，就是这个纯股票的并购，里头没现金，并购完了以后接着当牛马打工去。一般是发生了一些比较特殊的情况，才会出现这种纯牛马并购，或者叫纯股票的并购。我们来看看OpenAI吧，它自己现在的估值是多少钱呢？3,000亿美金。那么50亿美金的纯股票相当于多少股票呢？不是相当于50亿美金的股票吗？咱们不讲这个故事，相当于他的1.67%的股份。其实没多少，就是拿了1.67%的股份，我就直接把你这个IO全都收归旗下了。</p>



<p class="wp-block-paragraph">假设2023年底的第一次投资，因为是OpenAI投了头一回嘛，23%的股票，也是给的股票。因为OpenAI其实手里并没有那么多现金，即使是给了一些现金的话，这个里头大部分应该还是股票。当时呢，并没有对估值进行公布。但是呢，以强尼·艾夫的名声和履历来看，这个投资不会太便宜。所以呢，大家一拍脑袋给了一个小目标？这个不是小目标，给了一个独角兽，这个是比较合理的。一个独角兽多少钱？10亿美金占23%，这样的话它的估值大概40多亿美金。这是当时的这个交易，虽然没有公布，但是应该差不多就是这样。</p>



<p class="wp-block-paragraph">你想，山姆·奥特曼跟强尼·艾夫两个人坐在一起，也不可能说“我们这个9亿8，9亿9还是10亿零一”，这不可能是干这样的事嘛。肯定是一拍脑袋来，10亿占23%。当时的OpenAI的估值是多少钱呢？是800亿美金。所以呢，当时应该是给了OpenAI 1.25%的股份。强尼·艾夫手里边应该也不是特别缺钱，苹果的股票肯定就很值钱，再加上他后面的这个Love From从AirBNB、从法拉利手里头再挣的钱，每年都在挣钱。</p>



<p class="wp-block-paragraph">所以，当时我估计他拿股票的概率也很大。但是据说呢，IO项目里头还有一些其他的投资者。这个事呢，我也去查了一下，并没有特别确切的说明里头到底有哪些投资者，是按什么样的估值进去了，到底给了多少钱。这个事不是那么清晰。</p>



<p class="wp-block-paragraph">里头比较著名的就是软银的孙正义，据说是当时给了钱了。而且呢，当时给钱的时候好像是跟山姆·奥特曼、强尼·艾夫在一起，说他也出了一部分钱。但是这个钱到底是怎么出的，没有找到确切的说法。</p>



<p class="wp-block-paragraph">现在好了，包括软银的孙正义以及其他的一些投资人，和Love From的其他的这些老股东——因为当时IO是Love From去成立的，Love From是他的一个股东——现在等于这些人一扭脸，全都变成了OpenAI的股东了。因为OpenAI拿了50亿美金1.67%的股份出来说：“我把这个IO的77%股份给你收掉。”那么原来这些持股人就都通通变成了OpenAI的股东。</p>



<p class="wp-block-paragraph">做硬件这件事呢，本身还是挺烧钱的。不是说设计个字体，或者说我给你参加几个研讨会就可以拿到钱的。而且呢，IO这个团队，甭管它的创始团队或者说里边的员工背景有多么光鲜，它呢其实没有真正的产品面世。虽然说他做了一些尝试性的产品，但是哪个都没面世。</p>



<p class="wp-block-paragraph">而且前面呢，被寄予厚望的AI Pin这样的AI产品，号称是AI时代的iPhone，这样的产品呢也没什么响动。而且AI Pin呢还有一个比较讨厌的什么，那也是苹果离职员工干的，也是充满了苹果基因的产品，最后也直接扑街了。</p>



<p class="wp-block-paragraph">所以在这样的一个情况下，我们会发现IO身上聚集了很多的特性：第一个，很高的估值——前面40亿美金的估值，啥也没做出来过；而且整个赛道上铺满了尸体，不光是AI Pin，还有什么AI Rabbit还是什么，反正有一堆类似这样的产品都在前头死掉了。</p>



<p class="wp-block-paragraph">这个方向呢，所有投资人再冲上去就会谨慎一些。你如果估值低呢，再加上团队还不错，没准还有人愿意去试一试；你估值很高，这个玩意就没法整了。而且这不是一个硬件产品团队，这是一个设计师团队，他没有成功运营过硬件产品，这也是一个挺大的硬伤。</p>



<p class="wp-block-paragraph">再加上创始团队又特别豪华，强尼·艾夫爵士号称是定义了整个移动互联网时代的人，他做的公司你给一个比较低的估值，自己也不好意思。所以他这样的团队聚集了所有这些特性在身上，以后你再出去谈融资就会比较麻烦，没有人敢接这个活。就算是给了钱了，你还得给一个跟他们匹配的价格。在这里头没人敢贪小便宜，说我用一特别低的价格。</p>



<p class="wp-block-paragraph">我把它投了。这种出去会被人骂的，所以他这种公司很难融资。</p>



<p class="wp-block-paragraph">现在呢，现金肯定是非常紧俏的。估值不值钱，现金紧张，就只能达成选股票交易的这种并购了。而且大家要注意什么呢？在并购的过程中，估值涨没涨？估值没涨多少。他上一轮的投资，我们刚才推测了——不是猜测，是推测——他的估值大概是40多亿美金。这一次呢，涨到65亿，就属于是什么呢？就给大家有个交代，确实涨了。</p>



<p class="wp-block-paragraph">但是正常的这种热火烹油的赛道里头，这样的投资，这样的并购，经常3倍到5倍的估值上升，你才能把它卖掉。现在等于你涨了个30%吧。而且这也是一年半了吧？至少是2023年底到现在，2025年到年终了，一年半了才涨了这点估值，其实是说明整个团队运营的情况并不是很好。</p>



<p class="wp-block-paragraph">OpenAI手里边现金其实也不多。别看那么多人给他钱——微软给了100多亿，软银给了他400多亿——但是微软给的钱呢，很多应该是代金券。就是说我给你钱了，但是这个钱呢，我现在先不给你，我帮你存着，怕你去乱花。等你什么时候给你呢？上微软云租算力的时候，我就帮你抵扣掉。微软给的很多肯定是这种东西。</p>



<p class="wp-block-paragraph">软银那400多亿美金，应该给的真金白银吧？可能有一部分会折算成星际之门的一部分，里头肯定会有一部分现金，但是也不会特别多。大家投资的时候都是尽量少给现金的。</p>



<p class="wp-block-paragraph">OpenAI手里边的现金还要干嘛呢？还有一个很重要的用途：他有好几千人呢，而且还要不断的用高薪、高股票继续再去挖人去。所以他需要去维持一个几千人团队的运转，而且这些人的薪水都很高，所以他的现金也比较紧张。</p>



<p class="wp-block-paragraph">那么干脆说，拿个1.67%的股票出来，大家皆大欢喜一下就完事了。只是呢，多了几张嘴出来吃饭就完了。完全收购了以后，原来IO的这些员工，你们现在就算OpenAI的员工了，OpenAI给你们开薪水，这件事就结束了，没有什么其他的动作。</p>



<p class="wp-block-paragraph">真正火的并购，刚才我们讲了，高溢价，涨个3倍到5倍，要有一堆人去抢。如果没有人抢，这事不行。拿到钱的人要欢天喜地的庆祝，要开始这种堕落之旅，这个才叫真正的好的并购。牛马并购价估值涨那么一点点，像是这个40多亿涨到65亿，大家呢拿到的都是纸，全是股票。并购完了以后，好好干干活，上班去，就是有这样的差异。</p>



<p class="wp-block-paragraph">甭管并购是怎么完成的吧，是开心也好，不开心也好，几家欢喜几家愁也好，我们总还是要期待一下，强尼艾夫爵士到底准备搞点啥事。OpenAI和IO团队呢，都没有宣布过他们要干什么。</p>



<p class="wp-block-paragraph">你到底要做一个什么类型的产品？谁也没说过。因为前面这条赛道上已经躺满了尸体了，躺了好几个了，而且都是寄予厚望，都有苹果基因，都是上来就见光死，直接扑街。</p>



<p class="wp-block-paragraph">IO呢，前面是发表过一些硬件原型产品，包括感知用户情绪的智能眼镜、可折叠成钱包大小的投影设备，以及彻底取消屏幕的语音交互装置。但是具体最后它要造出一个什么东西，还不知道。而且呢，IO已经申请了12项专利了，与无屏交互相关的技术专利，通过机电信号捕捉手势的这种指环设备，基于空间音频的导航系统。</p>



<p class="wp-block-paragraph">什么叫机电信号捕捉手势呢？就是带一指环在上头，但是我们这个手动的时候，是有一些机电信号是可以捕捉到的。就是你在指环上做一些传感器，它可以知道你这个手在做什么动作。这个还是要一些技术的。</p>



<p class="wp-block-paragraph">我给大家讲一个特别好玩的东西吧。咱们用这个手环，或者我们管它叫手表这种东西，去做计步器，说记录一下我们到底走了多少步。这事很复杂，千万不要以为说，我们在手表里头装一个运动传感器，记一下你到底走了多少步就能记下来。不是这么回事。你这个手表里的运动传感器得到的那个数据是非常混乱的。你像我们走的时候手还要摆动，还要做一些其他的动作。你最后要把所有这些干扰都去掉了以后，才能够算出来你到底是走了多少步。</p>



<p class="wp-block-paragraph">你想你在手腕上记一东西，你最后要记录脚的动作，那他这个干扰大去了。像咱们最早的计步器都是搁哪的呀？都是别在腰带上的。那个时候机械计数器都是往腰带上一别，你就没有什么其他的运动干扰你，可以记的比较准。但现在你想你戴在手上，你还要把这个东西记下来很麻烦的。所以你现在要在指环上，通过机电信号收入了以后，再去把这些乱七八糟东西过滤掉，然后去判断你到底在做什么手势。这个还是有点技术难度的。</p>



<p class="wp-block-paragraph">咱们就说手表记步这个事。你去戴这个华为的表带、小米的表、苹果的表，他们每一个设备记出来的步数不一样。你把这小米手机、华为手机跟苹果手机，你揣身上走一天，你看看这技术的步数也是不一样。咱们就再用这个计步器的故事跟大家讲一讲，这种专利还是需要一些聪明才智的。</p>



<p class="wp-block-paragraph">现在呢，OpenAI跟IO呢，是准备推出一个销量可以超过1亿只的AI iPhone。他们定义的什么叫成功？什么叫划时代？什么叫革命性？就是我卖掉1亿个，这个就叫革命性了。你如果卖不到1亿个，这个就不叫。其实iPhone一也没有卖到1亿，现在是有了。因为小米是第三名吧，大概是1.7亿一年，三星是第一名，可能是2亿多吧。</p>



<p class="wp-block-paragraph">这个具体数字我们就不查了。但是iPhone一出来的时候，卖的不是那么多的。现在呢，他们计划2026年推出首款的AI硬件产品，定位呢是口袋里的智能体，或者呢叫AI伴侣。</p>



<p class="wp-block-paragraph">这个到底是一个什么样的东西？我们通过这些文字，其实还是比较难想象的。因为前面已经有了挂在脖子上的了，有夹在身上的了，有这个耳机型的了。这个到底是做出一个什么来，我们还要再去等待。</p>



<p class="wp-block-paragraph">但是呢，有几点是基本上确定的：<br>第一个就是无屏交互，突破传统屏幕限制，通过多模态感知、视觉语音、环境分析实现自然交互。例如通过眼球追踪和手势识别来输入指令。其实眼球追踪跟手势识别的话，Vision Pro就是这么来去交互的，已经有人做出来了，也是苹果家的东西嘛。</p>



<p class="wp-block-paragraph">第二个呢，就是要去做情绪感知。原来所有的这些手势识别也好，眼神跟踪也好，是没有情绪感知的。但是呢，现在你把这个图片扔给了Gemini以后，你是可以进行情绪感知了。所以未来情绪感知会在里面，能够实时理解用户的环境和需求，提供个性化服务，如实时翻译、情绪支持等等。你要不开心了，我要稍微逗你开心一下。</p>



<p class="wp-block-paragraph">原来我们经常说这个人工智能是人工智障，是怎么回事？就是它听不出来你现在开不开心，听不出来你到底想要什么。甭管你跟他多开心的讲，还是多不开心的讲，他都是一成不变的，在完成他自己认为的任务。</p>



<p class="wp-block-paragraph">这个设备呢，将无缝的融入生活设备，可能为穿戴式设备或者是家用终端，旨在成为用户继智能手机和笔记本电脑之后的第三个核心装备。这就是他们准备干的事情。</p>



<p class="wp-block-paragraph">和AI PIN比起来到底有什么不一样？因为AI PIN算是苹果基因，也是苹果团队做的一个失败产品，而且当时也是寄予厚望了。其实最大的差别呢，硬件到底有什么差别咱不知道，因为没看到嘛。但是模型的能力，这一段时间是有巨大提升的。</p>



<p class="wp-block-paragraph">第一个，增强语音模式。我们现在可以跟OpenAI的ChatGPT去聊天，去了还聊得很开心。你还可以随时打断它，用全世界各种语言聊天都很好。</p>



<p class="wp-block-paragraph">第二个，它可以进行实时搜索了。原来你跟ChatGPT去聊天，等于他都是我的最新知识库，截止到某年某月某日，我的知识没有了。你聊了半天，基本上都是在一本正经的胡说八道，这个是不行的。现在有实时搜索了以后，你就可以跟他聊一些今天怎么样、昨天怎么样、最近有什么样的东西，这事都可以聊了。</p>



<p class="wp-block-paragraph">然后视觉推理出来了，GPT-4里边已经有视觉推理了。你给它一张图片以后，它可以放大缩小，拆成一小块一小块的，然后调整角度。</p>



<p class="wp-block-paragraph">告诉你这都是什么？再进行整个的推理。这块已经强的一塌糊涂了，再加上长记忆。你现在跟他聊了半天，他知道你是谁，知道你原来问过什么，知道你的习惯。这个现在也是一个长足的进步。</p>



<p class="wp-block-paragraph">还有什么进步？就是MCP跟agent已经都上来了。原来你只能跟它聊天，最多可以搜索。现在说你给我订餐，你给我去查各种地图，给我去做各种的交易，它都可以直接实现了。所以在这一段时间，大模型有了长足的进步。如果把AI PIN这样的产品结合，今天的模型未必会失败的那么惨吧。</p>



<p class="wp-block-paragraph">现在OpenAI跟IO赶上这个模型进步了以后，这个人生伴侣也有可能是能够做出来的。IO呢，会获得更多的模态。原来我们讲ChatGPT可以干嘛？文字、语音、视频、图像，你可以做这样的这么多的模态的输入。现在有了IO了以后，什么电信号，什么运动传感器，我们可以把这样的一大堆的信号都给它塞进去。当引入了更多的传感器数据之后，这个模型训练了就可以变得更加聪明。</p>



<p class="wp-block-paragraph">到目前为止，我们相信scaling law依然是有效的。你怎么能够拿到更多的数据，让这个scaling low往前走呢？你说我的文字的语料就这么多了，但是我现在可以拿出大量的运动数据，进去重新训练模型，这个事情就又可以往前走了。</p>



<p class="wp-block-paragraph">而且OpenAI呢也准备在今年发布all-in-one的GPT5。就是你到了ChatGPT以后，不用再去选我要用4O，要用4.1，还是要用4.5，还是要用O3，O4 mini，就叫GPT5。你只管提出你的要求，然后它去根据你的要求，根据情绪判断来判定，我到底要用哪一个模型来替你服务。</p>



<p class="wp-block-paragraph">所以当所有这些都实现的时候，2026年我们还是可以期待一个非常有趣的产品呢。每一次大的交互革命都会带来一波红利。上一波的交互革命是什么？是触控。iPhone呢就是上一波红利的开山之作。自然交互呢一定是在触控之后的下一波交互革命吗？这个事呢我还不确定，因为也有可能直接跳过。</p>



<p class="wp-block-paragraph">再往后的一波交互革命，现在已经知道是什么了，就是脑机接口。像最开始我们是键盘鼠标，键盘鼠标前边还有什么？打孔卡，咱们就不研究了。到后面我们开始用笔在屏幕上写来写去，到iPhone这里就是说我们用触控，多点触控去实现交互。</p>



<p class="wp-block-paragraph">中间还有一点点小的波折是什么？就是任天堂玩的这种体感，这个也算是一个小的交互革命，但是并没有引起颠覆性的时代的更新。再往后呢就是马斯克的这个脑机接口。中间这个到底能不能成为一个划时代的？</p>



<p class="wp-block-paragraph">说我们整个定义一个新时代还要看，也有可能就像任天堂的体感这样，在一个相对小众的范围内进行传播的可能性也是存在的。</p>



<p class="wp-block-paragraph">总结一下，OpenAI 65亿美金收购了强尼艾夫爵士创办的IO这个团队。不管收购的过程有多少资本的故事，还是能够期待一下，自然交互可能会给我们带来一波新的爆发与红利的。期待强尼艾夫爵士给我们带来新的AI时代的iPhone吧。</p>



<p class="wp-block-paragraph">好，这个故事今天就跟大家讲到这里。感谢大家收听，请帮忙点赞、点小铃铛，参加DISCORD讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>200元租个外骨骼机器人轻松爬泰山？中国赛博化浪潮已席卷大山脚下，从户外运动到银发经济，未来科技触手可及。</title>
		<link>https://lukefan.com/2025/05/13/200%e5%85%83%e7%a7%9f%e4%b8%aa%e5%a4%96%e9%aa%a8%e9%aa%bc%e6%9c%ba%e5%99%a8%e4%ba%ba%e8%bd%bb%e6%9d%be%e7%88%ac%e6%b3%b0%e5%b1%b1%ef%bc%9f%e4%b8%ad%e5%9b%bd%e8%b5%9b%e5%8d%9a%e5%8c%96%e6%b5%aa/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Tue, 13 May 2025 00:48:43 +0000</pubDate>
				<category><![CDATA[机器人与具身智能]]></category>
		<category><![CDATA[YouTube频道]]></category>
		<category><![CDATA[中国]]></category>
		<category><![CDATA[中国模式]]></category>
		<category><![CDATA[中国科技]]></category>
		<category><![CDATA[人体增强]]></category>
		<category><![CDATA[人机结合]]></category>
		<category><![CDATA[低成本]]></category>
		<category><![CDATA[体育锻炼]]></category>
		<category><![CDATA[健身]]></category>
		<category><![CDATA[军用外骨骼]]></category>
		<category><![CDATA[农业科技]]></category>
		<category><![CDATA[减轻负重]]></category>
		<category><![CDATA[动力外骨骼]]></category>
		<category><![CDATA[助力行走]]></category>
		<category><![CDATA[助力设备]]></category>
		<category><![CDATA[可穿戴]]></category>
		<category><![CDATA[可穿戴设备]]></category>
		<category><![CDATA[商业模式]]></category>
		<category><![CDATA[外骨骼]]></category>
		<category><![CDATA[外骨骼机器人]]></category>
		<category><![CDATA[外骨骼租赁]]></category>
		<category><![CDATA[工程外骨骼]]></category>
		<category><![CDATA[市场化]]></category>
		<category><![CDATA[康复医疗]]></category>
		<category><![CDATA[康复外骨骼]]></category>
		<category><![CDATA[快速迭代]]></category>
		<category><![CDATA[意图识别]]></category>
		<category><![CDATA[户外运动]]></category>
		<category><![CDATA[技术应用]]></category>
		<category><![CDATA[技术普及]]></category>
		<category><![CDATA[控制论 (Cybernetics)]]></category>
		<category><![CDATA[新风口]]></category>
		<category><![CDATA[旅游]]></category>
		<category><![CDATA[无人机]]></category>
		<category><![CDATA[时事观察]]></category>
		<category><![CDATA[景区应用 (泰山]]></category>
		<category><![CDATA[智能传感]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[未来趋势]]></category>
		<category><![CDATA[机器人技术]]></category>
		<category><![CDATA[机械狗]]></category>
		<category><![CDATA[植保无人机]]></category>
		<category><![CDATA[民用]]></category>
		<category><![CDATA[民用科技]]></category>
		<category><![CDATA[消费级]]></category>
		<category><![CDATA[淘宝]]></category>
		<category><![CDATA[爬山]]></category>
		<category><![CDATA[物流搬运]]></category>
		<category><![CDATA[电助力]]></category>
		<category><![CDATA[电池续航]]></category>
		<category><![CDATA[登山]]></category>
		<category><![CDATA[登山外骨骼]]></category>
		<category><![CDATA[社会影响]]></category>
		<category><![CDATA[科技]]></category>
		<category><![CDATA[科技伦理]]></category>
		<category><![CDATA[科技评论]]></category>
		<category><![CDATA[租赁]]></category>
		<category><![CDATA[老年人]]></category>
		<category><![CDATA[老年人助力]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[膝盖保护]]></category>
		<category><![CDATA[赛博化]]></category>
		<category><![CDATA[赛博朋克]]></category>
		<category><![CDATA[运动能力提升]]></category>
		<category><![CDATA[银发经济]]></category>
		<category><![CDATA[高原补给]]></category>
		<category><![CDATA[黄山)]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2179</guid>

					<description><![CDATA[啊啊啊啊啊啊！家人们！我今天真的被震撼到破防了！200块钱就能租一个外骨骼机器人，帮你爬山！这是什么赛博朋克剧情啊？中国正在变得越来越科幻，未来已来，我不允许有人不知道这个神器！🚀

先说重点！五一假期，泰山、黄山这些热门景区已经开始提供外骨骼租用了！一天200块，两块电池，从山脚爬到山顶，体力不够也能轻松实现梦想！甚至半山腰开始爬，80块钱就够了！这玩意儿绑在腰上和大腿上，帮你抬腿、发力，下山还保护膝盖，简直是爬山界的“开挂神器”！我直接好用到哭！

再来聊聊细节！
1️⃣ **超省力**：几百块的装备靠弹簧助力抬腿，几千块的带电机和芯片，智能检测你的步伐，抬腿、蹬地全帮你！
2️⃣ **超轻便**：收纳起来就一个小背包，2-3公斤，穿上完全不觉得累！
3️⃣ **超贴心**：尤其是中老年人，爬山再也不是梦，体力不够也能满山玩，银发经济太香了！

最后，我真的想大喊：中国赛博化从大山脚下开始啦！从外骨骼到机械狗搬运工，再到无人机吊运，我们正在用科技抄近道，狠狠甩开国外！这波未来感，我直接沉浸式体验了！

家人们，你还等啥？下次爬山必须安排一个外骨骼，200块钱变身赛博人，山顶见！快点赞收藏，咱们一起冲！🔥

200元租个外骨骼机器人轻松爬泰山？中国赛博化浪潮已席卷大山脚下，从户外运动到银发经济，未来科技触手可及。

只需200元就能租赁**外骨骼**机器人轻松**爬山**？这已成为**中国**现实！**赛博化**浪潮正以前所未有的速度席卷而来，从**泰山**等景区的平民化**租赁**服务开始，**科技**正深刻改变我们的**户外运动**乃至**银发经济**。文章深入探讨了**外骨骼**的原理、分类（从几百元助力款到军工级应用）及其在**康复**领域的潜力，并揭示了**中国**如何通过市场验证和快速迭代，让这种**未来**感十足的**机器人**技术触手可及。不止于此，从替代背山工的**机械狗**，到高效运输的**无人机**，再到精准作业的**植保无人机**，**中国**正走出一条独特的**赛博化**发展路径，将先进**科技**融入日常，一个半人半机器的时代或许比想象中更近。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="200元租个外骨骼机器人轻松爬泰山？中国赛博化浪潮已席卷大山脚下，从户外运动到银发经济，未来科技触手可及。" width="900" height="506" src="https://www.youtube.com/embed/wmU0DsmlXrY?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">200块钱就可以租一个外骨骼机器人，帮我去爬山了。中国正在变得越来越赛博化。</p>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事的YouTube频道。今天咱们来讲一讲中国快速赛博化的一个故事。</p>



<p class="wp-block-paragraph">赛博什么意思？它呢是一个英文单词“Cyber”，是“Cybernetics”的缩写。这个词的意思是控制论，由美国数学家诺伯特·维纳于1948年提出来的，用于描述人类、动物与机器之间的控制与通讯的科学。源自于希腊语，译为“舵手”或者是“引导者”，强调系统的引导与反馈机制。</p>



<p class="wp-block-paragraph">想到了赛博朋克，大家想到的是什么呢？人与机器相结合，对人体进行机械化和电子化的改造。赛博朋克2077那个游戏里头，人都是换个机械手、换个机械腿、加个什么芯片，都在干这些事。所以一旦想到赛博，就是半人半机器。</p>



<span id="more-2179"></span>



<p class="wp-block-paragraph">外骨骼已经来到了我们的身边。什么是外骨骼？男孩比较喜欢机甲——机甲格斗、机甲战斗、各种外星机甲。巨大的机器人，人坐在里边操作，然后他在外边，甭管是一刀一枪还是用盾牌。机甲这种东西再怎么先进，你还是要用冷兵器的。</p>



<p class="wp-block-paragraph">那么机甲的简化版本是什么样的？就是外骨骼。就是让人穿在衣服外边，像骨骼一样来支撑我们的身体，并且呢，可以帮助我们更省力地完成很多的体力工作。</p>



<p class="wp-block-paragraph">这个东西听起来很科幻，但其实现在的外骨骼已经开始逐渐走入我们的生活了。几种常见的外骨骼用途：最常见的是军用和工程用，包括消防队。这些外骨骼呢可以在复杂地形里头，帮助军人也好，消防队员也好，或者是一些工程人员也好，去完成沉重的搬运任务。</p>



<p class="wp-block-paragraph">比如说现在有一些在西藏高原这种哨所，它需要进行补给的时候，就使用外骨骼直接搬着东西走上去。这个现在都是可以实现了，不再仅仅是在科幻电影里了。</p>



<p class="wp-block-paragraph">这个东西呢比机器人省事。你像轮式机器人，很多场景没法使用，还得给它修路。人形机器人到现在还没有那么靠谱，即使是马斯克的擎天柱。你说请搬上多重的东西到山上，给我送东西去，现在他还干不了这些事。咱们国内的机器人距离这个也还有很远的距离。</p>



<p class="wp-block-paragraph">那现在省事了，干脆给人穿上一套外骨骼。那人也有了，机器也有了，合一块就是机器人了。我们人是肉人，是生物人，加上机械的外骨骼，加上它的电子系统，我们就形成了这样的一种赛博机器人。</p>



<p class="wp-block-paragraph">另外一个外骨骼的用途是什么呢？就是康复和医疗。一些行动能力缺失的病人，需要做康复训练的病人，也会佩戴外骨骼，可以帮助他们增加运动范围。有些人可能压根走不了，加上外骨骼以后，就可以进行一定范围的移动了。因为这些缺失运动能力的人呢……</p>



<p class="wp-block-paragraph">并不是说完全躺那起不来，也有一些完全躺那起不来的人，可以通过神经接驳的方式控制一些外骨骼进行运动。但是这一块目前还在实验室里边。</p>



<p class="wp-block-paragraph">真正能够去用的，就是说有一些人，比如说我能走，但是呢走不了太远就累。他们加上外骨骼以后，基本上是可以像正常人一样四处溜达、出去玩的。</p>



<p class="wp-block-paragraph">还有一些人呢，是需要做康复训练。比如受了伤了，原来呢，你需要找康复师来陪着你。现在你可以穿上一套外骨骼，他来陪着你去进行训练。这个过程中可以帮助你怎么去发力，怎么去省力。在你有可能摔倒的时候，他还会保护你。这块现在也在运用起来。</p>



<p class="wp-block-paragraph">第三种用途呢，就是体育锻炼、户外运动以及中老年健身。中国肯定是要经历老年化的，这些老年人不需要上班，领着退休金肯定想干嘛？四处玩去。但是你想四处玩的这个过程，你让他爬个山，让他去做很大的体力运动，他又受不了。那干脆说你们使用外骨骼吧，他们来替你发力，替你省力，你就可以去爬山了。这也是一个很棒的方向。</p>



<p class="wp-block-paragraph">还有一些呢去做一些这种越野运动，可以使用外骨骼让人呢可以突破他的生理极限，达到更强的运动能力。现在可以帮助中老年外出爬山。我们今天讲的这个200块钱租一天的这个外骨骼，实际上就是这一类。</p>



<p class="wp-block-paragraph">今年的五一假期呢，在各个登山景区里头就开始赛博化了。你比如泰山、黄山这些景区里头就开始租外骨骼了。一天200块，两块电池。有一些稍微好一点的外骨骼是支持热插拔换电池的，有一些是不行的。你换电池必须找地坐下来。需要两块电池的就是200块。如果是从半山腰开始爬，说我一块电池就可以上到顶上了，80块，就算是半天了。也看到了爬泰山两块电池什么意思？两块电池可以从泰山底下爬上去，帮助很多体力不是很好的人实现登泰山的梦想。以后我要去爬泰山，估计需要这种装备了。</p>



<p class="wp-block-paragraph">发现了这么魔幻的场景之后，我就上淘宝上去搜了一下。不搜不要紧，一搜吓一跳。只有你想不到，没有淘宝买不着的。现在的外骨骼从几百块、几千块到几万块的都有，各种各样的。</p>



<p class="wp-block-paragraph">那么登山外骨骼到底是怎么工作的？几百块钱的登山外骨骼能干活吗？它的主体呢是绑在腰上的。一般登山外骨骼是只有下半身，没有上半身。因为你不需要去搬东西，不需要支撑上半身，所以没有上半身。所以它的主体绑腰上，发力的一端呢是绑在大腿上。等于是一头绑腰上，另外两头是绑在两条腿上。</p>



<p class="wp-block-paragraph">那几百块钱的它到底是怎么工作的？几百块钱实际上就在帮人抬腿。它上面呢有两个大弹簧，当你需要往起抬腿的时候呢。</p>



<p class="wp-block-paragraph">他帮你把腿拉起来，就干这么个事，大概是300多块钱。但是你往下踩的时候呢，往上登山的时候你还是需要蹬踏嘛，这个时候你就需要跟这个弹簧较个劲了。所以几百块钱大概就能干这个事。</p>



<p class="wp-block-paragraph">还有一些几百块钱的是干嘛的呢？是帮助膝盖缓冲的。它实际上就只有两个膝盖这块，它有一个弹簧在膝盖背面，而这个也是几百块钱可以搞定的。正常的在泰山上租的一般是几千块钱，或者是一万块钱上下的这种设备。这种设备里头就有电机了，它里面还有检测的芯片。它能干嘛呢？检测你的步伐，现在到底是要抬腿还是要蹬。需要的时候呢帮你来抬腿，蹬的时候呢一般就不管了，就不再给你使劲了。如果是帮你登，应该是更费电一些。然后重量也不重，这种几千块钱的外骨骼呢，应该收纳起来也就是一个小背包，加上电池的重量，大概是两公斤3公斤的样子。穿在身上并不会觉得沉重，就可以帮助大家极大的提高运动能力。</p>



<p class="wp-block-paragraph">那你说再贵的外骨骼什么样？就几万块钱都什么样？几万块钱的呢，除了帮你抬腿之外，登山的过程中也是要帮你去发力的。就是当你往下蹬的时候，他也是会使劲。而且呢，在下山的时候，还会帮你去减轻膝关节的冲击。很多人说不要爬山不要爬楼，你的膝盖会很快坏掉的。他也想到了，下山的时候帮你去减轻冲击。</p>



<p class="wp-block-paragraph">那你说军用和工程用的外骨骼什么样？就是一般登山外骨骼，都是只有下半身，没有上半身。这个军用和工程用的呢，它是有上半身的。在你抬重物的时候，给腿部脊椎和手臂呢提供支撑。这种设备呢首先要去检测你要干什么，进行意图检测。现在的这些外骨骼设备去进行意图检测，相对来说都比较容易了。你不需要跟他什么语音控制，或者是按遥控器，这个都不需要。你在使力的时候，这些芯片或者一些传感器，加上这些芯片都是可以知道你要干什么的。</p>



<p class="wp-block-paragraph">这个玩意有点像什么？有点像电助力自行车。这个不是电动自行车，电动自行车就是你一按电门，它就往前开。电助力自行车上的是没有开关的，当你去使劲蹬这个车的时候，他感受到你的力量以后，根据你的力量给你加助力，这样来控错的。让你的车是你越使劲，它就越跑得快。现在很多的这种外骨骼机器人也是这样的，他发现你在用力了，然后他来给你加一个助力。</p>



<p class="wp-block-paragraph">而且还有一个很大的功能是什么？就是支撑。当我们把一个重物搬起来以后，后面就是只管迈迈腿走就完了。原来我们是需要靠上肢的力量，靠脊椎的力量来支撑这个重物。那他现在说我直接给你锁死，你就支撑在这了，你只管迈腿往前走就完事了。这种的大概要几万块。</p>



<p class="wp-block-paragraph">从今年开始，我们的外骨骼已经彻底走向民用化了。很多做外骨骼的公司都开始做广告，说帮助老年人银发经济，大家都可以带上外骨骼，让你的膝盖慢一些磨损，老年人都可以满山遍野的去玩去了。这个是今年的一个新的风口。</p>



<p class="wp-block-paragraph">我们在发展机器人的道路上抄了个近道。国外呢，其实也不是说不做这东西，国外也做外骨骼。比如谷歌吧，他呢跟始祖鸟就联合研发了外骨骼设备。始祖鸟嘛，做户外用品的嘛。国外军队呢也在研发外骨骼，但是呢，跟中国不太一样。中国有一些特殊的路径，我们凭借中国人的智慧，将外骨骼不断的精简。像刚才我讲的，有上半身的，没有上半身的，只抬腿的，抬了腿再加上下蹬的，再加上这个膝关节的，甚至说我给你加个弹簧也敢叫外骨骼。就中国人会不断的去精简，精简完了以后呢，把全品类的商品全都扔到市场上去，大家自己试去吧。通过市场验证快速迭代，不断的降低成本，这个是中国独有的道路，国外玩不转这套东西。</p>



<p class="wp-block-paragraph">现在中国的赛博化从大山脚下开始，机械狗搬运工已经逐渐普及了。我记得我小时候去爬峨眉山的时候，还有背山夫，他们把东西从山下背上去到山上。矿泉水、方便面、火腿肠，在山上都是山下好多倍的价格。为什么？人背上去的嘛。甚至当时还有挑山工，是可以把人背上去。四川又黑又瘦的背山工，可以把这种白白胖胖的胖子从底下背上去。我小时候见过，但是我小时候是爬上去的，没有上金顶，就中间也是爬到一个比较高的地方了，但还是爬上去的。现在等于就全都是机械狗了，需要往山上运任何东西，找一个人带着遥控器，把东西绑机械狗上，可能一次可以绑个几十公斤100公斤的，就直接上去了。这块现在已经做的很好了。</p>



<p class="wp-block-paragraph">因为机械狗这种东西研发出来，你总要有用途，总要能卖得掉，总要能够让生意运转起来才可以。这就是中国的商业模式。你不能像波士顿动力似的，这帮人把机械狗发明出来以后，还在跟美军在玩成本游戏，这个东西多少万美金一个，在实验室里的小批量生产。到现在虽然波士顿动力的机械狗开始在美国的军方、警方小批量的装备了，但是绝对没有像中国这样，说来满山遍野给我搬东西去，还没有达到这样的一个效果。中国的机械狗，现在已经满山的在搬矿泉水了。</p>



<p class="wp-block-paragraph">第二个是什么？无人机吊运。现在很多年轻人也在向这个方向转型。你像机械狗，你要想把东西搬上去，你还是需要有人举着遥控器跟着它，还得有路。无人机要比这玩意快多了。你现在想在山上修点什么东西，什么太阳能板，或者是各种山里边的水果蔬菜。</p>



<p class="wp-block-paragraph">都可以直接通过无人机吊起来。一台无人机大概能够吊100公斤，而且这东西只要飞起来以后，就没有路什么事了，也没有地形的限制了。大家只要去考这个CAAC的认证，举着大遥控器就可以进行吊运了。而且现在这一块还是挺挣钱的，如果你能接到活的话，吊运一天大概也能够挣到几千块钱，这块还是不错的。</p>



<p class="wp-block-paragraph">还有植保无人机，国内现在开始大量普及，甚至开始出口全球。全世界的植保无人机，大部分都是中国产的，除了大疆之外还有几个牌子。你要想在山上比如说种点树，种点什么其他的东西，不用山上，咱在地里头种东西。你需要去撒化肥，需要去打农药，你要靠人或者靠这种车辆，都是非常麻烦的。</p>



<p class="wp-block-paragraph">原来美国人是靠飞机，那飞机的话飞的很高，那玩意不能飞太低，导致什么？大量的这个药会浪费掉，因为你飞的高嘛。另外呢，就是非常不精准，有的地方喷上了，有的地方没喷上。或者有些时候两块田挨着很近，你这边该喷的药就喷到那边去了，这个都没法解决。</p>



<p class="wp-block-paragraph">现在植保无人机上来了以后，直接拿着遥控器把这个地块量好了，说我这是起点，那是终点，中间哪有一个障碍物，这有一电线杆子需要绕着走。把东西加好了以后，他就一次加100公斤农药或化肥，直接顺着你这个田块，给你整个均匀的喷一遍。而且喷的时候，大概离地面也就是一两米远，离地面非常近，喷的极其均匀。而且哪怕你两块地挨着很近，这边该喷的东西也喷不到那边去。这块现在也是在大量普及。</p>



<p class="wp-block-paragraph">再加上现在满山遍野跑的外骨骼，我们正在从大山脚下，逐渐的跑向赛博化。这就是现在中国赛博化的一个进程吧。</p>



<p class="wp-block-paragraph">好，这个故事今天就讲到这里。感谢大家收听，请帮忙点赞、点小铃铛，参加DISCORD讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>从亦庄机器人半马看中国机器人产业雄心：争夺全球制造主导权，能否复制大疆辉煌，催生下一个科技巨头？</title>
		<link>https://lukefan.com/2025/04/11/%e4%bb%8e%e4%ba%a6%e5%ba%84%e6%9c%ba%e5%99%a8%e4%ba%ba%e5%8d%8a%e9%a9%ac%e7%9c%8b%e4%b8%ad%e5%9b%bd%e6%9c%ba%e5%99%a8%e4%ba%ba%e4%ba%a7%e4%b8%9a%e9%9b%84%e5%bf%83%ef%bc%9a%e4%ba%89%e5%a4%ba%e5%85%a8/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Fri, 11 Apr 2025 00:44:36 +0000</pubDate>
				<category><![CDATA[机器人与具身智能]]></category>
		<category><![CDATA[Figure AI (缺席)]]></category>
		<category><![CDATA[UBTECH (优必选)]]></category>
		<category><![CDATA[上海理工大学 (行者2号)]]></category>
		<category><![CDATA[中国机器人]]></category>
		<category><![CDATA[中科院自动化所 (凌志)]]></category>
		<category><![CDATA[交通管制]]></category>
		<category><![CDATA[产业竞争]]></category>
		<category><![CDATA[人工智能 (AI)]]></category>
		<category><![CDATA[人形机器人]]></category>
		<category><![CDATA[人机混合马拉松]]></category>
		<category><![CDATA[供应链]]></category>
		<category><![CDATA[全球首次]]></category>
		<category><![CDATA[关门时间]]></category>
		<category><![CDATA[北京亦庄]]></category>
		<category><![CDATA[北京人形机器人创新中心 (天工)]]></category>
		<category><![CDATA[北京天气]]></category>
		<category><![CDATA[北航 (天鹰)]]></category>
		<category><![CDATA[半程马拉松 (21公里)]]></category>
		<category><![CDATA[参赛团队]]></category>
		<category><![CDATA[双足机器人]]></category>
		<category><![CDATA[哈工大]]></category>
		<category><![CDATA[国际团队]]></category>
		<category><![CDATA[复杂路况 (柏油路/坑洼/坡度/草地/石子路)]]></category>
		<category><![CDATA[大疆 (类比)]]></category>
		<category><![CDATA[太虎机器人 (T170)]]></category>
		<category><![CDATA[奖金]]></category>
		<category><![CDATA[宇树科技 (H1)]]></category>
		<category><![CDATA[小米铁蛋 (静态展示)]]></category>
		<category><![CDATA[开源机器人]]></category>
		<category><![CDATA[换电池]]></category>
		<category><![CDATA[无人机产业 (类比)]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[机器人产业]]></category>
		<category><![CDATA[机器人制造]]></category>
		<category><![CDATA[机器人应用场景]]></category>
		<category><![CDATA[机器人技术发展]]></category>
		<category><![CDATA[机器人接力]]></category>
		<category><![CDATA[机器人控制 (自主/半自主/遥控)]]></category>
		<category><![CDATA[机器人竞赛]]></category>
		<category><![CDATA[机器人马拉松]]></category>
		<category><![CDATA[松岩动力]]></category>
		<category><![CDATA[比赛规则]]></category>
		<category><![CDATA[波士顿动力 (缺席)]]></category>
		<category><![CDATA[特斯拉擎天柱 (缺席)]]></category>
		<category><![CDATA[猎豹移动]]></category>
		<category><![CDATA[科技新闻]]></category>
		<category><![CDATA[科技赛事]]></category>
		<category><![CDATA[稚晖君 (智源机器人)]]></category>
		<category><![CDATA[行业标准制定]]></category>
		<category><![CDATA[补给点]]></category>
		<category><![CDATA[赛事意义]]></category>
		<category><![CDATA[遥控限制]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2089</guid>

					<description><![CDATA[救命！中国搞了个超级赛博朋克的大事情！！
北京本周日要举办全球首个【人机混合半程马拉松】！21公里赛道中间用铁马隔开，左边是人类跑者，右边是双足机器人！这画面想想都要尖叫啊啊啊！

🔥赛事三大爆点：
1️⃣ 机器人必须用两条腿！（轮子履带直接out！）
2️⃣ 全程自主避障+复杂地形！（石子路/草地/陡坡全安排！）
3️⃣ 可半路换机器人接力！（型号相同就能无限续杯？！）

👀围观重点选手：
✅宇树科技H1：春晚转手绢的1米8大长腿！47kg瘦身款，每秒冲刺3米！
✅天工机器人：全自主导航王者！UBTECH开源平台超能打！
✅猎豹移动：CEO刚怼完行业就真香参赛！（打脸来得太快就像龙卷风🌪）

⚠️逆天规则揭秘：
- 遥控员禁止陪跑！想操纵？请蹲守7个补给点！
- 换电池不罚时但扣分！（官方吐槽：没电你就菜！）
- 3.5小时跑不完直接抬走！（机器人：你礼貌吗？）

现在最刺激的是——比赛当天预报10级大风！！人类选手裹紧外套，机器人疯狂掉电，这画面不敢想啊啊啊！所以到底谁会赢？赌五毛钱：
👉人类组：56分钟记录保持者稳如老狗
👉机器人组：能完赛就是胜利！（毕竟要扛住妖风+碎石路+没电焦虑）

PS：小米铁蛋只敢静态展示，特斯拉擎天柱直接怂了没来！中国机器人这次真的支棱起来了！建议收藏这条，周日蹲直播见证历史啊啊啊！

（疯狂敲碗）求问姐妹们更想看哪家机器人翻车？评论区速速压注！！👇👇

从亦庄机器人半马看中国机器人产业雄心：争夺全球制造主导权，能否复制大疆辉煌，催生下一个科技巨头？

北京亦庄即将上演全球瞩目的**机器人马拉松**盛事，一场别开生面的**人机混合** **半程马拉松**，上万名人类选手将与超过20个团队的**人形机器人**在隔离赛道上同场竞技。这场**机器人比赛**对参赛的**双足机器人**有严格要求，考验它们在复杂路况下的**自主控制**或**遥控机器人**能力。包括**宇树科技**H1、北京**天工机器人**等国内顶尖**中国机器人**团队将力争在3.5小时内完赛，展示中国**机器人技术**的最新进展。此次赛事不仅是技术的较量，更折射出中国在**机器人产业**上的雄心，意图在全球**未来科技**竞争中占据领先地位，探索**机器人**应用的更多可能。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="从亦庄机器人半马看中国机器人产业雄心：争夺全球制造主导权，能否复制大疆辉煌，催生下一个科技巨头？" width="900" height="506" src="https://www.youtube.com/embed/S7B0nrNO6Xs?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">机器人马拉松要在北京开跑了。大家好，欢迎收听老潘讲故事的YouTube频道。本周日4月13号，在北京的亦庄要开始一场人机混合马拉松大赛。</p>



<p class="wp-block-paragraph">什么叫人机混合？就是它的赛道上中间隔着一个铁马，有一半是由人跑的，另外一半的赛道是由机器人跑的。两边等于跑同一个赛道，相同的路程。人呢，应该现在有上万人报名了吧。机器人现在应该有20多个单位，或者叫团队去报名了。</p>



<p class="wp-block-paragraph">21公里的半马，并不是要跑完整的马拉松。现在机器人跑全马还是有些难度的。机器人呢，要求在3小时30分钟之内完成整个的赛段。如果完不成的话就没有成绩了。人类的话是3小时10分钟，要求完成赛段要关门。人类的记录呢是56分钟，平均大概是两个小时多一些吧。</p>



<span id="more-2089"></span>



<p class="wp-block-paragraph">机器人的话，我觉得可能有一部分可以在3小时30分钟之内跑完。但是应该不太可能说20多台机器人，都可以在规定的时间内跑完。这也算是一个新的人类盛举了。应该会有交通管制，我就不到现场去凑热闹了。他是从周五晚上8点就开始逐步的封路，进行检测了。</p>



<p class="wp-block-paragraph">北京天气预报那天应该是有大风，有可能会到10级风。所以当天到底能不能跑，现在还不是特别确定。毕竟还有上万个真人要跟着跑。</p>



<p class="wp-block-paragraph">对于机器人参赛，它的规则是咋制定的呢？这个我估计是很多人关注的。到底谁得冠军？到底跑多少分钟？现在第一次的话，关注这个事还稍微有点早。所以咱们先看看要求是什么。</p>



<p class="wp-block-paragraph">第一个必须是双足机器人。四足的、轮式的、轮足的、履带的都是不允许的。你必须俩腿站那给我跑。身高呢，是0.5到2米之间。太小的、太大的都不要。你说我做个10米的机器人，没两步跑到了这事不行。所以，就是0.5到2米。</p>



<p class="wp-block-paragraph">支持手动遥控，含半自主或者是完全自主控制。但是需要在赛前提交控制模式说明。因为现在的机器人呢，有全自主的，就告诉他你要去什么什么地方，顺着哪条路走，他就自己去了。自己去判断地面上有什么障碍，有什么这些坑坑坎坎的，自己可以迈过去。</p>



<p class="wp-block-paragraph">也有的呢就是完全遥控的。你让它往前往后，或者是抬腿伸胳膊这样，完全遥控的。半自主是什么呢？就是你命令它开始动了，它就开始在原地踏步。然后你说前进，它就往前走了。在往前走的过程中呢，自己可以去避障，或者说可以深一脚浅一脚，爬个坡，下个梯子都是可以的。但是呢，你要想拐弯要想什么的，你还是得要遥控器。这就是半自主的。</p>



<p class="wp-block-paragraph">所以现在都有，甚至有些机器人呢，是几种模式都支持。但是你在参赛之前，你必须跟人说清楚，说我这个今天是用全自主方式参加的。</p>



<p class="wp-block-paragraph">还是用半自主方式参加的，还是完全手控的？你要去跟人说清楚。你说我这是全自主的，结果你举个遥控器站在旁边，前进后退，这个事是不行的。</p>



<p class="wp-block-paragraph">如果是这个遥控器，那遥控的人呢，不能陪着跑。原来我们还想说，这个半马20多公里，难道说这机器人在旁边吭哧吭哧跑，旁边还一哥们抱着遥控器，在后边跟着跑吗？这事是不允许的。因为他这个人跟机器人之间，本身也是不允许混的。因为机器人你万一磕了碰了他，现在的机器人倒不至于伤人，但是你要踢他一脚也挺烦的，这机器人摔一跟头也挺贵的。</p>



<p class="wp-block-paragraph">所以，人跟机器人就是完全隔离的，中间是有铁马来分割的。遥控者呢，要求站在补给点里头站，那遥控是不允许跟着机器人跑的。他这20多公里呢，应该也是七扭八拐的一个路线，有七个补给点。不是说你的遥控距离必须要超过20公里，应该有七个点，距离机器人最远的位置大概都是可能一公里两公里之内的这样的一个位置，大家是可以在这进行遥控的。</p>



<p class="wp-block-paragraph">但是呢，也有一些团队呢，准备玩车队遥控，就是他开个车，跟着机器人跑也是可以的，但是操纵人不可以跟着机器人跑。这个路线呢，涵盖了城市道路、平坦的柏油路、坑洼的裂缝路段，就是有些路没那么好。然后呢，有坡度路段，长缓坡或者短陡坡都有，以及公园区域，有石板路、草地、石子路等，多种复杂路况。就是要求这个机器人，在所有的这个路况里面都要跑下来，你要跑不下来，这事是不行的。</p>



<p class="wp-block-paragraph">中间呢，可以换电池，换电池呢是不罚时间的。但是你如果换了电池，到最后评分的时候，还是会稍微减一点分。因为他最终评的时候，你跑的时间是一个分数，大概占70%多。你到底换多少次电池，长得好不好看，大家是不是喜欢，都会占那么一点点分数。但是换电池，你不能说走到哪，跑着跑着哐当躺那了，然后你就奔奔过去给他换电池，这事不允许。还是7个补给点，你要想换电池，你就计算好跑到补给点换去。</p>



<p class="wp-block-paragraph">那你说我机器人摔了摔坏了，或者哪个地方过热了咋办？也是到补给点去，可以换零件或者换机器人都行。这个机器人是可以接力的，比如说俩机器人，一个跑前半段一个跑后半段，没毛病，只要是同一个型号就行。但是呢，换机型罚时10分钟，加10分钟的时间。</p>



<p class="wp-block-paragraph">这就是这一次的基本规则，也挺好玩吧。参赛和没参赛的都有哪些呢？就是一般到这样的比赛，大家就看哎谁谁谁来了，更重要的是谁谁谁没来。咱们看看20多个参赛团队，宇树科技肯定是要来，人家春晚都转了手绢了，这个要来。他呢，的型号应该是H1，1米八的大个子47公斤。</p>



<p class="wp-block-paragraph">还是挺瘦的，这个机器人。它大概每秒钟可以前进三点几米，是这样的一个速度。但是我们要注意，3个小时30分钟跑完21公里的话，大概每秒钟至少要前进接近两米的距离，你才可以按照这样的平均速度把它跑完。这中间还不算摔跟头换电池。你换电池虽然不扣时间，但是你也得让机器人停下来，走到补给站里头去换个电池。你没有个三五分钟，你也搞不定这事。</p>



<p class="wp-block-paragraph">另外一个种子选手呢，是北京人形机器人创新中心的天工机器人。这个机器人呢是1米63，43公斤。它呢是UB选联合研发的一个机器人。UB选是国内第一家机器人上市公司，现在他的机器人其实已经在很多的工厂里边干活去了。他的这个机器人呢，是一个开源机器人平台，就是他的软件硬件里头的模型都是开源的，大家都可以在这个平台上面去使用。这个天工机器人呢，就是一个全自主机器人。你告诉他去什么地方，他可以自己去识别道路，有坑有坎了，我怎么去迈过去，他他有这样的能力。但是具体怎么样咱们还要看了。</p>



<p class="wp-block-paragraph">还有呢，上海清新艺创科技有限公司叫松岩动力。这个机器人身高1米2，体重呢是35公斤。还有呢是上海理工大学叫行者2号，体重28公斤。太虎机器人T170，身高1米5，25公斤重。猎豹移动也去了。猎豹移动这挺逗的，傅盛前两天刚发言，力挺朱啸虎的人形机器人短期没有商业化的言论，这自己就直接把自己的人形机器人派去参赛去了。</p>



<p class="wp-block-paragraph">然后北京航空航天大学叫天鹰机器人，1米68，55公斤。你看他个矮还挺沉的，这玩意是液压的。其他的机器人大部分都是电驱动的，就是电机的。然后中国科学院自动化研究所叫凌志机器人，1米7，60公斤。还有一些大学的作品，就是像什么哈工大呀，都会有作品去参赛。</p>



<p class="wp-block-paragraph">小米的铁蛋呢，是在赛道边上静态展示，但是不参赛。对于他来说，2022年开过一次发布会，再往后呢，就没有什么动态更新出来了。雷军着急忙慌的在那造车呢，这个机器人让他去跑21公里，估计够呛。稚晖君的智源机器人呢，目前并没有明确是不是要去参赛。因为稚晖君的机器人呢，比较大个的都是有轮子的，他不允许参赛。小个的呢可能也没有为这种快速移动去进行设计。他在一个房间内进行慢速移动，处理一些问题还可以，但是你让他这种长时间跑21公里，而且还要达到一个这么高的速度，他应该是没有做相应的产品。</p>



<p class="wp-block-paragraph">车厂的机器人呢，应该都没有来参赛。像什么理想小鹏，都号称要做机器人。小鹏还号称说，我的机器人原型已经进车厂上班去了。</p>



<p class="wp-block-paragraph">但是他们这一次应该都没有来。国际团队这次呢，并没有确认是否参加。像什么特斯拉的擎天柱，还有figure 01，或者是figure 02，以及波士顿动力这些呢，并没有明确是否参加，大概率是不会来了。</p>



<p class="wp-block-paragraph">这个虽然号称是国际赛事，但是目前为止，确认的参赛团队都是国内的团队。机器人半马这种比赛，主办的目的是什么呢？</p>



<p class="wp-block-paragraph">第一个就是全球首次，我们一定要把这个名声留在手里头。中国人是很喜欢这个的。第二个就是奖金，冠军奖金5,000元人民币，亚军是4,000元人民币，这个基本上可以忽略不计。所以大家肯定不是为了奖金来的，更多的呢是让大家看到，机器人行业到底发展到什么样的一个状态了。</p>



<p class="wp-block-paragraph">以及呢，也创造一些标准，让这些做机器人的团队说，你就按照这个21公里，自己能够跑下来的这个模式来，去设计机器人就可以了。如果一个机器人可以在自主的情况下，在3.5个小时里头把这21公里跑完，有这个平面的柏油路，有水泥路，有坑洼路，有坡度坡路，草地石子路，什么台阶都可以搞定，那我觉得这样的机器人，它的应用场景就已经相当广泛了。</p>



<p class="wp-block-paragraph">而且前面我们也讲过，不要看着这些机器人有个遥控器，就觉得它很笨。现在这些机器人，你虽然有遥控器，但是它的运动控制、自己的平衡，这些东西还是有很先进的算法，很复杂的算法来控制的。因为你的遥控器只是控制前进和后退，并没有控制说抬腿伸腿，并没有做这样的控制，已经是做了极大的简化了。</p>



<p class="wp-block-paragraph">就像我们玩大疆无人机似的，大疆无人机，你会去控制四个螺旋桨速度吗？你不会的。但是你想，这种四旋翼无人机的控制，就是靠四个电机的速度去控制的呀。它是有飞控软件在里头，要考虑当时的风速，考虑你的飞行姿态，然后再去根据你的动作，根据你的操控，做出你意图中的这个动作出来。所以这个还是挺难的。</p>



<p class="wp-block-paragraph">所以在这一块的话，中国应该还是会快速的发展。这就像早期的汽车比赛一样，有了一个目标，大家就去努力的改车、造车，让这个车可以参加竞速赛，跑圈的拉力赛，各种各样的环境的让它跑下来。这个也算是在整个的汽车技术与工业发展过程中，都是起到了非常重要作用的。</p>



<p class="wp-block-paragraph">现在中国开始搞这样的机器人大赛，目的呢也是在机器人的硬件和标准上，要开始进行争夺了。美国人现在可能还在主要研究这些大模型，各个大学里面，特斯拉、figure 01、figure 02这样的机器，已经开始在去做大模型研究，而且在这块，应该会比咱们要稍微先进一些。</p>



<p class="wp-block-paragraph">中国人需要干嘛呢？需要跟日本、韩国、欧洲……</p>



<p class="wp-block-paragraph">去争夺机器人代工以及零配件生产制造的这张门票。你美国人造完了以后，你到底让谁给你造这个机器人？你让日本人造没问题，他能造得出来，而且可能很精准，但是很贵。但是你让中国人造，我可以给你造得很便宜，未必别人那好使，但是也能使。这个是我们现在要去争抢的。</p>



<p class="wp-block-paragraph">而且呢，很有可能会在机器人行业里头，再造就第二家或者第三家的大疆这样的企业出来。大疆其实在全世界的无人机领域里头，也算是一个妖怪，别人跟他竞争还是非常痛苦的。机器人产业有可能会被中国人玩成第二个无人机产业。</p>



<p class="wp-block-paragraph">什么叫第二个无人机产业？现在中国的无人机都在做什么？不光是有大疆控制板，中国大量的出口各种控制板。现在甭管是俄乌冲突，还是在中东的各种的战线上，很多的无人机控制板都是从国内出口出去的。现在美国FBI还在悬赏中国做电气元件的山东会计呢。所以我们是生产了非常非常多的底层零部件。</p>



<p class="wp-block-paragraph">你比如说刚才咱们讲那天工机器人，它里边使用的激光雷达是大疆造的。大疆也造很多这样的设备出去，包括一些无人驾驶汽车上面的激光雷达和他们的主控系统，都是大疆造的。现在机器人上面，肯定也有很多类似这样的零部件，我们也希望能够在中国制造生产。</p>



<p class="wp-block-paragraph">而且现在娱乐型的无人机，完完全全就是大疆独领风骚。其他人也有，但是你跟大疆竞争，根本就竞争不过你，价格你也打不过，整个的品质然后它的可玩性都差得很远。工业、矿业、电力、农业相关的无人机呢，现在除了大疆之外，还有几家中国公司也是在逐渐的垄断全球市场。在矿业上可能大疆还未必是老大，包括农业上，也还有国内的无人机厂商在跟大疆去竞争。你竞争来竞争去，最后就把其他人都打没了，因为它的成本还是很低的。可靠性在无人机这个领域里头，我们还是可以造到在工程角度上它是可用的。</p>



<p class="wp-block-paragraph">包括现在的表演无人机，就是几百架几千架无人机呼呼一下飞上去，给大家拼个花看看，这玩意全都是在中国生产的。包括现在的载人四旋翼飞机，国内现在也是上的非常猛。现在在无人机这个领域里头，玩的叫什么？叫有枣没枣三杆子，吃干抹净。只要是有可能东西我们全造，我都造的比你便宜，也都能使。你说我达到一个多高的安全性可靠性，我们也不拼，反正我在可控的成本范围内，咱能使在全世界大卖。这就是我们现在无人机的玩法。</p>



<p class="wp-block-paragraph">那以后可能整个机器人产业链也会变成这样。最后可能你做的像苹果手机这样，我们其他人都去做安卓。我们有一些这种开源的大模型，开源的控制系统搁进去。</p>



<p class="wp-block-paragraph">我这还有开源的硬件，咱们拼起来一大堆的中国产，像安卓机器人。安卓本身就是机器人的意思，我们就可以围剿特斯拉。机器人这事都是可能出现的，它的各种零配件通通都在中国生产，就像果链企业一样。</p>



<p class="wp-block-paragraph">未来就算有关税的这种战争，可能机器人这一块还是会有大量的产品在中国出来。而且现在看关税战争，虽然让很多的相对低端一点的制造业跑到东南亚去了，但是比较高精尖的制造业还是留在国内的，向那边转移的过程并没有那么快。</p>



<p class="wp-block-paragraph">未来一段时间，像人形机器人的马拉松以及其他的各种赛事呢，还会快速的启动。下一次也就是2026年计划的人形机器人马拉松，会有一部分是人跟机器人一起协作完成的。这一次还是人跟机器人是分隔开的，中间有一个铁马，人在这头，机器人在另外一头。下一次可能有一些需要人跟机器人一起搬东西，一起协作完成一些任务，才可以完成马拉松。这个是明年可以去看的事情。</p>



<p class="wp-block-paragraph">这些比赛呢，应该会以各种各样的形式展开。这一次的比赛呢是在北京亦庄开。北京亦庄呢，是北京人形机器人创新中心的所在地。刚才咱们讲那天工机器人就是开源的，还可以自主控制的一个机器人，就是从那出来的。所以，这是它的母厂。他就可以去设计，说我这个比赛要去考验这些特性，那么他就整了一个比赛。有些人就来了，有些人就不来了。</p>



<p class="wp-block-paragraph">那么没准下一次说，这回规矩是你定的，比如像稚晖君这样的不是很公平。我们在室内更灵巧，下一次我们做一个新的比赛，按照我的这个能力去设计一些新的赛事出来。那咱们再去拉一帮人来比赛，可能是很快就会有新的这种赛事出来。而且这一块的话会变得非常非常热闹。</p>



<p class="wp-block-paragraph">这一次可能那些没有来参赛的公司，他们就觉得你这个比赛定的对我不是那么合适。在这一块未来的一两年内，应该会看到很多有趣的赛事，有趣的表演。让我们一起来期待。</p>



<p class="wp-block-paragraph">好，这个故事就讲到这里。而最好呢是下次比赛，希望可以看到国际的选手参赛。我们也希望国际的一些比赛，中国的团队可以送机器人出去，一起来去参加这些比赛。</p>



<p class="wp-block-paragraph">好，这个故事就跟大家讲到这里。感谢大家收听，请帮忙点赞、点小铃铛，参加DISCORD讨论群。也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>川普推动星际之门计划：5,000亿美金的科技梦，能否实现全球算力中心？孙正义、山姆·奥特曼联手打造的大饼，OpenAI、英伟达、ARM、微软收益，Elon Musk和Anthropic、谷歌质疑</title>
		<link>https://lukefan.com/2025/01/24/%e5%b7%9d%e6%99%ae%e6%8e%a8%e5%8a%a8%e6%98%9f%e9%99%85%e4%b9%8b%e9%97%a8%e8%ae%a1%e5%88%92%ef%bc%9a5000%e4%ba%bf%e7%be%8e%e9%87%91%e7%9a%84%e7%a7%91%e6%8a%80%e6%a2%a6%ef%bc%8c%e8%83%bd%e5%90%a6/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Fri, 24 Jan 2025 00:41:19 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AI公司]]></category>
		<category><![CDATA[AI发展]]></category>
		<category><![CDATA[AI监管政策]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[ARM]]></category>
		<category><![CDATA[ARM技术]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[IT就业]]></category>
		<category><![CDATA[Meta]]></category>
		<category><![CDATA[MGX]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[OpenAI战略]]></category>
		<category><![CDATA[Oracle]]></category>
		<category><![CDATA[中东基金]]></category>
		<category><![CDATA[中东投资]]></category>
		<category><![CDATA[中东经济]]></category>
		<category><![CDATA[中国基建]]></category>
		<category><![CDATA[产业链]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[人工智能政策]]></category>
		<category><![CDATA[人才流动]]></category>
		<category><![CDATA[企业合作]]></category>
		<category><![CDATA[全球合作]]></category>
		<category><![CDATA[全球市场]]></category>
		<category><![CDATA[全球布局]]></category>
		<category><![CDATA[全球算力]]></category>
		<category><![CDATA[创新中心]]></category>
		<category><![CDATA[创新战略]]></category>
		<category><![CDATA[创新计划]]></category>
		<category><![CDATA[创新驱动]]></category>
		<category><![CDATA[台积电]]></category>
		<category><![CDATA[国际合作]]></category>
		<category><![CDATA[国际市场]]></category>
		<category><![CDATA[大模型]]></category>
		<category><![CDATA[孙正义]]></category>
		<category><![CDATA[山姆奥特曼]]></category>
		<category><![CDATA[川普]]></category>
		<category><![CDATA[川普政策]]></category>
		<category><![CDATA[市场前景]]></category>
		<category><![CDATA[市场投资]]></category>
		<category><![CDATA[市场趋势]]></category>
		<category><![CDATA[微软]]></category>
		<category><![CDATA[微软云]]></category>
		<category><![CDATA[技术领先企业]]></category>
		<category><![CDATA[投资机会]]></category>
		<category><![CDATA[投资策略]]></category>
		<category><![CDATA[星际之门计划]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[未来科技趋势]]></category>
		<category><![CDATA[欧洲科技人才]]></category>
		<category><![CDATA[硅谷]]></category>
		<category><![CDATA[科技产业]]></category>
		<category><![CDATA[科技企业成长]]></category>
		<category><![CDATA[科技创新]]></category>
		<category><![CDATA[科技博弈]]></category>
		<category><![CDATA[科技发展规划]]></category>
		<category><![CDATA[科技峰会]]></category>
		<category><![CDATA[科技愿景]]></category>
		<category><![CDATA[科技成果]]></category>
		<category><![CDATA[科技投资]]></category>
		<category><![CDATA[科技政策]]></category>
		<category><![CDATA[科技未来]]></category>
		<category><![CDATA[科技热点]]></category>
		<category><![CDATA[科技生态]]></category>
		<category><![CDATA[科技生态系统]]></category>
		<category><![CDATA[科技突破]]></category>
		<category><![CDATA[科技竞争]]></category>
		<category><![CDATA[科技繁荣]]></category>
		<category><![CDATA[科技股]]></category>
		<category><![CDATA[科技蓝图]]></category>
		<category><![CDATA[科技融资]]></category>
		<category><![CDATA[科技规划]]></category>
		<category><![CDATA[科技解决方案]]></category>
		<category><![CDATA[科技论坛]]></category>
		<category><![CDATA[科技资源]]></category>
		<category><![CDATA[科技趋势]]></category>
		<category><![CDATA[科技趋势分析]]></category>
		<category><![CDATA[科技进步]]></category>
		<category><![CDATA[科技革新]]></category>
		<category><![CDATA[科技项目]]></category>
		<category><![CDATA[科技领导力]]></category>
		<category><![CDATA[算力中心]]></category>
		<category><![CDATA[经济发展]]></category>
		<category><![CDATA[美国科技]]></category>
		<category><![CDATA[美国经济]]></category>
		<category><![CDATA[芯片]]></category>
		<category><![CDATA[芯片产能]]></category>
		<category><![CDATA[英伟达]]></category>
		<category><![CDATA[英伟达芯片]]></category>
		<category><![CDATA[行业动向]]></category>
		<category><![CDATA[计算中心]]></category>
		<category><![CDATA[谷歌]]></category>
		<category><![CDATA[跨国合作]]></category>
		<category><![CDATA[软银]]></category>
		<category><![CDATA[马斯克]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1866</guid>

					<description><![CDATA[啊啊啊啊啊啊啊！大家好！今天我们聊的是一个超级有趣的话题，星际之门计划！！！这个名字听起来就让人心潮澎湃是不是？！😱没错，就是川普、孙正义和山姆·奥特曼这些大咖们共同画的一张巨大的饼！🍰

首先，咱们要知道这个计划的目标是啥？天呐，竟然是4年内投入5,000亿美金！是的，你没有听错！5,000亿！这个钱可不是小数目呀！！！而且他们还说要创造10万个高级就业岗位，这听起来是不是很美好？可是谁来给我们保证这些就能实现啊？？？

而且，关键是，马斯克都发声了，直言不讳地说这个计划根本不靠谱，说根本筹不到那么多钱！OMG！这完全是把星际之门给戳了个大窟窿啊！💥 你说，裹挟着这一系列重磅角色，结果却可能是乌龙一场？？？

接下来，星际之门计划背后的参与者们，微软、OpenAI、英伟达、ARM……这都是互联网科技的巨头啊！但是，现在他们真的能合作无间吗？我觉得会有各种利益碰撞，大家都想在这块饼上分蛋糕！再说了，做的都是AI和算力这块，未来又能不能落地，真是让人担忧的呀！！！

总之，关于星际之门计划，大家是不是感觉一头雾水？这场科技巨头的博弈，未来又会如何发展？你们觉得这个饼能画圆吗？？让我们一起拭目以待，看看后续会有什么惊艳的消息出现吧！🚀💫

喜欢这个话题吗？快点赞、评论，告诉我你的看法！我们下期再见！！！❤️✨

川普推动星际之门计划：5,000亿美金的科技梦，能否实现全球算力中心？孙正义、山姆·奥特曼联手打造的大饼，OpenAI、英伟达、ARM、微软收益，Elon Musk和Anthropic、谷歌质疑

在"老范讲故事"的最新一期中，深入分析了星际之门计划，这是一项由川普宣布，计划在美国投资5,000亿美金的庞大项目，旨在建设全球算力中心。此计划由OpenAI、Oracle、软银和MGX等企业联合打造，预计能提供10万个高级就业岗位。然而，这一项目遭到马斯克和Anthropic的质疑，认为资金承诺不明。计划依赖于中东土豪基金的支持，但芯片供应仍需依赖台积电等企业。微软、英伟达和ARM等公司的股价受此影响大幅上涨，而Meta和谷歌则在技术竞争中扮演关键角色。文章质疑项目的可行性，认为川普的政策可能会导致全球人才流动，加剧美国与欧洲和中国的技术竞争。能否实现此项计划，尚需观察未来数年的发展和技术突破。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="川普推动星际之门计划：5,000亿美金的科技梦，能否实现全球算力中心？孙正义、山姆·奥特曼联手打造的大饼，OpenAI、英伟达、ARM、微软收益，Elon Musk和Anthropic、谷歌质疑" width="900" height="506" src="https://www.youtube.com/embed/iLQWaOR-VwU?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">星际之门计划，好大的一张饼。大家好，欢迎收听老范讲故事YouTube频道。今天咱们来讲一讲山姆奥特曼、川普、孙正义这些人给大家画的一张巨大的饼，叫星际之门计划。</p>



<p class="wp-block-paragraph">其实呢，在拜登时期，山姆奥特曼就已经四处开始忽悠星际之门计划了。他要去掌控巨大的算力中心，而且这个算力中心应该主要在美国的。现在川普上台了，川普就亲自去宣布这件事情。孙正义、山姆奥特曼、Oracle以及另外一个中东土豪，他们一起组建星际之门计划。4年时间在美国要投入5,000亿美金，这只是在美国。</p>



<p class="wp-block-paragraph">既然有中东土豪基金，那么可能在中东还会花钱，但是你要保证在美国花5,000亿。为什么是4年？川普的时任期就是4年嘛。而且呢，要在美国提供10万个高级就业岗位。做算力中心肯定不需要外卖员、快递员，但是一些IT维护人员算是高级就业岗位嘛。应该也算吧，IT蓝领这个还是需要一些的。</p>



<span id="more-1866"></span>



<p class="wp-block-paragraph">初期投资1,000亿，所有这种投资案子后期投资多少，4年以内投资多少，大家都不要太去关心。未来做得好就多投一些，做得不好就少投一些。我们现在先把这个决心表了，但是真认真了你就输了。</p>



<p class="wp-block-paragraph">前期投入的1,000亿美金的这个数，还是要稍微靠谱一点的。可能在未来的一两年里头，这个1,000亿美金就要落地。而且这个1,000亿美金应该是会写在协议里的。你如果不落地的话，未来还是要再去找一些借口，才可以把这个协议推翻掉的。</p>



<p class="wp-block-paragraph">但是后边那个四年之内5,000亿美金呢，基本上就是写在备忘录里就完了，但不会有什么法律约束的。直接的参与者呢，就是OpenAI、Oracle、软银以及一个叫MGX的公司。间接参与者呢是ARM，因为软银是拥有90%的ARM股份，所以ARM说我要去参与进来。而且你如果再去做新的算力芯片，你也要用到ARM的各种的IP，所以ARM在里面。</p>



<p class="wp-block-paragraph">然后微软也在里面。为什么呢？他拥有OpenAI 49%的股份。而且为了这一件事情，微软还说我还要做一些让步来。</p>



<p class="wp-block-paragraph">什么让步呢？就是原来OpenAI是必须从微软去采购云计算的算力的。现在我愿意放弃这个条款，你现在可以自己去搞算力去了。你不能说星际之门计划做完了以后，OpenAI不能用，因为协议约束你拿了我的钱，就必须都要买我的算力。这个事肯定微软要松口，否则的话后边就没有他什么事情了。</p>



<p class="wp-block-paragraph">那么微软得到什么呢？OpenAI的所有这些云计算上的API接口，你还是要走微软云的。所以呢，这个里面应该有一部分的星际之门是使用的微软云的系统，微软也会参与进来。而英伟达这个你绕不过去，就算你未来可以整出自己的芯片来，但是你现在还是得老老实实地去买英伟达的芯片。所以英伟达还是可以坐在那数钱的，至少再数个两年没毛病。</p>



<p class="wp-block-paragraph">那么这个计划一出来以后呢，肯定是几家欢喜几家愁。刚才咱们讲了，微软、英伟达、ARM股价就直接开始上升了。马斯克呢就要出来阴阳一下，因为大家知道，马斯克跟山姆·奥特曼以及OpenAI的官司还没完呢。一看说OpenAI你这星际之门计划一上来，这个5,000亿美金一砸下去，那我这整的这个巨大的算力池XAI买了这么多显卡就显不出来了。</p>



<p class="wp-block-paragraph">这个一定要说来讲一下，马斯克讲的是什么呢？说孙正义最多也就100亿美金，他没钱。而且芯片产能的这个问题，你是解决不了的。目前你们讲这些事根本没法落地，因为你再多的钱都得上台积电排队去。现在能造这个玩意的只有台积电一家，三星也造不出来。Intel据说是有高级制程的这个生产工艺，但是呢，也现在只能给大家展示，并没有谁真正在它上成功留片的。Intel自己要去做这种高制程的芯片，还得上台积电那代工去呢。所以，你们都是胡吹牛。</p>



<p class="wp-block-paragraph">另外一个竞争对手是谁呢？Anthropic，他也提出了质疑。Anthropic的CEO叫达里奥·阿莫迪伊，他讲的是什么呢？说这个项目的资金承诺和实现的进展有点乱，就是搞不清这个1,000亿美金也好，5,000亿美金也好。</p>



<p class="wp-block-paragraph">他到底是怎么进来的？我们看不明白。而且呢，这个川普取消了拜登的AI监管政策之后，他也表达了一个喜忧参半的感受。为什么呢？因为大家要知道，川普取消了拜登的AI监管政策，绝大部分的AI公司都是很欢迎的，因为呢，他不再需要让AI公司去承担各种的后果了，或者说承担各种责任就不需要了。</p>



<p class="wp-block-paragraph">但是大家要注意，Anthropic他们是以什么著称的？他们是以宪法模型著称的。他的模型比别人都安全，他希望说管得严一点，这样他可能还能够脱颖而出。川普说来，咱们冲，都不管了。他也只能表达了一个喜忧参半。谷歌呢，也算是一个重要的参与者吧，但大公司呢比较稳重，这个事他没说什么，但是他要用行动来表达一下，直接用钱投票，给Anthropic追加了10亿美金的投资，站哪队大家已经看明白了。</p>



<p class="wp-block-paragraph">Meta呢，一直是在圈外面玩耍。其实，Meta做LLARMa模型一直也是有声音的，但是真正的顶圈的竞争，谷歌的Gemini、Anthropic的Claude、OpenAI的ChatGPT，LLARMa其实一直没有进到这个圈子的竞争里面去。但是呢，Meta也算是为世界AI领域做出了巨大贡献，因为中国现在可以跑出这么多的AI大模型来，还是要感谢Meta的LLARMa模型开源的。</p>



<p class="wp-block-paragraph">那么这个饼到底画得圆不圆呢？前面咱们也讲了，川普也好，山姆·奥特曼也好，孙正义也好，已经把这个胸脯拍得啪啪响了。但是呢，马斯克也好，Anthropic也好，谷歌也好，都不看好。那这个饼到底画得圆不圆？首先我们先研究一下，到底有多少钱的问题。马斯克说就没钱，你就撑死了100亿，因为这个里头孙正义负责搞钱嘛，山姆·奥特曼负责出技术，Oracle负责出底层的机房建设，微软可能也能够得到一部分的机房，英伟达负责提供早期的算力卡，未来是不是会被替换，那是未来的事情了，先不管它在这个里头有没有钱，这个是第一重要的。首先我们要讲清楚，钱不是现金。</p>



<p class="wp-block-paragraph">而是融资能力，以及各种的资产拼接在一起来算，这个1,000亿美金。首先，融资能力呢，孙正义还是有的。有一段时间，孙正义的融资能力是下降的，因为投资人就是这样：你投了特别烂的案子，或者赔了很多钱以后，大家就不敢把钱给你了。但是你一旦说我要证明自己的能力了，大家又愿意把钱给你了。</p>



<p class="wp-block-paragraph">前面他去玩Wework的时候，差点没把软银玩儿挂掉，大家就不敢给他钱了。后面把ARM成功弄上市，握有ARM 90%的股份，让ARM的这个股价每天蹭蹭蹭涨上去。现在ARM大概快2,000亿美金了，而且呢，软银手里边还有9.8%字节跳动的股份，这也是一个不可忽视的力量。</p>



<p class="wp-block-paragraph">为什么呢？2024年，全世界买最多GPU的是谁？是微软。买第二多GPU的就是字节跳动。但是2024年呢，字节跳动买的大量的是H20，也就是英伟达允许向中国出口的这种芯片，买了大概是20多万块吧。虽然这个数量是第二多的，但这个芯片是被阉割过的，要稍微差那么一点点。</p>



<p class="wp-block-paragraph">而且字节跳动现在也在有很多的传闻出来，2025年120亿美金的采购量，接着去买这些芯片。这120亿美金的55亿美金是在中国境内采购，其中55亿美金的60%是要买国产芯片，也就是华为升腾910这样的东西。这些芯片呢，主要是用来做推理，就是他们不是用这些芯片去做大模型训练的。剩下40%的钱呢，是去买H20，这些是用来做训练的。</p>



<p class="wp-block-paragraph">整个的120亿美金里头，还有68亿美金是要在境外，这一部分钱就要去买英伟达的GB200、GB300这样的芯片去了。这些芯片有可能在哪里？有可能就在美国。所以这个里面，比如ARM的一部分市值，是不是就可以算到这个1,000亿美金里头来？其实是可以的。或者我把ARM的股票质押掉，然后拿钱出来行不行？也可以。孙正义你想，他9.8%的字节股东，那说我用这个字节的投票权，你们这个68亿美金的GPU算力采购，必须要放到美国来行不行？它也是说得上话的。</p>



<p class="wp-block-paragraph">而且字节在美国的云计算中心是哪？是Oracle，这个是里面另外一个核心参与者。是不是可以放到Oracle云的这个机房里边去，把这个事搞定呢？都是可以把这个故事讲圆的。字节的这个68亿美金，肯定也是会花在这个项目里边来的。</p>



<p class="wp-block-paragraph">还有一个公司，可能大家不是那么熟悉，叫MGX。这MGX呢，其实是阿联酋阿布扎比那边的一个巨大的基金，他们手里头就有上千亿美金。MGX的老大是阿联酋阿布扎比的副酋长。阿联酋叫阿拉伯联合酋长国嘛，阿布扎比就是其中的一个酋长国。副酋长就是这个MGX的总经理。这个项目呢，是阿联酋国家主权基金跟G42合资的一个基金，他们呢，手里面也是有非常多的优质资产。</p>



<p class="wp-block-paragraph">最后一个是Oracle。Oracle是TikTok的股东，TikTok 12.5%的股份。TikTok有一个叫做TikTok国际的公司，这个公司呢，80%的股份是属于字节跳动的，20%的股份是在美国手里面。20%这里头12.5是Oracle的，剩下7.5好像是沃尔玛的。为什么很多人说，哎呀，TikTok为什么放掉了？看看，都是捆一块了，孙正义也在这呢，Oracle也在这呢，他们绑在一起也是非常合理的。</p>



<p class="wp-block-paragraph">那么你说芯片制程工艺行不行？马斯克说了，你们没钱，这事我给你解释了。但确实这些钱怎么能够凑在一起，这个过程还是稍微有点混乱的。那么芯片制程呢，现在大家还要指望台积电，这个没什么办法。但是前几天有一个什么消息呢，在Intel把他们的老CEO干掉之后，就传出有神秘买家要下手买它。当然后来也并没有马上实现这个交易，但是呢，这个传闻在市场上跑了一段时间了。</p>



<p class="wp-block-paragraph">咱们看看Intel值多少钱。Intel大概不到1,000亿美金，938亿美金。按照现在的这个估值的话，如果是星际之门项目冲上去把Intel买下来，这个可能性不大。因为一开始第一期投资1,000亿美金，如果你938亿美金把Intel买下来了，那就没钱了，不能这么干这个活。</p>



<p class="wp-block-paragraph">但是，如果把Intel的芯片厂拆出来单独卖，这个可能性就是存在的了。大家要注意，这个里边还有一个烂账要处理。什么呢？Intel拿了拜登政府的一些钱，而且这个钱的话，最后可能是没有办法去平这个账。如果这个钱投进来了，把Intel的这个芯片厂买下来，那么整个这个账就平了。甭管最后这个芯片造的出来造不出来，所有在中间操作这个事情的人就稳了，这个可能会在未来看到。</p>



<p class="wp-block-paragraph">另外，咱们刚才讲这个阿联酋阿布扎比的这个基金就是MGX，他们手里还有什么呢？他们手里有两个非常重要的标的，一个是AMD，还有一个呢叫Global Foundries。AMD大家知道是谁，苏妈苏兹风的公司。Global Foundries是谁？这个公司呢，其实原来是属于AMD的，它是AMD的芯片代工厂。MGX的母公司，也就是阿布扎比的国家基金，冲上去直接把AMD投资了以后，就帮他们做了这个分拆。所以呢，阿联酋上面的这个国家基金是AMD和Global Foundries的大股东，他是这样来的。所以他手里也是有一定的制程能力的。</p>



<p class="wp-block-paragraph">所以呢，这个1,000亿美金、5,000亿美金到底怎么算，又没说一定是现金，各种股权、各种的价值合并，这个玩法其实是很多的。很多账目就可以平了。我前一段时间看了一个小说，讲的什么呢？说这个明朝为什么出去打仗，跟清朝打仗的时候，就动不动就整个编制就都没有了。原因也很简单，一帮武将在这吃空饷，拿了国家的钱来养兵，说我这有1万人，实际上可能两三千人。那一出去，全军覆没，哎，账平了。他们可以干这样的事情。</p>



<p class="wp-block-paragraph">所以呢，这个星际之门计划里头应该会起到一定的类似作用，就是把一些原来的烂账把它处理掉。所以呢，纸面上这个饼是可以画圆的。这个星际之门计划说出来以后，其他国家会如何应对呢？第一个是中东国家。中东国家应该会积极的出钱，因为他们也知道石油总有挖光的一天，趁着现在手里有钱，算力就是未来的石油，他们肯定会去积极投入的。</p>



<p class="wp-block-paragraph">甭管是阿联酋，可能未来沙特也会进来去给钱。而且呢，这个项目可能除了在美国本土落地的这些机房之外，还会有大量的算力中心落地在中东地区。因为现在拜登的AI限制行政命令应该已经被川普给取消掉了，中东国家就应该可以大力去建设这些机房了。</p>



<p class="wp-block-paragraph">欧洲国家的话，应该会被美国狠狠地虹吸一波人才。只要你能够去做大模型相关的事情，你发现哦这么多的机房、这么多的算力中心都在美国，那咱们去吧。所以，欧洲我估计会有这样的一个变化。</p>



<p class="wp-block-paragraph">中国呢，应该再搞一波基建，大基建再来一次。那你说中国搞这个大基建有意义没有？至少这个很多人会去买H20嘛，这个事还是要去做的嘛。国内这么多人也在做，国产GPU也要卖得出去吗？</p>



<p class="wp-block-paragraph">郑国渠的故事大家应该了解吧，就是秦始皇要统一六国之前，有一个郑国人出来献策，说你要去建一条郑国渠，让整个秦国的土地都可以得到很好的灌溉。但这个过程一定会让秦国国力被极大的拖累。但是呢，很多人依然支持这件事情，原因也很简单：第一个，政治正确，可以国富民强；第二个是什么？太多利益在里边，我只要有大的工程起来，一堆人可以在里边挣钱。</p>



<p class="wp-block-paragraph">所以，中国肯定会搞一波大基建，就跟当年的星球大战计划，让苏联也在里边做了一波大基建一样。当然，星球大战计划最后的结果是让苏联好像稍微有一点点捉襟见肘，这个我们就不去研究了。我们比他们有钱，比那时候苏联有钱多了。所以，大旗舰还是可以再来一波的。</p>



<p class="wp-block-paragraph">这个计划之后，各个公司的短期的变化或短期的预期是什么样的呢？英伟达必然会出货，因为再怎么做芯片，新设计芯片这个事也不是一两年能做出来的。你从现在开始设计芯片，到最后能够装在机房里用，至少得2年。这两年怎么办？你就老老实实买英伟达的芯片就算了。</p>



<p class="wp-block-paragraph">然后，台积电肯定是把订单排满，因为短期内其他公司的这种高级制程的工艺肯定还是不行的。Intel呢，据说在搞1.8纳米和1.4纳米制程，但是呢，未必能够在川普下台之前能做出来。</p>



<p class="wp-block-paragraph">至于Globe Fountries的话，10纳米以下的基本上已经放弃了。它最高大概能做到12纳米。现在如果重新捡起来的话，也不是两三年能够搞得定的事情。谷歌XAI、亚马逊在这个时候必然会疯狂加大投入，这个没办法，因为OpenAI已经拿到尚方宝剑了。川普那直接宣布说星际之门开始了，剩下这些人想要不被踢下牌桌的话，只能是拼命的再去买卡，再去加大投入；否则的话，就有可能会被挤下桌。</p>



<p class="wp-block-paragraph">至于微软跟OpenAI呢，其实稍微有一点点尴尬，就是OpenAI现在有一点点后继乏力了，并不是说真的把钱砸下来，他们就可以把产品做好的。这块呢，还需要在拭目以待。至少年前的连续12天发布会，还是让大家稍微有一点点失望的。那么字节呢，其实是有机会借机上桌了，但是呢，他还是要先把TikTok的大麻烦搞定，然后呢，再决定往哪头站队。他现在基本上应该是站OpenAI这一队的，因为里边所有的人都跟他有关系，甚至好几个股东都在里头呢。这件事情他应该没有什么别的选择。</p>



<p class="wp-block-paragraph">那么星际之门到底行不行，到底是不是一个大饼，咱们来给一个结论，就是这种巨型的项目，如果没有领袖型的人才参与的话，基本上没戏。现在职业经理人是肯定不可能搞定这种事情的。孙正义呢算是董事长，但是这个项目到底谁是CEO，谁是执行者，不知道，搞不清楚。就算是山姆·奥特曼成为执行者，我觉得都未必可以把这个项目搞起来。像OpenAI这种项目，如果早期没有像马斯克这种人，在里边去冲杀的话，未必有后边的这个结果。山姆·奥特曼其实还是一个政治家，他并不是一个特别好的工程技术人员，也未必是一个特别好的CEO。</p>



<p class="wp-block-paragraph">星际之门的话，我觉得在今年应该是要看到一些动作的。如果没有什么动作的话，那么后面大概也就没什么响动了，因为这种长期的项目，后续承诺都是走着瞧的。如果你前期没有什么响动，没有什么结果的话，那么后期咱们就哦，还有这个事吗？我想不起来了，就会变成这样。</p>



<p class="wp-block-paragraph">至于新的推理芯片到底会不会有，咱们先不说训练芯片。训练芯片可能很长一段时间还是英伟达一家的天下。那么推理芯片是有可能能够做出来的，未来的话还是可以想一想，有谁能够做出比较好的推理芯片来。</p>



<p class="wp-block-paragraph">因为以ARM为基础，做芯片设计这件事并没有那么费劲。关键难点是什么？关键难点是谁代工。如果还是台积电代工，咱们就接着跟大家一起排产能就完了。如果Intel真的说把芯片厂搞定了，然后叽哩咔嚓开始出这个1.8纳米、1.4纳米芯片了，那这件事就有的可看了。</p>



<p class="wp-block-paragraph">一款新的芯片从设计到定型的话，可能比较快是18个月，慢了可能两三年都是很正常的。希望在川普同志离任之前，可以看到美国的芯片厂生产出芯片来，也可以看到新的推理芯片，或者为星际之门所设计的推理芯片能够真正装到德克萨斯或者哪个地方的机房里边去，给大家使用。</p>



<p class="wp-block-paragraph">我的结论就是未必一定会失败，还是有成功的可能性的。但是呢，星际之门出来以后，会给我们留下更多的瓜，等我们慢慢地往后吃。好，这一期就跟大家讲到这里，感谢大家收听。请帮忙点赞，点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>OpenAI连续12天发布会回顾：科技领军者的12大跨越式创新，Sora、Canvas与GPT-4O带来哪些启示？</title>
		<link>https://lukefan.com/2024/12/16/openai%e8%bf%9e%e7%bb%ad12%e5%a4%a9%e5%8f%91%e5%b8%83%e4%bc%9a%e5%9b%9e%e9%a1%be%ef%bc%9a%e7%a7%91%e6%8a%80%e9%a2%86%e5%86%9b%e8%80%85%e7%9a%8412%e5%a4%a7%e8%b7%a8%e8%b6%8a%e5%bc%8f%e5%88%9b%e6%96%b0/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Mon, 16 Dec 2024 00:39:10 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AGI]]></category>
		<category><![CDATA[AIGC行业]]></category>
		<category><![CDATA[AI技术]]></category>
		<category><![CDATA[AI硬件]]></category>
		<category><![CDATA[AI行业趋势]]></category>
		<category><![CDATA[Apple Intelligence]]></category>
		<category><![CDATA[Canvas]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[Dalle更新]]></category>
		<category><![CDATA[Gemini 2.0]]></category>
		<category><![CDATA[GPT4.5]]></category>
		<category><![CDATA[Her语音功能]]></category>
		<category><![CDATA[LLaMA 3.3]]></category>
		<category><![CDATA[Meta]]></category>
		<category><![CDATA[O1订阅]]></category>
		<category><![CDATA[OpenAI发布会]]></category>
		<category><![CDATA[Project功能]]></category>
		<category><![CDATA[Siri集成]]></category>
		<category><![CDATA[Sora]]></category>
		<category><![CDATA[产品发布]]></category>
		<category><![CDATA[产品总结]]></category>
		<category><![CDATA[创新产品]]></category>
		<category><![CDATA[创新科技]]></category>
		<category><![CDATA[强化微调]]></category>
		<category><![CDATA[技术革新]]></category>
		<category><![CDATA[新功能]]></category>
		<category><![CDATA[新科技产品]]></category>
		<category><![CDATA[智能体框架]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[用户交互]]></category>
		<category><![CDATA[用户交互界面]]></category>
		<category><![CDATA[用户体验]]></category>
		<category><![CDATA[用户体验提升]]></category>
		<category><![CDATA[科学家工具]]></category>
		<category><![CDATA[科技产品]]></category>
		<category><![CDATA[科技产品创新]]></category>
		<category><![CDATA[科技产品创新趋势]]></category>
		<category><![CDATA[科技产品发展]]></category>
		<category><![CDATA[科技产品发布]]></category>
		<category><![CDATA[科技产品趋势]]></category>
		<category><![CDATA[科技公司]]></category>
		<category><![CDATA[科技公司产品]]></category>
		<category><![CDATA[科技公司产品创新]]></category>
		<category><![CDATA[科技公司产品创新趋势]]></category>
		<category><![CDATA[科技公司产品发展]]></category>
		<category><![CDATA[科技公司产品发布]]></category>
		<category><![CDATA[科技公司创新]]></category>
		<category><![CDATA[科技公司发展]]></category>
		<category><![CDATA[科技公司发展趋势]]></category>
		<category><![CDATA[科技公司发布]]></category>
		<category><![CDATA[科技公司发布会]]></category>
		<category><![CDATA[科技公司行业趋势]]></category>
		<category><![CDATA[科技公司趋势]]></category>
		<category><![CDATA[科技创新]]></category>
		<category><![CDATA[科技创新趋势]]></category>
		<category><![CDATA[科技发展方向]]></category>
		<category><![CDATA[科技发布]]></category>
		<category><![CDATA[科技发布会]]></category>
		<category><![CDATA[科技巨头]]></category>
		<category><![CDATA[科技行业发展]]></category>
		<category><![CDATA[科技行业趋势]]></category>
		<category><![CDATA[科技趋势]]></category>
		<category><![CDATA[行业领军]]></category>
		<category><![CDATA[视频交互]]></category>
		<category><![CDATA[视频模型]]></category>
		<category><![CDATA[视频生成]]></category>
		<category><![CDATA[视频生成模型]]></category>
		<category><![CDATA[语音功能]]></category>
		<category><![CDATA[语音识别]]></category>
		<category><![CDATA[谷歌]]></category>
		<category><![CDATA[项目管理]]></category>
		<category><![CDATA[项目管理工具]]></category>
		<category><![CDATA[高级语音]]></category>
		<category><![CDATA[高级语音功能]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1770</guid>

					<description><![CDATA[啊啊啊啊！OpenAI的连续12天发布会真的太刺激了！🤯🤯🤯每天都有新惊喜！我已经迫不及待想看看最后会发布什么了！

先来给大家总结一下前7天都发布了啥：

**Day 1：**OpenAI说，我们要涨价了！😱😱😱O1和O1 Pro每月200美金！不过对于咱们普通人来说，4.0就够用了啦～

**Day 2：**发布了一个叫强化微调的科学家工具，普通人用不上，跳过跳过！

**Day 3：**期待已久的Sora终于来了！🎉🎉🎉我连夜爬上去体验了一把，效果确实比其他视频模型好一些，交互方式也更方便了！

**Day 4：**Canvas免费开放！🎉🎉🎉这个功能真的绝绝子！以后都不用Office了！

**Day 5：**Apple Intelligence和Siri接入ChatGPT，可惜国内用不了😭

**Day 6：**Her真的来了！🎉🎉🎉可以打开摄像头和GPT聊天了！我试了试，真的太好玩了！

**Day 7：**发布了Project功能，可以把文件上传给ChatGPT处理，效率提升1000%！

除了OpenAI，谷歌、Meta、Pica、Midjourney等公司也都发布了新产品，AIGC行业真的太卷了！😱😱😱

我已经搬好小板凳，坐等OpenAI接下来的发布会了！你们最期待什么功能呢？评论区告诉我！

OpenAI连续12天发布会回顾：科技领军者的12大跨越式创新，Sora、Canvas与GPT-4O带来哪些启示？

在连续12天的发布会中，OpenAI已经发布了包括O1、强化微调、Sora、Canvas、Apple Intelligence、Her和Project在内的7款重磅产品，从科学家工具到通用用户应用，每款创新都指明了AI行业的未来发展方向。例如，Sora引领了视频生成领域新潮流，Canvas提升了文档与代码编辑效率，而增强语音和视频交互的Her则让人工智能更贴近人类。随着Project进一步探索工作流整合，OpenAI正在为未来取代传统操作系统铺路。这些发布在吸引全球关注的同时，也引发了行业巨头如谷歌、Meta、MidJourney等快速跟进，各大技术公司争相优化多模态生成和视频模型等领域。结合即将推出的Dalle改进版、智能体框架及可能的GPT4.5更新，这场发布盛宴将为未来的人工智能生态打开更多的可能性。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="OpenAI连续12天发布会回顾：科技领军者的12大跨越式创新，Sora、Canvas与GPT-4O带来哪些启示？" width="900" height="506" src="https://www.youtube.com/embed/760VNZv1O1k?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">OpenAI的连续12天发布会现在已经过半，发布了些什么东西呢？咱们来总结一下。</p>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事的YouTube频道。12天开12场发布会，算是前无古人了。人家以前的发布会都是在集中一两天的时间里，聚集尽可能多的人把它开掉。但是，OpenAI就是要不走寻常路，选择连续发布12天，每天发布一点新东西出来。而且他们的发布会是在网上开了个直播间，有时候山姆·奥特曼在，有时候他不在，大家就一起来讲讲这段时间又做了点什么新东西。这还是非常有趣的一种发布方式，算是把年底这一段时间所有人的注意力又都拉回了OpenAI以及AIGC这个赛道上。</p>



<p class="wp-block-paragraph">那么到年底了，大家都得卷，大伙有没有？有。但是，肯定没有12个。如果真的说年底有12个重磅级产品发布的话，他们也不会用这种方式。应该还是会有很多零七八碎的小功能在这12天发布出来，但也会有一些比较激动人心的东西。而且要卷，大家一起卷嘛。OpenAI作为AIGC行业的领军人物，既然开始卷了，其他人必然会跟进。</p>



<span id="more-1770"></span>



<p class="wp-block-paragraph">前段时间我们讲过，OpenAI的最主要的社会贡献是什么？就是为行业指明方向。他指明了方向，其他人就会跟。那么都发了些什么东西呢？</p>



<p class="wp-block-paragraph">第一天特别逗，首先涨价，上来先说我们做一个200美金一个月的订阅。如果你要去使用O1的完整版或者是O1 Pro，每个月的成本是200美金，这就是第一天发布的东西。而且，O1也好，O1 Pro也好，如果你不是科学家，不是那种真正需要进行推理的人，其实意义没有那么大。对于普通人来说，4O就已经足够了，O1完完全全就是很小众的一个产品。</p>



<p class="wp-block-paragraph">第二天发布的其实还是一个科学家工具，叫强化微调。意思是什么呢？就是大家现在都在讲炼丹，说明这个大模型不知道你到底是什么，不知道你具体要干嘛，所以他经常会所答非所问。</p>



<p class="wp-block-paragraph">我们对这个模型进行一定的微调之后，他就知道说：“哎，我今天是上岗来干什么什么事情呢。”就会做得好一些。OpenAI说来，我们发布一个强化微调的功能，你只需要提供比较少的数据，它就可以有一个非常好的微调的结果。这个呢也是一位科学家上来演示。像这种功能呢，跟前面我们讲的O1一样，就是普通人用不上，都是非常小众的科学家产品。</p>



<p class="wp-block-paragraph">等到第三天，终于有这个大活上来了，Sora千呼万唤始出来。我呢，基本上是等了接近一周的时间才爬上去。Sora出来以后，大家就都疯狂的往上去爬，想去尝试使用。但是呢，他一直是关闭注册的状态。就是你可以在第一个页面上看到演示的这个视频，但是你没有办法登录进去自己去创作。大概是等了，我忘了是几天了，四五天吧，然后才进去。</p>



<p class="wp-block-paragraph">Sora的模型呢，跟其他的一些视频模型比较起来，算是领先一点点。但是具体的感受，其实也没有那么大差异。对于像我这种一个月20美金的plus用户来说，我每个月应该可以生成50段动画。测试了感觉跟Runway、Pica，还有包括国内的可灵和集梦比起来，有差异，但是不是特别明显。从这个模型角度上说，更多的改进是什么呢？就是用户交互方式上改了。他给你了一些故事版，比如说你可以在一个时间线上写多段的这种提示词。这个呢，其实是给了大家很多的启示了。</p>



<p class="wp-block-paragraph">因为以前大家生成图片的时候，你给他一个提示词，他给你画出来没毛病。但是呢，生成视频的时候，再给他一个提示词，让他给你画出来，这个事就有点难了。因为视频是很多张图片凑在一起的嘛。所以说别费劲了，咱们就是在不同的时间点上使用不同的提示词，让这个大模型知道我们怎么在这个场景里边进行转换。我相信很快就会有其他的产品来跟进。</p>



<p class="wp-block-paragraph">到第四天呢，他们发了canvas。canvas其实原来就发过，只是现在告诉大家说，免费用户你也可以用了。现在canvas这个产品呢，基本上是垫进去隔office的命。什么意思呢？就是它等于是有一测试。</p>



<p class="wp-block-paragraph">你可以去跟他聊天了，但是最大的一个窗口实际上是个编辑器。你可以在一个编辑器里边说：“哎，给我去增加点什么内容，删除点什么内容。”然后哪一段呢，稍微的怎么去调整一下。然后你说：“你给我整个检查一下。”再检查一下说：“哎，这段怎么样，那段怎么样？”它有点像Word的使用方式。</p>



<p class="wp-block-paragraph">当然，你可以一边在这种对话框里跟他去聊天，另外一边什么呢？你可以直接在编辑器里改这个文件。改完了以后说：“哎，这样是不是好一点，那样是不是好一点？”就是人跟这个OpenAI的ChatGPT一起配合来去修改这个文件。如果这套东西大家使用习惯了以后，那么就不会再有Office什么事了。</p>



<p class="wp-block-paragraph">它现在呢，只是一个Word文档，大家可以在上面折腾，但是代码也可以，Canvas改代码的效果也是极好的。现在你说有没有像PPT这样的东西，或者像Excel这个表格这样的东西，可以让他在Canvas这边去干活的？我相信未来会有，这一定是奔着Office全家桶去的一个产品，这个产品还是非常非常好用的。现在免费也可以用嘛，这个功能上来以后，整个的效率会提升非常非常多的。</p>



<p class="wp-block-paragraph">然后到第五天，Apple Intelligence和Siri就上来了，其实就是给大家演示一下怎么可以在苹果设备上，甭管是电脑还是手机上，挂上ChatGPT，然后进行沟通、进行聊天，还可以做一些截屏，以及图片和视频方面的这种工作。这个呢确实是比较激动人心，但是对于中国来说其实没有用的。为什么？因为咱使不了。这个产品发布了以后，整个OpenAI的服务器，我觉得能有个五六个小时就直接宕机了。这个呢充分显示了苹果用户的威力，就是苹果的用户量还是非常非常大的，即使刨除掉中国，剩下的苹果用户也是非常给力的，直接把OpenAI的服务器干崩了。</p>



<p class="wp-block-paragraph">到第六天呢，是Her真的来了。原来我记得在发布GPT-4O的时候，当时大家看完了以后非常激动，实在是太震撼了。只是呢，在GPT-4O发布之后。</p>



<p class="wp-block-paragraph">它就又往回退了一点。它发布的是期货，并不是马上就能用的。刚才咱们讲的所有这些东西里头呢，有一个叫强化微调的功能，那也是个期货，现在使不了。其他的是马上就可以用下来了。OpenAI发布了GPT-4O之后呢，大概是过了也是几个月吧，才把高级语音功能拿出来，就是大家真的可以去跟GPT去聊天了。你可以打断它，它还可以去判断你的语气语调，这一块其实就已经强很多了。</p>



<p class="wp-block-paragraph">在这个之前呢，它还是通过说把语音识别出来，然后变成文字处理，处理完了以后，再把这个文字念出来，通过这样的方式来工作的。但是高级语音功能呢，等于语音进去，语音出来，端到端的中间并没有变成文字的这个过程。虽然你最后结束了以后，是可以去看到所有生成的文字的，但是它会流畅得非常非常多。</p>



<p class="wp-block-paragraph">但是呢，依然没有让我们看到完整的GPT-4O，或者叫Her，实际上是那个电影的名字，就是一个人工智能，像一个伴侣一样陪着你。这一次彻底出来了，加上什么呢？视频。我们可以打开摄像头，让GPT看着我们，跟我们去聊天。但是这个过程呢，GPT还是稍微有一点小滑头的。我让它看着我，我说你看我怎么样，它说你很精神。我说你看我年轻吗，它说你很有活力。后来我说，你能不能判断一下我的年龄，它说不行，我尽量不惹你生气。反正还是比较油滑的。</p>



<p class="wp-block-paragraph">我还跟我太太两个人一起上镜，我说来，我们俩谁好看，它说你们两个都很有活力。好吧，这个就当是它骂人吧，反而给我们带来了很多的欢乐。让它去拍各种场景，你家里边的各种家具，屏幕上的各种截图，你让它拍下来以后，它都可以实时地去做出反馈了。甚至呢，你比如说，你让它拍自己的视频的时候，你不跟他说话，朝它笑一笑，它都会马上这个回应你：“哎，笑一笑真好。”这个就显得非常非常智能了。</p>



<p class="wp-block-paragraph">这个功能极其好玩，如果你订阅了Plus，一定要去试一试，非常非常欢乐的一个产品。到第七天呢，发布了一个产品叫Project，Project的这个产品非常有意思，它等于是……</p>



<p class="wp-block-paragraph">在ChatGPT里边给大家开了一个目录。你可以把它打开了以后，然后说：“我现在需要处理这些文件。”然后你把这些文件都上传上去。然后呢，它根据这些文件去进行响应。</p>



<p class="wp-block-paragraph">原来呢，甭管是拆CPT也好，还有其他的所有这种聊天工具也好的，有一个很大的问题是什么？就是无状态。每一次去的时候，它都不认识你，需要从头去告诉它：“我今天有什么具体的事情。”如果你说：“哎，你把我的硬盘都搜索一下，在这个基础上跟我聊天呢？”它也很痛苦。为什么？因为你硬盘里的东西很多，它搞不清楚你到底要跟它聊具体什么事情。</p>



<p class="wp-block-paragraph">所以，让它在某一个具体的任务上聚焦起来，现在我们就来做一个旅游规划。我把旅游相关的所有信息都给你，你就在这个范围内给我回答。这件事情原来是比较难以做到的。很多人去做AI Agent，去做工作流，去做RAG，实际上都是为了解决这个问题。</p>



<p class="wp-block-paragraph">现在OpenAI说来了，咱们直接给你提供一个project的功能。你为了实现一个具体的功能，就把相应的文件都传上来，然后我就在你传上来的这批文件内给你去干活。这其实是OpenAI在向着自成操作系统的路上继续狂奔。他们认为以后不再需要操作系统了，什么Mac OS、Linux、Windows都不要这些玩意儿，我们自己干。我们自己把这些需要的东西找到了，以后就可以直接工作了。</p>



<p class="wp-block-paragraph">大家以后就慢慢地把各种各样的文件都存在OpenAI的服务器上。你每次就问它：“我这个项目里头都有什么事情？我应该如何继续往前走？”“我另外一个项目里都有什么事情？有什么文件？有什么信息？我应该如何往前走？”这以后就不再需要操作系统了。</p>



<p class="wp-block-paragraph">大家注意，前面谷歌出了一个产品，叫Workspace，其实已经部分实现了这件事情。Workspace就是你上去以后，实际上是个网盘，把各种文件都存上去。以后你就可以在网页端。</p>



<p class="wp-block-paragraph">直接去有所有的Office功能，不再需要说我在硬盘上存在什么地方，我在这个其他地方怎么去存，然后怎么去找到它，不用干这个事了。我们在全世界任何一台电脑上，只要你能登陆到自己的谷歌账户，我们就可以使用云端的这台电脑，它里面存着我们所有需要的文件，有完整的Office相应的功能。</p>



<p class="wp-block-paragraph">现在OpenAI说来，我们也照这个方式来。以后可能我们下一个产品，就是叫OpenAI网盘，大家以后就可以在那个上面干活了。那么以后你就问OpenAI说：“哎，某个目录里有些什么东西，或者是哪天放了一些什么东西上来呀？我最近有些什么样新的文件变化呀？”他就去工作去了。</p>



<p class="wp-block-paragraph">那么OpenAI可能就会有新的收费方式，按照这个网盘存储空间这样去收钱。这可能也是未来大家可以去前进的方向，因为我一直讲OpenAI对于社会的最大贡献，就是指明方向。其实现在你用谷歌的Gemini已经可以部分完成这种工作了。如果你给谷歌Gemini去付费，它也可以在你的Workspace里边去干活。</p>



<p class="wp-block-paragraph">但是Gemini目前为止呢，还没有那么聪明，虽然发了Gemini 2.0 Flash要稍微好一些，但是在各种的组件结合上，谷歌还有待提升。目前为止，12天里他已经过了7天了，大家注意，他礼拜六礼拜天是休息的，发布了7个新产品，后边呢还有5个新产品等待发布。其他公司呢，肯定也都没闲着，这个行业带头大哥已经冲了，其他人如果不跟着的话，肯定你的态度不够端正。</p>



<p class="wp-block-paragraph">第一个冲上来的是谷歌，谷歌的Gemini 2.0 Flash这个版本上来了，它的整个工作效果确实是要比原来的Gemini 1.5要强非常非常多。而且它是个Flash版本，速度非常快还免费。它比咱们在1.5以及他们中间出的各种各样的版本的这个模型都要快得多，效果也非常的好。只是呢，他演示的非常多的东西，其实你压根找不着在哪。为什么？这是个技术型的公司，大家不要对谷歌这种。</p>



<p class="wp-block-paragraph">技术型公司的产品能力抱有太高的期望，这个怎么讲呢？就是按他的说法，Gemini 2.0呢，完完全全可以像GPT-4那样，具备高级语音功能，像电影《Her》一样去工作。你可以与它对话，可以让它进行视频采集或图片采集。它生成的内容呢，甚至比PPT-4还要强。它可以生成混合内容，生成完文字后，再夹杂着图片一起生成出来。OpenAI现在只能生成图片或文字，无法将二者混合输出。</p>



<p class="wp-block-paragraph">现在的谷歌的Gemini 2.0，据说可以做到这些。只是呢，它把所有的多模态输入和输出功能，都放在了开发者工具里，或者是一些未来项目中，让大家去加入waitlist，等待使用。因此，我们现在唯一使用它的方式，就是像我这样去申请开发者账号，然后将Gemini 2.0 Flash的模型挂到自己的应用里，可以使用它的部分功能。完整功能，生成混合的文字和图片，目前还做不了。</p>



<p class="wp-block-paragraph">谷歌更新了之后，Meta肯定也不闲着。第一个呢，是把Llama 3.370币这个模型放出来了。现在Llama 3.370币的效能，比原来的Llama 3.1 405币高很多。其实在国内，我们一般不太尝试使用Llama，因为一旦Llama更新，可能过一个月左右，通义千问以及国内其他开源模型就会更新，补上这个窟窿。所以我觉得稍微等一等，可以期待下一步的产品。</p>



<p class="wp-block-paragraph">Meta也公布了自己的视频生成模型，OpenAI已经上来了，Sora也出来了。Meta也要有其他的，比如说腾讯混元纹身视频大模型，这两天也突然开放，大家可以去试用。我去试了试，还是有点一言难尽。做这种视频生成模型里，最难的其实不是视频生成，而是模型操控。它的用户交互界面稍微差了点。但是既然OpenAI已经指明了方向，大家就朝着这个方向努力就好了。</p>



<p class="wp-block-paragraph">Pica也更新了。Pica是华人团队做的一个美国的视频生成模型。他们呢，就很快地把OpenAI Sora的这些视频交互方式搁进去了。他怎么弄呢？就是你先上一副照片，说我要这个人，然后这个人呢，要去飞翔。他等于就可以很好地保持这个人的样子，然后去做后边这个动作。然后你再给他一幅图，说：“哎，现在要在这个环境下飞。”他这一块就可以编排得比较好了。现在已经可以做出一些非常有趣的小视频，在推特上面去传播了。</p>



<p class="wp-block-paragraph">Pica更新了，MidJourney也更新了。MidJourney更新的那个产品特别有意思，它叫故事版。什么意思呢？就是大家原来不都抱怨说这个东西的一致性差吗？说我想让它连续地输出一些内容，输出不出来。MidJourney你说来，我们这次更新一个有趣的功能。在一个故事版里头，你先定义角色，这叫张三，那叫李四，这叫王五，这叫赵六，定义了一堆角色。然后呢，再定义一堆场景，这是厨房，这是厕所，这是客厅，那是卧室，哪个地方是教室。定义完了以后呢，你再去定义，说张三在厕所里边碰到了李四，李四在厨房里边给王五做饭，王五在教室里边去做什么。当你把这些提示词写完了以后，他就用你前面定义的角色，在你前面定义的这个场景里边发生各种互动了。</p>



<p class="wp-block-paragraph">再往后，他家去做各种漫画，做各种的故事书，就非常非常方便了。你后边可以把这个故事写得很长，他在整个的生成过程中不会发生大的偏移。这个也是非常棒的。我觉得呢，也算是被Sora稍微提醒了一点吧，或者说大家可能殊途同归，都向这个方向走。只是呢，Sora发布了以后，MidJourney呢也再往前走一步。中国的各大模型公司呢，现在应该都在加班加点，Sora指明方向了以后，可灵还有像吉梦这样的视频模型，应该都会向这个方向前进，就是向故事版前进。视频生成过程中，某一些提示词在某几秒钟，或者某一些提示词在某个特定时间点里边起作用，这个大家应该都会跟上。</p>



<p class="wp-block-paragraph">CANVAS和Project的这样的功能的话，字节的豆包还有像Kimi，他们应该都会去学习一下。至于数学大模型的话，从O1 Preview出来之后，大家其实就都已经在追赶了。比如说像阿里出的QWQ，通义千问下面专门有一个模型叫QWQ，就是做这种推理模型的，32B在我本机就可以跑起来，推理效果还是相当不错的。Kimi呢，也专门做了一个叫K0MAS，专门的一个数学模型，都是进行推理使用的。</p>



<p class="wp-block-paragraph">搜索这一块的话，其实大家都已经做得还不错了。这就是前面七天给大家带来的这些变化。还有五天有可能发布什么呢？第一个很多人都在期待，Dalle是不是该出师了。Dalle3已经发布了很久很久了，没有什么更新。而且Dalle3现在明显的已经跟其他所有的图片生成模型比起来，落后非常多了。现在大家再去做视频生成的时候，都是用MidJourney生成的图片去做视频生成的地图。Dalle呢，是需要努力了，这个有可能会再往前走一步。</p>



<p class="wp-block-paragraph">他们发布会的时候，其实是有一些暗示的。这一次在发布的时候，OpenAI X7BT在网页端做了一个比较大的这种改变。什么呢？就是他在聊天窗底下加了一堆工具栏，然后这工具栏里头有一批呢，是搜索、Dalle，还有Canvas，这些东西是在一个栏里头。你要先选我要用哪个工具，然后再去跟它说话。大家想，这个里头为什么会有一个Dalle呢？肯定他是有事情了。他把这样的一个已经稍微有一点点小落后的产品，跟这次新出来的这种搜索呀、Canvas放在一起，那么它有可能会更新。</p>



<p class="wp-block-paragraph">然后新的智能体框架有可能也会出来。由于现在大家都在讲，说大模型就卷成这样可以了，后边呢，大家去搞一搞智能体。大家注意，现在的OpenAI呢，这么多新功能，其实是不能一起使的。什么意思呢？就是CANVAS、Search、语音功能，你每次必须选一个，你不能说我都选，说我一边语音功能，一边你去给我搜索。</p>



<p class="wp-block-paragraph">这事不行。你说我一边canvas一边去搜索，这事也不行。或者说，哎，我去推理一下，推理完了以后，你给我放到canvas里头，或者去做语音这个事，都是不允许的。每次只需选一个，这个还是非常不方便。未来可能会有一些方法把这些功能串起来，而这些功能串起来以后，OpenAI的ChatGPT的可用性会提高非常大的一大截。</p>



<p class="wp-block-paragraph">还有什么可以期待的呢？就还有人会去期待这个AI硬件。到年底了，折腾了这么长时间了，是不是也该拿出一个东西来？特别是前面，苹果当年iPhone的设计师，号称是在跟OpenAI一起合作做AI硬件。那么到年底了，是不是给大家瞅一瞅？这个有可能会出现，但这块呢，完全是咱们猜测，没有任何的依据。</p>



<p class="wp-block-paragraph">还有一个是什么呢？就是有可能会出GPT4.5，就是它有可能会在GPT4的基础上再往前走一点。你说一下到GPT5，这个呢稍微有一点点难度，但应该还是会继续往前走的。因为在发布Siri那一天，他呢也做了一个暗示。在发布Siri那天呢，他们拿这个是iPhone，上面呢只有一个日历的框，在这个屏幕上，那个日历上写着说，我们要去发布下一代的AGI或者什么这样的东西。大家就去猜测说，这有可能是GPT4.5。这就是未来五天里头，大家还是可以去期待一下的事情。</p>



<p class="wp-block-paragraph">等OpenAI把所有的12天、12个产品都发布齐了以后，我会再录视频跟大家进行总结。好，这一期就跟大家讲到这里，前面已经发布的产品，赶快去使用起来，非常好玩。好，感谢大家收听，帮忙点赞，点小铃铛，参加Discord讨论群，也欢迎有兴趣有能力的朋友加入我们，付费频道再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>Sora接口短暂泄露，艺术家们揭示Open AI的剥削内幕，是公关噱头还是真心合作？</title>
		<link>https://lukefan.com/2024/11/29/sora%e6%8e%a5%e5%8f%a3%e7%9f%ad%e6%9a%82%e6%b3%84%e9%9c%b2%ef%bc%8c%e8%89%ba%e6%9c%af%e5%ae%b6%e4%bb%ac%e6%8f%ad%e7%a4%baopen-ai%e7%9a%84%e5%89%a5%e5%89%8a%e5%86%85%e5%b9%95%ef%bc%8c%e6%98%af%e5%85%ac/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Fri, 29 Nov 2024 00:42:07 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AI工具]]></category>
		<category><![CDATA[AI应用]]></category>
		<category><![CDATA[DALL-E 3]]></category>
		<category><![CDATA[Hugging Face]]></category>
		<category><![CDATA[Open AI]]></category>
		<category><![CDATA[SEO优化]]></category>
		<category><![CDATA[Sora大模型]]></category>
		<category><![CDATA[Turbo版本]]></category>
		<category><![CDATA[业内动态]]></category>
		<category><![CDATA[互动媒体]]></category>
		<category><![CDATA[产品发布]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[企业创新]]></category>
		<category><![CDATA[企业合作]]></category>
		<category><![CDATA[保密协议]]></category>
		<category><![CDATA[公关策略]]></category>
		<category><![CDATA[内容优化]]></category>
		<category><![CDATA[内容匹配]]></category>
		<category><![CDATA[内容变现]]></category>
		<category><![CDATA[内容审核]]></category>
		<category><![CDATA[内容生成]]></category>
		<category><![CDATA[内容策略]]></category>
		<category><![CDATA[内容质量]]></category>
		<category><![CDATA[创意合作伙伴]]></category>
		<category><![CDATA[创意平台]]></category>
		<category><![CDATA[动态内容]]></category>
		<category><![CDATA[可控性]]></category>
		<category><![CDATA[品牌保护]]></category>
		<category><![CDATA[图像生成]]></category>
		<category><![CDATA[在线工具]]></category>
		<category><![CDATA[在线编辑工具]]></category>
		<category><![CDATA[媒体传播]]></category>
		<category><![CDATA[媒体内容]]></category>
		<category><![CDATA[媒体整合]]></category>
		<category><![CDATA[媒体营销]]></category>
		<category><![CDATA[实时生成]]></category>
		<category><![CDATA[宣传策略]]></category>
		<category><![CDATA[市场趋势]]></category>
		<category><![CDATA[平台发展]]></category>
		<category><![CDATA[平台生态]]></category>
		<category><![CDATA[开发者社区]]></category>
		<category><![CDATA[开源合作]]></category>
		<category><![CDATA[影视行业]]></category>
		<category><![CDATA[技术产业]]></category>
		<category><![CDATA[技术创新]]></category>
		<category><![CDATA[技术对比]]></category>
		<category><![CDATA[技术开发]]></category>
		<category><![CDATA[技术挑战]]></category>
		<category><![CDATA[技术突破]]></category>
		<category><![CDATA[挑战与机遇]]></category>
		<category><![CDATA[效果展示]]></category>
		<category><![CDATA[数字人]]></category>
		<category><![CDATA[数字媒体]]></category>
		<category><![CDATA[数据处理]]></category>
		<category><![CDATA[数据安全]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[模型参数]]></category>
		<category><![CDATA[模型训练]]></category>
		<category><![CDATA[法律风险]]></category>
		<category><![CDATA[深度学习]]></category>
		<category><![CDATA[版权纠纷]]></category>
		<category><![CDATA[生成模型]]></category>
		<category><![CDATA[用户交互]]></category>
		<category><![CDATA[用户体验]]></category>
		<category><![CDATA[知识产权]]></category>
		<category><![CDATA[社交媒体策略]]></category>
		<category><![CDATA[社交影响]]></category>
		<category><![CDATA[算力成本]]></category>
		<category><![CDATA[线上互动]]></category>
		<category><![CDATA[自动化处理]]></category>
		<category><![CDATA[艺术家]]></category>
		<category><![CDATA[艺术表现力]]></category>
		<category><![CDATA[行业先锋]]></category>
		<category><![CDATA[覆盖范围]]></category>
		<category><![CDATA[视觉创意]]></category>
		<category><![CDATA[视觉效果]]></category>
		<category><![CDATA[视频内容]]></category>
		<category><![CDATA[视频安全性]]></category>
		<category><![CDATA[视频模型]]></category>
		<category><![CDATA[视频流]]></category>
		<category><![CDATA[视频特效]]></category>
		<category><![CDATA[视频生成]]></category>
		<category><![CDATA[视频生成技术]]></category>
		<category><![CDATA[视频生成潜力]]></category>
		<category><![CDATA[视频编辑]]></category>
		<category><![CDATA[视频风格]]></category>
		<category><![CDATA[计算机视觉]]></category>
		<category><![CDATA[语音合成]]></category>
		<category><![CDATA[跨平台使用]]></category>
		<category><![CDATA[跨文化传播]]></category>
		<category><![CDATA[身份验证]]></category>
		<category><![CDATA[高成本]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1733</guid>

					<description><![CDATA[大家好！🎉今天我们聊聊Sora的短暂泄露事件！！！

也许你已经听说过，Open AI的Sora大模型从今年年初就引起了大家的关注！可是啊……等到现在，时间慢慢来到了年底，发布却依旧遥遥无期！这可真是让人感觉到无奈啊！！！

就在这样的时刻，一群充满激情的艺术家们决定将Sora的接口丢到Hugging Face上，进行短暂的开放！😱他们还很大胆地发表了一封公开信，表达了自己对Open AI剥削的不满！这可不是小事哦！等Open AI察觉到后，立刻就封闭了接口，真的是快！只用了一小时！⌛️

可是，等了这么久，大家更想知道的还是Sora到底什么时候启动！而这次泄露的信息出来的其实是名为“Turbo”的版本，不过这只是一个轻量级、快速的模型，并不能够展现出Sora真正的全部实力！我真的忍不住想说，艺术家们靠谱吗？为什么会有这么多的挑战在等着他们？🤔

《Sora泄露》背后的故事真的引人入胜！艺术家们表达的不仅仅是对技术的渴望，更多的是对创作自由的追求！🎨“富贵不归乡，如锦衣夜行”，这句话深刻地反映了他们渴望分享的心情！不让他们显摆的模样，简直就是把他们绑住了手脚啊！😩

那些加入Sora的艺术家们经历了什么？他们被分为三种角色，还有人被称为“红队成员”，这听起来就充满了挑战与戏剧性！想知道更多按住这个“电源”你可得耐心等一下，这可不是简单的公开信能解答的问题！🔍

所以，未来的Sora究竟何去何从？是否意味着艺术家们的呼声会得到更好的回应呢？✨各位小伙伴们，快来一起讨论吧！让我们一起关注这个备受争议的模型！🗣️

别忘了点赞、分享我的频道，我们下次见！😘

Sora接口短暂泄露，艺术家们揭示Open AI的剥削内幕，是公关噱头还是真心合作？

在今年2月，Open AI推出了备受期待的Sora大模型，它曾被视作视频生成领域的前景。然而，至今尚无正式发布。近期，一群艺术家在Hugging Face短暂开放了Sora的Turbo版本，并发表公开信指责Open AI对艺术家们的剥削，使得Sora再次成为公众焦点。尽管其生成的视频质量和表现力不如预期，艺术家们在其开发过程中的辛苦和对创意的高标准受到阻碍。当前已经有Runway、吉梦等多款视频生成工具可供使用，市场上充满了潜力。此次泄露事件到底是公关策略还是艺术家的反叛呢？值得深思。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="Sora接口短暂泄露，艺术家们揭示Open AI的剥削内幕，是公关噱头还是真心合作？" width="900" height="506" src="https://www.youtube.com/embed/9YVENpwuJEc?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了。很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了，Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧；然后也出来做了一些解释，表示这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫。大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，就是不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的。虽然一分钟视频并没有那么大的用处，超过一分钟都属于超长镜头，电影里头用这种镜头其实也不是那么多。这一次呢，只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟。其实跟我们现在可以使用到的大量的这种视频生成模型参数是一样的，现在的视频生成模型基本上都是5到10秒钟。</p>



<span id="more-1733"></span>



<p class="wp-block-paragraph">那么，艺术家们为什么干这么个事呢？原因呢也很简单。有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了。艺术家们加入呢，是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工。你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的。视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假或者版权侵害什么这样的视频。所以呢，需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。</p>



<p class="wp-block-paragraph">第三种呢叫创意合作伙伴。Sora每过一段时间呢，会发出一些样板视频来，那意思什么？他说，你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频，它不像是我们普通人去使用图片生成模型式的，那我们只要写一个提示词，生成出来大差不差的我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。所以呢，他说，我们付出了很多，但是发表的作品呢又非常难，因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们呢，应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线。大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说，这个时间长了以后一定会造反的。</p>



<p class="wp-block-paragraph">艺术家们呢就觉得他们成为了OpenAI的公关噱头。就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些呢其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢是呼吁Open AI可以更加开放。你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢，呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错。这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢，Open AI内部动荡不断，Sora到底什么时候能发布，还遥遥无期。仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢，就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。艺术家们在一个网站上开始征集签名，说来，你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，就2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个呢，就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪。图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢，在做一些动作的时候，里边的肢体就会从衣服外边撑出来。在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误。比如说，这个脚要往前走的时候，应该膝盖往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这个两条腿迈着迈着他都变成左脚了，都变成右脚。在图像生成模型上也会出现这种问题，视频生成模型更加难以避免。这个是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性。这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说，你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。</p>



<p class="wp-block-paragraph">脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。</p>



<p class="wp-block-paragraph">再往后呢，就是算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。当然了，这个还不是困扰视频生成本身的最大难题。</p>



<p class="wp-block-paragraph">更大的难题是什么呢？就是视频要好看。最后生成完了以后，视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢，做视频生成其实是在两个层面上大家在努力。第一个层面就是模型怎么能够让模型更好；第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式对话吗，上传图片吗，然后一大堆菜单和选项吗，应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件。这个时候就发现，这个实在太难了，因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，是否有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止，没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说，我们付出的努力极其艰巨呢，也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。</p>



<p class="wp-block-paragraph">像谷歌前面就是矫枉过正了，你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以这个到底掌握到什么步骤，他们也是很头疼的。再往后什么欺诈，视频的欺诈，那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全的可以以假乱真。</p>



<p class="wp-block-paragraph">我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然，有其他的工具可以干这件事情。</p>



<p class="wp-block-paragraph">现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。除了前面我们讲的什么欺诈、血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解的很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。但是，这个但是后边才是重点，艺术表现力非常的差。</p>



<p class="wp-block-paragraph">甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。</p>



<p class="wp-block-paragraph">所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦。吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些呢已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人人吃东西了，这个已经有一定的传播力了。数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的一个视频。我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频，在抖音、快手上也开始在盈利赚钱了。所以这块呢已经走入了商业化。以假乱真也造成了很多的困扰，比如说雷军骂人，于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语吧，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个，专业应用级别呢，可能还是会有专门的人去做。就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的，但是呢，也还是有很多专业团队，会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了。这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢，肯定还有待增强。普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上，或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP也在尝试跟各自的这种视频编辑工具进行结合。这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢，我们已经讲了Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好，吉梦也好，Runway Pica，一大堆的这样的视频模型就出来了。</p>



<p class="wp-block-paragraph">他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事。感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，已经有很多用户开始使用了，而Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，参数也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的。虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。</p>



<p class="wp-block-paragraph">这一次只提供了1080P、720P、360P三种的分辨率，时长就是5到10秒钟。其实跟我们现在可以使用到的很多这种视频生成模型参数是一样的。现在的视频生成模型基本上都是5到10秒钟。那么，艺术家们为什么干这么个事呢？原因也很简单，有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。</p>



<p class="wp-block-paragraph">对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。公开信里都写了什么呢？他写了说，艺术家们年初就被邀请加入，艺术家们加入是分为三种不同的角色。第一个叫早期测试者，估计就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假，或者版权侵害什么这样的视频。</p>



<p class="wp-block-paragraph">所以呢，需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。第三种叫创意合作伙伴，Sora每过一段时间会发出一些样板视频来，那意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。</p>



<p class="wp-block-paragraph">现在，这些艺术家们感觉被骗了。为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，那我们只要写一个提示词，生成出来大差不差的，我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出了自己能够满意的产品或者叫作品吧，这个事本身是非常难的。所以呢，他说，我们付出了很多，但是发表的作品又非常难，因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们也应该没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期，这就相当于什么，就是一帮人进去打测试服的游戏去了，结果始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试。</p>



<p class="wp-block-paragraph">然后，所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。艺术家们就觉得他们成为了OpenAI的公关噱头，每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢，是呼吁Open AI可以更加开放。你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢，呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错，这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期。仅仅依靠零星露出的作品保持社交媒体关注度，Open AI是可以接受的，但是艺术家们肯定接受不了。最后，艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以，他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。这些艺术家们在一个网站上开始征集签名，说来你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候就已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说，你穿了件衣服，里边有个人，但是呢，人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这两条腿迈着迈着它都变成左脚了，或者是变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。这是第一个问题，第二个问题就是一致性可控性。这个其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。</p>



<p class="wp-block-paragraph">现在在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。再往后呢，算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，它需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这个还不是困扰视频生成本身的最大难题。更大的难题是什么呢？就是视频要好看。最后生成完了以后，视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在，做视频生成其实是在两个层面上大家在努力。第一个层面就是模型怎么能够让模型更好；第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗？上传图片吗？然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，这个实在太难了，因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，是否有人见过飞机驾驶舱，从头到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。</p>



<p class="wp-block-paragraph">这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。到目前为止，没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说我们付出的努力极其艰巨呢，也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。</p>



<p class="wp-block-paragraph">像谷歌前面就是矫枉过正了。你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以，这个到底掌握到什么步骤，他们也是很头疼的。再往后什么欺诈，视频的欺诈，那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。</p>



<p class="wp-block-paragraph">因为这个东西完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。</p>



<p class="wp-block-paragraph">你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然，有其他的工具可以干这件事情。现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。除了前面我们讲的什么欺诈、血腥暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这对于视频来说也很麻烦。</p>



<p class="wp-block-paragraph">什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。</p>



<p class="wp-block-paragraph">但是，这个但是后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的。稍微擦点边的都拒绝服务。</p>



<p class="wp-block-paragraph">你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战、什么米老鼠，马上拒绝。</p>



<p class="wp-block-paragraph">所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人人吃东西了，这个已经有一定的传播力了。数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上有很多的这种预告片开始吸引流量。什么意思呢？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的一个视频我已经被这种视频骗了好多回了。</p>



<p class="wp-block-paragraph">我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。现在很多的漫画小说详解相关的视频在抖音、快手上也开始在盈利赚钱了，所以这块已经走入了商业化。</p>



<p class="wp-block-paragraph">那么，以假乱真也造成了很多的困扰，比如说雷军骂人，于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语，这个也是很容易骗到人的。下一步的AI工具会是什么样的呢？第一个专业应用级别，可能还是会有专门的人去做。</p>



<p class="wp-block-paragraph">就像现在我们，比如说在视频领域里头，我的视频处理都是用剪映的，但是呢也还是有很多专业团队会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强。普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的，他们可能还需要在用户交互上或者是工具上还要有待增强。这个大模型本身，他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但是呢，这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP也在尝试跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好、吉梦也好、Runway Pica，一大堆的这样的视频模型就出来了。</p>



<p class="wp-block-paragraph">他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索寻找新方向，但是呢，都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事。感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了，Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，称这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型吧，可以仿真出世界来的，当时是可以出一分钟的视频的。虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟。其实跟我们现在可以使用到的很多视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5到10秒钟。那么，艺术家们为什么干这么个事呢？原因呢也很简单。有一句话叫“富贵不归乡，如锦衣夜行”，什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了，艺术家们加入呢是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害什么这样的视频，所以呢需要一些成员说你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。</p>



<p class="wp-block-paragraph">第三种呢叫创意合作伙伴，Sora每过一段时间呢会发出一些样板视频来，那意思什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，我们只要写一个提示词，生成出来大差不差的，我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以，对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。所以呢，他们说：“我们付出了很多，但是发表的作品呢又非常难。”因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们呢应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试。</p>



<p class="wp-block-paragraph">然后，所有的测试还需要签保密协议，你还不能出来说，这个时间长了以后一定会造反的。艺术家们呢就觉得他们成为了OpenAI的公关噱头，就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。其实，这些呢是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢，是呼吁Open AI可以更加开放，你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢，呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错，这就是他们的一个公开信。现在呢，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。</p>



<p class="wp-block-paragraph">最后呢，就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。所以，他们就整了这么一个幺蛾子出来，你虽然跟我签了保密协议，但是我们就啪，把这个东西扔到世界上最大的开元大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。</p>



<p class="wp-block-paragraph">当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢？现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。也许过一段时间，人家就突然就发布了，发现哎，这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。</p>



<p class="wp-block-paragraph">这些艺术家们在一个网站上开始征集签名，说来你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。那么，视频生成为什么这么费劲呢？Open AI在年初的时候，就在2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。</p>



<p class="wp-block-paragraph">但是呢，视频生成本身的难度是很大的。第一个呢，就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯？这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的内容，两条腿突然走着走着就变三条了，或者是这两条腿迈着迈着就都变成左脚了，变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。</p>



<p class="wp-block-paragraph">脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。</p>



<p class="wp-block-paragraph">再往后呢，就是算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。当然了，这个还不是困扰视频生成本身的最大难题。</p>



<p class="wp-block-paragraph">更大的难题是什么呢？就是视频要好看。最后生成完了以后，视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢，做视频生成其实是在两个层面上大家在努力，第一个层面就是模型，怎么能够让模型更好；第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗，上传图片吗，然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，就是有没有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。</p>



<p class="wp-block-paragraph">这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。到目前为止没有特别好使的，在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说我们付出的努力极其艰巨呢，也是如此。</p>



<p class="wp-block-paragraph">他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。</p>



<p class="wp-block-paragraph">咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，还不能矫枉过正。像谷歌前面就是矫枉过正了，你跟他说任何的提示词里边一定是有黄种人、有黑人、有白人、有男的、有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。</p>



<p class="wp-block-paragraph">所以这个到底掌握到什么步骤，他们也是很头疼的。再往后，什么欺诈？视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢，你可以自己上传一张照片，说我现在让这个人去讲话。</p>



<p class="wp-block-paragraph">你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然，有其他的工具可以干这件事情。现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。</p>



<p class="wp-block-paragraph">除了前面我们讲的什么欺诈呀、血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。</p>



<p class="wp-block-paragraph">但是，这个但是后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjourney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。</p>



<p class="wp-block-paragraph">你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战，什么米老鼠，马上拒绝。所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。</p>



<p class="wp-block-paragraph">现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能。这些呢已经可以达到一部分商业使用的能力了。现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。</p>



<p class="wp-block-paragraph">很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个说话了，这个吃东西了，这个已经有一定的传播力了。数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。YouTube上呢，有很多的这种预告片开始吸引流量。什么意思呢？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。</p>



<p class="wp-block-paragraph">当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的视频我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画、小说详解相关的视频，在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。那么，以假乱真也造成了很多的困扰，比如说雷军骂人，于东来骂人，甚至还有人把德国选择党的那个女党首的这个视频配上中文上来，讲一些比较激烈的这种话语吧，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的视频处理都是用剪映的。但是呢，也还是有很多专业团队会使用一些更复杂的这种视频工具，Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用，用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强，普通人使用Sora这样的模型，或者使用其他的，刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP，也在尝试跟各自的这种视频编辑工具进行结合。这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好，吉梦也好，Runway Pica，一大堆的这样的视频模型就出来了。</p>



<p class="wp-block-paragraph">他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事。感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了。Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说这些艺术家们呢，都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，就是不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的。当时是可以出一分钟的视频的，虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟，实际上跟我们现在可以使用到的大量的这种视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5到10秒钟。那么，艺术家们为什么干这么个事呢？原因呢也很简单，有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了，艺术家们加入呢是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害什么这样的视频，所以呢需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。</p>



<p class="wp-block-paragraph">第三种呢叫创意合作伙伴。Sora每过一段时间呢会发出一些样板视频来，那意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。</p>



<p class="wp-block-paragraph">它不像是我们普通人去使用图片生成模型，式的那我们只要写一个提示词，生成出来大差不差的，我就能用。那些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。</p>



<p class="wp-block-paragraph">所以呢，他说哎，我们付出了很多，但是发表的作品呢又非常难，因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。即使是有作品被发表展示了，这些艺术家们呢应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。</p>



<p class="wp-block-paragraph">这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。艺术家们呢就觉得他们成为了OpenAI的公关噱头，就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些呢其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢是呼吁Open AI可以更加开放，你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错。这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢，就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以他们就整了这么一个幺蛾子出来，你虽然跟我签了保密协议，但是我们就啪，把这个东西扔到世界上最大的开元大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现哎，这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。艺术家们在一个网站上开始征集签名，说来你们谁支持我，这里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个呢，就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题，咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候呢，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯，这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这个两条腿迈着迈着他都变成左脚了，都变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说，非常非常难以控制和把握。再往后呢，就是算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这个还不是困扰视频生成本身的最大难题。更大的难题是什么呢？就是视频要好看，最后生成完了以后视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢，做视频生成其实是在两个层面上大家在努力，第一个层面就是模型，怎么能够让模型更好。第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗？上传图片吗？然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，就是有没有人见过飞机驾驶舱，从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置，才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说我们付出的努力极其艰巨呢，也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。像谷歌前面就是矫枉过正了，你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。</p>



<p class="wp-block-paragraph">所以这个到底掌握到什么步骤，他们也是很头疼的。再往后什么欺诈？视频的欺诈，那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全的可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。</p>



<p class="wp-block-paragraph">你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然有其他的工具可以干这件事情，现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。除了前面我们讲的什么欺诈呀、血腥暴力歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解的很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。但是，这个但是后边才是重点，艺术表现力非常的差。</p>



<p class="wp-block-paragraph">甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来。说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。</p>



<p class="wp-block-paragraph">所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部，也集成了视频直接生成的这种功能，这些呢已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人人吃东西了，这个已经有一定的传播力了。数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以。这样的一个视频，我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频在抖音在快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。那么，以假乱真也造成了很多的困扰，比如说雷军骂人、于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语吧，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的。但是呢，也还是有很多专业团队会使用一些更复杂的这种视频工具，Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用，用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强。普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好、可灵也好，还是挺难使的。他们可能还需要在用户交互上或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上，在吉梦也好、可灵也好，都在做手机APP，网站的这种Web APP也在尝试，跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆，可灵也好、吉梦也好、Runway Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事。感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了，Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说明这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的，虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟，实际上跟我们现在可以使用到的很多视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5-10秒钟。那么，艺术家们为什么干这么个事呢？原因呢也很简单，有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了。艺术家们加入呢，是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害什么这样的视频，所以呢需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过。</p>



<p class="wp-block-paragraph">这个叫红队成员。第三种呢叫创意合作伙伴，Sora每过一段时间呢会发出一些样板视频来，那意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。</p>



<p class="wp-block-paragraph">它不像是我们普通人去使用图片生成模型那样。我们只要写一个提示词，生成出来大差不差的，我就能用。这些人是艺术家，之所以能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以，对于他们来说，想要让这种视频模型输出自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。</p>



<p class="wp-block-paragraph">所以呢，他们说：“我们付出了很多，但是发表的作品呢又非常难。”因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。即使是有作品被发表展示了，这些艺术家们呢，应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。</p>



<p class="wp-block-paragraph">这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。</p>



<p class="wp-block-paragraph">艺术家们呢，就觉得他们成为了OpenAI的公关噱头。就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些呢，其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。再往后呢，是呼吁Open AI可以更加开放。</p>



<p class="wp-block-paragraph">你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢，呼吁艺术家们开始使用开源的视频模型，表示现在有很多开源模型已经可以用了，效果还不错。这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢，就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以，他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就啪，把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现哎，这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。这些艺术家们在一个网站上开始征集签名，说来，你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢，并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个呢，就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯？这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这两条腿迈着迈着都变成左脚了，都变成右脚。在图像生成模型上也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这种方式是可以让这个脸稍微的稳定一点的。</p>



<p class="wp-block-paragraph">脸是一方面，然后这个身材、身上的衣服、各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。</p>



<p class="wp-block-paragraph">再往后呢，就是算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高的。当然了，这个还不是困扰视频生成本身的最大的难题，更大的难题是什么呢？就是视频要好看。</p>



<p class="wp-block-paragraph">最后生成完了以后视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢，做视频生成其实是在两个层面上大家在努力。第一个层面就是模型，怎么能够让模型更好。第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗，上传图片吗，然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，有没有人见过飞机驾驶舱，从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。</p>



<p class="wp-block-paragraph">这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说都是极大的挑战。到目前为止没有特别好使的，在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说，我们付出的努力极其艰巨呢？也是如此，他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。</p>



<p class="wp-block-paragraph">像谷歌前面就是矫枉过正了。你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人，有男的、有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以这个到底掌握到什么步骤，他们也是很头疼的。</p>



<p class="wp-block-paragraph">再往后什么欺诈，视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢，完全的可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。</p>



<p class="wp-block-paragraph">你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然有其他的工具可以干这件事情，现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。</p>



<p class="wp-block-paragraph">除了前面我们讲的什么欺诈、血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。</p>



<p class="wp-block-paragraph">但是，这个但是后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。</p>



<p class="wp-block-paragraph">所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些呢已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人吃东西了，这个已经有一定的传播力了。数字人呢，也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的一个视频。我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。以假乱真也造成了很多的困扰，比如说雷军骂人，于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的。但是呢，也还是有很多专业团队会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强，普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上，或者是工具上还要有待增强，这个大模型本身，他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP，也在尝试跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好，吉梦也好，Runway Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么，虽然很多的厂商也在尝试去摸索寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事，感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了。Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说这些艺术家们呢，都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，就是不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的。当时是可以出一分钟的视频的，虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟，其实跟我们现在可以使用到的大量的这种视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5到10秒钟。那么艺术家们为什么干这么个事呢？原因呢也很简单，有一句话叫“富贵不归乡，如锦衣夜行。”什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了，艺术家们加入呢是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害这样的视频，所以呢需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务或者怎么能够规避，怎么能绕过，这个叫红队成员。</p>



<p class="wp-block-paragraph">第三种呢叫创意合作伙伴。Sora每过一段时间呢会发出一些样板视频来，那意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，那我们只要写一个提示词，生成出来大差不差的，我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。于是他们说：“我们付出了很多，但是发表的作品呢又非常难。”因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们呢应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说，这个时间长了以后一定会造反的。</p>



<p class="wp-block-paragraph">艺术家们呢就觉得他们成为了OpenAI的公关噱头，就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些呢其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。再往后呢是呼吁Open AI可以更加开放，你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错，这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。所以他们就整了这么一个幺蛾子出来，你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。</p>



<p class="wp-block-paragraph">当然现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。</p>



<p class="wp-block-paragraph">这些艺术家们在一个网站上开始征集签名，谁支持我，这里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。那么视频生成为什么这么费劲呢？Open AI在年初的时候，2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。</p>



<p class="wp-block-paragraph">第一个呢就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪。图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候呢，里边的肢体就会从衣服外边撑出来。</p>



<p class="wp-block-paragraph">你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误。比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这个两条腿迈着迈着他都变成左脚了，都变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。</p>



<p class="wp-block-paragraph">这是第一个问题。第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上。现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。再往后呢就是算力成本实在太高了。图片生成现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这个还不是困扰视频生成本身的最大的难题。更大的难题是什么呢？就是视频要好看。最后生成完了以后视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢做视频生成，其实是在两个层面上大家在努力。第一个层面就是模型，怎么能够让模型更好；第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式对话吗，上传图片吗，然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件。这个时候就发现，哎呀，这个实在太难了，因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。这大家想象一下，就是有没有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。</p>



<p class="wp-block-paragraph">视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说：“我们付出的努力极其艰巨呢？”也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大得多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。像谷歌前面就是矫枉过正了，你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人、有男的、有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。 所以这个到底掌握到什么步骤，他们也是很头疼的。</p>



<p class="wp-block-paragraph">再往后什么欺诈，视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。 当然有其他的工具可以干这件事情，现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。</p>



<p class="wp-block-paragraph">除了前面我们讲的什么欺诈呀、血腥暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。那么我们到底还需不需要等Sora呢？</p>



<p class="wp-block-paragraph">其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去。这个Dalle3算是最强的。但是，这个但是后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。</p>



<p class="wp-block-paragraph">你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战、什么米老鼠，马上拒绝。所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。</p>



<p class="wp-block-paragraph">现在可以用的视频大模型其实已经不少了，甭管是runway还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些呢已经可以达到一部分商业使用的能力了。现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人吃东西了，这个已经有一定的传播力了。</p>



<p class="wp-block-paragraph">数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。YouTube上呢有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的视频我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。以假乱真也造成了很多的困扰，比如说雷军骂人、于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语吧，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的，但是呢也还是有很多专业团队会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强，普通人使用Sora这样的模型或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用。但是呢，这个可能距离我们还稍微远一些。这种半专业应用的话，应该正在路上，在吉梦也好可灵也好呢，都在做手机APP，网站的这种Web APP也在尝试跟各自的这种视频编辑工具进行结合，这一块的话有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好、吉梦也好、Runway Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ，通义千问做的推理模型。在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索，寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。</p>



<p class="wp-block-paragraph">所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。好，这是今天讲的故事，感谢大家收听，请帮忙点赞点小铃铛，参加discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">其实，从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去。这个Dalle3算是最强的。但是，这个“但是”后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是画的过程还是比较粗糙的。稍微擦点边的都拒绝服务。</p>



<p class="wp-block-paragraph">你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来。说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战，什么米老鼠，马上拒绝。所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。</p>



<p class="wp-block-paragraph">现在可以用的视频大模型其实已经不少了，甭管是runway还是国内能够使用的吉梦。吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能。这些呢，已经可以达到一部分商业使用的能力了。现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人说话了，这个人吃东西了，这个已经有一定的传播力了。</p>



<p class="wp-block-paragraph">数字人呢，也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个你也不能说他粗制滥造，有的做的还可以。这样的一个视频，我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频，在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。至于Open AI下边该干嘛去呢，我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这个方向以后，大家就赶快都去出了一堆可灵也好，吉梦也好，Runway Pica，一大堆的这样的视频模型就出来了。</p>



<p class="wp-block-paragraph">所以，我们期待Open AI可以给大家指明下一个方向。等指明了以后，全球的厂商再顺着这个方向往前跑。好，这是今天讲的故事，感谢大家收听，请帮忙点赞、点小铃铛，参加discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂地泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，已经有很多用户开始使用了。Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂地开放了一段时间。这些艺术家还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，称这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫。大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，不是一个全尺寸的模型，参数也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的。虽然一分钟视频并没有那么大的用处，超过一分钟都属于超长镜头了，电影里头用这种镜头其实也不是那么多。这一次只提供了1080P、720P、360P三种的分辨率，时长就是5到10秒钟。其实跟我们现在可以使用到的大量这种视频生成模型参数是一样的，现在的视频生成模型基本上都是5到10秒钟。</p>



<p class="wp-block-paragraph">那么，艺术家们为什么干这么个事呢？原因很简单。有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初就被邀请加入了。艺术家们加入是分为三种不同的角色。第一个叫早期测试者，估计就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假，或者版权侵害什么这样的视频。所以需要一些成员不断地向他提这样的要求，看看能不能都识别出来，拒绝服务或者怎么能够规避，怎么能绕过，这个叫红队成员。第三种叫创意合作伙伴，Sora每过一段时间会发出一些样板视频来，意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。</p>



<p class="wp-block-paragraph">现在，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，我们只要写一个提示词，生成出来大差不差的我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出自己能够满意的产品，或者叫作品，这个事本身是非常难的。他们说，我们付出了很多，但是发表的作品又非常难，因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们应该也没有得到什么回报。对应一个1500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。这就相当于什么？就是一帮人进去打测试服的游戏去了，结果始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。</p>



<p class="wp-block-paragraph">艺术家们就觉得他们成为了OpenAI的公关噱头。就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后是呼吁Open AI可以更加开放。你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错，这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI是可以接受的，但艺术家们肯定接受不了。最后，艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以，他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上，让大家都瞅了这么一眼。当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停地玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。这些艺术家们在一个网站上开始征集签名，说来，你们谁支持我，这里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是，视频生成本身的难度是很大的。第一个，内容合理性其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边有个人，但是人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，膝盖应该往后弯的。但是，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的内容，两条腿突然走着走着就变三条了，或者是两条腿迈着迈着都变成左脚了，变成右脚。图像生成模型上也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。第二个问题就是一致性可控性，这个其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。</p>



<p class="wp-block-paragraph">现在在图片生成模型的一致性上，已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材、身上的衣服、各种配饰，你要让所有的这些图片都很稳定地保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。再往后，算力成本实在太高了。图片生成，现在我们画一幅1080P的图像，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这还不是困扰视频生成本身的最大难题。更大的难题是什么呢？就是视频要好看。最后生成完了以后，视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。</p>



<p class="wp-block-paragraph">现在做视频生成，其实是在两个层面上大家在努力。第一个层面就是模型，怎么能够让模型更好。第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗？上传图片吗？然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。</p>



<p class="wp-block-paragraph">当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。大家想象一下，有没有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。</p>



<p class="wp-block-paragraph">现在我们要做视频生成的这种工具了，在有大模型的基础上，你也需要大量的开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的做视频生成工具的人来说，都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止，没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以，为什么这帮艺术家也说我们付出的努力极其艰巨呢，也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大得多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时，你还不能矫枉过正。</p>



<p class="wp-block-paragraph">像谷歌前面就是矫枉过正了。你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人、有男的、有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以，这个到底掌握到什么步骤，他们也是很头疼的。</p>



<p class="wp-block-paragraph">再往后，什么欺诈，视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是你可以自己上传一张照片，说我现在让这个人去讲话。</p>



<p class="wp-block-paragraph">你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话它就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然，有其他的工具可以干这件事情。现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。</p>



<p class="wp-block-paragraph">除了前面我们讲的什么欺诈、血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。</p>



<p class="wp-block-paragraph">但是，这个“但是”后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝；你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝；你只要提到任何人的名字，直接拒绝；说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝；请给我画个什么星球大战、米老鼠，马上拒绝。</p>



<p class="wp-block-paragraph">所以，他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人吃东西了，这个已经有一定的传播力了。数字人也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以。这样的一个视频，我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频，在抖音、快手上也开始在盈利赚钱了，所以这块已经走入了商业化。那么，以假乱真也造成了很多的困扰，比如说雷军骂人、于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别，可能还是会有专门的人去做。就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的。但是，也还是有很多专业团队会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用肯定还有待增强，普通人使用Sora这样的模型，或者使用其他的，刚才我们说的吉梦也好、可灵也好，还是挺难使的。他们可能还需要在用户交互上，或者是工具上还要有待增强。这个大模型本身，他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用。但是，这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好、可灵也好，都是在做手机APP，网站的这种Web APP也在尝试，跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢，我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这个方向以后，大家就赶快都去出了一堆可灵也好、吉梦也好、Runway、Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索，寻找新方向，但是都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以，我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事，感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，已经有很多用户开始使用了。Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说明这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫。大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，就是不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的，虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟，实际上跟我们现在可以使用到的大量的这种视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5-10秒钟。那么，艺术家们为什么干这么个事呢？原因呢也很简单。有一句话叫“富贵不归乡，如锦衣夜行。”什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了，艺术家们加入呢是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害什么这样的视频，所以呢需要一些成员说你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。第三种呢叫创意合作伙伴，Sora每过一段时间呢会发出一些样板视频来，意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。</p>



<p class="wp-block-paragraph">现在呢，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，那我们只要写一个提示词，生成出来大差不差的，我就能用。这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。</p>



<p class="wp-block-paragraph">所以，对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。所以呢，他说：“我们付出了很多，但是发表的作品呢又非常难。”因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。即使是有作品被发表展示了，这些艺术家们呢应该也没有得到什么回报。对应一个1500亿美金的Open AI来说，大家觉得这个事有点太不公平了。</p>



<p class="wp-block-paragraph">而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期，这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。艺术家们呢就觉得他们成为了OpenAI的公关噱头，就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说：“你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。”这些呢其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢是呼吁Open AI可以更加开放。你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错。这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以，他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢？现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。</p>



<p class="wp-block-paragraph">这些艺术家们在一个网站上开始征集签名，说来你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个呢就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯？这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这个两条腿迈着迈着他都变成左脚了，都变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。再往后呢就是算力成本实在太高了。图片生成现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这个还不是困扰视频生成本身的最大的难题。更大的难题是什么呢？就是视频要好看。最后生成完了以后视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。</p>



<p class="wp-block-paragraph">现在呢，做视频生成其实是在两个层面上大家在努力。第一个层面就是模型怎么能够让模型更好。第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗？上传图片吗？然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件。这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情，都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，就是有没有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止没有特别好使的，在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说：“我们付出的努力极其艰巨呢？”也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。像谷歌前面就是矫枉过正了。你跟他说，任何的提示词里边一定是有黄种人，有黑人，有白人，有男的，有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以这个到底掌握到什么步骤，他们也是很头疼的。</p>



<p class="wp-block-paragraph">再往后什么欺诈，视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。</p>



<p class="wp-block-paragraph">当然有其他的工具可以干这件事情。现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。除了前面我们讲的什么欺诈呀，血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西。这呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看DALL·E 3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个DALL·E 3算是最强的。但是，这个“但是”后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjourney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。</p>



<p class="wp-block-paragraph">你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战、什么米老鼠，马上拒绝。所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。</p>



<p class="wp-block-paragraph">现在可以用的视频大模型其实已经不少了，甭管是Runway还是国内能够使用的吉梦。吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能。这些呢已经可以达到一部分商业使用的能力了。现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人吃东西了，这个已经有一定的传播力了。</p>



<p class="wp-block-paragraph">数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以。</p>



<p class="wp-block-paragraph">这样的一个视频，我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。现在很多的漫画小说详解相关的视频在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。</p>



<p class="wp-block-paragraph">那么，以假乱真也造成了很多的困扰，比如说雷军骂人、于东来骂人，甚至还有人把那个德国选择党的女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语，这个也是很容易骗到人的。下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的，但是呢也还是有很多专业团队会使用一些更复杂的这种视频工具。</p>



<p class="wp-block-paragraph">Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用，用完了以后出了所有东西，你们自己负责任，跟我就没有关系了。这是一种方式。半专业的应用呢肯定还有待增强，普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上，或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。</p>



<p class="wp-block-paragraph">至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用。但是呢，这个可能距离我们还稍微远一些。这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP也在尝试，跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢，我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好、吉梦也好、Runway、Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索，寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。</p>



<p class="wp-block-paragraph">所以，我们期待Open AI可以给大家指明下一个方向。等指明了以后，全世界的厂商再顺着这个方向往前跑。好，这是今天讲的故事。感谢大家收听，请帮忙点赞、点小铃铛，参加Discord讨论群。也欢迎有兴趣、有能力的朋友加入我们的付费频道，再见。</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
