<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>企业创新 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<atom:link href="https://lukefan.com/tag/%E4%BC%81%E4%B8%9A%E5%88%9B%E6%96%B0/feed/" rel="self" type="application/rss+xml" />
	<link>https://lukefan.com</link>
	<description>这里是老范讲故事的主站，持续更新 AIGC、大模型、互联网平台、商业冲突与资本市场观察，帮你看清热点背后的底层逻辑。</description>
	<lastBuildDate>Fri, 29 Nov 2024 00:42:09 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1</generator>

<image>
	<url>https://lukefan.com/wp-content/uploads/2026/03/cropped-jimeng-2026-02-28-5245-用图一的人物形象，替换图二中的人物，使用图二的风格。文字替换：老范讲故事，Yo-32x32.jpeg</url>
	<title>企业创新 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<link>https://lukefan.com</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>Sora接口短暂泄露，艺术家们揭示Open AI的剥削内幕，是公关噱头还是真心合作？</title>
		<link>https://lukefan.com/2024/11/29/sora%e6%8e%a5%e5%8f%a3%e7%9f%ad%e6%9a%82%e6%b3%84%e9%9c%b2%ef%bc%8c%e8%89%ba%e6%9c%af%e5%ae%b6%e4%bb%ac%e6%8f%ad%e7%a4%baopen-ai%e7%9a%84%e5%89%a5%e5%89%8a%e5%86%85%e5%b9%95%ef%bc%8c%e6%98%af%e5%85%ac/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Fri, 29 Nov 2024 00:42:07 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AI工具]]></category>
		<category><![CDATA[AI应用]]></category>
		<category><![CDATA[DALL-E 3]]></category>
		<category><![CDATA[Hugging Face]]></category>
		<category><![CDATA[Open AI]]></category>
		<category><![CDATA[SEO优化]]></category>
		<category><![CDATA[Sora大模型]]></category>
		<category><![CDATA[Turbo版本]]></category>
		<category><![CDATA[业内动态]]></category>
		<category><![CDATA[互动媒体]]></category>
		<category><![CDATA[产品发布]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[企业创新]]></category>
		<category><![CDATA[企业合作]]></category>
		<category><![CDATA[保密协议]]></category>
		<category><![CDATA[公关策略]]></category>
		<category><![CDATA[内容优化]]></category>
		<category><![CDATA[内容匹配]]></category>
		<category><![CDATA[内容变现]]></category>
		<category><![CDATA[内容审核]]></category>
		<category><![CDATA[内容生成]]></category>
		<category><![CDATA[内容策略]]></category>
		<category><![CDATA[内容质量]]></category>
		<category><![CDATA[创意合作伙伴]]></category>
		<category><![CDATA[创意平台]]></category>
		<category><![CDATA[动态内容]]></category>
		<category><![CDATA[可控性]]></category>
		<category><![CDATA[品牌保护]]></category>
		<category><![CDATA[图像生成]]></category>
		<category><![CDATA[在线工具]]></category>
		<category><![CDATA[在线编辑工具]]></category>
		<category><![CDATA[媒体传播]]></category>
		<category><![CDATA[媒体内容]]></category>
		<category><![CDATA[媒体整合]]></category>
		<category><![CDATA[媒体营销]]></category>
		<category><![CDATA[实时生成]]></category>
		<category><![CDATA[宣传策略]]></category>
		<category><![CDATA[市场趋势]]></category>
		<category><![CDATA[平台发展]]></category>
		<category><![CDATA[平台生态]]></category>
		<category><![CDATA[开发者社区]]></category>
		<category><![CDATA[开源合作]]></category>
		<category><![CDATA[影视行业]]></category>
		<category><![CDATA[技术产业]]></category>
		<category><![CDATA[技术创新]]></category>
		<category><![CDATA[技术对比]]></category>
		<category><![CDATA[技术开发]]></category>
		<category><![CDATA[技术挑战]]></category>
		<category><![CDATA[技术突破]]></category>
		<category><![CDATA[挑战与机遇]]></category>
		<category><![CDATA[效果展示]]></category>
		<category><![CDATA[数字人]]></category>
		<category><![CDATA[数字媒体]]></category>
		<category><![CDATA[数据处理]]></category>
		<category><![CDATA[数据安全]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[模型参数]]></category>
		<category><![CDATA[模型训练]]></category>
		<category><![CDATA[法律风险]]></category>
		<category><![CDATA[深度学习]]></category>
		<category><![CDATA[版权纠纷]]></category>
		<category><![CDATA[生成模型]]></category>
		<category><![CDATA[用户交互]]></category>
		<category><![CDATA[用户体验]]></category>
		<category><![CDATA[知识产权]]></category>
		<category><![CDATA[社交媒体策略]]></category>
		<category><![CDATA[社交影响]]></category>
		<category><![CDATA[算力成本]]></category>
		<category><![CDATA[线上互动]]></category>
		<category><![CDATA[自动化处理]]></category>
		<category><![CDATA[艺术家]]></category>
		<category><![CDATA[艺术表现力]]></category>
		<category><![CDATA[行业先锋]]></category>
		<category><![CDATA[覆盖范围]]></category>
		<category><![CDATA[视觉创意]]></category>
		<category><![CDATA[视觉效果]]></category>
		<category><![CDATA[视频内容]]></category>
		<category><![CDATA[视频安全性]]></category>
		<category><![CDATA[视频模型]]></category>
		<category><![CDATA[视频流]]></category>
		<category><![CDATA[视频特效]]></category>
		<category><![CDATA[视频生成]]></category>
		<category><![CDATA[视频生成技术]]></category>
		<category><![CDATA[视频生成潜力]]></category>
		<category><![CDATA[视频编辑]]></category>
		<category><![CDATA[视频风格]]></category>
		<category><![CDATA[计算机视觉]]></category>
		<category><![CDATA[语音合成]]></category>
		<category><![CDATA[跨平台使用]]></category>
		<category><![CDATA[跨文化传播]]></category>
		<category><![CDATA[身份验证]]></category>
		<category><![CDATA[高成本]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1733</guid>

					<description><![CDATA[大家好！🎉今天我们聊聊Sora的短暂泄露事件！！！

也许你已经听说过，Open AI的Sora大模型从今年年初就引起了大家的关注！可是啊……等到现在，时间慢慢来到了年底，发布却依旧遥遥无期！这可真是让人感觉到无奈啊！！！

就在这样的时刻，一群充满激情的艺术家们决定将Sora的接口丢到Hugging Face上，进行短暂的开放！😱他们还很大胆地发表了一封公开信，表达了自己对Open AI剥削的不满！这可不是小事哦！等Open AI察觉到后，立刻就封闭了接口，真的是快！只用了一小时！⌛️

可是，等了这么久，大家更想知道的还是Sora到底什么时候启动！而这次泄露的信息出来的其实是名为“Turbo”的版本，不过这只是一个轻量级、快速的模型，并不能够展现出Sora真正的全部实力！我真的忍不住想说，艺术家们靠谱吗？为什么会有这么多的挑战在等着他们？🤔

《Sora泄露》背后的故事真的引人入胜！艺术家们表达的不仅仅是对技术的渴望，更多的是对创作自由的追求！🎨“富贵不归乡，如锦衣夜行”，这句话深刻地反映了他们渴望分享的心情！不让他们显摆的模样，简直就是把他们绑住了手脚啊！😩

那些加入Sora的艺术家们经历了什么？他们被分为三种角色，还有人被称为“红队成员”，这听起来就充满了挑战与戏剧性！想知道更多按住这个“电源”你可得耐心等一下，这可不是简单的公开信能解答的问题！🔍

所以，未来的Sora究竟何去何从？是否意味着艺术家们的呼声会得到更好的回应呢？✨各位小伙伴们，快来一起讨论吧！让我们一起关注这个备受争议的模型！🗣️

别忘了点赞、分享我的频道，我们下次见！😘

Sora接口短暂泄露，艺术家们揭示Open AI的剥削内幕，是公关噱头还是真心合作？

在今年2月，Open AI推出了备受期待的Sora大模型，它曾被视作视频生成领域的前景。然而，至今尚无正式发布。近期，一群艺术家在Hugging Face短暂开放了Sora的Turbo版本，并发表公开信指责Open AI对艺术家们的剥削，使得Sora再次成为公众焦点。尽管其生成的视频质量和表现力不如预期，艺术家们在其开发过程中的辛苦和对创意的高标准受到阻碍。当前已经有Runway、吉梦等多款视频生成工具可供使用，市场上充满了潜力。此次泄露事件到底是公关策略还是艺术家的反叛呢？值得深思。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="Sora接口短暂泄露，艺术家们揭示Open AI的剥削内幕，是公关噱头还是真心合作？" width="900" height="506" src="https://www.youtube.com/embed/9YVENpwuJEc?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了。很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了，Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧；然后也出来做了一些解释，表示这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫。大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，就是不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的。虽然一分钟视频并没有那么大的用处，超过一分钟都属于超长镜头，电影里头用这种镜头其实也不是那么多。这一次呢，只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟。其实跟我们现在可以使用到的大量的这种视频生成模型参数是一样的，现在的视频生成模型基本上都是5到10秒钟。</p>



<span id="more-1733"></span>



<p class="wp-block-paragraph">那么，艺术家们为什么干这么个事呢？原因呢也很简单。有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了。艺术家们加入呢，是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工。你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的。视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假或者版权侵害什么这样的视频。所以呢，需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。</p>



<p class="wp-block-paragraph">第三种呢叫创意合作伙伴。Sora每过一段时间呢，会发出一些样板视频来，那意思什么？他说，你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频，它不像是我们普通人去使用图片生成模型式的，那我们只要写一个提示词，生成出来大差不差的我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。所以呢，他说，我们付出了很多，但是发表的作品呢又非常难，因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们呢，应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线。大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说，这个时间长了以后一定会造反的。</p>



<p class="wp-block-paragraph">艺术家们呢就觉得他们成为了OpenAI的公关噱头。就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些呢其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢是呼吁Open AI可以更加开放。你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢，呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错。这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢，Open AI内部动荡不断，Sora到底什么时候能发布，还遥遥无期。仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢，就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。艺术家们在一个网站上开始征集签名，说来，你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，就2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个呢，就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪。图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢，在做一些动作的时候，里边的肢体就会从衣服外边撑出来。在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误。比如说，这个脚要往前走的时候，应该膝盖往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这个两条腿迈着迈着他都变成左脚了，都变成右脚。在图像生成模型上也会出现这种问题，视频生成模型更加难以避免。这个是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性。这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说，你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。</p>



<p class="wp-block-paragraph">脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。</p>



<p class="wp-block-paragraph">再往后呢，就是算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。当然了，这个还不是困扰视频生成本身的最大难题。</p>



<p class="wp-block-paragraph">更大的难题是什么呢？就是视频要好看。最后生成完了以后，视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢，做视频生成其实是在两个层面上大家在努力。第一个层面就是模型怎么能够让模型更好；第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式对话吗，上传图片吗，然后一大堆菜单和选项吗，应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件。这个时候就发现，这个实在太难了，因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，是否有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止，没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说，我们付出的努力极其艰巨呢，也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。</p>



<p class="wp-block-paragraph">像谷歌前面就是矫枉过正了，你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以这个到底掌握到什么步骤，他们也是很头疼的。再往后什么欺诈，视频的欺诈，那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全的可以以假乱真。</p>



<p class="wp-block-paragraph">我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然，有其他的工具可以干这件事情。</p>



<p class="wp-block-paragraph">现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。除了前面我们讲的什么欺诈、血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解的很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。但是，这个但是后边才是重点，艺术表现力非常的差。</p>



<p class="wp-block-paragraph">甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。</p>



<p class="wp-block-paragraph">所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦。吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些呢已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人人吃东西了，这个已经有一定的传播力了。数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的一个视频。我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频，在抖音、快手上也开始在盈利赚钱了。所以这块呢已经走入了商业化。以假乱真也造成了很多的困扰，比如说雷军骂人，于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语吧，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个，专业应用级别呢，可能还是会有专门的人去做。就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的，但是呢，也还是有很多专业团队，会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了。这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢，肯定还有待增强。普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上，或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP也在尝试跟各自的这种视频编辑工具进行结合。这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢，我们已经讲了Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好，吉梦也好，Runway Pica，一大堆的这样的视频模型就出来了。</p>



<p class="wp-block-paragraph">他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事。感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，已经有很多用户开始使用了，而Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，参数也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的。虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。</p>



<p class="wp-block-paragraph">这一次只提供了1080P、720P、360P三种的分辨率，时长就是5到10秒钟。其实跟我们现在可以使用到的很多这种视频生成模型参数是一样的。现在的视频生成模型基本上都是5到10秒钟。那么，艺术家们为什么干这么个事呢？原因也很简单，有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。</p>



<p class="wp-block-paragraph">对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。公开信里都写了什么呢？他写了说，艺术家们年初就被邀请加入，艺术家们加入是分为三种不同的角色。第一个叫早期测试者，估计就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假，或者版权侵害什么这样的视频。</p>



<p class="wp-block-paragraph">所以呢，需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。第三种叫创意合作伙伴，Sora每过一段时间会发出一些样板视频来，那意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。</p>



<p class="wp-block-paragraph">现在，这些艺术家们感觉被骗了。为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，那我们只要写一个提示词，生成出来大差不差的，我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出了自己能够满意的产品或者叫作品吧，这个事本身是非常难的。所以呢，他说，我们付出了很多，但是发表的作品又非常难，因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们也应该没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期，这就相当于什么，就是一帮人进去打测试服的游戏去了，结果始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试。</p>



<p class="wp-block-paragraph">然后，所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。艺术家们就觉得他们成为了OpenAI的公关噱头，每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢，是呼吁Open AI可以更加开放。你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢，呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错，这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期。仅仅依靠零星露出的作品保持社交媒体关注度，Open AI是可以接受的，但是艺术家们肯定接受不了。最后，艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以，他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。这些艺术家们在一个网站上开始征集签名，说来你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候就已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说，你穿了件衣服，里边有个人，但是呢，人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这两条腿迈着迈着它都变成左脚了，或者是变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。这是第一个问题，第二个问题就是一致性可控性。这个其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。</p>



<p class="wp-block-paragraph">现在在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。再往后呢，算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，它需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这个还不是困扰视频生成本身的最大难题。更大的难题是什么呢？就是视频要好看。最后生成完了以后，视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在，做视频生成其实是在两个层面上大家在努力。第一个层面就是模型怎么能够让模型更好；第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗？上传图片吗？然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，这个实在太难了，因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，是否有人见过飞机驾驶舱，从头到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。</p>



<p class="wp-block-paragraph">这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。到目前为止，没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说我们付出的努力极其艰巨呢，也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。</p>



<p class="wp-block-paragraph">像谷歌前面就是矫枉过正了。你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以，这个到底掌握到什么步骤，他们也是很头疼的。再往后什么欺诈，视频的欺诈，那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。</p>



<p class="wp-block-paragraph">因为这个东西完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。</p>



<p class="wp-block-paragraph">你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然，有其他的工具可以干这件事情。现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。除了前面我们讲的什么欺诈、血腥暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这对于视频来说也很麻烦。</p>



<p class="wp-block-paragraph">什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。</p>



<p class="wp-block-paragraph">但是，这个但是后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的。稍微擦点边的都拒绝服务。</p>



<p class="wp-block-paragraph">你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战、什么米老鼠，马上拒绝。</p>



<p class="wp-block-paragraph">所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人人吃东西了，这个已经有一定的传播力了。数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上有很多的这种预告片开始吸引流量。什么意思呢？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的一个视频我已经被这种视频骗了好多回了。</p>



<p class="wp-block-paragraph">我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。现在很多的漫画小说详解相关的视频在抖音、快手上也开始在盈利赚钱了，所以这块已经走入了商业化。</p>



<p class="wp-block-paragraph">那么，以假乱真也造成了很多的困扰，比如说雷军骂人，于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语，这个也是很容易骗到人的。下一步的AI工具会是什么样的呢？第一个专业应用级别，可能还是会有专门的人去做。</p>



<p class="wp-block-paragraph">就像现在我们，比如说在视频领域里头，我的视频处理都是用剪映的，但是呢也还是有很多专业团队会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强。普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的，他们可能还需要在用户交互上或者是工具上还要有待增强。这个大模型本身，他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但是呢，这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP也在尝试跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好、吉梦也好、Runway Pica，一大堆的这样的视频模型就出来了。</p>



<p class="wp-block-paragraph">他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索寻找新方向，但是呢，都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事。感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了，Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，称这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型吧，可以仿真出世界来的，当时是可以出一分钟的视频的。虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟。其实跟我们现在可以使用到的很多视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5到10秒钟。那么，艺术家们为什么干这么个事呢？原因呢也很简单。有一句话叫“富贵不归乡，如锦衣夜行”，什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了，艺术家们加入呢是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害什么这样的视频，所以呢需要一些成员说你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。</p>



<p class="wp-block-paragraph">第三种呢叫创意合作伙伴，Sora每过一段时间呢会发出一些样板视频来，那意思什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，我们只要写一个提示词，生成出来大差不差的，我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以，对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。所以呢，他们说：“我们付出了很多，但是发表的作品呢又非常难。”因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们呢应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试。</p>



<p class="wp-block-paragraph">然后，所有的测试还需要签保密协议，你还不能出来说，这个时间长了以后一定会造反的。艺术家们呢就觉得他们成为了OpenAI的公关噱头，就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。其实，这些呢是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢，是呼吁Open AI可以更加开放，你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢，呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错，这就是他们的一个公开信。现在呢，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。</p>



<p class="wp-block-paragraph">最后呢，就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。所以，他们就整了这么一个幺蛾子出来，你虽然跟我签了保密协议，但是我们就啪，把这个东西扔到世界上最大的开元大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。</p>



<p class="wp-block-paragraph">当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢？现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。也许过一段时间，人家就突然就发布了，发现哎，这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。</p>



<p class="wp-block-paragraph">这些艺术家们在一个网站上开始征集签名，说来你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。那么，视频生成为什么这么费劲呢？Open AI在年初的时候，就在2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。</p>



<p class="wp-block-paragraph">但是呢，视频生成本身的难度是很大的。第一个呢，就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯？这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的内容，两条腿突然走着走着就变三条了，或者是这两条腿迈着迈着就都变成左脚了，变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。</p>



<p class="wp-block-paragraph">脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。</p>



<p class="wp-block-paragraph">再往后呢，就是算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。当然了，这个还不是困扰视频生成本身的最大难题。</p>



<p class="wp-block-paragraph">更大的难题是什么呢？就是视频要好看。最后生成完了以后，视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢，做视频生成其实是在两个层面上大家在努力，第一个层面就是模型，怎么能够让模型更好；第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗，上传图片吗，然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，就是有没有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。</p>



<p class="wp-block-paragraph">这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。到目前为止没有特别好使的，在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说我们付出的努力极其艰巨呢，也是如此。</p>



<p class="wp-block-paragraph">他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。</p>



<p class="wp-block-paragraph">咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，还不能矫枉过正。像谷歌前面就是矫枉过正了，你跟他说任何的提示词里边一定是有黄种人、有黑人、有白人、有男的、有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。</p>



<p class="wp-block-paragraph">所以这个到底掌握到什么步骤，他们也是很头疼的。再往后，什么欺诈？视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢，你可以自己上传一张照片，说我现在让这个人去讲话。</p>



<p class="wp-block-paragraph">你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然，有其他的工具可以干这件事情。现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。</p>



<p class="wp-block-paragraph">除了前面我们讲的什么欺诈呀、血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。</p>



<p class="wp-block-paragraph">但是，这个但是后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjourney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。</p>



<p class="wp-block-paragraph">你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战，什么米老鼠，马上拒绝。所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。</p>



<p class="wp-block-paragraph">现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能。这些呢已经可以达到一部分商业使用的能力了。现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。</p>



<p class="wp-block-paragraph">很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个说话了，这个吃东西了，这个已经有一定的传播力了。数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。YouTube上呢，有很多的这种预告片开始吸引流量。什么意思呢？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。</p>



<p class="wp-block-paragraph">当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的视频我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画、小说详解相关的视频，在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。那么，以假乱真也造成了很多的困扰，比如说雷军骂人，于东来骂人，甚至还有人把德国选择党的那个女党首的这个视频配上中文上来，讲一些比较激烈的这种话语吧，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的视频处理都是用剪映的。但是呢，也还是有很多专业团队会使用一些更复杂的这种视频工具，Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用，用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强，普通人使用Sora这样的模型，或者使用其他的，刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP，也在尝试跟各自的这种视频编辑工具进行结合。这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好，吉梦也好，Runway Pica，一大堆的这样的视频模型就出来了。</p>



<p class="wp-block-paragraph">他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事。感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了。Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说这些艺术家们呢，都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，就是不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的。当时是可以出一分钟的视频的，虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟，实际上跟我们现在可以使用到的大量的这种视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5到10秒钟。那么，艺术家们为什么干这么个事呢？原因呢也很简单，有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了，艺术家们加入呢是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害什么这样的视频，所以呢需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。</p>



<p class="wp-block-paragraph">第三种呢叫创意合作伙伴。Sora每过一段时间呢会发出一些样板视频来，那意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。</p>



<p class="wp-block-paragraph">它不像是我们普通人去使用图片生成模型，式的那我们只要写一个提示词，生成出来大差不差的，我就能用。那些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。</p>



<p class="wp-block-paragraph">所以呢，他说哎，我们付出了很多，但是发表的作品呢又非常难，因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。即使是有作品被发表展示了，这些艺术家们呢应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。</p>



<p class="wp-block-paragraph">这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。艺术家们呢就觉得他们成为了OpenAI的公关噱头，就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些呢其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢是呼吁Open AI可以更加开放，你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错。这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢，就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以他们就整了这么一个幺蛾子出来，你虽然跟我签了保密协议，但是我们就啪，把这个东西扔到世界上最大的开元大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现哎，这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。艺术家们在一个网站上开始征集签名，说来你们谁支持我，这里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个呢，就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题，咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候呢，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯，这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这个两条腿迈着迈着他都变成左脚了，都变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说，非常非常难以控制和把握。再往后呢，就是算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这个还不是困扰视频生成本身的最大难题。更大的难题是什么呢？就是视频要好看，最后生成完了以后视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢，做视频生成其实是在两个层面上大家在努力，第一个层面就是模型，怎么能够让模型更好。第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗？上传图片吗？然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，就是有没有人见过飞机驾驶舱，从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置，才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说我们付出的努力极其艰巨呢，也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。像谷歌前面就是矫枉过正了，你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。</p>



<p class="wp-block-paragraph">所以这个到底掌握到什么步骤，他们也是很头疼的。再往后什么欺诈？视频的欺诈，那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全的可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。</p>



<p class="wp-block-paragraph">你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然有其他的工具可以干这件事情，现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。除了前面我们讲的什么欺诈呀、血腥暴力歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解的很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。但是，这个但是后边才是重点，艺术表现力非常的差。</p>



<p class="wp-block-paragraph">甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来。说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。</p>



<p class="wp-block-paragraph">所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部，也集成了视频直接生成的这种功能，这些呢已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人人吃东西了，这个已经有一定的传播力了。数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以。这样的一个视频，我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频在抖音在快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。那么，以假乱真也造成了很多的困扰，比如说雷军骂人、于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语吧，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的。但是呢，也还是有很多专业团队会使用一些更复杂的这种视频工具，Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用，用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强。普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好、可灵也好，还是挺难使的。他们可能还需要在用户交互上或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上，在吉梦也好、可灵也好，都在做手机APP，网站的这种Web APP也在尝试，跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆，可灵也好、吉梦也好、Runway Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事。感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了，Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说明这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的，虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟，实际上跟我们现在可以使用到的很多视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5-10秒钟。那么，艺术家们为什么干这么个事呢？原因呢也很简单，有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了。艺术家们加入呢，是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害什么这样的视频，所以呢需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过。</p>



<p class="wp-block-paragraph">这个叫红队成员。第三种呢叫创意合作伙伴，Sora每过一段时间呢会发出一些样板视频来，那意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。</p>



<p class="wp-block-paragraph">它不像是我们普通人去使用图片生成模型那样。我们只要写一个提示词，生成出来大差不差的，我就能用。这些人是艺术家，之所以能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以，对于他们来说，想要让这种视频模型输出自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。</p>



<p class="wp-block-paragraph">所以呢，他们说：“我们付出了很多，但是发表的作品呢又非常难。”因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。即使是有作品被发表展示了，这些艺术家们呢，应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。</p>



<p class="wp-block-paragraph">这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。</p>



<p class="wp-block-paragraph">艺术家们呢，就觉得他们成为了OpenAI的公关噱头。就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些呢，其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。再往后呢，是呼吁Open AI可以更加开放。</p>



<p class="wp-block-paragraph">你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢，呼吁艺术家们开始使用开源的视频模型，表示现在有很多开源模型已经可以用了，效果还不错。这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢，就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以，他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就啪，把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现哎，这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。这些艺术家们在一个网站上开始征集签名，说来，你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢，并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个呢，就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯？这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这两条腿迈着迈着都变成左脚了，都变成右脚。在图像生成模型上也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这种方式是可以让这个脸稍微的稳定一点的。</p>



<p class="wp-block-paragraph">脸是一方面，然后这个身材、身上的衣服、各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。</p>



<p class="wp-block-paragraph">再往后呢，就是算力成本实在太高了。图片生成，现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高的。当然了，这个还不是困扰视频生成本身的最大的难题，更大的难题是什么呢？就是视频要好看。</p>



<p class="wp-block-paragraph">最后生成完了以后视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢，做视频生成其实是在两个层面上大家在努力。第一个层面就是模型，怎么能够让模型更好。第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗，上传图片吗，然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢，是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，有没有人见过飞机驾驶舱，从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。</p>



<p class="wp-block-paragraph">这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说都是极大的挑战。到目前为止没有特别好使的，在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说，我们付出的努力极其艰巨呢？也是如此，他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。</p>



<p class="wp-block-paragraph">像谷歌前面就是矫枉过正了。你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人，有男的、有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以这个到底掌握到什么步骤，他们也是很头疼的。</p>



<p class="wp-block-paragraph">再往后什么欺诈，视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢，完全的可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。</p>



<p class="wp-block-paragraph">你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然有其他的工具可以干这件事情，现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。</p>



<p class="wp-block-paragraph">除了前面我们讲的什么欺诈、血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。</p>



<p class="wp-block-paragraph">但是，这个但是后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。</p>



<p class="wp-block-paragraph">所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些呢已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人吃东西了，这个已经有一定的传播力了。数字人呢，也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的一个视频。我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。以假乱真也造成了很多的困扰，比如说雷军骂人，于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的。但是呢，也还是有很多专业团队会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强，普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上，或者是工具上还要有待增强，这个大模型本身，他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用，但这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP，也在尝试跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好，吉梦也好，Runway Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么，虽然很多的厂商也在尝试去摸索寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事，感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，都已经有很多用户开始使用了。Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说这些艺术家们呢，都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫，大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，就是不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的。当时是可以出一分钟的视频的，虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟，其实跟我们现在可以使用到的大量的这种视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5到10秒钟。那么艺术家们为什么干这么个事呢？原因呢也很简单，有一句话叫“富贵不归乡，如锦衣夜行。”什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了，艺术家们加入呢是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害这样的视频，所以呢需要一些成员说，你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务或者怎么能够规避，怎么能绕过，这个叫红队成员。</p>



<p class="wp-block-paragraph">第三种呢叫创意合作伙伴。Sora每过一段时间呢会发出一些样板视频来，那意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。现在呢这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，那我们只要写一个提示词，生成出来大差不差的，我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。于是他们说：“我们付出了很多，但是发表的作品呢又非常难。”因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们呢应该也没有得到什么回报。对应一个1,500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说，这个时间长了以后一定会造反的。</p>



<p class="wp-block-paragraph">艺术家们呢就觉得他们成为了OpenAI的公关噱头，就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些呢其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。再往后呢是呼吁Open AI可以更加开放，你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错，这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。所以他们就整了这么一个幺蛾子出来，你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。</p>



<p class="wp-block-paragraph">当然现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。</p>



<p class="wp-block-paragraph">这些艺术家们在一个网站上开始征集签名，谁支持我，这里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。那么视频生成为什么这么费劲呢？Open AI在年初的时候，2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。</p>



<p class="wp-block-paragraph">第一个呢就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪。图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候呢，里边的肢体就会从衣服外边撑出来。</p>



<p class="wp-block-paragraph">你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误。比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这个两条腿迈着迈着他都变成左脚了，都变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。</p>



<p class="wp-block-paragraph">这是第一个问题。第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上。现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。再往后呢就是算力成本实在太高了。图片生成现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这个还不是困扰视频生成本身的最大的难题。更大的难题是什么呢？就是视频要好看。最后生成完了以后视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。现在呢做视频生成，其实是在两个层面上大家在努力。第一个层面就是模型，怎么能够让模型更好；第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式对话吗，上传图片吗，然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件。这个时候就发现，哎呀，这个实在太难了，因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。这大家想象一下，就是有没有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。</p>



<p class="wp-block-paragraph">视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说，都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说：“我们付出的努力极其艰巨呢？”也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大得多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。像谷歌前面就是矫枉过正了，你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人、有男的、有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。 所以这个到底掌握到什么步骤，他们也是很头疼的。</p>



<p class="wp-block-paragraph">再往后什么欺诈，视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。 当然有其他的工具可以干这件事情，现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。</p>



<p class="wp-block-paragraph">除了前面我们讲的什么欺诈呀、血腥暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。那么我们到底还需不需要等Sora呢？</p>



<p class="wp-block-paragraph">其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去。这个Dalle3算是最强的。但是，这个但是后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢，画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。</p>



<p class="wp-block-paragraph">你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战、什么米老鼠，马上拒绝。所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。</p>



<p class="wp-block-paragraph">现在可以用的视频大模型其实已经不少了，甭管是runway还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些呢已经可以达到一部分商业使用的能力了。现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人吃东西了，这个已经有一定的传播力了。</p>



<p class="wp-block-paragraph">数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。YouTube上呢有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以，这样的视频我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。以假乱真也造成了很多的困扰，比如说雷军骂人、于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语吧，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的，但是呢也还是有很多专业团队会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用呢肯定还有待增强，普通人使用Sora这样的模型或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用。但是呢，这个可能距离我们还稍微远一些。这种半专业应用的话，应该正在路上，在吉梦也好可灵也好呢，都在做手机APP，网站的这种Web APP也在尝试跟各自的这种视频编辑工具进行结合，这一块的话有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢？我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好、吉梦也好、Runway Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ，通义千问做的推理模型。在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索，寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。</p>



<p class="wp-block-paragraph">所以我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。好，这是今天讲的故事，感谢大家收听，请帮忙点赞点小铃铛，参加discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">其实，从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去。这个Dalle3算是最强的。但是，这个“但是”后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是画的过程还是比较粗糙的。稍微擦点边的都拒绝服务。</p>



<p class="wp-block-paragraph">你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来。说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战，什么米老鼠，马上拒绝。所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。</p>



<p class="wp-block-paragraph">现在可以用的视频大模型其实已经不少了，甭管是runway还是国内能够使用的吉梦。吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能。这些呢，已经可以达到一部分商业使用的能力了。现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人说话了，这个人吃东西了，这个已经有一定的传播力了。</p>



<p class="wp-block-paragraph">数字人呢，也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个你也不能说他粗制滥造，有的做的还可以。这样的一个视频，我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频，在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。至于Open AI下边该干嘛去呢，我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这个方向以后，大家就赶快都去出了一堆可灵也好，吉梦也好，Runway Pica，一大堆的这样的视频模型就出来了。</p>



<p class="wp-block-paragraph">所以，我们期待Open AI可以给大家指明下一个方向。等指明了以后，全球的厂商再顺着这个方向往前跑。好，这是今天讲的故事，感谢大家收听，请帮忙点赞、点小铃铛，参加discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂地泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，已经有很多用户开始使用了。Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂地开放了一段时间。这些艺术家还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，称这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫。大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，不是一个全尺寸的模型，参数也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的。虽然一分钟视频并没有那么大的用处，超过一分钟都属于超长镜头了，电影里头用这种镜头其实也不是那么多。这一次只提供了1080P、720P、360P三种的分辨率，时长就是5到10秒钟。其实跟我们现在可以使用到的大量这种视频生成模型参数是一样的，现在的视频生成模型基本上都是5到10秒钟。</p>



<p class="wp-block-paragraph">那么，艺术家们为什么干这么个事呢？原因很简单。有一句话叫“富贵不归乡，如锦衣夜行”。什么意思呢？有钱了得回家显摆显摆，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">那公开信里都写了什么呢？他写了说，艺术家们年初就被邀请加入了。艺术家们加入是分为三种不同的角色。第一个叫早期测试者，估计就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假，或者版权侵害什么这样的视频。所以需要一些成员不断地向他提这样的要求，看看能不能都识别出来，拒绝服务或者怎么能够规避，怎么能绕过，这个叫红队成员。第三种叫创意合作伙伴，Sora每过一段时间会发出一些样板视频来，意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。</p>



<p class="wp-block-paragraph">现在，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，需要付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，我们只要写一个提示词，生成出来大差不差的我就能用。</p>



<p class="wp-block-paragraph">这些人是艺术家，之所以能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。所以对于他们来说，想要让这种视频模型输出自己能够满意的产品，或者叫作品，这个事本身是非常难的。他们说，我们付出了很多，但是发表的作品又非常难，因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后再要经过Open AI的审核，才有极少的一部分作品可以发表。</p>



<p class="wp-block-paragraph">即使是有作品被发表展示了，这些艺术家们应该也没有得到什么回报。对应一个1500亿美金的Open AI来说，大家觉得这个事有点太不公平了。而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期。这就相当于什么？就是一帮人进去打测试服的游戏去了，结果始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。</p>



<p class="wp-block-paragraph">艺术家们就觉得他们成为了OpenAI的公关噱头。就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。这些其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后是呼吁Open AI可以更加开放。你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错，这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI是可以接受的，但艺术家们肯定接受不了。最后，艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以，他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上，让大家都瞅了这么一眼。当然，现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢，现在不知道，因为Open AI绝对是社交媒体公关大师，不停地玩各种奇怪的事情。</p>



<p class="wp-block-paragraph">也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。这些艺术家们在一个网站上开始征集签名，说来，你们谁支持我，这里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，2月份的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是，视频生成本身的难度是很大的。第一个，内容合理性其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边有个人，但是人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，膝盖应该往后弯的。但是，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯，这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的内容，两条腿突然走着走着就变三条了，或者是两条腿迈着迈着都变成左脚了，变成右脚。图像生成模型上也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。第二个问题就是一致性可控性，这个其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。</p>



<p class="wp-block-paragraph">现在在图片生成模型的一致性上，已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材、身上的衣服、各种配饰，你要让所有的这些图片都很稳定地保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。再往后，算力成本实在太高了。图片生成，现在我们画一幅1080P的图像，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这还不是困扰视频生成本身的最大难题。更大的难题是什么呢？就是视频要好看。最后生成完了以后，视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。</p>



<p class="wp-block-paragraph">现在做视频生成，其实是在两个层面上大家在努力。第一个层面就是模型，怎么能够让模型更好。第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗？上传图片吗？然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件，这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。</p>



<p class="wp-block-paragraph">当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。大家想象一下，有没有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。</p>



<p class="wp-block-paragraph">现在我们要做视频生成的这种工具了，在有大模型的基础上，你也需要大量的开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的做视频生成工具的人来说，都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止，没有特别好使的。在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以，为什么这帮艺术家也说我们付出的努力极其艰巨呢，也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大得多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时，你还不能矫枉过正。</p>



<p class="wp-block-paragraph">像谷歌前面就是矫枉过正了。你跟他说，任何的提示词里边一定是有黄种人、有黑人、有白人、有男的、有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以，这个到底掌握到什么步骤，他们也是很头疼的。</p>



<p class="wp-block-paragraph">再往后，什么欺诈，视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是你可以自己上传一张照片，说我现在让这个人去讲话。</p>



<p class="wp-block-paragraph">你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话它就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。当然，有其他的工具可以干这件事情。现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。</p>



<p class="wp-block-paragraph">除了前面我们讲的什么欺诈、血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西，这个都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看Dalle3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个Dalle3算是最强的。</p>



<p class="wp-block-paragraph">但是，这个“但是”后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjorney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝；你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝；你只要提到任何人的名字，直接拒绝；说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝；请给我画个什么星球大战、米老鼠，马上拒绝。</p>



<p class="wp-block-paragraph">所以，他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。现在可以用的视频大模型其实已经不少了，甭管是Runway，还是国内能够使用的吉梦，吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能，这些已经可以达到一部分商业使用的能力了。</p>



<p class="wp-block-paragraph">现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人吃东西了，这个已经有一定的传播力了。数字人也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。</p>



<p class="wp-block-paragraph">YouTube上有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以。这样的一个视频，我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。</p>



<p class="wp-block-paragraph">现在很多的漫画小说详解相关的视频，在抖音、快手上也开始在盈利赚钱了，所以这块已经走入了商业化。那么，以假乱真也造成了很多的困扰，比如说雷军骂人、于东来骂人，甚至还有人把那个德国选择党的那个女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语，这个也是很容易骗到人的。</p>



<p class="wp-block-paragraph">下一步的AI工具会是什么样的呢？第一个专业应用级别，可能还是会有专门的人去做。就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的。但是，也还是有很多专业团队会使用一些更复杂的这种视频工具。Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用。用完了以后出了所有东西，你们自己负责任，跟我就没有关系了，这是一种方式。</p>



<p class="wp-block-paragraph">半专业的应用肯定还有待增强，普通人使用Sora这样的模型，或者使用其他的，刚才我们说的吉梦也好、可灵也好，还是挺难使的。他们可能还需要在用户交互上，或者是工具上还要有待增强。这个大模型本身，他们自己慢慢训就可以了。至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用。但是，这个可能距离我们还稍微远一些。</p>



<p class="wp-block-paragraph">这种半专业应用的话，应该正在路上。在吉梦也好、可灵也好，都是在做手机APP，网站的这种Web APP也在尝试，跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢，我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这个方向以后，大家就赶快都去出了一堆可灵也好、吉梦也好、Runway、Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ，通义千问做的推理模型，在32B的参数下，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。</p>



<p class="wp-block-paragraph">所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索，寻找新方向，但是都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。所以，我们期待Open AI可以给大家指明下一个方向，等指明了以后，全世界的厂商再顺着这个方向往前跑。</p>



<p class="wp-block-paragraph">好，这是今天讲的故事，感谢大家收听，请帮忙点赞点小铃铛，参加Discord讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>



<p class="wp-block-paragraph">昨天，Sora短暂的泄露。但是，我们真的还需要等待Sora吗？大家好，欢迎收听老范讲故事的YouTube频道。在今年2月份，Open AI公布了他们的Sora大模型之后，大家一直在等待这个产品的正式发布。但是，等到了现在，已经到年底了，很多跟随Sora的产品都已经上线，已经有很多用户开始使用了。Sora自己还遥遥无期。</p>



<p class="wp-block-paragraph">在这样的一个时间点里，突然有一群艺术家将Sora的这个接口公开到了Hugging Face上面去，短暂的开放了一段时间。这些艺术家呢，还发表了一封公开信，表达了自己对于Open AI的各种剥削的不满。Open AI呢，及时发现，在一小时之后封闭了接口，说你们就到这吧，然后也出来做了一些解释，说明这些艺术家们都是跟我们一起去合作的，他们都是自愿参加的，没有什么强迫。大概也是讲了一些这种片汤话。</p>



<p class="wp-block-paragraph">至于Sora什么时候能发布，人家也没有再继续提供更进一步的信息。那么，这一次泄露出来的呢，是Sora的Turbo版本。Turbo是轻量级快速的版本，就是不是一个全尺寸的模型，参数呢也并不是很突出。2月份，Sora当时号称自己是世界模型，可以仿真出世界来的，当时是可以出一分钟的视频的，虽然一分钟视频并没有那么大的用处，超过一分钟都属于是超长镜头了，电影里头用这种镜头其实也不是那么多。这一次呢只提供了1080P、720P、360P三种的分辨率，然后时长呢就是5到10秒钟，实际上跟我们现在可以使用到的大量的这种视频生成模型参数是一样的。</p>



<p class="wp-block-paragraph">现在的视频生成模型基本上都是5-10秒钟。那么，艺术家们为什么干这么个事呢？原因呢也很简单。有一句话叫“富贵不归乡，如锦衣夜行。”什么意思呢？有钱了得回家显摆显摆去，要不然的话就跟穿了个好衣服，晚上出门没人看见那是一样的。对于这帮艺术家们来说，有了一个好东西，你又不让他们显摆，这肯定是非常非常不爽的。</p>



<p class="wp-block-paragraph">公开信里都写了什么呢？他写了说，艺术家们年初呢就被邀请加入了，艺术家们加入呢是分为三种不同的角色。第一个呢叫早期测试者，估计呢就是最一开始的一批人，还没有进行详细的分工，你们先来试试各种的接口能不能跑起来。第二个角色呢叫红队成员，这是干嘛使的？视频模型非常害怕一件事情，就是生成一些有害视频，色情、暴力、虚假呀，或者版权侵害什么这样的视频，所以呢需要一些成员说你不断的向他提这样的要求，看看能不能都识别出来，拒绝服务，或者怎么能够规避，怎么能绕过，这个叫红队成员。第三种呢叫创意合作伙伴，Sora每过一段时间呢会发出一些样板视频来，意思是什么？他说你看我还活着呢，我还在继续往前走，你们其他人怎么追赶也追不上。</p>



<p class="wp-block-paragraph">现在呢，这些艺术家们感觉被骗了，为什么呢？因为付出很多，Sora这种模型绝对没有那么好使。不是说它输出的东西不好，而是说你要想使用这个模型，付出的努力一定是非常艰巨的，因为你需要向它描述你到底要一个什么样的视频。它不像是我们普通人去使用图片生成模型式的，那我们只要写一个提示词，生成出来大差不差的，我就能用。这些人是艺术家，之所以他能成为艺术家，一定是他们对于自己的艺术产品有极高的要求。</p>



<p class="wp-block-paragraph">所以，对于他们来说，想要让这种视频模型输出了自己能够满意的产品，或者叫作品吧，这个事本身是非常难的。所以呢，他说：“我们付出了很多，但是发表的作品呢又非常难。”因为他们发表作品一定是经过层层筛选，甚至是竞赛，然后呢再要经过Open AI的审核，才有极少的一部分作品可以发表。即使是有作品被发表展示了，这些艺术家们呢应该也没有得到什么回报。对应一个1500亿美金的Open AI来说，大家觉得这个事有点太不公平了。</p>



<p class="wp-block-paragraph">而且这么长时间，你要说时间短了还可以，Sora大模型的发布又遥遥无期，这个就相当于什么？就是一帮人进去打测试服的游戏去了，结果呢始终也不给你公测，或者始终也不给你进正式上线，大家只能在里边参加各种删号测试，然后所有的测试还需要签保密协议，你还不能出来说。这个时间长了以后一定会造反的。艺术家们呢就觉得他们成为了OpenAI的公关噱头，就是每过一段时间，他们会在这么多艺术家，可能300多个艺术家里头，挑选那么几个作品放出来，说：“你看，这就是Sora现在能够达到的成就，你们其他人就羡慕去吧。”这些呢其实是艺术家们的艰苦工作，并不是Sora本身模型到底有多好。</p>



<p class="wp-block-paragraph">再往后呢是呼吁Open AI可以更加开放。你不要上来就是签一大堆保密协议，这个实在是对于艺术家们来说太不友好了。而且呢呼吁艺术家们开始使用开源的视频模型，说现在有很多开源模型已经可以用了，效果还不错。这就是他们的一个公开信。</p>



<p class="wp-block-paragraph">现在呢，Open AI内部动荡不断，Sora到底什么时候能发布还遥遥无期，仅仅依靠零星露出的作品保持社交媒体关注度，Open AI呢是可以接受的，但是艺术家们肯定接受不了。最后呢就是艺术家毕竟不是工程师，不是律师，不是会计师，不是其他的这种社畜。如果他们完全按照逻辑，按照大家签的协议去做事的话，就不是艺术家了。</p>



<p class="wp-block-paragraph">所以，他们就整了这么一个幺蛾子出来。你虽然跟我签了保密协议，但是我们就把这个东西扔到世界上最大的开源大模型的集散网站Hugging Face上去，让大家都瞅了这么一眼。当然现在也有人在讲说这个事情是不是又是Open AI的一次公关策略呢？现在不知道，因为Open AI绝对是社交媒体公关大师，不停的玩各种奇怪的事情。也许过一段时间，人家就突然就发布了，发现这个江湖上又没有哥的声音再传播了，咱们得再整出点幺蛾子出来，这个都难说。</p>



<p class="wp-block-paragraph">这些艺术家们在一个网站上开始征集签名，说来你们谁支持我。这个里边还有一个签名的人，号称叫埃隆·马斯克。只是签名的过程呢并不需要进行身份验证，所以也不知道这个是真是假。</p>



<p class="wp-block-paragraph">那么，视频生成为什么这么费劲呢？Open AI在年初的时候，已经为全世界整个的AIGC行业指明了方向，这个贡献还是非常巨大的，我们要承认。但是呢，视频生成本身的难度是很大的。第一个呢就是内容合理性，其实很难保持。六个手指头、七个手指头，手长得很奇怪，图片生成模型既然已经有这种问题了，那么视频生成模型有同样的手指头问题，或者各种的合理性问题，这个都是很正常的，避免不了的。</p>



<p class="wp-block-paragraph">还有就是物理破膜的问题。咱们做过3D动画的人都知道，经常是就会出现这种叫物理破膜。什么叫物理破膜？你比如说你穿了件衣服，里边呢有个人，但是呢人在做一些动作的时候，里边的肢体就会从衣服外边撑出来。你在视频模型生成的时候，有可能也会发生同样的事情，包括一些解剖学错误，比如说这个脚要往前走的时候，应该膝盖是往后弯的。但是呢，你怎么能够把这个膝盖必须往后弯这件事告诉大模型，让他每一次生成的时候都向后弯？这个挺难的。</p>



<p class="wp-block-paragraph">我们看过很多视频模型生成的这种内容，两条腿突然走着走着就变三条了，或者是这个两条腿迈着迈着他都变成左脚了，都变成右脚。在图像生成模型上，也会出现这种问题，视频生成模型更加难以避免。这是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题就是一致性可控性，这个呢其实也是从图像生成模型那边就遇到的问题，到视频生成模型依然难以搞定。现在呢，在图片生成模型的一致性上已经好一点。什么叫一致性？比如说你说让老范讲故事这张脸出现在不同的角色身上，或者是不同的艺术风格上，现在图片生成模型有一些方法，比如说自己去训练小模型，这个方式是可以让这个脸稍微的稳定一点的。脸是一方面，然后这个身材，身上的衣服各种配饰，你要让所有的这些图片都很稳定的保持一致性，这个很难。</p>



<p class="wp-block-paragraph">像一个视频，一秒钟25帧到30帧，你要保证每一帧上，比如说这里都带着一个麦克风，这个对于他们来说非常非常难以控制和把握。再往后呢就是算力成本实在太高了。图片生成现在我们画一幅1080P的这种图像吧，大概就需要几个美分。那你想一秒钟25帧到30帧的视频，他需要多少算力？大家去做各种测试和实验的时候，这个成本是非常非常高。</p>



<p class="wp-block-paragraph">当然了，这个还不是困扰视频生成本身的最大的难题。更大的难题是什么呢？就是视频要好看。最后生成完了以后视频难看，没有人愿意看，没有人愿意传播，这个本身是没有任何意义和价值的。</p>



<p class="wp-block-paragraph">现在呢，做视频生成其实是在两个层面上大家在努力。第一个层面就是模型怎么能够让模型更好。第二个层面是什么？就是怎么去操控，我到底应该用一些什么样的方式，对话吗？上传图片吗？然后一大堆菜单和选项吗？应该怎么能够让他进行顺畅的操作，把这个视频生成出来，这个其实非常难。</p>



<p class="wp-block-paragraph">我记得在2014年的时候，有大量的团队尝试去做手机端的视频编辑软件。这个时候就发现，哎呀，这个实在太难了。因为最早的时候，视频编辑这件事情，都是在视频编辑机，那是个硬件，在那个上面弄的。再往后呢是在这种很专业的视频编辑电脑上面去操作，而且是由一些专业人士操作。当你要把视频编辑这件事情弄到手机上去操作的时候，需要调控的东西实在太多了，非常麻烦。</p>



<p class="wp-block-paragraph">这个大家想象一下，就是有没有人见过飞机驾驶舱？从头上到脚下，你身边所有能看见的地方，全都是各种各样的开关和仪表。视频编辑其实跟这个过程很像，大量的参数和开关选项需要设置才能够得到你满意的视频。现在我们要做视频生成的这种工具了，你在有大模型的基础上，你也需要大量的这种开关选项、菜单或者是提示词，才能够告诉大模型我们到底要生成什么样的视频。这些交互的过程应该如何去安排，这个对于现在所有的这种做视频生成工具的人来说都是极大的挑战。</p>



<p class="wp-block-paragraph">到目前为止没有特别好使的，在这么难操控的情况下，你要能保证输出出来的视频是有人愿意看的，这个难度就会更大一些。所以为什么这帮艺术家也说说：“我们付出的努力极其艰巨呢？”也是如此。他们想控制Sora这样的一个半成品，甚至可能都没有界面，你还需要去写代码，才可以让他跑起来的一个系统，让这样的系统去输出需要的视频，这个是非常非常麻烦的。</p>



<p class="wp-block-paragraph">除了视频模型操作的问题之外，下一个问题就是视频安全性，风险要比图片、文字、音频都要大的多，甚至把所有的这些前面我们讲的这些风险都盛起来，都没有视频所生成的这种风险更大。咱们前面讲的红队要去处理的问题，就是看怎么能够把这些风险在发布之前尽可能地发现，尽可能地排除掉。这些风险包括色情、暴力、歧视性的，而且歧视性你不能出现的同时呢，你还不能矫枉过正。像谷歌前面就是矫枉过正了。你跟他说，任何的提示词里边一定是有黄种人，有黑人，有白人，有男的，有女的，还有奇奇怪怪性别的人凑在一起，最后被骂的直接把这个接口封掉了。所以这个到底掌握到什么步骤，他们也是很头疼的。</p>



<p class="wp-block-paragraph">再往后什么欺诈，视频的欺诈那要比文字欺诈、图片欺诈、声音欺诈都要吓人，因为他真的像真的一样。因为这个东西呢完全可以以假乱真。我今天测试了一下，在剪映里边去使用真人数字人。什么叫真人数字人？就是有一个数字人在这讲话，但是呢你可以自己上传一张照片，说我现在让这个人去讲话。你要想做这个操作的话，剪映要干嘛？要去做人脸识别，保证你上传的这个照片是你自己，否则的话他就拒绝工作了。你说我今天上传一个雷军的，让他去骂人，去让他去做一些其他的事情，这个事他不干。</p>



<p class="wp-block-paragraph">当然有其他的工具可以干这件事情。现在雷军骂人也好，于东来骂人也好，这种视频都是在满天飞的。除了前面我们讲的什么欺诈呀，血腥、暴力、歧视之外，还有一个问题叫版权纷争。你一旦是遇到了版权纷争，这个对于视频来说也很麻烦。什么叫版权纷争？比如说请给我按照宫崎骏的风格画一个什么东西，或者生成一个什么动漫，或者星球大战里的一个什么角色去做一个什么样的事情，或者说你现在请用马斯克的脸给我生成一个什么东西。这呢都面临着版权纠纷，包括一些品牌和形象的纠纷，这些是需要去注意的。</p>



<p class="wp-block-paragraph">那么，我们到底还需不需要等Sora呢？其实从达利3的这个角度上来看，我觉得我们完全不需要再去期待Sora了。为什么呢？我们看看DALL·E 3现在画图的效果。首先，咱们先说优点，文字理解还是相当不错的。当你给他一个很长的提示词的时候，他会把提示词中的各个部分都理解得很清楚，而且尽量的都给你画到这个图片上去，这个DALL·E 3算是最强的。但是，这个“但是”后边才是重点，艺术表现力非常的差。甭管是跟最新的Flex比，还是跟Midjourney 6.1比，完全没法看。细节也是非常差的。他虽然可以把每一个提示词里边要求的东西都给你画上，但是呢画的过程还是比较粗糙的，稍微擦点边的都拒绝服务。</p>



<p class="wp-block-paragraph">你比如说，我要求给我按照迪士尼的3D风格画一个什么东西，马上拒绝。你说现在请给我按照日本漫画风格画，可以画出来；说现在请按照宫崎骏的风格给我画，马上拒绝。你只要提到任何人的名字，直接拒绝。说现在请按照哪一个漫画里的这个情节，七龙珠的漫画情节给我画一个东西，马上拒绝。请给我画个什么星球大战、什么米老鼠，马上拒绝。所以他的拒绝的东西实在是太多了。如果按照同样的政策去执行的话，那我觉得Sora是完全不值得期待的一个东西。</p>



<p class="wp-block-paragraph">现在可以用的视频大模型其实已经不少了，甭管是Runway还是国内能够使用的吉梦。吉梦是剪映下面的字节跳动做的，效果还可以。快手做的可灵效果其实也能够使用了，甚至在剪映内部也集成了视频直接生成的这种功能。这些呢已经可以达到一部分商业使用的能力了。现在的各种亲友照片变成视频，这种内容已经有很强的传播力了。很多人会把一些过世亲友的照片拿出来，给他一个提示词，说这个人现在笑了，这个人人说话了，这个人吃东西了，这个已经有一定的传播力了。</p>



<p class="wp-block-paragraph">数字人呢也已经开始赚钱了，甭管是数字人直播，还是数字人带货，或者数字人骂街，这块已经可以跑了。YouTube上呢，有很多的这种预告片开始吸引流量。什么意思？就是他经常告诉你说，现在哪一部大片后边要拍续集了，大家赶快去看呀。当你看了以后，发现是有很多的前作剪辑，然后再加上一些AI生成的内容，拼凑起来的一个，你也不能说他粗制滥造，有的做的还可以。</p>



<p class="wp-block-paragraph">这样的一个视频，我已经被这种视频骗了好多回了。我现在再看到说哪个大片要准备拍续集，上预告片了，我先得看谁发布的。如果不是原来那个电影的制作公司发布的，我就直接跳过不看了，很容易上当受骗。现在很多的漫画小说详解相关的视频在抖音、快手上也开始在盈利赚钱了，所以这块呢已经走入了商业化。</p>



<p class="wp-block-paragraph">那么，以假乱真也造成了很多的困扰，比如说雷军骂人、于东来骂人，甚至还有人把那个德国选择党的女党首，她的这个视频配上中文上来，讲一些比较激烈的这种话语，这个也是很容易骗到人的。下一步的AI工具会是什么样的呢？第一个专业应用级别呢，可能还是会有专门的人去做，就像现在我们，比如说在视频领域里头，我的这个视频处理都是用剪映的，但是呢也还是有很多专业团队会使用一些更复杂的这种视频工具。</p>



<p class="wp-block-paragraph">Sora以后可能就会向那个方向发展，说我们干脆就永远不再向公众开放了，就是直接签约给这些电影公司，让他们去用，用完了以后出了所有东西，你们自己负责任，跟我就没有关系了。这是一种方式。半专业的应用呢肯定还有待增强，普通人使用Sora这样的模型，或者使用其他的刚才我们说的吉梦也好，可灵也好，还是挺难使的。他们可能还需要在用户交互上，或者是工具上还要有待增强，这个大模型本身他们自己慢慢训就可以了。</p>



<p class="wp-block-paragraph">至于个人应用的话，是否能够爆发，我觉得应该还是可以爆发的，就是使用AI大模型生成视频的这种个人应用。但是呢，这个可能距离我们还稍微远一些。这种半专业应用的话，应该正在路上。在吉梦也好，可灵也好，都在做手机APP，网站的这种Web APP也在尝试，跟各自的这种视频编辑工具进行结合，这一块的话，有可能会最先让我们看到成绩。</p>



<p class="wp-block-paragraph">至于Open AI下边该干嘛去呢，我们已经讲了，Open AI的Sora已经不值得期待了。Open AI作为行业的排头兵老大，它有一个非常重要的职策，就是为整个行业指明下一个方向。他指明了Sora这一个方向以后，大家就赶快都去出了一堆可灵也好、吉梦也好、Runway、Pica，一大堆的这样的视频模型就出来了。他说我们要做O1这种可以带推理的模型，然后一堆的推理模型在这个后边就出来了。</p>



<p class="wp-block-paragraph">今天我还装了一个叫QWQ通义千问做的推理模型，在32B的参数下吧，可以达到甚至是部分超越O1 mini的这个能力了。他现在还达不到O1 Preview的这个能力，但是可以达到O1 Mini的能力，只有32B，那这个还是非常棒的一个东西。所以再往下一个方向到底是什么？虽然很多的厂商也在尝试去摸索，寻找新方向，但是呢都没有Open AI指的方向。他只要摇旗呐喊，大家就直接跟风往上冲，没有这种号召力。</p>



<p class="wp-block-paragraph">所以，我们期待Open AI可以给大家指明下一个方向。等指明了以后，全世界的厂商再顺着这个方向往前跑。好，这是今天讲的故事。感谢大家收听，请帮忙点赞、点小铃铛，参加Discord讨论群。也欢迎有兴趣、有能力的朋友加入我们的付费频道，再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>川普时代的汽车产业链动荡：关税政策下的全球供应链如何重新洗牌？</title>
		<link>https://lukefan.com/2024/11/15/%e5%b7%9d%e6%99%ae%e6%97%b6%e4%bb%a3%e7%9a%84%e6%b1%bd%e8%bd%a6%e4%ba%a7%e4%b8%9a%e9%93%be%e5%8a%a8%e8%8d%a1%ef%bc%9a%e5%85%b3%e7%a8%8e%e6%94%bf%e7%ad%96%e4%b8%8b%e7%9a%84%e5%85%a8%e7%90%83%e4%be%9b/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Fri, 15 Nov 2024 00:58:22 +0000</pubDate>
				<category><![CDATA[新能源智能汽车]]></category>
		<category><![CDATA[OEM]]></category>
		<category><![CDATA[PTT造车]]></category>
		<category><![CDATA[R&D]]></category>
		<category><![CDATA[中国新能源]]></category>
		<category><![CDATA[产业布局]]></category>
		<category><![CDATA[产业政策]]></category>
		<category><![CDATA[产业迁移]]></category>
		<category><![CDATA[产业链优化]]></category>
		<category><![CDATA[企业创新]]></category>
		<category><![CDATA[企业战略]]></category>
		<category><![CDATA[企业转型]]></category>
		<category><![CDATA[供应管理]]></category>
		<category><![CDATA[供应链优化]]></category>
		<category><![CDATA[供应链公司]]></category>
		<category><![CDATA[全球供应链]]></category>
		<category><![CDATA[全球市场]]></category>
		<category><![CDATA[全球经济]]></category>
		<category><![CDATA[公司治理]]></category>
		<category><![CDATA[关税政策]]></category>
		<category><![CDATA[创新技术]]></category>
		<category><![CDATA[制造业回流]]></category>
		<category><![CDATA[制造基地]]></category>
		<category><![CDATA[制造流程]]></category>
		<category><![CDATA[区域经济]]></category>
		<category><![CDATA[台积电]]></category>
		<category><![CDATA[商业环境]]></category>
		<category><![CDATA[商业策略]]></category>
		<category><![CDATA[国际合作]]></category>
		<category><![CDATA[国际竞争]]></category>
		<category><![CDATA[国际贸易]]></category>
		<category><![CDATA[土耳其]]></category>
		<category><![CDATA[增值税]]></category>
		<category><![CDATA[墨西哥]]></category>
		<category><![CDATA[大政府]]></category>
		<category><![CDATA[宏观经济]]></category>
		<category><![CDATA[小政府]]></category>
		<category><![CDATA[川普]]></category>
		<category><![CDATA[工业政策]]></category>
		<category><![CDATA[市值]]></category>
		<category><![CDATA[市场分析]]></category>
		<category><![CDATA[市场动态]]></category>
		<category><![CDATA[市场竞争]]></category>
		<category><![CDATA[市场需求]]></category>
		<category><![CDATA[并购战略]]></category>
		<category><![CDATA[成本管理]]></category>
		<category><![CDATA[技术创新]]></category>
		<category><![CDATA[投资战略]]></category>
		<category><![CDATA[政府补贴]]></category>
		<category><![CDATA[政策应对]]></category>
		<category><![CDATA[效率提升]]></category>
		<category><![CDATA[新能源汽车]]></category>
		<category><![CDATA[日本车企]]></category>
		<category><![CDATA[欧洲车企]]></category>
		<category><![CDATA[汽车产业链]]></category>
		<category><![CDATA[汽车出口]]></category>
		<category><![CDATA[汽车装配]]></category>
		<category><![CDATA[汽车销售]]></category>
		<category><![CDATA[海外市场]]></category>
		<category><![CDATA[海运爆仓]]></category>
		<category><![CDATA[物流行业]]></category>
		<category><![CDATA[特斯拉]]></category>
		<category><![CDATA[环球企业]]></category>
		<category><![CDATA[生产布局]]></category>
		<category><![CDATA[生产效率]]></category>
		<category><![CDATA[生产能力]]></category>
		<category><![CDATA[生产链]]></category>
		<category><![CDATA[生存策略]]></category>
		<category><![CDATA[电动车市场]]></category>
		<category><![CDATA[盈利模式]]></category>
		<category><![CDATA[知识产权]]></category>
		<category><![CDATA[研发中心]]></category>
		<category><![CDATA[竞争优势]]></category>
		<category><![CDATA[经济放缓]]></category>
		<category><![CDATA[经济整合]]></category>
		<category><![CDATA[经济模式]]></category>
		<category><![CDATA[经济转型]]></category>
		<category><![CDATA[美国制造]]></category>
		<category><![CDATA[美国经济]]></category>
		<category><![CDATA[职业发展]]></category>
		<category><![CDATA[自主研发]]></category>
		<category><![CDATA[芯片制造]]></category>
		<category><![CDATA[芯片法案]]></category>
		<category><![CDATA[英特尔]]></category>
		<category><![CDATA[行业动荡]]></category>
		<category><![CDATA[行业布局]]></category>
		<category><![CDATA[行业挑战]]></category>
		<category><![CDATA[行业规划]]></category>
		<category><![CDATA[行业调整]]></category>
		<category><![CDATA[行业趋势]]></category>
		<category><![CDATA[设计中心]]></category>
		<category><![CDATA[财务管理]]></category>
		<category><![CDATA[贸易壁垒]]></category>
		<category><![CDATA[贸易政策]]></category>
		<category><![CDATA[进口关税]]></category>
		<category><![CDATA[马斯克]]></category>
		<category><![CDATA[高端制造]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1695</guid>

					<description><![CDATA[大家好呀！🚗今天咱们一道来聊聊川普时代的汽车产业链迁移，真是太精彩了，大家一定要看看！！！

首先，川大统领以关税作为新手段，意图重塑汽车产业链，这个操作有点让人大跌眼镜啊！😱他总是想让美国制造再次崛起，但真相是市场是复杂且动态的，不能忽视这个道理呀！短期关税让产品变贵，但长远来看，市场会自行调整。你说，是不是？

举个例子，咱们知道英特尔在芯片法案中受益匪浅，然而，真的是阴云笼罩，前景岌岌可危！一旦政策变动，是否能继续收割红利，还是个未知数。💰

再说说马斯克！他要求所有供应链厂商把工厂搬离台海，这是结合地缘政治分析后的智慧之举！他举动的背后，体现出的是对全球化供应链的思考和前瞻性。如果没有准备，未来可能面临麻烦。⚠️

而对于中国汽车产业链的迁移，咱们的电动车企业必须重新布局，甚至与先进的技术企业合作，才有可能在激烈的竞争中保住一席之地！谁能想到，贾跃亭在这个时候真的崛起了呢？他帮助中国新能源车企在美国打开市场的大门，简直是绝绝子呀！😆

最后，未来的汽车格局究竟会如何？不妨耐心等待，市场总会给出答案！同时，记得把握机遇，因为每一次变动，都是一次新机会的诞生！大家一起关注吧，千万不要错过！🔥

感谢你们的收看，继续关注我，我们下期再见哟～～✨

川普时代的汽车产业链动荡：关税政策下的全球供应链如何重新洗牌？

随着川普时代的来临，美国政府在关税和经济政策上进行了重大调整，对全球汽车产业链造成了深远影响。这一系列措施促使供应链在动态市场中寻找新的生存途径。中国新能源企业、欧美传统车企，以及供应链企业都在调整布局，以适应关税政策带来的变化。与此同时，小政府与大政府政策的对比、芯片法案的实践，以及海运爆仓等事件，都对全球经济产生了波动。马斯克等行业领袖的举动，也成为市场动荡中的一个缩影。在这场全球产业链重组中，未来的市场格局将如何演变，值得我们继续关注。
]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="川普时代的汽车产业链动荡：关税政策下的全球供应链如何重新洗牌？" width="900" height="506" src="https://www.youtube.com/embed/Ou4sRshPqeg?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事的YouTube频道。今天来讲一讲川普时代的汽车产业链如何迁移。</p>



<p class="wp-block-paragraph">首先，川大统领确实是上台了。这其中有一点让我觉得很诧异，就是在投票之前，那一周的民调到底是咋做的。在民调之前的两周，再往前都是川大统领必胜，各种遥遥领先。到最后这一周的时候，突然就感觉两边都在使力气说不行了，有可能要输，有可能会有问题。跟川普有关的各种经济指标，像比特币的价格，很多他的股票相关的信息，都有明确的回调。这个让我觉得非常诧异，感觉好像是两边约好了一样。</p>



<p class="wp-block-paragraph">民主党说：“我们也得走一些好看的数据。”到共和党说：“我们也不能让大家掉以轻心。”一旦大家觉得稳赢了，可能就不出来投票了，所以一定要让大家有危机感。因此，双方配合起来，给大家看了一个势均力敌，甚至在很多的州里边，哈里斯还领先的这样的一个民调结果出来，最后让大家担惊受怕了一整天，特别是到11月5号的时候。但最终呢，有惊无险，川大统领还是上台了。这个过程我们就不去详细分析了，因为你按阴谋论的方式，这个事就没完没了了。</p>



<span id="more-1695"></span>



<p class="wp-block-paragraph">我们来讲一讲，靠关税解决问题的川大统领，是否真的智慧？这真的是一种很好的方式吗？其实我们要思考这样的一个问题：市场这种东西到底是一个怎么运作的方式？其实很多人都在去解释说，哎呀，美国给中国商品加关税，中国的GDP会下降多少，美国的GDP会下降多少，或者是两边的日子都不好过。</p>



<p class="wp-block-paragraph">也有人说，哎，我们不去加关税，我们去做补贴，我们去限制出口，或者做一些这样的事情，是不是OK？大家要注意，市场不是一个静态的。刚才所有分析这些方式的人，都是把市场作为一个静态的市场来去看待的。当然，他们有的时候也投机取巧，他们说什么呢？说这个关税一旦增加了以后，短期之内这个商品的价格会上涨，人民的生活水平会下降。他们隐藏了长期的可能会进行调整，或市场可以自动适应这种新关税的可能性。他们在里头加了一个短期之内，但我们要知道……</p>



<p class="wp-block-paragraph">市场本身是一种动态平衡的状态。政府提出各种各样的政策以后，商人们会在市场里重新找到平衡。这个最忌讳的是什么呢？最忌讳的是微调。事无巨细，哪样都想动一下，这个是非常非常麻烦的。这会打破市场自己动态平衡、动态调节的节奏。就跟很多人去吃益生菌似的，说这个益生菌吃到肚子里以后，我们就补充了很多的有益菌群。实际上去测试的是什么呢？就是你吃完益生菌以后，它会首先把你肠胃里的菌群整个破坏掉。如果没法建立起新的益生菌群的话，这个肠胃就会失调。</p>



<p class="wp-block-paragraph">怎么说呢？大政府喜欢事无巨细，东弄一下西弄一下，而小政府一般喜欢处理的方式就是，我只动一下，然后等着市场整个自己去调整。这样其实才是一个真正有智慧的方式。这也是叫奥卡姆剃刀原理吧。在面对市场的时候，如果没有必要，千万不要增加乱七八糟的东西。稍微动一下，等着自己动。</p>



<p class="wp-block-paragraph">在这里呢，我们举一个案例。咱们今天先不讲汽车，先讲一个别的案例——芯片法案。芯片法案其实就是一个大政府的玩法。我想要芯片了，那我怎么办？向美国的芯片企业发补贴，向台湾的芯片企业发补贴，到美国来建厂吧。这就是大政府玩法。包括咱们中国国内的各种电动车补贴、电池补贴，其实都是这种大政府玩法。</p>



<p class="wp-block-paragraph">这个里头，请让我们先为伟大的英特尔公司默哀5秒钟。为什么呢？英特尔其实是芯片法案最大的受益者。在500多亿美金的芯片法案里头，他大概能够得到85亿或者更多一些，再加上其他的各种投资减税的政策，所以他可以得到非常多的钱。因为所有造芯片的这些公司里头，只有英特尔是根红苗正的美国公司，所以他一直在努力地找政府要这笔钱。但是呢，直到目前为止，芯片法案的前期是英特尔没要到手。为什么呢？因为英特尔在奥巴马时期其实已经干过一次了。他在美国建了芯片厂，但是因为芯片卖不掉，所以厂房是长期空置的。等过了很长一段时间以后，发现芯片可以卖掉了，他才去把机器从阿斯麦拉回来，开始生产芯片。</p>



<p class="wp-block-paragraph">如果芯片卖不掉的话，他这个机器还会停产。拜登有芯片法案了，英特尔又把这个厂房盖起来了，然后跑到国会去要钱。国会说：“我要万一把钱给你了，你又劣迹斑斑地把这个厂房盖了，然后不把机器拉回来，不给我生产这玩意，我不就亏了吗？这不划算呀。”</p>



<p class="wp-block-paragraph">而且英特尔现在自己的状态又非常不好。高通都提出收购邀约了。在八月份的时候，在他公布上一季财报的时候，市值一度跌到了千亿美金之下，只剩下了810亿美金。但是最近呢，稍微缓了一点，1,131亿美金。你想想，另外一个芯片巨头英伟达，3.6万亿美金，这个是差得多大的一个数据。</p>



<p class="wp-block-paragraph">当然了，现在川大统领上来以后，英特尔可以去做空了，接着往下跌。为什么他这钱拿不着了？前面政府或者说国会就不敢把这钱给他，怕被骗，因为他前面干过这种事。另一方面，你自己业绩又不好，真拿了钱了以后，你盖了工厂，拉了积蓄回来，你把芯片造出来，你卖不掉咋办？这事算谁的？</p>



<p class="wp-block-paragraph">这是一方面。另一方面呢，现在其实虽然川大统领还没有就职，但是应该是众议院已经是共和党的了。共和党已经有众议院的议长，他上来说：“这个不划算，我应该把这个芯片法案直接废掉。”这不给你钱了，这给你了以后，你最后也造不出芯片来，或者你造了你也卖不掉，这实在是非常不划算的一个事情。</p>



<p class="wp-block-paragraph">如果把芯片法案换成川普的这种关税会怎么样？咱比较一下，芯片法案是花钱，政府补贴给钱，他没有办法改变整个的供应链。你新英特尔就算把芯片造出来了，你打算把芯片卖给谁呢？你还是得卖给中国厂商，卖给韩国人，卖给台湾人。那这些人为什么不从台积电买？为什么不从三星买？为什么要从你那买呢？</p>



<p class="wp-block-paragraph">你造出来的这个芯片，品质又没有人家好，良品率又没有那么高，还很贵。我干嘛上你那去定制芯片？真不划算。所以他没有办法去改变供应链，新建的工厂没有订单，就只能闲置。那么为什么这些大政府还会去搞芯片法案这种东西出来呢？其实大家都是心知肚明的，就是想去骗这笔钱。</p>



<p class="wp-block-paragraph">最后呢，只能是睁一只眼闭一只眼，让有关系的人能够把钱骗走。这就是芯片法案大政府干的活。但换一种方式，关税了。就比如川大统领上来，他玩关税，那他怎么弄呢？他政府收钱，我不给你钱，我要收一笔钱进来。从境外运向美国的芯片都会变得很贵，不划算了。如果想在美国去销售一个更便宜的设备，那只能是在美国本土去造芯片，等于把整个供应链结构给改了。你就必须要在美国建工厂去生产，而且它让这件事情变得划算。</p>



<p class="wp-block-paragraph">你像前面，甭管是英特尔还是台积电，在美国盖了工厂以后，它都不生产。为什么？我生产了以后卖不掉。你在美国生产的芯片，一定是比在台湾生产的贵的，甚至可能一些低制程的芯片，它比在大陆生产都贵。而且品质一开始肯定是比较差的。在这样的情况下，他就先搁那，搁着，我先把补贴要到手再说。</p>



<p class="wp-block-paragraph">现在呢，等于芯片法案发了，但是钱一个都没发，现在是这么一个状态。那么有了生产动力，然后下面有了生产能力的公司，就会跑到美国去建工厂。像台积电，像Intel，它就有可能真的去建一个工厂去生产这些芯片，它就会变得划算起来。就算不在美国建工厂，他们也会将芯片的利润留在美国。</p>



<p class="wp-block-paragraph">这什么意思呢？芯片大家想英伟达挣的多，还是台积电挣的多？肯定是英伟达挣的多嘛，3.6万亿美金的公司，现在市值第一。他一定是设计最挣钱。那只要是说我设计在美国设计，那我在台湾生产，在大陆生产，在任何地方生产，那我再弄到美国来，我交税，我只需要交生产那部分的税就可以了。</p>



<p class="wp-block-paragraph">你比如说英伟达，委托台积电在台湾生产一堆芯片，比如说H100，一块芯片4万美金，5万美金。台积电说我这个加工费值2,000美金，剩下的48,000美金都是您的设计费。那他只需要为加工费这个2,000美金交税就完了。那个设计费本来就是美国人挣到了，他就不用再交税了，他就可以来这样处理。</p>



<p class="wp-block-paragraph">那么商人呢，就会根据利益自行去选择应对的方法。所以小政府一般使用这种方法，他没有人惦记在里头贪钱。</p>



<p class="wp-block-paragraph">他也不允许在里头贪钱，那干脆就是我收一笔关税，大家在里边随便玩就好了。现在呢，趁着川大统领还有俩月上台，最近的新形势是什么？海运爆仓。什么叫海运爆仓？就是所有的码头堆满了东西，准备拿集装箱把它运走。这是为什么？第一个，圣诞季快到了，圣诞季的时候，全世界的人民都要买东西。然后另外一个呢，再过俩月川大统领上来就要加关税了，那大家肯定趁着这个时候，抓紧的把买卖做了呀，把这个东西都运出去。</p>



<p class="wp-block-paragraph">其实在中国Q3，咱们的整个的出口数据是非常难看的。咱们当时的就讲说欧美的消费不行，不好好买东西了。但川大统领一上来以后，赶快买，赶快再不买了，川大统领加税了，咱现在趁着便宜都买点。现在所有的海运都爆仓了，在9月份、10月份的时候，码头上都堆着空集装箱，没东西运。很多货人都停在那，但是川大统领一上台了以后，疯了，说赶快把东西都运到美国去，趁着没加税之前。</p>



<p class="wp-block-paragraph">咱们讲到这了，后边汽车该怎么办？汽车产业链应该如何迁移？这件事情呢，还是要看马斯克跟特斯拉的供应链到底是怎么移动。大家照着他这样移，就没有什么大毛病了，因为毕竟他是第一功臣嘛，帮着川大统领上了台了，马上就要建这个什么真章的时候了，你不能把马斯克的后路断了呀。所以马斯克怎么挪，大家照那个方式去挪就行了。</p>



<p class="wp-block-paragraph">第一个，马斯克现在要求所有供应链厂商离开台海两岸，避免台海两岸变成唯一的生产基地。应该是昨天的最新消息，首先对于台湾的供应商，甭管是特斯拉的还是Spacex的，所有位于台湾的供应商必须搬离台湾，这个没什么好说的，马上搬走。这个其实也很简单了，台湾是没有特斯拉的工厂的，所有的供应商，你必须跟着工厂走。</p>



<p class="wp-block-paragraph">原来你还可以比如说在台湾造出一些东西，运到大陆来去使用，现在就别费劲了，就搬走就完了。所有台湾的有40多家工厂必须搬离台湾。然后大陆的供应链，大陆的供应链呢，你该给上海工厂供货的这部分，你只能在大陆生产，不能搬到其他地方生产去，这个没什么好说的。</p>



<p class="wp-block-paragraph">但是，必须在离开台海两岸的地方设置新工厂。你不能说我就在这生产，其他地方我没有了，这个不允许。我以后不采购你的，你必须是在大陆给上海工厂供货的，同时再到墨西哥去给我的墨西哥工厂生产。你要在墨西哥重新建工厂。这是马斯克对台海两岸的供应链提出的要求。</p>



<p class="wp-block-paragraph">现在已经有非常多的人跟着特斯拉一起去墨西哥建工厂去了。当然了，这个呢是为最坏的可能性在做准备。什么叫最坏的可能性？就是两岸可能会一起受到非常长时间的禁运。特斯拉不能为这事死掉，SpaceX还要奔赴火星呢，不能为这个事死掉。所以大家赶快搬家，这是马斯克提的要求。</p>



<p class="wp-block-paragraph">因为一旦台海有事的时候，最大的可能性是什么？最大的可能性就是一起封锁，这个没有办法。它不像乌克兰似的，有一头还有一个很长的陆地边境，然后另外一头是很强大的欧洲，还可以不停地把东西运进去。台湾呢是在海上，咱们自己也算有两条航母了，有一堆的战斗机每天绕着台湾岛飞来飞去的。所以要封锁呢，肯定就一封一起封掉了。</p>



<p class="wp-block-paragraph">大陆到底能不能打下台湾来，咱不知道。这个就算打下来了，也很难被国际社会所承认。在这样的一个情况下，那就封着呗，像现在俄罗斯入侵乌克兰似的，一下封三年。马斯克现在要做出这样的这个动作来，告诉你说：“唉，你没法拿捏我。”实际上干了这么个事，这是马斯克的运作方式。</p>



<p class="wp-block-paragraph">咱们呢后边分四种不同的企业来讲一讲其他的汽车企业应该如何进行产业链的迁移。首先呢，咱们先讲一下川普的关税政策。第一个是给全世界所有的商品加10%关税，任何商品去美国加10%关税，这个有点像咱们收增值税，反正你进来就收10%。中国的商品关税是60%起步，然后接着往上涨。</p>



<p class="wp-block-paragraph">其实拜登政府已经设置了一些关税，比如咱们的电动汽车是100%关税，光伏太阳能板是50%的关税。但大家注意没有，这两样东西其实都是马斯克的产品。马斯克在上海生产特斯拉汽车，马斯克的Solar City也使用大量的光伏板。</p>



<p class="wp-block-paragraph">马斯克原来SOLO city是在美国很多的超市或者这种大的办公楼上面去装这个太阳能板，全都是中国生产的。这个基本上是奔着马斯克去的。但是现在呢，川普说了，如果谁在美国雇佣大量的工人，你可以豁免这个税。如果马斯克说：“我准备把大量的中国太阳能板弄到美国来销售，那你看我在美国雇佣了这么多工人，那你这个税豁免了。”这是可以干这个事了。</p>



<p class="wp-block-paragraph">所以咱们来分四个部分讲讲，咱们怎么办。第一个，中国的新能源企业该怎么办？中国的新能源车企呢，可以去投奔贾跃亭了。为什么？贾跃亭其实在七八月份的时候就在讲，说我已经具备独特优势了。我在美国整个把造整车这条路都走通了，所有该做的批文，所有该做的手续我都做过了。哪个地方有什么问题我都摊过了。任何人想在美国销售汽车的时候，你来找我，我帮你把这事弄完。然后呢，你就可以跑到我这来造汽车，整车最后在美国生产，在美国可以直接把所有的手续、所有认证都给你做完。</p>



<p class="wp-block-paragraph">甭管他卖了几辆车吧，但是他把所有手续都跑遍了。现在贾跃亭应该是已经可以开心的乐了。就算是买北国倒闭工厂改建的话，其实在美国造工厂也是很慢的，四年未必能够投产。但是呢，将设计中心迁移到美国去，将汽车的主要利润搬迁到美国去，这个事呢还是可以做的。</p>



<p class="wp-block-paragraph">比如说我们经常使用的一种产品，上面写的叫“加州设计，中国生产”，这样的产品如果到美国去，我就把中国生产那部分的税交了，不就完事了吗？那设计这部分的利润我就留在美国，就不用交税了。而这个“加州设计，中国生产”的这个产品叫iPhone，他们就是这么干的。那么也是可以走得通的这条路，所以中国车企就准备往美国搬吧。</p>



<p class="wp-block-paragraph">当然了，他们搬到美国会很贵，那怎么办呢？可以把生产中心搬到墨西哥去，将涉及市场、广告相关的这种成本中心迁移到美国去，这个应该是最优解了。当然，墨西哥前面建立的汽车厂、汽车配件厂呢，其实并没有那么顺利了，因为墨西哥政府自己其实并不是那么积极。墨西哥政府到底是为了什么去服务的？</p>



<p class="wp-block-paragraph">咱们不知道，但是呢，很多的墨西哥工厂现在也在慢慢地建起来。毕竟，川普要求墨西哥管好非法移民，否则对墨西哥产品征税。那你干脆也甭过来了，你在墨西哥的工厂里，在汽车厂里上班吧。你也不用走线了，这个没准会在未来形成一种解决方法。中国的新势力就可以走这条路走通了。</p>



<p class="wp-block-paragraph">所有的供应链企业，就是我不造整车的，我是TIER one、TIER two的这种供应链企业，跟着主机厂走就行了。主机厂去哪你就去哪。就是咱们管造整车的，这个工厂叫主机厂。台湾没有主机厂，所以就离开就行了。因此，特斯拉、SpaceX都要求所有的台湾的工厂撤离。主机厂肯定是跟着市场走的，哪个地方卖车卖得多，我就在哪个地方造整车。</p>



<p class="wp-block-paragraph">全世界卖车卖得最多的前三名，大家知道在哪吗？2023年，第一名是2,300万辆车卖掉了，乘用车销售，这个地方叫中国；第二名是1,545.7万辆车，这是美国；第三名是1,284.8万辆车，是欧盟。这就是全世界卖汽车卖得最多的这三个地方。</p>



<p class="wp-block-paragraph">所以你看，马斯克的工厂是在上海、在柏林、在墨西哥，当然在美国也有一些工厂。车厂主机厂一定要奔这去，三大汽车生产基地就是中国，这个没什么好说的，因为我们卖掉2,300万辆车嘛，谁也不愿意放掉这块市场。美国跟墨西哥算是一对，因为你在美国生产的贵，到墨西哥生产的就变得便宜很多嘛。美国人也不傻，也愿意买便宜货。</p>



<p class="wp-block-paragraph">德国跟土耳其其实也是一对，德国特斯拉工厂是在那的，很多的配件厂，包括一些像比亚迪，很多这样的工厂都在土耳其。为什么？那便宜，而且那离欧洲近，直接上火车就拉走了。这个汽车这种东西，你要装到这种滚装船上去，全世界拉着满处都跑，一般是不划算的。</p>



<p class="wp-block-paragraph">所以呢，基本上就这三个地方，配件厂就奔这仨地方走。你在中国、在墨西哥、在土耳其，你不一定跑到美国，跑到德国去。在这仨地方都是可以的。所以供应链必须向这三个地方迁移。现在呢，是中国供应链过剩，咱们的东西太多了，所以呢，现在就是中国的供应链。</p>



<p class="wp-block-paragraph">在快速往墨西哥和土耳其迁移，这是供应链企业再往后的第三个选择。日本和欧洲的车企怎么办？那你说他们怎么来应对这个关税问题呢？怎么应对新的电动车风潮？这样的问题呢，他们现在的应对方式是这样的：在中国养蛊练兵。就是我在中国，我不能放弃这个市场，我还得在中国生产和销售电动车，即使赔钱也不退出中国市场。我就是要在这，跟你们这些中国新势力打来打去的。打完了以后我就有战斗力。你跟中国新势力战斗了，完了以后才有机会再去挑战特斯拉吗？要不然你挑战不了他。</p>



<p class="wp-block-paragraph">咱们现在每天都是重新势力，围剿特斯拉这样的一个态势。所以他们还是要在中国做。这两天又出了一些新闻，比如说奥迪启用了新的商标Audi，他把这四个圈去了。干嘛呢？就生产电动车，在中国生产，用华为的系统。生产完了以后在中国销售。如果能够在中国占有一席之地，那咱就把这车拉回去呗，再弄到欧洲，弄到美国，再去生产再去销售，不就完事了吗？</p>



<p class="wp-block-paragraph">所以他们还是要在这折腾的。而且呢，他一旦是说要到美国、到欧洲或者到墨西哥去生产这些奥迪汽车或者丰田汽车的时候，他可以继续使用特斯拉在中国建立起来的产业链，快速迭代出自己的车型来。这是他们现在努力在做的事情。现在丰田在中国销售的电动车使用的是中国的车机系统，他们自己投资了一家，他们也有一部分车直接用的华为的。奥迪用的华为的，大众则是直接买了小鹏的技术。</p>



<p class="wp-block-paragraph">其他的很多欧美车企、日本车企都是在中国找合作伙伴。而且他们大量投资和收购中国的汽车软件企业以及软件设计师。他要把这块板补上。因为大家知道，特斯拉是不需要这事的，他所有东西都自研的。但是日本车企、德国车企是没有这个能力的。所以干脆说，你们都做得差不多了，还便宜买下来吧。而且这些日本车企、德国车企本来就在美国有大规模的生产基地。我记得原来讲这个Figure01那个机器人的时候，他们就是跑到美国的宝马工厂里去实习的，机器人上岗了已经。所以他们已经直接可以申请。</p>



<p class="wp-block-paragraph">减免相关的关税了。那么，将中国的研发团队搬到美国，或者将利润留在美国，可能也是他们未来的一个选择。那是三个了，第四个是什么呢？第四个可能在川普的关税政策生效之后，会诞生大量的美国新势力。现在都是中国新势力，PPT造车造完了以后，真的把车造出来以后，这么多的品牌人员、设计人员、营销人员都往美国聚集了。他们要把利润搬到美国，这部分不要交税了。</p>



<p class="wp-block-paragraph">这些人去美国，去了美国以后就总有离职的，总有人混不下去的。这些人就会去创业，这些人呢，就会快速地利用已经整合好的供应链，而且是弹性供应链，直接把新车造出来。这些人再设计出来的新汽车，就可以直接拿这些供应链去生产了。那么，PPT造车就不再是梦了。像富士康做的Model B，就等着大家呢。你看，我们有生产能力，你只管拿出图纸来，我就给你把车做出来。这个事是没有任何问题的。而且，如果马斯克开放了FSD，因为马斯克一直承诺要把FSD开放出来给别人用，那么可能大量的美国新势力就直接崛起了。</p>



<p class="wp-block-paragraph">这个可能是一些新的方向。那你说中国政府难道就看着就不动吗？这个肯定不会了。中国政府呢，按道理说应该是会对美国的商品进行反向制裁。甭管这个日子过得怎么样，生意怎么好不好做，反正面子咱不能丢。美国一旦是开始给中国的商品加税，我们呢，一定是会给他加回去的，包括农产品和一些其他的美国商品，都会加税加回去。</p>



<p class="wp-block-paragraph">短期内呢，我们可以靠俄罗斯的农产品和工矿原料，可以搞定这个事情。长期的话，就要看咱们一带一路到底好不好使。如果下边换民主党了咋办？美国他要选的呀，下一届有可能会换回去。民主党呢，属于这种大政府，或者说至少比共和党的政府大吧。他们大概率呢，会在当前的关税政策基础上继续画蛇添足，然后修修补补。大政府一定是惦记说钱在我手里，然后呢，我去花。因为你只有策划花钱的时候，才有机会上下其肉。你收钱的时候，收完了以后到国库里了，它变成了一本很干净很透明的帐，你是没有办法去上下其手的。</p>



<p class="wp-block-paragraph">所以到民主党的时候不会有大的改变，但是他还是会想办法再补贴点什么，再把一些钱落落手里。那么未来的汽车市场格局会是什么样的呢？设计品牌营销等高利润环节，为了躲避关税，可能就会去美国。这是一个比较现实的问题。主机跟供应链厂一定会跟着市场走，哪个地方卖的车多就奔哪里去。你说这个供应链全都搬离中国，这不用想，咱卖2,300万辆车的，这个是死数。而且那是2023年，2024年肯定比这数还高得多，因为现在卖车已经卖疯了。</p>



<p class="wp-block-paragraph">我前两天去这个特斯拉商场里体验店，他们就告诉我说，你现在交钱，在这也得等俩礼拜。特斯拉也得排期，你不能说马上交了钱马上把车开走。我说那好吧，他这个也是不那么容易交付的。所以今年的这个车在中国的销售量一定是比去年高非常多的一个数字。那么主机厂跟供应链厂在中国一定会留一套，美国呢应该会出现大量的造车新势力。未来在美国你想造出一款新车来，可能会变得非常容易。</p>



<p class="wp-block-paragraph">美国会出现各种各样的实验型工厂和这种黑灯工厂，就是什么机器人那种工厂会在里面。所以虽然制造业会回流美国，但是真的不一定会给万斯的老乡们更多的就业机会。你像特斯拉已经把擎天柱造出来了，准备明年下场了。Figure 01的那个机器应该明年也可以下场。所以就算是这些工厂去了美国，也不会增加太多就业。</p>



<p class="wp-block-paragraph">中国、墨西哥、德国、土耳其应该会成为新的汽车产业中心。这就是未来的一个汽车格局。当然了，中国肯定也看到了，哎呀，汽车这条路好像是被美国封住了吧，咱们以后做航空吧。所以呢，咱们在航空工业上努力发力。有一家公司被普遍看好，2000年就创立了，做航空与空中交通管理软件的相关业务，也做人工智能、VR、AR，还做飞行模拟和训练。最近一个月股价暴涨了100%。创始人是一个老教授，叫尤志胜，是四川大学的一个老教授。这个公司第二大股东呢，就是四川大学。这个公司的名字叫川大致胜，当然今天好像这个股票跌了。</p>



<p class="wp-block-paragraph">所以，我们未来可能向航空业发展。这就是咱们今天讲的第一个故事。最后，用一个开心的笑话跟大家结束一下。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>字节跳动终于迎来懂王！未来会怎样？！🤔✨在美国和全球，TikTok会沿着抖音的路径，继续高歌猛进</title>
		<link>https://lukefan.com/2024/11/10/%e5%ad%97%e8%8a%82%e8%b7%b3%e5%8a%a8%e7%bb%88%e4%ba%8e%e8%bf%8e%e6%9d%a5%e6%87%82%e7%8e%8b%ef%bc%81%e6%9c%aa%e6%9d%a5%e4%bc%9a%e6%80%8e%e6%a0%b7%ef%bc%9f%ef%bc%81%f0%9f%a4%94%e2%9c%a8%e5%9c%a8/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Sun, 10 Nov 2024 00:37:48 +0000</pubDate>
				<category><![CDATA[字节跳动，故事多]]></category>
		<category><![CDATA[AI技术]]></category>
		<category><![CDATA[Live Goodbye]]></category>
		<category><![CDATA[Meta]]></category>
		<category><![CDATA[TikTok]]></category>
		<category><![CDATA[互联网巨头]]></category>
		<category><![CDATA[互联网经济]]></category>
		<category><![CDATA[产品创新]]></category>
		<category><![CDATA[产品策略]]></category>
		<category><![CDATA[企业价值]]></category>
		<category><![CDATA[企业创新]]></category>
		<category><![CDATA[企业形象]]></category>
		<category><![CDATA[企业战略]]></category>
		<category><![CDATA[供应链]]></category>
		<category><![CDATA[全球影响力]]></category>
		<category><![CDATA[全球竞争]]></category>
		<category><![CDATA[创新能力]]></category>
		<category><![CDATA[利润增长]]></category>
		<category><![CDATA[利益分配]]></category>
		<category><![CDATA[品牌价值]]></category>
		<category><![CDATA[品牌发展]]></category>
		<category><![CDATA[商业利益]]></category>
		<category><![CDATA[商业前景]]></category>
		<category><![CDATA[商业变革]]></category>
		<category><![CDATA[商业拓展]]></category>
		<category><![CDATA[商业智能]]></category>
		<category><![CDATA[商业模式]]></category>
		<category><![CDATA[商业生态]]></category>
		<category><![CDATA[商务合作]]></category>
		<category><![CDATA[国内市场]]></category>
		<category><![CDATA[国际市场]]></category>
		<category><![CDATA[国际布局]]></category>
		<category><![CDATA[增强现实]]></category>
		<category><![CDATA[增长战略]]></category>
		<category><![CDATA[媒体影响]]></category>
		<category><![CDATA[媒体策略]]></category>
		<category><![CDATA[字节跳动]]></category>
		<category><![CDATA[客户价值]]></category>
		<category><![CDATA[市场份额]]></category>
		<category><![CDATA[市场增长]]></category>
		<category><![CDATA[市场洞察]]></category>
		<category><![CDATA[平台活力]]></category>
		<category><![CDATA[广告]]></category>
		<category><![CDATA[广告收益]]></category>
		<category><![CDATA[应用发展]]></category>
		<category><![CDATA[必要信息]]></category>
		<category><![CDATA[懂王]]></category>
		<category><![CDATA[战略规划]]></category>
		<category><![CDATA[技术创新]]></category>
		<category><![CDATA[投资机会]]></category>
		<category><![CDATA[投资策略]]></category>
		<category><![CDATA[抖音]]></category>
		<category><![CDATA[政策分析]]></category>
		<category><![CDATA[政策机遇]]></category>
		<category><![CDATA[数字化转型]]></category>
		<category><![CDATA[数字平台]]></category>
		<category><![CDATA[数字广告]]></category>
		<category><![CDATA[数字经济]]></category>
		<category><![CDATA[数字营销]]></category>
		<category><![CDATA[数据分析]]></category>
		<category><![CDATA[数据安全]]></category>
		<category><![CDATA[数据整合]]></category>
		<category><![CDATA[数据驱动]]></category>
		<category><![CDATA[新兴市场]]></category>
		<category><![CDATA[智能推荐]]></category>
		<category><![CDATA[未来布局]]></category>
		<category><![CDATA[流量分配]]></category>
		<category><![CDATA[流量变现]]></category>
		<category><![CDATA[流量策略]]></category>
		<category><![CDATA[流量红利]]></category>
		<category><![CDATA[海外市场]]></category>
		<category><![CDATA[海外收购]]></category>
		<category><![CDATA[消费趋势]]></category>
		<category><![CDATA[物流服务]]></category>
		<category><![CDATA[用户参与度]]></category>
		<category><![CDATA[用户基础]]></category>
		<category><![CDATA[用户数据]]></category>
		<category><![CDATA[用户时长]]></category>
		<category><![CDATA[用户活跃度]]></category>
		<category><![CDATA[用户生成内容]]></category>
		<category><![CDATA[用户留存]]></category>
		<category><![CDATA[用户行为]]></category>
		<category><![CDATA[电商]]></category>
		<category><![CDATA[电商增长]]></category>
		<category><![CDATA[盈利模式]]></category>
		<category><![CDATA[短视频]]></category>
		<category><![CDATA[社交媒体]]></category>
		<category><![CDATA[社交影响]]></category>
		<category><![CDATA[经济影响]]></category>
		<category><![CDATA[行业分析]]></category>
		<category><![CDATA[行业前景]]></category>
		<category><![CDATA[行业趋势]]></category>
		<category><![CDATA[跨国扩展]]></category>
		<category><![CDATA[跨境交易]]></category>
		<category><![CDATA[跨境电商]]></category>
		<category><![CDATA[金融服务]]></category>
		<category><![CDATA[马斯克]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1680</guid>

					<description><![CDATA[大家好！今天我们来聊聊字节跳动和懂王的故事！啊啊啊啊！真的太激动了！懂王终于当选了，不仅马斯克高兴，字节跳动的小伙伴们也纷纷露出了笑容！🤩

为什么呢？因为在拜登任内，他们可是面临着巨大的压力哦！要么卖掉股份，要么就准备被封！现在，懂王来了，真是“守得云开见月明”的完美时刻！☀️

据说字节跳动的表现一直非常强势，啊，那份上半年730亿美金的财报简直让人目瞪口呆！🚀没错，已经开始赶超Meta了！虽然境内的增速稍微放缓，但只要用户活跃度还在，未来真的太有希望了！✨

字节跳动最近的策略更是特别！“要流量，不要销售额”！🤯是的，你没听错！他们通过鼓励便宜商品的销售来获取用户流量，这让用户们一边刷视频一边买买买，简直太聪明了！而现在，他们在境外的TikTok收入也是一路飙升，170亿美金的成绩真是一骑绝尘！💪💸

今后，字节跳动与懂王的结合，将会擦出怎样的火花呢？未来的发展瞬息万变，但我相信，字节跳动定会继续保持领先地位，甚至有机会借助懂王的东风，乘风破浪！🌊🚢

大家快来关注字节跳动的动向吧，别忘了点赞、转发，还有更多精彩内容等着你！❤️✨

字节跳动终于迎来懂王！未来会怎样？！🤔✨在美国和全球，TikTok会沿着抖音的路径，继续高歌猛进。

字节跳动在懂王上台后迎来了新一轮的政策机遇，拜登时期对TikTok施加的封禁阴霾似乎暂时散去。字节跳动通过其全球平台，如抖音和TikTok，以惊人的用户活跃度突显市场竞争力，尤其是其独特的“要流量，不要利润”策略，提升了用户留存和参与度。在国际市场上，字节跳动成功地以广告业务为主，继续增长，其海外收入达到170亿美元。目前，该公司正在积极拓展电商和金融服务领域，并投资于AI技术，预计未来将重新定义全球数字经济版图。字节在这场与Meta、X（前Twitter）的竞争中，将平台优势与创新能力结合，努力在全球市场中占据一席之地。
]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="字节跳动终于迎来懂王！未来会怎样？！🤔✨在美国和全球，TikTok会沿着抖音的路径，继续高歌猛进。" width="900" height="506" src="https://www.youtube.com/embed/FOiHvAqic4k?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">字节跳动守得云开见月明，等来了懂王。大家好，这里是老范讲故事的YouTube频道。说这几天懂王当选了，谁最开心？除了马斯克之外，估计字节跳动的人应该也在其列。为什么？因为前面拜登政府是要封禁他，把字节跳动放在了一个没有任何回旋余地的地方，就是要么你把股份卖掉，成为完完全全的美国公司，要不然就直接被封禁，等于退无可退。</p>



<p class="wp-block-paragraph">但是现在终于算是天晴了，太阳出来了，懂王来了。要想被挽救，一定要自身过硬。你比如说，我们盼着懂王拯救一下，你说我自己的数据很拉胯，完全没法看，这个对于商人来说是没有任何价值和意义的。所以打铁还需自身硬。</p>



<p class="wp-block-paragraph">字节跳动上半年的财报算是一骑绝尘，在国内已经完全没有对手了。不要去跟这种大国企、大央企去比，跟所有的互联网企业比，它已经算是一骑绝尘跑掉了。在全球范围内的话，它的收入已经开始直追Meta了。上半年字节跳动收入是730亿美金，Meta上半年是755亿美金，所以这个直追是真的追得很近的。而且年底的话，没准还能再往前蹭一蹭。</p>



<span id="more-1680"></span>



<p class="wp-block-paragraph">现在的字节跳动，在国内的收入已经开始放缓。今年上半年的整体增长了35%，境内收入的增长呢，要稍显疲软一些，只增长了28.89%。其实你对一个互联网企业来说，你有两位数的增长，就是10%以上的增长，已经算是还不错了。如果说降到两位数以下，我们就不认为你是互联网企业了。但是对于像字节跳动这样的公司来说，28.89%这样的同比增长率，还不是一个很好的数字。为什么呢？因为这属于还没上市的独角兽，这种公司的增长一般都是在百分之三四十往上走的。</p>



<p class="wp-block-paragraph">为什么字节跳动在国内的增长放缓了呢？第一个是境内的经济还是没有那么好。现在虽然不太讲稳中向好了，但是依然不承认有大的系统性结构性的问题。其实很多问题你如果不承认的话，就很难把它解决掉。所以现在国内的所有商家只能是继续卷。在卷成这样的一个情况下，它依然可以增长，这就已经是非常不容易了。</p>



<p class="wp-block-paragraph">干了一个很奇葩的事情，它叫“要流量，不要销售额，不要利润”。什么意思呢？你正常来说，我是一个公司，我一定是要最大的利润，要挣最多的钱，要回报股东。很多人说呀，你们公司的slogan是什么？你们公司的目标是什么？讲得天花乱坠，但其实所有的公司只有一个目标，就是挣了钱回报股东。如果哪个公司说我们的目标不是这个，要么你是非盈利，要么你就是骗钱。</p>



<p class="wp-block-paragraph">但是呢，字节就反过来了，说我不要利润，甚至我也不要销售额，我就要单量。什么意思呢？就是它也是可以在后台调参数嘛。你在要利润的时候，那你一定是什么？要让利润最高的商品多展示、多销售，这样利润才能上去。你要销售额呢，你一定要把比较贵的商品多展示，要不然你说我卖一堆特别便宜的商品，那凑了半天，你这个销售额是很少的。而且便宜的商品卖得越多，你利润越低。为什么呢？不是说便宜的商品利润率就低，但你想，你每一件商品卖掉了以后，是有固定成本的，运维、合规、交付、快递什么的都是成本。</p>



<p class="wp-block-paragraph">你等于卖了一个5块钱的东西，哪怕你挣3块钱，你把那些成本摊掉了以后，没准会赔钱的。你卖了一个1万块钱的东西，哪怕说我只挣个500，这也就是挣了一个5%的钱，但贪完那些成本以后，你可能还是挣钱的。</p>



<p class="wp-block-paragraph">而现在，字节跳动搞了一个特别奇葩的事情，就是说我只鼓励销售的单量，至于你卖的便宜、卖的贵我不管你，卖的利润多少我也不管你，我就要单量。导致什么呢？所有在字节跳动平台上卖东西的人说：“哎，我们应该尽量卖便宜的东西，只有便宜的东西单量才能大嘛。”利润要低，价格要单价要低，甚至呢，很多东西我们要把它拆开了卖，大包装拆小包装去买，这样卖的话，字节才乐意。</p>



<p class="wp-block-paragraph">字节乐意有什么好处？他给你流量，他给你做流量倾斜。那你说这种玩法，是不是导致了他今年上半年在国内的收益增长放缓？是这样的。但是呢，这个玩法背后实际上是有阴谋的，不是随随便便就来的。你虽然收入变少了，收入的增长率变少了，收入还是上升的。</p>



<p class="wp-block-paragraph">但是，收入的增长率变低了。我们要看到一些数据，比如抖音。抖音有8亿用户，8亿用户不算多呀。腾讯的微信有10亿用户。对抖音来说，它是一个娱乐产品，而微信是一个人们生活中必不可少的工具。所以，抖音8亿用户，但8亿用户不算特别神奇的事情。</p>



<p class="wp-block-paragraph">神奇的在于，8亿用户里头有7亿日活。这是完全无法想象的一个数据。日活是什么？就是每天活跃的用户。中国一共有8亿用户，7亿都是日活。因此，它的用户活跃度极高。</p>



<p class="wp-block-paragraph">很多应用，你一看，哎，用户量很大，但累计安装时不去重的情况也很常见。因为很多算累计安装的时候不去重，一个人装10次就算10个。哪怕你去掉重复的累计安装，你有10个用户，但日活不一定有那么两三个，这才是一个正常的情况。</p>



<p class="wp-block-paragraph">但是像抖音这种，8亿用户，7亿日活，真是非常恐怖。但这还不是最恐怖的数据。最恐怖的数据是什么？单用户日活时长接近一小时。什么意思？每个日活用户刷抖音的时候，平均每天大概刷一个小时。这是非常非常吓人的。</p>



<p class="wp-block-paragraph">你说我这个日活很高，但你的用户每一个日活时长只有20秒、30秒，或者是10分钟。这跟日活时长一小时的差异在哪里？大家知道吗？你日活时长一小时，你有非常多的展示机会，有很多看广告的机会，很多形成交易的机会。如果单个用户的日活时长只有十几秒、二十几秒的话，你能看几条广告？你能有几次形成交易的机会？这之间是有巨大差异的。</p>



<p class="wp-block-paragraph">所以，抖音在国内的数据，整个字节跳动在国内的数据，都好得一塌糊涂。这就是通过刚才我们讲的，要销售的单量，不要销售额，不要利润造成的。为什么？我就是让你不停在我这刷。刷完了以后，哎，很便宜买一个吧。待会再刷，刷完了以后再买，哎，刚刚好像买过东西。嗨，没事，那个东西也不到几十块钱，再买一个也没什么关系。</p>



<p class="wp-block-paragraph">实际上，他们通过这种方式牺牲销售额、牺牲利润，在干嘛？抢流量、抢用户、抢用户时长。原来它可以花钱去买，你可以像华为去买，像OPPO、vivo、小米去买，这些流量现在已经没什么可买的了。</p>



<p class="wp-block-paragraph">所有的用户都已经转换完了。现在大家都是在用户有限的使用时长上去抢时间。如果你比如说我今天在抖音上买了一个5000块钱的东西，那我可能今儿我就不看了，或者再看到任何其他东西我就不买了。但是你看我今儿在抖音上买了一个20块钱的东西，没准刷刷刷我就又买了个20块钱的，或者再买了一个100块钱的东西，我就会一直刷下去。</p>



<p class="wp-block-paragraph">原来没准这些时间我就去逛拼多多、逛淘宝、逛京东去了。但是现在好了，反正没花多少钱，接着逛吧。我可能就大量的时间在抖音上就都消耗掉了。而这实际上是一个阳谋，就是用利润去换用户的使用时长。我少挣点钱，你在这多刷会，多买了点东西，没关系，很便宜，再买没事。这是抖音在国内干的活，也是现在的无奈之举吧。</p>



<p class="wp-block-paragraph">在境外那就是高歌猛进了，TikTok继续狂奔，海外收入170亿美金。也就是刚才咱们讲的730亿美金里头，有170亿是TikTok，同比增涨了60%，涨得是非常猛的。但是现在的TikTok收入还是非常非常保守的。为什么现在TikTok的主要收入是广告，而且是娱乐和媒体广告占主导地位？</p>



<p class="wp-block-paragraph">为什么说这样的数据就很保守呢？大家要注意，抖音在国内的主要收入是什么？是电商以及电商的广告。这才是主流最挣钱的。因为你打了半天广告，最终还是要变成交易的。如果没有办法在你的平台上变成交易，那你的交易转化率可能就有问题。大家就不会愿意去认可你的交易价值，或者广告价值，就比较难以被认可。</p>



<p class="wp-block-paragraph">但是如果你哪天电商走通了，雪球整个滚动起来了，就完全挡不住。因为我在这卖东西，我就要再去打广告，去推广我的这个账号、推广我的店铺、推广我的直播间。所有的这些用户，就会在这个电商模式的基础下，整个运转起来。这才是真正挣钱的方式。现在TikTok这个大钱还没开始挣呢，他就已经挣到170亿美金了。未来的话，TikTok应该会比抖音更挣钱。为什么？因为它用户量更大，而且用户的支付能力也足够强。</p>



<p class="wp-block-paragraph">欧美用户和日韩用户，这都是很有钱的用户，绝对比中国用户支付能力强。但是，唯一的缺陷是什么呢？就是欧美日韩这些地方的产品交付能力要比国内差一些，送快递什么的，这个要差一些。等着马斯克的RobotaXi，加上他的擎天柱无人送快递，等哪天这玩意成了以后，TikTok就可以再上一层楼。</p>



<p class="wp-block-paragraph">现在字节跳动说：“我自己的成绩足够好，懂王您上来了拉我一把呗。”前面要封禁TikTok的法令依然在，但是现在TikTok在起诉美国政府，而且这个案子也还在审理之中。现在懂王上来以后，至少这个案子再想去快速推动，就没有那么容易了。谁有这积极性跟懂王找不痛快呢？懂王已经讲了：“我们并不需要把TikTok干掉，如果把它干掉了以后，唯一受益者是Meta，他变成一家独大，这个事并不好。”这是懂王的原话。</p>



<p class="wp-block-paragraph">那么在这样的情况下，你一个案子就慢慢放耗着呗。拜登到退任之前的最后一天，到底能不能签个字，直接把这个正在审理之中的案子直接给他执行掉，现在应该就有很大的问号。而且拜登其实也没有必要在最后找这个不痛快，他也说了：“我们顺利做好交接就完事了，不再需要折腾什么其他事情了。”所以，TikTok应该算是逃过一劫了。</p>



<p class="wp-block-paragraph">那么懂王为什么不希望Meta一家独大呢？现在X是属于马斯克的，但是Meta这块的扎克伯格呢，就属于忠诚的不绝对，绝对的不忠诚这种人。马斯克属于绝对忠诚，站在懂王的那个演讲台上，上蹿下跳，挨着个的发钱，说：“你们赶快给懂王投票，投了票我给你钱。”这样的方式，把懂王真正的托举起来，所以这个绝对是最忠诚的手下了。</p>



<p class="wp-block-paragraph">但是扎克伯格不行，扎克伯格虽然也表态了：“哎呀，懂王被枪击了以后，这个照片让我看到了，感觉热血沸腾，这就是我崇拜的英雄。”但是他也表态了：“我们是中立的，不支持任何一个候选人。”这个是完全不一样的一个表态。那么你说，我已经有X，可以在Meta面前去竞争了，为什么还要再留一个TikTok呢？现在Meta在主要打短视频。</p>



<p class="wp-block-paragraph">X实际上也在主要打短视频。你现在到X的页面上去翻，到X的这种应用里边去翻，上面从上到下都是短视频。为什么一定要留着他？其实X在Meta面前是基本上不够看的。即使在大选的最后几天，X的活跃数猛增了数倍，但依然比不了。马斯克在大选胜利之后，专门晒了一张图说：“你看，我们X上的用户活跃度蹭蹭蹭就上去了。”但为什么比不了用户总量？X跟Meta是差着数量级的，这个差非常非常远。活跃用户的数字，那就差得更远，可能差两个数量级以上了。用户停留时长，这个也是非常大的差距。而用户价值的话，完全没法看。</p>



<p class="wp-block-paragraph">Meta的用户广告价值是非常高的。很多人都是在这个上面打广告，做电商，做各种各样的宣传和推广。因为我们以前做游戏公司的时候，每年都是大量的钱投在Meta上，甚至是我们可能每年销售额拿回来的钱，百分之八九十都交给Meta。就中国玩流量的这些公司，都是给Meta交钱的，剩下的可能是交给谷歌了。为什么交给谷歌的少？因为谷歌的广告系统相对来说不是那么好用，并不是说它效率差，只是工程师做的系统嘛，你需要学习更多的技巧，才可以把它用好。用好了也是很厉害的。</p>



<p class="wp-block-paragraph">Twitter在这一块，或者叫X这一块的用户价值，就已经非常非常打折扣了。为什么？就是原来X还是有一定的用户价值的，但是在马斯克上来以后，他被很多的广告联盟所抵制，大家不在这打广告，所以导致X现在的收益其实是要比原来收购之前差非常远的。很多人都说：“哎呀，懂王上台了，X是不是已经估值翻倍了？”他440亿美金收下来的，就算他估值翻倍了，也就是880亿美金。Meta呢，是上万亿美金的公司，而字节跳动是2,000亿美金的公司。而且我觉得字节跳动如果真的上市的话，奔万亿走是没什么问题，因为他的收入跟Meta已经上下差不太多了嘛。哪怕你达不到万亿，达到个七八千亿，这个事是没毛病的。这个X跟他们比实在差太远了，商业价值上也是完全没法比的一个事情。</p>



<p class="wp-block-paragraph">所以，TikTok才能够在这种媒体竞争中，或者叫社交媒体竞争中，平衡Meta的强势。当然，很多人说懂王上来，他应该按照商人的方式去思考问题，去处理问题，因为他是个成功的商人。那么，商人怎么处理问题呢？懂王您话下道来，字节跳动和TikTok在下头执行就完了。您说怎么办，我们就怎么办。你说我们应该把多少整合团队，或者审核团队弄到美国来，我弄来。你说我需要在美国怎么去建立这个审核的机房，怎么能够保证美国的数据不到外边去，这些东西我们需要怎么让第三方监督。你只要划开道了，我们就给你办就完了。</p>



<p class="wp-block-paragraph">桌子下边还有东西吗？一定有。但是，桌子下边的东西是不能摆在桌子上边的。这个什么意思？其实我们去看拜登政府给TikTok下的禁令，以及他们前面的所有听证会，你会感觉到疑邻人为贼。我怀疑你是坏人，有证据没？反正我就是怀疑你。你自己也没法自证清白。他就这样的一个状态，他把很多桌子下边的东西搬到上边来了。我因为怀疑你，我又没有什么证据，但是我心情不好，我就处罚你。</p>



<p class="wp-block-paragraph">这个事情商人一般不这么干活。桌子上面的东西就是桌子上面东西，桌子下面的东西就是桌子下面的东西，他不会弄混的。而且懂王阵营里头还有一个反华大将，谁？万斯。他这个副总统，但是万斯呢，是PayPal黑帮的代表。他后边很多的大佬都是原来PayPal的创始人，包括像马斯克这些人。这是一个圈子里的人，他们是完全明白互联网到底是怎么做互联网的。很多的推荐算法和这些东西到底是什么情况，他们是搞得明白的。他不像是民主党这帮人似的，说他其实不懂到底是怎么回事。他不懂了以后，他就开始恐惧，然后无限的往上拉升，说我们做到这样，我还是觉得不够，再往前坐一点，我还是觉得不够，搞成这样的情况。</p>



<p class="wp-block-paragraph">而且商人的处理模式里头，还有一个很重要的点是什么呢？就是政治服务于商业，而不是反过来。底层逻辑是商业逻辑，我们只要把生意做好了就可以了。如果生意受到阻碍了……</p>



<p class="wp-block-paragraph">再使用政治手段，比如价格、税什么这样的事情，我们最终还是要商业利益。反过来的话，我们的商业行为是要为政治服务的。一切先讲政治，这件事情呢，至少原来民主党他们搞的这一套东西，现在看并没有什么特别好的结果。</p>



<p class="wp-block-paragraph">现在对于字节跳动来说，下边该干嘛了？大力出奇迹的时刻到了。前面美团、拼多多都是属于中国比较喜欢干“大力出奇迹”的这些公司，现在该轮到字节跳动了。说上吧，甭想了。字节跳动的用户基本盘是稳定的，用户量在快速增长，活跃度非常高，高到简直是吓人的一个地步。活跃时长一小时，咱们看到这么多的应用里，大概只有Meta还有Instagram的活跃时长可以达到50分钟，其他很少有应用和服务的活跃时长可以达到这么长的时间。游戏可以，但是你只要不是游戏类的这种应用和服务，你的用户活跃时长能够到20分钟，就已经非常不错了。</p>



<p class="wp-block-paragraph">然后用户的商业价值极高，这是TikTok现在的一个基本盘。而且字节跳动，甭管是抖音还是TikTok，它已经把所有商业模式都打透了。那你说所有商业模式这么夸张吗？对的，广告这个商业模式打透了，文化娱乐，从动漫、小说、短剧、游戏也都做明白了。字节跳动可能就是游戏做的稍微差一些，他的游戏团队总是三天打鱼两天晒网，今天收购一团队，明天把他开了的这样的一个状态，游戏还没有太搞懂。但是小说、短剧都已经做得非常好了，而且这两块目前还没怎么出海呢，更不要说什么直播这些东西，直播现在也是可以出海的。</p>



<p class="wp-block-paragraph">这些之外还有什么？电商，包括直播电商、货柜电商、本地生活、团购，这些东西抖音都已经玩透了。而且在国内里头，他可以按着每一个行业里的老大上阵，厮杀三百回合。货架电商可以跟淘宝、头天集团干一仗，直播电商他就是老大，别人都惦记着干他呢。本地生活可以拉着美团下场厮杀一顿，团购也是如此。</p>



<p class="wp-block-paragraph">再往后还有什么挣钱的商业模式？金融。我都搞完电商了，那剩下的呢？借钱，像我们在抖音上买东西。</p>



<p class="wp-block-paragraph">为什么喜欢买，都是使用抖音的“先买后付”这种服务。一摁确认，这个东西就到手了。等你收到货了以后，再去付钱。这都属于抖音金融的产品。所有这些商业模式，他这样都打明白了。只要能够守住现在的用户盘，就可以把所有的这些挨着个都上一遍。广告现在已经有了，在TikTok上已经挣到钱了。其他的什么短剧、小说、游戏、电商、本地生活、团购、金融，挨着个的，在全世界让他们都见识见识，中国人都是过着什么水深火热的日子。</p>



<p class="wp-block-paragraph">那这个收益，绝对是可以翻着跟头往上涨的。而且字节跳动这几年各种降本增效，游戏团队干掉吧，教育团队干掉。除了他维护基本盘之外，剩下集中力量办的大事是什么？AI啊，全村最后的靓仔，一定是花足够多的钱、足够多的人、足够多的数据和足够多的显卡。他在中国买显卡，算是买的非常多的一个公司。而且呢，做人工智能的人，字节跳动的这个团队，应该也是国内最强的一个团队。就是甭管是从人员数量、素质、薪资，所有加在一块，字节跳动应该都是最强的，应该比百度还要强。他们从百度挖了很多人，而且也在里头投了足够多的钱去烧。</p>



<p class="wp-block-paragraph">而且呢，字节跳动还有一些优势，比如像OpenAI，他们都比不了的，是APP能力。APP能力那真的是全球第一，没有之一。你说我想做个应用，想做个APP，想做一些服务，这一块谁也比不上他，可以做出十几亿用户的应用来，而且可以让大家在里头玩的很开心的，这种团队，全世界没几个。Meta是可以，但其实我要告诉大家，Meta做的应用的品质跟字节跳动比起来，简直是太粗糙了。字节跳动那是中国公司，他可以上十倍的人在里头绣花，Meta哪有这功夫，哪有这人力。</p>



<p class="wp-block-paragraph">再加上什么，我们这一波干的叫AIGC，内容生成。但内容生成了以后，最大的社交媒体平台，最大的短视频平台，这个是谁？社交平台最大的是Meta，但是社交媒体平台最大的短视频平台，那是TikTok。大家能够生成最好的内容，视频、图片、文案、音乐，这些东西。</p>



<p class="wp-block-paragraph">你还是要往 TikTok 平台上放的呀。学得文武艺，要货卖帝王家。你不能说我自己生成了一大堆的视频，最后我没地放，我没地方挣钱去。那这个没有任何意义。哪怕是 OpenAI，它把 Sora 大模型做出来了，做得还特别好。那你 Sora 最后做出来的产品，还是得到 TikTok 上去放。原来 Sora 在比较热的时候，每个月每个礼拜就往那个 TikTok 平台上放新的视频，大家一看，哦，好漂亮好帅，都是这样的。</p>



<p class="wp-block-paragraph">你如果没有往那放的这个能力的话，那你咋弄？那你说其他的一些视频平台，他们没有这个能力吗？还真没有。YouTube 世界上最大的视频平台不是短视频，短视频最大的是 TikTok。最大的视频平台 YouTube 压根儿就没有这种工具。像我天天做 YouTube 还在用字节跳动加的剪映，每天在这剪东西呢。而剪映里头各种 AI 功能那叫一个完整，一堆的人给他做测试。因为剪映在很长一段时间，在美国的 iOS 排行榜上排第一。在 AI 的领域里头，字节跳动应该还是大有可为的。</p>



<p class="wp-block-paragraph">那么最后总结一下，字节跳动未来可期。赶到懂王上台了，终于把拜登老爷子熬过去了。未来的话就是大力出奇迹，使劲使劲往前走。而懂王团队的话，甭管后边是万斯背后的 Paypal 黑帮人员，还是说里边有马斯克这样的人，他们对于字节跳动这种智能推荐算法为核心的商业模式，就至少却魅了。他不会说看这玩意害怕，他知道这东西怎么回事，也可以比较清晰地来划清责任利益。</p>



<p class="wp-block-paragraph">那么在这个过程中，该在桌上搞定的事情，字节跳动肯定也都愿意配合给你搞定；可以在桌下搞定的事情，这些人其实已经是整个互联网圈子里头最顶尖的一群人了，他们也可以达成相应的合作或者相应的交易。所以不用为他们担心。</p>



<p class="wp-block-paragraph">大家赶快去看看字节跳动，哎呀，还没上市。好吧，继续期待一下吧。好，这一期节目就跟大家讲到这里，感谢大家收听，请帮忙点赞点小铃铛，参加 Discord 讨论群，也欢迎有兴趣有能力的朋友加入我的付费频道。</p>



<p class="wp-block-paragraph">再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>超级智能的黎明：山姆·奥特曼如何定义智能时代并引发人性与科技的重新思考？</title>
		<link>https://lukefan.com/2024/10/02/%e8%b6%85%e7%ba%a7%e6%99%ba%e8%83%bd%e7%9a%84%e9%bb%8e%e6%98%8e%ef%bc%9a%e5%b1%b1%e5%a7%86%c2%b7%e5%a5%a5%e7%89%b9%e6%9b%bc%e5%a6%82%e4%bd%95%e5%ae%9a%e4%b9%89%e6%99%ba%e8%83%bd%e6%97%b6%e4%bb%a3/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Wed, 02 Oct 2024 00:43:20 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AGI]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[业务拓展]]></category>
		<category><![CDATA[产品创新]]></category>
		<category><![CDATA[产品发布]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[人工智能应用]]></category>
		<category><![CDATA[人工智能研究]]></category>
		<category><![CDATA[人机合作]]></category>
		<category><![CDATA[人类协作]]></category>
		<category><![CDATA[企业创新]]></category>
		<category><![CDATA[企业发展]]></category>
		<category><![CDATA[企业文化]]></category>
		<category><![CDATA[企业管理]]></category>
		<category><![CDATA[公司增长]]></category>
		<category><![CDATA[公司愿景]]></category>
		<category><![CDATA[公司战略]]></category>
		<category><![CDATA[公司运营]]></category>
		<category><![CDATA[创业故事]]></category>
		<category><![CDATA[创业经验]]></category>
		<category><![CDATA[创新挑战]]></category>
		<category><![CDATA[创新方向]]></category>
		<category><![CDATA[创新科技]]></category>
		<category><![CDATA[创新管理]]></category>
		<category><![CDATA[创新能力]]></category>
		<category><![CDATA[创新趋势]]></category>
		<category><![CDATA[创新领导者]]></category>
		<category><![CDATA[前沿科技]]></category>
		<category><![CDATA[商业分析]]></category>
		<category><![CDATA[商业战略]]></category>
		<category><![CDATA[商业模式]]></category>
		<category><![CDATA[增长策略]]></category>
		<category><![CDATA[大数据]]></category>
		<category><![CDATA[山姆·奥特曼]]></category>
		<category><![CDATA[工业革命]]></category>
		<category><![CDATA[市场前景]]></category>
		<category><![CDATA[市场动态]]></category>
		<category><![CDATA[市场竞争]]></category>
		<category><![CDATA[市场表现]]></category>
		<category><![CDATA[市场领导者]]></category>
		<category><![CDATA[技术团队]]></category>
		<category><![CDATA[技术实力]]></category>
		<category><![CDATA[技术革新]]></category>
		<category><![CDATA[投资分析]]></category>
		<category><![CDATA[投资机会]]></category>
		<category><![CDATA[投资策略]]></category>
		<category><![CDATA[时代变革]]></category>
		<category><![CDATA[时代走势]]></category>
		<category><![CDATA[智能产品]]></category>
		<category><![CDATA[智能发展]]></category>
		<category><![CDATA[智能时代]]></category>
		<category><![CDATA[未来发展]]></category>
		<category><![CDATA[未来展望]]></category>
		<category><![CDATA[未来社会]]></category>
		<category><![CDATA[未来科技]]></category>
		<category><![CDATA[未来规划]]></category>
		<category><![CDATA[机器学习]]></category>
		<category><![CDATA[深度学习]]></category>
		<category><![CDATA[深度学习成功]]></category>
		<category><![CDATA[研发投入]]></category>
		<category><![CDATA[社会发展]]></category>
		<category><![CDATA[社会变革]]></category>
		<category><![CDATA[社会繁荣]]></category>
		<category><![CDATA[社会责任]]></category>
		<category><![CDATA[科技创新]]></category>
		<category><![CDATA[科技前沿]]></category>
		<category><![CDATA[科技动态]]></category>
		<category><![CDATA[科技发展]]></category>
		<category><![CDATA[科技发展趋势]]></category>
		<category><![CDATA[科技展望]]></category>
		<category><![CDATA[科技影响]]></category>
		<category><![CDATA[科技影响力]]></category>
		<category><![CDATA[科技愿景]]></category>
		<category><![CDATA[科技投资]]></category>
		<category><![CDATA[科技提升]]></category>
		<category><![CDATA[科技行业]]></category>
		<category><![CDATA[科技趋势]]></category>
		<category><![CDATA[管理团队]]></category>
		<category><![CDATA[管理层动荡]]></category>
		<category><![CDATA[管理策略]]></category>
		<category><![CDATA[经济增长]]></category>
		<category><![CDATA[经济趋势]]></category>
		<category><![CDATA[融资]]></category>
		<category><![CDATA[行业内幕]]></category>
		<category><![CDATA[行业动向]]></category>
		<category><![CDATA[行业发展]]></category>
		<category><![CDATA[行业挑战]]></category>
		<category><![CDATA[超级智能]]></category>
		<category><![CDATA[高级智能]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1600</guid>

					<description><![CDATA[山姆·奥特曼在最近的博客中畅想了超级人工智能（AGI）的未来。他指出，AGI可通过深度学习实现，人类社会将因AGI而迈入前所未有的繁荣阶段。OpenAI正面临融资阶段的动态调整，管理层变动频繁。然而，奥特曼强调智能时代的来临不可阻挡。他认为，未来超级智能将超越人类，并推动社会整体智慧的不断发展。在这一过程中，如何使所有人过上更好的生活成为关键。OpenAI作为AIGC创新先锋，必须在研发与盈利间找到平衡，引导人类进入智能时代的黎明。

啊啊啊啊啊啊！山姆奥特曼的最新长文简直震撼到我了！🤯 他说，我们即将迎来「超级智能」的时代，每个人都有可能拥有自己的AI团队，未来的生活会大幅度提升！我们现在连想象都不知道自己会生活得多好！

他甚至提到，社会整体的智能水平要比我们每个人都聪明！这让人感受到超级智能的未来，不是仅仅是技术，更是整个人类社会的革命！🔥

但是等等！他也指出，虽然未来看似美好，繁荣并不等于快乐！这真的值得我们深思——当科技越来越强大，我们是否会因此感到孤独？😢 生活品质上升，但内心的空虚依然存在…这可不是什么小事！

山姆在里面还提到，AGI（通用人工智能）和超级智能的区别，超级智能会远远超越人类，我们要建立起怎样的规则呢？🤔 我们到底该如何与如此聪明的机器共处？

而在这股人工智能浪潮下，OpenAI的融资故事也让人关注！山姆·奥特曼不仅成为了管理的关键，那些曾经的团队成员纷纷离去，这可不只是管理层的更迭，还意味着他们对未来的信心崩塌吗？💔

总之，科技的风口已然来临，我们如何适应、拥抱，甚至引领这个时代，是我最大的期待！让我们一起关注超级智能吧，未来在等着我们探索！✨

#超级智能 #山姆奥特曼 #未来探索 #人工智能]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="超级智能的黎明：山姆·奥特曼如何定义智能时代并引发人性与科技的重新思考？" width="900" height="506" src="https://www.youtube.com/embed/iKgdBXI4ba8?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">第二个故事：山姆奥特曼的超级人工智能，或者叫超级智能。现在呢，OpenAI的融资时刻，总是要集中的发声表达意见，而且呢，只能有一个声音，唯一的声音，不能大家随便乱说。所以，山姆奥特曼给大家打了一个样，以后说的照我这样说，或者干脆以后就只许我说，你们都别说。</p>



<p class="wp-block-paragraph">现在呢，它等于发了一堆东西。第一个是发了O1的这个模型，第二个呢，也发了一篇长文。今天咱们解读一下这篇长文。语音模式的高级使用方法呢，现在也上线了。我现在手机上能用，但是我的Mac电脑现在还用不了，要稍微等一等。但是呢，手机能用了以后，并没有什么新鲜感，唯一的差异就是你现在可以打断它了，这块要好一些了，交流起来要稍微自然一些。</p>



<p class="wp-block-paragraph">这一次，山姆奥特曼的文章里都写了什么？9月24号，山姆奥特曼发了一篇博客长文，里边呢讲了几件事。第一个呢，他承认说社会是高级智能，比我们任何人都更聪明、更有能力。这个呢，算是提出了一个新的观点吧，人类的能力提升并非源自于基因，而是来自于社会，跟我最近在看的《世人之上》相互呼应吧。</p>



<span id="more-1600"></span>



<p class="wp-block-paragraph">第二个他说，每个人都可以拥有自己的人工智能团队。在不同领域里头，都会有虚拟专家来辅助你，共同创造几乎所有我们想象的东西。那就是未来AGI实现了，可能就是这样的一个状态。而且呢，他希望大家可以共享繁荣，不是有多少个人有电脑，有多少人有手机，不是这样的啊，完全是不一样的繁荣程度。每个人的生活，都将比现在的任何人更好啊。</p>



<p class="wp-block-paragraph">这个呢，其实就是一种大的工业革命以后的效果。你就想，有了汽车以后，是不是所有人的生活都比马车时代要好？基本上可以这么认为，除了战乱地区之外，就是你认为和平地区可以是这么去想的一个事情。所以他觉得智能时代以后也是如此，每个人的生活都会比现在任何人都好。</p>



<p class="wp-block-paragraph">繁荣并不一定快乐，并不是说大家就把所有问题解决了啊，很多富人依然不快乐。但是呢，生活的品质会上升，然而上升了以后，我们还是不快乐，还想考古啊，这事是不对的。然后呢，也给AGI下了定义啊。</p>



<p class="wp-block-paragraph">就任何通用人工智能，不需要特定训练的情况下，可以完成很多任务。而且呢，提出了新概念，就是超级智能。大家注意啊，超级智能里头少了俩字，少了哪俩字？人工没了啊。AGI这个东西呢，就是要跟人一样聪明，可以完成人的一些工作，而且不需要预训练。但是超级智能是要比人聪明。那么它呢，应该是超越人工智能的范畴，也超越人的范畴，在任何智力任务上都大大超越人类。这是未来的方向。而且呢，他觉得这个也不远了，应该是几千天就可以实现了。有些人说可能是十年或者几年，就有可能会看到这种超级智能的实现，甚至呢，可能达到完全不可思议的一个程度，无法想象的一个智慧了。就是基本上是要去造神的状态。</p>



<p class="wp-block-paragraph">如何实现超级智能呢？他也讲了深度学习取得成功，就可以造出这种超级智能来。实际上就是进一步推scaling low，还是要堆数据，堆更多的算法，堆显卡，堆到更大的一个规模之后，达到一个数量级突破，我们就可以得到超级智能了。而且在做超级智能的过程中呢，不要过度的关注细节。大模型的发展是一个整体的发展。你说：“哎呀，你的语音做怎么样了？你的图像做怎么样了？你的视频做怎么样了？你是不是安全？是不是不安全？”说如果纠结这些事情，超级智能就做不出来了。所以我们一定要努力去做去。</p>



<p class="wp-block-paragraph">而且呢，也给时代下了个定义，比如说这是一个智能时代的黎明，那我们还没有到智能时代。原来是比如原始时代，或者是愚昧的时代，然后是工业化的时代，再往下一个时代就是智能时代了。只是现在我们还没到。其实很多人喜欢给时代打标签。我记得前两天是Michael Anti写了一个，说我们现在又几点零时代了，AI是应该怎么去分类啊什么的。这个呢，我个人是不太喜欢给时代打标签的啊。你像山姆·奥特曼这样的人给时代打了标签，可能就没有那么可笑。但是绝大部分人给时代打标签，就会显得稍微的不那么严谨吧。山姆·奥特曼给时代下了一个定义，智能时代的黎明，要将人工智能交给更多人手中。</p>



<p class="wp-block-paragraph">OpenAI的这个使命，山姆·奥特曼依然准备去遵循。什么意思呢？就是他讲说，如果人工智能成为了有限资源，只有很少数人能用的话，是有可能引起战争的，会成为富人的专用工具的，这个是他不希望看到的。他希望OpenAI可以让更多的普通人可以用起来。但是这件事情不是他光希望就可以的。要让普通人都用上这个东西，还是要对普通人有作用，让普通人有感知才行。</p>



<p class="wp-block-paragraph">而现在的OpenAI推出的很多新东西，其实对于普通人来说意义不是很大，特别像O1这样的模型，给普通人去用其实没什么用的。然后去讲说未来可期啊，令人震惊的成就将司空见惯，就是我们现在觉得完全无法想象的事情，未来可能四处都是，而且会不断地发生。他会解决气候问题，建立太空殖民地，发现所有物理定律。这句话写得非常奇葩，所有物理定律会发现，而不是说像以前我们想象的那样，我们发现的物理定律越多，我们发现我们越无知。</p>



<p class="wp-block-paragraph">这里面他讲了一个叫“发现所有物理定律”，而且是有无限的智慧和充沛的能源，这是他对未来的一个期望。当然了，他也讲到说AIGC的理论，大模型是有风险的，人工智能，包括超级智能，都会带来很多问题和风险。但是呢，我们不能因为害怕这个事情就不干了，不能因噎废食，还是得努力前进。</p>



<p class="wp-block-paragraph">而且最终的结论是什么呢？作为一个社会，我们将回归一个不断拓展的世界。其实在这个过程中，我们要看到背后讲的是什么，背后讲的是我们不要以人类这样的一个基础去说到底应该怎么去发展，是不是会被替代，是不是会被伤害，而是要以社会这个层面去看。本来人类得到发展，也是得到了社会的帮助。开始讲社会本身是一个超级智能，比所有人都聪明。那么在这样的一个情况下，他要改变的是社会。</p>



<p class="wp-block-paragraph">至于未来的社会里，到底是有人还是没有人，还是人跟机器怎么去合作，那是未来的事情。但是呢，社会在智能或者在超级智能的帮助下，会重新变成一个不断拓展的世界，不断地去拓展新的文明，新疆域。</p>



<p class="wp-block-paragraph">这使他对整个社会的一个期望吧。那文章大概写了这么长，写的还是比较有想象力的吧。但是呢，这样的文章里头，它其实没有任何具体东西。你不可能说，像原来OpenAI发布Sora，OpenAI发布GPT-4，OpenAI发布其他的这样东西，可以让别人有的抄，有方向可以去模仿，什么都没有，写了一堆非常空泛的东西。但是呢，也可以让我们去想象一下，未来到底是什么。</p>



<p class="wp-block-paragraph">在融资的时候，通常都是公司最动荡的时候。山姆·奥特曼呢，也终于成了孤家寡人。咱们举一个例子，Sora在年初的时候发布，震惊了全世界。震惊完了以后，他自己又拿不出产品来，全世界所有的人都在去做Sora，百度这两天也出了，字节也出了，快手也出了，还有一堆的创业公司也都做了自己的Sora。结果到现在为止，他做不出来了，这事就很麻烦。</p>



<p class="wp-block-paragraph">山姆·奥特曼在去年11月罢免事件之后，重新回去做CEO的时候，我当时录了节目就讲说，这个人的心理会有一些扭曲的。他以后不会再相信其他人了，他一定会相信他可以掌握的事情，否则的话，努力了半天，结果被董事会扔出来。而这个对于一个创始人来说，是非常非常大的伤害。这种伤害会伴随他一辈子，就是一个人是由他的过去经历来塑造和定义的。</p>



<p class="wp-block-paragraph">去年11月份的罢免事件呢，也算是塑造了山姆·奥特曼。以后可能就更加的狡猾多疑吧，会变成这样的一个人。他呢，一定会任用更加值得信任的团队来管理事务性的事情。你说科技的事情他可能管不了，但是各种事务还是要他去控制得住的人去管，就跟咱们国内很多公司的老板喜欢找老婆或者是小三来去管财务一样，这个过程是一样的，也像古代的皇帝喜欢任用太监是一样的。</p>



<p class="wp-block-paragraph">这一次融资呢，据说已经超募了。什么叫超募？就是说我现在准备融65亿，现在呢，愿意给钱的人比那多。就是每个人给的钱加一块比这个数多了。那么一般超募了以后的处理方式呢，就是要去拒绝一些人。啊，当然有时候超募的时候会多募一点，比如说我要65亿。</p>



<p class="wp-block-paragraph">现在超募了10%或者超过了20%，一般在募集之前会跟大家说好。如果超过了20%，我就把这20%之前拿进来就完事了，再多的钱就要拒绝了。选谁的不选谁的，大家要去谈判。在谈判的过程中，可能是根据条款以及条件去限定其他的话，可能就基本上拒绝掉了。</p>



<p class="wp-block-paragraph">所以他这一次融资基本上算完成了。而且呢，据说这一次融资可以摆脱非盈利机构的束缚了，他就完完全全变成一个盈利公司。但是非盈利组织还会在，只是他们的管理关系会发生一些变化。而且呢，也要开始给山姆奥特曼发股票了。山姆奥特曼据说是会发到7%的股份，对于一个1,500亿美金的公司的7%，哇，好多钱啊。我就不算了，你们帮我算一下这是多少钱吧。</p>



<p class="wp-block-paragraph">其他的管理团队在这个时候呢，咱们不说什么理念相合呀，或者是我们想做的更安全呀，或者说有没有个人发展呀，这个事我们就不研究了。可能有这样方面的原因，在融资的时候团队分崩离析的，实际上我见过非常多的案例，最主要的核心原因只有一个，就是分赃不均，大家分股票没分明白。</p>



<p class="wp-block-paragraph">现在山姆奥特曼分了7%，其他的这些管理团队，或者是叫做联合创始人的这些人，他们就会干嘛？不患寡而患不居。这一个礼拜大概又走了三个，他那个美女CTO也跑掉了。当时把山姆奥特曼干掉的时候，就是这个美女CTO说：“我一定要让他弄回来”，然后跟这个董事会对抗，最后把山姆奥特曼给拯救回来。今天她也走掉了。</p>



<p class="wp-block-paragraph">对于基层员工来说，实际上相对是比较容易满足的，因为大家都差不多，大家都是拿的期权池，可能每个人有个百分之零点零零几这样的一个情况。但是你别看百分之零点零零几，对于他们来说可能也是几十万美金，几百万美金，就不要想比例的事情了吧，大家都挺开心的。</p>



<p class="wp-block-paragraph">但是对于最上面这个，就是对于可以去按比例分这个股份的人来说，你是分不明白的。山姆奥特曼如果能分到7%的话，剩下的人可能连1%都没有，或者0.几，那肯定心里就不满意了嘛。那么说，趁着融资的时候，我们看看是不是调整一下架构。</p>



<p class="wp-block-paragraph">应该怎么去分一下？这个事估计就没分明白。对于创业团队和管理层来说，预期管理是非常难的啊。像我们做投资的时候，其实基本上做两件事：第一件事呢，叫做信任游戏。如果不信的话，你是拿不了钱，别人也没有办法去相信把钱给你。</p>



<p class="wp-block-paragraph">另外一个呢，叫预期管理。如果我觉得你的公司值100万，你觉得值一个亿，这就属于预期管理失败。特别是当有很多股东、很多投资方的时候，就要把所有人的预期对齐。如果对不齐的话，交易就没法做。有些人只觉得山姆奥特曼这公司Open AI值1,500亿，有些人觉得值1,000亿，有些人觉得值800亿，那这个就没法在同一份协议上签字。有些人觉得说，山姆奥特曼上百亿美金了，那我们其他人跟你一起玩的时候，我是不是也应该有个几十亿美金，或者有个几亿美金？如果你没分到的话，这就属于预期管理失败。如果是一堆投资人和股东，预期管理失败呢，那大家就没法签协议，要换投资人啊，换股东。最后让一些人对齐了以后再签字。如果是创始团队的，那就离职。所以现在在融资即将落地的时候，有核心大将离职是非常正常的。这个事情我们见得非常多。</p>



<p class="wp-block-paragraph">然后咱们来讲这个吹牛的事情。Sora呢到现在为止依然遥遥无期。我看很多人去写文章、发视频，讲Open AI CTO这个漂亮姑娘去离职的时候啊，都在讲是因为她发了Sora，结果最后没做出来，她跑了。而且呢，她走了以后，Sora可能做不出来了。这个呢，我觉得最大的问题就是，预期管理失败。他等于对整个的社会放了一个预期，然后他自己又没有在预期相应的时间内把东西做出来，没有填这个坑。吹的太详细了，而且让别人都照着做这事是不行的啊。</p>



<p class="wp-block-paragraph">前面吹的牛现在还需要慢慢的填。山姆奥特曼呢，算是给吹牛立了一个标杆，以后再吹牛怎么吹啊？多讲哲学，少讲些具体的实施方法。像刚才我们看的山姆奥特曼的博客，长文基本上就是这样的一个东西。我不会告诉你说这东西怎么做的，我也不会告诉你说……</p>



<p class="wp-block-paragraph">我们具体会做成什么样？他只是告诉你说，未来可厉害了啊，厉害的你都无法想象了，无法用文字去描述了。他如果能描述得清楚，未来就是这样的，那甭等他做，别人就冲着这方向就去了。他现在已经是排头兵了，已经是风向标了，就不能再去讲很具体的事情了。</p>



<p class="wp-block-paragraph">那么公司呢，有的时候就会失去创新力。其实像Open AI现在正在慢慢向这个方向前进。我们以前去做很多公司的调查，15年、16年的时候吧，在国内走访了大量的做AI相关的公司。走访了一段时间以后，最后我们立了一个标准，什么样的标准呢？挣钱的都不要，外包的都不要，接工程的都不要。为什么呢？因为做科研的公司锐意进取，他是没有办法盈利的。你也搞不清楚这东西到底怎么挣钱。而你一旦要去做销售为王，要开始做外包、开始做工程了，那么他就没有办法说，我再去投入那么大的精力去做这种你的预期完全无法预测的科研。</p>



<p class="wp-block-paragraph">这个事就没法干了，因为很多的这种公司都是这样，说我一开始是做AI系统的研究，做底层，做自然语言处理，等做完了以后呢，还不挣钱，然后呢就开始去接项目。中国的甲方又是有名的刁钻啊，或者说比较苛刻，他们会提各种各样的问题。提出问题了以后呢，这个工程团队就会专门有另外一帮程序员去给他们实现。而在实现的过程中，其实即使到现在的大模型，你会发现很多事情，直接写程序进行简单判断实现，要比大模型给你生成的效果可能还好一点，特别是在甲方很规模的情况下，更是如此。</p>



<p class="wp-block-paragraph">那么在这样的情况下，为什么要花这么高的薪水，养这么一帮不赚钱的科研团队呢？我们应该更倾斜一些，让给公司挣钱的人得到更好的收益，他们会做这样的一个事情。公司只要向这个方向发展，他们的一开始的原始研究团队就会快速离散掉，因为你又不愿意给他钱，而且还天天给他脸色看，说你看你每天花钱做出来的东西，别人又用不了，别人也搞不明白怎么用。接到工程项目里头以后呢，这个代码的质量又特别差，这个是很正常的。</p>



<p class="wp-block-paragraph">我看科学家写的代码，这个品质都稀烂无比。像我们以前做人脸识别，都是专门雇佣的科学家。科学家最后写完代码以后，我们需要再雇一个程序员把它重写一遍。他们两个人就是鸡同鸭讲，科学家说：“我为什么这么做？算法是怎么做的？”正经的程序员根本就没法看，因为他们的各种内存泄漏、各种不规范的工程方式特别多，完全没有办法进到这个代码库里边去。</p>



<p class="wp-block-paragraph">在这样的情况下，这些科学家就会走开。所以现在，OpenAI其实也在经历这样的一个事情，就是能做出业绩的人留下，财务、法务、人事、行政这样的一个团队来去管理公司。这样的团队实际上就是“皇上信任的事务团队”。山姆·阿尔特曼经历了去年11月份的罢免之后，现在整个OpenAI也有上千人了，所以他应该会有一个很强大的事务团队。</p>



<p class="wp-block-paragraph">我见过很多这种创业公司，在一开始公司很小的时候，都是一帮技术、一帮销售、一帮业务人员，每天大家在商量说公司应该怎么做，应该如何去处理。等公司涨到一定程度以后，所有的话语权就会回到财务、法务、人事、行政手里面。然后，这些元老，特别是一些原来喜欢去说两句的，都会被财务、法务来教育：“你不可以去对你不负责任的事情发表言论，这些事情不应该你知道，你就不能知道，这个事情是要保密的。”他们会通过这样的方式把整个公司的创新力完全扼杀掉。</p>



<p class="wp-block-paragraph">但这也没办法，公司的发展到一定阶段以后，一定会走这条路。那么现在OpenAI应该正在走这条路。一方面就是分钱没分明白，另一方面可能确实也有一些人是有理想主义的，但最终很多公司就是被金钱战胜了，最后谁有业绩谁留下。你说财务、法务这帮人，肯定也是围着有业绩的人去转，因为他们自己不挣钱嘛。你说另外一波不挣钱的人，肯定是我怎么看着怎么不顺眼，一定是这样的一个状态。由他们再去管理公司以后，大家的积极性就没有了。</p>



<p class="wp-block-paragraph">现在呢，我们只能说，希望 OpenAI 还可以在排头兵的位置上多站个一到两年。你也不要对他有更多的预期了，再多站一站，至少把 AGI 做出来啊。觉得以 OpenAI 现在的这种势头，已经积累的这些人、这些代码、这些钱，他应该还是可以把 AGI 做出来的。把 AIGC 企业当前遇到的各种问题呢，也要解决掉，这是 OpenAI 当前的一个任务。</p>



<p class="wp-block-paragraph">AIGC 的企业当前遇到了哪些问题呢？第一个问题就是不赚钱。你做了一大堆研究，最后没有赚到钱。而且大家没想明白这东西到底咋赚钱。但是 OpenAI 一旦把这个问题解决掉了，以后它也就不再是一个研发型公司了，它就变成了一个老老实实的该挣钱的公司，就像微软、苹果这样的公司了。这是第一个问题。</p>



<p class="wp-block-paragraph">第二个问题是什么？就是距离解决实际问题的这个差距。这个其实是一个用户交互的问题。我一直在讲，OpenAI 做的聊天式的交互方式其实是有害的。大家其实并不需要这样的一个聊天交互方式。现在我们看到的一些比较好的交互方式是什么呢？就是一种叫流式交互，就是我们把需要做的事情规范好，设定几个流的节点，然后一步一步请你把它做完。这个其实才是可能更好的一种交互方式。但是这种流式交互方式，对于不同的业务是需要重新去设计的，它没有通行性。所以现在大家也在思考，应该如何去把这种先进的技术，用好的交互方式跟所有的人融合在一起，这个是需要去思考的。也希望，比如 OpenAI 和苹果合作的过程中，可以把实际问题解决掉。</p>



<p class="wp-block-paragraph">最后呢，AIGC 行业还面临了一个很大的问题，就是消灭就业而不增加就业。就像山姆·奥特曼讲的，未来会面临巨大繁荣，所有人都会比现在任何人活得更好。但是，怎么走到这一步，怎么能够让所有人比现在都活得更好，这个是要去思考的一个问题。就像我们可能在马车时代很难想象，说高速公路家家户户都有汽车，这个事是没法想的。那么，未来到底是什么样的呢？</p>



<p class="wp-block-paragraph">我们现在想象不出来，怎么能够让所有人都生活得更好。这个事情呢，至少让他再打个样本出来。这个我觉得是OpenAI的一个使命。如果它能把这些事情实现了，那么它倒下了也没有什么关系。如果你说你实现了以后，最后像谷歌一样，成为了一个基础设施公司也行。你千万不要说它把所有东西实现了以后，变成了政府，那就比较危险了。这个可能性也是存在的。</p>



<p class="wp-block-paragraph">至于说超级智能这样的东西，到底会不会出现，会不会到来呢？不知道啊，有可能会有。而且真到了那一天，可能从人类的角度上来说，我们可能叫新人类，或者说叫一些什么不一样的东西。我们就跟现在的人，已经完全是两个不同的物种了。而且真的是超级智能了，以后你咋跟他说话？特别聪明的人，比如说北大伟神，够聪明了吧？你站在他面前有任何交流的欲望吗？其实你是没有的。还是说我们就见到这种得道高僧似的面前，我们说什么，他任何一个回复，或者佛陀拈花一笑，我们都觉得自己是个傻子。这样有意思吗？其实也没什么意思。</p>



<p class="wp-block-paragraph">所以未来的这种超级智能，到底应该如何跟人一起去协作？或者人在未来超级智能掌管的这种社会里头，应该在一个什么样的位置上？它都已经远远超越人类了，还要我们干嘛使啊？这个其实是我们需要去思考的。而且我觉得，山姆·奥特曼把这个问题提出来，本身也是一个很好的事情。这个就是今天我们要去讲的：山姆·奥特曼在融资的时候发的这个文章，到底在讲什么？以及OpenAI为什么会有这么多的管理者、这么多的技术大拿会离开？以及我们应该如何去面对超级智能的一个故事。</p>



<p class="wp-block-paragraph"></p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>娃哈哈宗馥莉接班之路波折不断：员工维权委员会起诉事件解析</title>
		<link>https://lukefan.com/2024/09/17/%e5%a8%83%e5%93%88%e5%93%88%e5%ae%97%e9%a6%a5%e8%8e%89%e6%8e%a5%e7%8f%ad%e4%b9%8b%e8%b7%af%e6%b3%a2%e6%8a%98%e4%b8%8d%e6%96%ad%ef%bc%9a%e5%91%98%e5%b7%a5%e7%bb%b4%e6%9d%83%e5%a7%94%e5%91%98%e4%bc%9a/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Tue, 17 Sep 2024 10:37:14 +0000</pubDate>
				<category><![CDATA[新消费]]></category>
		<category><![CDATA[VIE架构]]></category>
		<category><![CDATA[上市规则]]></category>
		<category><![CDATA[互联网企业]]></category>
		<category><![CDATA[产业结构]]></category>
		<category><![CDATA[企业上市]]></category>
		<category><![CDATA[企业创新]]></category>
		<category><![CDATA[企业发展]]></category>
		<category><![CDATA[企业发展战略]]></category>
		<category><![CDATA[企业并购]]></category>
		<category><![CDATA[企业战略]]></category>
		<category><![CDATA[企业文化]]></category>
		<category><![CDATA[企业治理]]></category>
		<category><![CDATA[企业管理]]></category>
		<category><![CDATA[企业融资]]></category>
		<category><![CDATA[企业责任]]></category>
		<category><![CDATA[企业转型]]></category>
		<category><![CDATA[全过程民主]]></category>
		<category><![CDATA[公司历史]]></category>
		<category><![CDATA[公司架构]]></category>
		<category><![CDATA[公司治理]]></category>
		<category><![CDATA[关联交易]]></category>
		<category><![CDATA[关联方交易]]></category>
		<category><![CDATA[分红权]]></category>
		<category><![CDATA[利润分配]]></category>
		<category><![CDATA[利益非公允]]></category>
		<category><![CDATA[劳动合同]]></category>
		<category><![CDATA[司马南]]></category>
		<category><![CDATA[合规操作]]></category>
		<category><![CDATA[合资公司]]></category>
		<category><![CDATA[合资协议]]></category>
		<category><![CDATA[员工持股平台]]></category>
		<category><![CDATA[员工权益]]></category>
		<category><![CDATA[员工起诉]]></category>
		<category><![CDATA[商业争端]]></category>
		<category><![CDATA[商标授权]]></category>
		<category><![CDATA[国资企业]]></category>
		<category><![CDATA[国资持股]]></category>
		<category><![CDATA[外商独资企业]]></category>
		<category><![CDATA[娃哈哈]]></category>
		<category><![CDATA[宗庆后]]></category>
		<category><![CDATA[宗馥莉]]></category>
		<category><![CDATA[封疆大吏]]></category>
		<category><![CDATA[工会]]></category>
		<category><![CDATA[工资收入]]></category>
		<category><![CDATA[市场分析]]></category>
		<category><![CDATA[市场环境]]></category>
		<category><![CDATA[市场监管]]></category>
		<category><![CDATA[市场竞争]]></category>
		<category><![CDATA[投资协议]]></category>
		<category><![CDATA[政府干预]]></category>
		<category><![CDATA[柳传志]]></category>
		<category><![CDATA[民族主义]]></category>
		<category><![CDATA[民族企业]]></category>
		<category><![CDATA[法律法规]]></category>
		<category><![CDATA[法律诉讼]]></category>
		<category><![CDATA[法院受理]]></category>
		<category><![CDATA[管理层更替]]></category>
		<category><![CDATA[组织闹事]]></category>
		<category><![CDATA[经济体制]]></category>
		<category><![CDATA[经济体系]]></category>
		<category><![CDATA[经济发展]]></category>
		<category><![CDATA[经济合作]]></category>
		<category><![CDATA[经济增长]]></category>
		<category><![CDATA[经济损失]]></category>
		<category><![CDATA[经济改革]]></category>
		<category><![CDATA[经济政策]]></category>
		<category><![CDATA[经济效益]]></category>
		<category><![CDATA[经济模式]]></category>
		<category><![CDATA[经济环境]]></category>
		<category><![CDATA[经济纠纷]]></category>
		<category><![CDATA[经济趋势]]></category>
		<category><![CDATA[经济转型]]></category>
		<category><![CDATA[经销商股东]]></category>
		<category><![CDATA[绩效分配]]></category>
		<category><![CDATA[绩效考核]]></category>
		<category><![CDATA[维权委员会]]></category>
		<category><![CDATA[股东利益分配]]></category>
		<category><![CDATA[股东权益]]></category>
		<category><![CDATA[股权回收]]></category>
		<category><![CDATA[萧山顺发]]></category>
		<category><![CDATA[行业分析]]></category>
		<category><![CDATA[行业规范]]></category>
		<category><![CDATA[诉讼程序]]></category>
		<category><![CDATA[财报审计]]></category>
		<category><![CDATA[资本家]]></category>
		<category><![CDATA[资本市场]]></category>
		<category><![CDATA[资本投资]]></category>
		<category><![CDATA[资本管理]]></category>
		<category><![CDATA[资本运作]]></category>
		<category><![CDATA[达能]]></category>
		<category><![CDATA[零对价]]></category>
		<category><![CDATA[领导风格]]></category>
		<category><![CDATA[鸿盛饮料]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1568</guid>

					<description><![CDATA[本文深入探讨了娃哈哈员工起诉宗馥莉的事件，揭示了强制股权回收、劳动合同转移和零对价股份转让等关键问题。宗馥莉在接班过程中，面临员工维权委员会和个人诉讼的多重挑战，同时公司内部治理和股东利益分配的混乱也成为焦点。通过分析这些事件，我们看到娃哈哈的公司治理结构存在的深层次问题，以及未来可能的发展方向。关键词包括：娃哈哈、宗馥莉、员工起诉、股权回收、劳动合同、零对价、维权委员会、公司治理、股东利益分配。

啊啊啊啊啊！家人们，你们敢信？！我从小喝到大的娃哈哈，居然爆出惊天大瓜！！😱😱😱宗馥莉接班后，被自家700多名员工集体起诉了！！这到底是怎么回事？！

据说啊，宗馥莉上台后就开始大刀阔斧改革，先是强制回收员工股份，美其名曰“改革”，实际上就是变相降低分红！😠😠😠以前老员工躺着都能拿钱，现在全都要看宗馥莉脸色！

更过分的是，她还把员工强制转到其他子公司，连干股分红都没了！😰😰😰这不明摆着欺负老实人吗？！难怪员工要集体维权！

更更更过分的是，宗馥莉还把一个子公司的股份，零对价就转让给自己了！😱😱😱这波操作简直是教科书级别的“空手套白狼”啊！

家人们，你们说，这娃哈哈还能不能好了？！😭😭😭我还能不能安心喝我的AD钙奶了？！

#娃哈哈 #宗馥莉 #员工维权 #打工人 #搞钱 #内幕 #瓜 #救命 #我不允许有人不知道 #真相是]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="娃哈哈宗馥莉接班之路波折不断：员工维权委员会起诉事件解析" width="900" height="506" src="https://www.youtube.com/embed/FU1yg5fXtQE?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">第二个故事讲一下员工起诉宗馥莉的事。娃哈哈的闹剧还在继续，一堆公司可能都会因为类似这样的事情暴雷。宗馥莉的接班之路还要走，从前面她突然辞职，被家族长辈指责，说：“宗馥莉，你太着急了，不要着急挣钱。你就是给国家去看门了，你不是一个普通的资本家。”政府出来抹了一把稀泥，说：“这事我不知道。”过了一段时间，宗馥莉重掌大权，也干掉了一批族老，换上了自己人。这是前面的事情。</p>



<p class="wp-block-paragraph">当时这个事情过去了以后，很多人都在解读，认为“哇哈哈，这事过完了，大家等着继续去喝他们家纯净水就完事了。”没有那么容易，事情远没有结束。现在，大概有700多个员工组织了维权委员会，起诉宗馥莉，也有几十个员工以个人身份起诉了宗馥莉。据说法院已经受理了这些案件。很多案件，起诉完了法院是不受理的，现在已经受理，进入标准的诉讼程序了。</p>



<p class="wp-block-paragraph">当然，员工持股平台和娃哈哈的工会也出来辟谣，称这事没有，他们做的所有操作都是合规的，举报的所有事情都是造谣。中国特色嘛，也出来讲了一下这个事。这里头就会出现一个问题：到底谁代表谁的问题。以前只要员工持股平台或者工会愿意给这些员工发钱，这些员工其实并不太在意谁代表他。你只要发钱，让我日子过得还可以就行了。现在不给发钱了，谁让我经济受到损失了，你们想代表我就没门了。</p>



<span id="more-1568"></span>



<p class="wp-block-paragraph">到底是什么原因引起的诉讼，大概有三个原因。第一个是强制股权回收。因为有员工持股平台，达到一定条件的人是持有娃哈哈一部分的股份的，而这些股份每年都会分红。原来是一股一年分8毛钱。至于娃哈哈到底挣了多少钱，留了多少利润，怎么去做，反正是一笔糊涂账，因为不是上市公司，也没有财报，不需要经过审计。所以他就每年按照这样的一个比例，一股8毛钱给分。</p>



<p class="wp-block-paragraph">如果混的年头长的员工，手里股票就比较多，他们的主要收入来源其实是这个分红，而不是工资收入。这就是这样的一种制度。在宗庆后去世之前，突然就说：“咱们别这么干了，你们把手里这股票都卖给我，不要有员工持股平台了，我们就把它都回收了。”员工持股平台和工会同意了，按照多少钱去回购这些股份呢？首先，先把以前没分配完的利润给分配掉。原来是一股8毛，现在一股两块，然后再按照一股一块钱的价格把这个股票再买回来。等于原来拥有娃哈哈股票的人，现在一股能够拿到3块钱，就不再是娃哈哈的股东了。<br>到底是不是两块钱？这个事是一笔糊涂账，谁也说不清楚。这一块钱的对价到底合不合理，实际上也是拍脑袋来的。你按道理说，如果经过会计的核算呢？你怎么着？你应该是个有零有整的数。这边两块，那边一块，明显是拍脑袋来的价格。</p>



<p class="wp-block-paragraph">在这个过程中，员工代表大会和持股平台我同意了，反正我已经代表大家同意了。整个的流程也是极其敷衍的，根本就没有经过审核和审计，没干就把这事干完了。职工代表大会这个制度，你们可以把它理解成为全过程民主中的一项吧。</p>



<p class="wp-block-paragraph">那么在回收了这些股份之后，他们也不是说这个钱就不分了，还是要分的，按照干股分红。就是原来大家拿着股份来分，现在大家都没有股份了，我按干股分。那怎么分？不是说原来谁的股份多分的多，而是现在谁干的好分的多，变成了一种绩效的分配方式。</p>



<p class="wp-block-paragraph">其实也很简单了，以前有很多老员工，我已经有这么多股份了，我不需要努力了。我干多干少我都可以过得很好，因为我的股票分红已经比我的工资高了。新的员工就觉得很不公平，你说我累死累活的，我比他干的还好，结果我挣的这么少，他就觉得很没意思。</p>



<p class="wp-block-paragraph">所以呢，宗庆后当时活着的时候就干这个事，说我们要把它改掉。其实这个字像什么，就是从POS改POW。POW是工作量凭证，POS是你拥有的股票的凭证。这跟以太坊矿似，原来是你拥有多少以太坊，我就给你多少配售的。新的以太坊我给你改成说大家拿着显卡去挖矿，换成这样方式，现在大家不乐意了。</p>



<p class="wp-block-paragraph">宗庆后活着时候还能压得住，现在宗庆后没了，宗馥莉上来了，说我们要翻一下旧账，这个事不行了。这是起诉的第一个原因。</p>



<p class="wp-block-paragraph">第二个问题是什么呢？转劳动合同。原来很多的员工是娃哈集团的员工，现在我们要给你转，转到鸿盛饮料这个公司去。转过去呢，连干股分红都没有了，大家就不乐意了，说你凭什么给我转那头去啊，这个事我们不开心。</p>



<p class="wp-block-paragraph">第三个事是什么呢？还有一个下边的子公司，叫萧山顺发。这个子公司实际上是娃哈哈的投资的平台，也是娃哈哈一些食品包装的一些平台。这个公司原来员工持股平台里头，也占个可能百分之二三十的股份。最近这些股份被转让给了宗馥莉，按什么样的价格？零对价，就是一分钱没拿着。那么这个股票就直接归了宗馥莉了。</p>



<p class="wp-block-paragraph">那么这个员工就不乐意了，说员工持股平台的这个股份，凭什么零对价就转给你了？这事肯定有问题啊。虽然员工持股平台和公会说，我们已经代表你同意过了，你们及个别人有什么意见，你们提出来。但是现在这三件事把宗馥莉给告了。<br>哇哈哈其实本身就是一屁股烂账。早年应该是在96年还是九几年，法国著名的乳品企业叫达能。当时他就跑来跟娃哈哈谈合作，说我出49，你出51，咱们成立一合资公司，咱们一起用娃哈哈的品牌，在中国推各种各样的饮料、牛奶、酸奶。当时的宗庆后觉得挺好的，有外商看上我了，我们干呗。就开始干起来了。</p>



<p class="wp-block-paragraph">干了一段时间以后，宗庆后就老觉得说这挣了钱，还得要接受法国人的审计，这个很不爽。他怎么办？他就整了一个幺蛾子，让员工组织起来，说咱们成立一些新的公司。这个新的公司跟这个合资公司没关系，咱们在那边挣了钱以后，咱们自己分。一堆的员工就同意了。这事是1999年干的。</p>



<p class="wp-block-paragraph">成立的公司呢，最早我忘了叫什么了，但是后边咱们讲的这鸿盛饮料、萧山顺发，实际上都是从最早成立的这批公司里头演化出来的。这么一公司成立以后，肯定达能就不乐意了嘛，说你看我花了钱，咱们是用的娃哈哈的品牌，你现在娃哈哈的品牌的钱没让我赚着，让其他公司赚着了，这个利润又不分给我，这事肯定不行啊。</p>



<p class="wp-block-paragraph">像我们以前跟人去签投资协议的时候，都会签着竞业禁止。你跟我做了这个协议以后，你就不能再在其他地方干同样的事情，你要保证我们一块合资干这个生意，你所有做这件生意的收益，我这能分得着才行。</p>



<p class="wp-block-paragraph">娃哈哈就干了这么一个幺蛾子的事。其实正常的这种公司，包括像很多VIE上市公司啊，它这个公司架构都很复杂。公司下头有好几百个公司是很正常的。为什么他们是可以合法运转呢？因为他们是这样的一个架构：第一层在开曼，再往下一层是在，比如说新加坡、香港，这种实际的运营主体在这边。再往后，是在国内做一些外商的独资企业。整个这个过程的股份，其实都是100%上去的。</p>



<p class="wp-block-paragraph">其他你说我是百度的股东，因为百度在开曼嘛，那你都是在开曼公司股东，从新加坡到国内都是100%控股我们，能保证所有的利润都汇集到最上面那股东那里去。即使是有一些公司跟最上面那开曼母公司没有任何的股权关系，也有，因为VIE嘛。比如说你拿一些国内的牌照的这些公司，他就没有股权关系，但他会签这种协议控制，就是保证这个公司只用来拿牌照，他不产生任何的收益和利润。如果产生了收益和利润，我们会把所有的收益、利润全部上交到母公司去，这样才能保证你最上层的股东可以享受到所有收益。</p>



<p class="wp-block-paragraph">但是娃哈哈就完全不一样了。他在这个过程中，等于有一堆的公司跟娃哈哈集团没有任何的股权关系，也没有任何协议控制，也没有说你挣了钱以后咱们怎么分。<br>这事都没有，他就自己做了这么一公司，自己挣钱。所以，现在的娃哈哈是品牌归娃哈哈集团，这个是一个可能40%多都是国资的企业。所有娃哈哈的生产、制造、销售、运输这些东西，都是在鸿盛饮料。</p>



<p class="wp-block-paragraph">至于说鸿盛饮料到底给了娃哈哈集团多少钱，说不清楚，也没有人去审计。他是这样的一个结构，就非常不正规。这个过程在互联网里经常遇到，什么呀，叫自己盗版。自己说我现在是一个小说网站或者是一个游戏网站，我这的游戏不太挣钱，那么我怎么办？我在外面再做一个网站，盗版我自己的游戏。</p>



<p class="wp-block-paragraph">那你说这玩意，何必费这个劲呢？差在哪呢？你盗版的小说和游戏，以后你不需要跟原来的作者分钱了。你说这个人是写了一本小说的，如果我放在原始的网站上去，那你需要跟他分钱。那你说我自己盗版了，另外一公司盗版了，这个钱就完完全全落在这个公司自己手里了，做着就没关系了。</p>



<p class="wp-block-paragraph">就跟这个出版社，你说我每次给你印书，多印个几千册，或者增加印数了以后不告诉你，这个过程其实是一样的。在这个过程中，国资自己其实没说什么，反而你们就买卖挣的钱，该给分给我就拿着。我就睁一只眼闭一只眼，我估计掌管国资的这些人自己肯定也都赚到了。但是从账面上来说，这事肯定有问题。</p>



<p class="wp-block-paragraph">达能当时跟娃哈哈就四处打官司，说你这个坑人，你违反了商业协议，你明明把商标授权给我的合资公司了，而且是咱们两家的合资公司。结果呢，自己又搞了一摊，违反了所有的这些协议。宗庆后出来说，他们骗我了，他们签的这个协议是不公平协议，是我被人坑了，所以这个事我就一定要反抗。</p>



<p class="wp-block-paragraph">怎么说呢，反正人家就用民族大义吧，折腾了几年以后，最终是娃哈哈把达能集团的股份买回来了。咱们别合作了，好说好散。你当时付的钱，我现在再付给你，你也没亏也没赚。我印象里大概是3亿欧元，重新把股份赎回。现在等于娃哈哈的所有品牌都在娃哈哈集团手里，达能就不跟他玩了。</p>



<p class="wp-block-paragraph">这就是他们当时做的一个事情。做完了以后，娃哈哈等于就彻底地走上另外一条路。娃哈哈是没法上市了，刚才我们讲的这个架构他是没法去上市，因为你有大量的钱在体外循环，而且这个钱跟你这个娃哈哈集团之间没有任何关系。</p>



<p class="wp-block-paragraph">所以宗庆后也做了四步原则，叫不负债、不发行债券、不贷款、不上市。但是现在哈哈也一直在传说，我们还是想上的。你上市一次还是可以造富，这个过程也还是在慢慢的发生转化。毕庆宗介后已经走了，现在是宗馥莉在负责。</p>



<p class="wp-block-paragraph">那你说有这么多问题，原来咋不爆发，怎么今儿爆发了呢？<br>达能的官司，靠着民族主义算抹稀泥，最后给抹过去了，收购了达能的股份，这事结束，合作就完事了。我不玩了。宗庆后在的时候，实际上他下的有一大堆的封疆大吏，这些人各自搞定自己一亩三分地的事。这地方有人闹事了，有人不乐意了，你去搞定。那地方有人闹事了，你去搞定。他们玩的就是这种，叫王权不下县的玩法。我只管搞上面这个大面上，你们下边自己的事自己搞。</p>



<p class="wp-block-paragraph">那么下边你自己有利益，自己有回扣，自己去拿去。他原来搞这样的方式。宗馥莉接班了以后，这帮封疆大吏就被削翻了，现在都是宗馥莉原来手下的一帮人在接所有的这些核心的管理层的事情。接完了以后，这些失事的封疆大吏自己还惦记着闹事呢，但是他们一般不会自己闹，他们会鼓动别人闹。封疆大吏发动群众把这事给闹起来了。</p>



<p class="wp-block-paragraph">自古造反的其实都不是农民，自古造反的其实都是地主。真正最后造反上来的农民实际上只有朱元璋一个，其他人都是地主，或者是以前那叫士大夫阶层。那你说像他这事，最后会有什么样的结果？职工代表大会和职工持股平台，这种事其实是符合全过程民主的这种运作机制的，翻不出花来。</p>



<p class="wp-block-paragraph">原来说我买那股票，甭管是按什么钱买的，哪怕是零对价买的，反而我们也可以做出一整套的规则来，让你看，大家投了票了，大家同意了啊，多少以上同意了，我们来做一个流程，做一个备忘，这个事就能过去。所以这个是不可能翻花的，因为这个事要翻花，我们很多的根基就有问题了。</p>



<p class="wp-block-paragraph">自己在外边做的一大堆关联交易，这件事其实是牺牲了政府利益，也牺牲了很多其他股东的利益。这种事可大可小，肯定有不合适的地方，但这事未必违法。不要看着我前面讲的很热闹，这事就一定违法不一定。为啥？因为前面早期签的这种协议，相对来说都比较松散，可能压根就没有规定这件事。他没有规定说政府拥有的这个品牌，以后你必须要得到一个什么样的授权，或者才能去使用，或者我必须要有百分之多少利益回来，可能压根都没说。</p>



<p class="wp-block-paragraph">所以这事未必违法，但是官字两张口，这个还是要看到时候的斗争的需要。如果斗争需要把你干掉，那么他们就会被牺牲掉。如果不需要，这个就是很好的民族企业家了。现在这个事情的组织者就是组织闹事，这个人肯定自己没有站在前排，一定是他发动的。但是这些组织者屁股底下肯定都不干净，因为原来宗庆后让下边那帮封疆大帝去管事情的时候，肯定一帮人底下都是拿了钱了。中国自古以来处理这种事情的方式是，什么叫擒贼先擒王。<br>这个也是一个惯用手段。如果能够快速定位到组织者，然后找到把柄把他们扔进去，再把一些核心闹事的，甭管扔进去还是安抚下去，这个事可以算抹过去了。国内其实靠这种员工持股平台运作的公司是蛮多的。但是有些公司是先去跑起来，融资了以后再去发员工股。但是也有像娃哈哈这样的，一开始大家就是一个集体企业，拿了国资以后，或者把国资的一部分入股以后，员工也变成一个大股东的，这种也有。一些老牌企业这种情况是蛮多的，这里头比较有名的一个是娃哈哈，另外一个是华为，福耀玻璃其实也是这么来的。</p>



<p class="wp-block-paragraph">但是呢，福耀玻璃已经上市了，账目应该还是清晰的，因为只要上市，你必须符合上市规则嘛。但是福耀玻璃是在A股上市的，这个账目到底是不是清晰，就当它清晰吧。员工持股平台其实并不是娃哈哈遇到的最大的问题，也不是包括像华为这样的企业遇到的最大的问题。因为员工持股平台只要是企业蒸蒸日上，只要是愿意给大家分钱，比如华为也是那样，大家可以按照股份去分钱的，把各种问题都可以掩盖掉，没有毛病，只要分红权保障，员工对于决策权通常是没有什么要求的。而且都是觉得任正非你就是神啊，今后你就是神，大家都像神一样，像爸爸一样崇拜他们。</p>



<p class="wp-block-paragraph">但是一旦是从蒸蒸日上变成稳中向好，又动了员工的分红权了，那就要出事。你比如像华为这样的企业，每年有这么高的利润，跟他合作的人其实都是亏钱，包括赛里斯这种，亏得跟什么似的。所有跟他一块造车的人，其实除了问界之外，其他所有车基本上都趴街了。在这样的一个情况下，每年利润高高的，为什么？因为他有这么多的员工，包括这么多的离退休员工，都在等着华为股票分红。一旦哪天说这个股票不分了，或者说跟娃哈哈玩这个事似的，我给你把股票回购了以后不分了，那肯定就要闹出很多的幺蛾子出来。</p>



<p class="wp-block-paragraph">那么这些公司里头最麻烦的其实是这种关联交易。像娃哈哈搞的这套事情，现在他们讲究娃哈哈有两个娃哈哈，一个是国资持股的，另外一个就是完完全全由宗馥莉持股的。这个公司所有挣钱、所有运作的都是在宗馥莉这头。国资持股那头呢，反正大家睁一只眼闭一只眼，这事往前走就完事了。这块其实才是比较麻烦的，就像去年司马南去逮柳传志一样，这里头有很多事，你干其实没毛病。你说我把它在律师的帮助下把这个手续走全也没问题。但是很多事呢，你是不能放在桌面上来说的，比如当年柳传志说中科院那块地，你是怎么变成你自己的了，或者变成联想的了。<br>咱们在这个过程中做的价格对不对？当时这个价格对不对？现在对不对？好多这个话是没法讲的。这一块可能会给很多这样的企业带来很大的麻烦。所以，他真正的麻烦叫利益非公允的分配，而且这些东西是禁不起审计的。包括像华为现在也没法去上市，你上市把所有人都审计掉。虽然华为每年会去公布财报，但是他这种财报就是自己看，看完了以后自己改，改完了以后拿出来说到底有多少真的多少假的，反正大家自己开心就好了，没有那么关键。</p>



<p class="wp-block-paragraph">很多这种老企业的共性是国资持股，员工建一个持股平台，外部也有一些投资，再有一些这种经销商持股。经销商股东其实挺麻烦的，谁是一代对经销商股东？就是格力专门有一个大股东，就是他的经销商。所以他现在拿这些经销商也没有办法。电商想去赚这种新的零售什么的，这些经销商说我不同意，这个事你就没招。</p>



<p class="wp-block-paragraph">在时间比较宽裕的时候，前景也比较光明的时候，这些一团烂账的企业其实是可以坐下来慢慢改的。像联想也改了，把自己改上市了，福耀也把自己改上市了。他其实是可以有机会去改。你在改的过程其实也没有那么复杂，先把员工的劳动关系理顺，然后再去说我们跟各个公司之间，要么去签股东协议，进行入股，进行并购，或者说我们干脆去签一些协议，控制或者是公允的利润分配协议，把这些协议都签死了以后，这个东西还是可以经得起审计，可以上市的。但是要有时间，还要有光明的前景。</p>



<p class="wp-block-paragraph">如果说没有时间了，很着急的时候，大家对未来没什么信心的时候，就会暴雷。娃哈哈的未来会什么样呢？第一个，这个瓜肯定还有得吃，未来还且吃瓜。另一个是最终其实还是要看关系，以及看未来的一个时势。比如说政府希望娃哈哈一直活下去，那么这些员工就会被镇压。如果又出来说万恶的资本出来，像司马南这种人，你像司马南当年去骂柳传志的时候，骂了一年还是两年，柳传志没法还嘴，任何说司马南的人都被删掉。现在司马南不见了，柳传志又变成民族企业家了。这个里头其实跟对错没有那么大关系，做的比娃哈哈过分的其实多了去了。娃哈哈能做到这么大，肯定还是在一定的规则范围内的，也算是一个过往历史，留下来的一些余想。</p>



<p class="wp-block-paragraph">这种很混乱的公司治理架构，我记得应该是在2000年前后的时候。当时中关村还是有很多公司呢，讲说困扰中关村最大的问题是什么？就是治理的结构、运作的方式以及他们的所有制是不匹配的。像联想中科院的很多公司，上面的大股东是国家，但是呢，真正运营这些公司的人又不服气。<br>后来，大家把这个问题有些解决了，有些就这么挂着。解决的方式就是，我引入一些外部的资金，赎买也好，或者说国资。你现在有一个代表挂着就完了，到时候只管分红，其他啥也甭管了。通过这样的方式，慢慢地稀释国资，让这些企业才能发展起来。娃哈哈可能也该走到这一步了。这就是我们今天讲的第二个故事：娃哈哈宗馥莉被员工起诉的故事。</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
