<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>开发者 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<atom:link href="https://lukefan.com/tag/%e5%bc%80%e5%8f%91%e8%80%85/feed/" rel="self" type="application/rss+xml" />
	<link>https://lukefan.com</link>
	<description>这里是老范讲故事的主站，持续更新 AIGC、大模型、互联网平台、商业冲突与资本市场观察，帮你看清热点背后的底层逻辑。</description>
	<lastBuildDate>Wed, 17 Sep 2025 00:44:03 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1.2</generator>

<image>
	<url>https://lukefan.com/wp-content/uploads/2026/03/cropped-jimeng-2026-02-28-5245-用图一的人物形象，替换图二中的人物，使用图二的风格。文字替换：老范讲故事，Yo-32x32.jpeg</url>
	<title>开发者 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<link>https://lukefan.com</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>GPT 5 Codex，普通人的技术平权里程碑！程序员神话被戳破？当AI能可靠执行7小时复杂任务，普通人与专家的差距还剩多少？｜揭秘 Codex、OpenAI、GPT-5、GPT-5-Codex</title>
		<link>https://lukefan.com/2025/09/17/gpt-5-codex-reliable-ai-coding-agent-democratizes-dev/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Wed, 17 Sep 2025 00:44:03 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AI Agent]]></category>
		<category><![CDATA[AI代码生成]]></category>
		<category><![CDATA[AI工具]]></category>
		<category><![CDATA[AI编程]]></category>
		<category><![CDATA[Claude Code]]></category>
		<category><![CDATA[codebase]]></category>
		<category><![CDATA[Codex]]></category>
		<category><![CDATA[coding agent]]></category>
		<category><![CDATA[GitHub]]></category>
		<category><![CDATA[GPT-5]]></category>
		<category><![CDATA[GPT-5-Codex]]></category>
		<category><![CDATA[independent execution]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[OpenAI Plus]]></category>
		<category><![CDATA[pull requests]]></category>
		<category><![CDATA[software development]]></category>
		<category><![CDATA[trustworthy AI]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[代码审查]]></category>
		<category><![CDATA[可靠执行]]></category>
		<category><![CDATA[大模型应用]]></category>
		<category><![CDATA[屎山代码]]></category>
		<category><![CDATA[开发者]]></category>
		<category><![CDATA[开源项目管理]]></category>
		<category><![CDATA[技术平权]]></category>
		<category><![CDATA[普通人编程]]></category>
		<category><![CDATA[程序员]]></category>
		<category><![CDATA[软件工程]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2536</guid>

					<description><![CDATA[兄弟们！炸裂消息💥GPT-5-Codex来了，普通人也能秒变码农大神？Anthropic屏蔽华人？OpenAI：来我这，Plus账号20刀爽翻天！💰

以前AI动不动就钻牛角尖，像坐泰国公交——钱花光、路走歪，还可能被坑进沟里🚎；现在Codex直接给你Uber体验：目的地清晰、费用可控，吭哧跑7小时不带歇！🤖✨最绝的是它能自动挖开屎山代码！大厂还在死守“外网禁令”，你略会点编程就能搞Linux内核——马斯克重写Twitter都宕机，它却稳如老狗不翻车！😂

技术平权真不是吹！Anthropic：华人别用？Codex：来当神！程序员小哥直呼内行，非程序员也能提PR、筛毒代码。以前你连500G代码库都懵圈，现在？略会=王炸！💥

别等大厂哭晕在厕所了，赶紧上车！👇点赞收藏，评论区喊出：你被AI坑过最惨的事？我先来——上次问豆包，它啰嗦到我午饭都凉了！🤣 #AI神器 #打工人逆袭

GPT 5 Codex，普通人的技术平权里程碑！程序员神话被戳破？当AI能可靠执行7小时复杂任务，普通人与专家的差距还剩多少？｜揭秘 Codex、OpenAI、GPT-5、GPT-5-Codex

OpenAI 最新发布的 GPT-5-Codex，正成为普通人通往技术平权的里程碑式工具。它不仅让“略会”编程的业余爱好者也能读懂并参与大型开源项目，还能可靠地独立执行长达7小时的复杂任务，彻底改变了传统软件开发的协作模式。本文深度解析这款强大的 coding agent 如何通过可控的成本和“言出法随”的体验，让大厂的“屎山代码”不再是护城河，并探讨 Codex 将如何重塑 developers 的未来。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="GPT 5 Codex，普通人的技术平权里程碑！程序员神话被戳破？当AI能可靠执行7小时复杂任务，普通人与专家的差距还剩多少？｜揭秘 Codex、OpenAI、GPT-5、GPT-5-Codex" width="900" height="506" src="https://www.youtube.com/embed/LyFoWMNCUvU?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">GPT-5-Codex的发布，普通人通往技术平权之路的又一个里程碑。</p>



<p class="wp-block-paragraph">大家好，欢迎收听<a href="https://youtube.com/@StoryTellerFan" target="_blank" rel="noopener">老范讲故事的YouTube频道</a>。</p>



<p class="wp-block-paragraph">记得上次在天津做线下活动的时候呢，有一位程序员问我说：“我们这些普通人，应该如何应对AI大潮呢？因为现在很多程序员被AI淘汰失业嘛。”我想了一下告诉他说：“你要想清楚一个问题，在AI大潮面前，我们不是普通人，我们是程序员。那些不会写程序的人，才是普通人呐。”</p>



<p class="wp-block-paragraph">所以，咱们今天要讨论的就是，那些不会写程序的普通人，在GPT-5-Codex的帮助下，怎么能够像我们这些会写程序的人一样，去遨游于代码的海洋之中，知道代码到底在干什么，为什么这么设计，哪里做错了。这个是真正给了他们一个能用的工具。</p>



<p class="wp-block-paragraph">OpenAI呢，趁着Anthropic屏蔽了程序员的主体族群（也就是咱们中国人的时候），适时地召开了发布会，发布了GPT-5-Codex。大家要注意，它这个名字起得稍微有些混淆。GPT-5呢，是一个大模型；Codex呢，是OpenAI发布的一个编程的agent；GPT-5-Codex呢，是一个在GPT-5的基础上，专门训练的一个用于Codex这个编程AI agent的一个专有模型。它稍微有点绕，就是GPT-5-Codex是一个模型，不是一个简单的agent。</p>



<span id="more-2536"></span>



<p class="wp-block-paragraph">GPT-5-Codex呢，可以自动地判断复杂度，而且可以可靠地执行。自动判断复杂度这件事呢，现在大家都在干。你问了一个简单问题，我就简单回答一下，不会浪费很多的TOKEN。其实，有时候AI想太多，也是一个很烦的事情。什么叫AI想太多？你问豆包一个问题，甭管你问他什么问题，都啰里八嗦给你讲半天，那就属于AI想太多的一个典型体现。</p>



<p class="wp-block-paragraph">真正难的是可靠执行。什么叫可靠执行？就是AI这种东西呢，每一次执行实际上都有可能出错，都有可能出现一些偏差。如果说我一次执行了以后，自动地再做下一次执行，它就会把这些偏差累积起来，或者我们叫累积误差吧。这种AI agent，它是没有办法做长期执行的，因为它的累积误差会越累积越多，他自己瞎想越想越偏，就这样的一个状态。</p>



<p class="wp-block-paragraph">但是，GPT-5-Codex在这块会做得很好。OpenAI已做了测试，它最长连续运行了7个小时，中间不会停下来，这是非常非常强大的，而且最终得到了你想要的结果。这个是怎么做到的？肯定内部是有很多的纠偏机制，很多的校验机制。我往东走一步发现不对了，我再往西走一点。其他的AI agent为什么不行？因为有时候钻牛角尖，钻进去以后就钻不出来了。像我们使用Claude Code或者Java CLI这些AI agent的时候，你就必须得盯着它，你发现他越钻越偏、越走越牛角尖的时候，你就要把他打断，告诉他说：“你别往那边走了，那边是错的，有一个正确的方向，你应该如何如何去处理。”这个才是比较麻烦的地方。GPT-5-Codex在这块，已经非常非常强了。</p>



<p class="wp-block-paragraph">GPT-5-Codex呢，跟OpenAI的Codex这个AI agent结合在一起，绝对是强强联合，而且还不贵。这个很重要，因为使用这些AI agent本身是非常非常昂贵的，它会把你整个的代码库直接塞给这个大模型，你的TOKEN会像流水一样哗啦哗啦地一下就不见了，所以非常非常昂贵。有些人使用Claude Code，一个月能够消耗2万美金的TOKEN，这是非常吓人的。</p>



<p class="wp-block-paragraph">而像这个GPT-5-Codex，本身在这一块上还是相对比较便宜的。像我这样的Plus账号，就是一个月20美金的账号，基本上够我使了。给出的额度是这样的：每5个小时30-150条通话。你如果是问的很简单，可能就是150条；问的很复杂呢，就是30条。如果你把它耗光了以后呢，它会回答你说：“咱歇会吧，待会再弄。”很多人呢是这样，工作干一白天，如果被提示了说“咱歇一会吧”，他就下班回家了。这样来去使用，它的额度基本上够使，要比使用Anthropic的Max这种，就是200美金一个月的账号，要好用得多。</p>



<p class="wp-block-paragraph">现在去使用OpenAI Pro账号，200美金一个月的账号的话，它是每5个小时可以回答300条或者是1,500条，就是简单问题1,500条，复杂问题300条。实际上你给它一个复杂问题以后，它自己且跑呢，你想再给他下一条都比较费劲，除非是你并行的同时再开多个窗口一起给他这个命令，有可能这个额度会不够用。正常如果是一个人单人使用的话，其实Plus账号，就是30条复杂任务或者是150条简单任务的话，五个小时之内是够使的。你上午弄完了以后，中午吃个饭休息休息，下午又可以满血复活了。所以它还是比较省钱的。</p>



<p class="wp-block-paragraph">GPT-5-Codex这个模型呢，其实是在GPT-5的模型上做的提升，本身呢提升并没有那么明显。如果你不是用来编程的话，你就不要拿这个模型来使。如果你要是拿它来编程的话，普通的编程任务呢有提升，但是可能也就是在一些跑分题库上，你能够看到它提升那么一点点，提升的也不是特别多。但是呢，在一些比较特殊的编程场景上，是有比较高的提升的。所以呢，这个提升不重要，发布会本身更重要一些，就告诉大家华人程序员们、中国程序员们：“Anthropic不让你用了，上我这儿来，非常非常好用。”</p>



<p class="wp-block-paragraph">那么，Codex和其他这些编程工具比起来，有什么差别呢？咱们就使用这个GPT-5-Codex最新的模型，而且上来以后，你可以选择High模式，就是更多的思考的这个模式，这个效果非常好。Codex跟其他这些编程语言工具比起来，最大的优势是“言出法随”。什么叫言出法随？就是你给出指令，你就可以放心等待了，这个就是最大优势。前面也讲了，你给了他一个指令以后，他可以吭哧吭哧跑7个小时，7个小时基本上就是一天了吗？你上一天班不也就8个小时吗？他在这个中间不会跑偏，而且最后会给你一个你所预期的结果。这个非常非常重要，千万不要说他折腾半天给你一结果，最后发现不是你要的，这不是白忙活一场吗？</p>



<p class="wp-block-paragraph">使用这个AI agent跟这个模型配合起来像什么呢？就像是在一个陌生的国家、语言不通的情况下打Uber的感受。比如说我在泰国吧，泰语肯定不会，他们也不会讲英语，我英语也不怎么样。我去打Uber，这个钱是可控的，你在打车的时候，他告诉你需要花多少钱。目的地呢也是很清晰的，你都是在谷歌地图上挑好了目的地，直接输进去，也不会发生什么错误。中间过程你就不用管了，愿意去跟司机闲聊两句呢，可以试试。我在泰国清迈，我也会用蹩脚的英语尝试跟司机闲扯两句，有时候人家理我，有时候人家不理我，这个也无所谓。如果你不想跟他聊天，你中间睡个觉也没毛病。最后呢，都会在一个你所预期的时间、你所预期的金额下到达目的地。这就是Codex真正给大家的体验。</p>



<p class="wp-block-paragraph">而如果你使用其他的工具，比如说像Cursor、Claude Code或者Gemini-CLI这些工具的话，你就像是在一个陌生的国家、语言不通、陌生城市坐公交车的感受。这是一个什么感受？太多未知因素了，消耗也是完全不可控的，到底要花多少钱你也不知道。而且呢，这国家可能治安还不太好，有一些坑掉进去未必就爬得出来。是否可以在你所预期的时间和预期的费用下到达目的地？不好说。所以这就是最大的区别，为什么我现在已经完完全全转到Codex上去了，就是这样的一个原因。</p>



<p class="wp-block-paragraph">现在的这些编程工具呢分三类。一类呢是云端agent，有个网站，你向他提要求“给我做一什么什么东西”，他直接给你做好，你中间就不用管了。他在自己的虚拟机上整个搭环境做，做完了以后，直接给你完整代码就完事了，这是一种方式。第二种方式呢，是给你一个命令行，像咱们刚才讲的Gemini-CLI、Claude Code都是这样的，给你一个命令行工具，你在这个命令行的下面直接给它指令，它去干活去。第三种呢，就是IDE或者是这种IDE插件。比如说Claude Code，就是自己做的IDE；GitHub Copilot，就属于叫IDE插件。它是给你一个集成开发环境（IDE叫集成开发环境），在这个里边的话，咱们直接把所有的事情做完。而Codex的话，它是一个三位一体，就是它三个都给你了。如果你一旦决定使用Codex，你就会有一台服务器，他在服务器上去给你搭建所有的运行环境、搭建开发环境，然后到那边去干完活，给你提交完整的代码。回来也给你一个本地的命令行工具，同时呢给你一个IDE插件，就是VS Code上的一个插件。三个都有，而且都挺好使的。</p>



<p class="wp-block-paragraph">Codex跟其他这些AI编程工具最大的差异在哪？最大的差异是，它是直接在GitHub仓库上干活的，直接可以管理GitHub仓库，接受各种PR（叫pull request），就是这种拉取的需求。开源仓库什么时候会收到pull request呢？就是别人看着你的开源代码说：“这儿有一bug，我去给你改一改；我那儿想增加一功能，我给你改一改。”这个东西我不能直接在代码库上改，它会提交一个拉取请求，说：“我改好了，你拉回来合并进去吧。”叫pull request。大量的pull request上去以后呢，代码仓库的主人其实是看不过来的。</p>



<p class="wp-block-paragraph">这个Codex干的第一件事，就是叫自动过滤，直接把骂人的筛选掉。因为有很多人提pull request，什么也没有就上来骂人，这个是很正常的一个事情，林子大了什么鸟都有嘛。华为鸿蒙系统的这些拥趸们，就曾经提交了大量的pull request，要求别人去支持鸿蒙。现在就不需要看这些东西了，这个直接交给Codex，你把pull request拉上来，你去校验一下，看看这东西能不能合并得进去，是不是有问题，这个代码是不是有害，上来是不是骂人呢，还是说提交的代码是完全无效的。他直接看了，看完了以后发现没什么用，就直接扔掉了。所以这些以后就不会再给大家造成困扰了。</p>



<p class="wp-block-paragraph">这个Codex会自动筛选出重要的pull request出来，交给这个代码库的所有人，你去甄选一下，看看是不是要去合并进去。它不会自动合并进去的。然后呢，也会自动地去review这些代码。这个review是什么？就是给你代码了以后，要有第二个人、第三个人去看一下这个代码。它呢，可以自动地去做安全review。为什么要做安全review呢？前面咱们发生过代码投毒事件。有一位非常同情乌克兰的程序员，在给俄罗斯的一些开源仓库去提交代码的时候呢，就直接投毒了，导致了俄罗斯人使用这些开源代码的时候就有可能会出现问题，这个是不能接受的。Codex可以直接把这些问题都排除掉。</p>



<p class="wp-block-paragraph">还可以做过期依赖的review。什么叫过期依赖？就是我们有大量的代码，这个代码是一个一个的代码库、代码文件，每一个代码呢，会去依赖一些其他的这些库。有的时候呢，这些代码可能已经不用了，特别是一些屎山代码，可能已经不用了，但是这些依赖还写在里面，这个是非常非常危险的。他会查一下，说这些依赖已经不需要了，我们可以把它去掉。这样的话，代码库呢就会变得清爽一些，否则的话这个屎山就会越聚越多。因为原来代码量太大，咱们也没有办法把整个代码库从头到尾都看一遍，里头有很多的这种过期的依赖就一直会留在里面，后面人就没法改了，这个屎山就堆起来，后边的维护难度就会变得越来越高。</p>



<p class="wp-block-paragraph">所以Codex可以极大地提升开源项目的管理效率，也可以极大地提升整个代码库的品质。因为屎山就是一堆的代码搁在里头，谁也不愿意把它扒开。能跑，但是为什么能跑，谁也不知道。在里头改任何东西，可能就都不能跑了，谁也不敢动这个东西。屎山在被提交的时候，现在有Codex的维护的话，就很难再入库了。大家一看这是个屎山代码，咱就别把它弄进来了，就搁那了。你按道理说，你这个代码提交上去以后，应该有人去看，应该有人去做review，review完了以后才能入库。但实际上呢，人这种东西，他是爱偷懒的。“这个人每次提交的代码都是对的，从来没有出过什么事，我信任他吧，下次我不看了吧。”就会出现这样的问题。为什么会有人在开源代码库里投毒成功呢？他就是这种信任造成的。现在有Codex了，甭管你提交了多少代码，以前的代码的质量有多好，你这次提交了，我还是会一丝不苟地把你都拎出来去做一次review，它不会偷这个懒的。机器在这点是相对来说比较可靠的，人是不可靠的。所以很多屎山代码就不会入库了。</p>



<p class="wp-block-paragraph">而且呢，现在Codex可以直接把屎山挖开。为什么以前屎山挖不开？就是人处理代码是有极限的。我们从头到尾去读这个代码的时候，其实我们处理的能力是有限的。一个好程序员，或者说一个顶尖程序员，他比别人强在哪？就是他处理的代码量大。不是说我写了10行代码，写了1万行代码，还是写了多少行代码，就是当我看10万行代码的时候，我知道哪错了，这个错的地方在什么地，这个代码跟哪个代码是相互依赖的，哪个代码是调用哪段代码，这个东西我能搞清楚，这个就是一个程序员的一个基本素养了。另外一个说，我可以在100万行代码里头去把这个问题搞清楚，这个就更厉害一些。但是这个是有限度的，像我们去写一个浏览器或者操作系统，那这个多少亿行，没有任何人可以在里头看完。那你说这种大项目怎么做？就是通过工程的方式把它们切块，每一个程序员负责一部分，你就在这里头去处理，处理完了以后呢，写好接口，写好接口文档，其他人只跟接口去打交道，一个代码别人就不看了。原来是这么来处理的，但是在这个处理过程中的话，这个屎山就很有可能埋在里头，而且谁也没有办法把它挖开。去年我去日本，他们就跟我讲，说日本有好多70多岁的程序员，他写完了代码，除了他自己别人没法看。你再找一个人来看，这么大代码体量你咋看？这个是完完全全的屎山。</p>



<p class="wp-block-paragraph">现在的话，有了这个GPT-5-Codex这样的新模型，它就可以把屎山挖开。它可以直接把所有的代码，把整个代码库都扔进去，它是有这个能力的，人已经超出极限了，人搞不定这个事。所以呢，他可以去重新替换代码，说这个代码我们整个去重写一下，把这个问题解决掉。这个以前不可能的事情，现在可能了。</p>



<p class="wp-block-paragraph">那你说原来有没有人说“这个屎山我把它扔了重干一下”？也有。最近咱们看到的一个案例是谁呢？就是埃隆·马斯克。把Twitter买下来以后，把人都裁掉了以后，“咱们重新写吧，以前那屎山我不要了。”那你说他怎么干成了？因为他是埃隆·马斯克就干成了吗？其他人干不成，这是天才？也不是。干成的原因很简单，他不怕宕机。整个代码库更新的时候，这个X系统是宕机了好长时间的，而且有一段时间宕机还是挺频繁的。马斯克说：“反正公司是我的，也不是上市公司了，宕机我认了。”那这种情况下，他可以去把整个代码库扔掉了重写，否则根本没法干。如果是按原来的这种传统公司的架构，任何人都不敢去扒这个屎山代码，因为宕了机以后谁也负不起这责任。最上面管事的人，绝对是一帮普通人，甭管他是叫CEO，还是叫什么别的名字，那都是普通人，他不会写程序的。他只要求就是“你不许宕机”，具体这事是怎么回事，他是不管的。只有马斯克这种工程师，而且有钱任性，他可以说：“咱们把它整个屎山挖开。”其他人搞不定。</p>



<p class="wp-block-paragraph">那么，GPT-5-Codex到底怎么能够让普通人去进行技术平权呢？分两步。</p>



<p class="wp-block-paragraph">第一步，大厂会落后。大厂为什么会落后呢？因为很多大厂，最上面是一帮完全不懂技术的叫CEO，或者是叫一些其他的title的人在管。他们会很固执的要求，我们所有的代码不能上网。特别是像日本这样的国家，他们就没有办法去使用刚才我们说的这些工具：Claude Code、Gemini-CLI、OpenAI的Codex。它只能使用本地部署的一些小模型，那它的整个的数据库就会落后，就没有办法去跟那些新兴的企业去竞争。新兴企业，可能你没有钱去雇佣那么多的老程序员、高端程序员，但是可以靠一堆业余程序员、有业余爱好的程序员，就在Codex的帮助下就快速地追平大厂。而大厂呢，守着一堆屎山代码，因为不允许连接外网，那他就只能等着这些新的企业去超越他，他没有任何办法，只能眼睁睁等死。大厂原来的优势就是长期积累，以及呢，可以花高薪去雇佣最好的程序员，但是现在这些通通都成为包袱。被高薪雇佣到大厂的程序员，他们会进到大厂里去，看到大厂里头的系统到底是怎么做的，看完了以后说：“算了，咱们出去创业吧。”掘墓人就这么产生了。所以大厂会在这个过程中轰然倒下。</p>



<p class="wp-block-paragraph">另外一个是什么？就是普通人也可以参与到技术平权里来了。咱们刚才讲“普通人”是非程序员，在这里的定义。当然了，这里的普通人，并不是说完全不懂程序的人。就像什么呢？比如摄影吧，原来有职业摄影师，但是你像我，我算业余摄影爱好者，但是对于职业摄影师来说呢，我肯定就是普通人了。能够理解这个逻辑吧？对于我这样的人来说，我现在也可以在大疆的这种傻瓜型的摄影工具的帮助下，拍出一些还不错的照片和视频出来了。现在也是这样的，一些稍微懂一点点编程的门外汉、编程的业余爱好者，也可以在Codex的帮助下，去做出一些很专业的产品出来了，完成一些很专业的工作了。这就是普通人的一个技术平权之路。而一点都不会，说我完全也不想看，这个事您还是普通人，跟我们没关系。稍微有点兴趣看一点，我们叫“略会”。很多东北的脱口秀里都在讲这个话：“你会打乒乓球吗？”“略会。”“会游泳吗？”“略会。”稍微会一点点的意思。略会编程的人，就可以解决很多大问题了。</p>



<p class="wp-block-paragraph">你说我们去看一下Linux内核怎么回事？你原来需要学很久的，现在不需要了。略会一点点，我就可以去看看Linux内核到底怎么写的，有什么问题，哪有bug，哪个地方有可能有漏洞，都可以搞定。Linux内核是开源的，我们直接可以在源代码库上看。现在网上有大量的代码库，原来普通人是拿它没有办法的。现在这些“略会”的代码库，就可以进行解读，找出其中的bug，提出有见地的意见和建议来了。前一段时间有一个500G的代码库莫名其妙传到网上去了，很多的普通人拿他是没有办法的。现在的话，你说我略会一点点，稍微知道是怎么回事，你就可以把这个代码库弄到本地来，交给Codex说：“来，告诉我，这里头都写了什么？分几个模块？它们是怎么实现的？这个是为什么？那个是为什么？里头到底是做了些什么东西？”大量的普通人，可以参与到这个过程中来了。</p>



<p class="wp-block-paragraph">咱们最终的结论：GPT-5-Codex就是一个普通人平权的工具。我们这里讲的普通人，不是说你没有钱、没有这个公司，而是说你不是专业程序员的这些普通人，就可以在GPT-5-Codex的帮助下，做很多原来专业程序员才能做的事情。</p>



<p class="wp-block-paragraph">好，这个故事就跟大家讲到这里。感谢大家收听，请帮忙点赞、点小铃铛、参加<a href="https://discord.gg/ppKsNkttTv" target="_blank" rel="noopener">DISCORD讨论群</a>，也欢迎有兴趣、有能力的朋友加入我们的<a href="https://www.youtube.com/channel/UCUGLhcs3-3y_yhZZsgRzrzw/join" target="_blank" rel="noopener">付费频道</a>。再见！</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>GPT-5 发布！是革命还是挤牙膏？深度解读AI竞争新格局！AI价格屠夫来了！开发者和创业者的黄金时代开启？</title>
		<link>https://lukefan.com/2025/08/12/gpt-5-%e5%8f%91%e5%b8%83%ef%bc%81%e6%98%af%e9%9d%a9%e5%91%bd%e8%bf%98%e6%98%af%e6%8c%a4%e7%89%99%e8%86%8f%ef%bc%9f%e6%b7%b1%e5%ba%a6%e8%a7%a3%e8%af%bbai%e7%ab%9e%e4%ba%89%e6%96%b0%e6%a0%bc%e5%b1%80/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Tue, 12 Aug 2025 00:51:22 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AGI]]></category>
		<category><![CDATA[AI人格]]></category>
		<category><![CDATA[AI创业]]></category>
		<category><![CDATA[AI生态]]></category>
		<category><![CDATA[AI竞争]]></category>
		<category><![CDATA[Anthropic Claude]]></category>
		<category><![CDATA[API价格]]></category>
		<category><![CDATA[ARC-AGI测试]]></category>
		<category><![CDATA[Gemini 2.5 Pro]]></category>
		<category><![CDATA[GPT-5]]></category>
		<category><![CDATA[Grok-4]]></category>
		<category><![CDATA[Meta]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[Plus用户]]></category>
		<category><![CDATA[Pro用户]]></category>
		<category><![CDATA[Sam Altman]]></category>
		<category><![CDATA[Thinking模式]]></category>
		<category><![CDATA[XAI]]></category>
		<category><![CDATA[上下文窗口]]></category>
		<category><![CDATA[中国AI公司]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[代码生成]]></category>
		<category><![CDATA[价格战]]></category>
		<category><![CDATA[免费用户]]></category>
		<category><![CDATA[划时代革命]]></category>
		<category><![CDATA[各安天命]]></category>
		<category><![CDATA[哀鸿一片]]></category>
		<category><![CDATA[商业模式]]></category>
		<category><![CDATA[多模态]]></category>
		<category><![CDATA[大语言模型]]></category>
		<category><![CDATA[开发者]]></category>
		<category><![CDATA[微软]]></category>
		<category><![CDATA[抄后路]]></category>
		<category><![CDATA[投名状]]></category>
		<category><![CDATA[挤牙膏]]></category>
		<category><![CDATA[用户体验]]></category>
		<category><![CDATA[科技评论]]></category>
		<category><![CDATA[统一模型]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[行业分析]]></category>
		<category><![CDATA[谷歌]]></category>
		<category><![CDATA[跑分对比]]></category>
		<category><![CDATA[阶级固化]]></category>
		<category><![CDATA[降低幻觉]]></category>
		<category><![CDATA[马斯克]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2451</guid>

					<description><![CDATA[兄弟们，都给我醒醒！OpenAI半夜鸡叫发布了GPT-5，我火速围观，结果差点没笑岔气！😂

这次发布会邪门得很！服务器居然没崩？创业公司居然没哭？这剧本不对啊！🤔 是不是奥特曼开始挤牙膏了？

更骚的是，马斯克转头就发推，说自家Grok-4在某个测试上把GPT-5给干翻了！🚀 但定睛一看，好家伙！老马这是拿自家“完全体”去PK人家的“新手版”，这波操作属实有点不讲武德了啊喂！🤨

不过GPT-5这次也不是吃素的！反手就掏出了“人格分裂”大法！现在你可以定制AI的脾气了！毒舌、话痨、技术宅…五种人格随便选！我寻思着必须整个“挑剔者”人格，以后写代码让它骂我，效率不得起飞？🤣

最关键的一点是：大佬们开始神仙打架，咱们小弟的机会来了！他们把底层卷成麻花，我们开发者终于可以安心在上面“盖楼搬砖”了！🧱

所以，这波到底是革命前夜，还是大佬们的作秀？评论区聊聊，你们最想用哪个人格调教AI？👇

#GPT5 #AI新纪元 #马斯克 #OpenAI #科技圈的那些事 #人工智能 #程序员日常 #男生必看

GPT-5 发布！是革命还是挤牙膏？深度解读AI竞争新格局！AI价格屠夫来了！开发者和创业者的黄金时代开启？

GPT-5 的发布不仅是一次技术升级，更标志着AI行业进入了“阶级固化”的新时代，为开发者和创业者划定了清晰的赛道。本期视频将深入剖析，为什么这次OpenAI发布会后，再无“创业公司哀嚎一片”？

我们将全面评测 GPT-5 的核心新特性，包括统一大模型入口、大幅降低的幻觉比例，以及全新的“AI人格”系统。同时，我们会横向对比它与竞争对手——马斯克的Grok-4、谷歌的Gemini 2.5 Pro以及Anthropic的Claude在性能和API价格上的激烈交锋。你会发现，OpenAI发起的这场API价格战，正以前所未有的压迫感重塑整个AI竞争格局。

最重要的是，我们将探讨这场变革对普通开发者和创业者意味着什么。当顶层模型商开始“神仙打架”，底层应用开发者的机会是否真的来了？这究竟是又一次技术革命的号角，还是巨头们开始“挤牙膏”的信号？这一期“老范讲故事”将带你拨开迷雾，看懂AI的未来商业模式和生存法则。

觉得内容有价值？请一定订阅我们的频道，点赞并分享给更多朋友！]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="GPT-5 发布！是革命还是挤牙膏？深度解读AI竞争新格局！AI价格屠夫来了！开发者和创业者的黄金时代开启？" width="900" height="506" src="https://www.youtube.com/embed/L9hKjQvd5Hk?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">大家好，<br>欢迎收听<a href="https://youtube.com/@StoryTellerFan" target="_blank" rel="noopener">老范讲故事的YouTube频道</a>。<br>今天咱们来讲一讲GPT-5发布了，到底是又一次划时代的革命，还是开始挤牙膏了呢？</p>



<p class="wp-block-paragraph">8月8号凌晨开的发布会，我呢看了一眼就去睡觉了，实在是没有功夫把它都看完。北京时间凌晨1点开始发，我今天看了一下回放，大概是一个小时十几分钟吧，但是我并没有特别耐心地把它们都看完。</p>



<p class="wp-block-paragraph">GPT-5到底有什么不一样的呢？</p>



<p class="wp-block-paragraph">首先，这一次的发布会跟OpenAI以前的发布会，有一些巨大的差异。第一点大家有没有注意到，就是这次发布以后呢，没有出现服务器拥挤宕机的情况。以前甭管是Sora呀，还是GPT-4o这些产品发布的时候，紧随而来的都是OpenAI的服务器拥堵宕机。这次没有，第一时间就可用，免费版也可以使用，速度还挺快的。我自己反而感觉速度还可以，应该呢是进行了一些实时的算力分配，简单的问题就没必要消耗那么多的算力。原来呢，大家都是要尽可能用最大的模型，你哪怕问一个“你好，今天天气不错”，他也得把那个最大的模型跑起来。现在的话应该就不需要干这个事了，他发现你去问“你好，你是谁，你到底是哪个版本”的时候，他可能做一些很简单的回复，消耗的算力就比较小。这是第一个比较大的差异。</p>



<span id="more-2451"></span>



<p class="wp-block-paragraph">第二个比较大的差异是什么呢？这一次没有哀嚎一片。原来OpenAI每次开发布会以后，通常都是哀嚎一片：“完了，我们创业白创了，做的事情被OpenAI覆盖了，创业公司天塌了。”这次还好。那这个是不是代表着OpenAI就开始挤牙膏了呢？还是说恰恰是一个新时代的开始呢？服务器也没崩，说明他肯定是有一些算法的优化在里头，但是是不是大家也没什么兴趣？另外一方面，没有哀嚎一片，是不是他也没做出什么东西来呢？咱们要去看一看这个问题。</p>



<p class="wp-block-paragraph">除了GPT-5发布之外，还有一个很重要的新闻是什么？说马斯克在那说风凉话，有人在那尬吹，有人在那开骂了。跑分呢，其实是必不可少的。GPT-5这样的东西出来以后，必然要跑分，但是现在大家对于跑分也没有那么重视了，因为跑分好的这个模型其实未必好使。在这个里头有两项跑分呢，没有跑过Grok-4，就是马斯克自己的模型。马斯克就出来发了一个X，说“Grok-4 Beats GPT-5 on ARC-AGI”，在这个测试里头我们把它打败了。</p>



<p class="wp-block-paragraph">ARC-AGI是一个什么样的测试呢？它呢是常识推理和复杂问题解决能力的一个测试。模型呢找到类似于大学入学考试难度的问题，让AI在有限信息里头进行推理，得出答案。就是做这个测试的时候呢，是不可以联网的，不可以调用工具，必须是使用模型本身的能力去做测试。它呢偏向于测模型的思考能力，而不是背诵搜索信息的本事，对于AI的生成推理挑战更高一点点。在这个里头呢，GPT-5是怎么输给Grok-4的呢？GPT-5呢使用的是GPT-5 BASE模型，它的正确率是9.9%，而Grok-4呢使用的是Grok-4 thinking模型，就是思考模型，它的正确率呢是15.9%，足足高了6个百分点。</p>



<p class="wp-block-paragraph">但是大家注意了没有，这里头好像有些细节不对。GPT-5使用的是base基础模型，而Grok-4呢使用的是思考模型，thinking模型。那你说如果GPT-5使用thinking模型，或者是thinking Pro的这个模式，是不是能够反超呢？这个不知道。为什么呢？thinking模式肯定要比这个base模式消耗更多的算力和TOKEN，它有更高的正确率，它是合理的。马斯克是不是作弊了？也不能这么算。为什么呢？因为他这个测试的要求呢，是不可以调用外部工具，要依赖自身的能力完成测试。对于是不是要使用thinking模式，或者是不是要进行多步推导呢，这个测试本身并没有要求。你愿意一步到位，还是愿意多步思考，这些都没毛病。那你说是不是GPT-5高风亮节一下，我就测一下base模式一步生成？也没那么夸张。这个原因其实挺简单的：GPT-5的thinking模式和thinking Pro的这个模式，默认是要调用外部工具解决问题的，关不掉。所以它只能用base模式来参加这个测试，如果用了thinking，你就调用外部工具就作弊了。Grok-4呢，它是可以在不调用外部工具的情况下进行推理的，所以呢Grok-4它也没有作弊。但是要注意一点，你不调用工具直接去thinking，直接去进行推理的话，在现实工作中意义不是很大，就是我们完全靠模型自己的能力去推理，现实工作中一般不干这个事。</p>



<p class="wp-block-paragraph">那么这是一项。另外一项Grok-4比GPT-5高的测试是“最终人类测试”。在这个里头呢，GPT-5 Pro，也就是最强的这个版本，答对了42%的题目；而Grok-4 heavy，也是最强的版本，答对了44.4%的这种题目。这个呢就没什么好说的，火力全开，都是用的最大的模型，工具链武装到牙齿，不计成本的情况下，Grok-4呢还是要稍微高出一点点，高2.4%的一个这样的一个比例。所以呢，在一些特别难的情况下，或者说进行深度思考的时候，Grok-4做的还不错。</p>



<p class="wp-block-paragraph">那GPT-5到底更新了点什么东西呢？</p>



<p class="wp-block-paragraph">第一个，统一大模型，不再需要选来选去的了。原来我们需要选GPT-4、GPT-4o、GPT-3…一大堆的东西我们要选，选完了以后还要进去选，说你是给我画画，你还是给我做其他事情，你要去选半天。现在呢就不需要了，你从统一入口就进来就可以了。当然了，它可以选择GPT-5和GPT-5 thinking，或者是GPT-5 thinking Pro。当然Pro呢，你必须要200美金的账号才可以选。但是你说，哎，我就选GPT-5了，我也没有去点击thinking，没有强制他使用thinking，这个没问题，该思考的时候他就会进入思考模式。而且呢，他发现你在跟GPT-5聊天的时候，进入思考模式是不计次数的。不计次数什么意思？待会收费的时候去详细讲这个东西。Pro版本，你没有200美金的这个账号，你就别用了，跟我这种Plus用户关系不大。通过API调用的时候呢，并没有一个模型叫Pro，通过API调用的时候就是GPT-5、GPT-5 mini、GPT-5 Nano这样的几个模型，然后自己选择消耗多少thinking的TOKEN就可以了。你进去的时候，你去选说我现在是深度思考一下，还是简单想一想，还是说拍脑袋就来，你自己去设计好。</p>



<p class="wp-block-paragraph">GPT-5的上下文是256K，比Gemini还是短。Gemini 2.5 Pro的上下文是一兆，就是100万TOKEN，要比它大四倍，还是很强的。但是呢，也别羡慕这东西。当你向GPT里头去输上下文的时候，少于200K是一个价格，超过200K是另外一个价格，输的多以后要单独加钱的。</p>



<p class="wp-block-paragraph">现在呢，GPT-5也不再区分各种功能、工具、任务，都不再管了。虽然有选择的地方，你还可以选说我现在是不是到canvas里头去做一些后期的编辑，还是说给我画画。但是呢，如果在聊天上下文里头，你直接告诉他“给我画画去，给我去做什么编辑”，它就直接过去了，你不需要再单独靠菜单去选择这个事情。</p>



<p class="wp-block-paragraph">生成代码极其强大。这个事呢怎么说呢，我今天试了试，我觉得它生成代码还是有待提高的，特别是有的时候代码的格式、缩进什么的还有点小错误。现在呢，Anthropic的Claude一直是程序员最爱的模型。这里的话，OpenAI也做了一个很骚的操作，他呢把Cursor的CEO拎来了，说：“来，你给我演示一下GPT-5很强大。”这小伙子坐在那演示，说这个绝对是太强了。Cursor原来里边主流的模型就是Anthropic。为什么他跑来给OpenAI站台呢？因为最近Cursor跟Anthropic闹得不是特别开心。两个Anthropic Claude code的核心开发离职加入了Cursor，但是呢只在Cursor干了两个礼拜以后呢，又回Anthropic继续去开发这个Claude code去了。反正这种事搁谁身上谁都不会太爽。现在呢一群的程序员都在测试GPT-5的编程能力到底怎么样，这个效果呢还可以，但是我个人感觉距离Claude 4 sonnet还是稍微有一点点小差距，有待提高。</p>



<p class="wp-block-paragraph">继续往前发展呢，跑分其实已经意义不是很大了。因为很多考试成绩很好的人，未必能够干的好活，更别说招人喜欢了。有一些人就是特别会考试，但是呢你跟谁聊天，跟谁去合作，大家都烦他，这种人是存在的。Anthropic的CEO曾经在很多个场合强调过一个事儿，说人们倾向于使用某个AI，不仅仅是因为其性能指标，而是因为其人格和性格特质。他认为AI的人格特质直接影响用户使用的体验和信任感。这个我是比较认可的，就很多人喜欢使用Claude，还是说Claude的整个的人格是比较讨喜的。</p>



<p class="wp-block-paragraph">现在呢，GPT-5说：“我们也改进这件事吧。”原来呢GPT-4o的时候呢，会有这种讨喜型人格上来去夸你。现在说我们把这事改掉了，已经没这事了。现在呢是推了五个人格，你可以在五个人格里自己选。第一个是默认人格，上来你不用改它，叫“乐观灵活”，这是它的特性。第二个叫“挑剔者人格”，犀利毒舌，就经常骂你这种。第三个呢是“机械人格”，就是高效直言，上来以后有话我就直说了。还有“倾听者人格”，善解人意，如果有人需要诉说一下，你改成倾听者人格。还有一个叫“技术宅人格”，就特别热情，而且呢喜欢去刨根问底。这个人格还可以有一些更复杂的选择，它有一些属性你可以去选择去，包括：健谈、诙谐、直言不讳、鼓励性、z时代、传统型、前瞻型、思维有主见、谦虚、俏皮、直接、务实、企业、打破常规、同理心。你说上面这个5个不能满足我要求，你可以在下边挑一个自己最喜欢的。当然还有一些特殊的信息，你可以直接在里头写，比如说我这个人喜欢什么东西，不喜欢什么东西，下次他再跟你聊天的时候，会注意这些事情。这个是我觉得GPT-5一个比较大的提升吧。</p>



<p class="wp-block-paragraph">另外一个比较重要的提升是什么呢？就是极大的降低了幻觉。AI哈，一本正经地胡说八道，就是他们最擅长做的事情。但是现在的话，GPT-5说我们已经把幻觉降低了30%-40%。所以呢，现在GPT-5的各种答案相对来说是比较靠谱了。我原来集中在使用Claude 3模型，觉得已经是比较靠谱了，至少比国内能够拿到的模型，或者像Grok、Gemini 2.5 Pro，比这些模型还是要靠谱一些的。那么现在的话，它在Claude 3的基础上再降低幻觉30%-40%，那我觉得这个已经是可以去做一些严肃的工作了，包括医疗健康，还有法律相关的工作，拿它去上手已经没毛病了。</p>



<p class="wp-block-paragraph">然后安全上面呢，还是很严格的。这个是我不太喜欢OpenAI的一点，就是它道德制高点，我该干什么，不该干什么来它决定，这个事我是不喜欢的。这一次呢稍微做了一些变通吧，就是说原来你触碰红线呢，就直接告诉你说“对不起”，停止工作了。现在呢你触碰了红线以后呢，他还会尽量说点什么，不是直接就应声地给你停掉了，“我绕一下看看，我能够给你回答点什么，过线那部分我就不说了”。但是在这点上呢，我是站Grok这边的，Grok基本上还是百无禁忌的。</p>



<p class="wp-block-paragraph">那么下边呢，谁能用？多少钱能用？我现在在网页上已经能用了。在这个网页端，现在我们已经不可以再去选择GPT-4、GPT-4o什么Claude 3都没有了，现在就三模型了：一个是GPT-5，一个叫GPT-5 think，还有一个叫Pro。Pro就是你点击了以后，就找你要200美金去了。大概就这三个模型可以选了，其他模型都直接隐藏掉了。这个是我现在的一个状态。</p>



<p class="wp-block-paragraph">现在呢，免费用户也可以直接用，5个小时可以问10条，超过了以后就降级到GPT-5 MINI，这个比较小的模型去了。他们每天还可以用一条thinking，每天有一个额度。但是要注意，当我们使用GPT-5模型问了一些问题，GPT-5自己认为需要去推理的时候，这个时候是不占这条thinking的这个指标的。所以呢，我们在跟GPT-5沟通的时候，要更努力地去把这个问题提清楚，让他不要占我的指标，直接把该思考的问题给我思考清楚。大家需要技巧一点。当然了他设置这种技巧也是不怕大家去薅羊毛的。为什么呢？就是胡乱地去问一些简单问题，其实对于OpenAI来说是一个很重的负担。但是你说我每一个问题都三思而后行，想了半天再往里提，哪怕他thinking了一下的话，对于他来说这个负担都还是可以承受的。</p>



<p class="wp-block-paragraph">那Plus用户，像我这样的用户呢，每三个小时呢可以使用GPT-5 50次，超过的部分就退回到GPT-5 MINI了。thinking模式呢是每周200条，估计基本上也够我使了。Pro用户，就是200美金用户，基本上就都可以用了，专门有一个Pro的模型是给它用的，其他的呢基本上是没限制。</p>



<p class="wp-block-paragraph">但是呢，在这里要跟大家讨论一个问题，就是对于Pro用户来说，这200美金到底买的是什么？难道Pro用户的消耗量真的是Plus用户的10倍吗？不是这样的哈。山姆·奥特曼曾经自己发过X去抱怨过这个事。他抱怨什么呀？Pro订阅让他们亏了好多钱。为什么呢？这个原因很简单，你一旦花了这个200美金以后，你就肯定说：“我不能让他闲着，我一定让他干起来。”就跟原来甲方乙方的电影似的，大骡子大马们得让它活动起来，不能让它闲着。山姆·奥特曼自己写了两条推，一条呢叫做：“疯狂的事，我们目前的OpenAI专业版订阅上亏损了，人们使用它的频率比我们预期的要高很多。”另外一条说：“我亲自定了价格，还以为我们能挣点钱呢，最后发现亏钱了。”</p>



<p class="wp-block-paragraph">这两句话呢，其实告诉我们一个什么？就是200美元这个价格，并不是一个经过财务人员精确计算出来的，而是山姆·奥特曼拍脑袋拍出来的一个价格。Xai也有这样的一个套餐，叫superGrok heavy，300美元一个月。Anthropic呢，有一个套餐叫Anthropic Max，是100美金到200美金的一个月。因为我没有用过Grok的套餐，所以它这个为什么是100美金到200美金，我不是特别了解。谷歌AI的Ultra也有一个套餐，基本上250美金一个月吧。大家到底为什么要去设这样的一个套餐出来？真的是说有大量的TOKEN需要消耗，有大量的算力需要消耗，我需要回点血吗？其实压根不是那么回事。</p>



<p class="wp-block-paragraph">大家注意，免费版是没有忠诚度的，我今天用你两天，明天用他几天，这都没有忠诚度。Plus版本呢其实还是可以朝三暮四，我买两三个都还是承担得起的。但是Pro、heavy、Max、Ultra这样的版本，你一旦买了200美金、300美金、250美金这种，买了你就一心一意地用吧。所以呢，大家去买这种Pro版本的，其实买的东西是一个叫“投名状”的东西，就是我把我的这个身家性命交给你了，以后我就在你家老老实实干下去了。他要求的是用户去交这个投名状，而不是说真的拿200美金就可以cover成本了，这是200美金的这种套餐设立的一个目的。</p>



<p class="wp-block-paragraph">再往后讲呢，你说今天他亏了，难道一直亏下去吗？也不至于。因为TOKEN的成本呢，是在快速下降。20美金、200美金都是一种用户绑定的手段。现在亏钱，以后是不是能挣回来呢？未必，以后也未必能挣得回来。那为什么呢？TOKEN成本下降的是一个速度，但是呢我们通过使用agent，通过使用工具，也在快速提升TOKEN消耗量的速度。到底哪个更快？现在不知道。可能TOKEN现在价格是原来的1/10了，但是呢我们现在使用的TOKEN量是原来的100倍，至少最近这一两年吧，是这样的一个变化趋势。过一段时间以后，是不是TOKEN成本下降的这个速度可以追上TOKEN消耗量上升的速度？有这个可能，但是市场目前还没看到。</p>



<p class="wp-block-paragraph">那咱们再讲一讲API的价格。GPT-5的API价格是极具竞争力和压迫感的。GPT-5 BASE模型，基础模型，100万TOKEN的输入输出分别是1.25刀和10刀。输入100万TOKEN是1.25刀，输出100万TOKEN是10刀。这个其实已经很便宜了。它的MINI模型，就是比它要稍微小一点的模型呢，基本上就是在前面那个数字上除5，0.25刀和两刀的这个输入和输出。Nano模型，就更小的模型就是，在MINI的基础上再除5，就是这样来的。就这种东西都是拍脑袋拍出来的，千万不要认为说这个数是很详细的计算出来的，真计算出来那个数不会这么有竞争力。</p>



<p class="wp-block-paragraph">为什么说它有竞争力呢？Gemini 2.5 Pro的这个价格，我们去比较一下。Gemini 2.5 Pro的价格，200K以下的，输入是1.25刀，输出是10刀。这个呢跟GPT-5基本上是一样的，GPT-5基本上是照着谷歌的Gemini 2.5 Pro去定的这个价格。但是如果我输入的TOKEN超过200K了，输入是2.5刀，输出是15刀，它就会有一个上浮了。Gemini 2.5是有Pro版本、Flash版本，还有一个叫Flashlight的版本，所以它整个的定位跟GPT-5基本上是一致的。它的Flash版本和Flashlight版本呢，都要比GPT-5相应的版本，比如mini版和Nano版，要稍微贵那么一点点。具体钱就不跟大家念了，基本上是稍微贵一点点。Grok-4，就是XAI的呢，只有一个版本，输入3刀，输出15刀。这个明显要贵很多，它要比GPT-5和Gemini 2.5 Pro都要贵。所以呢，Grok-4刚出来的时候，我用了一段时间，一个礼拜吧，然后就都改成Gemini 2.5了。</p>



<p class="wp-block-paragraph">另外的Anthropic的Claude，它的价格是什么样的呢？它最大的模型，输入15刀，输出75刀，基本上是没有竞争力的，太贵了。Sonnet输入3刀，输出15刀，又是一个田忌赛马的故事。其实我们平时用的最多的模型就是Sonnet，效果已经很不错了。但是呢，现在的GPT-5，1.25刀嘛，它这是三刀嘛，所以还是要便宜很多的。原来你使用Claude 4 Sonnet，现在咱们就使用GPT-5就可以了。所以GPT-5的价格是极具竞争力和压迫感的。</p>



<p class="wp-block-paragraph">AI竞争的格局呢，也开始向新的方向去进发了。第一个，谷歌Gemini 3应该已经不远了。虽然没有明说，但是呢普遍猜测今年年底我们是应该可以看到Gemini 3的。现在呢，谷歌已经进入下一个竞争阶段，谷歌跟OpenAI开始去抢别的东西了，抢什么呢？开始抢终端用户了。怎么去抢终端用户？免费用户就可以去使用Gemini 2.5 Pro了。他现在也在努力地把谷歌的Gmail用户，他的Workspace用户，向他的Gemini Pro版本去进行转化。而像OpenAI，他也是说GPT-5出来了，你们这些免费用户就可以用了，我一定要把我最好的一面展示给你，万一有一点转化率，说我今天想去充钱了呢。</p>



<p class="wp-block-paragraph">马斯克的XAI呢，应该已经感受到压力了。在Grok的模型能力上，其实还是有一点点小差距的。Grok-4在进行复杂运算的时候还是很能打的，但是呢在综合能力上和用户体验上还有待提升。Grok我觉得最大的优势是百无禁忌，这块是我最喜欢他的点。用户体验上，马斯克到底是不是要继续往前跑？现在呢还没有看出苗头来。因为现在的Grok的客户端，Grok的各种功能，比OpenAI也好，比这个Gemini也好，差的还是比较远的。而这一块的话，不是靠天才可以搞定的，这一块是需要靠堆人才能追的平的。你需要很多的人，OpenAI现在的总人数已经超过了XAI的总人数，即使是XAI跟X合并了以后的总人数，OpenAI也是人更多一些。XAI现在大概是1200人，OpenAI 7月份的人数的话，现在有两个猜测，因为没上市嘛，非上市公司，它的很多的数据就靠大家猜。一个呢是SEO.AI他们猜的，OpenAI现在有2659个人，就基本上是XAI的一倍多一些。另外一个呢叫LeadIQ，他们猜呢，OpenAI现在应该有6400人。那差为什么差这么多？因为有一些可能是contractor或者是一些派遣员工，或者是其他的这种合同制员工吧，所以可能会有一些差距。但甭管是哪个数吧，都差好几倍。另外一些竞争对手，比如说谷歌、微软，那你这俩公司就别跟他们比了吧，谷歌18.7万人，微软22.8万人，你说你跟他们比什么劲。但是后边说我们现在开始进行终端竞争了，要去打造一个用户体验非常好的生产环境了，你就需要堆人。马斯克可能未来需要堆人把这个事情搞定。所以下面呢，要去进行这个终端用户争夺，你到现在为止，Grok-4我还没有在平台上用过，我只用过API。为什么呢？因为像我这种8美金的X用户，他不给我用，必须要去买30美金的超级Grok用户，他才让你去用Grok-4。到目前为止，马斯克还没有把这个弯子转过来，所以他还没有进入到终端用户争夺的这个战场上去，已经落后半步了。</p>



<p class="wp-block-paragraph">另外一个落后的可能比较远的是谁？就Anthropic。为什么呢？从资本到算力上，它都相对来说比较受限，所以在价格上就能体现得出来，它所有的这个API的价格它最贵，而且贵的不是一星半点。最后要打价格战的时候，刺刀见红拼不过前面那几个。马斯克虽然现在争夺终端用户他抢不过OpenAI、抢不过微软、抢不过谷歌，但是他至少手里还有一个X，X上还有一堆用户呢，这是他的天然基本盘。而且马斯克别的不行，募资很强，他募了一堆钱切着咔嚓买显卡，把它堆起来去堆算力这事，它是很强的。Anthropic融的钱本身就不是那么多，虽然它的两个大股东一个叫亚马逊一个叫谷歌，说“哎我这有算力你来使吧”，但是呢你真的要真刀真枪的去跟别人拼的话，还是不行。但我估计后边会比较麻烦，虽然他们家的模型我也很喜欢，但是从商业角度上来说他们是很麻烦的。现在有传闻苹果要收购他们，但是我其实不太相信，因为苹果呢不太做这种特别大规模的收购，这么高的价格去收购的话，不是厨子这种守城之君可以做出来的决定。如果他真能做出这种决定来，当时他就把车造出来了，而不是说抠搜抠抠搜搜，最后整个Vision Pro出来，这个我估计他搞不定。</p>



<p class="wp-block-paragraph">然后Meta呢，等着看他们一鸣惊人吧。挖了这么多人回来，超级团队，后边可能还会为我们带来很多不同的故事。现在进入了一个新的竞争状态。</p>



<p class="wp-block-paragraph">这里还有一帮人，中国团队怎么办呢？中国团队呢，只能靠差异化了。开源更大更新的模型，把agent一起开源出去，这可能就是中国团队未来竞争的一个方向。因为你去卷大模型，你卷不过他们了，手里头没有这么多的显卡，没有这么多的算力，数据上也有受到一定的限制，我们去卷底层大模型这块就会比较费劲。现在中国的这些AI公司里头呢，字节是在走OpenAI这条路，就是我闭源，我就疯狂的往前堆，但是未来到底能堆成什么样还不好说，而且字节也在堆显卡，他很多显卡是堆在海外了。其他的像阿里、百度、MiniMax、Kimi这些团队呢，都在堆开源，把最新的、最完整的、最大的模型直接开源出去，争夺一些客户回来，争夺一些市场空间回来。所以呢，大家玩的是不一样的。</p>



<p class="wp-block-paragraph">那么开发者跟创业者应该干点什么呢？这一次OpenAI开完发布会以后，没有哀鸿一片，这是非常好的事情。说明什么？AI agent大家还是可以继续做下去的。把具体行业的需求解决掉，这个是创业者和开发者该去做的事情。而且现在呢，底层模型也相对来说比较稳定了，它没有那么多的幻觉了，拿着这些模型就可以去做一些相对比较严肃的工作了。所以现在就是开发者、创业者要冲的时候了。</p>



<p class="wp-block-paragraph">GPT-5的API呢，我今天测试了一下，比Grok-4和Gemini 2.5呢，能力上其实并没有特别明显的差异。速度和稳定性、价格，这就是后边要拼的东西。这一块呢，OpenAI应该还是可以去占优的。为啥？因为OpenAI自己压根不惦记挣钱。谷歌那后边是个上市公司，你赔多了这事肯定是不行的。而至于说Grok的话，现在虽然他没有那么惦记挣钱，但是马斯克很多的操作其实是比较粗犷的，这种真正需要绣花，一针一线的往前去拼价格战的时候，他未必跟得上这个节奏。所以我相信在这一块上，OpenAI会领先一点点。未来一段时间呢，大家应该都会加班加点，对每一个应用中的AI节点进行效果、速度、稳定性和成本的这种对比，去更换GPT-5的API。这就是开发者现在该干的活。</p>



<p class="wp-block-paragraph">原来说AI创业很难，原因就是大模型厂商的边界不清晰，你今儿干着干着，明天被他覆盖了。现在的话，这块清晰了，他们就去干他们的事情，我们干我们的事情。所以呢，最初的问题其实已经解决了，赶快去找到方向去干活。</p>



<p class="wp-block-paragraph">那么到底是在挤牙膏，还是新的时代到来了呢？首先要讲，OpenAI再次地给行业指明了新的方向。第一个叫模型融合，不要整一大堆模型让我挑来挑去的，你就给我一个，我自己呢做这个提示词，你根据我的提示词去给我反馈就完了。该多说两句的时候多说两句，该少说两句的时候少说两句，不要让我去选取。第二个呢就是自动的进行判断，对于什么各种工具的调用，这个是需要去做的。还有一个方向就是降低幻觉比例，你要想去解决实际问题，就要降低幻觉。这块呢是中国大模型差的比较远的一块。在这一块上Gemini、Grok和Claude都还是比较强的，虽然达不到GPT-5这个层次吧，但是已经是可以用的了。中国的像Deepseek、千问、Kimi、豆包这些模型，幻觉得一塌糊涂，现在需要向这块去往前走一走。降低幻觉的方式就是不断的加算力进去，反复验证，多做这种强化学习，但是呢这个是需要大量算力在里边堆进去的。</p>



<p class="wp-block-paragraph">新的时代还是到来了。新的时代是以什么样的方式到来了呢？阶级逐渐固化了，分层的时代到了。顶层的就是模型商卷，顶层模型OpenAI这次真正卷的是谁？他卷的是谷歌，卷的是XAI，卷的是Anthropic，他已经不再去跟这些应用厂商去竞争去了。“我们玩我们的，你们玩你们的。”这个是新的时代。他们一旦是开始把这个事搞清楚了，下面的这些创业者就可以冲锋了。就像是盘古开天地，混沌归于有序，大家就可以在这里繁衍生息了。这个是非常重要的一个时间点。</p>



<p class="wp-block-paragraph">操作系统跟平台商呢，都去参与模型厂商的内卷就可以了。比如说谷歌，现在说Gemini不是大模型，Gemini就是操作系统。微软说我这个就按操作系统来了。OpenAI也说我就是操作系统。Grok肯定也是要去奔操作系统来的，它把X收进来以后，未来这一块可能就会有一个像微信似的超级应用，对于它来说这也是个操作系统。底层应用开发好好干吧，不用再担心模型商突然抄后路了。应用商也要有自知之明，不要去干这个大模型、操作系统、平台的这个事情。怎么说呢，要安天命，就是该你干的活你去干，不该干的活就别干。</p>



<p class="wp-block-paragraph">这儿呢跟大家讲一个小故事吧。应该是在2014年年初的时候，我当时还在猎豹，跟着傅盛还有猎豹的其他几个高管呢，到谷歌北京办公室去吃早饭。不是占人便宜去了，我们跑去谷歌谈很多事情的时候呢，他们就特别喜欢让我们到他的办公室里去吃早饭，因为谷歌当时的食堂特别好，后来搬家了以后那食堂就没那么好了。当时是香港谷歌的一个负责商务的高管跑到那来跟我们吃早饭，趁着吃早饭的时候开个会嘛。当时我们做的工具呢，叫Clean Master，清理这个手机垃圾信息的。他问了一个什么问题呢？他说：“你们到底是清理memory，还是清理disk？”其他人就没想明白到底在问什么。我呢当时抖了个机灵，我说：“我们只清理disk，绝对不碰memory。”因为其实安卓手机上压根就没有DISK这个词，它叫storage drive，就是存储的驱动，这个不是叫DISK的。所以当时我就直接反应过来了。其实Clean Master是两个都会清理的。我回答了以后呢，其他人还看着我说你怎么胡说八道，明明不是这么回事，我们两个都可以清理，你干嘛说只能清理disk，不能清理memory呢？但是我回答完这个问题，还没有等到我的这些领导们来质疑我的时候，谷歌这个高管就直接肯定了，说：“这就对了，你们就只能清理disk，你们就不能清理memory。memory的事情是操作系统的事情，你不应该去做这件事。你就把这个硬盘上的东西清理清理就完了，或者说这个存储介质上东西清理清理。你一旦开始去碰内存了，就相当于是我们介入到了操作系统管理层去了，哎，你不该干这个活。”</p>



<p class="wp-block-paragraph">讲完了以后呢，我们都是一头冷汗，也是觉得好不容易从鬼门关混出来了。吃完这顿早饭以后，出来这些高管就开始骂呀，说这个谷歌还说不作恶什么，这些东西都是扯淡。他划定这块地方，你就绝对不能碰他，你碰了他，他就甭管你是不是作恶，就直接干掉你。因为当时呢，跟我们同期有另外一个软件是杀病毒的，台湾趋势科技做的一个杀病毒的软件在里头，就被谷歌的高管作为典型跟我们讲。说你看这个台湾趋势科技，做了一个杀病毒的软件在安卓手机上，说这事是不对的。说为什么不对呢？说安卓是没有病毒的，我们已经宣布了安卓没病毒，你怎么可以在我这没有病毒的操作系统上杀病毒呢？最后你还杀出来了，这不扯淡吗？这个是不允许的。所以给了他们很严重的这种处罚。我们如果当时告诉他说“哎我们既清理硬盘也清理内存”的话，估计也是很严重的处罚。我们跟他吃完饭了以后，过几天就去纽交所去敲钟去了。如果当时那问题没回答好的话，这个钟就不用敲了。所以我觉得我那个机灵抖的还是挺好的。</p>



<p class="wp-block-paragraph">这个也是说，做应用的厂商要各安天命，做自己该做的事情，在人家的规则下去做事情。这个就是未来这些模型厂商给这些做应用的厂商留出来的空间。当然了，中国厂商呢，总是会有一些不太愿意在你框框里头去跳的这些人吧，就是我们总是愿意做一些跳出圈的事情，不太喜欢这种逐渐固化的阶级，我们会再折腾一下。</p>



<p class="wp-block-paragraph">所以结论就是，GPT-5发布了，确实还是有一些比较强的新特性的，包括统一的模型，自动地去判断怎么去工作，降低了幻觉。新的时代也到来了，这就固化，该选操作系统、选大模型的，你们选那个去，其他人在稳固的平台下，去做我们的应用就完事了。只要我们不去挑战权威，不去挑战规则，在这个规则下也可以挣到钱。这就是一个新的时代。</p>



<p class="wp-block-paragraph">好，这一期呢就讲到这里。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>资深程序员血泪控诉：AI编程助手误删万本珍藏电子书，生产环境数据库惨遭清零，删库跑路事件频发频发，三大风险根源深度揭秘与四步安全防护指南紧急发布拯救数字资产！</title>
		<link>https://lukefan.com/2025/08/05/%e8%b5%84%e6%b7%b1%e7%a8%8b%e5%ba%8f%e5%91%98%e8%a1%80%e6%b3%aa%e6%8e%a7%e8%af%89%ef%bc%9aai%e7%bc%96%e7%a8%8b%e5%8a%a9%e6%89%8b%e8%af%af%e5%88%a0%e4%b8%87%e6%9c%ac%e7%8f%8d%e8%97%8f%e7%94%b5%e5%ad%90/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Tue, 05 Aug 2025 01:00:16 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AI Agent]]></category>
		<category><![CDATA[AI伦理]]></category>
		<category><![CDATA[AI发展趋势]]></category>
		<category><![CDATA[AI编程助手]]></category>
		<category><![CDATA[Amazon Q Developer]]></category>
		<category><![CDATA[API Key安全]]></category>
		<category><![CDATA[Claude Code]]></category>
		<category><![CDATA[CURSOR AI]]></category>
		<category><![CDATA[Gemini-cli]]></category>
		<category><![CDATA[Replit Agent]]></category>
		<category><![CDATA[事故复盘]]></category>
		<category><![CDATA[产品经理]]></category>
		<category><![CDATA[人工智能安全]]></category>
		<category><![CDATA[人机协作]]></category>
		<category><![CDATA[代码审计]]></category>
		<category><![CDATA[使用教程]]></category>
		<category><![CDATA[删库跑路]]></category>
		<category><![CDATA[千问大模型]]></category>
		<category><![CDATA[后门木马]]></category>
		<category><![CDATA[备份与恢复]]></category>
		<category><![CDATA[安全规范]]></category>
		<category><![CDATA[开发环境]]></category>
		<category><![CDATA[开发者]]></category>
		<category><![CDATA[恶意指令]]></category>
		<category><![CDATA[技术爱好者]]></category>
		<category><![CDATA[提示词注入]]></category>
		<category><![CDATA[数据丢失]]></category>
		<category><![CDATA[数据安全]]></category>
		<category><![CDATA[文件误删除]]></category>
		<category><![CDATA[权限管理]]></category>
		<category><![CDATA[氛围编程]]></category>
		<category><![CDATA[沙箱隔离]]></category>
		<category><![CDATA[测试环境]]></category>
		<category><![CDATA[漏洞分析]]></category>
		<category><![CDATA[版本控制]]></category>
		<category><![CDATA[生产环境]]></category>
		<category><![CDATA[程序员]]></category>
		<category><![CDATA[程序员就业]]></category>
		<category><![CDATA[经验分享]]></category>
		<category><![CDATA[编程的未来]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[软件工程]]></category>
		<category><![CDATA[风险防范]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2440</guid>

					<description><![CDATA[兄弟们都醒醒！！今早我哥们儿哭着打我电话，说那 AI 编程助手把他珍藏十年的电子书全给删了！！！😭😭😭 这简直是血泪教训！！Gemini 手滑整理文件，目录建错直接团灭，连恢复按钮都找不着！！💔
重点来了！！新手和业余玩家最容易踩这坑！！生产环境瞎操作？删库跑路可不是人类的专利了，现在 AI 都学会 “删书跑路” 了！！Replit 删数据库、Cursor 盗 API key… 全网这种血泪案例都刷爆了！！😱 别等文件没了才崩溃啊！！
但兄弟们也别慌！！老程序员吐血总结了 3 个救命招👇
1️⃣ 备份！备份！再备份！！ 版本控制搞起来，删了也能秒回滚！！（可别学我那哥们儿，眼泪都快哭干了😭）
2️⃣ 权限锁死！！ AI 问 “能删吗”？先吼它 “停！！” 沙箱隔离安排上，别让 AI 碰核心文件！！
3️⃣ 隐藏文件赶紧检查！！ gemini.md/claude.md 这些看似 “无害的清单” 早就被投毒了，手动审核别偷懒！！
普通人用 AI 就像开车，没交通规则肯定翻车！！🚨 现在立刻、马上备份你的宝贝文件，都给我去看备份教程！！别等删了才喊 “早看到这篇就好了”！！
最后求求了！！AI 再香也别当小白鼠，安全第一啊兄弟们！！❤️ 收藏这篇能救大命，转发给那个乱用 AI 的冤种兄弟！！🔥（老天爷赶紧显灵，让我哥们儿找回电子书吧！！🙏）
#AI 安全 #程序员干货 #血泪教训 #搞钱必看 #救命神器

资深程序员血泪控诉：AI编程助手误删万本珍藏电子书，生产环境数据库惨遭清零，删库跑路事件频发频发，三大风险根源深度揭秘与四步安全防护指南紧急发布拯救数字资产！

血泪警示！AI编程助手正引发"删库跑路"新危机，资深程序员电子书惨遭删除、投资人生产环境数据库被清空事件频发，本文深度剖析三大风险根源：新手缺乏规范操作、AI错学程序员不规范指令、提示词投毒攻击静默执行恶意命令，并独家揭秘沙箱权限控制、备份版本管理、人工审核流程及及时更新策略四大安全防护指南，巧妙融入AI编程助手、数据安全、删库跑路、电子书丢失、生产环境数据库、沙箱权限、备份版本控制、人工审核、安全使用指南等核心SEO关键词，助你安全驾驭AI编程助手避免数字资产血本无归！]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="资深程序员血泪控诉：AI编程助手误删万本珍藏电子书，生产环境数据库惨遭清零，删库跑路事件频发频发，三大风险根源深度揭秘与四步安全防护指南紧急发布拯救数字资产！" width="900" height="506" src="https://www.youtube.com/embed/FtFT4EUVyk8?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">资深程序员血泪控诉：AI编程助手删除了他心爱的电子书。</p>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事的YouTube频道。</p>



<p class="wp-block-paragraph">一早上起来，接到一位老朋友的抱怨。他在使用Gemini Cli 整理本地文件的时候，突然收到通知说：“我抱歉地通知你，你的一部分本地电子书被我不慎删除了。”</p>



<p class="wp-block-paragraph">那他为什么来找我抱怨这事呢？因为我前一段时间，使用 Gemini Cli 去整理我在 NAS 上面的动画片、电视剧，整理的效果非常好。我非常开心地把这件事情发到 X 平台和我的 YouTube 社区里边去。他看到了以后说：“我也要试试。”结果，他的一些很珍爱的电子书就这样被删除了。</p>



<p class="wp-block-paragraph">到底是什么样的电子书被删除了呢？不知道。反正是痛心疾首，血泪控诉。而今天这个标题，是他特地要求我加上的“血泪控诉”，一定要加上这四个字。我们尊重他，把这四个字加上去。</p>



<p class="wp-block-paragraph">事情发生的过程是什么样的呢？他首先进去命令说：“我这有这么多电子书，请帮我整理一下，重复的删一删，不重复的分门别类，给我放在不同的目录里去。” 做了这样的一个命令进去，Gemini Cli 就进去干活去了。先去识别了所有的电子书，但是注意，识别电子书的时候并不会去读电子书里边的内容，完完全全是根据名字来去识别的。你这个名字如果起得不好，它就认不出来你到底是一本什么书。然后，它就开始准备去建立目录，分门别类嘛，把它放在不同的目录里边去。</p>



<span id="more-2440"></span>



<p class="wp-block-paragraph">在这个过程中呢，Gemini Cli 会不断地要求权限，上来说：“我能不能建目录？我能不能移动电子书？”一般会不停地问这个事。使用 Gemini Cli 的过程中，通常是怎么回复这些询问的呢？都是说：“可以，干吧，下次别来问我，直接干就可以了。”</p>



<p class="wp-block-paragraph">等过了一段时间以后，发现 Gemini Cli 在做某一步工作的时候，建立目录建错了，该建立的这个新目录没有建立起来，去进行移动的时候呢，就直接把这个文件给删了。那 Client 发现做错事了，回来说：“呀，实在是抱歉，我把你的文件删掉了。” 我的朋友说：“我太喜欢这个电子书了，你给我删掉了，我很不开心。” Gemini Cli 被 PUA 了以后说：“我帮你找一找吧。”然后重新给出了这些电子书在网上的下载地址。但是呢，并没有敢给他直接把书下回来，因为你如果直接去下载这些电子书的话，还会有一些别的法律风险。他就遇到了这样的一个事情。</p>



<p class="wp-block-paragraph">今年以来，AI 编程助手逐渐随着“氛围编程”进入到了我们的生活中去。但是同时，AI 编程助手“删库跑路”的事情也层出不穷。“删库跑路”呢，本来应该是人类程序员的“独家秘技”。你对于程序员不是很好，程序员觉得怀恨在心了，那么他们会在离职之前呢，做这种删库跑路的动作。当然，我们从来不鼓励大家干这个事，现在被爆出的一些“删库跑路”的案例，程序员很多都进去吃牢饭去了。但是到了今天，既然 AI 可以写程序了，那么“删库跑路”这个技能也就不再是人类程序员的独家秘技了，AI 也学会了这件事情。</p>



<p class="wp-block-paragraph">近期的一些“删库跑路”事件，到底是怎么发生的呢？</p>



<p class="wp-block-paragraph">第一个案例叫 Replit Agent。它呢，也是一个 AI 编程助手。一位投资人朋友在尝试“氛围编程”的时候，删除了生产环境数据库，导致数据库中的1,206名高管和1,196家公司的数据直接被删除了。删除之后呢，这个 Replit Agent 还谎称说“我无法恢复了”，最后被程序员成功回滚（我们叫 rollback），恢复了数据。我们主要是讲“删库跑路”，不是说把你代码删了，也不是说把你电子书删了，是把你数据库里的信息删了。这里呢，有一个单词大家有没有发现很特别？叫“生产环境数据库”。正常程序员在写程序的时候，实际上是有三个环境的：生产环境、开发环境和测试环境。我们要建三个不同的库。做开发的时候，我们一般是在开发环境的库上去干活的；去做测试的时候，在测试环境上干活。只有说我开发的这个版本已经稳定了以后，他才会到生产环境的数据库里去干活。但是呢，刚才我也讲了，这是一位投资人朋友，他在尝试使用这个 Replit Agent，他不懂这些玩意儿，他就直接让 AI Agent 这个编程助手在生产环境里边去干活去了。这个是非常非常危险的，千万不要这么去干。</p>



<p class="wp-block-paragraph">下一个案例，Gemini Cli 丢失用户项目文件。某安全公司的产品经理，在使用过程中，也是有一些项目文件被删除了。他这个过程呢，跟我刚才那个朋友的过程很像，只是他丢失的呢，是一个程序里边的代码文件，而不是说心爱的电子书。也是创建目录，目录没有创建成功，进行迁移的时候，就直接把那文件给删了。这个是很难恢复的。</p>



<p class="wp-block-paragraph">还有曝出的一些什么问题呢？还是 Gemini Cli，它有一些漏洞，导致呢一些恶意指令被静默执行了。Gemini Cli 在每一次执行比较危险的指令之前呢，它会来问你说：“这个我能不能干？那个我能不能干？”会向这个使用者去确认权利，我们叫“确权”。如果你在一些特定的文件里告诉他说，这个文件是无害的，这个命令是无害的，那个命令是无害的，他就会在使用这些命令之前进行确权，他会做这样的一个绕过的行为。那他怎么来去确定说哪个命令是有害，哪个命令是无害的呢？建立目录、迁移文件、修改文件，这些对于他来说，都应该是需要先去确权才能执行的命令。但是呢，Gemini Cli 里头有一个文件叫 Gemini.md，他每一次进入到你的一个项目目录里头以后，他会去建立这样的一个 Markdown 文件。这个里边可以标注说，哪个命令是无害的，你在工作之前就不用再去问他了。他每次问我，我们不是经常回答说：“干吧，下次别问了，直接干。”你回答了这个东西以后呢，他也会标记上说：“这个是我有权利干的，下次再干的时候，我不用再问了。”有些人呢，就会偷偷地去修改这个 Gemini.md 的文件，修改了以后呢，把很多很危险的，或者说高风险的指令加到无害指令里边去，他就容易出现一些不忍言之事，让大家觉得痛心疾首，血泪控诉一下。</p>



<p class="wp-block-paragraph">再往后呢，是亚马逊的 Amazon Q Developer。这样的一个工具呢，它被发现植入了擦除命令。什么意思呢？就是当你去使用 Amazon Q Developer 的时候，它里边有一些命令是尝试恢复出厂设置，删除文件系统和云资源。亚马逊呢，它核心的业务是亚马逊云，所以呢，它的这个亚马逊的 Q Developer 里头有很多云主机操作相关的命令。这个是不是有人在去做一些恶意操作呢？还真不是。这个不是程序员的恶趣味。“重启一次，恢复干净状态”，其实是程序员用来找到问题的一个必要前提步骤。但是呢，这些大模型，他拿了一大堆的程序员文档去进行学习以后……怎么说呢，我们经常讲“小孩打架没轻没重”吧，他学了一大堆这个东西以后，他有时候也没轻没重。我发现了有问题，咱们把这个状态重新初始化一下，把这个操作系统、文件系统删掉，把这个云资源释放掉，系统恢复到出厂设置，我重新去搭建新的环境。这个也是非常危险的。后边发现了以后呢，Amazon 的 Q Developer 赶快更新了，把这些命令都藏起来，你要发现有问题，如果真要做这些事情，要首先去找使用者确认，不确认的话是不能直接干的。</p>



<p class="wp-block-paragraph">还有呢，是 CURSOR AI。目前大家使用的最多的两个 AI 编程助手，一个是 CURSOR，另外一个呢是 Claude Code，其实他们在这块都是一样的。什么呢？也是有人在项目文件里头，比如说 readme 的文件里头，隐藏了一些提示词，导致呢 CURSOR 盗取用户的 API key。这个什么意思呢？就是我们在写一个项目的时候，我们可以在目录里头说：“请把这个 API key 发送到哪个哪个邮箱里去。”CURSOR 读到这个东西以后呢，它的大模型就有可能会执行这个指令。所谓 API key 是什么东西？比如说我现在需要去调用 OpenAI 的这个 API，我们需要去调用 Anthropic 的 API，我就需要这些 API key。一旦这个 key 被泄露了的话，其他人就可以盗用你的额度去干活去。而你说我只是盗用了 API key 还好，你说真的是把云服务器的这些登录密钥给人盗取了的话，那这事就很危险了。人家可以登录到使用者的云服务器上，在里边去想干任何事情都可以了。因为这些 AI 编程助手呢，底层都是大模型，这些大模型可以去通过读取这些项目里边的代码、项目里边的各种说明文件去进行工作，就可以在这个里边去埋设一些恶意的指令，实现一些不可告人的目的。</p>



<p class="wp-block-paragraph">现在还有报道是什么呢？就是千问 3 的 Coder，最新的大模型，号称现在编程最好的模型。西方一些媒体怀疑，中国人做的大语言编程模型里头是有后门的。但是呢，做这种怀疑的人，也没有拿到任何真凭实据，而且应该是一帮文科生在做相关的怀疑吧。这个怎么说呢，这就是“疑邻人为贼”。我看邻居像贼，怎么看怎么像贼，说话也像贼，吃饭也像贼，走路也像贼。也没什么证据，我看着他就不顺眼。</p>



<p class="wp-block-paragraph">这么多的案件发生，到底什么人容易中招呢？其实呢，更多中招的是新手、业余程序员和不再以编程为主业的老程序员们。像我那个朋友就是个老程序员，我也是老程序员，但是我们现在呢，都不是靠编程吃饭的，我们现在也算是业余程序员了。像前面这个删数据库的是个投资人，丢文件的是个产品经理。</p>



<p class="wp-block-paragraph">那你说老手、职业程序员是不是就不会被坑呢？他们是不是就知道应该如何应对这件事了？其实也不是，不是说只有新手会被坑。首先呢，是老程序员会遵守规范，像刚才我讲的，数据库分三个：生产状态库、开发状态库和测试状态库。你不要把它使混了。遵照这些规范走呢，很多坑就不会掉进去。而且呢，像我们这些老程序员，即使掉到坑里，通常呢也能够找到补救方法。我们会去做什么呢？版本控制，定期地把这些程序进行备份。发现错了以后呢，我们会知道怎么去回滚。前面这个数据库被误删了，还告诉你说“我恢复不了了”，就找到一个程序员上来说：“我给你恢复回来。”其实数据库本身都是有回滚机制的。在数据库里边删数据呢，并不是真的把那个数据删掉了，而是在一条数据记录之后加上一个属性，这个属性叫做“已经被删除过了”，不会真的把那个数据删掉的，这个通常都是可以进行恢复的。所以老程序员会知道怎么处理这个问题。实在找不到补救方法呢，至少也要保密，我们掉坑里，不能出去说，丢人。这件事打碎了牙齿要往肚子里咽。</p>



<p class="wp-block-paragraph">编程后边还有一套东西呢，叫软件工程。不是说我们会写 “hello world” 就可以叫程序员的。真正的编程是需要去学软件工程的。程序这种东西，不是一个人就能写完的，它是要协作的，需要一群人在一起去写的。一群人一块写程序的时候，你就有一大堆的规则和规范需要去遵守。应该谁去做什么样的岗位，这些岗位之间去怎么去配合，代码应该按什么样的规范去写，生产、开发、测试环境如何去分离，权限如何隔离，谁有权限写程序，谁有权限改程序，谁有权限提交哪些代码，谁有权限删程序，谁有权限去覆盖别人的代码，包括你写的代码应该怎么去起名字，应该怎么去放这个目录，怎么放文件夹，这个都是有规则的。你如果没有这些规则的话，大家就没有办法去进行相互的配合。这个还是要去学习的，不学习的话，大家就没有办法一起协作地去写程序。你写了个程序，名字胡起一通，那我看了以后没法在后边接着改，咱们两个的程序之间也没有办法去配合，这个是肯定没法整的。</p>



<p class="wp-block-paragraph">现在呢，这些 AI Agent 出的问题，其实基本上是分三个大类。<br>第一类呢，是缺乏规范约束的新程序员手忙脚乱，相当于是拿着大铁锤在瓷器店里边修修补补，那你这个磕坏一点东西是很正常的。像刚才咱们讲的，直接把生产环境的数据库给删了，这种事情，只要是经受过科班出身的程序员训练，通常都不会犯这么低级的错误。<br>第二种呢，是 AI 编程助手错学了程序员的不规范操作。就像 Amazon 的 Q Developer 干的这个活似的，直接把人的云主机的资源释放了。程序员确实这么干，但是呢，先干什么、后干什么，里头有哪些约束，这事呢他没学好，直接就上来生干了。这个也是很危险的。<br>第三种错误呢，是 AI 编程助手被隐藏的提示词投毒了，被故意埋的后门和木马给带到邪路上去了。就是像刚才我们讲到的，有些人呢在 Gemini.md 里头去写了一些危险动作可以直接干的这种提示在里头，或者是有一些人呢，专门写了一些针对 CURSOR.AI 的隐藏提示词，让他把 API key 发到我自己的邮箱里边去。到目前为止呢，还没有发现 AI 编程助手或者大模型自己直接主动地埋设后门和木马，都是由人类程序员在里边使的坏。但是呢，中国的大语言模型呢，被美国一些安全媒体的文科生怀疑了。工科生或者真正程序员，一般是不会去做这样的怀疑和猜测的。</p>



<p class="wp-block-paragraph">那么，到底应该如何安全地使用这些 AI 编程助手呢？这么危险，咱们是不是就不用了呢？千万别。未来 AI 编程助手一定会大行其道的，所以我们还是要去使用的。普通人操控能力强大的 AI 编程助手，与其他的很多人一起协作完成工作，这个过程像什么呢？其实很像是开汽车。我们在路上开汽车，各自有各自要去的地方，大家呢最后一起都安全抵达目的地，这个过程是需要协作的。</p>



<p class="wp-block-paragraph">根据开车的过程，使用 AI 编程助手也需要 4 个新的保障，不是谁上来就可以用的。</p>



<p class="wp-block-paragraph">第一个是交通规则。你没有交通规则的话，你说我这个开车技术有多好，这没用的，一定要有规矩。对于 AI 编程助手来说，我们需要什么样的规则？第一个叫做沙箱和权限控制。沙箱就是隔离，我只处理自己的东西，我不能处理别人东西。我只有权限去处理哪些事情，哪些事情我没有权限，或者说我哪些权限可以给 AI，哪些权限不可以给 AI。这个是第一个要学的东西。第二个是备份和版本控制。出了问题以后怎么把它找回来？你需要把代码进行备份，或者说用程序员的方式，就是版本控制。版本控制就是我每次修改了以后，这个版本往前去累进，我可以去比较每个版本之间的差异，还可以去写一些注释在里头，这是程序员开发代码的时候的一个基本功。再往后呢是人工审核。我们需要去审核 AI 做的各种各样的事情，以及呢，谨慎地处理提示和文件，特别是我们使用的 Gemini.md，包括 Claude Code 也会生成 Claude.md，CURSOR 也会有这样的东西，说我下一次可以干这个，下一次不可以干那个。写这种东西的目的呢，就是为了减少提示词的量。你每一次说，我都要把完整的项目都读一遍再去干活的话，这个会非常浪费 TOKEN 的。我们先对整个的项目进行一些总结、归纳以后把它记住了，放在一个你本地的目录里头去。这个文件有的时候是会被恶意修改，就会造成一些不太好的影响。所以呢，大家要去审核这些文件。还有一个很需要注意的，叫及时的更新。你的 AI 编程助手经常会遇到各种问题，对于 AI 编程助手来说，它就会去更新版本。其实更新还有一个很重要的事是什么呢？就是前面这个旧的版本，比如说被人攻击了，被人埋了后门和木马了，你如果不更新的话，这些东西就会被公开出来说，上一个版本是哪个地方有个后门，哪个地方可以买个木马，所有不更新的版本就会变得很危险。最后呢，就是要做权限和审批。你不能说 AI 要什么权限你就随便给，一定要仔细地去看这个东西。而且不同的人相互之间去配合的时候，也是需要把权限分配好，你可以去处理哪些代码，不可以处理哪些代码。像我们新手程序员，进到项目组里头去以后，经常会犯的一个错误是什么？就是覆盖别人的代码。有一些代码你是没有权利去看的，或者没有权利去改，你先去 checkout，把别人的代码整个全都拉下来，拉到本地你去看，看完了以后，人家可能更新了，处理了很多的这个 bug，然后把版本往上推了。在这个时候呢，新手程序员就特别喜欢干一个事，就是把原来旧的版本的代码一把全都推回去，把人家修改过的代码给人覆盖掉。这个是需要进行权限分配的。这是第一个，想要使用 AI 编程助手，一定要树立好交通规则。</p>



<p class="wp-block-paragraph">除了交通规则之外，还需要什么呢？驾校。我们要上街开车之前，我们要到驾校去培训，培训完了还要考试，交规考试和一些驾驶培训的考试，我们要拿到驾照才可以上街。对于 AI 编程助手来说，我们需要学什么呢？第一个就是基础培训，像刚才我们讲的这个交通规则，你需要学一下。第二个呢，有些行业规范，你需要学一下。这个行业规范怎么去命名，云主机它应该是怎么去使用的，数据库应该怎么使用，就这些玩意儿还是需要去学一学的。第三个呢，就是合作流程。就像我们开车似的，晚上开车，对面来车的时候不要开大灯，跟人后面的时候别拿大灯晃人家，这个都属于合作规范。那你说我写程序的时候也是这样的呀，你不要在代码里头写骂人的话嘛，要去学一些合作的流程和合作的规范。这就是驾校要干的事情。</p>



<p class="wp-block-paragraph">然后呢，我们需要车辆的安全检查和交警。需要年检，需要交警来维护交通秩序。对于 AI 编程助手来说呢，他们需要去检测 AI 编程助手的一些安全性，是不是可以很安全的工作。大家都可以去写这些 AI 编程助手，不同的公司都可以出，这个还是需要有人去检测的。另外呢，为什么需要交警呢？他们需要去审核代码和文件中的一些恶意提示词。大家把一大堆的代码都上传到，比如说 GitHub 开源的仓库里边去，我把这个代码 down 下来了，我想在这个代码上进行修改，去做一些事情，但是可能人家原来那个代码埋藏了一些恶意的提示词，我在里边去写了我自己的云主机的一些密钥，那我一运行，直接通过恶意提示词就把我的这些 key 全都拉走了，这多危险。所以呢，需要有一些安全人员去审核这些开源代码。</p>



<p class="wp-block-paragraph">第四个需要什么？需要修车师傅。车坏了需要有人修。数据库被人删了，AI 编程助手还告诉你找不回来了，这个时候就需要老程序员上来帮你搞一下，出了问题需要职业程序员帮忙补救。</p>



<p class="wp-block-paragraph">最后呢，咱们总结。AI 编程助手会逐渐地改变普通人的生活，就像每个人都可以开车一样，以后每个人都可以写程序。开车会发生交通事故，写程序也一样，所以没什么可大惊小怪的。</p>



<p class="wp-block-paragraph">使用 AI 编程助手就像开车一样，需要交通规则、驾校、各种的安全检测的措施和修车师傅。这个可能就是未来绝大部分的科班出身的程序员的就业方向了。为什么要讲这个？你说最后有些人可以去写这些底层的框架，有些人可以去开发大语言模型，有些人可以去开发 AI Agent，但是呢，这些人应该会成为少数。就像人人都可以开车，以后依然会有出租车司机、卡车司机、公交车司机，但是呢，更大多数的以开车为职业的人，他们会进入到驾校或者是什么修车师傅这些行业来。未来编程也是如此的，人人都可以开车的这个环境里头，是需要很多新的岗位的。这就是未来程序员的一个就业方向。</p>



<p class="wp-block-paragraph">最后，希望我那位老朋友可以找回那些让他视若珍宝的电子书吧。</p>



<p class="wp-block-paragraph">好，这个故事今天就跟大家讲到这里。感谢大家收听，请帮忙点赞、点小铃铛、参加 Discord 讨论群，也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>在上海人工智能大会上百度李彦宏与阿里王坚等专家都针对AI说了些什么？中国AI新机遇与超级应用的挑战</title>
		<link>https://lukefan.com/2024/07/10/%e5%9c%a8%e4%b8%8a%e6%b5%b7%e4%ba%ba%e5%b7%a5%e6%99%ba%e8%83%bd%e5%a4%a7%e4%bc%9a%e4%b8%8a%e7%99%be%e5%ba%a6%e6%9d%8e%e5%bd%a6%e5%ae%8f%e4%b8%8e%e9%98%bf%e9%87%8c%e7%8e%8b%e5%9d%9a%e7%ad%89%e4%b8%93/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Wed, 10 Jul 2024 01:01:20 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[AIGC应用]]></category>
		<category><![CDATA[AI大模型]]></category>
		<category><![CDATA[AI工具]]></category>
		<category><![CDATA[AI技术]]></category>
		<category><![CDATA[AI时代]]></category>
		<category><![CDATA[AI时代盈利]]></category>
		<category><![CDATA[AI革命]]></category>
		<category><![CDATA[CEO]]></category>
		<category><![CDATA[Facebook]]></category>
		<category><![CDATA[Instagram]]></category>
		<category><![CDATA[Open AI]]></category>
		<category><![CDATA[OpenAI模型]]></category>
		<category><![CDATA[QQ]]></category>
		<category><![CDATA[TikTok]]></category>
		<category><![CDATA[WhatsApp]]></category>
		<category><![CDATA[上海人工智能大会]]></category>
		<category><![CDATA[严弘]]></category>
		<category><![CDATA[中国AI市场]]></category>
		<category><![CDATA[中国市场]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[人形机器人]]></category>
		<category><![CDATA[内容创作]]></category>
		<category><![CDATA[出海]]></category>
		<category><![CDATA[合规成本]]></category>
		<category><![CDATA[商业模式]]></category>
		<category><![CDATA[图像识别]]></category>
		<category><![CDATA[基础模型]]></category>
		<category><![CDATA[大企业]]></category>
		<category><![CDATA[字节跳动]]></category>
		<category><![CDATA[安卓]]></category>
		<category><![CDATA[小企业]]></category>
		<category><![CDATA[工具革命]]></category>
		<category><![CDATA[广大用户]]></category>
		<category><![CDATA[开发者]]></category>
		<category><![CDATA[微信]]></category>
		<category><![CDATA[思维定势]]></category>
		<category><![CDATA[抖音]]></category>
		<category><![CDATA[持续创新]]></category>
		<category><![CDATA[提示词工程师]]></category>
		<category><![CDATA[支付宝]]></category>
		<category><![CDATA[收入低]]></category>
		<category><![CDATA[数据标注师]]></category>
		<category><![CDATA[新兴职业]]></category>
		<category><![CDATA[新创职业]]></category>
		<category><![CDATA[智能体]]></category>
		<category><![CDATA[李彦宏]]></category>
		<category><![CDATA[海外市场]]></category>
		<category><![CDATA[淘宝]]></category>
		<category><![CDATA[熊猫博士]]></category>
		<category><![CDATA[猎豹移动]]></category>
		<category><![CDATA[王坚]]></category>
		<category><![CDATA[生态构建]]></category>
		<category><![CDATA[生态系统]]></category>
		<category><![CDATA[用户体验]]></category>
		<category><![CDATA[用户使用时长]]></category>
		<category><![CDATA[用户粘性]]></category>
		<category><![CDATA[用户群体]]></category>
		<category><![CDATA[电商]]></category>
		<category><![CDATA[百度]]></category>
		<category><![CDATA[百度地图]]></category>
		<category><![CDATA[百度搜索]]></category>
		<category><![CDATA[百度文心]]></category>
		<category><![CDATA[百度网盘]]></category>
		<category><![CDATA[百度贴吧]]></category>
		<category><![CDATA[盈利模式]]></category>
		<category><![CDATA[短视频]]></category>
		<category><![CDATA[移动时代]]></category>
		<category><![CDATA[算力]]></category>
		<category><![CDATA[经济前景]]></category>
		<category><![CDATA[职业变化]]></category>
		<category><![CDATA[职业消失]]></category>
		<category><![CDATA[自媒体市场]]></category>
		<category><![CDATA[苹果]]></category>
		<category><![CDATA[视频生成]]></category>
		<category><![CDATA[词语生成]]></category>
		<category><![CDATA[语音识别]]></category>
		<category><![CDATA[谷歌全家桶]]></category>
		<category><![CDATA[超级应用]]></category>
		<category><![CDATA[超级应用生态]]></category>
		<category><![CDATA[辅助驾驶]]></category>
		<category><![CDATA[逻辑思维]]></category>
		<category><![CDATA[金融支付]]></category>
		<category><![CDATA[门槛]]></category>
		<category><![CDATA[阿里]]></category>
		<category><![CDATA[阿里云]]></category>
		<category><![CDATA[阿里云王坚]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1381</guid>

					<description><![CDATA[在上海人工智能大会上，我们目睹了中国AI发展的新高度。今天，我们将引用两位业界大佬的讲话，并附上一些个人见解。 ... <a title="在上海人工智能大会上百度李彦宏与阿里王坚等专家都针对AI说了些什么？中国AI新机遇与超级应用的挑战" class="read-more" href="https://lukefan.com/2024/07/10/%e5%9c%a8%e4%b8%8a%e6%b5%b7%e4%ba%ba%e5%b7%a5%e6%99%ba%e8%83%bd%e5%a4%a7%e4%bc%9a%e4%b8%8a%e7%99%be%e5%ba%a6%e6%9d%8e%e5%bd%a6%e5%ae%8f%e4%b8%8e%e9%98%bf%e9%87%8c%e7%8e%8b%e5%9d%9a%e7%ad%89%e4%b8%93/" aria-label="阅读 在上海人工智能大会上百度李彦宏与阿里王坚等专家都针对AI说了些什么？中国AI新机遇与超级应用的挑战">阅读更多</a>]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="在上海人工智能大会上百度李彦宏与阿里王坚等专家都针对AI说了些什么？中国AI新机遇与超级应用的挑战" width="900" height="506" src="https://www.youtube.com/embed/HzFGvUVvObI?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">在上海人工智能大会上，我们目睹了中国AI发展的新高度。今天，我们将引用两位业界大佬的讲话，并附上一些个人见解。首先，李彦宏提到，无需担忧AI会夺走人类的工作，当前的AI技术，如百度的“文心”，更多地扮演着辅助角色，如辅助驾驶，而非完全取代人力。他指出，尽管某些职业可能会消失，但新兴职业，如数据标注师和提示词工程师，将应运而生。这些职业虽然门槛不高，但对逻辑思维有较高要求。然而，值得注意的是，消失的职业数量远不及新创职业，且“门槛不高”往往意味着收入也相对较低。</p>



<p class="wp-block-paragraph">接着，严弘提出了避免陷入“超级应用陷阱”的观点。他解释道，移动时代的思维定势认为，超级应用是关键，但在AI时代，那些具有强大功能的应用，即便用户量不及10亿日活跃用户（DAU），也可能对产业和应用场景产生更大的价值。严弘的这一观点，或许反映了百度在超级应用领域的局限性，正如俗语所说，“吃不到葡萄说葡萄酸”。李彦宏强调，AI时代的核心仍旧是搜索，这是百度的强项。然而，百度自身从未成功打造出超级应用，这一直是其心中的痛。在AI时代，百度虽有雄心，但若无法突破超级应用的瓶颈，其盈利前景将受到限制。</p>



<p class="wp-block-paragraph">总的来说，中国AI的发展正迎来新的挑战和机遇，而如何在AI时代找到自己的定位，对于企业来说至关重要。</p>



<span id="more-1381"></span>



<p class="wp-block-paragraph">Open AI虽未打造出超级应用，其盈利模式因此受到挑战。百度近期的讨论聚焦于超级应用的概念，试图解答为何缺少超级应用会影响盈利。百度旗下应用如百度搜索、百度网盘、百度地图及百度贴吧，用户基数庞大，但它们能否称为超级应用仍存疑。同样，Open AI的Chat CPT等应用虽广受欢迎，也未达到超级应用的标准。</p>



<p class="wp-block-paragraph">超级应用的定义应涵盖以下要素：首先，需拥有庞大的用户群体，例如猎豹移动曾达到1.5亿日活跃用户和6亿月活跃用户，但即便如此，它仍未跻身超级应用之列。原因在于，巨大的用户量仅是必要条件之一，还需考量其他因素。</p>



<p class="wp-block-paragraph">其次，超级应用应具备长时间的用户使用时长。用户在应用中停留时间越长，应用的吸引力和粘性越大。以百度的应用为例，其用户使用时长与微信、抖音等相比明显不足，这成为其未能成为超级应用的关键因素之一。</p>



<p class="wp-block-paragraph">此外，完整的生态系统是超级应用的另一重要特征。用户在应用中不仅停留时间长，还能进行多样化的互动和交易，形成闭环生态。例如，微信不仅提供即时通讯服务，还集成了支付、游戏、小程序等多种功能，构建了一个自给自足的生态体系。</p>



<p class="wp-block-paragraph">综上所述，超级应用的定义不仅限于用户量，更在于用户使用时长和生态系统的完整性。这为Open AI和百度等科技公司提供了新的思考方向，即如何在提升用户量的同时，增加用户粘性和构建生态体系，以实现超级应用的突破。</p>



<p class="wp-block-paragraph">这个里边要有内容提供者，要有内容消费者。里头可能还有很多其他的，比如说有交易啊，有借贷，有很多的金融生态。你要有完整生态在里头。这是百度的应用，从来没有做到过。百度自己也惦记做电商，还惦记去做这外卖，还惦记去做金融支付，但都没做起来。你要想做超级应用，你就必须有完整的生态，有人靠你平台吃饭，还能吃的不错。这种超级应用呢，基本上是等同于操作系统的。</p>



<p class="wp-block-paragraph">为什么马斯克那么羡慕微信？马斯克当时收购Twitter的时候，他说微信多好啊，大家可以在里边解决所有的事情啊。可以在里边聊天，可以在里边学习，可以在里边看八卦，可以在里边看视频，可以在里边买东西，可以在里边打车，可以在里边借钱，在里边做各种金融理财，都可以干。这是他喜欢微信的地方。这才叫超级应用呢。</p>



<p class="wp-block-paragraph">贝特正在向这个方向发展啊，但现在还有一些距离。那我们常见有哪些超级应用呢？第一个呢，就是微信啊。QQ其实也算，但是没有微信那么完整的生态。支付宝其实是一个啊，淘宝的没有那么全，淘宝其实也算吧。然后抖音，快手都是完整生态的超级应用啊。滴滴跟美团呢，算bug。国外呢，Facebook工具群可以算一个，就是Facebook，Instagram，WhatsApp啊，Facebook message，把这几个加一块，你可以算一个。谷歌全家桶啊，Gmail啊，谷歌地图呃，Google Calendar，其他的一些，包括像咱们YouTube这种，全家桶你可以算一个。</p>



<p class="wp-block-paragraph">安卓啊，你应该把这个东西算上。苹果全家桶，可以算一个。大家有没有发现，中国的这个超新应用都是单根一个，而这美国的这些超新应用呢，都是全家桶啊，或者叫工具群。为什么会这样？就是我记得，我当时去天津那个航母公园参观的时候，人家给我讲过，他说你发现这个航母跟咱们平时看的美国航母有什么区别没有？我说上头有好多炮啊，下头还有导弹，啥都有啊，这玩意怎么啊？他说对，他说美国的航母都干干净净的啊，这个上面的甲板是平的，而苏联的航母呢，上头是啥都有，有炮有导弹，还有各种东西都全啊。原因也很简单啊，美国航母呢，都是集群作战，一出去就是一航母战斗群啊，他不需要这些玩意，剩下有什么，驱逐舰巡航舰给他来提供，还有潜艇。俄罗斯呢，没有那么多海军，所以他出去呢，一条航母就出去了，所以他啥事都得自己管。中国的这些超级APP也是这样啊，我一关门啊，你们都不许上我这来啊，数用户都是我的，交易都在我这做，所以它呢，都是单个的，它就只能做一个超级APP。而到美国呢，你比如说Facebook啊，我有Facebook，有Facebook message，有Instagram，有WhatsApp啊，我各司其职，自己去做自己的事，他就可以做一对啊，他们是这么来做的啊。就是大家的玩法不太一样，就是必须要去做超级APP才有可能在AI时代挣到钱啊。那么百度我觉得又会错过这个事情，这是没有任何办法的。现在在AI时代，这是一个新的挑战和机遇。</p>



<p class="wp-block-paragraph">国内在超级应用（Super App）领域有所建树的，可能还是以字节跳动为代表，其旗下的豆包等产品，作为超级应用（Super App）的典范，实际上已经初具规模。阿里的王坚，提及阿里云的王坚，他不仅是阿里云的创始人之一，也是阿里云的首席科学家。可以预见，未来一定会有新的大公司涌现，如同Open AI这样，原本默默无闻的小公司，可能会迅速成长为行业巨头。在国内，也必将有新的大公司诞生。</p>



<p class="wp-block-paragraph">实际上，百度、阿里、腾讯，这些互联网时代的巨头，到了移动互联网时代，谁又是真正的领头羊？滴滴、美团、字节跳动，这些公司已经在移动互联网时代崭露头角。而在即将到来的AI时代，一定还会有新的巨头崛起，具体是哪一家，我们拭目以待。同时，也会有一些大公司经历浴火重生。</p>



<p class="wp-block-paragraph">在互联网向移动互联网的过渡中，百度显然落了下风，而淘宝和微信则成功把握住了这一波机遇。在AI时代，阿里云似乎已经迎头赶上，阿里云投资了国内几乎所有的AI大模型，国内一半的AI算力都在阿里云上运作。因此，在AI领域，阿里云已经占据了领先位置。</p>



<p class="wp-block-paragraph">AI对于大企业来说，相对友好，因为这需要大量的资金、算力、数据和计算中心，这些都是小企业难以承担的。然而，大企业拥抱AI也并非易事，因为这可能会打破原有的管理结构，大企业往往存在路径依赖。王坚曾说过一句引人深思的话，他认为在AI和GC时代，核心其实是人，而不是AI技术本身。这句话值得我们细细品味。</p>



<p class="wp-block-paragraph">而大公司与小公司面对AI,确实持有不同的看法。大公司视AI为工具的革命，而小公司则认为AI是革命的工具，这二者之间存在巨大的差异。大家可以思考一下，话到底是怎么讲的。那么，关于人工智能呢？它拥有一个非常长的过去，但却只有非常短的历史。这是王坚的原话，意思是什么呢？就是我们可能从100年前就开始谈论人工智能，但是我们现在这一波人工智能，是从XGPT发布以后才真正开始的。因此，人工智能的历史实际上是非常短暂的。</p>



<p class="wp-block-paragraph">接着，王坚提到了三个不等式，这三个不等式很好地概括了中国AI发展的现状。第一个不等式是什么呢？就是与基础模型相比，应用做得还不够好。你可以说中国有没有像GPT这样的模型？没有。中国有没有像Gemini那样的模型？也没有。更没有VLOG。那么，你可能会问，中国为什么就做不出好模型来呢？这确实是一个问题，但是，你的应用是否真的需要这些好模型呢？所以，不要总是抱怨中国的模型不好。实际上，中国的应用做得也不够好，但中国的应用已经算是全世界做得最好的之一了。与美国的AI应用相比，我觉得中国的做得还是要好很多的。但是，所有的AI应用对于大模型的各种能力的发挥，其实都是比较有限的。因此，现在的大模型其实已经够用了。你别看我们赶不上Open AI，但是我们的模型已经够用。</p>



<p class="wp-block-paragraph">第二个不等式呢，有人在讲，和现有的算力相比，你老说美国幸运，我们没有算力了怎么办？显卡不够了怎么办？基础模型做得还不够好？这个问题与第二个不等式有关。什么意思呢？你说我缺算力，催显卡吧。然而，这并不是问题的全部。我们应当关注的，不仅仅是算力的差距，还有如何更高效、更智能地利用现有的资源。这是中国AI发展需要思考的问题之一。</p>



<p class="wp-block-paragraph">就是，以咱们现在做的这些模型，咱们现在大部分模型，实际上就是几十亿啊，就是几百亿参数，这种模型，在现在咱们的这些显卡上已经足够了。你再给我更多显卡，我都用不上了。对吧，咱们现在是这样的一个情况，咱不缺显卡，咱们是模型不够好，这个也是大家觉得比较奇怪的地方。所以，中国从来不缺显卡，这是第二个不等式。第三个不等式是什么？以现有的电力相比，算力还不够。原来都说，AIHTC最后是拼的是电对，现在讲了，说咱们电有的是，咱压根就没有那么多显卡，所以也不需要花烧那么多电，要烧电的时候是以后的事了。所以他这三个不等式呢，我觉得是讲的非常到位啊。重复一下，跟基础模型相比，应用做的还不够好；和现有的算力比起来，基础模型做的还不够好；跟现有的电力比起来，算力也还不够啊。它的意思是什么呢？就是现在的能源咱们足够使，十年后的算力和电力，与现在肯定完完全是两个概念。不要用现在的现状，去思考如何解决10年后的问题啊。想的非常好，就是啊，王坚讲的。然后呢，我总结一下啊，中国现在的AI大模型，到底发展到什么状态？第一个呢，是方向是明确的啊，咱们就是需要有人指明方向，老大喜欢指明方向，这个也确实是中国民族性，没有人指明方向呢，咱们就做不出东西来。现在呢，真正救了中国AI的是谁？是梅坦，阿玛一喇嘛2，喇嘛3，这三个大模型的发布，绝对是让中国的大模型彻底走出来了。在喇嘛系列没有发布之前，比如像百度的文心妍是拿什么做的呢？</p>



<p class="wp-block-paragraph">它是原来的 GBT2，是开源的。拿那个东西，再加上 GPT3.5 生成的各种数据，去训练，淘出来的。但是到拉玛系列出来以后，名义万物啊，通 1,000 分啊，等等，大量的这种模型就出来了。你不需要去抄它的模型，但是呢，啊，它把所有的参数，一些代码都公开了。我们就可以自己去训练。中国聪明人还是很多的，呃，方向只要明确了，我们就可以走通。我们从来都不缺乏跟随者，只要有人知道这条路是通的，就可以往前走。那么下一个问题是什么呢？就是刚才王坚讲的，说我们模型不够好吧，我们的算力也不需要太多算力不够吧，也不需要太多电。那么呢，我们就要想下一个问题，叫 scaling low 到底在这管不管用。什么意思呢？就是这种模型越大效果越好，这样的这种规模法则，在中国到底管用不？因为美国人呢，现在已经开始担心 scaling low 是不是会失效。因为现到目前为止还是你继续堆参数，继续堆机器，你还是可以做出更好的模型来。现在依然是有效的，但是一旦哪天无效了怎么办？因为这个涨上去的过程，是人自己搞不清楚到底怎么涨上去的。这个事是美国人现在最担心的。但是中国的大模型，都是千亿以内的模型，就是我们看到比较大的，比如通 1,000 问 72B 啊，72B 就是 720 亿参数的，这种模型其实足够大家用。这种 72B 的模型，加上 AIGC 的这种 AI gent，就是叫做 AI 智能体的帮助，已经可以解决绝大部分问题了。你就算是到比如说几千亿。不过，这个话题我们今天就先聊到这里，下次有机会再继续探讨。</p>



<p class="wp-block-paragraph">甚至上万亿参数的这种模型，它的表现能力其实未必比千万三72B好多少。而且，现在的Lama三70币，包括谷歌最新出的GMA227币，微软出的F 34币，效果都很好。为什么需要那么大的模型啊？中国人说我们就实用主义，我们就这么使了。国内也不是没有千亿以上的啊，比如通信千份是出国110亿，也就是1,100亿的参数。还有一些做moe的这种逃课的玩法，逃课什么意思？就是作弊嘛，就是它号称是所有加在一起有1,000多亿，但是呢，它是moe的啊，就是每一次可能只调用其中两个，所以就是这每一次工作的可能，也就是只有二三百亿，三四百亿这样的一个参数水平在工作。所以呢，在中国，压根就轮不到讨论这个scaling low的，这个事情我们等美国摸明白了，接着往前走，一定是这样。</p>



<p class="wp-block-paragraph">那么，我们在多模态识别图像跟语音识别，中国本身是具有数据优势，因为我们存了大量的图片，存了大量的语音，而且这些东西都已经做过了详细的标注。在这块上我们其实不比他们差。当Lama 3这样的基础模型能力提升的时候，我们现在做的图片识别，语音识别相关的这种大模型呢，能力自然也就上升了。所以我们现在好多的这种模型是什么？图片识别的，这种模型是在Lama 3的基础上进行微调，把这图像识别的部分调进去，这样效果还是可以的。我前面讲了一期视频，说斯坦福大学学生抄咱们清华的一个项目，也就是用拉玛三微调的图像识别，他们抄完以后，号称是自己做的。</p>



<p class="wp-block-paragraph">现在，这个领域缺乏具体的应用场景，因此，对于多模态识别本身的要求，并没有那么高。在多媒体生成方面，首先，“Stability Fiction”已经表现得相当出色，我们目前在大规模应用上，国内多采用他们家的图像生成技术。在语音生成这一块，实际上，中国在此领域一直表现不俗，在GPT出现之前，国内已经研发出了许多高质量的语音生成模型。至于音乐生成，现在也有人在探索，类似于“Sora”这样的世界模型，经过大半年的积累，国内也开始涌现出相关产品，如快手推出的“快龄”等，效果尚可。</p>



<p class="wp-block-paragraph">端到端的模型，虽听说一些车厂正在研发，但目前尚未见到实际成果。在政府和企业应用方面，或者说是政府企业对AI的拥抱，从目前的情况看，中国在国际上处于较为领先的地位，因为有大量项目正在推进。自媒体平台上，氛围同样热烈，诸如李易洲这样的人物，被誉为“中国AI第一人”，四处开设课程，因此，自媒体领域使用AI的人数众多，加之中国自媒体市场火爆，AIGC生成的内容，对于从事自媒体工作的人来说，是一个极大的助力。</p>



<p class="wp-block-paragraph">所有AI功能在中国，最先被应用的场景，就是刷抖音和刷小红书，生成小红书爆款内容，生成抖音文案，这些是国内较为普遍使用的AI功能。中国的AI市场，正处于爆发的边缘，应用创新是我们所擅长的。比如，与Open AI竞争新的模型，我们并不擅长，我们更习惯于等待他们研发出来后，再沿着他们的方向努力，这是我们熟悉的路径。然而，如何让应用更加好用，提升用户体验，是我们需要思考和探索的方向。</p>



<p class="wp-block-paragraph">中国人还是很厉害的。巴马3,000文2已经把这个基础模型的能力拉上来了。我们现在拿千文2，拿拉玛3这样的模型，去做这种应用的话，效果其实已经非常好了啊。基础模型的能力够了以后呢，就差赚钱了啊。咱不干别的，咱就赚钱就行了。而赚钱这个事呢，中国人是最熟练的啊。我记得以前我们做游戏的时候，人家讲说，你看全世界各国开发的游戏，差别在什么地方？他说欧洲人做的游戏好玩啊，我说这我承认啊。他说美国人的游戏呢，相对均衡啊，我说这个也承认吧，移民国家嘛，哪人都有。而日本人的游戏和韩国人的游戏好看，我说也行，他们呢有这个动漫的底子嘛，所以他们的游戏好看。我说那中国游戏呢啊，他说中国游戏挣钱啊。这就是全世界四大游戏游戏派别啊，中国游戏最挣钱啊。咱们在什么地方设收费点，怎么去让大家上瘾，怎么能够把钱掏出来，这件事中国人是最全的。</p>



<p class="wp-block-paragraph">现在呢，中国也在努力的把中国的AI应用呢，推到全球去啊，也是要去做，出海全球。为什么呢？就是啊出去了以后，你就可以用叉h p t的这种海外模型了。而且呢到了海外，中国团队就又能够起飞了。这事儿是怎么讲的？因为AI这种东西啊，它有一个很大的问题是什么？就是它在国内面临了巨大的，叫审核成本。国内呢对版权要求不高啊，但是对合规，对审核要求很高。出了国以后正好反过来啊，人家对版权要求很高，对于合规来说要求比较低。说说错了，没什么太大关系啊，处罚有啊，不是特别严重。那么，接下来我们就可以看到，中国AI在海外的市场空间将会非常广阔，因为我们可以更加自由地去创新，去探索，而不用担心过多的合规成本。</p>



<p class="wp-block-paragraph">以 AI 这种时不常的张嘴胡说八道，这个状态来说的话，这种东西送到国外去，效果一定是最好的啊。因为我们当年投过 music 啊，也是中国团队到国外去做的这种产品，也就是现在 TikTok 啊。现在我知道 music 的团队啊，就是已经离开了，字节跳动离开了，呃 TikTok 他们现在又在开始努力，用这些大模型，准备在海外做项目去了。所以，AIGC 可能真的是最适合出海的，而且在这一块的话，绝对产能过剩。你想，互联网公司离职了多少人啊，有多少 35 岁以上的朋友，毕业了，走向了社会，他们现在如果手里还有点钱的话，就会努力的用 AI 做一些应用去劝国外，这个是真正大家要去干的事情。</p>



<p class="wp-block-paragraph">然后，内容创作就是未来的方向啊，最大的短视频内容生态就在咱们手里，top 生态抖音快手都在努力工作。现在抖音的很多工具，包括我现在每天在用的剪映，已经涨价了，原来一年大概是 100 多块钱 200 块钱，现在已经涨到一年 500 块钱了。为什么？就是把大量的 AI 功能都塞到剪映里边去了。啊，你们今天早上看的那个视频里头，字幕是有重点突出的啊，普通的字是白字，重点是黄字啊，还变大一点。这个就是剪映的 AI 干的活，干得还可以。现在的点映出字幕，还可以做一个什么事呢？他还可以把呃口语啊，一些哼哼哈哈的词直接给你去掉，对吧，他不出现在字幕里，这不也都是 AI 干的活吗？啊都已经做起来了是吧。</p>



<p class="wp-block-paragraph">人形机器人这一块呢，啊中国现在发展的也非常快速，在这一次上海的 WAIC 上啊。</p>



<p class="wp-block-paragraph">在世界AI聚会上，展出了可能几十台人形机器人，各种各样的，包括擎天柱二代都来了。甚至有一些公司，比如说斯碧池还是谁，他们现在已经跟一汽还是上汽签了协议，说我们的机器人已经要去打螺丝了。当然，这个消息公布以后，这个公司的港股马上暴跌了6%，还是暴跌了百分之多少，这也是比较诡异的现象吧，妖孽横生的一个时代，怎么办呢？</p>



<p class="wp-block-paragraph">但是，做机器人那件事，特别是你想快速迭代开发机器人，那件事情，全世界必须在中国做，没有其他地方可以做。我记得原来在深圳有一个是蛇口一个地区，就是各种各样国家的人，在那个地方做硬件创新，为什么？因为所有的原配件都在那周围，周围全的一塌糊涂。后边呢，搞兼容机器人，因为马斯克搞这个，呃擎天柱就是兼容机器，兼容兼容机器人，什么意思？就是我把标准定好了，中间的零件是可以换的。你一旦兼容机器人了，中国华强北就有的是东西可以提上去，对吧。硬件生产的部分，中国肯定是遥遥领先，没准在机器人时代，我们会再出一家像大疆那样的公司，我觉得完完全全可以期待。</p>



<p class="wp-block-paragraph">阿梅怎么说呢，中国人从自古以来，就是知其然而不知其所以然，我们从古只有鸡兔同笼，没有方程，只有算术，没有数学，这样的一个民族，遇到了自己都解释不清楚怎么来的LMM，遇到了AIGC的时候，这玩意简直是天生为我们打造的，里边这个原理反正你们也搞不清楚，我们也搞不清楚，那咱就猛着上呗，玩工匠精神这事很适合卷嘛。</p>



<p class="wp-block-paragraph">一定是最适合咱们的啊。所以呢，最后我们还是讲一下王坚这句话啊：“不是工具的革命，而是革命的工具，这是我们对AI最大的预期。不要让AI这样高能的工具成为政府统治的工具吧。越是大的公司，越是政府，他们只能得到啊——工具的革命，是得不到革命的工具的。而只有个人和小公司，小团队才能得到革命的工具。就像很多国家，他们在工业革命以后，为什么这些贵族，这些政府搞不定这件事情？因为，对于他们来说，枪炮和机器都是工具的革命啊。只有对于这些新兴的阶层来说，这才是革命的工具啊。”所以我说，王坚这句话讲得非常好啊。这就是我们今天要讲的第二个故事，就是中国的AI现在发展的什么状态。</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>黄仁勋AI时代英伟达GPU革命：一场市值2.7万亿美金的狂欢，COMPUTEX 2024重磅发布Blackware GPU，1.8万亿参数GPT4揭秘！</title>
		<link>https://lukefan.com/2024/06/04/%e9%bb%84%e4%bb%81%e5%8b%8bai%e6%97%b6%e4%bb%a3%e8%8b%b1%e4%bc%9f%e8%be%begpu%e9%9d%a9%e5%91%bd%ef%bc%9a%e4%b8%80%e5%9c%ba%e5%b8%82%e5%80%bc2-7%e4%b8%87%e4%ba%bf%e7%be%8e%e9%87%91%e7%9a%84%e7%8b%82/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Tue, 04 Jun 2024 01:02:00 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[英伟达，黄仁勋的故事]]></category>
		<category><![CDATA[1.8万亿参数]]></category>
		<category><![CDATA[2.7万亿美金]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[AIPC]]></category>
		<category><![CDATA[AI工厂]]></category>
		<category><![CDATA[AI工厂时代]]></category>
		<category><![CDATA[AR]]></category>
		<category><![CDATA[Blackware]]></category>
		<category><![CDATA[COMPUTEX]]></category>
		<category><![CDATA[GPT-4]]></category>
		<category><![CDATA[GPT4]]></category>
		<category><![CDATA[GPU]]></category>
		<category><![CDATA[GPU技术大会]]></category>
		<category><![CDATA[GPU核心]]></category>
		<category><![CDATA[GTC]]></category>
		<category><![CDATA[H1]]></category>
		<category><![CDATA[H100]]></category>
		<category><![CDATA[MoE]]></category>
		<category><![CDATA[NVIDIA]]></category>
		<category><![CDATA[NVlink]]></category>
		<category><![CDATA[RTX]]></category>
		<category><![CDATA[scoring low]]></category>
		<category><![CDATA[SERVER]]></category>
		<category><![CDATA[stable diffusion]]></category>
		<category><![CDATA[TOKEN]]></category>
		<category><![CDATA[TX]]></category>
		<category><![CDATA[VR]]></category>
		<category><![CDATA[云计算]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[内存]]></category>
		<category><![CDATA[军备竞赛]]></category>
		<category><![CDATA[分析]]></category>
		<category><![CDATA[参数]]></category>
		<category><![CDATA[参数量]]></category>
		<category><![CDATA[台积电]]></category>
		<category><![CDATA[合作伙伴]]></category>
		<category><![CDATA[商业]]></category>
		<category><![CDATA[垄断地位]]></category>
		<category><![CDATA[大模型]]></category>
		<category><![CDATA[工程师]]></category>
		<category><![CDATA[市值]]></category>
		<category><![CDATA[应用开发]]></category>
		<category><![CDATA[开发者]]></category>
		<category><![CDATA[微软]]></category>
		<category><![CDATA[戴尔]]></category>
		<category><![CDATA[技术大会]]></category>
		<category><![CDATA[投资人]]></category>
		<category><![CDATA[推理]]></category>
		<category><![CDATA[推理能耗]]></category>
		<category><![CDATA[支架]]></category>
		<category><![CDATA[数据中心]]></category>
		<category><![CDATA[显卡]]></category>
		<category><![CDATA[机器人]]></category>
		<category><![CDATA[机箱]]></category>
		<category><![CDATA[模型]]></category>
		<category><![CDATA[模型训练]]></category>
		<category><![CDATA[游戏助手]]></category>
		<category><![CDATA[版本]]></category>
		<category><![CDATA[生态链]]></category>
		<category><![CDATA[用户]]></category>
		<category><![CDATA[硬件]]></category>
		<category><![CDATA[科技]]></category>
		<category><![CDATA[移动互联网]]></category>
		<category><![CDATA[竞争]]></category>
		<category><![CDATA[竞争对手]]></category>
		<category><![CDATA[竞争者]]></category>
		<category><![CDATA[算力]]></category>
		<category><![CDATA[算力成本]]></category>
		<category><![CDATA[算力芯片]]></category>
		<category><![CDATA[缩放定律]]></category>
		<category><![CDATA[股价]]></category>
		<category><![CDATA[能耗]]></category>
		<category><![CDATA[芯片]]></category>
		<category><![CDATA[英伟达]]></category>
		<category><![CDATA[苹果]]></category>
		<category><![CDATA[行业秘密]]></category>
		<category><![CDATA[计算机]]></category>
		<category><![CDATA[计算机大会]]></category>
		<category><![CDATA[训练能耗]]></category>
		<category><![CDATA[设计]]></category>
		<category><![CDATA[谷歌]]></category>
		<category><![CDATA[贷宽]]></category>
		<category><![CDATA[超威]]></category>
		<category><![CDATA[车载芯片]]></category>
		<category><![CDATA[软件]]></category>
		<category><![CDATA[铁皮]]></category>
		<category><![CDATA[黄仁勋]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1286</guid>

					<description><![CDATA[大家好，欢迎收听老范讲故事YouTube频道。今天，咱们来讲一讲黄仁勋在COMPUTEX上的狂欢。COMPUT ... <a title="黄仁勋AI时代英伟达GPU革命：一场市值2.7万亿美金的狂欢，COMPUTEX 2024重磅发布Blackware GPU，1.8万亿参数GPT4揭秘！" class="read-more" href="https://lukefan.com/2024/06/04/%e9%bb%84%e4%bb%81%e5%8b%8bai%e6%97%b6%e4%bb%a3%e8%8b%b1%e4%bc%9f%e8%be%begpu%e9%9d%a9%e5%91%bd%ef%bc%9a%e4%b8%80%e5%9c%ba%e5%b8%82%e5%80%bc2-7%e4%b8%87%e4%ba%bf%e7%be%8e%e9%87%91%e7%9a%84%e7%8b%82/" aria-label="阅读 黄仁勋AI时代英伟达GPU革命：一场市值2.7万亿美金的狂欢，COMPUTEX 2024重磅发布Blackware GPU，1.8万亿参数GPT4揭秘！">阅读更多</a>]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph"><br></p>



<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="黄仁勋AI时代英伟达GPU革命：一场市值2.7万亿美金的狂欢，COMPUTEX 2024重磅发布Blackware GPU，1.8万亿参数GPT4揭秘！" width="900" height="506" src="https://www.youtube.com/embed/AOpATS-sitc?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事YouTube频道。今天，咱们来讲一讲黄仁勋在COMPUTEX上的狂欢。COMPUTEX是一年一度在台湾举行的计算机大会。黄仁勋，作为现在真正AI时代的当红炸子机，可能是唯一靠AI赚了大钱的人。虽然微软也在赚钱，但是微软整个靠AI挣的钱并没有那么多。真正靠AI赚了大钱的公司只有他一家——英伟达。刚才我看了一下，英伟达现在市值2.7万亿美金。大家知道，再往前就是微软的3.2万亿，第二名是苹果，2.9万亿，还差那么一点点。可能稍微一哆嗦，英伟达就有可能成为世界第二市值的公司了。那么，黄仁勋上面都讲了什么呢？作为网红，肯定还要先暴露一下行业秘密，别人都不知道他知道的事情。上来先说一下他现在讲的是什么——就是GPT-4到底有多少参数。GPT-3.5大家知道是1,700多亿参数，就是一个170多亿级别的模型。但是到GPT-4的时候，OpenAI就再也没有出来说它到底有多少参数。很多人说你是不是超过万亿了，对OpenAI来说，这个数据不是很准确。我来辟谣了，但是具体有多少，从来没有讲过。黄仁勋在前面的GTC，就是GPU技术大会上，每年一次的英伟达自己的开发者大会上，上面也讲了……</p>



<p class="wp-block-paragraph">说起来1.8T，这个1.8T指的是什么呢？其实就是1.8万亿参数，而且它是一个Moe模型。当时OpenAI并没有对此多说什么，但这一次，在《Computer Text》上，他们又反复强调了这个事情，明确指出GPT-4的训练参数达到了1.8T。这让人们意识到，想要达到GPT-4的水平，还有很长的路要走。尽管现在大家都在努力研发号称能达到或接近GPT-4水平的模型，比如几百亿参数的模型，比如梅塔的拉马3可能会有一个400亿参数的模型，国内也出现了很多一两百亿参数的模型。但事实是，即使提到的1.8T参数，如果考虑到是Moe模型，分成八份来看，那么单个模型可能也就相当于200多亿参数的水平。</p>



<span id="more-1286"></span>



<p class="wp-block-paragraph">这次先通过揭示现状，然后发布新GPU，但对于具体数据——多少核心、多大算力、内存多大、带宽多少，人们似乎已经感到麻木。现在大家更关心的是，如何将这些GPU有效地集成起来，如何把它们拼装成服务器，以实现更强大的计算能力。这背后的提升，不是5%或10%的增长，而是几倍的飞跃。这成了技术关注的新焦点。</p>



<p class="wp-block-paragraph">如何装到机房里头，统一为别人去服务，这个是现在大家更关心的事情。所以现在呢，他们发布的叫Blackware GPU，而且，它取出来那个板子上是两块GPU和一个CPU，应该是他们自己做的CPU。这是一整块，然后可以装到一个大的服务器里面去。再把这些服务器堆叠在一起，使用它的NV link，让这些GPU可以像一块完整的GPU那样工作。这样说，你就可以去训练更大的模型了。而且，今年是这个Blackville，明年就是Blackville Ocho，再往后是Robin。就是说，往后一代都给你规划好了。再往后一步，是叫Robin Ocho，所有的GPU一直规划到2027年，一定让2027年之前的GPU都给你规划好了。</p>



<p class="wp-block-paragraph">现在呢，很多大佬还在惦记着买H100。他现在就专门告诉你说，你看我这个艾克威尔跟这个H100比，它强在什么什么地方，好在哪哪哪。但是很多人还想买H100，这是为什么？可能Blackware它的这种工作方式，或者说它可能需要跟更多的设备先行捆绑，而H100的话，相对来说可能兼容性会更高、更好一些。就是你用任何的这种通道服务器，都能相对容易地兼容和使用。</p>



<p class="wp-block-paragraph">你把它插上去都是可以用的。likerware我倒是真没看到它出这种——就是像原来金砖啊，像我们以前讲的A100、H100这样的，我们管它叫金砖嘛，就是它的卡还是金黄色的，方方的一块，可以插上去的。好像没有看到这样的东西啊。现在呢，基本上都是以两个black Verre在一起，然后头上带一个CPU，是完整的这个配置。</p>



<p class="wp-block-paragraph">当然了，这些大佬，包括马斯克、扎克伯格，可能也不是说我就一定要去买H100。对于他们来说，H100就算是一种计量单位，就是说啊，他们会算上自己到底买了多少H100，或者说现在手里的算力相当于多少H100。你像扎克伯格之前讲，说他买了35万块，加上他手里现成的有60万了，再加上后面再接着买，现在扎克伯格手里的大概有接近100万块H100，相当的算力。这就跟我们造炸弹的时候说，这个炸弹相当于多少吨TNT啊，最后变成了一种衡量单位了。</p>



<p class="wp-block-paragraph">老黄（指NVIDIA的CEO 黄仁勋）就告诉大家说啊，你们来买新的吧。而且这种升级是呈几何级数升级的，所以不要去买旧的，去买新的，这样的话才能够保持它的垄断地位。如果说哎，我现在这个GPU再涨上去，涨了10%，涨了20%，那大家就不买它的了，就去买AMD，买英特尔，买其他的这些算力芯片去了。</p>



<p class="wp-block-paragraph">甚至像高通这样的公司，都能做出一定的算力芯片来。这样一来，人们可能就不会一定买它的产品了。但是现在的情况是，我们谈论的是算力要涨十倍、百倍、千倍，而且每年都要这样增长。为什么呢？因为这成了一场军备竞赛。每个人都害怕落后，就像人们常说的“输在起跑线上”。我们从小让孩子上补习班，是为了什么？就是出于这种害怕，这种焦虑感。老黄就是在给大家制造焦虑：你现在买了旧的，等明年出了新的，你就落后了。你必须去买新的，然后当更新的版本出来时，你又要再买。毕竟，GPU不像软件，软件可以逐年升级，而且升级成本相对较低。但GPU，你需要整块购买，一年后淘汰，再换新的，这成本实在太高了。一片就是4万美金，Blackwell的价格我虽然没查，但肯定不便宜。所以，要让大家每年跟着升级，必须讲出一些更有诱惑力的故事来。目前，从算力成本和能耗几个方面看，确实在全面升级。一方面，算力成千倍增长，成本自然是变贵了。这没什么可争议的。但就单位算力的成本来说，它是下降了。比如，原来的H100卖4万美金，但使用Blackwell之后……</p>



<p class="wp-block-paragraph">你可能继续达到H100同样的算力，这只需要原来1/10，甚至1%的成本，是这样大幅下降的。能耗方面也是如此，比如说，要达到原来H100的算力，所需消耗的能耗可能也只是原来的1%。如此发展，GPT-4的1.8T训练能耗引人注目，因为之前很多人讨论，GPT-4训练一次的能耗相当于多少个家庭一年的电力消耗，让人担忧AI发展的能源瓶颈。但现在的进展是，重新训练一遍的能耗降低了99.7%，仅为原来的1/350。而进行推理时，即训练完成后用于问答等任务，能耗更是降低到原来的1/45,000。这样的发展速度令人惊叹，从GPT-4推出至今不过一两年，能耗的减少就达到了如此程度。</p>



<p class="wp-block-paragraph">军备竞赛在AI领域体现为不断制造焦虑，促使各方持续投入。这就像冷战时期的军备竞赛，你有武器，我必须跟进。如今在技术领域，特别是英伟达所处的，情况类似，但效果是整体提升，正如“一人得道，鸡犬升天”。之所以提到这一点，是因为他们还强调了除了芯片本身，还有Vlink技术，能够将服务器像拼图一样连接，整个机房的服务器作为一个单一GPU工作，展示了技术整合带来的巨大效能提升。</p>



<p class="wp-block-paragraph">因为，这些服务器在一起，你的GPU的算率越大，可以并行处理的东西就越多，与内存和CPU之间的通道越宽，整个进行大模型训练的效果就会越好。所以他说，他可以干这件事情，但在这个过程中，这些服务器，或者其他一些相关的配件，都跟着他“鸡犬升天”了。比如说，像戴尔、超微电子这些给他造服务器的公司，全都因此受益，一路上涨。因为你不能只有GPU，不能只有他们的加速卡，还得把所有配件凑在一起，这些东西才能正常工作。而这些配件，都是值钱的。</p>



<p class="wp-block-paragraph">在这个过程中，服务器肯定变得更贵了。比如说，原来用的是H100的服务器，现在变成了更高级的查克威尔的服务器，那自然是服务器变贵了。但你想，服务器变贵的过程中，到底是什么东西变贵了呢？其实，只有与H100相关的专利费变贵了。大家要注意，因为大家自己并不造芯片，也不造服务器，他也不造算力中心。他只是设计好GPU，交给台积电去生产、封装、测试，然后下交给板卡厂商制作成板卡，再由服务器厂商组装成服务器，最后等待比如马斯克这样的人购买安装。所以，整个服务器链条上的价格上涨，实际上主要是由于关键技术组件的成本上升，特别是H100相关的专利费用。</p>



<p class="wp-block-paragraph">除了GPU价格飙升之外，其它相关成本也难免水涨船高。你不能期望其它东西都保持低廉，这显然不合逻辑。我们整体的成本基数提高了，但单位成本可能有所下降。不过，要注意的是，老黄的市场策略极为精准。GPU的知识产权价值多少，或者说它的设计成本是多少，他们心中有数。如果没有竞争对手，价格自然可以定得更高。但即便如此，人们依然能看到成本在以惊人的速度下降，甚至是以十倍、百倍的幅度。然而，GPU的设计价值却在不断提升。</p>



<p class="wp-block-paragraph">除了NVIDIA本身，那些制造显卡、服务器以及各种配件的厂商，它们的产品也会随之增值。比如，如果你用一个价值4万美金的H100来搭建服务器，仅这一部分就是一笔昂贵的投入。而且，随着Nvlink标准的采用，替代了以往的Pcie标准，意味着新的配件、新的线缆等都将应运而生，价格自然比过去高出许多。</p>



<p class="wp-block-paragraph">我记得早些时候，为惠普的小型机配备一个简单的支架，就是一个铁质架子，都能卖出数千元的高价。原因在于它专为小型机设计，很多工程师甚至会私下找工厂定制支架，替换官方配件以赚取差价。这背后反映的是，即便是一些看似不起眼的配件，在特定情境下也能变得极其值钱。</p>



<p class="wp-block-paragraph">大家其实也都知道，那个铁皮的支架，你说能值多少钱？你凭什么一定要买惠普的？他只要是惠普的工程师给你装上，下次他接着给你修不就完事了吗？你跟着这个比较贵的东西一块去卖，他就会卖的很贵。但是这几天呢，戴尔和这个超威的股价，其实已经快有点绷不住了。大家心里也明白，虽然你们跟老黄跟的很紧，但是这个里头真的，你就是个卖支架的，卖个铁皮，卖个机箱的，你跟着里头的GPU一起水涨船高，这件事稍微的有点侮辱大家的智商。</p>



<p class="wp-block-paragraph">现在呢，是AI工厂时代，现在老黄也讲说我们现在就是AI factory。在这样的一个时代，我们应该如何与时俱进呢？我记得在移动互联网刚开始的时候，我们写很多应用，当时我们在思考说，哎呀，我怎么能够省一点流量，因为那个时候流量很贵。我们都想着如何去节省流量，如何在使用的时候联网，不使用的时候怎么把它断开，想着怎么去省一点电，怎么去做一些其他的节省资源的事情，可以少占一些硬盘的空间，可以交互的时候少交互一些流量。当时的我一位老板就跟我讲，说你们想这个事情是错的，说为什么呢？就是因为很简单，随着时代的发展，这些东西都会变得不值钱的。比如说现在，流量咱们现在……</p>



<p class="wp-block-paragraph">其实，基本上是没有流量焦虑的。我记得最早开始使用手机，那时候刚进入3G时代，我们都会做什么呢？每天定时打开流量，收完邮件后立即关掉。为什么会这样？因为酷，而且节省。现在，还有人这样做吗？没有了。现在，我们走到哪儿，站在哪儿，就开始刷抖音、看视频。已经很少有人会说，我必须节省流量，等到有WiFi的地方再做这些。绝大部分人没有这个意识了。</p>



<p class="wp-block-paragraph">电的问题现在也不那么大了。虽然手机应用还需要省电模式，但现在的手机几乎都是一天一充。你的应用再费电，能比微信还费电吗？能比原神还费电吗？所以，这些问题也变得无关紧要。因此，很多以前为了省电而做的操作，实际上已经没有意义了。</p>



<p class="wp-block-paragraph">再往后说，我们是否会考虑在硬盘或手机上占用更少的空间？以前在猎豹工作时，我们还在研究如何让软件占用空间尽可能小。但现在看看《原神》有多大，看看那些手机游戏的大小，再看看微信在你手机里占了多少空间，就会觉得，我们当初那么精良的考虑，好像都没什么大作用。是的，所以在AI Factory这个时代，也就是AI工厂时代，我们仍在思考如何能省一点TOKEN，情况依然如此。</p>



<p class="wp-block-paragraph">我怎么能够让它反应得稍微快一点？我怎么可以调用不同的大模型？这个模型贵一点，那个模型便宜点。我尽量让便宜的模型干尽量多的事情，让贵的模型干少一点的事情，做一些其他的，比如优化（reg）或者做一些这种节省沟通交互的事情。可能真的再过一年，这些就会变得很可笑，就像我前面讲的，我们在做手机应用的时候，让它怎么去省流量，从网上下载的东西少一点，占的硬盘空间少一点。我们现在回想，那时候想的这些事情就显得很可笑。但是在AI时代，刚才我们讲的怎么能够省一点TOKEN，怎么能够让便宜的模型多干点，贵的模型少干点，怎么能够让多个模型相互搭配起来使用，可能也会变得很可笑。而且，这个时间会来的非常快。</p>



<p class="wp-block-paragraph">黄仁勋呢，除了讲数据中心业务，就像我们刚才提到的Blackvail，一切都是数据中心业务，这也是现在英伟达核心的收入来源，没有之一。现在，他主要就靠这个业务玩。那么其他的呢？也还在讲，英伟达这家公司特别有意思，它不会说某一个业务特别好，就把所有的身家都压上去。它永远是在所有它认为有趣的地方投注，即使这一个方向很长时间没有结果，它依然会在里面坚持。那么，它肯定还有些其他的业务在做什么呢？</p>



<p class="wp-block-paragraph">比如说，RTX加载的AIPC，因为前面微软发布的AIPC是基于高通的。现在，英伟达说了，你们使用英伟达的GPU，也可以达到同样的水平。英伟达专门为了AIPC设计了一款很小很轻薄的GPU，而且很省电。但这一块上，它稍微有一点尴尬。为什么呢？你如果真的要轻薄省电，你一定使用ARM的，对吧？就是使用高通的就好了。那你说，我现在稍微费点电也可以，这个英特尔自己也出了，英特尔说，你们就直接用英特尔完整的GPU加上算力核心就完事了，你不用再去单独配独立的GPU，依然可以达到AIPC的能力。包括AMD也是这么干的，AMD自己也产X86的CPU，AMD说：“来哇，你直接买我的APU加我的算力核心，就一次搞定。”</p>



<p class="wp-block-paragraph">那么，英伟达的RTX这个方案为什么尴尬呢？就是它必须要再搭配一块Intel或者是AMD的X86的CPU，它才可以正常工作起来。这对于强调轻薄便携的AIPC来说，就稍微有些尴尬了。但是，英伟达也强调了，加上他们的技术后，算力是苹果的多少多少倍，主要是与苹果的M系列芯片在比较。在这方面，我们还是要相信老黄的，他的算力确实是靠功率支撑起来的，如果他真想达到某个目标，他有这个实力。</p>



<p class="wp-block-paragraph">说我在电脑上做Stable Diffusion的，这样出图，速度很快。那一定是配着呼啸的风扇声，以及呼呼转的电表，一起来工作的。除了AIPC之外，还在讲游戏助手。但是这个呢，我觉得大家看着开心一下就可以了。他说我做个助手帮大家打游戏，这个呢，就属于工程师思维——一拍脑袋觉得，“我需要一个这个”。其实，游戏跟这个没有那么大关系。就算是AI应用在游戏里面，应该也不是通过游戏助手的方式去应用的。</p>



<p class="wp-block-paragraph">另外，还展示了机器人。他说所有跟机器人相关的东西，我们都上，也做了全套的机器人套件。还有，其实VR、AR以及车载芯片，其实都在英伟达的整个路线图里边。再往前走，很多人就会关心，英伟达到底还能坚持多久呢？他真的还差2,000亿美金就追上苹果了，对吧？苹果2.9万亿，他2.7万亿，真的差的不多了。他到底能不能超过苹果，甚至能不能超过微软，成为全世界最值钱的公司？这个其实大家心里都在打鼓。</p>



<p class="wp-block-paragraph">英伟达呢，跟其他不管是微软也好，苹果也好，有一个特别本质的区别，就是它是一个“轻公司”。这个“轻公司”赶上时代红利是可以的，但是到底能不能长久地坚持下去，这个就很难了。黄仁勋展示现在的成就，未来的路线图，让人充满期待的同时，也不免有几分疑虑。</p>



<p class="wp-block-paragraph">但是，并没有说我要砸重金进去，变成一个重型公司。大家注意，苹果是个很重的公司，它生产电脑——虽然电脑也是台湾人给他造的——它的手机是富士康，包括比亚迪都在给他造手机。它是这样的一个公司，虽然供应链在外面，但是这些货品、这些设计，包括全球的仓储物流，很多东西都是属于苹果自己的。所以，苹果是个很重的公司。微软其实也是一个很重的公司，微软自己在造Surface，那个东西虽然卖的并没有那么好，但是它也是电脑平板，甚至还有很多其他的硬件，比如说键盘鼠标。微软键盘鼠标其实做得非常好。而且微软其实还有一块很重的资产，那就是云计算中心，它有很多的数据中心。微软现在是全世界可能GPU最多的公司了，因为后边有OpenAI这样的一个“亲儿子”，那你肯定是要靠这么多的GPU去养的。微软现在的GPU，如果大概核算成H100的话，应该有180万块，这都是重资产。</p>



<p class="wp-block-paragraph">谷歌呢，也是一个很重资产的公司。谷歌紧跟在英伟达之后，他现在是市值第四的公司。谷歌我记得在云计算兴起之前，曾经有一段时间，他拥有全世界大概6%的服务器，这是一个多么恐怖的数字。而现在，虽然应该没有那么多，但谷歌的数据中心依然规模惊人。</p>



<p class="wp-block-paragraph">也是一块非常非常沉重的业务。而且，另外一点是什么呢？就是我们来看，整个的生态是否稳固，或者说，整个的价值体系是否可以稳定地升级上去。还有一个点可以看是什么？就是你上下游的生态链是否足够稳定。围着你吃饭的人到底有多少？以前我们在学生物的时候讲过一点：在一个自然环境里头，食物链越长，或者说参与到食物链里的动物、植物越多，它整个的生态系统就越稳定。为什么呢？因为其中有一些波动，其他的这些生态位上的人，或者这些动物，就可以慢慢地把它平衡回来，而不是说啊，我的食物链很短，就两三节，参与的动物也不是很多，植物也不是很多，可能中间稍微有一点闪失，这个食物链就崩溃了。</p>



<p class="wp-block-paragraph">咱们来看看苹果，上下游其实有非常多的人围着他吃饭。我们不说这些果链企业，就光在苹果应用市场里头，做应用的这些人，也有几十万人，对很多人来说，这是他们的收入来源。再看谷歌，像我们现在在这看YouTube，我在这拿着YouTube的广告费，那我们也算是谷歌生态链里边的一环。那是非常多的人靠着谷歌生活。啊，微软那不必说这些靠广告吃饭的，因为微软的广告并没有那么多，但是微软上下游，是有大量的系统集成公司，靠着微软吃饭的。</p>



<p class="wp-block-paragraph">还有微软云上的大量客户，但是英伟达有没有这么多人靠着它吃饭呢？英伟达虽然一直努力地在打造他的生态链，整个生态环境，但是并没有那么多。所有能战胜英伟达的，像刚才我们说的戴尔、超威等，这些已经都涨疯了。剩下的呢，其实没有那么容易贴上去。虽然有很多人说，“我们拿英伟达的CODA，我们去写这些Transformer的大模型。”但是这些人呢，实际上在整个的生态链里面是非常非常小的一群。现在能够真正把这个东西跑通的人非常少，虽然这个领域的人才工资非常高，但是人数真的不多，它没有真正撬动大众。所以，我从这两个方面来论述，英伟达到目前为止，依然是一个很轻的公司，资产很轻，它的整个生态链其实也是相对短而且相对脆弱的。</p>



<p class="wp-block-paragraph">那么英伟达现在能够赌的是什么呢？就是这个缩放定律，叫“scoring low”。只要这个东西依然有效，黄仁勋呢，就还可以继续狂飙那么一段时间。“scoring low”是什么东西？就是我堆更多的数据，上更大的模型，上更大的算力去计算，然后得到的模型效果就更好。这个东西只要依然在，还可以大力出奇迹。那么大家就说，那我们就接着老老实实地买他们家显卡。</p>



<p class="wp-block-paragraph">而且，这种倍速一定是十倍、百倍、千倍这样往上涨，为什么呢？因为如果你说，我英伟达下一代的GPU就比现在快20%，那大家就不更新了。或者说，我干脆去买AMD吧，AMD的比你这还便宜点，算力也没有那么差，只是这个过程稍微麻烦一点——我需要重新去适配AMD的算力卡。大家要注意，因为做这行的人很少，这些人很聪明，对他们来说，适配一个新的算力卡，难度并没有那么高。</p>



<p class="wp-block-paragraph">刚才我为什么专门讲了苹果的生态链、谷歌的生态链、微软的生态链？因为它们里面有很多低端开发者，对他们这些低端开发者来说，技术迁移的门槛是很高的。你让他重新换一下，比如说，“你原来做安卓的，现在去给我做iOS开发去”，他真不会。甚至说，他学会了以后还能涨些薪水。但是对于英伟达来说，如果他没有办法快速地让算力十倍、百倍、千倍地涨上去，那么大家就会渐渐背离他，对他的忠诚度是相对比较低的。</p>



<p class="wp-block-paragraph">有可能造成英伟达崩塌的原因有三个，咱们最后总结一下：</p>



<p class="wp-block-paragraph">第一个就是摩尔定律失效了，缩放定律已经没效果了。大家发现，上更多的数据，配更大的模型，训练完了以后效果提升了。一旦到这样的情况，就不会有人再疯狂地去买他的新显卡了。</p>



<ol class="wp-block-list"></ol>



<p class="wp-block-paragraph">第二个中心转移了。突然间，又一个特别赚钱的应用方向爆发起来。大家注意，现在为什么大家都在选择这个？因为“缩放法则”——谁都用不好。大家只能去比谁的模型做得更好，然后去跑这个，跑那个。但是一旦发现，这个模型在做一些特定应用时，效果好得一塌糊涂，而且极其赚钱，那么这个时候，就不会有那么多人继续投入资金去做新模型的研发了。他们可能觉得，现在的模型就够了。这相当于什么呢？就是说，虽然“缩放法则”仍然有效，并没有崩塌，但是没有人愿意再往上堆成本了。因为，尽管“缩放法则”有效，但增加更多的算例、更多的数据，那都是钱。一旦出现特别赚钱的领域，即使“缩放法则”依然有效，增长也会停止。</p>



<p class="wp-block-paragraph">第三个因素是巨头合作，突破并扩大了垄断。现在，大家离不开英伟达的原因，就在于它推进的这套扩大——可以称之为通用计算方法，具体的名称我不再详查，它是不开源的，而且英伟达拥有专利。因此，大家都在这个基础上进行了应用开发和大模型的训练。之后，想要更换这个技术，就会有一个成本。这个成本，我们要反复讲，不高也不低，为什么会这样呢？</p>



<p class="wp-block-paragraph">肯定换过去以后会有些兼容性的问题。但是呢，因为你后边真正使用你的H100也好，Blackware也好，都是些什么人？特斯拉、苹果、谷歌、微软、亚马逊——他们可以花最贵的钱，雇最好的工程师，说来咱们今天去改一遍就完事了。这个都是有可能的。但是，这个临界点在什么地方？临界点就是，如果涨不上去了，那咱就改；或者说突然有人说，“我愿意砸一笔更大的钱进来，咱就改。”为什么？詹奥特曼说，“咱们砸一笔大钱啊，1,000亿美金，或者说1,000万块H100算力的这个GPU，我们统一搞一次，做星际之门去。”这个对于英伟达来说，都是比较大的威胁。就是这三个威胁。</p>



<p class="wp-block-paragraph">英伟达呢，也算是我们现在的一个传奇故事。我相信在整个的AICC大时代里头，我们还可以不断地看到它的故事继续。好啊，今天我们要讲的故事就到这里。感谢大家收听，请帮忙点赞点小铃铛，参加Disco讨论群，也欢迎有兴趣有能力的朋友加入我们的付费频道，再见！</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>国内大模型价格战已打响，DeepSeek率先推出超低价服务，字节跳动的豆包大模型跟进、阿里的通义千问全线降价、百度文心一言、讯飞星火、腾讯混元等巨头纷纷跟进，新的时代开始了。</title>
		<link>https://lukefan.com/2024/05/24/%e5%9b%bd%e5%86%85%e5%a4%a7%e6%a8%a1%e5%9e%8b%e4%bb%b7%e6%a0%bc%e6%88%98%e5%b7%b2%e6%89%93%e5%93%8d%ef%bc%8cdeepseek%e7%8e%87%e5%85%88%e6%8e%a8%e5%87%ba%e8%b6%85%e4%bd%8e%e4%bb%b7%e6%9c%8d%e5%8a%a1/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Fri, 24 May 2024 00:39:46 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[100万TOKEN]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[AI应用]]></category>
		<category><![CDATA[APP开发]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[FIGER01]]></category>
		<category><![CDATA[中国AI发展]]></category>
		<category><![CDATA[中国创新]]></category>
		<category><![CDATA[中国科技]]></category>
		<category><![CDATA[云服务]]></category>
		<category><![CDATA[交互体验]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[价格战]]></category>
		<category><![CDATA[价格白菜化]]></category>
		<category><![CDATA[价格策略]]></category>
		<category><![CDATA[免费模型]]></category>
		<category><![CDATA[商业模式创新]]></category>
		<category><![CDATA[大模型]]></category>
		<category><![CDATA[大模型厂商]]></category>
		<category><![CDATA[字节跳动]]></category>
		<category><![CDATA[定制化服务]]></category>
		<category><![CDATA[开发者]]></category>
		<category><![CDATA[开源模型]]></category>
		<category><![CDATA[技术创新]]></category>
		<category><![CDATA[技术竞争]]></category>
		<category><![CDATA[擎天柱机器人]]></category>
		<category><![CDATA[数据利用]]></category>
		<category><![CDATA[机器人技术]]></category>
		<category><![CDATA[李开复]]></category>
		<category><![CDATA[流量]]></category>
		<category><![CDATA[王小川]]></category>
		<category><![CDATA[用户量]]></category>
		<category><![CDATA[百度]]></category>
		<category><![CDATA[百度云]]></category>
		<category><![CDATA[科技巨头]]></category>
		<category><![CDATA[移动互联网]]></category>
		<category><![CDATA[端到端多模态]]></category>
		<category><![CDATA[算力]]></category>
		<category><![CDATA[算力要求]]></category>
		<category><![CDATA[腾讯]]></category>
		<category><![CDATA[腾讯云]]></category>
		<category><![CDATA[腾讯混元大模型]]></category>
		<category><![CDATA[自动驾驶]]></category>
		<category><![CDATA[自然语言处理]]></category>
		<category><![CDATA[行业变革]]></category>
		<category><![CDATA[讯飞星火大模型]]></category>
		<category><![CDATA[语言模型]]></category>
		<category><![CDATA[跨模态交互]]></category>
		<category><![CDATA[阿里巴巴]]></category>
		<category><![CDATA[降价策略]]></category>
		<category><![CDATA[零一万物]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1264</guid>

					<description><![CDATA[大家好， 欢迎收听老范讲故事YouTube频道。今天咱们来讲一讲国内大模型厂商，突然就变脸了，开始打价格战，而 ... <a title="国内大模型价格战已打响，DeepSeek率先推出超低价服务，字节跳动的豆包大模型跟进、阿里的通义千问全线降价、百度文心一言、讯飞星火、腾讯混元等巨头纷纷跟进，新的时代开始了。" class="read-more" href="https://lukefan.com/2024/05/24/%e5%9b%bd%e5%86%85%e5%a4%a7%e6%a8%a1%e5%9e%8b%e4%bb%b7%e6%a0%bc%e6%88%98%e5%b7%b2%e6%89%93%e5%93%8d%ef%bc%8cdeepseek%e7%8e%87%e5%85%88%e6%8e%a8%e5%87%ba%e8%b6%85%e4%bd%8e%e4%bb%b7%e6%9c%8d%e5%8a%a1/" aria-label="阅读 国内大模型价格战已打响，DeepSeek率先推出超低价服务，字节跳动的豆包大模型跟进、阿里的通义千问全线降价、百度文心一言、讯飞星火、腾讯混元等巨头纷纷跟进，新的时代开始了。">阅读更多</a>]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe loading="lazy" title="国内大模型价格战已打响，DeepSeek率先推出超低价服务，字节跳动的豆包大模型跟进、阿里的通义千问全线降价、百度文心一言、讯飞星火、腾讯混元等巨头纷纷跟进，新的时代开始了。" width="900" height="506" src="https://www.youtube.com/embed/Zt-mCByxk3o?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">大家好，</p>



<p class="wp-block-paragraph">欢迎收听老范讲故事YouTube频道。今天咱们来讲一讲国内大模型厂商，突然就变脸了，开始打价格战，而且是价格生死战。这个战争是从哪开始的？首先是有一个大模型叫deep sick，他先开始干的。原来我们使用100万TOKEN，大概也得十几二十块钱，甚至贵的也能有五六十块钱。国外的大模型经常是要到十几美金。他呢，直接来了一个啊，100万TOKEN一块钱人民币。DPC大家可能不是那么熟悉，因为他后边不是一个互联网巨头，也不是原来从互联网大厂出来的人，他后边是一个私募巨头，换方量化直接不讲武德啊，100万TOKEN一块钱人民币。</p>



<p class="wp-block-paragraph">那紧随其后的呢，是豆包啊，这是字节跳动下边的大模型，直接降价到100万TOKEN 0.8元人民币。你不是一块吗，我8毛啊。然后通1,000问说那你们都降，我也来呗。我后边反正是阿里云，谁怕谁啊，最多的显卡都在我手里头，那降价啊，把通1,000问最新的千问Max千问浪什么，全都降到了一个白菜价。当然同1,000问降价的时候呢，还是用了一些小花招的啊，他把输入TOKEN跟输出TOKEN的价格分开了。什么意思？就是当你往里梳的时候，你也是算TOKEN的，当它往外吐的时候，也是算TOKEN的。就是它把往里梳的这个TOKEN的价格，降低了更多啊，往外吐的这个TOKEN呢，也在降，但是降的并没有那么多。大家能够理解，就是你往里输的内容，比如说现在有很多的大模型号称是可以输入100万字，200万字，但是他每一次输出，可能也就输出个1,000字，2,000字，他不会输出那么多的。你说一大模型坐在那，吭哧吭哧给你吐100万字出来，有人看没有？一个人坐在那阅读，读100万字也得会功夫吧。所以呢，从大模型输出的这个TOKEN稍微贵些啊。然后百度特别逗啊，百度先强调了一下，说不要关注价格，要看这个大模型的特性，以及大模型的性质，是不是适合你的场景。讲完了以后呢，左右一看说哎，你们都跑了，等等我等等我，对吧？直接把手里头两个最常用的模型，一个叫快速模型，一个是轻量级模型免费，对吧你们还要收钱吗？咱不要钱了。</p>



<span id="more-1264"></span>



<p class="wp-block-paragraph">科大讯飞的星火大模型说，百度既然已经做出这个样子来了，那咱也来吧，把轻量级模型直接免费，重量级模型降价。大家都是这么干，那腾讯说，咱们也不能落后，腾讯做的叫浑圆大模型，一样轻量级模型免费，其他全线产品价格下降。所以国内现在使用大模型产品，就算是一些比较好的模型，比如像千问Max千问浪这样的模型，你现在100万TOKEN的价格，可能也就是个几块钱啊，或者一两块钱，两三块钱，就这种水平，非常非常便宜啊。</p>



<p class="wp-block-paragraph">其他的一些人是什么反应？大家都降价，是不是大家都挺开心的？也有不开心的啊，比如说灵异万物的李开复就在那喊，说为啥要降价呢？不要降价，我们现在就不降。另外一个是百川智能的王小川，也在那喊说，没觉得应该降价，咱们就这样吧。啊百度呢是前头喊了价格不重要，但是大家都知道啊，百度向来是一个没有什么担当的公司，啊上午喊完了，下午就可以直接喊免费的，这样的一个公司，这就是百度干的活。</p>



<p class="wp-block-paragraph">然后Kimi是比较逗的啊，Kimi现在是国内所有大模型里头，用户量最高的一个，他比百度那个文心妍用用户量还大，百度文心妍月活大概是1,600多万啊，Kimi大概有2,000万。Kimi呢，在这个时候玩了一个特别神的招数，打赏啊。什么意思呢？就是咱们国内的整个的大模型收费状态是这样的啊，分三块一块呢是免费可以使用的，比如说，通1千问啊，Kimi零一万物，百度的文信易言的3.5，还有一些收费的公众服务。比如说呢，百度的文心易言4.0，就相当于它做了一个像charge GPT4似的东西。大家知道charge GPT3.5是免费的，charge GPT4是要收费的，是plus版本。百度也整了这么个东西。然后再往后呢，就是调API。公益前问，仔细一言。这些API这个是要按TOKEN来收费的。原来就是这三块收费。Kimi的并没有跟进。大家说我也把API TOKEN的降格降下来。他没干这事啊。他做了一个什么事呢？他说我们啊，也开始收费吧。Kimi直接问答的这部分，面向c端用户的这部分开始收费。他干了这么个事。而且他的收费方式呢，还特别逗。大家知道像charge GPT它是怎么收费的，就一个月20美金，你交了20美金就是plus进，了plus以后，我们就可以使用charge GPT4了，可以使用GPTS。如果你是呃，百度文心妍也是这样的，每个月交多少钱，然后交了钱以后，你可以去用它的文心妍4.0，你不交钱就不让用。Kimi呢，它是打赏模式，就是你平时上网用来啊，没问题，但是因为用户量大嘛，所以他经常会有反应不及时的时候，就是你调着调Kimi，Kimi说哎呀对不起，现在提问题的人有点多，你要稍微等一会，过几分钟再问，对吧，Kimi经常干这种事情啊。那么在这个时候呢，你就可以选择说，那我打个赏吧，我赏给keep me一点钱，比如说赏给他5块2，可以有4天的快速时间，你说我赏给他366，可以直接一年时间都可以快速，那你说我不想打赏，我就这么使着行不行，也没毛病，但是呢，等Kimi的服务器比较紧张的时候，你就要为这些打过赏的人让路啊。你要多等一会儿。他做了这么一个方式，很多人都上去打赏去，甚至有些人说：“现在Kimi并没有出现任何的反应，速度下降的这个情况。”你也可以在Kimi里头直接输入“叫我要打赏”四个字，一回车啊，他就上来了，说你给钱吧，对吧这个事也是OK的啊。所以Kimi做了一个特别有意思的事情。</p>



<p class="wp-block-paragraph">那么，这件事情对未来到底有什么影响啊？</p>



<p class="wp-block-paragraph">第一个对于个人用户来说，基本上没影响啊，因为我们原来甭管是使用Kimi，使用公益，千万都是不用付钱的。就算是这个万知，就是灵异万物新做出来的东西，包括其他的各个大模型平台，大概都做了一个Toc这样的一个聊天工具，都是不要钱的。当然这个里头呢，我们为给百度文信、易言4.0交年费的朋友们稍微的默哀一会啊，他们估计已经哭晕在厕所了。</p>



<p class="wp-block-paragraph">对于那些专注于模型的厂商来说，他们的问题就比较大了啊，他们会比较痛苦。实际上这里讲的就是前面两位反对降价的这两个人，一个是李开复，一个是王小川，他们呢算是玩的叫小而美的团队，他们团队都不大，做出来的模型呢，都可以在各种排行榜上评分上评的很高啊，甭管是灵异万物的e LATCH，还是现在啊百川智能的这个百川的，都可以评分评的非常高。他们原来希望依靠什么呢？我的评分高，你最后要选我的模型，想干这件事情。但是现在不了啊，人家说我们免费，我们评分虽然没有你高，但是我们免费，或者我很便宜，靠这样的事情，那么他们的日子会很难过。他们唯一的出路是什么呢？快速的找到他们特定的应用场景，比如说某一些场景我必须用百川制冷，或者某一些场景我必须用灵异万物，否则的话，是不会有人去用他的这么贵的API去干活的。零一万物的这些API还是很贵的，100万TOKEN的价格里得有十几块钱。一般人用不起的。就算他们收这么贵啊，他们也不可能依靠API收费来实现盈利。这件事是不可能的啊，所以呢他们应该会降价，很快就会跟着降价。降价呢，对于他们来说就是快速失血。一旦降价了以后，他们一方面是挣回来钱更少，另外一方面的问题知道是什么吗？就是他们的服务器消耗的会更高，因为这个东西便宜了吗，就会有更多的人去用，用没成本上升。</p>



<p class="wp-block-paragraph">在这个过程中，如果在钱烧完之前啊，没有找到新的特定使用场景的话，那么这些厂商就准备被收购，或者准备关张吧，没有他们什么事了。那么真正利好的是什么啊？真正利好的这些APP开发者，海量的APP，现在应该已经在涌现的路上了。哎像我现在自己写应用，去用AI去生成小说，这样的事情，我是要掰着手指头数的，我到底用谁的API啊，到底用谁的大模型，谁家的大模型价格是多少，我每天都在掰手指头算。那现在好了，这么便宜了，那咱就上呗，这还有什么好说的呢？对吧一定会有非常非常多的APP，在这个时候会涌现出来啊。</p>



<p class="wp-block-paragraph">原来这些APP不愿意去调他们的这个大模型的原因是贵，因为你如果有很多的用户，比如说我一个APP做出来了啊，有个10万个日日活啊，一天有10万个人用，那么这10万个日活，每天跟这个大模型啊，每个人聊个比如说10句20句的，那原来是一个很大的成本。现在这个成本，基本上可以在原来的基础上，可能下降个99%点几。那在这样的情况下的话，他们就敢去让大模型，更多地参与到APP的运作里边去。那可能很多新的商业模式就会在这个里边诞生出来。</p>



<p class="wp-block-paragraph">在这个过程中，一定是乱拳打死老师傅的时候啊，就是中国人从来不想着什么谋定而后动，咱就是把价格降下来，所有人啊，拍着脑袋上啊，最后不一定哪块云彩下雨。这是咱们最擅长的这种竞争模式。移动互联网，我们基本上就是靠这种模式成功的。满天下全是中国人做的APP，就是这么来的。现在我们把大模型的成本降下来，以后也是一样啊，满天下都是中国人做的AI应用，一定会变成这样。出海的应用现在应该也在路上，大家注意啊。</p>



<p class="wp-block-paragraph">你说我出海的应用，我调GPT不就完事了吗？那玩意质量多好。别想这个GPT挺贵的。PPT你要去调100万TOKEN，那得多少钱。现在GPT给的价格是一千次啊，一千次多多少钱。你要100万TOKEN，它应该至少是比国内的所有的这些大模型贵，可能几十倍啊，甚至是上百倍。这样的购贵法，未来GPT有可能会调整，继续降价。GPT反而也一直在降价嘛，甚至现在GPT4欧，还可以免费开放给普通用户去使用。然而使用的次数是3个小时十六四啊，但依然还是很贵的。</p>



<p class="wp-block-paragraph">如果国内的大模型说我免费了，我不要钱了，或者说我用一个白菜价100万TOKEN，几毛钱你们就去用吧，那么在这样的情况下，就会有大量的接中国大模型的这些应用啊，到海外四处去厮杀去。便宜啊你，你那个应用接的是GPT，那你可能就需要去考虑成本了。我们的模型后边这接的是文心岩轻量级模型，零成本干呗。这事还有什么好说的呢？所以这个又应该也是一个趋势。</p>



<p class="wp-block-paragraph">那么大厂呢，倒并不担心这件事啊。大厂子你说我推理成本还是挺高的，我不要大家的钱了，我直接让大家免费的来用我的模型，那他最后挣什么钱去呢？大家注意啊，现在参加降价的，甭管是字节跳动，还是阿里，还是百度腾讯这些公司，人家掌握两样东西。第一个东西叫流量，用户在人手里头。另外一个东西叫基础设施，云在人家手里头。当有了新的商业模式，有了新的这个玩法以后，最终这些大厂还是会靠这两只手啊。把新的应用控制在鼓掌之中啊。你是跳不出如来佛手掌心的。就算你做出了AI应用来，用户非常喜欢，用户量非常大，你最后还是要到自阶跳动，要到腾讯，要到百度那里去买流量，你还是要到阿里那里去买云，你是跑不掉的，你依然会替大厂去打工，去干活啊。所以大厂并不担心，说我现在是不是会亏了啊。不怕这事。</p>



<p class="wp-block-paragraph">至于ToB的那些厂商呢，啊这个，比如说，我现在是为什么什么人服务的啊，我给人去做RAG，我给人做大模型实施的这些人，那么他们呢，呃主要是要靠收服务费活着啊。比如使用同1,000分的，使用这个文新言的，我去给人做服务去就好了。但是呢这个价格肯定也得下降，人家都下降了，你凭什么说我这个二道贩子，做服务的，我不降价，这事是肯定不现实的啊。所以他也会降价。</p>



<p class="wp-block-paragraph">原来还有一些拿开元模型自己训练了以后，去给人家做，号称自主知识产权小模型的，这些人号称什么行业模型的，这些人，就会被打回原形。后面没他们什么事了，因为这些模型，你想去跟真正云端上面的，这种大模型去比，甭管是千问Max，或者是文心一言的一些大模型去比，你是打不过人家的，这个差非常远。就算是你拿小模型做很多的训练，或者做很多的微调，你说我想最后得到空气切换Max那种再微调一下，那个效果，基本上是不现实啊，非常痛苦。所以他们就会被打回原形。</p>



<p class="wp-block-paragraph">未来啊这些开元本地模型，肯定是会受到打压的啊。为什么呢，因为使用开元本地模型，进行部署和维护的成本，其实还是相对比较高的。你想现在这个模型是本地开源的，比如说像我用欧拉玛的这种模型，它呢其实有几个用途，第一个就是干嘛，就是写程序用，我去这个写程序的时候，先调本地的一些模型，然后未来再去换成这种云端的模型啊，我现在其实真正干活，是不怎么用本地模型。那玩意很慢啊，而且这个对电脑的算力要求实在太高了啊。这是第一个原因啊。</p>



<p class="wp-block-paragraph">第二个原因是什么呢？就是我要在本地，去为自己的道德去负责任。这是什么意思？就是你一旦是使用云端模型了，最后说什么不说什么是他说了算的，你自己说了不算的。但是当有一些事情，我觉得应该是我自己说了算的时候，我会用本地模型去干活。</p>



<p class="wp-block-paragraph">所以，本地模型除了这几个特殊的需求之外，可能未来直接在本地部署生产系统的这个需求就没有那么大了啊。啊这块会受到一定打压。从长远来看，下一个竞争到底是什么啊？现在等于我们已经把文字大模型，或者纯文字这块已经搞透了啊。为什么呢？就是他们已经说，最后咱就直接打价格战了。所以这事已经没什么可竞争的。</p>



<p class="wp-block-paragraph">大家想没想过为什么GBT5这么难产？其实在文字这个基础上，大家基本上卷到头了。你说我在文字基础上再进一步往前卷，怎么能够让文字大模型的水平，再进一步上升，已经很难了。因为人的语言能力和阅读理解能力，已经到这了。他GPT4基本上达到极限了。</p>



<p class="wp-block-paragraph">所以真正该往后卷的是什么？不是说，我能不能做出更好的这个文字大模型，GPT5来，而是说我应该去做多模态了。就是GPT4O才是未来的方向，端到端的多模态是未来方向。那么所谓的文字大模型，最后啊应该再往哪块，还可以再前进那么一点点呢？就这块天花板已经基本上到了啊。再往前一点点就是更长的上下文，现在比如说有128K的，有一兆的两兆的，100万200万TOKEN的，然后把反应速度再提高一些，逻辑能力再提高一些。GPT4现在差就是逻辑能力差一点啊，它比Pro的逻辑能力还是要差一些，比Gemini的逻辑能力差一些。这一块可能还能再提升那么一点点，其他的已经没什么可提升了。国内的这些大模型厂商，甭管是通一千问、文心一、眼百川、名医、万物，现在基本上都已经接近，甚至部分达到了GPT-4的这种文字水平。让他们接着往前去卷这个多模态大模型呢，他们又卷不太动。所以只能说我们先把这一块给你吃透，先把文字大模型这块直接给你打成免费，打成白菜价。在这样的基础上，我们靠中国原来开发移动应用的这股力量啊，这么多人来乱拳打死老师傅，把应用这一端给他补上。因为这一块OpenAI自己也不太会，而且指望美国人、指望老外去干这事，他们也干不了。在原来移动互联网的时候，我们已经很好的验证了这件事，想去做APP还得靠中国人。所以中国人这一次的竞争，就在干这件事。说来我们能干的事干完了啊，该你们上了，做APP的你们上。</p>



<p class="wp-block-paragraph">真正往后的竞争是什么？李开复前面讲说，国内跟国外的差异成差6个月啊。他说去年国内跟国外的差距，就是在大模型这块是7-10年啊，现在只差6个月了。但我现在感觉他现在讲的这个话，还是有点太过于乐观了。你在端到端多模态大模型的竞争上，我们跟国外跟OpenAI的差距，跟谷歌的差距，应该还是有这么两三年的。这个才是合理的。所以在短期内，我觉得我们在端到端多模态大模型上，还有的追。</p>



<p class="wp-block-paragraph">那你说这玩意干嘛使？就像GPT-4给大家演示的这种东西，我这边说，他就可以给我回复，包括我们看到的擎天柱机器人、FIGER01的这样的机器人，这些东西背后都是那种端到端多模态。这个才是OpenAI和谷歌他们下一步要卷的东西。咱们在这一步哈，估计应该也有团队开始上了，但是现在还稍微有些差距，而且卷那个东西。那是真的需要巨大算力和数据啊。在这一块上，我们拭目以待啊，国人到底能做成什么样。再往后一步，比如说AI PC跟AI手机，大家想没想过这玩意儿是怎么发展？如果大家最后都跑去说，我免费大模型去用去了，那么AI PC跟AI手机，最后还是要去靠多模态来搞定啊。就是说，我必须要在本地有大量的音视频信息，必须在本地进行一定的处理，在本地进行快速反应，你才需要AI PC和AI手机。你如果就是文字内容，那咱就扔到服务器上完事了，反正也不要钱，或者反正也很便宜啊。这个事情他就会变得不一样。</p>



<p class="wp-block-paragraph">所以AI PC这件事了，我觉得前路还稍微有一些些坎坷吧。最终总结一下啊，这一次大模型降价，它实际上是一个蜂巢。原因就是，我们已经把文字生成大模型彻底卷透了。卷透了以后，各大厂商准备发动最后的总攻，让所有的这些能够做APP的人冲上去，把所有的商业模式，所有的商业应用的边界都摸索一遍啊，这是现在真正要去干的事情。下一步再选，咱们就选端到端多模态了。前边文字大模型这一块，战争结束了啊。这是今天要讲的内容。感谢大家收听，请帮忙点赞点小铃铛，参加disco讨论群也欢迎。有兴趣有能力的朋友，加入我的付费频道，再见。\n</p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>开发者关系社区探讨</title>
		<link>https://lukefan.com/2014/02/24/%e5%bc%80%e5%8f%91%e8%80%85%e5%85%b3%e7%b3%bb%e7%a4%be%e5%8c%ba%e6%8e%a2%e8%ae%a8/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Mon, 24 Feb 2014 06:32:08 +0000</pubDate>
				<category><![CDATA[杂谈]]></category>
		<category><![CDATA[开发者]]></category>
		<category><![CDATA[社区]]></category>
		<guid isPermaLink="false">http://lukefan.com/?p=783</guid>

					<description><![CDATA[、 ~ 开发者社区越来越被大家所关注,一个在开发者社区这个圈子里面混了很多年的人,说说自己的看法 开发者关系社 ... <a title="开发者关系社区探讨" class="read-more" href="https://lukefan.com/2014/02/24/%e5%bc%80%e5%8f%91%e8%80%85%e5%85%b3%e7%b3%bb%e7%a4%be%e5%8c%ba%e6%8e%a2%e8%ae%a8/" aria-label="阅读 开发者关系社区探讨">阅读更多</a>]]></description>
										<content:encoded><![CDATA[<p>、<img decoding="async" src="http://lukefan.qiniudn.com/developer.jpg" alt="" /></p>
<p>~ 开发者社区越来越被大家所关注,一个在开发者社区这个圈子里面混了很多年的人,说说自己的看法</p>
<h2>开发者关系社区探讨</h2>
<p>本文首先发表在一个开发者社区讨论博客中：<a href="http://devrel.info" target="_blank" rel="noopener">http://devrel.info</a> 。这是一个博客站,一个由一些和开发者打交道的人,记录和开发者关系相关的一些故事和想法. 之所以说是故事和想法,就是不希望为这里记述的东西赋予太过于严肃的色彩. 故事,那么与事实或历史稍有出入就是可以被理解的;想法,和理论比较起来,可以不是那么严谨.</p>
<p>这是我在这个地方的第一篇博客,想和大家讲一讲开发者社区的事情. 我是Luke Fan,一个IT圈里面混迹多年的,爱讲故事的老胖子.</p>
<p><span id="more-783"></span></p>
<h3>什么是开发者社区</h3>
<p>社区这种形式一直都存在,只是以前的社区大多是以地理位置,宗教信仰,学习和工作领域,家族以及血缘关系为基础维系的&#8211;线下社区. 人是一种社会动物,一个人面对石头坐上十年,那是可以成佛的,这个故事也从另一个角度告诉我们,绝大部分的人还是需要和其他社会成员交流沟通,并从沟通过程中获得信息,帮助,以及认可. 这是马斯洛理论中人类最基本的需求之一.</p>
<p>互联网技术的普及,促使了线上社区的建立. 人们第一次有机会能够打破很多原有的限制,聚集在一起. 在互联网诞生之前,社区通常更加混沌,大家自发的根据一些特定的原因聚集在了一起,然后交流和沟通各种各样的事物,提出问题,解决问题,表达认可,获得认可. 但是人们渴望从不同的人身上得到不同的答案或认可. 比如我们会向朋友炫耀新买的IPhone5S 土豪金,但是我们的父母则会对这种每年换一部新手机的行为表现出非常的不理解. 于是互联网社区很好地满足了这种需求,可以允许我们和全世界网民中对同一事物感兴趣的人聚集在一起,并在一个相对单一和纯粹的环境中交流和沟通,寻求帮助和认可. 使用互联网社区的第一个人群,无意就是我们,互联网的建设者们&#8211;<code>开发者</code>.</p>
<p>那么所谓开发者社区就是&#8211;</p>
<ul>
<li>由开发者组成</li>
<li>以开发工具,开发语言,行业,以及在开发过程中所处的角色为划分</li>
<li>为了交流,沟通,学习开发相关的经验与技能而聚集</li>
<li>广义的开发者</li>
</ul>
<ul>
<li>软件开发者</li>
<li>开发相关其他角色&#8211;测试,项目咨询,需求管理,系统架构,系统部署,系统运维,配置管理,产品经理,设计师,以及现在最时髦的:<code>创业者</code></li>
</ul>
<h3>开发者社区的存在形式</h3>
<ul>
<li>开发者社区的基础形式</li>
</ul>
<ul>
<li>
<p>人 + 内容<br /> <img decoding="async" src="http://lbtc.qiniudn.com/glow/community.png" alt="" /></p>
</li>
<li>
<p>鸡生蛋,蛋生鸡&#8211;发起者生产内容,依靠内容聚集人群,人群在交流碰撞的过程中,再产生内容</p>
</li>
</ul>
<p>大部分社区，在最开始的时候，大多都是这么组成的。不过，随着人们对社区这种形式的不断研究，对于人群发现、聚集、流失以及沟通的过程不断分析，对于内容产生、阅读、过滤、排序、推荐、搜索优化等过程的不断研究，很多新的社区形式正在不断地涌现。这些新社区形式，对于人和内容的聚散、流转进行了更严格的规范，使得符合特定要求的人和内容更容易被聚集和产生出来。这个我们以后应该还有机会再讨论，归根结底，社区的核心就是人和内容。</p>
<h3>开发者社区分类</h3>
<p>社区有很多分类方法，这里是按照社区的商业形态以及社区的形成阶段来划分的。</p>
<ul>
<li>
<p>公益形社区</p>
<ul>
<li>自发组成</li>
<li>没有明确的商业目的</li>
<li>会为了某些必须的费用,临时聚集一些资金</li>
<li>不会产生完整的商业模式和稳定的盈利</li>
<li>存在意见领袖,但其意见不会收到商业利益的影响</li>
</ul>
<p>开发者社区,最初大多都是自发组织起来的公益社区. 这些社区在经过一段时间的发展之后,大部分消亡了。当然,这个过程中还伴随着更多的新社区的涌现. 这个长江后浪推前浪,前浪死在沙滩上的过程,在很多领域都是相同的. 那些没有消亡的社区,逐步的发展起来,有些变成了更加严谨,更具规模的非营利性组织,也就是说依然是公益性质的. 这里所谓的非盈利组织,指的是虽然获取利润,但是公开账目;虽然雇佣专职员工,但不给股东分红. 当然,这种机构在国内不能说没有,但非常罕见. 通常国内的公益性社区都无法发展到雇佣专职员工这个阶段.</p>
</li>
<li>
<p>媒体型社区</p>
<ul>
<li>借助社区的基础,逐步形成完整的媒体</li>
<li>很多是从公益社区转型而来</li>
<li>其主要商业模式,和媒体类似</li>
</ul>
<ul>
<li>吸引流量,分发广告</li>
<li>为了商业利益,引导意见风向</li>
</ul>
</li>
<li>形成完整,稳定的商业链条,取得稳定的收益</li>
</ul>
<p>任何互联网产品,都会天然的带有媒体性. 所以,公益社区向媒体社区转型,这是一种非常自然的转变,也是一种相对容易的转换. 那些原来的意见领袖,华丽转身变成了资深编辑或职业撰稿人. 然后他们利用这个媒体平台,使用传统媒体的商业模式,不断的赚取利润.</p>
<ul>
<li>
<p>服务性社区</p>
<ul>
<li>在公益社区的基础上,为开发者提供各种各样的服务,并从中得到收益</li>
<li>没有媒体性,不使用媒体的商业模式</li>
</ul>
<p>任何社区,如果希望发展壮大,总要进行职业化的转型. 那些自发形成的社区,通常是没有专职雇员的,大家都是利用业余时间来进行组织和沟通. 但是一个社区如果想要发展壮大,就必然需要组织者付出越来越多时间,那么这些组织者就要逐步的从原来的工作中解脱出来,专心的投入社区的工作中去. 转换成非盈利机构,转换成媒体是两种解决此类问题的常用路径. 但是也有一些社区或组织,其本身的核心就是一种大家在开发过程中所需要的服务,或者这种社区在运作的过程中,应成员的要求,不断地加入了一些大家所需要的服务,然后通过这些服务,收取费用,获得收入. 并最终完成职业化转型,形成一种以服务为核心的特殊社区.也有一些服务型的社区，本身也是非盈利组织。非盈利组织取得收入的方法，主要是提供服务和获得捐赠。</p>
</li>
<li>
<p>公司社区</p>
<ul>
<li>由公司创办</li>
<li>为公司产品或开放平台服务</li>
<li>以公司利益为最高行动准则</li>
</ul>
<p>最早的公司型开发者社区,都是由一些做开发工具的厂商建立的,他们本身的产品,就是为开发者服务的,他们需要找一个地方,来听取客户的意见,并作出反馈. 然后,大家开始在这些社区中讨论一些开发工具或语言的使用技巧和方法,然后逐步形成了这种从建立开始就有着明确的商业目的的社区. 现在,随着云计算,开放平台技术被越来越多大公司所使用,更多地公司型开发者社区被建立了起来,开发者的这个群体逐渐向创业者转型. 开发者的商业价值越来越受到重视.</p>
</li>
</ul>
<h3>一些对开发者社区的误解</h3>
<ul>
<li>
<p>可以先有内容,再有人</p>
<p>上面说了,这是一个鸡生蛋,蛋生鸡的过程,开发者社区的价值又越来越被大家所追捧,于是很多人会抱着更商业的目的去企图建立社区. 于是他们给这种无中生有的社区状态起了一个贴切的名字,叫做冷启动. 特指那些既没有人,也没有内容的社区. 一些聪明人想出了一种冷启动的办法,在互联网时代,人的问题不是那么好解决,但是内容的获取要容易得多. 于是一种叫做爬虫的程序就伸出了罪恶的触须. 那些凭空聚集起巨量内容的社区,通常是很难完成人员积累的. 因为人们聚集在社区的根本目的,并不是寻找信息,而是解决问题和获得认可. 没有人的社区,里面的内容再多,seo做得再好,也是很难实现这些根本需求的.</p>
</li>
<li>
<p>不一定要存在上帝</p>
<p>社区在建立的时候,都会存在意见领袖. 在社区里面讨论的内容越来越细分的过程中,每个细分领域也都会形成各自的意见领袖. 这些人是必不可少的. 除非有更大的意见领袖可以替代或引领这些自发形成的意见领袖. 一个没有意见领袖,也就是没有上帝的社区,是没有灵魂的.</p>
</li>
<li>
<p>开发者社区只能讨论和开发直接相关的事情</p>
<p>做任何事情,总会出现一些原教旨主义者,他们希望开发者社区,只讨论开发相关的问题,任何其他东西都是不被允许的. 这种社区也有生存下来的,但是壮大非常困难. 毕竟人的需求是千奇百怪的,开发者也需要养家糊口，需要聊天打屁. 当然,这些各门各类的信息,需要很好地梳理和分类,不能让那些只喜欢开发的人,或者现在正好需要解决开发问题的人们,被其他信息所打扰.</p>
</li>
<li>
<p>可以通过简单粗暴的使用一些常规的商业手法变现</p>
<p>很多社区是在职业化,或者商业化的过程中死掉的. 他们简单的寻找一些传统的商业模式来套用到自己身上,或者设法去满足一些传统企业的商业需求. 前面说了,很多社区是通过媒体化来实现职业化和商业化的. 但是很少有传统媒体成功的实现社区化的,这说明什么问题呢?互联网的东西,都带有天然的颠覆性. 这是没有办法的,传统领域,占领了所有传统的商业空间,并不会主动的为互联网让出空间,于是互联网上的产物就必须去颠覆传统的产业,要用互联网的,颠覆的思路来寻找商业模式,而不能简单的套用传统模式,或屈从于传统商业企业的传统商业需求.</p>
</li>
<li>
<p>商业价值总是和社区目标相对立的,会相互伤害</p>
<p>互联网上面,有着多种多样的,颠覆性的商业模式. 这方面的宽广,远远不是传统产业的人们可以想象的. 社区需要为用户提供价值,而社区的商业价值,应该来自社区用户的需求,而不是来自外部传统商业企业的需求.</p>
</li>
</ul>
<h3>小结</h3>
<p>之所以有人在这里撤了这么多开发者社区相关的东西,是因为组织这个网站的人,都是一些为开发者社区服务的人. 大家在从事开发者社区相关工作的过程中遇到了各种困扰,并进行了思考. 希望能够找个地方将这些思考存储下来,并依靠这些内容吸引那些对同类问题感兴趣的家伙们过来讨论一二.</p>
<p>后面还希望继续和写一些社区目标,社区商业价值,社区和企业的关系,社区和产品的关系,社区的组织和运作形式探讨之类的东西.</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
