<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>API服务 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<atom:link href="https://lukefan.com/tag/api%E6%9C%8D%E5%8A%A1/feed/" rel="self" type="application/rss+xml" />
	<link>https://lukefan.com</link>
	<description>这里是老范讲故事的主站，持续更新 AIGC、大模型、互联网平台、商业冲突与资本市场观察，帮你看清热点背后的底层逻辑。</description>
	<lastBuildDate>Mon, 05 May 2025 00:36:55 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.0.4</generator>

<image>
	<url>https://lukefan.com/wp-content/uploads/2026/03/cropped-jimeng-2026-02-28-5245-用图一的人物形象，替换图二中的人物，使用图二的风格。文字替换：老范讲故事，Yo-32x32.jpeg</url>
	<title>API服务 &#8211; 老范讲故事｜AI、大模型与商业世界的故事</title>
	<link>https://lukefan.com</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>AI大模型竞赛白热化：Meta于LLAMA CON belatedly 推出官方API与APP，对比OpenAI、谷歌Gemini、XAI及腾讯元宝的策略，其元宇宙捆绑和缓慢步伐是否已彻底错失良机？</title>
		<link>https://lukefan.com/2025/05/05/ai%e5%a4%a7%e6%a8%a1%e5%9e%8b%e7%ab%9e%e8%b5%9b%e7%99%bd%e7%83%ad%e5%8c%96%ef%bc%9ameta%e4%ba%8ellama-con-belatedly-%e6%8e%a8%e5%87%ba%e5%ae%98%e6%96%b9api%e4%b8%8eapp%ef%bc%8c%e5%af%b9%e6%af%94openai/</link>
		
		<dc:creator><![CDATA[Luke Fan]]></dc:creator>
		<pubDate>Mon, 05 May 2025 00:36:54 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[Meta的故事]]></category>
		<category><![CDATA[2023年]]></category>
		<category><![CDATA[2024年]]></category>
		<category><![CDATA[2025年预测]]></category>
		<category><![CDATA[AI Agent]]></category>
		<category><![CDATA[AIGC (AI Generated Content)]]></category>
		<category><![CDATA[AI发展]]></category>
		<category><![CDATA[AI战略]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[API服务]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[Facebook]]></category>
		<category><![CDATA[Gemini]]></category>
		<category><![CDATA[Google]]></category>
		<category><![CDATA[GPT-4o]]></category>
		<category><![CDATA[Grok]]></category>
		<category><![CDATA[Groq]]></category>
		<category><![CDATA[LLaMA]]></category>
		<category><![CDATA[LLAMA API]]></category>
		<category><![CDATA[LLAMA Con]]></category>
		<category><![CDATA[LLAMA发布历史]]></category>
		<category><![CDATA[Meta]]></category>
		<category><![CDATA[Meta AI APP]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[Qwen (通义千问)]]></category>
		<category><![CDATA[XAI (马斯克)]]></category>
		<category><![CDATA[云计算]]></category>
		<category><![CDATA[亚马逊云]]></category>
		<category><![CDATA[产品体验]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[元宇宙战略影响]]></category>
		<category><![CDATA[免费策略]]></category>
		<category><![CDATA[商业模式]]></category>
		<category><![CDATA[大语言模型 (LLM)]]></category>
		<category><![CDATA[字节]]></category>
		<category><![CDATA[应用程序 (APP)]]></category>
		<category><![CDATA[开发者大会]]></category>
		<category><![CDATA[开源模型]]></category>
		<category><![CDATA[微软云]]></category>
		<category><![CDATA[战略失误]]></category>
		<category><![CDATA[战略惯性]]></category>
		<category><![CDATA[扎克伯格]]></category>
		<category><![CDATA[扎克伯格 (Mark Zuckerberg)]]></category>
		<category><![CDATA[技术社区]]></category>
		<category><![CDATA[播客内容]]></category>
		<category><![CDATA[智能眼镜]]></category>
		<category><![CDATA[杨乐坤 (Yann LeCun)]]></category>
		<category><![CDATA[杨乐坤观点]]></category>
		<category><![CDATA[模型对比]]></category>
		<category><![CDATA[流量入口争夺]]></category>
		<category><![CDATA[深度学习]]></category>
		<category><![CDATA[百度]]></category>
		<category><![CDATA[社交优势]]></category>
		<category><![CDATA[科技评论]]></category>
		<category><![CDATA[竞品分析]]></category>
		<category><![CDATA[老范讲故事]]></category>
		<category><![CDATA[腾讯]]></category>
		<category><![CDATA[腾讯元宝]]></category>
		<category><![CDATA[行业分析]]></category>
		<category><![CDATA[起了个大早赶了个晚集]]></category>
		<category><![CDATA[追赶者]]></category>
		<category><![CDATA[阿里]]></category>
		<category><![CDATA[马斯克 (Elon Musk)]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=2160</guid>

					<description><![CDATA[**啊啊啊Meta你醒醒啊！！不买眼镜不让用AI是什么迷惑操作？！**

家人们谁懂啊！！最近被Meta气到摔手机！！🤯

事情是这样的⬇️
听说Meta终于出了官方AI助手APP，本科技宅连夜翻墙下载！结果刚打开就弹窗：「请连接Meta智能眼镜」？？？😱
我：？？？现在用AI还得先买雷朋眼镜？？（查价格中）打扰了告辞！！💸

**这波操作有多窒息：**
1️⃣ 全球用户：想用Meta AI？先交1500刀眼镜税！
2️⃣ 竞品狂喜：OpenAI/谷歌APP随便下啊喂！
3️⃣ 元宇宙PTSD：小扎你清醒点！现在2025年了！！

**对比隔壁学霸操作：**
✅ OpenAI：网页/APP/插件全平台打通
✅ 谷歌Gemini：更新慢但至少不卖眼镜！
✅ 腾讯元宝：撒钱送会员求着用户用！

**Meta三大致命伤：**
🔥 战略精分：左手元宇宙右手AI 结果两手空空
🔥 捆绑销售：眼镜滞销救救我们？
🔥 科学家拆台：自家CTO天天说大模型要完！

现在才想起来抄OpenAI作业？别人API都赚两年钱了！！💸
要我说赶紧做三件事：
1. 立刻解除眼镜捆绑！！
2. 学腾讯砸钱换用户！！
3. 把说风凉话的CTO嘴堵上！！！

所以问题来了👉 你会为Meta AI买雷朋眼镜吗？
（反正我不买🙅♀️ 评论区蹲个勇士实测！）

#AI #科技八卦 #Meta翻车 #信息差 #数码吐槽大会
（配图建议：Meta眼镜价格截图+卸载APP动图+扎克伯格元宇宙表情包）

AI大模型竞赛白热化：Meta于LLAMA CON belatedly 推出官方API与APP，对比OpenAI、谷歌Gemini、XAI及腾讯元宝的策略，其元宇宙捆绑和缓慢步伐是否已彻底错失良机？

Meta在其首届**LLAMA CON 开发者大会**上宣布推出对标**ChatGPT**的**Meta AI APP 智能助手**及官方**LLAMA API**服务，试图弥补其在大模型应用部署上“**起了个大早赶了个晚集**”的尴尬局面。然而，这款新**APP**竟要求用户必须连接**Meta**与**雷朋**合作的**智能眼镜**才能使用，形成了强制**捆绑**，而官方**API 服务**的推出也远落后于**OpenAI**、**Anthropic**等竞争对手，后者早已通过完善的**API**和多平台**客户端**积极抢占**流量入口**。与此同时，**谷歌Gemini**已调整策略迎头赶上，**马斯克**的**XAI/Grok**路径飘忽但紧随其后，国内如**腾讯元宝**更是专注于流量争夺。Meta的滞后被认为源于**扎克伯格**对**元宇宙**的持续**战略惯性**，以及其**首席科学家**、**图灵奖**得主**杨乐坤**对当前大模型技术路线的公开质疑。尽管**LLAMA**系列**开源大模型**曾有重要贡献，但其领导地位已被如阿里**Qwen**等超越，且Meta尚未与**Groq**等芯片厂商深入合作部署。分析指出，Meta仅靠模仿竞争对手补课已难以**追赶**，未来必须整合**AI Agent**能力，彻底放弃**眼镜捆绑**策略，并充分利用其庞大的用户基础和**社交场景**进行**变现**创新，才能避免在AI竞赛中彻底掉队。]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="AI大模型竞赛白热化：Meta于LLAMA CON belatedly 推出官方API与APP，对比OpenAI、谷歌Gemini、XAI及腾讯元宝的策略，其元宇宙捆绑和缓慢步伐是否已彻底错失良机？" width="900" height="506" src="https://www.youtube.com/embed/0Oza4_J8cOU?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">Meta召开LLAMA Con开发者大会。他原来丢的这些课程，现在补还来得及吗？</p>



<p class="wp-block-paragraph">大家好，欢迎收听老范讲故事的YouTube频道。4月29号，Meta召开了首届的LLAMA CON开发者大会。Meta原来是开open大会，他反正每年都会开一到两次的这种开发者大会，这是开了第二次开发者大会了。这一次呢，主要就是对LLAMA进行了一些发布。前面LLAMA4已经发布过了，而且发完了以后还翻车了。现在呢，Meta说我也要去补课了。</p>



<p class="wp-block-paragraph">补什么课呢？第一个是我要出一个独立的APP智能助手，叫MetaAI APP，对标ChatGPT。另外呢，我要开始面向开发者直接提供官方的LLAMA API服务了。这块呢，还准备去跟Groq这些芯片厂商去合作去，我帮他们去部署。现在呢，LLAMA的这些服务都是免费给大家使用的，LLAMA API未来有可能会收费。</p>



<p class="wp-block-paragraph">你说人家OpenAI一出ChatGPT就开始给大家提供服务，APP也出了这么长时间了。这Meta真的是起了个大早赶了个晚集，到今天才想起来说我的这些API也要为大家服务了，我的APP也要为大家服务了，还来得及来不及？</p>



<span id="more-2160"></span>



<p class="wp-block-paragraph">首先跟大家说一下使用的情况。MetaAI APP呢，我去下载了一个。下载完了以后呢，一开始说对不起，在你这个区域不服务，这个也很正常嘛。后来我又使用了一些手段，终于让他跑起来了。跑起来以后第一件事说，请把你的眼镜拿出来。什么眼镜呢？就是Meta的这个智能眼镜，跟雷朋做的这智能眼镜。说我必须要连智能眼镜，我在那跟他折腾了十几二十分钟。我说能不能跳过去，我说咱能不连这东西吗？不能，你只要启动这个软件就必须连这个智能眼镜，连不上它就不往前走了。我只能把它卸载了。</p>



<p class="wp-block-paragraph">至于说LLAMA API呢，因为原来我们也在云端使用各种LLAMA的模型，LLAMA2、LLAMA3都用过。但是呢，都是由第三方云厂商来提供的，从来没有官方提供的。而第三方厂商提供的这些LLAMA API的话，就都要收费嘛，而且比较贵。现在Meta说我现在要官方提供了，你直接在Meta云上就可以用了，不用再到各个的平台上去找去了。而且你到各个平台上找了，他这个版本也不一致，有大的，有小的，还有各种微调过的版本，服务的水平也不是很一致。这块，你们统一都到官方来。而且你到了官方以后呢，还可以把这种微调的版本存在官方的云上。反正我有这么多GPU，咱跑呗。</p>



<p class="wp-block-paragraph">现在用的人也少，咱们就免费。像Grok他们家的这个XAI的API，现在其实也是免费的。我现在每个月还是用的蛮多的，但是作为个人吧，应该是没有达到使用的上限。所以你基本上做各种测试、开发都是不要钱的。这后来者必须要靠免费，这是生生的迟到了两年。但是呢，依然做的非常的不彻底。</p>



<p class="wp-block-paragraph">你想LLAMA1是Meta公司2023年2月24号发布的，当时发布出来这些事就应该干。现在都2025年5月份了，才开始搞这些事情，才开始补这个坑，真的是起了个大早赶了晚集。为什么整成这样呢？就是他一直在纠结元宇宙，直到现在为止还是没有放弃。你现在想要在手机上，甭管安卓手机、苹果手机，你想要用MetaAI APP，对不起，您还得去买他们家的眼镜去。也不知道他到底卖了多少眼镜了，你没有眼镜不让用，这个很神奇。</p>



<p class="wp-block-paragraph">那么各大厂商都是怎么做的呢？看看人家先进同学、好同学，别人家的孩子怎么干的。OpenAI跟Anthropic肯定是标杆，这两家怎么干，其他人照着抄。每次发布新的模型、新的版本，一定是有官方的API出来。而且这些官方API通常是在它发布之后，有的时候可能就是当天就用了，有的时候会过个几周。比如说前两天发布的GPT4O image，就是画图的这个功能，应该是发布了以后过了两周还是三周，这个API就出来了，大家就可以上去用。而且在很努力的去争夺流量入口，甭管是OpenAI的客户端，安卓、iOS、Windows、Mac，我不知道有没有Linux版本，反正就全都有，包括各种网页都可以用。Anthropic也是如此，安卓、Mac、iOS、Windows都是有的，都在很努力的去抢占各种客户端，抢占流量入口。</p>



<p class="wp-block-paragraph">还要去做什么？Chrome插件，就是你的浏览器上还要做插件。大家有没有试过在Chrome浏览器上安装OpenAI的插件？装上了以后呢，Chrome就警告，你说它想改这个默认搜索引擎行吗？你一说同意，你再往后在Chrome的地址栏里输入什么东西一打回车，就直接上OpenAI搜索去了，没有任何其他的功能，也要把这个流量入口抢回来。人家都是这么干的。</p>



<p class="wp-block-paragraph">国内的厂商呢，通常都是站这一队，照这样学，包括是阿里、字节呀、百度。字节学的是最快的，百度跟阿里呢，还是要稍微的慢一点点。国内呢，是分两个阵营，大厂的其实通常都是云计算厂商，包括字节后边都是有云计算服务的。新势力呢基本上就是。</p>



<p class="wp-block-paragraph">照着OpenAI和Anthropic这条路走，就没毛病了。因为OpenAI跟Anthropic都不是云计算厂商，他们两家的服务器都是部署在其他人的云上的。OpenAI是部署在微软云上的，Anthropic是在亚马逊云上。这个跟国内的云厂商还不太一样，国内蔚小理这些人基本上是一模一样在照抄他们的作业，也是在抢占流量入口。</p>



<p class="wp-block-paragraph">谷歌的Gemini呢，原来也是有点晕头转向的。虽然事儿干了，Gemini的客户端也出来了，API在官方也提供了，但是呢非常难用。每一次有新模型出来以后，都是在AI studio，就是给程序员用的API接口这块，在这先出来。可能很长很长时间以后，才会去Google Gemini客户端。所以它这个版本更新的都非常奇怪，很多人说新版本出来了，我怎么用不上？你们一帮人在这说好，一帮程序员你们在这自嗨。我说对了，谷歌就是程序员的公司，它就是专门为程序员自嗨设计的。</p>



<p class="wp-block-paragraph">但是现在好很多了，最新的版本Gemini 2.5 Pro已经在Gemini的客户端上直接可以使用了，而且可以免费使用。这就完完全全在抄OpenAI的作业，现在Google算是醒过味来了，而且这个作业呢基本上算抄对了。Gemini 2.5 Pro是我现在用过的各种模型里效果是非常非常好的一个，特别是对程序员很友好。所以我现在大量的工作都是使用Google Gemini来工作。</p>



<p class="wp-block-paragraph">马斯克的XAI呢，它的路径比较飘忽。因为公司非常小，它的融资规模很大，但是人很少。他的路径呢经常是看谁家好，就赶快往里边飘一点，那边好就往这边飘一点。要开源，我也开源去了；要提供API，我也去提供API；需要APP吗，我也来了。现在Grok APP是单独的，是在x之外专门有一个APP叫Grok。你说我需要做什么deep research，需要做什么AI agent，这那我也上。一帮人更新了以后，我这个Xai的GROK3好像不是最新了，不是最好用的这个了。更新更新，5月5号这周，马斯克承诺要更新Grok 3.5出来。他就还比较飘忽。</p>



<p class="wp-block-paragraph">腾讯呢，算是逼不得已自成一派。为什么？他前头走的比较慢，自己做的各种模型压根就没怎么做出来。等到DeepSeek上来以后说算了，我全线拥抱DeepSeek吧，就开始直接抢流量去了。就是底层模型它就不更新了，或者更新了，大家也不太惦记了。所以现在腾讯在用元宝跟大家抢流量。</p>



<p class="wp-block-paragraph">Meta呢，到目前为止，其实依然没太想明白后边到底要怎么玩。虽然它开发了独立APP，虽然他现在开始提供官方API了，但是未来怎么办，他其实还没想明白，更不要说怎么能够赶上了。那你说Meta到底是，怎么整成这样的一个样子呢？起了个大早，赶了个晚集。</p>



<p class="wp-block-paragraph">第一个大原因是战略上的惯性。扎克伯格呢，一直惦记搞元宇宙。这个原因也很简单，并不是说扎克伯格看到了元宇宙未来发展的方向，他只是被苹果恶心到了。作为一个这么大公司的老板，这么大的平台，全世界有这么多用户，被苹果狠狠地恶心了一把。因为他的软件必须要在苹果和安卓的设备上才可以去挣钱，才可以去放广告。苹果说我要管你，你的这个权限不能有，那个权限不能有，这个数据不能用，那个数据不能用，差点没被苹果弄死。然后扎克伯格说，我一定要革苹果的命。原来Facebook是个APP嘛，你要上人家的APP store才可以去工作，你上了人家的APP store，人家就要立规矩，你要去遵守。现在说APP是最差的，我坚决不要这东西。但其实呢，他所谓的元宇宙是他自己要坐苹果那个位置。在这个位置上，我要让其他的人都在我这下面做APP。他就惦记说我要去整平台，这就是他整元宇宙这个事的最初始目的。</p>



<p class="wp-block-paragraph">后来发现搞不定，因为VR、AR都卖的不是很好。搞不定，那怎么办呢？转向这个大语言模型，因为别人都在做这件事，他不转这个向他搞不定。但是呢，内部的各种层级条块之间都不太愿意去放弃元宇宙这个事情。原因很简单，扎克伯格自己没放弃。现在他去开各种的什么财报会、年会、季会什么，还在那讲的，说我元宇宙这事没放弃，我还接着干呢。VR头像其实也还在做。但是呢，现在主要想去做跟雷朋设计的这个眼镜，我也没买过。甚至还出来说，我现在要进入时尚界，这个眼镜是最时尚的事情，在开始搞这样的一个，就是没有梗硬吃的这么一个事情。</p>



<p class="wp-block-paragraph">现在在这样的一个平台下呢，特别是老大没有放弃的情况下，那只能大家说，什么事都得带上点。你如果不戴上的话，好像就是忠诚的不绝对，就是绝对的不忠诚。我记得原来有首诗词：“宰相巍巍坐庙堂，说着精量便要精量。那个幕僚上一章，头说精良尾说精良。轻狂太守在五洲，闻说精良星夜精良。山东河北久抛荒，好去精良胡不精良。”这个是南宋时期一个词人写的词。什么意思？就是这个宰相在庙堂上坐着，说我要把这个土地丈量一下。他说完了以后呢，拍脑袋说一出是一出。下边这些幕僚官署呢。</p>



<p class="wp-block-paragraph">一看到这事，这赶快得说呀！我也得上一个章附和一下。从头说丈量，尾巴上也说丈量。有一个很轻狂的太守，听说要丈量土地了，星夜丈量，就是晚上就开始干，不要等明天了。说这个河南、山东、河北这么多地方都被金人侵占了，现在金人走了，这一块都抛荒了，你这怎么不去丈量？讲了这么一首词，其实就很像是Meta现在的一个状态。</p>



<p class="wp-block-paragraph">做了个APP，还惦记把那个眼镜挂上，不挂眼镜不让你用。这个呢，算是在特定语境下的黑暗森林。黑暗森林法则是什么？就是猜疑链嘛！不知道你是不是好人，我也不知道怎么告诉你我是好人，我也不知道我告诉你是我是好人之后，你会怎么对待我。这个产业链无限延长以后，就没有办法沟通交流了。其实很多大公司都是这样的，现在对于Meta来说就是这样。我不知道你是不是元宇宙这一派的，我也不能告诉你我不是元宇宙这一派的，我是大模型这派的。我不能跟你说，我也不知道我告诉你了，我不是元宇宙这派的，你会怎么反馈。他会有这样的事情。</p>



<p class="wp-block-paragraph">但我只知道呢，在这个公司里从上到下，你是不能批评元宇宙这个事的。你不能说元宇宙不好，这个事也不容置疑。这个事是变成这样。其实在任何一个语境里头，当某件事情不容置喙的时候，就会形成一个黑洞，就会变成一片黑暗森林。这个是Meta掉队的一个很重要的原因，因为他战略方向一直没有确定下来，还惦记玩元宇宙呢。</p>



<p class="wp-block-paragraph">另外一个原因是什么呢？就是他的科学领头人太科学、太超前了。他科学领头人是谁？叫杨乐坤，是个法国人，后来跑到美国去。他呢是Meta的副总裁兼首席人工智能科学家，基本上就是他领头的。这光环满满，深度学习三巨头，这个项目是2018年获得图灵奖，所以也叫图灵奖三巨头。因为获图灵奖人多去了，但深度学习这块三个老大。然后呢，还有一个title叫卷积神经网络之父。这样的一个人在这带头，这么有钱的公司，这么多用户，老板也说我要去做大模型了，还有这样的科学带头人在这顶着，那咋就不行呢？</p>



<p class="wp-block-paragraph">这个老哥每天出去演讲，都在讲什么？大语言模型不行了，靠预测TOKEN这种方式是搞不定的，这条路走不通。作为大学教授、科学家，你愿意讲什么讲什么没问题。他呢只是太超前了。未来一段时间，肯定还是会有新的方法、新的算法来去替代Transformer，来去替代这种TOKEN预测这个方式。你现在作为一个公司的副总裁和首席科学家，你讲这个话真的不合适。你讲这个，你让下边人怎么干活？怎么向你汇报工作？上杨乐坤这汇报工作来了。</p>



<p class="wp-block-paragraph">我们把LLAMA4再怎么推进了一下，然后他给你讲了半天说这事不行，这条路走不通的。你说你咋办？所以Meta是一个什么样的现状？CEO还惦记搞元宇宙呢，首席科学家总在那说方向错了。那你让下边人怎么干活？好难。</p>



<p class="wp-block-paragraph">他发了这四个版本的LLAMA，真的是为中国奠定了大模型的基础。没有他们，就绝对没有中国今天的大语言模型。什么人工智能、AIGC，整个都没有，都是从这开始的。所以还是要感谢他们。</p>



<p class="wp-block-paragraph">但是呢，在自己的产品跟服务之中，只进行了非常有限的改进和融合，并没有完完全全把这些LLAMA用起来。新的流量完全放弃，因为他自己有的是流量。OpenAI、Anthropic、谷歌现在在抢占的这个流量，原来就压根没动过，到今天才开始想起来：“我也得得着这流量，不能让你们都拿走了。”</p>



<p class="wp-block-paragraph">弄完了以后还眼镜捆绑上去，没有眼镜我不让你玩。我很高傲，玩了这么一套东西。新的技术社区完全任其自生自灭：“我把LLAMA做出来了，做完了以后呢，你不能在我的社区讨论，你也不要到我这儿来。去使用官方API？没有的，你们谁愿意用谁用。反正我头一个我把东西拿出来了，大家都跟着使，就这样就完事了。”</p>



<p class="wp-block-paragraph">新的技术方向已经基本上失去领导地位了。开源大模型这一块，基本上是被阿里的Qwen站在前面，真正领旗的位置上了。那你说现在还来得及吗？咱们最后来回答这个问题。</p>



<p class="wp-block-paragraph">结论：再照抄别人的作业，肯定是来不及了。因为人家已经提前跑了两年了，你现在大模型也不比别人先进，甚至还是测评翻车的一个状态。现在想把人家的这个官方API和独立APP这个作业抄上，就想去追赶，这是不可能的。</p>



<p class="wp-block-paragraph">现在就还需要补更多的课。第一个是什么？就要把AI agent加上，现在他这一块呢还是短板，别人都已经走到这一步了，还得把这个课补上。第二个呢，别再捆绑眼镜了行不行？你想，Meta那么多用户，有多少用眼镜了？你现在是要把所有的Meta用户转换过来来做Meta AI，而不是说眼镜那几个用户。甚至这个眼镜用户，可能还要把这个吃灰的眼镜再拿出来，再去转换Meta AI。所以不要再去捆绑眼镜了。</p>



<p class="wp-block-paragraph">如果不捆绑的话，过两天我再去试一试。如果真走通了要干嘛？像腾讯现在推元宝这样撒狠钱进去推。但是Meta好像在这块一直都比较佛系，因为流量对于他来说比较富裕嘛。他老觉得这些流量就在这待着，我只要是给了功能，大家就会去使。真砸钱去推这一块的话，Meta好像并不是特别激进。腾讯现在就是砸死了钱往里推。</p>



<p class="wp-block-paragraph">一个月花多少亿人民币往里砸，现在在干这样的一个事情。Meta真正该干的活是什么呢？就是要放大自己的优势：场景、社交。要跟腾讯学，还有各种变现。Meta的变现就是在Meta上打广告，然后做各种的社交、内部的信息传播。这块是非常强大，有一堆人在围绕这一块去思考，再去写程序，再去创业。</p>



<p class="wp-block-paragraph">Meta的LLAMA一定要在这一块要往前再走一步。如果这块不走的话，他一点优势都没有。这就是今天咱们讲的故事。Meta现在补作业还来得及来不及？</p>



<p class="wp-block-paragraph">这个故事今天就讲到这里。感谢大家收听，请帮忙点赞，点小铃铛，参加DISCORD讨论群。也欢迎有兴趣、有能力的朋友加入我们的付费频道。再见！</p>



<p class="wp-block-paragraph"></p>
]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>OpenAI推出GPT 4o mini，这是要卷死谁？Sam Altman封禁中国 API IP后放大招，你就给我看这个？中国大模型是不是有机会弯道超车？</title>
		<link>https://lukefan.com/2024/07/23/openai%e6%8e%a8%e5%87%bagpt-4o-mini%ef%bc%8c%e8%bf%99%e6%98%af%e8%a6%81%e5%8d%b7%e6%ad%bb%e8%b0%81%ef%bc%9fsam-altman%e5%b0%81%e7%a6%81%e4%b8%ad%e5%9b%bd-api-ip%e5%90%8e%e6%94%be%e5%a4%a7%e6%8b%9b/</link>
		
		<dc:creator><![CDATA[老范 讲故事]]></dc:creator>
		<pubDate>Tue, 23 Jul 2024 00:48:07 +0000</pubDate>
				<category><![CDATA[AIGC]]></category>
		<category><![CDATA[100亿参数]]></category>
		<category><![CDATA[10亿参数]]></category>
		<category><![CDATA[70亿参数]]></category>
		<category><![CDATA[AI Agent]]></category>
		<category><![CDATA[AI模型策略]]></category>
		<category><![CDATA[Anthropic Cloud H3]]></category>
		<category><![CDATA[API代理]]></category>
		<category><![CDATA[API服务]]></category>
		<category><![CDATA[API调用]]></category>
		<category><![CDATA[GPT-3.5]]></category>
		<category><![CDATA[GPT-4o]]></category>
		<category><![CDATA[GPT-4o MINI]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[Plus用户]]></category>
		<category><![CDATA[Plus订阅计划]]></category>
		<category><![CDATA[个人服务器]]></category>
		<category><![CDATA[中国市场]]></category>
		<category><![CDATA[云端模型]]></category>
		<category><![CDATA[产品发布]]></category>
		<category><![CDATA[付费频道]]></category>
		<category><![CDATA[价格便宜]]></category>
		<category><![CDATA[价格策略]]></category>
		<category><![CDATA[低价模型]]></category>
		<category><![CDATA[免费用户]]></category>
		<category><![CDATA[函数调用]]></category>
		<category><![CDATA[分岔趋势]]></category>
		<category><![CDATA[功能集成]]></category>
		<category><![CDATA[参数未公开]]></category>
		<category><![CDATA[台式机模型]]></category>
		<category><![CDATA[合作伙伴]]></category>
		<category><![CDATA[商业模型]]></category>
		<category><![CDATA[商业策略]]></category>
		<category><![CDATA[大模型市场]]></category>
		<category><![CDATA[大模型替代]]></category>
		<category><![CDATA[封禁中国IP]]></category>
		<category><![CDATA[小模型]]></category>
		<category><![CDATA[小模型效能]]></category>
		<category><![CDATA[工作流]]></category>
		<category><![CDATA[工作站级别]]></category>
		<category><![CDATA[市场占有率]]></category>
		<category><![CDATA[市场反馈]]></category>
		<category><![CDATA[市场竞争]]></category>
		<category><![CDATA[市场趋势]]></category>
		<category><![CDATA[市场需求]]></category>
		<category><![CDATA[应用开发]]></category>
		<category><![CDATA[开源模型]]></category>
		<category><![CDATA[微型模型]]></category>
		<category><![CDATA[技术优势]]></category>
		<category><![CDATA[技术创新]]></category>
		<category><![CDATA[技术挑战]]></category>
		<category><![CDATA[技术程度]]></category>
		<category><![CDATA[技术进步]]></category>
		<category><![CDATA[技术领先]]></category>
		<category><![CDATA[数据调用]]></category>
		<category><![CDATA[未来计划]]></category>
		<category><![CDATA[本地部署]]></category>
		<category><![CDATA[模型升级]]></category>
		<category><![CDATA[模型性能]]></category>
		<category><![CDATA[浏览器插件]]></category>
		<category><![CDATA[用户体验]]></category>
		<category><![CDATA[用户分叉]]></category>
		<category><![CDATA[用户反馈]]></category>
		<category><![CDATA[用户吸引力]]></category>
		<category><![CDATA[用户满意度]]></category>
		<category><![CDATA[用户粘度]]></category>
		<category><![CDATA[用户需求]]></category>
		<category><![CDATA[田忌赛马]]></category>
		<category><![CDATA[移动端模型]]></category>
		<category><![CDATA[竞争对手]]></category>
		<category><![CDATA[竞争策略]]></category>
		<category><![CDATA[端侧使用]]></category>
		<category><![CDATA[端侧竞争]]></category>
		<category><![CDATA[经济考量]]></category>
		<category><![CDATA[经济高效]]></category>
		<category><![CDATA[视觉多模态识别]]></category>
		<category><![CDATA[训练成本]]></category>
		<category><![CDATA[谷歌Gemini Flash]]></category>
		<category><![CDATA[输入100万TOKEN]]></category>
		<category><![CDATA[输出100万TOKEN]]></category>
		<category><![CDATA[高性能模型]]></category>
		<category><![CDATA[高效模型]]></category>
		<guid isPermaLink="false">https://lukefan.com/?p=1426</guid>

					<description><![CDATA[OpenAI在封禁中国IP访问其API之后，第一个大动作居然是发布了一个GPT4o mini。你发布了个小模型 ... <a title="OpenAI推出GPT 4o mini，这是要卷死谁？Sam Altman封禁中国 API IP后放大招，你就给我看这个？中国大模型是不是有机会弯道超车？" class="read-more" href="https://lukefan.com/2024/07/23/openai%e6%8e%a8%e5%87%bagpt-4o-mini%ef%bc%8c%e8%bf%99%e6%98%af%e8%a6%81%e5%8d%b7%e6%ad%bb%e8%b0%81%ef%bc%9fsam-altman%e5%b0%81%e7%a6%81%e4%b8%ad%e5%9b%bd-api-ip%e5%90%8e%e6%94%be%e5%a4%a7%e6%8b%9b/" aria-label="阅读 OpenAI推出GPT 4o mini，这是要卷死谁？Sam Altman封禁中国 API IP后放大招，你就给我看这个？中国大模型是不是有机会弯道超车？">阅读更多</a>]]></description>
										<content:encoded><![CDATA[
<figure class="wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio"><div class="wp-block-embed__wrapper">
<iframe title="OpenAI推出GPT 4o mini，这是要卷死谁？Sam Altman封禁中国 API IP后放大招，你就给我看这个？中国大模型是不是有机会弯道超车？" width="900" height="506" src="https://www.youtube.com/embed/NlHlullCcvA?feature=oembed" frameborder="0" allow="accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share" referrerpolicy="strict-origin-when-cross-origin" allowfullscreen></iframe>
</div></figure>



<p class="wp-block-paragraph">OpenAI在封禁中国IP访问其API之后，第一个大动作居然是发布了一个GPT4o mini。你发布了个小模型，这究竟是要卷死谁啊？中国团队是不是有机会弯道超车呢？大家好，这里是老范讲故事YouTube频道。Open AI第一次发布微型模型，以前的Open AI都是一个比一个大，因为原来人家讲的叫Scaring Law，就是这种伸缩法则，只要是变大，我一定会变强。而且，也嘲笑那些小模型说你们肯定不行啊，一定是大的好使。我自己原来也是很喜欢使用大模型，有大的不识小的，这是我原来挑选模型时候的基本原则。但是现在，Open AI开始卷小模型了。</p>



<p class="wp-block-paragraph">Open AI的这个GPT4O mini有什么特点呢？第一个，快啊，小模型一定是比大模型跑得快的。另外，就是极其便宜，它这个里面输入的信息，100万TOKEN，15美分啊，非常非常便宜了。输出的信息呢，是100万TOKEN，60美分，也就相当于是100万4块多人民币啊，已经快要接近国内的这些模型的价格了。效能呢，也应该是比GPT3.5要强一些啊，这是GPT4O MINI的一个基本情况。</p>



<p class="wp-block-paragraph">那么，这样的一个鼓励越大越好的公司，原来更多的人力肯定是去研究更大的模型去了。现在说不，我要上一个小的，而且这种小模型呢，跟一般的小模型还有区别。区别在于它可以支持Function Call，可以支持视觉多模态的识别。那么，这是GPT4O MINI比其他的普通小模型所独有的特点。</p>



<span id="more-1426"></span>



<p class="wp-block-paragraph">以上就是关于Open AI发布GPT4O mini的全部内容，如果你对这个话题感兴趣，欢迎在评论区留言。我们下期节目再见！</p>



<p class="wp-block-paragraph">型U的地方，那么MINI到底有多大呢？并没有说。其实啊，大家出的这种小模型，这种必原厂商出的小模型，都是不会对外讲说“我到底有多大”。包括一些开源厂商自己去出的一些啊，闭园小模型，也不会告诉外边到底有多大。比如说吧，灵异万物对吧，他的对外模型是开源的，告诉你这个是6B的，9B的，34B的。但是呢，它自己内部壁源的这些模型，就是你直接通过商业方式去买的啊，它就分什么medium，large，是这样分的啊，你不知道它到底有多大。包括像谷歌啊，Gemini Flash到底有多少个参数，你也不知道。Gemini Pro你也不知道有多少参数啊，cloud三个版本，其实各个参版本有多少参数，都是不说的啊。所以啊，Open AI的GPT4O mini到底有多少个参数，也不知道。现在呢，大家普遍猜测应该是在10币以内，大概也就是7币，也就70亿到100亿之间的参数，应该算是最小一个档次的。</p>



<p class="wp-block-paragraph">怎么用这个模型呢？免费用户跟plus用户，已经可以跟GPT3.5说再见了。那就是我们现在打开了啊，Open AI的聊天网站之后，能够看到的三个模型：一个叫做GPT4O，一个叫GPT4，一个叫GPT4欧mini。三点五已经彻底成为过去式了。API的用户，你现在依然可以使用3.5，因为这个是不可能马上取消的啊，大家都写在程序里头了啊。模型的名字叫GPT3.5，特本什么什么的叫这样名字，你要说我直接把这个模型关闭了。不过，这通常不会发生，因为很多用户和开发者都依赖于它。</p>



<p class="wp-block-paragraph">然后，上1GPT 4O mini一下替代掉的话，这事肯定不行对吧？那个程序会报错的。所以啊，GPT4O mini啊，现在已经可以为啊，直接使用Open AI API的这些用户开放了。啊，但是呢，3.5还是可以用的，现在我还没法使啊。为什么呢？因为我没有办法，直接从Open AI去买它的API服务的啊。它会识别出来，我在中国大陆不会为我服务的。所以，我现在的CPT相关的API，是通过扣子或者是一些Open AI代理服务去购买的。但现在，这个上面都没有GPT4O MINI的这个模型。为什么在这样的一个时间点，出了这么一个产品呢？他把中国大陆的API的IP封掉了以后，本来想着，他是不是专心的做个GPT5出来，或者做一点啊，把这个前面吹过的牛稍微能还上一点啊。怎么现在整了那么个小东西出来？</p>



<p class="wp-block-paragraph">首先，大家要想清楚一个问题啊，Open AI就是行业里边的老大。老大最怕什么啊？老大怕竞争吗？啊，现在没有人跟他竞争啊，谁也竞争不过他。虽然现在号称御三家，就是谷歌、Siropic和Open AI里头，已经可以打个有来有回了。但是，从市场占有啊，从整个技术的程度上来说，Open AI还是绝对领先的。那么，他到底怕什么呢？他害怕的东西叫分叉啊。什么叫分叉呢？就是有很多的人是不会去看别的服务的，也不会去用任何其他的大模型，上来就用Open AI家的啊，其他所有我都不用。那么，这个呢，就属于忠实铁粉。但是一旦分岔了以后，可能会出现一些小的分支，这些分支会逐渐壮大，最终可能会影响到Open AI的市场地位和影响力。为了避免这种情况的发生，Open AI可能会采取一些策略，比如推出GPT4O MINI这样的产品，来吸引更多的用户，保持其在市场上的主导地位。同时，通过限制某些地区的直接访问，Open AI可能也在试图保护其技术和市场，防止技术的过度扩散和滥用。</p>



<p class="wp-block-paragraph">大家说：“哦，不，我不能只用Open AI的，我所有的都要用一下。我要在不同的场景里头，找到不同合适的模型来使用。这个过程要分叉了，老大最怕的就这件事情。他现在已经看到了有分叉的这种方向了啊，或者说，他现在已经看到了有分叉的趋势了。所以，必须要冲出来说，我要把所有分叉的趋势，掐死在萌芽状态啊。这就是GPT4O MINI发布的一个大的前提。因为GPT4和GPT4欧，包括GPT4 Turbo所有的这些模型呢，它比较贵。越来越多的人呢，就希望转型。像我现在做很多这种AI agent，这种工作流，我会把最费劲的一个点交给GPT去做。对于理解能力，对于推理能力没有那么强的节点，我都尽可能去选择更便宜的，这种大模型来工作，或者更小一点的大模型来工作。这个是经济的考量啊，而且我们发现，在这种稍微小一点的大模型，你让他做简单的工作，效果其实是很好的，并不比GPT4差啊。这个是现在Open AI不能允许的啊，你们就老老实实的，你要想去用这个小模型，我也给你提供上啊。这个是要注意。</p>



<p class="wp-block-paragraph">而且呢，现在所有在跟Open AI竞争，或者说在Open AI这条道路上，追赶他的这些人呢，目标都很明确。怎么叫目标明确呢？每一个人上来说，我现在都是接近GPT4对吧，没有人超过啊，就很少有人超过，或者可能只是在个别指标上超过。整体超过的，现在还没有，或者说不多吧。但是呢，我们现在甭管国内的大模型，国外的大模型，都在努力地追赶，试图在某些方面超越Open AI，这是一个非常明显的趋势。</p>



<p class="wp-block-paragraph">都说我现在已经接近GPT4了，然后呢，遥遥领先于GPT3.5。对吧，这也是现在的一个时间点。而且，很多的小模型，甚至是这种70亿、100亿、300亿、几百亿这种模型，都已经超过GPT3.5了。GPT3.5有多少个参数呢？当时是1750亿个参数，这么多的参数，怎么还这么差呢？这么多年了，时代在进步，而且AIGC大模型的发展，真的叫日新月异，每一天每一个小时都在发生变化。</p>



<p class="wp-block-paragraph">这么长时间过来以后，你用原来这种架构，GPT3.5的这种架构，它确实是效能比较低了。所以现在很多的这种1000亿以内的，700亿的，或者是更小一点的，几百亿的，都可以超过GPT3.5。那么GPT3.5就已经必须退役了。</p>



<p class="wp-block-paragraph">退役的原因也很简单：第一个，原来GPT3.5一直挂在那，不是说Open AI没有更好的模型给大家用，而是什么呢？他希望让你去买它的Plus，让你说，哎，你看这个实在是难使吧，你直接升级，一个月20美金就可以有GPT4用了。GPT3.5跟GPT4之间，一定要有一个很明显的，个人可以直接感知到的差异，你才会觉得我这20美金一个月花的值，否则的话，你会觉得花的不值了。</p>



<p class="wp-block-paragraph">但是现在其他的模型都赶上来了，你再继续摆这么一个3.5在这恶心人，就已经不太合适了。另外一个是对于免费用户来说，GPT3.5实在是缺乏吸引力，我不愿意付钱，我可以使用Gemini呀，我可以使用很多的其他免费的这种模型。</p>



<p class="wp-block-paragraph">这些模型，现在已经完完全全超越三点儿五了。所以，这个也是到了该抛弃三点儿五的时候了。另外呢，很多的API代理也让Open AI非常不爽。像我就是用的API代理啊，API代理呢，像跑冒滴漏。像我现在用Open AI的所有API，价格应该是至少打到4折，或者是还要更低一些的折扣啊。我就可以去使用。</p>



<p class="wp-block-paragraph">到了那么这些的话，Open AI觉得就算是打折，也应该从我这打啊。凭什么你就去打折了啊？这个他是不开心的。而且他现在降到这样的一个程度，为什么这些API代理没有跟进呢？他没利润啊，这些啊，也是会对他们造成一定的影响和损失。</p>



<p class="wp-block-paragraph">另外，也要开始应对中国了。Open AI肯定发现，封堵了中国IP的API调用之后，Open AI调用数据一定是在暴跌的啊。这个肯定也不是他们希望看到的。</p>



<p class="wp-block-paragraph">现在我们要讲一下田忌赛马的故事。田忌赛马是什么？就是用我最好的马，对应你这个中间的马啊，用我中马对应你的下马啊。你最上面那个你赢一场算了，剩下的我赢两场。在大模型这个行业里头，其实也是如此的。大家呢会分成不同的层次去竞争，端侧的竞争，就是说我们甭管在手机端、PC端还是各种的啊，设备端吧。那么现在大家在争的是什么？Open AI基本上是不参加端侧竞争的啊。哪怕它是GPT4OMINI，到目前为止，也没有说，这个产品可以给大家在端上使用啊。当然你说，未来会不会把这东西拿到端上来使用？不确定啊。但是至少现在没有说这个事儿。</p>



<p class="wp-block-paragraph">呃，它这个大家猜测在10B以内，可能7B到8B这样的一个水平上。按道理说，是在手机上可以运行的。对吧，可以在iPhone里头跑。那么是不是说，呃，跟苹果合作了，我干脆就把这东西呃，拿出来就给大家用了。是不是他给了苹果一个类似于一个GPT4OMINI的版本，但是苹果你不允许拿出去再扩散了啊。但是在iOS 18里边，应该会带这样的一个东西，可能性是存在的啊。啊，但是这个事谁都没说。</p>



<p class="wp-block-paragraph">在端侧竞争上，一般移动端呢，5B以内的跑的是比较好的啊。你如果手机的配置高一些，跑到7B到9B应该也还是能跑的。台式机呢，你到10B左右啊，都是没有什么问题的。包括我们后边讲的这些AIPC，其实AIPC是所有能够跑大模型的台式机里头，水平比较烂的啊。那么工作站呢，就是我们比较高端的台式机，比如说你这里头有独立显卡啊，4090，然后不是4090，你有个四零六零，四零七零那样的独立显卡，或者比如说像我们使用麦克这种呃，M1，M2 Max，或者M3 Max这样的这种机器的啊，那么它就基本上属于工作站级别了。这种机器里头呢，大概跑到三十几B都是可以跑通的啊。再大了跑不动了。</p>



<p class="wp-block-paragraph">然后像这种个人服务器上，是可以跑到70B的。咱们现在能够接触到的开源大模型，可以到本地跑的，基本上也就是70B，72B到头了。再大一点呢，啊，通1,000问1.5的时候出过一个110B啊，但是那个模型流行的并不是很广泛。</p>



<p class="wp-block-paragraph">绝大部分都是在七十几币就到头了。这个呢，就是在思域服务器上用的。而且，在70B这个档次上，现在Open AI肯定是感受到压力了。中国团队基本上在70B这个档次上，站稳脚跟了。咱们国内推的各种各样的大模型，基本上都是70B上下的。为什么？因为懒。Meta的LaMa3就是70B的。我们在这个基础上再去进行调整，或者再去进行一些相应的训练吧。我们出到72B，或者七十几B这样的一个模型，效果其实已经很好了。加上RAG，就是本地知识库的这种辅助，加上长上下文，再加上多模态搜索的辅助，效果其实跟GPT-4之间，已经没有那么差了。对吧，GPT-4就是说你不加上这些东西，它也可以回答的很好啊。你如果是加上这些，搜索辅助啊什么的，70B基本上够使。</p>



<p class="wp-block-paragraph">对于快速反应的这种低价模型来说，大家竞争的是什么？刚才咱们讲的是端侧模型啊。在云端模型其实也是分两拨的。一拨呢，就是大模型啊。大模型是，GPT啊，Gemini Pro这个，呃，Cloud Opus啊，这些就属于大模型啊，比较贵，性能比较高。那么大家都去推这种小模型，特别是另外两家。刚才预三家我们讲了啊，Open AI，谷歌和Anthropic。谷歌跟Anthropic都推了一种小模型，一个叫Gemini Flash，另外一个呢，叫做Cloud Haiku，叫这样的一个名字，都是相对比较小的，很便宜，反应速度很快。原来啊，GPT3，GPT是没有的，现在出来就是要去卷它们。大模型竞争。</p>



<p class="wp-block-paragraph">咱们自己去比一比啊。这个小模型，你们出了，我也得出一个。所以，咱们回答开题的那个问题：“Open AI到底想卷死谁啊？”他想卷死的是Gemini 1.5、Flash和Cloud 3，嗨酷啊。是选这两个产品，但是要注意啊，Cloud 3.5现在已经出来了。但是3.5呢，只出了Sonit一个产品啊。它是分三个档次的，这种大模型啊。一个叫做High酷，是最小的，估计应该是10亿币以内，也就是7亿左右的一个模型。然后是Sonit啊，3.5已经到Sonit，它呢应该是在二三十亿币。但是都不是对外公开的啊。还有一个叫Opus啊，Opus是最大的，但是Opus到底有多大，可能是上百亿币的一个模型对吧。现在呢，3.5已经把中间这个模型出来了，上下两个还没出，估计呢应该本月会出。</p>



<p class="wp-block-paragraph">所以在这个时候啊，Open AI说不行，我要把你这个底层的，这个给你封掉啊，让大家觉得啊，就算是用这种底层的小模型啊，这个也有一个更便宜的Open AI来用啊。这是他真正要去干的事情。那么对于开源模型来说的话啊，就是本地部署这个呢，Open AI应该不在这个赛道上啊。它有可能说，我用一些必源的模型，直接跟苹果，跟谁去合作，这个事可能是存在的。但是呢，他不会说我到GitHub上，到HuggingFace上，直接把这个GPT40 mini扔出来啊。应该不会干这个事情。</p>



<p class="wp-block-paragraph">那么对于中国团队来说，到底有没有弯道超车的机会？这是一个值得探讨的问题。</p>



<p class="wp-block-paragraph">这也是我们开题上的一个问题，对吧？“卷”就一个字，在这个字上呢，中国团队绝对是遥遥领先的。中国现在已经开始卷下一个层次了啊，在上一个层次里头，中国团队发现：哎，我只要把模型推到七十几，对吧，加上搜索辅助，加上reg，加上这个啊，长上下文，效果已经非常好了，对吧，不需要再往前推进了啊。真的效果非常好了吗？很多人说你是不是吹牛啊。他这个事是这么算，就是再有相差的这部分，个人感觉不出来，因为人的感受有时候很主观的啊。你不可能说：哎，我去招聘了，对吧，我一定要挑出最好的那一个来，不可能的。你一定是找了一个相对顺眼的，然后磨合了一段时间，发现：哎，这个工作还能干得下去，日子也能过得下去啊，也不讨厌，你就可能一直用这个人用下去。你不可能说：哎，旁边这个人，好像比我招的这小伙子，还要更厉害一点，对吧，我就马上把我这开了，把那个人招回来，不会干这个事了。在这样的一个情况下啊，我们只要用习惯了，慢慢的对于我们已经招聘进来的人，就会有更高的容忍度。为什么要讲招聘的故事呢？其实我们使用大模型的过程，跟招聘的过程差不多。在挑选的时候，我们一定是非常小心的，来去确定到底哪一个适合我们，我们的这个任务，它是不是可以很好的完成。一旦你把它挑进来了，下一件事是什么？就是我们要去跟他磨合，怎么能够跟这个大模型一起，把我们要做的事情做完。当大家互相习惯了以后的话，你不会说：哎，那个更好，我马上换人的。一个大模型，它是有很高的粘度的。</p>



<p class="wp-block-paragraph">所以，中国团队在70亿参数这一块，基本上已经达到了一个阶段，我们可以说，我们已经能够吸引一部分用户，而且这部分用户愿意留下来，持续使用我们的产品。再往前推进，当你提到我现在发布的几千亿参数的模型，也就是几百亿参数的这类模型时，第一个问题在于训练上，我们可能还没有完全搞明白，应该如何应对这个挑战，因为目前开源出来的就是70亿参数的模型，再大的版本现在还没有开源，所以这件事情还搞不定。</p>



<p class="wp-block-paragraph">那么再往上，你说我们闭着眼睛去研究一下行不行？也不行，为什么呢？因为越大的模型，你训练的成本就越高，而且越难去控制。在这种情况下，我们可以说，我们就停在这了。那么停在这，中国团队现在在干嘛呢？他们搞APP开发，搞各种接触用户的方式，我们现在要去获取所有用户，这是我们已经开始卷的东西，Open AI还没卷到这呢，我们其实已经开始弯道超车了。</p>



<p class="wp-block-paragraph">你说Open AI不是也有APP吗？它有安卓APP，有iOS APP，甚至最近还开始出Mac APP。但是你要想清楚，中国人做的是什么呢？聊天、搜索、绘图、情感陪伴，都整合在了一个APP里头。而且，我们的APP是Windows、Mac、安卓、iOS全都有。你说Open AI自己为什么不做一个Windows APP？亲爹不让啊，谁是亲爹？微软。微软说这个事情打住，我在那边玩Copilot，你自己不要来找这个事情，你到Mac那边去玩耍就可以了。有什么问题，去霍霍苹果，不要来霍霍我，这个他就没法整。而在中国，你看看啊，豆包，所有的平台，都在积极地推进和用户接触的策略。</p>



<p class="wp-block-paragraph">Windows、Mac、iOS、安卓，全都出齐了。而且，它还把所有的功能都集齐了。像Open AI做的Mac版的APP，只能干嘛呢？就是回答问题。也就是说，你可以听话，可以去语音识别，他就干这些事情就完事了。中国的就什么都可以干啊。你让他去唱歌跳舞，让他去画图，让他去做图像识别，包括各种的角色扮演，就是Carrot AI做的那些事情啊，咱们也都可以搞定。只要是外边有的，只有咱想不到，没有咱做不了的啊。这一块还是非常好用的啊。我现在用的量很大的就是豆包APP啊，非常好使。然后另外一块我们再卷的是什么呢？啊，Chrome的这个插件啊，就是在浏览器上做插件。因为现在的浏览器，基本上都是Chrome的内核啊，甭管是Chrome的啊，还是这个微软的Edge，底层都是Chrome啊。所以我们现在在上面做插件，甭管是Kimi还是豆包，都在上面卷插件。而且那个插件的功能，那全的是一塌糊涂。你一旦在浏览器上装了豆包插件了，然后你去用谷歌搜索豆包，就在侧边栏开始对搜索结果进行总结。你说哎我现在去看一下YouTube，马上旁边就开始给你做，我给你做个视频总结吧啊。甚至说你在这看YouTube的时候，他说我给你翻译个字幕吧。或者我随时在浏览器里头，选中一个单词，选中一句话，他说我帮你翻译一下吧。或者说你在浏览器里头有一个空格啊，或者叫有一个输入框，需要你输入信息的时候，他马上跳出来想输入点什么，我帮你润色一下。</p>



<p class="wp-block-paragraph">要不要从上到下，事无巨细，只要他能粘手的地方，全都给你冲上来？说来，我在这呢，让我看点什么吧。或者说你现在浏览一个网页，说帮我总结一下。那这是人家的本行，干的甭提多好了。这一块，中国已经彻底卷风了啊。那你说美国人不做这种浏览器插件吗？也做，但是呢，美国人做都是小团队或者个人做。那你跟像豆包这种，可能后边有好几十人，上百人的团队，大家领着薪水，加着班，然后疯狂的往前卷。这事谁卷谁啊？对吧，你肯定卷不过他。现在在接触用户这角度上说，甭管是做APP，做浏览器插件，这啊，中国团队已经弯道超车了啊啊。</p>



<p class="wp-block-paragraph">至于说Open AI，现在再去推出的GPT4 Omni，实际上它已经是在追赶其他人，但不是追赶我们啊。它在追赶的是谷歌的Gemini Flash和Anceropic的啊，CloudHi苦啊，在追赶这两个产品，希望把他们卷死。我们现在已经在另外一个层次上，在卷了，等他们把这仗打完了以后，发现哎，这个用户都已经被中国团队卷干净了啊。可能会出现这样的情况。</p>



<p class="wp-block-paragraph">好啊，这个故事就跟大家今天讲到这里。感谢大家收听，请帮忙点赞，点小铃铛，参加Disco讨论群。也欢迎有兴趣，有能力的朋友加入我们的付费频道。再见。</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
