Daily Tech Briefing
AI 科技速览

每天 5 分钟内学习 AI。获取最新的人工智能新闻,理解其重要性,并学习如何将其应用于您的工作。

AI 快讯
爱范儿 · 2026/8/4 11:01:01

深度|开源大模型的「奥本海默时刻」

AI 中文解读
大模型行业正迎来自己的“奥本海默时刻”:DeepSeek新推出的V4 Flash模型,直接把AI调用价格打到了“骨折价”——比竞争对手便宜上千倍,甚至有三方平台免费提供,一天就被消耗了8万亿token。更夸张的是,这个模型还是开源的,几百GB内存的电脑就能本地跑起来。这场价格战的本质不是烧钱补贴,而是技术代差带来的效率革命——中国团队用更聪明的算法,让参数更少也能干出同样漂亮的活儿。 对普通人来说,最直接的感受就是:AI服务要大降价了。过去收费较高的智能助手、编程工具,现在可能白菜价甚至免费。创业公司也能用更低成本开发AI应用,新玩法会像雨后春笋般冒出来。当然,大厂的日子就没那么好过了,一边是云计算靠AI创业公司赚钱,一边是自研模型要跟人家抢市场,左右互搏的尴尬戏码才刚开始。总之,AI行业格局正在被彻底改写,这波红利最终会流向普通用户。
过去几天,DeepSeek 和 Qwen 对大模型行业带来了前所未有的颠覆效果。 Hermes Agent 背后的公司 Nous Research 宣布,刚刚正式推出的 DeepSeek V4 Flash 模型在其平台上启动一折促销,持续 7 天。 这是一个荒诞却又务实的价格,Nous 原话说 DSV4 Flash 的调用成本比 Fable 5 便宜千倍以上。即便回归正价,其性价比依然维持着百倍左右的碾压优势,打不打折都便宜到离谱。 更别提它还是开源的,理论上只需数百 GB 显存/统一内存即可部署量化版本,内存稍多一些甚至可以部署无损版本。比如一台(目前尚无新机可售的) 256/512GB RAM 版本 Mac Studio,或者两台英伟达 DGX Spark 堆叠起来。事实上,DeepSeek 一直是开源模型当中对准消费级硬件本地部署最友好的,参见我们的 Mac Studio 部署体验。 如果这对你来说还是太极端,那么云端充个几十块钱 API 也足够用很久了。由于 DSV4 Flash 性价比实在太高,甚至有三方平台免费提供: OpenCode 透露仅在 8 月 1 日这天,DSV4 Flash 就消耗掉了 8 万亿 token,其中包括 5 万亿免费、3 万亿付费额度。OpenCode CEO 发推表示:我觉得大家根本没意识到正在发生什么。 是啊,我们并未清楚地看到什么发生了,却有足够强的感受:一夜之间,好像一切都变了。 1942 年,科学家爱德华·泰勒提出了一种极其微小但并非是 0 的可能性,让全力开动的曼哈顿计划陷入恐惧:核裂变产生的瞬时高温,有可能点燃空气中的氮原子,进而引发一场不可逆的链式反应,摧毁整个地球。 好在,后续的论文和实测打消了这一顾虑,但一直以来对政治颇有兴趣的奥本海默,有着更深层的担忧: 链式反应确实发生了,只是不在大气层里,而是经由 Trinity 试验的成功开启了一个新的核时代,并彻底重塑了人类社会的政治、地缘、工业与文明形态。 此时此刻,恰如彼时彼刻。未来的科技行业又将怎样彻底改写? 价格战的连锁反应 本周正式发布的 Qwen-3.8-Max,展现出与 DeepSeek V4 Flash 类似的「新方向」。 无论是模型创业公司还是互联网巨头,过去发布模型时无一例外将特定任务上的绝对性能摆在最醒目的位置。这一次略有不同:Qwen-3.8-Max 拥有强悍的底座,其宣发叙事却向「性价比」全面倾斜,与 DeepSeek 遥相呼应。 爱范儿认为,这并非偶然的营销巧合,而是越来越多的模型团队,在同一种行业演进逻辑下不期而遇。 我们采访过许多模型公司/团队负责人,询问开源时代何时终结。每个人都有不同答法,但结论无一不指向即将到来的价格战。 过去的价格战,例如打车、共享单车、外卖等,大多是资本充沛者通过亏本补贴来强行清场的戏码。但这次模型价格战的底色不同——表面上看起来是价格战,底层是一场由算法架构代差,由基础研究和创新能力所驱动的非对称效率战。 DeepSeek 等一众国模敢于将价格砸穿,底层依托的是稀疏激活、注意力机制重构等基础研究和工程层面的创新。中国模型公司和团队们在底层上找到了极度残忍的算力解法,能够用相对更小的参数激活量,榨取出比肩硅谷天量级参数量稠密模型的推理质量。 这种技术路径的突破,不仅在其他模型厂商的脖子上架上一条「斩杀线」,更彻底改写 AI 创业公司与互联网巨头大厂的对战规则。 传统移动互联网时代,大厂拥有近乎无限的资金池与云计算基础设施,创业公司难以在价格战中与之抗衡,不陷进泥潭被耗尽现金流。 但是到了 AI 时代,你会发现情况发生了巧妙的逆转:以 DeepSeek、月之暗面等为代表的硬核创业公司,反而获得了极其惊人的爆发力,丝毫不怵价格战(有的甚至逆势涨价)。 这些创业公司的研发组织相对扁平,创新能力更强,内部也极有可能沉淀着并未公开的技术优势。甚至有人开玩笑,DeepSeek 梁文锋肯定还藏着几手,随便使出来就足以让 Fable 和 GPT 更加颜面扫地——只是出于维持中美之间半年到一年差距这一「战略性落后」,绝活不轻易亮出来。 对于这些模型创业公司而言,价格战绝非自残,反而成为了一众高效的增长杠杆。 我们认为逻辑大概是这样的:技术创新降本,砸穿全球底价;Token 调用爆发,ARR 曲线拉升;资本市场追捧,完成更多融资。 说白了,这些模型创业公司越卷价格,用户粘性越高,资金回笼与技术迭代的闭环反而越坚实,飞轮转的越快。 大厂呢?相比之下,他们有更强的路径依赖,也需要贯彻集团的协调意志。面对价格战,大厂惯于依靠自有现金流、云计算业务来硬扛补贴,用庞大的固定资产来组成壁垒。但当创业公司将单位 Token 成本压到史低水平,巨头的补贴思路却更容易让云计算业务乃至集团整体的财报承压。 价格战里,创业公司越卷越舒服,大厂却可能被拖垮业绩。 巨头的围墙内部撕裂也正在悄然发生。表面上看,无论是阿里还是腾讯,都已经明确将大模型以及相关产品定为公司新一号位。组织架构多次调整,财力、人力、算力资源向模型与模型产品部门倾斜,声势浩大。各团队纷纷「赛马」推出竞争产品,僧多肉少。 但在表面之下,这种一号位的资源灌注,大刀阔斧的调整,以及再次热闹起来的「赛马」文化,却让僧多肉少的形势进一步加剧,容易引发剧烈的自我吞噬与组织紊乱。 云计算部门是大厂最核心的现金流支柱,今天最关键的优质客户,恰恰也是风头正劲的 AI 创企。 而当价格战开打,大厂集团层面面临着难以调和的商业悖论:云计算当然希望 DeepSeek、Kimi、智谱们过的越来越好,创业公司用量越大,采购需求就越强;但与此同时,大厂自研模型和模型产品部门,在 C 端和 B 端也在与这些创业公司进行着市场份额的激烈争夺。补贴自家模型和模型产品,代价就是暂时性让财务报表承压。 答案是明确的:一位大厂 CEO 曾表示,当前的任务是以超过行业平均的速度获取市场份额,「利润率是我们的第二目标。」 对于云计算部门,客户是内部还是外部本来没什么关系。但现在他们面临的尴尬处境是,给自研模型和模型产品部门输血,集团层面势必对云计算的商业决策产生干预。 倒不是说云计算行业过去对于公有云的商业与生态中立原则(不与客户争利)有多么看重,至少更务实来讲,云部门与模型部门的共谋行为难免引发外部客户不信任,倒逼创业公司自建云,进而影响大厂云部门的收入。 类似的尴尬,在亚马逊与 Netflix,与沃尔玛、Target 等零售巨头之间都曾发生过。 ——当然,以上都只是基于合理推断的可能性,并未完全真实发生。但当价格战真正开打,在大厂内部,作为现金牛的云计算部门和作为新一号位的模型与模型产品部门,难免陷入互为毒药的僵局。 信息图中资料截止时间:2026 年 5 月底 在现实中,大厂通过投资创业公司完成战略上的对冲。本质上,这种做法让钱从战投的左兜出、云计算的右兜进,云部门赚取了账面收入,战投获得了股权,集团扩展了自己的疆域,画出新的山头。 这难免让自研模型部门暗自不爽,因为他们会发现市场上最猛烈的低价子弹,其实是用自家的钱购买、从自家服务器的枪口里射出来的。 更深层的问题是,在移动互联网时代,巨头投资创业公司能够将其锁进自己的流量布局中,间接享受创新与竞争的红利;但在 AI 时代,大厂是管不住这些创业公司的,创新的「主权」与大厂的资本布局是解耦的。 这些头部模型创业公司的核心资产是算法效率和工程优化能力,而这些能力源自优秀的人才、前卫的组织架构,跟大厂的钱没什么关系。甚至你会看到像 DeepSeek 这样的公司,仅仅依靠实现 AGI 的理想就能够笼络人心,开出远超市价的工资,甚至原则上不需要外部融资。 更何况资本市场对 AI 创业公司已经形成一套新的评价和供应体系:模型和模型产品公司冲出惊人的 Token 调用量/ARR,就能轻松地在国内乃至全球拿到下一轮高估值融资,不再需要对大厂俯首称臣。 长期来看,大厂的战略对冲投出去的钱,反而可能变成瓦解自己的催化剂。 更多链式反应 商业世界的藩篱坍塌只是第一块倒下的多米诺骨牌。 旗舰级模型的推理智力部署在桌面上,这件事今天已经开了头。随着模型性价比进一步提高,智力和算力的民主化终将彻底改变软件形态、流量机制、人才传承,乃至全球硬件格局的深层肌理——颇似核裂变的成功对后世产生不可估量的深远影响。 这里我们再举两个例子: 流量机制 现代互联网的繁荣,建立在「人类眼球」的流量逻辑上: 从搜索引擎优化到社交媒体推荐算法,底下是一个隐秘而庞大的数字广告帝国。但其运行的前提是人类打开浏览器或 app、点击网页、接受广告信息的洗礼,要么产生消费行为,要么观看、停留、点击的数据被保存和处理,用于下一次更加精准的推荐。 长久以来,人类的注意力和时间是支持互联网运转的唯一「硬通货」。但我们认为,模型性价比的提升和算力的普及,让人人都可以运行自己的 Agent,而互联网主干流量的来源,也将从人变成 Agent。传统互联网的运行机制将不复存在,新的规则亟待建立。 试想这样一个场景:你希望预定一整套跨国出游的行程,包括机票、酒店、地接导游、当地交通工具等。过去你需要打开多个 App 在密密麻麻的 UI 中比价、查看评价、填写信息。 但在「A 联网」的时代,由强大模型所驱动,全权代表我们的 Agent,可以与航空公司、酒店、地接旅行社的 Agent 直接发起握手:它们在人看不到的数据暗流中,以结构化的数据包传递信息、匹配条件、议价和确认支付,整个过程只消耗了几秒钟,没有人类眼球扫过图形界面,甚至不需要点击。 人类不再需要亲自使用 App、逛网页,广告在 Agent 高效
分享
阅读原文