白鲸出海—让中国互联网服务世界

{{user_info.user_name}}
您当前是白鲸会员
开通VIP,享受更多服务
会员到期时间:{{user_info.expire_date*1000 | formatDatebyDay}}
合作查看次数: {{users_vip_equities.view_cooperation || 0}}次
合作发布次数: {{users_vip_equities.release_cooperation || 0}}次
公司查看次数: {{users_vip_equities.view_company || 0}}次
报告下载次数: {{users_vip_equities.download_book || 0}}次
鲸币数量:{{user_info.jingbi}}
发布
当前位置:白鲸出海 > 资讯 > 正文

开源的火,烧向硅谷

裴政开  • 

原标题:开源的火,烧向硅谷

作者:苏扬

来源:腾讯科技

硅谷正在发生一场微妙的变化。

过去两年,企业谈论 AI 时,最关心的问题往往是“哪家的模型最强”。如今,随着 AI 应用规模扩大,另一个问题开始变得越来越现实:完成同一项任务,究竟有没有必要使用最贵的模型?

随着 IT 支出持续上升,美国企业开始重新审视 AI 成本,并越来越多地转向价格更低的“开源”AI 模型。更准确地说,其中相当一部分是“开放权重”(open-weight)模型。

根据研究平台 AlphaSense 的数据,今年 8 月和 9 月,美国企业财报电话会议和投资者会议中提及“开放权重”或“开源”模型的次数,是去年同期的 6 倍。

从科技公司到金融、物流、工业和电信行业,企业开始尝试根据任务难度组合不同模型:最昂贵的前沿模型负责复杂任务,更便宜的开源模型承担大量日常工作。

一、前沿模型无法“通吃”

641.jpeg

两家中国 AI 初创公司智谱 AI 和月之暗面发布了性能足以媲美美国实验室产品的新模型

过去几年,OpenAI 和 Anthropic 不断刷新前沿模型的能力边界,也形成了一套清晰的商业逻辑:企业愿意为更强的模型支付更高价格,因为更高的智能水平意味着更好的代码、更复杂的推理和更强的自动化能力。

但当 AI 从少量试验进入大规模生产环境后,企业开始重新计算这笔账。

信息提取、文本分类、简单代码修改、客服回复等大量常规任务,并不需要调用最昂贵的前沿模型。

路透社今年 6 月报道称,微软首席执行官萨蒂亚·纳德拉、Palo Alto Networks 首席执行官尼基什·阿罗拉(Nikesh Arora)以及 Coinbase 首席执行官布莱恩·阿姆斯特朗(Brian Armstrong)等高管,都开始强调更小、更便宜的模型能够满足相当一部分企业需求。

Uber 就是一个典型案例。

由于员工大量使用 AI 编码工具,公司仅用了 4 个月就消耗掉原本覆盖 2026 全年的 AI 预算,最终不得不对 AI 工具的使用设置上限。

更复杂的任务还会进一步推高成本。随着一次请求涉及更多步骤、更长上下文和更多工具调用,即使单个 Token 价格下降,企业的最终账单仍可能快速增长。

于是,“哪个模型最强”逐渐变成了“哪个模型最适合这项任务”。开源模型因此获得了机会。

与 OpenAI、Anthropic 等公司主要通过云端提供模型服务不同,开源模型允许企业下载模型参数,在自己的服务器或云基础设施上运行,并根据业务需求进行微调,从而降低部分调用成本,同时获得更大的部署和数据控制权。

《金融时报》援引 Vercel 的数据称,今年 8 月,该公司的 AI Gateway 的全部 Token 中,开源模型占比达到 56%,而去年 12 月仅为 7%。路透社援引花旗银行数据称,OpenRouter 上开源模型处理的 Token 占比,也从今年 1 月的 34% 升至 6 月的 65%。

二、“模型拼盘”

微信图片_2026-10-05_134030_540.png

真正重塑 AI 商业模式的,并非某个开源模型击败了闭源巨头,而是企业开始放弃“一个模型解决所有问题”的思路。这种变化在软件行业尤为明显。

Match Group 旗下 Tinder 为控制飙升的 AI 成本,已经开始将部分非技术查询路由给开源模型。其 CTO 维奈·库鲁维拉(Vinay Kuruvila)透露,公司 AI 支出的年化规模从 1 月的 100 万美元猛增至 7 月的 1000 万美元。虽然顶级模型能够胜任约 90% 的任务,但随着开源模型持续追赶,大量工作已经没有必要调用最昂贵的系统。

电信巨头 AT&T 走得更远。其首席数据与 AI 官安迪·马库斯(Andy Markus)透露,目前约 40% 的 AI 工作负载运行在开源模型上,计划一年内提升至 70%。面对每天 450 亿 Token 的处理量,AT&T 还会利用专有数据微调开源模型,让其在特定任务上达到甚至超过闭源模型的表现。

因此,“模型拼盘”正在成为 AI 应用的常见架构:前沿模型负责复杂推理和规划,低成本模型承担大量执行工作。

不仅是消费级应用,工具与开发类软件也在经历同样的转向。

Cursor 团队的测试也体现了这种成本差异。从零构建浏览器,若全程使用 OpenAI GPT-5.5,成本超过 1 万美元;改用自研 Composer 模型搭配 Anthropic Opus 4.8,成本降至 1339 美元,前后相差约 7.5 倍。

这种模式也让“模型中立”(Model Agnostic)成为 AI 应用的重要能力。企业可以根据任务难度和成本,在 OpenAI、Anthropic、谷歌以及开源模型之间灵活调度,而不再绑定单一供应商。

Telnyx 公司此前使用 Anthropic 顶级模型运行 1000 个机器人智能体(Bot Agent),按原计费方式,日均成本可能升至 10 万美元。转向开源模型后,其机器人智能体增至 1400 个,单个智能体日均成本却降至约 100 美元。

法律 AI 初创公司 Harvey 也采取了类似策略:日常任务由开源模型承担,只有极高难度的工作才调用顶级模型。

三、重新分配价值

这场变化对 OpenAI 和 Anthropic 的商业根基构成了深刻冲击。

过去,前沿模型公司通过不断提升模型能力,推动企业增加 AI 支出。模型越强,溢价越高,溢价再转化为下一代模型的算力投资。但开源模型正在打破这种闭环。

花旗银行的数据显示,此前部分开源模型的价格已低至每百万 Token 18 美分,而顶级闭源模型平均价格约为 4 美元。即便开源模型在部分极限任务上存在性能差距,如此悬殊的价格差,也足以让企业重新评估是否有必要为所有任务调用顶级模型。

更重要的是,开源阵营在硬核能力上的追赶速度远超预期。

DeepSeek 在未经预热的情况下将 V4 Pro 模型推向通用(GA),该模型在 SWE-bench Verified 上跑出了 80.6% 的顶尖成绩,并创下了测试模型中最高 Codeforces 评级。而它的综合 Token 费率,仅为 Claude Opus 4.7 的 1/46 左右。

当一个成本仅为闭源顶流 1/46 的开源模型,不仅能够胜任工作,甚至在深度编码与算法推理等关键指标上直接对标前沿顶级模型时,买方采购策略的平衡木被彻底打破了。

WEKA 首席 AI 官瓦尔·贝尔科维奇(Val Bercovici)曾将此趋势概括为“以 10% 的价格实现 90% 的效果”,而像 DeepSeek V4 Pro 这类产品的出现,甚至正在打破“90% 效果”的局限,向顶级表现看齐。

成本之外,数据控制也是开源模型的重要吸引力。

Digital Realty 解决方案架构高级全球总监斯科特·华莱士(Scott Wallace)表示,公司已经建立基于开源模型运行的内部聊天界面,并根据任务的敏感程度和复杂程度,在开源模型与专有模型之间进行组合。

对于涉及敏感医疗、金融记录或商业机密的任务,开源模型允许企业将代码与参数部署在自有基础设施内进行微调与审计,这不仅是经济账,更是合规与治理账。

四、软件公司又行了

过去两年,AI 行业一直有一种担忧:基础模型公司可能直接吃掉传统软件的市场。如果用户可以直接向 ChatGPT 或 Claude 提出需求,为什么还需要购买传统软件?但随着模型成本快速下降,这种逻辑正在发生逆转。

对于软件公司而言,AI 本质上是一种投入成本(Input Cost)。模型越便宜,软件公司就越能以极低成本将 AI 能力嵌入产品,同时拉高自身利润率。

William Blair 分析师近期指出,更便宜、更开放的 AI 模型对软件公司构成“明确利好”。软件公司既可以扩大 AI 功能覆盖面,也有机会改善利润空间。OpenAI、Anthropic、谷歌以及开源模型之间的剧烈竞争,让软件买方拥有了空前的议价权和选择权。

与这一趋势相呼应的是企业软件股的强劲反弹。

过去一个月,HubSpot 上涨近 30%,Adobe上涨超过 20%,Intuit、Salesforce、ServiceNow和Asana 均上涨至少 12%。

前 Benchmark 合伙人比尔·格利(Bill Gurley)认为,如果强大的 AI 模型能够保持开放且价格低廉,初创公司、云服务商、芯片公司、企业和研究人员都将从中受益。

对于大量 AI 初创公司而言,它们无需投入数十亿美元去卷基础模型预训练,而是直接将现有高性能模型接入产品,利用客户关系、行业知识、专有数据和工作流建立竞争壁垒。模型越便宜,这种模式的成本压力就越小。

五、“够用就好”的时代?

微信图片_2026-10-05_134059_885.jpg

英伟达首席执行官黄仁勋在 X 平台的推文中表示,他支持闭源与开源模型并存。

这种变化最终将倒逼巨头调整长期战略。

此前 OpenAI 便推出了提升 Token 效率的 GPT-5.6 Sol,Anthropic 也推出了高性价比的 Claude Opus 5;随后,两家公司更是加速发布了最新的前沿与轻量化模型,企图通过提供更丰富的“高低搭配”产品线,在自身生态内锁定不同算力预算的企业客户。

模型竞争的衡量标准也随之重塑。

除了基准测试成绩和纯粹的推理能力,单位 Token 成本、Token 效率、任务完成成本(Cost per task),以及能否在多模型架构中灵活路由,正在变得比以往任何时候都更重要。

《金融时报》报道称,Anthropic 正准备潜在 IPO,市场预期其估值可能达到 2 万亿美元甚至更高;OpenAI 在将 IPO 计划推迟至2027年后,也正在就约 1.2 万亿美元估值的私募融资进行早期谈判。企业 AI 支出的流向,直接关系到两家巨额算力投入能否持续转化为商业回报。

与此同时,开源模型阵营仍在加速扩张。

Mistral、英伟达、Reflection AI、Thinking Machines Lab以及 DeepSeek 等团队都在持续推高开源模型的上限,微软、英伟达、Meta、Palantir和IBM等企业也公开支持开放 AI 生态。英伟达首席执行官黄仁勋曾表示:“世界既需要前沿闭源模型,也需要前沿开源模型。”

在这一背景下,过去那种对每一个提示词都无差别支付“闭源模型税”(Closed-model tax)的盲目惯性正在被彻底打破。从初创公司的灵活架构转向,到电信巨头每日动态路由数百亿 Token 的精细算账,决策权正从单纯的“品牌信任”转移到“架构设计与合同条款”。

或者说,未来选择的逻辑在于:完成这项任务,谁能用更低的成本,提供足够好的结果?


文章信息来自于腾讯科技,不代表白鲸出海官方立场,内容仅供网友参考学习。对于因本网站内容所引起的纠纷、损失等,白鲸出海均不承担侵权行为的连带责任。如若转载请联系原出处。

友情提醒:白鲸出海目前仅有微信群与QQ群,并无在Telegram等其他社交软件创建群,请白鲸的广大用户、合作伙伴警惕他人冒充我们,向您索要费用、骗取钱财!


分享文章

扫一扫 在手机阅读、分享本文

15424
{{votes}}
分享文章

扫一扫 在手机阅读、分享本文

15424
{{votes}}

要回复文章请先登录或注册

与CEO聊合作

(备注姓名、公司及职位)