讲师中心 微信公众号
AI工具推荐 视频效率加速

开源模型赢了Token流量,Anthropic赚走了大部分钱

星敏酱_9396

星敏酱_9396

发布时间:2026-07-11 10:09:42

|

836人浏览过

|

来源于php中文网

原创

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

开源模型赢了token流量,anthropic赚走了大部分钱

本周一,Decagon 首席执行官 Jesse Zhang 发表了一篇深度分析文章,指出尽管开源模型在实际应用中快速普及,但企业在开源模型上的预算占比却呈现下滑趋势。

这一现象让人联想到此前 Anthropic CEO Dario Amodei 曾提出的颇具争议的观点:在当前 AI 生态中,开源更像是一种“干扰项”,甚至称得上是一个被误用的概念。

“即便模型权重公开,你依然无法窥见其内部推理逻辑、训练数据分布或系统级优化细节。因此业内更准确的表述应是‘开放权重’,而非真正意义上的‘开源’。传统开源软件允许社区自由修改、协同演进、持续增强功能,而大语言模型并不天然具备这种可协作性。”Amodei 解释道。

正因如此,他评估一款新模型时,从不首先关注它是否开放权重。“DeepSeek 是否开源?对我来说毫无意义。”他直言,“我唯一关心的是:它能否在关键任务上超越我们?是否足够可靠、高效、可控?”他还强调,开源绝不等于零成本——模型参数动辄数十亿甚至千亿,企业仍需投入大量资金用于云上推理部署、工程化调优与运维保障,以确保低延迟、高稳定性。比起纠结“是否开源”,不如聚焦于“谁的模型能最出色地完成你的核心任务”。

随着 AI 应用逐步从探索走向落地,轻量化、场景化模型正成为主流趋势,Decagon 也不例外。但 Jesse 指出一个耐人寻味的事实:企业在尖端闭源模型上的总支出,并未随开源模型崛起而显著减少。

据透露,Decagon 当前约 90% 的线上工作负载运行在开源模型之上,而非 OpenAI 或 Anthropic 提供的服务。他进一步说明:

这并非出于成本压力,也非客户强制要求(尽管他们通常乐见其成)。根本原因在于:我们别无选择。当你在生产环境中部署客服类 AI 智能体时,响应延迟直接决定产品生死。若每轮对话平均等待 8 秒,用户早已流失。因此必须选用体积更小、推理更快的模型。一次简单的售后咨询,不需要模型知晓立陶宛首都,也不必掌握量子力学公式。然而,开箱即用的小型模型往往达不到客户对准确性、一致性与鲁棒性的严苛标准。唯有通过大规模、高强度的任务定制化微调,才能让它们真正胜任。问题在于,前沿模型实验室几乎不提供此类能力组合:你既无法对它们最强的旗舰模型进行深度定制,也无法获得其小型版本的完全控制权——这些模型不属于你,也不能任你重塑。所以,“轻量模型 + 极致微调”这一路径,本质上只能依托开放权重模型实现。成本优势确实存在,但只是次要收益;自托管带来的数据主权与合规安心感,也只是附加价值,而非我们拥抱开源模型的核心动因。

在 Jesse 看来,前沿模型与开源模型之间并非零和博弈关系。开源模型的成功,并非建立在前沿实验室市场份额萎缩的基础之上。二者更像是同一技术生命周期中的两个阶段:企业先用昂贵的前沿模型验证某个新场景是否可行;待该场景逻辑清晰、边界明确、需求稳定后,再平滑迁移至更经济、更可控的开源模型上。

正因不断有成熟场景向轻量模型迁移,同时又有大量新兴应用场景持续涌现,企业在前沿模型上的总体投入并未明显收缩。

Jesse Zhang 并未公布详尽统计数据支撑上述判断,但 TechCrunch 挖掘到了一些佐证线索。

Vercel 的 AI Gateway 监控面板显示,仅过去七天内,DeepSeek 的 Token 处理量已跃居榜首,目前占据 Vercel 全平台 AI 流量的三分之一以上。同期,推出 GLM-5.2 的智谱科技也强势攀升至第四位。

但如果切换视角,观察整体 Token 支出结构,则会发现 Anthropic 依然牢牢掌控着该平台近半数的 AI 开支。虽然近期 Anthropic 自行上调了部分服务价格,导致其支出占比在过去一个月略有回落,但幅度微乎其微。

OpenRouter 的数据同样印证了类似格局。相较 Vercel,OpenRouter 覆盖范围更广、终端用户更多元,但企业级客户比例略低。

从绝对使用量看,DeepSeek V4 Flash 已成最大赢家,单周处理 Token 数高达约 5.3 万亿。而最受追捧的前沿模型 Opus 4.8,单周 Token 处理量约为 2.05 万亿。

OpenRouter 并未直接披露各模型支出排名,但数据显示:Opus 4.8 的平均每百万 Token 成本约为 1.37 美元,而 V4 Flash 仅为 0.06 美元——前者成本是后者的 23 倍左右。

据此推算,尽管 Opus 4.8 的 Token 使用量不足 V4 Flash 的一半,它仍极有可能贡献了平台绝大部分的模型支出。

Unified LLM Gateway - One API for 70+ AI models. Route to GPT, Claude, Gemini, Qwen, Deepseek, Grok and more
Unified LLM Gateway - One API for 70+ AI models. Route to GPT, Claude, Gemini, Qwen, Deepseek, Grok and more

统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。

下载

这些数据尚未囊括刚刚入场的 NVIDIA Nemotron。凭借 NVIDIA 在芯片、云服务与垂直行业的深厚资源,以及 Nemotron 出色的软硬协同适配能力,这款模型有望迅速跻身头部阵营。

目前的数据尚不足以完全证实 Jesse Zhang 关于 AI 应用生命周期演进的理论,但至少表明:Anthropic 等前沿模型厂商并未因开源浪潮而遭受实质性冲击——至少现阶段尚未显现。

一种可能的解释是:AI 可覆盖的任务总量扩张速度远超预期。即便越来越多成熟场景转向开源模型,顶级闭源模型仍可通过抢占新场景的早期验证阶段,稳住自身市场地位。

正如 Jesse Zhang 所言:“开源模型支出占比下降,并非因为它们正在失败,而是因为整个企业级 AI 市场仍处于技术采纳曲线的最初期。”“前沿模型实验室将持续主导‘应用发现’,而开源模型则将越来越多地承担‘规模化交付’的重任。”

新场景初现之时,企业倾向于采用当下最强大的通用模型——因为你尚不清楚最终问题形态,愿意为那些未来或许用不上的‘冗余智能’支付溢价。此时,这是一种理性投资。

但当场景高度成熟,输入特征分布已知、行为边界清晰、失败模式可预测时,权衡逻辑就会逆转。

此刻,过度泛化的通用能力反而成了负担。企业真正需要的是体积最小、响应最快、且经过极致任务定制、能把单一目标做到极致的专用模型。

“依此逻辑,今天所有基于前沿模型开展原型验证的应用,未来都有望迁移到开源模型生态中。”Jesse 表示,“不过,这个过程或将比多数人预想的更为漫长。”

另一种可能性在于:即便客户开始尝试开源方案,仍有大量高复杂度场景难以被低价模型替代——比如金融风控、医疗辅助诊断、工业仿真等对精度、可靠性与可解释性要求极高的领域。

但无论如何,“双层模型经济”——即前沿模型负责探索创新、开源模型专注规模落地——很可能将成为 AI 产业长期稳定的结构性特征。

参考链接:

https://www.php.cn/link/41b1436d082d03c3f0bd834b2efdcfe4

https://www.php.cn/link/423aba7c2acfc597e43e90830bf4524b

https://www.php.cn/link/99f2661ae6f88169af63fd82e8f82901

本文来自微信公众号“AI前线”,作者:褚杏娟 ,36氪经授权发布。

热门AI工具

更多
立刻MV
立刻MV Hot

立刻MV是一款AI文本写作工具,AI 音乐视频(MV)创作工具。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

Seko
Seko Hot

一款AI视频创作工具,主要用于商汤科技推出的创编一体的AI短视频创作Agent,适合需要提升相关任务效率的用户。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

音述AI
音述AI Hot

一款AI音频处理工具,主要用于音述AI是一个以“用声音述说故事”为核心的 AI 音乐创作与声音分享社区,适合需要提升相关任务效率的用户。

超级简历WonderCV

一款AI办公效率工具,主要用于免费求职简历模版下载制作,应届生职场人必备简历制作神器,适合需要提升相关任务效率的用户。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

LibLibAI
LibLibAI Hot

一款AI视频创作工具,主要用于国内领先的AI创意平台,以海量模型、低门槛操作与“创作-分享-商业化”生态,让小白与专业创作者都能高效实现图文乃至视频创意表达,适合需要提升相关任务效率的用户。

切问学术

切问学术是一款AI论文写作工具,复旦大学NLP团队推出的AI学术智能体。

相关专题

更多
LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

0

2026.09.30

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

0

2026.09.30

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

0

2026.09.30

PDF转图片方法
PDF转图片方法

需要把 PDF 页面用于上传、预览、分享或图片归档时,PDF 转图片方法专题整理 JPG/PNG 格式选择、逐页导出、清晰度设置、批量下载和结果检查等流程,帮助用户稳定完成 PDF 图片化处理。

0

2026.09.30

PixTV AI视频生成与无限画布创作
PixTV AI视频生成与无限画布创作

PixTV专题整理AI视频与视觉内容创作相关功能使用教程,涵盖AI生图、视频生成、无限画布、多模型创作、素材管理、声音音乐及视频剪辑等功能,帮助用户快速掌握PixTV从创意到成片的完整制作方法。

0

2026.09.29

Buffalo框架数据库开发全教程
Buffalo框架数据库开发全教程

本专题围绕Buffalo框架数据库开发,讲解database.yml多环境配置、soda与fizz迁移生成回滚、模型结构体标签、增删改查与条件查询、一对多与多对多关联、数据校验、回调钩子、事务处理及原生SQL执行能力。

220

2026.09.23

Buffalo框架路由与请求处理实操指南
Buffalo框架路由与请求处理实操指南

本专题讲解Buffalo框架路由与请求处理机制,涵盖路由注册与分组、资源路由、Handler编写规范、Context上下文方法、参数绑定、中间件编写挂载、Session与Cookie读写、Flash消息及错误页面定制方法。

120

2026.09.23

Buffalo框架零基础入门教程
Buffalo框架零基础入门教程

本专题整理Buffalo框架入门内容,涵盖Go环境准备、buffalo CLI安装、新项目生成、目录结构说明、dev热加载启动、数据库连接配置与常见报错排查,帮助新手按约定优于配置的思路跑通第一个Buffalo框架应用。

100

2026.09.23

Conan创建软件包配方指南
Conan创建软件包配方指南

本专题介绍通过conanfile.py创建软件包的方法,讲解包名、版本、依赖和构建设置等基础信息,以及source、build、package、package_info等常用方法的作用及编写思路。

60

2026.09.22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
墨刀帮助中心
墨刀帮助中心

共0课时 | 0人学习

腾讯元宝使用手册
腾讯元宝使用手册

共0课时 | 0人学习

Kimi K2.6学习视频
Kimi K2.6学习视频

共1课时 | 145人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn