讲师中心 微信公众号
AI工具推荐 视频效率加速

Kimi K3会复刻DeepSeek时刻吗:机构为何看好算力需求扩张

风辰同学_2721

风辰同学_2721

发布时间:2026-07-22 14:56:22

|

454人浏览过

|

来源于php中文网

原创

kimi k3能否复刻deepseek时刻?华尔街一致给出反直觉结论:反而强化高端算力需求

月之暗面最新发布的 Kimi K3 大模型表现亮眼,也很快带动市场围绕“是否会复刻 DeepSeek 时刻”的讨论升温。一部分资金曾担心,美股 AI 板块会不会再次出现明显抛压。不过,多家华尔街机构随后给出的判断却比较一致,而且结论有些“反直觉”:Kimi K3 的突破并没有削弱高端算力需求,反而可能进一步强化这一趋势。

如果用更容易理解的话来说,逻辑并不复杂。大模型想要变强,前期训练通常离不开大规模 GPU 集群;而当模型推理效率提升、能力也更强时,它往往更容易被企业和开发者真正用起来。一旦部署范围扩大、调用频次增加,对 GPU、存储、网络和数据中心的需求也可能随之上升。也正因为如此,市场对 AI 产业链的关注点,正在从单纯讨论“能不能降本”,逐步转向“会不会带来更大的需求扩张”。

换句话说,市场虽然一度把 Kimi K3 当作“DeepSeek 时刻 2.0”来看待,但这一次,华尔街主流机构的结论并不相同。

7 月 16 日深夜,月之暗面在上海发布 Kimi K3。这个 2.8 万亿参数的开源模型,在 Artificial Analysis 智能指数中获得 57 分,排名全球第三至第四位,与 Anthropic 的 Claude Opus 4.8 和 OpenAI 的 GPT-5.5 处于同一区间。更受关注的是,在加州大学伯克利分校创建的 Frontend Code Arena 编程榜单中,K3 以 1679 分登顶,超过 Claude Fable 5 和 GPT-5.6 Sol,成为首个在权威编程榜单上超越全部海外闭源模型的开源模型。

7 月 17 日,美股半导体板块出现明显回调。这样的市场反应并不难理解。因为在 2025 年初 DeepSeek R1 发布后,算力股就曾经历过一轮快速下跌。当时市场最核心的担忧是:如果中国模型持续逼近全球前沿水平,美国 AI 公司是否还需要维持如此高强度的算力投入?如果更低成本模型不断出现,英伟达、HBM、服务器和网络设备的需求预期是否要被重新定价?

不过,据追风交易台消息,瑞银、野村、美银美林和花旗等多家机构的最新观点认为:Kimi K3 不是算力需求的终结者,更像是新一轮算力需求扩散的催化剂。

从市场影响来看,Kimi K3 与 DeepSeek R1 带来的冲击并不完全一样。R1 更强调效率,而 K3 更突出规模。2.8 万亿参数、1M token 上下文、常开推理、原生多模态以及 MoE 架构,这些特征共同决定了它并不属于“轻资产”叙事。相反,它会同时抬升推理、内存、网络和存储侧的基础设施压力。

Kimi K3未复刻DeepSeek,反强化算力需求

Kimi K3 是什么:先看懂它的能力、定位和成本

Kimi K3 由月之暗面于 2026 年 7 月 16 日发布,完整模型权重计划于 7 月 27 日开放。作为一款 2.8 万亿参数的开源权重大模型,它被多家机构视为当前规模最大的开源权重 LLM 之一。

如果从新手更容易理解的角度来看,K3 主要有三项值得关注的特征:

  • 1M token 上下文窗口:简单理解,就是它一次能处理的信息量更大,适合长文本阅读、复杂代码仓库分析,以及更大体量的企业资料处理。
  • 常开推理能力:这说明它不只是做简单问答,更偏向处理多步骤、长链路的问题,也更适合 Agent 类任务。
  • 原生视觉能力:除了文本,它还可以覆盖图像、视频、游戏开发、前端设计、CAD 等多模态场景。

在架构层面,K3 采用 Kimi Delta Attention、Attention Residuals 和 Stable LatentMoE。MoE 部分由 896 个专家构成,每个 token 激活其中 16 个专家。月之暗面的说法是,与 Kimi K2 相比,整体 scaling efficiency 提升约 2.5 倍。

这也解释了为什么 K3 不能被简单理解成“更便宜的 K2”。根据 Nomura 整理的数据,K3 输入价格为每百万 token 3 美元,缓存命中输入为 0.30 美元,输出价格为每百万 token 15 美元;按 Artificial Analysis 的口径,K3 每项任务成本约为 0.94 美元,低于 Claude Fable 5 的约 2.75 美元和 Claude Opus 4.8 的约 1.80 美元,接近 GPT-5.6 Sol 的 1.04 美元。不过,它仍明显高于 GLM-5.2 的 0.32—0.47 美元,也远高于 DeepSeek V4 Pro 的 0.04 美元。

因此,如果从币圈、Web3 和 AI 产业观察的视角来看,Kimi K3 的定位并不是“最低价模型”,而是在一个更有竞争力的价格区间里,尽量接近前沿模型的能力水平。

Kimi K3能否复刻DeepSeek时刻?华尔街一致给出反直觉结论:反而强化高端算力需求

Kimi K3 会削弱算力需求吗:四家投行怎么看

围绕“Kimi K3 会不会重演 DeepSeek 冲击”这个问题,多家投行的结论基本一致:这更像是需求重估,而不是需求削弱。

野村:AI 竞争加剧,基础设施价值链反而可能受益

野村证券亚太科技团队分析师段冰在报告中表示,全球大模型市场的竞争与创新不会停止。随着行业继续向通用人工智能靠近,生成式 AI 在消费端和企业端的应用仍会扩张。前沿 AI 实验室和超大规模云平台公司,大概率仍会维持高投入,以确保自身竞争位置。在这个框架下,野村把竞争升级视为 AI 基础设施价值链的正面信号。

花旗:这更像是“杰文斯悖论”再次出现

花旗半导体分析师 Peter Lee 在 7 月 19 日的报告中,直接将这一主题概括为“又一次杰文斯悖论”。这个概念可以简单理解为:当技术效率提高、使用门槛下降时,结果不一定是总需求减少,反而可能因为更多人愿意使用,带来更大的整体消耗。

放到 AI 行业里,如果高质量模型变得更便宜、更容易部署,开发者和企业就可能上线更多应用、处理更多 token,最终推高整体算力消耗。

Peter Lee 还指出,即便 K3 获得更广泛应用,服务器 DDR5 和 eSSD 等通用内存与存储需求仍有继续增长的空间。原因在于,K3 的推理效率虽然接近其他前沿模型,但随着上下文长度增加,KV 缓存占用也会持续放大,内存压力不会因为效率提升而自动下降。

美银美林:美国前沿实验室可能会选择“更多算力”

美银证券半导体分析师 Vivek Arya 在 7 月 17 日的报告中给出的表述更直接:美国前沿 AI 实验室的回应不会是“更少算力”,而是“更多算力”。如果中国开源模型持续逼近,OpenAI、Anthropic 和 Google 为了维持差异化,可能需要投入更大规模训练、更重推理以及更快的产品迭代。

Arya 还提到,媒体报道称 Google 的 Gemini 3.5 Pro 已较原计划推迟数月,且编程能力未达到内部目标。这也从一个侧面说明,前沿模型想长期保持领先,难度正在上升。

瑞银:K3 更偏“规模”逻辑,长上下文会继续推高内存压力

瑞银分析师 Timo Arcuri 团队在 7 月 20 日的报告中指出,K3 与 DeepSeek R1 的确存在可比性,但 K3 的重点更偏向“规模”。它拥有 2.8 万亿参数和 100 万 token 上下文窗口。报告强调,开源模型通常比闭源前沿模型更吃内存,尤其在更长上下文场景下,即便进行量化处理,KV 缓存的绝对需求仍会增长,这使得开源模型部署对 HBM 和存储的依赖度更高。

Unified LLM Gateway - One API for 70+ AI models. Route to GPT, Claude, Gemini, Qwen, Deepseek, Grok and more
Unified LLM Gateway - One API for 70+ AI models. Route to GPT, Claude, Gemini, Qwen, Deepseek, Grok and more

统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。

下载

Kimi K3能否复刻DeepSeek时刻?华尔街一致给出反直觉结论:反而强化高端算力需求

Kimi K3 可能影响哪些方向:算力、存储、网络、云平台怎么理解

从机构观点来看,Kimi K3 对产业链的影响并不是平均分布的,而是更可能集中在几个关键环节。对于不熟悉 AI 基建的新手来说,可以把它理解为:模型越强、应用越多,背后承载这些能力的“底层硬件和服务”就越重要。

1. 存储与内存:HBM、DDR5、eSSD 关注度提升

存储与内存是机构普遍认为最直接受益的板块之一。瑞银测算显示,到 2028 年,存储与内存板块累计自由现金流预计可达到市值的约 30%,在各子板块中占比最高,其中美光(MU)约为 47%。花旗和野村也维持对三星电子的买入评级,原因之一是全球内存市场仍处于供给偏紧状态。

花旗指出,Kimi K3 在推理侧的内存需求并不弱于其他前沿模型,KV 缓存规模上升将直接带动服务器 DDR5 与企业级固态硬盘需求。其特别提到,K3 大规模部署需要超过 64 块 GPU 的“超节点”集群配置。

Kimi K3能否复刻DeepSeek时刻?华尔街一致给出反直觉结论:反而强化高端算力需求

2. 算力基础设施:英伟达、台积电等仍是关键变量

算力基础设施方面,台积电与英伟达被视为重点受益方向。无论是训练侧的规模定律继续发挥作用,还是推理侧 token 使用量持续增长,最终都对应更多先进制程芯片需求。野村重申对台积电、ASE、联发科等公司的买入评级。

英伟达此前公开表示,现代 MoE 模型在 GB300 NVL72 上的推理性能功耗比,相较上一代 Hopper 架构可提升高达 25 倍。像 K3 这样的模型,也被认为天然更能受益于英伟达最新硬件平台。

3. 网络侧:超节点架构会抬高光模块与光芯片需求

网络侧也被视为结构性机会所在。原因在于,Kimi K3 需要超节点集群,而中国本土算力又受到高端芯片出口限制影响,超节点架构被认为是弥补单卡性能差距的重要方案之一。这会进一步推升光模块、光芯片等网络层供应链需求。野村看好中际旭创和苏州旭创。

4. 云平台与数据中心:模型分发和企业部署价值上升

云平台与数据中心同样被机构重点提及。能够托管多种前沿开源模型的云平台,通常具备更强议价能力,也不必过度依赖单一闭源模型供应商。野村看好阿里巴巴(BABA)在中国 AI 云生态中的核心位置,同时关注 GDS、万国数据(VNET)等数据中心运营商。

中国 AI 模型全球渗透率变化:开发者流量是个重要信号

在这轮讨论中,一个容易被忽视但实际上很关键的变量,是中国 AI 模型在全球开发者生态中的渗透速度。

根据开放 API 网关 OpenRouter 的统计,中国 AI 模型在全球开发者流量中的 token 使用占比,一年前不足 2%,目前已超过 45%。与此同时,美银美林的数据也显示,AI 整体渗透正在加快:目前约 55% 的美国企业已订阅 AI 模型、平台或工具,Anthropic 的企业采用率为 42%,OpenAI 为 40%。在头部 AI 消费者中,前 1% 的企业用户每位员工每月 AI 支出已达到 4833 美元。

从竞争格局来看,市场正在出现更明显的分层。一边是以 DeepSeek、Kimi K3 为代表的中国开源模型,覆盖经济型及中高端性价比市场;另一边是美国顶级前沿模型,继续向更复杂的工作负载,例如科学计算等场景集中,以维持技术溢价和定价能力。野村的判断是,中美两侧的领先大模型玩家都可能受益,前提是能够持续处于技术曲线前沿。

Kimi K3能否复刻DeepSeek时刻?华尔街一致给出反直觉结论:反而强化高端算力需求

Kimi K3能否复刻DeepSeek时刻?华尔街一致给出反直觉结论:反而强化高端算力需求

Kimi K3 改变了什么:它更像是在重塑 AI 竞争节奏

K3 发布后,市场第一时间仍会把它与 DeepSeek R1 放在一起比较。这种比较本身并没有问题,但如果讨论只停留在“会不会再次打击 AI 硬件”这个层面,显然还不够全面。

如果说 DeepSeek 让市场重新评估了训练效率,那么 Kimi K3 进一步证明的是:开源模型同样能够在规模、长上下文、Agent 和多模态等方向推进到前沿区间。

这意味着,美国前沿实验室可能仍需保持高投入,而中国模型也有望在全球开发者生态中继续扩大影响力。闭源顶级模型保留技术和价格溢价,开源模型则覆盖更广的价格带与部署场景;云厂商承担模型分发和企业落地,硬件产业链继续承接训练与推理侧的基础设施压力。

短期来看,受“DeepSeek 记忆”影响,相关交易仍可能出现波动。中期来看,只要 token 使用量继续增长,长上下文和 Agent 场景持续扩散,算力、HBM、存储、网络和 IDC 仍会是难以绕开的关键成本项。

这也是为什么多家机构在 K3 发布后给出了相似结论:更强的开源模型,并不是 AI 基建需求的终点,反而可能成为下一轮需求扩散的起点。

不过,美银美林也明确提示了一项尾部风险:如果效率提升的速度快于工作负载增长,那么基础设施建设节奏可能出现回落。换句话说,如果模型持续变得更便宜,但使用量未能同步明显扩张,算力需求增长逻辑也会受到影响。后续仍需要结合模型部署进度、企业采纳情况以及实际 token 消耗变化持续观察。

需要说明的是,以上内容主要围绕机构观点和产业逻辑展开,属于行业信息解读,并不构成任何投资建议。AI、半导体、算力及相关概念资产波动通常较大,市场判断也可能随技术进展和企业实际落地情况而变化。

热门AI工具

更多
咔片AIPPT

一款在线AI演示文稿制作工具,可根据主题和内容需求辅助生成PPT结构与页面,提高演示材料制作效率。

Atoms
Atoms Hot

Atoms是一款AI智能体工具,第一支自动构建真实业务的 AI 团队。

AionClaw
AionClaw Hot

AionClaw是一款面向办公、创作和编程任务的AI桌面智能体。

讯飞绘文

讯飞绘文是一款由科大讯飞推出的一站式 AIGC 内容运营平台。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

Loomy
Loomy Hot

一款AI工具,主要用于科大讯飞发布的桌面级 AI 助理,比 OpenClaw 更易用、更安全!,适合需要提升相关任务效率的用户。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

超级简历WonderCV

一款AI办公效率工具,主要用于免费求职简历模版下载制作,应届生职场人必备简历制作神器,适合需要提升相关任务效率的用户。

相关专题

更多
DeepSeek官方入口
DeepSeek官方入口

DeepSeek,一个综合性的搜索引擎,提供来自学术数据库、新闻网站和社交媒体的广泛结果。访问 DeepSeek 的官方网站。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

38049

2025.02.17

deepseek在线提问
deepseek在线提问

本合集汇总了DeepSeek在线提问技巧与免登录使用入口,助你快速上手AI对话、写作、分析等功能。阅读专题下面的文章了解更多详细内容。

1089

2026.02.27

DeepSeek 入门与快速上手指南
DeepSeek 入门与快速上手指南

面向 AI 工具新手,从 DeepSeek 的账号注册、网页端与客户端使用讲起,介绍 DeepSeek-V3、DeepSeek-R1 等模型的能力定位与选择建议、对话提示词(Prompt)编写技巧、深度思考模式与联网搜索功能的使用场景、API Key 申请与首次接口调用流程,帮助用户快速上手 DeepSeek 并将其融入日常工作与学习。

2209

2026.05.12

DeepSeek API开发与应用集成教程合集
DeepSeek API开发与应用集成教程合集

系统讲解 DeepSeek 开放平台 API 的开发与集成方法,涵盖 API Key 鉴权与请求签名、Chat Completions 接口参数详解(temperature/top_p/max_tokens)、多轮对话上下文管理、流式输出(SSE Streaming)的前后端实现、Function Call 函数调用与外部工具对接、Embeddings 文本向量接口的使用、Python requests / openai SDK / J

351

2026.05.12

DeepSeek 提示词工程与高效使用教程合集
DeepSeek 提示词工程与高效使用教程合集

聚焦如何通过提示词工程充分发挥 DeepSeek 的能力上限,涵盖基础 Prompt 结构(角色/任务/格式/约束)设计、System Prompt 系统指令的最佳实践、Few-shot 示例引导与 Zero-shot 直接提问的场景选择、思维链(Chain of Thought)逐步推理引导、复杂任务的分步拆解策略、输出格式控制(JSON/Markdown/表格)、避免幻觉与提升准确率的约束技巧、DeepSeek-R1 深度推理模式的

407

2026.05.12

DeepSeek本地部署与私有化方案
DeepSeek本地部署与私有化方案

面向有数据隐私需求的开发者与企业,讲解 DeepSeek 开源模型的本地化部署方案,涵盖 DeepSeek-R1 各蒸馏版本(1.5B/7B/8B/14B/32B/70B)的硬件需求与能力对比、Ollama 一键本地运行与模型管理、vLLM 高性能推理服务部署、llama.cpp 量化推理(GGUF 格式/Q4/Q8 量化)在消费级显卡上的实践、Hugging Face Transformers 加载与微调、Docker 容器化部署、多

282

2026.05.12

DeepSeek行业应用场景实战
DeepSeek行业应用场景实战

以实际业务场景为导向,展示 DeepSeek 在不同行业中的落地应用方案,涵盖代码开发辅助(代码生成/审查/重构/单元测试编写)、长文写作与内容创作(报告/文案/论文大纲)、Excel 数据分析与可视化建议、智能客服机器人搭建(意图识别/多轮对话/知识库检索)、RAG 检索增强生成实现企业知识库问答、合同与法律文本审查、教育领域个性化辅导,帮助用户将 DeepSeek 转化为切实的生产力工具。

472

2026.05.12

DeepSeek 与主流 AI 大模型对比评测
DeepSeek 与主流 AI 大模型对比评测

从多个维度对 DeepSeek 与市场主流大语言模型进行客观对比,涵盖模型参数规模与架构差异(MoE 混合专家架构)、中文理解与生成能力对比、英文与多语言表现、数学推理与代码能力基准评测(MMLU/HumanEval/GSM8K)、长文本处理与上下文窗口对比、API 定价与性价比分析、响应速度与并发能力、开源生态与私有化部署灵活性,帮助用户根据自身需求在 DeepSeek、ChatGPT、Claude、Gemini、Llama 等模型中

225

2026.05.12

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

0

2026.09.30

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Kimi K2.6学习视频
Kimi K2.6学习视频

共1课时 | 145人学习

KIMI官方手册
KIMI官方手册

共0课时 | 0人学习

腾讯元宝使用手册
腾讯元宝使用手册

共0课时 | 0人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn