K3大模型发布引市场热议,大模型混战升级谁能笑到最后?

发布时间:2026/9/26 0:29:01

K3大模型发布引市场热议,大模型混战升级谁能笑到最后?
【K3大模型发布引发市场讨论】上周全球市场大跌真假小作文甚嚣尘上。除韩国加息、地缘问题导致的流动性去杠杆因素外K3大模型的发布以及“中美竞争”也被反复讨论。【K3大模型的优势与影响】K3所代表的中国大模型缩短了前沿大模型的追赶进程凭借成本优势模型架构、人才、电力等、开源优势为终端用户提供了优质大模型的另一种选择。不过海豚君认为K3受制于短期算力供给在性价比和输出速度上并无优势短期对闭源模型龙头影响有限但开源模型缩小与顶尖闭源模型的技术差距意义重大也是纯大模型商业模式边际恶化的拐点。对于独立AI Lab来说可能会拉长头部大模型厂商扭亏为盈的等待期。但这并不意味着AI全行业商业模式被证伪开源大模型的技术突破短期增强了资金雄厚的追赶者和中小企业本地部署大参数量模型的投入信心中长期将加速AI大模型的大宗商品化进程提高全行业的AI渗透促使中游CSP等企业服务、下游C端应用层高速发展。【大模型竞争蔓延到头部】今年上半年头部模型Lab密集发布前沿大模型。北美以Anthropic和OpenAI为模型创新主力xAI、Meta、Google紧随其后中国大模型虽不领先但生态百家争鸣。企业端看重模型质量Anthropic在ARR表现上一超多强2月推出Opus 4.6后流水ARR加速后续Opus 4.7、4.8性能也不断上升直到4月OpenAI推出GPT - 5.5才与之有一战之力3 - 6月Anthropic的ARR月环比增速保持在30%以上。而独立C端用户更看重价格中国大模型凭借性价比和开源优势在OpenRouter渠道的Token用量占比6月起超过美国大模型带动整体Token单价下滑。原本企业高端需求由Anthropic满足个人普通需求有腾讯HY3.0、DeepSeek、小米、Minimax等方案。但Coding市场原本被Anthropic独吞如今北美OpenAI、Google以及中国智谱、Kimi调整研发目标提升大模型的Coding能力。7月战火真正燃起北美内部OpenAI的GPT 5.6 - Sol性能看齐Fable 5单价仅为其30%单任务成本指标为38%中国Kimi带着基模K3打入核心阵营K3的AA智能评分位列Fable、Sol之后在Arena榜单中被投成榜一。综合实力上北美厂商仍有优势但二季度以来智谱、Kimi先后进入TOP 5与Anthropic的研发差距从6 - 12个月缩短到3个月。【K3短期竞争影响有限但意义重大】1. 大模型迭代“越大越好”Kimi K3是开源权重大模型7月27日除最底层代码和训练数据库外将全网开源。在第三方评测核心指标榜单上K3均排在前列部分指标获第一。其优势在于前端开发和智能体UI审美高级、网页生成完成度高擅长处理长周期多工程任务。这主要得益于总参数规模扩大K3总参数量达2.8万亿刷新了DeepSeek V4的1.6万亿记录。不过与GPT 5.6、Fable 5的5 - 10万亿量级相比仍有差距目前大模型迭代遵循Scaling Law规律未来前沿大模型参数量提升趋势明确。2. 实际性价比不高K3发布后Anthropic将Fable 5纳入Max及Team订阅体系。但目前Kimi K3性价比不高与GPT - 5.6 - Sol相比单价低一半的情况下Token使用效率偏低、推理速度偏慢实际执行任务成本只便宜10%。不过Kimi在底层技术路线上致力于提高训练效率两个核心技术创新相比上一版本K2带来2.5x的缩放效率提升。中国AI Lab受高端芯片供应和资金短缺限制MoE稀疏架构成为中国开源大模型厂商的选择OpenAI自GPT - 4起也采用。2024年初DeepSeek优化MoE稀释架构改善了训练效率和成本。Kimi的K3通过扩大模型稀疏度降低无效算力消耗有效激活率不足2%刷新了DeepSeek V4 Pro的3%记录性能接近的GLM - 5.2激活率为5%北美大模型大多为10%。此外K3还通过KDAKimi Delta Attention和注意力残差机制提升训练效率解决传统Transformer在“长上下文”上的弊端KDA技术可减少75%的KV Cache。3. 高部署门槛大参数量提高模型性能的同时也提高了硬件部署门槛。K3虽减少了75%的KV缓存但总参数逼近3T级别所有专家权重需常驻显存整体模型权重存储需求超1.5TB加载模型需1.5T的HBM容量。NV DGC B200单节点8颗GPU总显存约1.4T只能装下原始权重几乎无运行空间需GB300机柜Kimi建议K3最佳部署为至少64颗加速器的高带宽超级节点华为昇腾950 Superpod也可满足运行需求。模型权重开源后本地部署最小规模的K3推理集群至少需要8颗NV A100硬件成本超400万元。实测显示K3算力紧缺明显199元/月的登月套餐Allegretto只能用10小时 49元/月的初级套餐Andante低频使用三天也会遭遇算力告急Kimi官方已暂停新增订阅以保证存量用户体验。【变天的不是行业而是Anthropic】有观点认为Anthropic和OpenAI模型迭代性能边际提升缩小中国大模型技术追赶会加剧行业竞争导致Anthropic的ARR放缓商业模式遇阻。AI龙头商业化情况影响全行业军备竞赛预期当前产业链预期打满Capex增长斜率降低会导致市场短期崩盘。Anthropic ARR近一年优势明显主打AI Coding场景市场预期今年经营利润转正。上半年3 - 6月ARR加速海豚君按20%月均环比增速估算7月8月后考虑竞争加剧增速下滑预计年底达1180亿与年初目标和市场预期相比达成难度不大。但如果下半年ARR环比增速降至年底的5%隐含年化增速70%将不利于Anthropic上市后的估值弹性。不过考虑到Kimi K3的算力瓶颈、无性价比优势和输出速度劣势以及产品生态布局再加上川普可能出台限制中国AI的政策中国大模型出海尤其是企业端需求可能不顺畅。即便Anthropic“势头走弱”也不代表全行业完蛋。北美是全球AI投入最快、规模最大的市场AI渗透率全球最高20%的企业已采用AI预计今年继续上升3ppt。Coding领域渗透率最高公司内其他岗位和To C端侧AI是未来增长方向但需要时间、资金投入降低算力门槛是加速AI在Coding之外领域渗透的关键。【大模型混战升级的思考】Kimi K3的出现削弱了市场对Anthropic技术壁垒的信心也让资金雄厚的追赶者尤其是有生态、渠道优势的Big Tech更有投入信心。但大模型行业竞争残酷独立AI Lab成本高领先优势从12个月缩短到3个月盈利难。中国大模型的“性价比”优势部分源于人才、电力成本差额更多靠忍受亏损的“补贴”。2026年AO两家毛利率在60%上下智谱预计毛利率降至30%以下考虑训练成本经营亏损差距将拉大。盈利结构的拐点可能源于下半年中国高端自主芯片量产。在缩放定律失效前竞争不会停止大模型公司是吞金兽商业模式变成资本竞赛。下半年Anthropic、OpenAI、DeepSeek、Kimi等将筹划上市届时决战将开始。AI主权问题可能使全球分割成多个战场持久战不可避免。混战期间大模型商业模式更难看清跑分刷榜推动融资现象可能更频繁。拥有企业平台生态和渠道优势的CSP厂商有望摆脱低利润率模式拿回更多话语权。那么在这场大模型混战中究竟谁能脱颖而出呢

相关新闻

AI拟人化互动服务新规施行:一场关于“技术、人性与权力”的三重博弈

AI拟人化互动服务新规施行:一场关于“技术、人性与权力”的三重博弈

2026/8/23 4:09:30

2026年7月15日,《人工智能拟人化互动服务管理暂行办法》正式生效。豆包、千问同步下线智能体功能,腾讯元宝、网易妙时提前关停。 这不是一次简单的行业整顿,而是一场关于“技术如何触碰人心”的深刻社会实验的阶段性终结。 一、事件本身&…

Agentic AI核心技术解析与2025年应用展望

Agentic AI核心技术解析与2025年应用展望

2026/8/23 4:09:31

1. 项目概述"Agentic AI"这个概念最近在技术圈里越来越热,作为一个从2012年就开始接触智能体系统的老码农,我想结合自己这十多年踩过的坑,聊聊这个领域的现状和未来两三年的发展可能。不同于市面上那些浮于表面的趋势分析&#xff…

Windows系统如何通过Seelen UI实现macOS交互体验

Windows系统如何通过Seelen UI实现macOS交互体验

2026/8/23 4:09:31

1. 项目概述:当Windows遇上macOS美学作为一个长期在Windows和macOS双平台切换的用户,我始终对macOS那种简约而不简单的交互设计念念不忘。直到去年偶然在GitHub发现Seelen UI这个开源项目,它用前端技术栈在Windows系统上完美复刻了macOS的Doc…

CANN/GE ACL数据集缓冲区添加函数

CANN/GE ACL数据集缓冲区添加函数

2026/9/25 10:06:33

aclmdlAddDatasetBuffer 【免费下载链接】ge GE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、Te…

用ffmpeg高效批量调整图片尺寸的实战指南

用ffmpeg高效批量调整图片尺寸的实战指南

2026/9/25 9:40:47

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

Transformers 音频特征提取工具库 audio_utils 全解析:从 Mel 刻度换算到对数 Mel 频谱

Transformers 音频特征提取工具库 audio_utils 全解析:从 Mel 刻度换算到对数 Mel 频谱

2026/9/25 10:06:21

Transformers 音频特征提取工具库 audio_utils 全解析:从 Mel 刻度换算到对数 Mel 频谱 【免费下载链接】transformers 🤗 Transformers: the model-definition framework for state-of-the-art machine learning models in text, vision, audio, and mu…

RustFS 多节点集群重启与滚动升级实战:Readiness、Quorum 与 Degraded 模式完全指南

RustFS 多节点集群重启与滚动升级实战:Readiness、Quorum 与 Degraded 模式完全指南

2026/9/25 9:53:52

RustFS 多节点集群重启与滚动升级实战:Readiness、Quorum 与 Degraded 模式完全指南 【免费下载链接】rustfs 🚀2.3x faster than MinIO for 4KB object payloads. RustFS is an open-source, S3-compatible high-performance object storage system sup…

Java Integer缓存揭秘:128陷阱原理、避坑与面试全解

Java Integer缓存揭秘:128陷阱原理、避坑与面试全解

2026/9/25 8:58:17

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

RustFS Scanner 数据用量发布权威性决策:配额准入如何获得可用的权威依据

RustFS Scanner 数据用量发布权威性决策:配额准入如何获得可用的权威依据

2026/9/25 10:00:17

RustFS Scanner 数据用量发布权威性决策:配额准入如何获得可用的权威依据 【免费下载链接】rustfs 🚀2.3x faster than MinIO for 4KB object payloads. RustFS is an open-source, S3-compatible high-performance object storage system supporting mi…

远程协作的工作台整理

远程协作的工作台整理

2026/9/24 16:02:49

远程协作的工作台整理远程协作的核心不是再加一个工具,而是让交接信息足够完整。异步任务要写明目标、输入位置、完成标准和需要决策的人。 工作台的最小配置 将日程、待办、代码和沟通入口收拢到少数固定位置;通知按紧急程度分层。工作台不需要模仿办公…

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

2026/9/25 9:41:47

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能分类:[AI/大模型]细分主题:AI 增强型 CI/CD 流水线自动化与 GitOps 实践:Agent 工作流、工具调用与任务拆解:从原型到生产的验收清单很多团队在尝试用大…

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

2026/9/25 4:22:14

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场分类:[工程技术]细分主题:Kubernetes 生产环境运维与排障实战:可复制的项目复盘模板与决策记录大部分团队的事故复盘报告,最后都变成了躺在 Confluence 或钉…