国产大模型进入融资与技术双爆发期,DS与Kimi估值暴涨

南都N视频APP · 政商数据
原创2026-08-05 18:12
图片

8月5日,大模型公司DeepSeek被爆出已重启第二轮融资,本轮计划募资500亿元,投前估值约5000亿元,并计划在8月下旬完成签约。就在一个月前,DeepSeek刚刚完成首轮外部融资,首轮融资金额为500亿元、投后估值超过3500亿元。若第二轮融资顺利落地,DeepSeek将在两轮融资中累计募资超1000亿元。

与此同时,另一家国产大模型企业月之暗面kimi近期也被爆出,已启动G轮(Pre-IPO)融资,本轮估值达500亿美元(约3373亿元人民币)。

除了资本以外,国产大模型也正在经历一场技术爆发期。从技术端看,短短一个月内,Kimi K3、MiniMax H3、字节Seedance 2.5、DeepSeek-V4-Flash、阿里Qwen3.8密集落地,在参数规模、多模态能力、编程与Agent能力上全面对标乃至超越国际闭源旗舰。与此同时,多个国产模型画出了一条价格“斩杀线”。

图片

国产模型一个月内密集迭代

一个月内,国产大模型进入密集迭代期。

7月16日,2.8万亿参数的kimi K3大模型横空出世,以1679分登顶Frontend Code Arena榜单,‌‌‌被埃隆·马斯克再次留言称“令人印象深刻”。 K3除了总参数高达2.8万亿、刷新全球开源模型规模上限,以及在Coding和长程Agent能力表现颇为出色以外(首次实现开源模型在Frontend Code Arena前端编程榜单超越一众Claude、GPT等闭源模型),另一特点是具备原生多模态能力。

7月31日,MiniMax发布了其第三代视频模型H3,在价格方面,MiniMax H3视频生成价格为0.8元/秒(2K分辨率),仅为业内同类旗舰视频模型的三分之一。另外,在研发H3时,MiniMax将重点从单项能力提升转向任务统一和泛化。不同于Hailuo 01和Hailuo 02两代视频模型的架构,H3应用了最新模型架构,能在多模态上下文中统一理解创作意图。

MiniMax发布H3的同天,字节跳动也正式发布其Seedance 2.5。这一版本在生成时长、多模态理解、编辑精度等维度实现全面升级。不过字节跳动更想讲的故事,是模型进产业的进展。可以看到在发布模型的同时,字节也官宣了Seedance 2.5进入小鹏汽车、机器人企业产线的一系列进展。

赶在7月最后一天,DeepSeek-V4-Flash上线了正式版API。在次日国际AI基准测试与分析机构Artificial Analysis的测评榜单中,DeepSeek V4 Flash最新版本的智能指数比 GPT-5.6 Luna(最高51分)仅低1分。

紧随月之暗面之后追逐超大参数的是阿里巴巴。8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8,总参数量2.4万亿略低于kimi K3的2.8万亿,但其性能也在发布当日快速登上三方榜单Arena第二名,仅次于Anthropic的Claude系列。在发布当日,阿里方面还表示Qwen3.8-Max、Qwen3.8-27B都将在下周开源。


国产模型集体选择开源

在模型厂商密集的动作中,“开源”和“价格”再次站到了这次国产模型密集迭代的舆论中心。

在开源方面,早在kimi K3发布后,国际就针对开源展开了大辩论。当时马斯克视其为挑战目标、OpenAI与Anthropic高管则提出了“开源威胁论”。其中,OpenAI战略未来负责人迪恩·鲍尔曾公开发帖抨击Kimi K3模型,称开放权重模型会削弱前沿模型的商业回报,称其为“减速主义力量”。Anthropic首席执行官Dario Amodei认为,开源模型失去了撤销访问权限、更新安全护栏或防止滥用的能力,更难保证安全。

当地时间7月24日,包括Meta、英伟达、微软在内的25家美国科技公司联名签署公开信《开放权重与美国AI领导力》,呼吁开放权重AI模型。在签署该公开信后,英伟达创始人黄仁勋发布了第一条推特,转发了上述公开信。他在转发语中表示,人工智能将改变每个行业、赋能每个公司并由每个国家构建。开源模型加强安全性和网络安全、加速创新和传播,世界需要前沿闭源模型,也需要前沿开源模型。

将视角转回国内,开源正在成为越来越多模型厂商的选择。其中,阿里官宣即将于下周开源的Qwen3.8-Max是阿里首次开源的Max规格模型。此前针对Max系列,阿里方面仅支持API调用,用户无法下载权重。

另外,MiniMax也选择在长期闭源的视频模型赛道开启开源模式,于8月3日开放了H3模型的权重。值得一提的是,MiniMax此前已先后开源三代M系列文本模型,但在视频生成模型上则是首次开源。

对于Anthropic和OpenAI目前对模型开源的态度,Forrester副总裁兼首席分析师戴鲲认为,这本质上是商业模式和安全理念的双重选择。他进一步提到,“闭源API模式有利于持续获取推理收入、控制模型迭代节奏并保护训练资产。同时,Anthropic长期强调安全和可控性,认为高能力模型开放权重后无法撤回、补丁修复或限制滥用。”

对于国产模型近期纷纷进一步转向开源的现象,戴鲲告诉南都N视频记者,中国模型市场已进入能力交互成长、生态加速竞争阶段。“开源成为获取开发者、建立行业标准、扩大云消费和Agent生态的最快路径。对于阿里、MiniMax等厂商而言,模型本身越来越像入口,真正争夺的是平台流量、企业部署和推理市场份额。”

模型厂商开源后护城河将体现在哪些地方?戴鲲认为,未来模型厂商的护城河位置会转移,护城河不再是模型权重而在于模型训练调优,特别是推理基础设施、专有数据、语义网络构建与知识基础设施、Agent框架、上下文工程与驾驭工程,以及Agentic AI在细分通用与垂直业务场景的应用与解决方案、企业分销渠道以及规模化运营与服务能力等方面。


国产模型画出一条“价格斩杀线”

另一个在此次模型厂商迭代动作中被讨论的关键词,则是价格。

7月31日DeepSeek-V4-Flash上线正式版API后,“模型斩杀线”一词快速被大众讨论。在次日国际AI基准测试与分析机构Artificial Analysis的测评榜单中,DeepSeek V4 Flash最新版本的智能指数比GPT-5.6 Luna(最高51分)仅低1分。但在成本上,根据Artificial Analysis实测,DeepSeek V4 Flash跑完基准测试一次任务成本只需0.03美元,Anthropic旗舰模型Claude Fable 5需3.15美元,DeepSeek比Claude便宜超100倍。

但这一“模型斩杀线”并不仅仅由DeepSeek单家国产模型画出。据Artificial Analysis在Kimi K3发布后测算,当时K3单任务成本约0.94美元,与同期GPT-5.6 Sol的1.04美元接近,是Claude Opus 4.8耗费的1.8美元的一半。

OpenRouter的数据分析专家Justin Summerville预估,开源的中国模型性能接近顶尖水平,成本却比美国领先的Anthropic和OpenAI的模型便宜60%到90%。这一极具竞争力的成本优势,促使一些大型美国公司开始转向中国大模型。

戴鲲则提到,他认为开源正在推动模型能力快速商品化,压缩闭源厂商的定价权。“未来模型厂商的估值将进一步从模型能力领先本身转向模型相关的应用、数据、生态和企业场景适配。OpenAI和Anthropic的收入增速仍会增长,但估值倍数可能下降,而开源厂商将通过云服务、Agent平台和生态变现获得更高价值。”

对于国产模型厂商为何能做到以开源引领闭源,此前不少业内人士皆提到原因之一是“被缺卡倒逼出来的”。这一“动力”同样反而增加了国产模型的成本优势。

戴鲲认为国产大模型的成本优势主要来自于MoE架构、高推理利用率、本土算力供应链、工程优化以及激烈竞争。“可以看到,中国模型厂商会更关注单位算力产出而非绝对性能领先,它们通过激活少量参数、降低推理成本和快速迭代,实现接近前沿模型的能力,却能以远低于海外厂商的价格提供服务。”


采写:南都N视频记者 林文琪

编辑:田爱丽

南都N视频,未经授权不得转载、授权联系方式
banquan@nandu.cc. 020-87006626