中国大模型的参数竞赛,正在以令人惊叹的速度冲向一个此前难以想象的规模。
7月19日,阿里巴巴Qwen官方账号宣布,Qwen3.8即将推出并开放模型权重。官方给出的总参数规模达到2.4万亿,并称这款模型仍在持续演进,其能力可与全球领先的前沿模型竞争,在Qwen自己的判断中“仅次于Claude Fable 5”。
这不是一次普通的版本更新。就在几天前,月之暗面发布了拥有2.8万亿总参数的Kimi K3;OpenAI则在7月全面推出GPT-5.6系列,旗舰型号Sol主打复杂专业工作和智能体任务;Anthropic的Claude Fable 5继续占据多个高难度评测的领先位置。Qwen3.8的出现,意味着最强模型的竞争不再只是OpenAI与Anthropic两家美国公司的内部赛跑,而是演变为封闭旗舰与中国开放权重模型之间的正面碰撞。
2.4万亿参数,而且准备开放权重
Qwen官方帖文透露的信息很短,却包含两个极具冲击力的关键词:2.4万亿参数和Open Weight。
从总参数规模看,Qwen3.8已经远远越过传统百亿、千亿参数模型的范围,进入万亿级混合专家模型的新阶段。作为对照,Kimi K3拥有2.8万亿总参数、100万Token上下文和原生视觉能力。Qwen尚未披露Qwen3.8每次推理会激活多少参数、上下文长度、多模态范围、训练计算量和部署要求,因此仅凭2.4万亿总参数不能直接判断它的速度、成本与真实能力。
但“开放权重”让这次预告的意义明显放大。如果后续发布允许开发者下载、部署和研究模型,Qwen3.8就不只是一个通过网页或API访问的云端产品,而会成为全球开发者、企业和研究机构可以实际掌握的前沿基础设施。
参数规模并不等于智能水平,开放权重也不必然意味着容易部署。一个2.4万亿参数模型对硬件、显存、并行推理和运维能力的要求极高,即使采用MoE架构和量化技术,本地运行完整版仍可能只属于大型机构。不过,权重开放会促进量化、蒸馏、推理框架优化和行业微调,其外溢影响远大于一个完全封闭的API模型。
与Claude Fable 5相比:Qwen主动把目标放在最高一档
Qwen官方最引人注意的表述,是称Qwen3.8可与领先前沿模型竞争,并“仅次于Fable 5”。这相当于主动把Claude Fable 5设为最高参照物。
Anthropic在6月发布Fable 5时,将其定位为面向最复杂、最长周期任务的Mythos级模型。官方称它在软件工程、知识工作、视觉和科学研究等多个领域达到自身最强水平,并且任务越复杂、执行时间越长,相对旧模型的优势越明显。
Qwen目前没有随预告公布完整基准成绩,也没有说明“仅次于Fable 5”依据哪些评测、推理配置和成本条件。因此,这一排名现阶段应被理解为Qwen的产品定位,而不是经过独立验证的统一结论。
真正令人惊叹的地方,恰恰不是Qwen是否已经在某张榜单上追平Fable 5,而是一款即将开放权重的中国模型,已经公开把Anthropic最高能力档作为直接竞争目标。
与GPT-5.6 Sol相比:封闭旗舰的效率,对上开放权重的规模
GPT-5.6 Sol代表了另一条路线。OpenAI把它定位为GPT-5.6家族的旗舰,重点提升编程、专业知识工作、网络安全、科学任务和长时间智能体执行。它支持约105万Token上下文,并提供更深的max推理以及由多个子智能体协作的ultra模式。
OpenAI强调的重点并不是参数规模,而是单位Token效率、任务完成率、速度和总成本。在OpenAI公布的评测中,GPT-5.6 Sol在多项编程与智能体任务上超过Fable 5,同时在另一些综合智能评测中仍略低于Fable 5。这说明“谁是最强模型”已经无法用一张排行榜简单回答:模型可能在代码、专业工作、视觉设计、科学推理、速度和成本上分别领先。
Qwen3.8与GPT-5.6 Sol的竞争因此很有代表性。前者用2.4万亿参数和开放权重制造震撼,后者用高度产品化的工具链、推理档位和智能体系统强调完成真实工作的效率。一个让开发者拥有模型,一个让用户直接获得成熟服务,两者争夺的是不同层面的控制权。
与Kimi K3相比:中国开放权重模型开始内部竞速
如果说GPT-5.6 Sol和Fable 5是Qwen3.8的国际参照,那么Kimi K3就是最直接的中国竞争者。
月之暗面公布的Kimi K3拥有2.8万亿总参数、100万Token上下文和原生多模态能力,采用混合专家架构,每个Token只激活部分专家。官方承认其综合表现仍落后于Fable 5和GPT-5.6 Sol,但称它在一系列评测中达到前沿水平。Kimi K3还在网页前端开发等部分公开竞技场中表现突出,完整权重计划于7月27日前发布。
Qwen3.8的总参数比Kimi K3少4000亿,但总参数并不能直接决定实际表现。关键要看激活参数、训练数据、推理架构、强化学习、视觉能力、工具使用和任务完成效率。Qwen此前已经建立了庞大的开源模型、云端API和Qwen Code生态,如果Qwen3.8能够以开放权重接近Fable 5,同时保持较好的推理成本和工具能力,其实际影响可能不亚于参数更大的Kimi K3。
更值得关注的是节奏:Kimi K3刚刚用2.8万亿参数震动行业,Qwen随即预告2.4万亿参数的Qwen3.8。中国模型厂商已不再满足于追赶上一代美国旗舰,而是开始围绕当代最强模型展开高频竞速。
令人惊叹的不是数字,而是差距缩短的速度
几年前,开放模型通常意味着能力落后、上下文较短,或者只能承担相对简单的任务。如今,Kimi K3和Qwen3.8开始把开放权重模型推进到万亿参数和前沿能力区间,并直接与Claude Fable 5、GPT-5.6 Sol比较。
这可能改变整个AI产业的议价结构。封闭模型的优势在于稳定服务、安全体系、产品体验和完整工具生态;开放权重模型则给予企业更多部署控制、数据自主权和二次开发空间。当开放模型的能力差距从一代缩短到几个百分点,企业是否必须依赖少数美国API供应商,就会成为一个可以重新计算的问题。
当然,现在还不到宣布Qwen3.8胜负的时候。官方尚未披露正式发布日期、许可证、激活参数、上下文、多模态能力、API价格和完整评测。开放权重承诺也需要等待文件真正发布后才能验证。
但仅从这次预告已经可以看到一条清晰趋势:Fable 5仍然是许多团队试图挑战的能力标杆,GPT-5.6 Sol正在把智能体效率推向更高水平,Kimi K3用2.8万亿参数打开了超大规模开放模型的想象空间,而Qwen3.8准备以2.4万亿参数加入同一战场。
最令人惊叹的,不是哪一家在今天暂时领先,而是前沿模型的封闭与开放、中国与美国、规模与效率之间,已经从遥远追赶变成了几乎同时发生的正面竞争。
资料来源:
- Qwen官方X账号:Qwen3.8预告
- OpenAI:GPT-5.6系列正式发布
- OpenAI开发者文档:GPT-5.6 Sol
- Anthropic:Claude Fable 5与Mythos 5
- Moonshot AI:Kimi K3技术介绍
截至发稿时,Qwen3.8仍处于预告阶段。本文对其能力与影响的讨论基于Qwen官方表述和已公开信息,最终规格、许可证及独立评测结果以正式发布为准。

TopsTip