精华速览
据量子位报道,阿里研究员近日透露,Qwen系列模型的后续版本,包括Qwen4.5和Qwen5,参数规模将扩展至5-10T。这一表态意味着阿里通义千问团队正计划将模型体量提升至万亿级区间,较当前公开版本有数量级上的跨越。素材未披露具体发布时间、训练数据规模、算力投入及模型架构细节,也未说明5-10T是指总参数还是激活参数。若该计划落地,Qwen将成为少数公开确认冲击十万亿参数级别的国产大模型系列,其训练成本、推理效率和部署门槛都将成为行业关注焦点。目前相关信息仍属研究员单方面透露,尚待阿里官方确认。
要点透视
- 阿里研究员透露,Qwen4.5、Qwen5等后续版本将扩展至5-10T参数规模。
- 该信息由量子位报道,原始出处为阿里研究员对外表态,非阿里官方正式发布。
- 5-10T参数若指总参数,将较当前主流开源大模型提升约一个数量级。
- 素材未说明5-10T是总参数还是激活参数,也未披露是否采用MoE等稀疏架构。
- Qwen4.5与Qwen5被并列提及,但两者的具体发布时间和版本关系尚不明确。
- 报道未给出训练数据量、算力投入、推理成本及开源计划等配套信息。
- 该计划若推进,Qwen将成为公开确认冲击万亿级参数区间的国产大模型系列之一。
- 截至素材采集时,阿里官方尚未对该参数扩展计划作出回应或确认。
文章拆解
从素材看,这次信息的核心不是某个模型已经发布,而是一位阿里研究员对未来Qwen版本参数规模的预告。5-10T是一个相当激进的数字。当前主流开源大模型多在数十亿到数千亿参数区间,万亿级已属头部,十万亿级则意味着模型容量、训练数据和算力需求都要同步跃升。如果5-10T指总参数,Qwen后续版本的体量将比现有公开版本高出一个数量级;如果指激活参数,则实际总参数可能更大,通常需要极稀疏的MoE架构来支撑。
这一表态背后的逻辑,可能是阿里对 scaling law 仍持乐观态度,希望通过更大参数规模换取推理、代码、多模态等复杂任务上的能力上限。对行业而言,头部厂商继续加码超大模型,会进一步抬高训练门槛,中小团队更难跟进,开源生态也可能出现“大而强”与“小而美”的分化。对用户来说,短期未必能直接用到5-10T模型,因为超大参数带来的推理成本和部署难度会限制其落地形态,更可能先以云端API或受限场景提供服务。
值得关注的变量有几个。第一,5-10T究竟指总参数还是激活参数,这直接决定模型的实际计算开销。第二,Qwen4.5和Qwen5的时间表,素材没有给出,尚待确认。第三,是否延续开源策略,若十万亿级模型不开源,其对开发者的实际影响会大打折扣。第四,训练数据从何而来、是否触及数据质量瓶颈,也是超大模型能否兑现能力提升的关键。潜在风险同样明显:算力成本高企、推理延迟和能耗上升、商业化回报周期拉长,以及参数规模与真实能力提升之间可能并不线性对应。在官方确认之前,这一参数计划应视为方向性信号,而非既定事实。

暂无评论。