#阿里Qwen4投入训练#云栖大会上,阿里正式对外披露,基于新一代架构的Qwen4大模型已经正式投入训练,消息一出,迅速引发AI圈广泛讨论。
作为通义千问系列的下一代主力模型,Qwen4搭载全新的技术架构,同时引入RSI递归自我改进技术。这套技术可以让模型自主搭建训练流程、生成训练数据、设计实验、定位自身缺陷,在减少人工干预的前提下完成迭代优化,也是本次升级的一大亮点。
按照公开的路线规划,在Qwen4之后,Qwen4.5、Qwen5版本还会继续向上突破,计划把总参数量提升至5万亿到10万亿的级别,向着更强的通用人工智能方向探索。
回顾Qwen系列的发展,此前Qwen3.8‑Max已经展现出不俗的能力,在代码、智能体任务上表现亮眼,还完成过数十轮无人工参与的自主迭代,为Qwen4的研发打下了扎实基础。阿里也同步推进全模态矩阵,视频、语音、图像、音乐等多类模型都在同步迭代,下一代视频生成模型也计划在11月推出。
不少业内人士分析,Qwen4不只是简单的参数放大,重点在于架构革新与自我进化能力。在算力成本不断被优化的背景下,依靠新架构,能够在提升能力的同时,尽可能控制训练与运行的开销。
当然目前Qwen4还处在训练阶段,具体的能力指标、发布时间、开源策略,都还没有最终敲定。大家也都在期待,完成训练之后的Qwen4,会在推理、长任务、多模态理解上带来怎样的突破。
国产大模型的竞争越来越激烈,阿里持续推进模型迭代,也代表国内AI技术正在稳步向前。后续Qwen4的训练进展,以及正式上线后的实际表现,也将持续受到行业和普通用户的关注。
http://t.cn/AXOgEugy
发布于 北京
