AI AI工具情报站
AI资讯ai-models

2.4T MoE、激活 95B、原生 256K 上下文

IT之家(RSS)2026-08-12T16:10:01.000Z

核心亮点

阿里 Qwen 团队这次真的放大招了。8月,团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别的旗舰模型第一次以开源方式完整公开,并且可以免费使用。对开源社区而言,这相当于把过去只有付费 API 才能调用的顶级能力,直接搬到了所有人都能下载的仓库里。

具体能力或事件经过

据 IT之家报道,此次开放的 Qwen3.8-2.4T-A95B 总参数达到 2.4T,但每个词元也就是 token 只激活 95B 参数,属于典型的 MoE 混合专家架构。更关键的是,它原生支持 262144 个词元的上下文长度,并且可以进一步扩展至 1010000 个词元,也就是超过百万级的长上下文。这意味着它可以一次性读下整本书、整套代码库,甚至大型技术文档,而不必切块处理。

技术细节

从参数设计看,2.4T 总参数、95B 激活参数的组合,体现了大模型容量加低推理成本的思路。MoE 架构让模型在保持巨大知识容量的同时,把每次推理的算力开销控制在可接受范围。百万级上下文的扩展能力,则依赖分块缓存与稀疏注意力等技术,使超长输入的训练和推理在工程和成本上变得可行。对研究者来说,开放权重还意味着可以微调、蒸馏、做量化,真正把模型变成自己的。

与竞品对比

说白了,开源旗舰第一次摸到闭源顶配的门槛。此前 Qwen-Max 这类能力通常只存在于阿里云的商业 API,如今权重公开,直接对标 Llama、Mistral 等开源阵营里的最大型号。相比需要庞大集群才能跑起来的稠密模型,Qwen3.8 的 MoE 设计在同等效果下更省显存,降低了部署门槛。当然,2.4T 的总规模仍然需要相当可观的硬件,普通开发者很难在本地完整运行。

行业影响或适用场景

对企业与开发者来说,这次开放最大的价值是可控。数据敏感的行业,金融、医疗、政务,可以把模型私有化部署在自家机房,既用到旗舰能力,又不把数据送出边界。对学术研究而言,开放权重意味着可复现、可审计。简单来说,Qwen 把顶级能力开源化这件事又往前推了一步,也让开源与闭源的边界进一步模糊。