通义千问团队正式发布 Qwen3.8-Flash-Next,这是一款采用全新架构的模型,目标是在不牺牲生成质量的前提下,将推理与部署成本压缩到极致。与以往版本相比,新架构在计算效率、显存占用和响应速度方面均有明显优化,更加适合高并发、高频调用及资源受限的生产环境。
该模型延续了 Qwen 系列的开源策略,开发者可基于现有工具链快速集成,并针对具体场景进行微调。团队表示,Qwen3.8-Flash-Next 的推出是迈向“极致成本效率”的重要一步,未来将持续探索架构创新,让高性能 AI 能力以更低门槛服务更多企业和开发者。