ESC
AI 1 分钟阅读

Qwen3.8-Flash-Next:全新架构,迈向极致成本效率

通义千问发布 Qwen3.8-Flash-Next,采用全新架构,旨在实现极致成本效率。新模型在保持生成质量的同时显著降低推理与部署成本,面向开发者和企业提供更经济的大模型服务方案,有望推动 AI 应用在成本敏感场景中的规模化落地。

来源:Hacker News

通义千问团队正式发布 Qwen3.8-Flash-Next,这是一款采用全新架构的模型,目标是在不牺牲生成质量的前提下,将推理与部署成本压缩到极致。与以往版本相比,新架构在计算效率、显存占用和响应速度方面均有明显优化,更加适合高并发、高频调用及资源受限的生产环境。

该模型延续了 Qwen 系列的开源策略,开发者可基于现有工具链快速集成,并针对具体场景进行微调。团队表示,Qwen3.8-Flash-Next 的推出是迈向“极致成本效率”的重要一步,未来将持续探索架构创新,让高性能 AI 能力以更低门槛服务更多企业和开发者。