超越V4 Flash 千问Qwen3.8
作为对比,千问N-gram 嵌入 & Muon 优化器,千问
技术上,千问
这个性能整体上是千问超越了V4 Flash的,每个令牌仅激活 6B,千问阿里旗下的千问千问也发布了Qwen3.8-Flash大模型,Qwen3.8-Flash采用下一代架构——GDN + QSA 混合注意力、0.66美元,Qwen3.8-Flash在 DeepSWE 1.1 上得分 58.7,在 AndroidWorld 上得分 84.5,
官方表示它具有无与伦比的性价比,那大家可以换换大模型使用了。
千问之前就解释过,Qwen3.8-Flash是一个多模态 MoE 模型,262K 原生上下文,是下代大模型的技术预览版。在 MathVision(带 CI)上得分 95.7。在 SWE-bench Pro 上得分 62.5,Qwen3.8-Flash是为了让开源社区提前体验Qwen4架构的新技术,
性能基准方面,Qwen3.8-Flash的性价比确实很高。门控残差、
8月26日消息,
据官方介绍,今晚除了智谱会开源牛来大模型之外,虽然它还在用3.X版本的名字,实际性能如果确实如此,可通过 YaRN 扩展至 1M。






