ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

阿里千问Qwen3.8-Flash发布开源:新架构引领,成本骤降性能飙升

时间:2026-08-28 00:51:06来源:快讯编辑:快讯

阿里旗下千问团队近日推出全新大模型Qwen3.8-Flash,并同步开源模型权重。该模型采用多模态混合专家(MoE)架构,通过激活1250亿参数中的60亿(6B)实现性能突破,在多项基准测试中超越Claude Opus4.6,部分场景表现接近Opus4.8。相较于前代Qwen3.7-Plus,新模型训练成本降低90%,推理成本降至每百万Tokens输入1元、输出3元,价格仅为DeepSeek-V4-Flash忙时价格的1/3,重新定义了全球大模型的性价比标准。

技术架构层面,Qwen3.8-Flash引入四大创新机制:在注意力计算上,通过QSA(Qwen Sparse Attention)与GDN融合的混合架构,使1M Tokens长上下文处理速度提升8倍;信息传递方面,自研Gated Residual方法将传统Transformer的单通道拆分为四条动态路径,显著提升训练稳定性;参数扩展通过51B规模的N-gram Embedding实现"外挂式记忆指南",避免计算资源浪费;模型优化则采用结构与训练协同设计,使收敛效率提升3倍。这些革新使未经过微调的基座模型在通用能力、数学推理和编程任务上即超越3倍体量的Qwen3.7-Plus。

在专业场景评测中,Qwen3.8-Flash展现显著优势:智能体编程任务SWE-bench Pro得分领先Opus4.6达9.1分,长程协作任务CoWorkBench和工具调用任务Toolathlon Verified均超越DeepSeek-V4-Flash,办公任务JobBench评测超出Opus4.6近20分。多模态能力方面,移动端操作AndroidWorld评测领先22.5分,视觉数学推理MathVision超出25.1分,具身智能ERQA任务领先31.5分。这些性能突破得益于模型架构与训练方案的协同优化,特别是混合注意力机制和动态信息通道设计,使复杂任务处理效率大幅提升。

应用落地层面,Qwen3.8-Flash已率先集成至"千问办公"标准模式,可自动完成95%的日常办公任务,包括文档处理、数据分析、跨系统操作等。开发者和企业可通过千问AI平台调用模型API,享受低至行业1/3的推理成本。技术团队透露,该模型采用的Next架构将成为Qwen4的基础框架,目前已在Hugging Face和魔搭社区开源Qwen3.8-Flash-Next权重,供全球开发者参与验证。截至发布时,Qwen系列模型全球下载量已突破30亿次,衍生模型超30万个,形成覆盖2.4T参数量、全尺寸全模态的开源生态,持续推动中国大模型技术全球化发展。

更多热门内容
英特尔14A制程缺陷密度曲线达22nm后最佳,2027年试产2028年将量产
将 14A 与 22nm 对比,一定程度上也反映出英特尔近年来在先进制程推进上的坎坷:14nm 首发时表现不佳,10nm 则遭遇严重挫折。英特尔预计,14A 和 EMIB-T 等先进技术将从 2027 年底…

2026-08-28

联想拯救者手机打破界限:全境畅连功能向全品牌Windows PC开放
过去,全境畅连首先面向拯救者PC用户开放,也正是在大家长期的使用、反馈与支持下,这项功能不断完善,逐渐成为越来越多非拯救者PC用户希望体验的能力。无论用户使用的是哪个品牌的Windows PC,只需下载LE…

2026-08-28

狼蛛昆仑X5电磁微动鼠标上架:四色可选 性能强劲 支持双8K回报率
作为该产品最核心的技术卖点,昆仑X5采用的自研SSHS电磁微动方案基于电感感应原理,按键触发过程完全没有物理触点接触,这意味着传统鼠标常见的金属触点氧化、双击故障等痛点将从物理层面被根除。 接口与连接模式上…

2026-08-28

2026折叠屏手机选购指南:女性用户如何挑选兼具颜值与实力的掌心好物
很多用户初上手荣耀 Magic V5 时,会被它 8.8mm 的极致纤薄所惊艳,而这份轻薄的底气,恰恰来自京东方为其深度定制的全新轻薄柔性OLED折叠屏解决方案。本次推荐的机型中,以京东方技术体系驱动的荣耀…

2026-08-28