数据世界
产业资讯 宏观经济 企业动态 人物动态 科技数码 数据洞察 AI前沿 行业峰会 热点资讯

阿里千问Qwen3.8-Flash发布开源:新架构引领,成本骤降性能飙升

2026-08-28来源:快讯编辑:瑞雪

阿里旗下千问团队近日推出全新大模型Qwen3.8-Flash,并同步开源模型权重。该模型采用多模态混合专家(MoE)架构,通过激活1250亿参数中的60亿(6B)实现性能突破,在多项基准测试中超越Claude Opus4.6,部分场景表现接近Opus4.8。相较于前代Qwen3.7-Plus,新模型训练成本降低90%,推理成本降至每百万Tokens输入1元、输出3元,价格仅为DeepSeek-V4-Flash忙时价格的1/3,重新定义了全球大模型的性价比标准。

技术架构层面,Qwen3.8-Flash引入四大创新机制:在注意力计算上,通过QSA(Qwen Sparse Attention)与GDN融合的混合架构,使1M Tokens长上下文处理速度提升8倍;信息传递方面,自研Gated Residual方法将传统Transformer的单通道拆分为四条动态路径,显著提升训练稳定性;参数扩展通过51B规模的N-gram Embedding实现"外挂式记忆指南",避免计算资源浪费;模型优化则采用结构与训练协同设计,使收敛效率提升3倍。这些革新使未经过微调的基座模型在通用能力、数学推理和编程任务上即超越3倍体量的Qwen3.7-Plus。

在专业场景评测中,Qwen3.8-Flash展现显著优势:智能体编程任务SWE-bench Pro得分领先Opus4.6达9.1分,长程协作任务CoWorkBench和工具调用任务Toolathlon Verified均超越DeepSeek-V4-Flash,办公任务JobBench评测超出Opus4.6近20分。多模态能力方面,移动端操作AndroidWorld评测领先22.5分,视觉数学推理MathVision超出25.1分,具身智能ERQA任务领先31.5分。这些性能突破得益于模型架构与训练方案的协同优化,特别是混合注意力机制和动态信息通道设计,使复杂任务处理效率大幅提升。

应用落地层面,Qwen3.8-Flash已率先集成至"千问办公"标准模式,可自动完成95%的日常办公任务,包括文档处理、数据分析、跨系统操作等。开发者和企业可通过千问AI平台调用模型API,享受低至行业1/3的推理成本。技术团队透露,该模型采用的Next架构将成为Qwen4的基础框架,目前已在Hugging Face和魔搭社区开源Qwen3.8-Flash-Next权重,供全球开发者参与验证。截至发布时,Qwen系列模型全球下载量已突破30亿次,衍生模型超30万个,形成覆盖2.4T参数量、全尺寸全模态的开源生态,持续推动中国大模型技术全球化发展。

从商用展示到赛场竞技,“爱湫”助力成都高新区具身智能产业腾飞
从世界机器人大会面向客商展示商用产品、做服务接待,到人形机器人运动会的高强度实战检验,“爱湫”的连续亮相,是成都高新区具身智能产业发展的一个缩影。 作为国家新一代人工智能创新发展试验区、国家人工智能创新应用…

2026-08-27

小米智能存储京东首发!预装西数红盘,安全便捷还享3年整机质保
即日起,用户在京东APP搜索“小米智能存储”即可直达新品选购页面,抢先体验这款集存储、互联、安全于一体的家庭数据中枢,并享受31天迅雷会员、3年整机质保及评价抽2000京豆等首发权益,开启便捷、安全的智能存…

2026-08-27

阿里发布Qwen3.8-Flash模型:开源新架构雏形,成本大降性能跃升
模型采用了与此前千问大模型不同的全新架构:在注意力方面,引入独特的QSA(Qwen SparseAttention)机制,形成与GDN高效融合的混合注意力架构,可显著降低计算开销,在高缓存命中的1M Tok…

2026-08-27

乌龟海岸Vulcan II XP键盘发布:全尺寸悬浮设计,机械轴热插拔兼容多键帽
IT之家 8 月 26 日消息,Turtle Beach(乌龟海岸)当地时间今日宣布推出 Vulcan II XP键盘。这一型号采用全尺寸设计(右上为媒体控制区),配备 TITAN HS 机械触点式开关,集…

2026-08-27