数据世界
产业资讯 宏观经济 企业动态 人物动态 科技数码 数据洞察 AI前沿 行业峰会 热点资讯

阿里发布Qwen3.8-Flash模型:开源新架构雏形,成本大降性能跃升

2026-08-27来源:快讯编辑:瑞雪

阿里近日正式推出并开源了新一代大语言模型Qwen3.8-Flash,这款采用多模态混合专家(MoE)架构的模型凭借其创新技术,在模型效率与成本控制方面树立了全球新标杆。该模型通过激活1250亿参数中的60亿(6B),实现了超越Claude Opus4.6的性能表现,同时在训练成本上较前代Qwen3.7-Plus降低近90%,推理成本更是低至每百万Tokens输入1元、输出3元,成为当前性价比最优的模型之一。

Qwen3.8-Flash的核心优势源于其架构革新。模型引入了自研的QSA(Qwen Sparse Attention)注意力机制,与GDN高效融合后形成混合注意力架构,使长上下文处理速度提升8倍以上;通过Gated Residual方法将信息主通道扩展为4条,实现动态信息读写,训练稳定性显著提高;51B规模的N-gram Embedding参数则作为“外挂记忆手册”,在不增加计算负担的前提下提升参数扩展效率。这些技术突破使模型在通用能力、数学推理、编程任务等基础评测中,超越了参数规模3倍于己的Qwen3.7-Plus。

在专业场景测试中,Qwen3.8-Flash展现出全面领先性。智能体编程评测SWE-bench Pro中,其得分较Opus4.6高出9.1分;长程任务CoWorkBench与工具调用Toolathlon Verified评测均超越DeepSeek-V4-Flash;办公任务JobBench评测中更以近20分的优势领先Opus4.6。多模态能力方面,模型在移动端操作AndroidWorld、视觉数学推理MathVision、具身智能ERQA等任务中,分别取得22.5分、25.1分和31.5分的显著优势,整体多模态表现远超同类模型。

成本优化是Qwen3.8-Flash的另一大亮点。该模型仅用前代九分之一的资源完成训练,推理成本仅为Claude Opus4.6的3%,闲时价格是DeepSeek-V4-Flash的2/3、忙时价格的1/3。目前,千问办公“标准模式”已内置该模型,可完成95%的日常办公任务,开发者与企业可通过千问AI平台获取API服务。阿里同步开源了Qwen3.8-Flash-Next模型权重,在Hugging Face与魔搭社区全面开放,为全球开发者参与Qwen4模型研发提供基础。

随着Qwen3.8系列发布,阿里已开源2.4T参数量的Qwen3.8-Max、27B及Flash三大尺寸模型。截至目前,Qwen系列全球下载量突破30亿次,衍生模型超30万个,其全尺寸、全模态的开源策略正推动中国AI模型在全球范围内形成技术影响力。

乌龟海岸Vulcan II XP键盘发布:全尺寸悬浮设计,机械轴热插拔兼容多键帽
IT之家 8 月 26 日消息,Turtle Beach(乌龟海岸)当地时间今日宣布推出 Vulcan II XP键盘。这一型号采用全尺寸设计(右上为媒体控制区),配备 TITAN HS 机械触点式开关,集…

2026-08-27

小米澎湃OS 4融合设备中心升级:卡片布局更便捷,支持家庭一键切换
IT之家 8 月 26 日消息,小米官方今日放出了澎湃 OS 4 系统的全新融合设备中心。 据介绍,在小米澎湃 OS 4 系统上,融合设备中心焕新,人车家全生态管理优化:采用全新卡片布局,设备再多也能快速找到…

2026-08-26

华为发布会官宣定档!多款新品齐亮相,阔直屏与三折叠屏手机引期待
同时,华为Pura X View首发搭载HarmonyOS 7,带来全新沉浸式空间美学体验,天生流畅,久用更丝滑。就现有消息来看,全新的HarmonyOS 7将带来更沉浸、更智能、更流畅、更安全、更便捷的…

2026-08-26

新款Mac mini发布在即,或成库克卸任前硬件绝唱,AI与制造新变局引关注
预计苹果发布新品时,会着重强调这款产品的美国本土制造属性,落地苹果制造业回流的规划。AI算力需求推高产品热度,但存储短缺又持续制约产能,涨价、缺货已经成为现款机型的标签。对于用户而言,新品能否解决供货紧张、优…

2026-08-26