ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

DeepSeek开源V3.2-Exp实验版模型 架构创新或成国产AI发展新动力

时间:2025-09-30 15:22:42来源:快讯编辑:快讯

DeepSeek近日宣布开源其最新实验模型DeepSeek-V3.2-Exp,首次引入DeepSeek Sparse Attention(DSA)稀疏注意力机制,在保持模型输出质量的同时显著提升长文本处理效率。这一技术突破被定义为"迈向新一代架构的关键中间步骤",标志着大模型优化方向的重要转变。

据技术报告披露,DSA机制通过"闪电索引器"和动态token选择技术,将传统注意力计算的复杂度从二次方降至近似线性。在H800 GPU实测中,该模型使长序列推理成本降低40%以上,同时保持与前代模型相当的任务完成质量。这种效率提升直接反映在API定价策略上——输出100万token的费用降至3元,仅为V3.1系列的四分之一。

产业界的响应速度超出预期。华为云在模型发布后6小时内完成部署,采用CloudMatrix 384超节点提供服务;寒武纪通过Triton算子开发实现4分钟极速适配,开源vLLM-MLU推理引擎;海光信息宣布其DCU处理器完成Day 0级优化,确保算力"零等待"部署。截至发稿时,已有华为、寒武纪、海光等12家芯片厂商完成适配,覆盖从云端到边缘的多元计算场景。

开发者社区的实测反馈呈现两极分化。在编程任务测试中,V3.2-Exp生成的代码量较前代减少35%,但某动画生成案例出现逻辑错误,显示模型在复杂场景下的稳定性仍需优化。信息检索任务测试表明,新模型响应速度提升28%,但推荐结果的精准度下降12%,特别是在需要多条件约束的场景中表现明显。

技术团队在GitHub披露的细节显示,该模型采用"继续预训练+混合强化学习"的双阶段优化策略。预训练阶段通过稠密模式初始化索引器参数,再逐步引入稀疏选择机制;后训练阶段结合领域专家蒸馏和统一强化学习框架,在保持模型通用性的同时强化特定领域能力。这种训练范式使模型在数学推理、代码生成等任务上的表现与前代持平,但工作记忆容量指标下降15%。

开源社区的热烈讨论揭示出技术演进的新方向。HuggingFace平台数据显示,模型发布首日即获得超过2.3万次下载,社区贡献者已提交47个优化补丁。值得注意的是,某开发者通过修改索引器阈值参数,成功将推理延迟再降低18%,这为后续技术迭代提供了重要参考。

当前,DeepSeek-V3.2-Exp已在App、网页端及小程序全面上线,同时保留V3.1-Terminus的API接口供对比测试。技术团队强调,作为实验性版本,该模型需要在真实业务场景中接受更严苛的考验,特别是在高并发、长序列处理等极端条件下验证其稳定性。随着更多企业和研究机构参与协同优化,这项突破性技术有望在年内实现产业化落地。

更多热门内容
苹果iOS 26.1系统将迎Siri功能升级 国行Apple Intelligence或年底前上线
按照苹果此前的说法,新版本的Siri将在2026年才会推出,而据MarkGurman披露的消息称,部分Siri优化功能已在开发中,最早会随着iOS 26.1版本更新后上线。 苹果Apple Intellig…

2025-09-30

DeepSeek-V3.2-Exp模型开源上线 稀疏架构助力效率提升API降价超五成
【环球网科技综合报道】9月29日,据DeepSeek官方消息,DeepSeek-V3.2-Exp大语言模型正式发布并开源。该模型通过引入创新的稀疏Attention架构,在降低计算资源消耗的同时显著提升推理效…

2025-09-30

余承东履新华为IRB主任:聚焦AI战略,引领资源向核心目标倾斜
9月29日,据网易科技今日报道,华为公司今天任命余承东正式增任公司产品投资评审委员会(IRB)主任,该任命由任正非签发。此次履新后,余承东将同时执掌常务董事、终端BG董事长与IRB主任三大职务。目前余承东的微…

2025-09-30

OPPO Find X9系列10月16日登场:哈苏影像加持,性能续航全面进阶
2025年9月30日,OPPO官微发布消息称,OPPO Find X9系列暨智能生态旗舰新品发布会将于10月16日19:00举办,其中OPPOFind X9系列影像旗舰,定位OPPO哈苏画质王,致力于成为新…

2025-09-30

华为三款新机入网:Mate 80系列或配100W快充与麒麟9系芯片,nova 15影像升级
CNMO猜测,华为nova 15将在影像方面得到较大提升,而Mate 80系列将搭载最新款麒麟芯片。性能方面,Pro及以上版本搭载麒麟9030处理器,全系或配备支持100W有线充以及80W无线充的6000mA…

2025-09-30

​DeepSeek发布实验性大模型V3.2-Exp,引入DSA机制,API成本降超50%​
作为其下一代架构探索的关键中间步骤,新模型的核心亮点在于引入了自主研发的 DeepSeek Sparse Attention (DSA)稀疏注意力机制,旨在大幅优化长文本处理的训练和推理效率。 DeepSe…

2025-09-30

华为eSIM超薄新机测试中,三重技术突破或超越iPhone Air成高端新宠
月 30 日消息,据数码博主@智慧皮卡丘爆料,华为正在测试一款主打超薄设计的 eSIM 手机,全面对标苹果最新发布的 iPhone Air。 虽说是全面对标苹果,但也并非是简单复刻人家的“轻薄”理念,而是通过…

2025-09-30

国产手机对标苹果新动作,华为“Air”机型测试中,最高或配2TB大存储
苹果在9月份发布了主打超薄的iPhone Air,为了做到5.64mm的极致厚度,不仅只用了后置单设,而且连国行版也采用了eSIM技术。在采用eSIM技术后,省下来的这部分空间,预计能让电池容量增加500m…

2025-09-30

官宣来袭!一加15携骁龙8 Elite Gen5芯片,设计影像续航全面升级
一加 15 预计将搭载「天工散热系统 Pro」,VC 均热板面积或将刷新品牌纪录,并辅以多层精密石墨烯和先进导热材料。而最让人兴奋的莫过于潜望式长焦镜头的规格提升,一加 15 很可能配备更高倍率的光学变焦…

2025-09-30

华为畅享70X:千元价位新标杆,以实用主义重塑5G手机价值体验
华为畅享70X却选择了一条不同的路:它搭载的麒麟8000A处理器,性能确实并非其最大卖点,但结合华为自研的5G调制解调器与鸿蒙系统的深度优化,其在日常社交、网页浏览、视频播放等典型应用场景中表现足够流畅稳定。…

2025-09-30