DeepSeekExp模型发布 引入稀疏架构提升推理效率

【太平洋科技快讯】9 月 29 日消息,深度求索公司正式发布 DeepSeek-V3.2-Exp 模型。据官方消息,这是一个实验性(Experimental)版本,旨在通过技术创新提升模型在处理长文本时的效率表现。

据了解,V3.2-Exp 模型在 V3.1-Terminus 的基础上引入了稀疏 DeepSeek Sparse Attention 架构。该架构专门针对长文本的训练和推理效率进行了探索性优化,能够有效降低计算资源消耗并提升模型推理效率。

虽然该模型已在公开评测集上完成有效性验证,但仍需在用户真实使用场景中进行更广泛、大规模的测试。为方便用户进行对比测试,官方为 V3.1-Terminus 临时保留了额外API访问接口,使得研究人员和开发者能够同时访问新旧两个版本,便于在实际应用中比较性能差异。

展开阅读全文

更新时间:2025-09-30

标签:科技   稀疏   架构   模型   效率   文本   版本   消息   官方   实验性   太平洋

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight 2020- All Rights Reserved. Powered By 71396.com 闽ICP备11008920号
闽公网安备35020302034903号

Top