科技日报记者 崔爽
9月30日,依托国产深算智能加速卡及全国一体化算力网,DeepSeek-V3.2-Exp正式上线国家超算互联网AI社区,企业和开发者均可在社区免费下载DeepSeek-V3.2-Exp模型文件进行快速开发。
9月29日,DeepSeek正式发布DeepSeek-V3.2-Exp模型,这是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步骤,V3.2-Exp在V3.1-Terminus的基础上引入了DeepSeekSparseAttention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。
DeepSeekSparseAttention(DSA)首次实现了细粒度稀疏注意力机制,在几乎不影响模型输出效果的前提下,实现长文本训练和推理效率的大幅提升。
据了解,目前超算互联网AI社区已汇聚700余款国内外优质开源模型,包括DeepSeek-V3.1-Terminus、DeepSeek-R1-0528、DeepSeek-R1、DeepSeek-V3等DeepSeek系列,用户可登录超算互联网AI社区,实现集API(应用程序接口)调用、Chatbot(聊天机器人)在线推理对话、国产大模型分布式训练、微调等功能于一体的MaaS(模型即服务)服务。