【Spark-X2.5 开源 4B 和 1.7B 模型,原生支持 1M 上下文】 #Spark-X2.5 开源#
SparkLLM 开源了 Spark-X2.5 系列,提供 4B 和 1.7B 两种参数规模。每个规模都有直接推理的发布版、用于继续训练的 Base 版,以及适合本地运行的 GGUF 版。
模型采用全量注意力与滑动窗口注意力混合架构,原生支持最长 1M token 上下文和 200 余种语言。官方称,它使用约 20 万亿 token 数据预训练,又用千亿 token 长上下文数据专项训练,后训练覆盖数学、编程、工具调用和指令遵循。官方基准显示多项成绩达到同尺寸领先水平,但仍要等待更多独立评测。
部署选择比较全:SGLang、vLLM、llama.cpp、MLX、Ollama 和 LM Studio 都有对应说明,并适配英伟达、华为、海光等硬件平台。模型权重和推理模板已经在 ModelScope 上线。
你会更愿意在本地设备上尝试 1.7B,还是把 4B 版本放到服务器?
#端侧大模型# #开源模型#

“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”




