【Spark-X2.5 开源 4B 和 1.7B 模型,原生支持 1

【Spark-X2.5 开源 4B 和 1.7B 模型,原生支持 1M 上下文】 #Spark-X2.5 开源#

SparkLLM 开源了 Spark-X2.5 系列,提供 4B 和 1.7B 两种参数规模。每个规模都有直接推理的发布版、用于继续训练的 Base 版,以及适合本地运行的 GGUF 版。

模型采用全量注意力与滑动窗口注意力混合架构,原生支持最长 1M token 上下文和 200 余种语言。官方称,它使用约 20 万亿 token 数据预训练,又用千亿 token 长上下文数据专项训练,后训练覆盖数学、编程、工具调用和指令遵循。官方基准显示多项成绩达到同尺寸领先水平,但仍要等待更多独立评测。

部署选择比较全:SGLang、vLLM、llama.cpp、MLX、Ollama 和 LM Studio 都有对应说明,并适配英伟达、华为、海光等硬件平台。模型权重和推理模板已经在 ModelScope 上线。

你会更愿意在本地设备上尝试 1.7B,还是把 4B 版本放到服务器?

#端侧大模型# #开源模型#

【Spark-X2.5 开源 4B 和 1.7B 模型,原生支持 1