仅14MB!树莓派5纯CPU也能跑AI:离线指令毫秒级响应
快科技9月23日消息,近日开发者Cactus Compute发布了一款名为Needle 2的轻量级AI模型。
该模型体积仅为14MB,专门针对树莓派5(Raspberry Pi 5)的处理器环境进行了深度优化,能够在无需AI加速扩展板的情况下,将自然语言指令实时转换为预设的函数调用。

树莓派官方博客介绍,Needle 2并非传统的通用聊天机器人,而是专注于设备端指令执行的专用模型,当用户输入点亮LED灯时,系统仅需78毫秒即可完成从识别到执行的全过程,几乎做到了即时响应。
在性能与资源占用方面,Needle 2也展示了极致的效率。在树莓派5(8GB内存版)的实测中,该模型运行时的内存占用仅约为28MB,即便运行完整的Python演示程序,总内存消耗也仅为46.4MB。
这种轻量化设计使得模型能够完全脱离云端API和网络环境,在边缘侧实现纯本地的智能化控制。

硬件特色与接口调用上,Needle 2通过Python标注系统与底层硬件深度绑定。开发者只需在现有的函数代码上添加特定目印,模型即可自动抓取函数名称、描述及参数类型,并构建调用规范。
例如查询处理器温度的指令响应时间为149毫秒,系统会准确返回摄氏度数值,整个过程完全在本地处理器内完成。
但需要注意的是,该模型在逻辑判断上表现得相当克制,对于无法匹配到预设函数的无关提问(如“法国首都是哪里”),Needle 2会在92毫秒内返回空值,而非强行作答。
目前Needle 2的模型权重已在Hugging Face平台发布,相关代码也遵循Apache 2.0协议在GitHub开源。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”




