快科技 9 月 23 日消息,近日开发者 Cactus Compute 发布了一款名为 Needle 2 的轻量级 AI 模型。
该模型体积仅为 14MB,专门针对树莓派 5(Raspberry Pi 5)的处理器环境进行了深度优化,能够在无需 AI 加速扩展板的情况下,将自然语言指令实时转换为预设的函数调用。

树莓派官方博客介绍,Needle 2 并非传统的通用聊天机器人,而是专注于设备端指令执行的专用模型,当用户输入点亮 LED 灯时,系统仅需 78 毫秒即可完成从识别到执行的全过程,几乎做到了即时响应。
在性能与资源占用方面,Needle 2 也展示了极致的效率。在树莓派 5(8GB 内存版)的实测中,该模型运行时的内存占用仅约为 28MB,即便运行完整的 Python 演示程序,总内存消耗也仅为 46.4MB。
这种轻量化设计使得模型能够完全脱离云端 API 和网络环境,在边缘侧实现纯本地的智能化控制。

硬件特色与接口调用上,Needle 2 通过 Python 标注系统与底层硬件深度绑定。开发者只需在现有的函数代码上添加特定目印,模型即可自动抓取函数名称、描述及参数类型,并构建调用规范。
例如查询处理器温度的指令响应时间为 149 毫秒,系统会准确返回摄氏度数值,整个过程完全在本地处理器内完成。
但需要注意的是,该模型在逻辑判断上表现得相当克制,对于无法匹配到预设函数的无关提问(如 " 法国首都是哪里 "),Needle 2 会在 92 毫秒内返回空值,而非强行作答。
目前 Needle 2 的模型权重已在 Hugging Face 平台发布,相关代码也遵循 Apache 2.0 协议在 GitHub 开源。


登录后才可以发布评论哦
打开小程序可以发布评论哦