Meta Muse Glimmer:30B多模态开源

Meta发布开源模型Muse Glimmer——300亿参数稠密多模态模型,Apache 2.0许可,支持文本、视觉、多步推理和工具调用,4-bit量化后体积可压缩至20GB以下,可在24GB或32GB显存的消费级设备运行。这是自Llama 4以来Meta再次开放模型权重,面向本地常驻智能体。

Cactus Compute Needle 2:14MB跑树莓派

Cactus Compute发布Needle 2——4500万参数、14MB的Apache-2.0智能体模型,基于2-bit训练感知量化与Walsh–Hadamard"Simple Attention Network",在树莓派5上28MB内存即可跑500 tok/s,Meta Quest 3S上400-1500 tok/s。端侧Agent进入"亚百MB"时代。

一道科技解读:消费级设备成AI载体

30B可跑笔记本、14MB可跑树莓派,端侧AI的"设备半径"急剧扩大。一道科技看重这类模型在工厂边缘设备、门店终端上的数据私密价值。