文件列表:
东吴证券:消费电子行业点评报告:端侧AI周跟踪:Agent模型加速落地,端云协同提升端侧AI价值.pdf |
下载文档 |
资源简介
>
投资要点
Meta发布MuseGlimmer,30B级Agent模型可实现消费级单卡本地部署。8月10日,Meta发布约300亿参数的开源权重多模态模型MuseGlimmer,定位于可长期运行在个人设备上的本地Agent,官方表示模型可在单张消费级GPU上运行。Glimmer采用Dense结构,支持文本、图片输入及文本输出,覆盖100余种语言。机器学习研究者SebastianRaschka指出,GlimmerBF16模式下KVCache仅约52KiB/token,低于Qwen3.627B的64KiB/token,并远低于Gemma431B约840KiB/token;其认为Glimmer最突出的特点在于较低内存占用、较快Prefill/Decode速度与较完整Agent能力的组合。
NVIDIA发布Nemotron3.5Lightning,进一步明确“强模型规划、小模型执行”的Agent分层架构。8月11日,NVIDIA推出Nemotron3.5Lightning30B-A3B,底层采用Mamba-2、MoE与Attention混合架构,支持最长1M上下文,可运行于GeForceRTX5
加载中...
已阅读到文档的结尾了



