如果你最近正在寻找一款适合本地部署,并且 Agent 与工具调用能力都足够强的开源模型,那么 Meta 最新发布的 Muse-Glimmer-30B,绝对值得关注。它并不是一款单纯用于聊天、写代码的传统大语言模型,而是从设计之初就将: Agent 工作流、工具调用、多步骤任务以及自主执行作为重点能力。

Muse-Glimmer-30B 总参数规模约 30B,并支持最高 128K 上下文,因此它更像是一款专门面向本地 Agent 场景打造的基础模型。
更值得注意的是它在 Agent 类测试中的表现。根据目前公开的测试数据,Muse-Glimmer-30B 在 MCP Atlas 上拿到了 75.5 分,明显高于 Qwen 3.6 27B 的 62.5 分;在 DeepSearch QA 上也取得了 74.6 分。这意味着,如果你的需求并不是简单地让 AI 陪你聊天,而是希望它能够主动调用 MCP 工具、执行代码、操作文件、进行搜索,并把一个复杂任务拆解成多个步骤自主完成,那么 Muse-Glimmer-30B 就非常值得实测。
同时在DFlsh的加速下,本地输出Token速度可以提升2~3倍,零度已经通llama.cpp进行了实测,确实能达到这个提速效果,关键是输出质量并没有受影响!

如果按照 30B 左右参数规模来看,我会暂时把它放在:
Muse-Glimmer-30B
Qwen 3.6 27B
Gemma 4 31B
这三个目前是非常值得拿来直接比较的。
但三者方向不一样:
| 模型 | 最大优势 |
|---|---|
| Muse-Glimmer 30B | |
| Qwen 3.6 27B | |
| Gemma 4 31B |
Meta 自己的定位也非常明确:Muse Glimmer 是专门为了 consumer hardware + autonomous agentic tasks 打造的。而且官方明确支持 OpenClaw、Hermes Agent。
1、Huggingface 下载【点击前往】
2、网盘下载 【点击前往】
3、高速直连下载 【点击前往】

llama.cpp是在本地,以最小的设置和最先进的性能,在各种硬件上实现 LLM(和 VLM)推理。
里面有适合N卡、A卡、I卡、CPU、MacOS 等版本,大家可以根据自己的需要进行下载,值得注意的是,如果的N卡,需要将里面的驱动文件一并下载合并在一期,嫌麻烦可以直接下载 llama.cpp的一键安装包 【点击前往】

只需将一键启动脚本下载解压,然后将里面的3个文件,全部放入llama.cpp的根目录进行启动即可,它可以根据你的硬件自动识别适合你的启动参数和方式,并且可以选择启动的模型、是否开启DFlash加速等!

如果需要将Muse-Glimmer 30 模型,本地执行 Agent 、工具调用、多轮复杂任务运行,那么推荐使用开源的 Hermes Agent,无论是兼容性,还是上下文长度,都可以做到很好的适配!

比如通过一个游戏截图,让它自己调用工具,本地生成游戏,它也能一次性搞定,效果非常可以


本站为个人博客,博客所发布的一切破解软件、补丁、注册机和注册信息及软件的文章仅限用于学习和研究目的;不得将上述内容用于商业或者非法用途,否则,一切后果请用户自负。
本站所有内容均来自网络,版权争议与本站无关,您必须在下载后的 24 个小时之内,从您的电脑中彻底删除上述内容,如有需要,请去软件官网下载正版。
访问和下载本站内容,说明您已同意上述条款。
本站为非盈利性站点,不贩卖软件,不会收取任何费用,所有内容不作为商业行为。