Muse Glimmer – Meta 开源的 300 亿参数大语言模型AI工具2天前发布AI小集12Muse Glimmer是什么Muse Glimmer 是 Meta 开源的 300 亿参数大语言模型,专为全天候本地常驻 Agent 工作流深度优化。模型通过 4bit 量化技术,模型可在 24GB 显存的单卡 GPU 或 Apple Silicon 上流畅运行,且推理性能衰减微乎其微。模型实测在 RTX 5090、M4/M5 Max 平台上可胜任实时对话与智能体交互,结合 DFlash 推测解码技术实现最高 3.1 倍提速,在 MCP Atlas、SWE-Bench Pro 等多项基准中领先同尺寸竞品。Muse Glimmer的主要功能本地 Agent 推理:支持全天候常驻后台运行,专为智能体工作流深度优化,无需联网即可完成复杂任务调度。低显存高效部署:应用 4bit 量化技术,30B 参数模型可在 24GB 显存单卡或 32GB 统一内存的 Mac 上本地运行。实时交互对话:在 M4 Max、M5 Max 及高端 PC 上实现流畅对话与实时 Agent 响应,满足低延迟场景需求。多模态与工具调用:支持 MCP Atlas 等智能体基准测试,具备工具使用、代码生成与多步推理能力。Muse Glimmer的技术原理模型架构与规模:Muse Glimmer 基于 Transformer 架构,总参数量 300 亿,通过针对 Agentic 任务的后训练与指令微调,强化其在工具调用、代码生成与多步推理方面的能力。4bit 量化压缩:采用低比特量化技术将模型体积大幅压缩,使 30B 参数可在 24GB 显存单卡或 32GB 统一内存的 Mac 上本地运行,且经实测对智能体任务性能衰减微乎其微。DFlash 推测解码:集成推测解码机制,利用草稿模型快速生成候选 token 并由主模型并行验证,在 RTX 5090 上实现最高 3.1 倍提速,解码速度达到 233 tok/s。跨平台推理框架:针对 Apple Silicon 通过 ExecuTorch 适配,针对 NVIDIA GPU 通过 llama.cpp 适配,确保模型在不同硬件平台上均能获得一致且高效的本地推理体验。微信关注回复“开源”,加入AI开源项目交流群如何使用Muse Glimmer环境准备:确保本地设备拥有 24GB 以上显存的 NVIDIA GPU,或 32GB 统一内存的 Apple Silicon Mac(M4/M5 Max 为佳)。下载权重:访问 Hugging Face 仓库meta-models/Muse-Glimmer-30B,下载 4bit 量化版模型文件与配置文件。框架选择:NVIDIA 用户通过 llama.cpp 加载模型;Apple Silicon 用户通过 ExecuTorch 运行以获得最佳性能。启动推理:用兼容的本地推理 UI加载模型,开启 DFlash 推测解码获取最高推理速度。接入 Agent 工作流:通过 MCP 协议或本地 API 将模型接入个人知识库、代码仓库与工具链,实现常驻后台的自动化任务处理。Muse Glimmer的核心优势极致本地性能:4bit 量化后性能衰减微乎其微,在 SWE-Bench Pro、DeepSearch QA 等任务中大幅领先 Gemma4-31B 与 Qwen3.6-27B。硬件门槛亲民:打破大模型本地部署的显存壁垒,24GB 显存可运行 30B 参数模型,降低个人开发者与中小企业的使用成本。推理速度飞跃:集成 DFlash 推测解码,在 RTX 5090 上解码速度从 74.9 tok/s 提升至 233 tok/s,实现 3.1 倍加速。安全与可控:100% 本地计算,数据不出设备,在 Siren AgentDojo 安全测试中攻击成功率低于竞品,兼顾性能与隐私。Muse Glimmer的项目地址HuggingFace模型库:https://huggingface.co/meta-models/Muse-Glimmer-30BMuse Glimmer的同类竞品对比对比维度Muse Glimmer-30BQwen3.6-27B参数规模30B27B开源协议Apache 2.0Apache 2.0量化支持官方 4bit,24GB 显存可运行需第三方量化方案MCP Atlas75.562.5SWE-Bench Pro51.250.2SWE-Bench Verified76.077.2DeepSearch QA74.671.1OSWorld-Verified65.975.6AIME 202694.794.1安全攻击成功率28.4%(更低更安全)40.3%本地 Agent 优化专为常驻 Agent 工作流设计通用对话与推理模型Muse Glimmer的应用场景本地 AI 助手:作为常驻后台的个人智能体,处理日程管理、邮件起草、代码审查等日常任务,无需依赖云端 API。隐私敏感行业:适用于医疗、金融、法律等对数据合规要求极高的领域,确保核心数据 100% 留在本地设备。开发者工具链:集成至 IDE 或终端,提供离线代码补全、自动化测试生成与仓库级代码理解,支持 SWE-Bench 级别的软件工程任务。边缘设备部署:在配备 24GB+ 显存的工作站或高性能 Mac 上运行,为中小团队提供低成本的企业级 AI 能力。# AI工具# AI项目和框架©版权声明本站文章版权归AI工具集所有,未经允许禁止任何形式的转载。上一篇GPT-5.6-Cyber - OpenAI 推出的 AI 网络安全模型下一篇小鹅桌面 - 腾讯推出的 Windows 端桌面美化工具相关文章MMRole – AI多模态角色扮演智能体(MRPA)框架AI小集2BizGen – 清华大学联合微软推出的AI信息图生成工具AI小集2Qwen2.5-Math – 阿里Qwen团队开源的数学专项模型,超越GPT-4oAI小集3Bytespider – 字节跳动推出的AI模型数据网络爬虫工具AI小集5Forum – Meta 推出的独立社区 AI 应用AI小集3Speechelo – AI文本转语音工具,支持多语言转换、调整语速、音调、情感表达AI小集21 条评论再想想发表评论xxx游客嗯,所以我还是选择qwen3.6 27b,毕竟它不需要那么高显存。2天前回复热门工具Loomy即梦AISekoAiPPT秘塔AI搜索妙呀堆友Agent美图设计室绘蛙AIupdream办公小浣熊秒哒最新收录知漫剧QwenPawRenoiseLawbot脱敏猫ClineJoyAI最新文章EvoX – EvoMap 推出的自进化 AI Agent,首创蜂群模式28分钟前LTX-2.5 – Lightricks 开源的 AI 视频生成基础模型30分钟前Today AI – 个人级 AI Agent 操作系统,能接入各类云服务32分钟前秒悟Meoo – 1分钟生成前后端完整的网站,真0门槛开发!14小时前Nemotron 3.5 Lightning – 英伟达开源的 MoE 模型14小时前DeepSeek Harness – DeepSeek 推出的 AI 智能体运行框架14小时前IndexTTS-2.5 – Bilibili 开源的工业级零样本语音克隆模型21小时前Palmier Pro – 开源 AI 视频编辑器,在剪辑中生成视频、图像21小时前Shotcut – 开源的视频编辑软件,支持多轨剪辑24小时前PAST-Bench – 普林斯顿推出的个人 Agent 的性能归因基准1天前HOMIE – 香港科技大学开源的数字人视频生成框架1天前Karpo – AI 生活助手,主动监测用户日程与兴趣2天前yesand – AI 创意社交平台,灵感到创作产品完整闭环2天前小鹅桌面 – 腾讯推出的 Windows 端桌面美化工具2天前GPT-5.6-Cyber – OpenAI 推出的 AI 网络安全模型2天前