DC娱乐网

一张显卡跑,Meta开源又搅局 Meta昨天又放大招了。8月10日发布Muse Glimmer开源模型,29.6B参数,4-bit量化后只需17到20GB显存,一张RTX 4090或RTX 5090就能跑,数据完全本地化,不用上云。 更扎心的是评测成绩。Artificial Analysis Intelligence Index给了35分,直接超越Anthropic的Claude Haiku 4.5 ​

一张显卡跑,Meta开源又搅局Meta昨天又放大招了。8月10日发布Muse Glimmer开源模型,29.6B参数,4-bit量化后只需17到20GB显存,一张RTX 4090或RTX 5090就能跑,数据完全本地化,不用上云。更扎心的是评测成绩。Artificial Analysis Intelligence Index给了35分,直接超越Anthropic的Claude Haiku 4.5。在MCP Atlas工具调用基准测试里,Muse Glimmer拿到75.5分,把Gemma4-31B和Qwen3.6-27B甩在身后。这说明开源模型在Agent任务维度已经追平部分闭源产品。 推理速度也不是摆设。RTX 5090上通过DFlash技术,生成速度从每秒74.9个token飙到233.4个,直接3.1倍加速。 问题来了:本地跑大模型成本这么低了,云端AI服务的生意还好做吗?Meta开源模型 MuseGlimmer本地AI部署消费级GPU开源vs闭源