查看: 6|回复: 0

“大模型一定要大内存”这条规则,正在被重新挑战。

[复制链接]

15

主题

0

回帖

55

积分

注册会员

积分
55
发表于 2 小时前 | 显示全部楼层 |阅读模式
“大模型一定要大内存”这条规则,正在被重新挑战。

Colibrì 做了一件很有意思的事:让拥有 7440 亿参数的 GLM-5.2 MoE 模型,在约 25GB 内存的普通设备上运行。

它没有把整个模型塞进内存,而是利用 MoE 模型“按需激活”的特点:

核心部分常驻内存
大量专家参数放在硬盘中
使用时按需加载和缓存

这样一来,原本需要大型 GPU 集群才能玩的模型,也有机会在个人设备上启动。

当然,代价也很明显:速度会受到硬盘读写影响,最低配置下更适合体验和研究,而不是日常高频使用。

但它最大的意义在于——本地运行超大模型的门槛,正在被一点点降低。
🔗:https://github.com/JustVugg/colibri



本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注公众号

相关侵权、举报、投诉及建议等,请发 E-mail:2776601884@qq.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|青ICP备2025004122号-1

在本版发帖
关注公众号
返回顶部