0
26B模型只占约2GB内存:端侧AI开始把SSD当成模型仓库
开源项目 TurboFieldfare 通过把混合专家模型的大部分权重存放在 SSD 中,仅在需要时加载对应专家,让 Gemma 4 26B-A4B 在约 2GB 内存占用下运行。这展示了端侧模型部署的一条新路线。
开源项目 TurboFieldfare 通过把混合专家模型的大部分权重存放在 SSD 中,仅在需要时加载对应专家,让 Gemma 4 26B-A4B 在约 2GB 内存占用下运行。这展示了端侧模型部署的一条新路线。