GLM-5.2-colibri-int4:可在消费级设备上运行 GLM-5.2(744B MoE)大模型,支持流式专家加载。提供预转换的 int4 权重容器,无需下载原始 FP8 模型,仅需 colibrì 引擎即可部署,具备原生推测解码能力。【此简介由AI生成】 - AtomGit AI社区