腾讯混元团队宣布,已将其开源的295B参数大模型Hy3权重量化至1bit与4bit,并打包为GGUF格式,配合llama.cpp生态运行。此前该模型只能部署在多卡集群上,量化后最低仅需一张推理显卡、乃至内存充足的本地机器即可运行,大幅降低了开源社区的使用门槛。