跳到正文
原文
Hugging Face Blog·· 2026-08-25AI 评分59

QAH 将 GPT-OSS 120B 压缩为 60B 4-bit 模型,并在 9 项基准中 7 项超过 BF16 版本

Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision original

AI 导读

Multiverse Computing 提出 Quantization-Aware Healing(QAH),将 GPT-OSS 120B 压缩为 60B 参数并量化至 MXFP4,在 9 项基准中的 7 项超过同架构 BF16 检查点。

来源:Hugging Face Blog · huggingface.co