当前位置:首页>排行榜>Bonsai 2 量化模型加入对比评测

Bonsai 2 量化模型加入对比评测

  • 更新时间 2026-09-19 17:44:01

Bonsai 2 量化模型加入对比评测

在 Qwen3.8 量化对比的统一流程里,评测者把最近发布的 Bonsai 2 QAT 模型放了进去。这个动作直接决定了后面那串数字能怎么读。

帖子标题写明,Prism-ML Bonsai 2 加入了 Qwen3.8 量化对比。正文说明,Bonsai 2 基于 Qwen3.8,是 QAT 模型。评测者想看在既有方法下它们的表现,于是用自己的基准套件跑了 Bonsai 2,而不是只转述发布方的说法。

在评测里,模型在吞吐和质量之间取得平衡,composite benchmark 约为 91.5%。评测包含分开的 Instruct 和 Thinking 基准。这里能确认的就是这个数字和两类基准,不能顺势推断更多能力。

帖子还专门做了澄清:这些是评测者的结果,不是 Prism 报告的 benchmark 数字。运行使用 Prism 的 fork/runtime,但 workload、benchmark suite 和 evaluation methodology 与其余比较保持一致。我会先把它当作同一方法下的横向对照,而不是 Prism 官方成绩的替代。原因很直接,数字来源不同,不能混用。

对关注本地模型和量化部署的人,可用的增量是评测口径:同一方法、同一工作负载、分开的 Instruct 与 Thinking,以及明确的结果归属。要在自己的选型表里引用,先确认引用的是哪一套结果,再决定是否把它放进 Qwen3.8 量化对比的位置。

原帖链接:https://www.reddit.com/r/LocalLLaMA/comments/1wju8ky/prismml_bonsai_2_joins_our_qwen38_quantization/

泰国,11分钟前,

随机文章