刚刷到一份大模型编程能力榜(Ai coding),数据是今天抓的。榜单只列了前三十名,分数差得挺明显。
OpenAI 的 GPT-6 Astra 以 48.5 分拿下第一。紧随其后的是自家 GPT-5.6 Sol,以及 Claude Fable 5。前三名全被美国包揽。
国产模型里,DeepSeek-V4.1-Flash 拔得头筹, 排第五。Kimi K3 和智谱的 GLM-5.3 也进了前十。阿里、腾讯各有两款上榜。DeepSeek 更是有三款挤进前三十。
不过这榜单看看就好。它综合了好几个测试基准,各家测试口径都不一样。真要挑个写代码的帮手,还得看具体任务。