新Grok编程涨9分,跻身评测前四
新Grok编程涨9分,跻身评测前四
Grok 4.7已经发布,主攻编程和知识工作。独立评测机构Artificial Analysis测得,在高推理强度、配合自家编程框架的条件下,它的编程智能体指数达到56分,比上一代高9分,在使用原生框架的参测模型中排第四。
成绩提升也伴随着较高的输出用量。评测报告记录了这一代模型输出较长的情况,单个词元价格不变,完成任务的总账单也未必不变。官方介绍,新模型换用了更大的基座,经过更长时间的强化学习训练,并加强了长任务中的自我检查。
#AI新闻 #Grok #AI编程 #模型评测