6月18日新闻
GLM-5.2逼近闭源编码领先者
智谱AI发布了 GLM-5.2,并将其定位为面向长程任务的模型,适合持续数小时、涉及数千个步骤的工作。为支持这类场景,公司把上下文窗口扩展到 100 万 token,并重点用智能体式编码工作负载进行训练。智谱强调,真正困难的不是宣布一个很大的上下文窗口,而是在长时间、非结构化的编码会话中保持稳定可靠的表现。在 FrontierSWE 基准上,GLM-5.2 得分为 74.4%,仅比 Anthropic 的 Claude Opus 4.8 低 1 个百分点,同时略高于 OpenAI 的 GPT-5.5。在 PostTrainBench 上,它击败了 GPT-5.5 和 Opus 4.7,但仍落后于 Opus 4.8。到了难度更高的 SWE-Marathon,GLM-5.2 的表现就明显落后了,只拿到 Opus 4.8 大约一半的分数。
阅读更多