GPTProto

Kimi K3 trails frontier US models by a wide margin on cyber exploits, and distillation may explain why

The Decoder:AI News(RSS)·Jul 24, 2026, 5:48 PM·Kimi / Moonshot AI

英国AI安全研究所与美国AI标准与创新中心联合评估显示,月之暗面的Kimi K3在ExploitBench基准上得分32.2%,远低于美国领先模型的76.2%,但优于智谱GLM-5.2的24.4%。