星知

logo
logo
登录

Kimi K3 攻防考卷翻车:漏洞利用只到美国前沿模型四成,蒸馏疑云被安全机构摆上台

英美安全机构评测揭示月之暗面Kimi K3网络安全能力大幅落后美国前沿模型,漏洞利用得分仅为其四成,同时侧面印证了Kimi K3可能通过蒸馏Anthropic模型输出进行训练的指控。
发布时间:2026/07/25 03:20|分类:人工智能
英美AI安全机构(UK AISI与CAISI)联合评测月之暗面最新模型Kimi K3。在卡内基梅隆大学ExploitBench基准测试中,美国领先模型平均得分76.2%,Kimi K3仅32.2%,智谱GLM-5.2为24.4%。41项任务中,Kimi K3未能实现任意代码执行,而美国模型攻下20项。在模拟企业网络攻击的TLO测试中,Kimi K3平均走到第17步即卡住,美国领先模型推进至第28.5步。评测结果引发蒸馏指控:美国机构称月之暗面可能将Anthropic的Claude模型输出作为训练数据,但因Anthropic安全分类器会掐掉高级攻击性查询,导致Kimi K3在网络安全能力上存在明显短板,虽能在通用基准上叫板西方对手,却未学到深层漏洞利用本领。
人工智能星知