利好

美商务部测Kimi K3称美领先,但测试非对等

2026-07-24 19:38:06

Kimi K3漏洞利用得分32%,低于美模型76%。因测试范围受限,结果误差较大,参考价值存疑。

据 Woofun AI 消息,美国商务部旗下 AI 标准与创新中心联合英国 AI 安全研究所对 Kimi K3 的网络攻击能力进行评估,并重申美国在该领域保持领先优势。评估显示,Kimi K3 在漏洞利用基准测试中得分约 32%,高于 GLM-5.2 的 24%,但显著低于美国领先模型约 76% 的平均水平。在模拟攻击链测试中,Kimi K3 平均完成 17 步(共 32 步),10 次尝试中成功攻破网络 1 次,而美国前沿模型平均完成 28.5 步。

报告指出,Kimi K3 已具备一定自主攻击能力,其安全护栏未能阻止模型开发漏洞或执行攻击。然而,由于托管环境限制,Kimi K3 仅参与部分测试,整体能力估算主要基于 41 项基准,与其他接受全面测试的模型相比,其结果存在更大误差范围,测试并非完全对等。

WOOFUN AI

影响力评估 · 一键速读

该测评虽强调美国领先,但明确指出 Kimi K3 的测试条件受限,导致数据可比性下降。Kimi K3 在漏洞利用上表现优于其他非美模型,显示中国大模型在网络攻击潜力上的快速进步。测试非对等性意味着当前差距可能被高估,后续需关注更公平环境下的横向对比结果。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅