利好
美商務部測Kimi K3稱美領先,但測試非對等
2026-07-24 19:38:06
Kimi K3漏洞利用得分32%,低於美模型76%。因測試範圍受限,結果誤差較大,參考價值存疑。
據 Woofun AI 消息,美國商務部旗下 AI 標準與創新中心聯合英國 AI 安全研究所對 Kimi K3 的網絡攻擊能力進行評估,並重申美國在該領域保持領先優勢。評估顯示,Kimi K3 在漏洞利用基準測試中得分約 32%,高於 GLM-5.2 的 24%,但顯著低於美國領先模型約 76% 的平均水平。在模擬攻擊鏈測試中,Kimi K3 平均完成 17 步(共 32 步),10 次嘗試中成功攻破網絡 1 次,而美國前沿模型平均完成 28.5 步。
報告指出,Kimi K3 已具備一定自主攻擊能力,其安全護欄未能阻止模型開發漏洞或執行攻擊。然而,由於託管環境限制,Kimi K3 僅參與部分測試,整體能力估算主要基於 41 項基準,與其他接受全面測試的模型相比,其結果存在更大誤差範圍,測試並非完全對等。
WOOFUN AI
影響力評估 · 一鍵速讀
該測評雖強調美國領先,但明確指出 Kimi K3 的測試條件受限,導致數據可比性下降。Kimi K3 在漏洞利用上表現優於其他非美模型,顯示中國大模型在網絡攻擊潛力上的快速進步。測試非對等性意味着當前差距可能被高估,後續需關注更公平環境下的橫向對比結果。
WOOFUN AI 生成 · 僅供參考,非投資建議
評論
暫無評論