利好

Qwen微调后40.3%被误识为Claude

2026-07-31 18:37:07

开源模型经Claude数据微调后身份混淆率飙升,证实语言风格而非蒸馏技术导致身份误认。

Woofun AI 监测数据显示,研究者钟子谦利用去除标识的Claude问答数据对Qwen等开源模型进行微调,导致部分模型出现自我身份识别错误。Qwen3.5-397B-A17B被识别为Claude的比例从0.6%激增至40.3%。实验表明,模型在预训练阶段已接触大量Claude内容,微调使其习得特定表达模式并关联至自身身份。当使用改写后的简单句式数据进行微调时,多数模型不再被误识,证实语言风格是引发身份混淆的主因。此前《潜意识学习》研究亦指出,模型会从训练数据中继承其他模型的偏好与行为模式。

WOOFUN AI

影响力评估 · 一键速读

该实验揭示了大模型身份认同的可塑性,表明微调数据中的语言风格足以覆盖模型原有的身份标识。这提示开发者在微调开源模型时需警惕数据污染风险,避免无意中引入其他模型的‘人格特征’。随着多模型交互数据增加,此类身份混淆现象或将在社区微调模型中更为普遍。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅