LineageEval: 验证模型蒸馏是否传递审查机制

Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship. Try it

LineageEval: 验证模型蒸馏是否传递审查机制

我们深入研究了将DeepSeek V4 Flash等中国前沿模型蒸馏为GPT-OSS模型时,审查机制是否会随之转移。通过LineageEval工具,我们在金融推理等场景下进行了严格测试,发现尽管学生模型继承了强大的推理能力,但并未继承教师的政治审查行为。研究对比了涉及中国敏感话题与中性对照组的回答,证实了蒸馏过程不会传递审查偏见。我们开源了所有模型权重、评估代码及数据集,帮助开发者安全高效地利用开源模型提升性能。

政治审查并未在蒸馏过程中转移:尽管教师模型在涉及中国敏感话题时表现出明显的回避,但由该模型蒸馏出的学生模型在保持高性能的同时,完全保留了回答这些问题的自由。

同日更多故事

2026-07-30