寂静回声 发表于 前天 13:29

阿里千问公开招聘AI蒸馏工程师

给 Qwen 3.8 喂一段 GPT-5.5 Pro 的思考开头,它接下去写出来的答案就往 GPT 那边靠。发现这个现象的团队,就是之前搞出「把 OpenAI 和 Anthropic 藏起来的推理过程还原出来」那个漏洞的人。
       
他们的方法说穿了很简单:先用顶级闭源模型跑一遍基准题,把还原出来的推理链掐头只留前 1%,塞给开源模型当作它自己思考的开头,再看答案会不会变得更像原主。
论文版本先验的是 Kimi-K3,接上 Claude 4.8 的开头后,答案明显向 Claude 4.8 靠拢,被认为后训练用过 Claude 的数据。
这次的博客把同一套方法用到 Qwen 3.8 上,结论是它的后训练大概率借助了 GPT-5.5 Pro,或者一个回答风格很接近的 GPT 模型。
https://s3.bmp.ovh/2026/09/14/VHXIQVUe.jpg


2266998 发表于 前天 13:35

有逆向能力才是竞争的核心能力,直言不讳

wwfs0z 发表于 前天 14:08

打定主意内战了?
页: [1]
查看完整版本: 阿里千问公开招聘AI蒸馏工程师