两个 Token 就让 Kimi“变成”Claude?前Google DeepMind研究员意外撞上大模型的蒸馏疑云

前沿 AI 模型在回答前会先“思考”,有时这种思考过程相当难以困惑。这些模型把思考过程加密,像密封信封一样交还给你。Ilia Shumailov 和 Alexander Panfilov 发现,这个封条几乎没什么作用。他们可以解码前沿 LLM 的推理轨迹,包括像 GPT-5 Sol 这样最先进的模型,而且只需要使用同一家族中较小的 LLM 就能做到。这开启了一个巨大的威胁模型:你可以从用户会话中窃取秘密,可以用解码出的推理轨迹做训练,可以做提示注入,可以做越狱,各种刺激的事情。

--91likeyou---

🔥 热词:#Kimi · #Token · #Ilia · #Alexander · #K3 · #Opus · #两个 · #就让