新研究发现Kimi K3与Claude Opus推理模式的高度相似性
一项最新研究表明,Moonshot的Kimi K3在预测和延续Anthropic公司Claude Opus的文本方面表现出异常高的统计概率。研究人员发现了一种利用前沿AI公司的API漏洞提取模型内部推理的方法,并验证了这一方法的有效性。研究揭示了一个重大安全隐患:AI提供商使用全球加密密钥,使得较弱的模型可以解码并输出较强模型的秘密思想。这可能导致数据泄露、安全绕过和隐藏注入等风险。例如,开发者经常在线发布包含敏感信息的日志文件,研究人员通过解码公开日志发现了大量个人资料和秘密凭证。即使AI拒绝给出危险答案,其内部思考过程也可能暴露有害步骤。攻击者还可以将恶意命令直接嵌入这些不可见的加密块中以劫持AI工作流程。
