布拉格经济大学研究员托马什·布鲁克纳发现,通过让模型反复输出1到100的随机数,可生成独一无二的"行为指纹"。
对165个模型各问30次后发现,GPT-4o偏爱42和37,Claude Sonnet 5疯狂输出47,Qwen3-Max则30次全部回答42。
该方法仅需约120条请求即可识别模型身份,错误率约10.6%,为验证API是否被偷换模型提供了轻量级方案。
Исследователь Пражского экономического университета Томаш Брукнер обнаружил, что, заставляя модель многократно выдавать случайные числа от 1 до 100, можно...
Исследователь Пражского экономического университета Томаш Брукнер обнаружил, что, заставляя модель
многократно выдавать случайные числа от 1 до 100, можно получить уникальный «поведенческий отпечаток». После 30 опросов 165 моделей было обнаружено, что GPT-4o предпочитает 42 и 37, Claude Sonnet 5 массово выдает 47, а Qwen3-Max во всех 30 случаях отвечает 42. Этот метод требует всего около 120 запросов для идентификации модели, а ошибка составляет примерно 10,6%, что предоставляет легкий способ проверить, не была ли API подменена.
布拉格经济大学研究员托马什·布鲁克纳发现,通过让模型反复输出1到100的随机数,可生成独一无二的"行为指纹"。
对165个模型各问30次后发现,GPT-4o偏爱42和37,Claude Sonnet 5疯狂输出47,Qwen3-Max则30次全部回答42。
该方法仅需约120条请求即可识别模型身份,错误率约10.6%,为验证API是否被偷换模型提供了轻量级方案。
研究员托马什·布鲁克纳通过让模型反复输出1至100的随机数,提取不同模型的回答偏好,并将其作为识别模型身份的“行为指纹”。
材料称,研究对165个模型各提问30次,观察到GPT-4o偏爱42和37,Claude Sonnet 5常输出47,Qwen3-Max的30次回答均为42。
Aioga判断,这种方法的价值在于用较简单的重复请求辅助核验API背后的模型身份,但约10.6%的错误率意味着结果不能被视为确定性证明。
该方法可能为识别API中转服务是否更换模型提供轻量级线索。值得关注的是,材料仅说明随机数回答偏好,未说明其在更多调用环境中的稳定性。 建议按材料所述约120条请求进行重复测试,并结合错误率审慎解释结果。进一步应用前,值得关注不同模型、不同时间与不同接口条件下的复现情况。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: 摘要聚合 · 原始域名: mp.weixin.qq.com
Источник: 公众号:数字生命卡兹克
原文链接: Открыть оригинал
Aioga 归档: 查看情报页
Content record: summary-fallback · Updated: 2026-07-21T01:10:49.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。