低成本的模型身份验证探针。论文有点标题党 One Token Is Enough,其实是要尝试几十次让模型输出这一“One Token” arxiv.org/abs/2607.10252
粗略找了一下,类似论文还有很多,排除掉既要问题长、又要次数多的,LLMmap 8个精心问题,TRAP是对一次暗号(暗号怎么来你别问)
相反的防御论文也有,比方说混合20%,能让部分方案降到随机水平(Are You Getting What You Pay For?)
越来越像造假酒了。掺点水看不出来是吧。
低成本的模型身份验证探针。论文有点标题党 One Token Is Enough,其实是要尝试几十次让模型输出这一“One Token” arxiv.org/abs/2607.10252
粗略找了一下,类似论文还有很多,排除掉既要问题长、又要次数多的,LLMmap 8个精心问题,TRAP是对一次暗号(暗号怎么来你别问)
相反的防御论文也有,比方说混合20%,能让部分方案降到随机水平(Are You Getting What You Pay For?)
越来越像造假酒了。掺点水看不出来是吧。