BriefGPT.xyz
大模型
Ask
alpha
关键词
linguistic watermarks
搜索结果 - 1
可学习的语言水印:对大型语言模型的模型提取攻击进行追踪
在快速发展的人工智能领域中,保护大型语言模型(LLMs)的知识产权变得越来越关键。我们提出了一种新颖的方法,在 LLMs 中嵌入可学习的语言水印,以追踪和防止模型提取攻击。我们的方法通过向令牌频率分布中引入可控噪声来微妙地修改 LLM 的输
→
PDF
2 months ago
Prev
Next