文章通过实验展示了在开源LLM中嵌入后门的可能性,并强调了嵌入风险的隐蔽性和检测的困难性。作者呼吁在使用LLM时保持警惕,无论其是否开源,并期待AI研究者开发出有效的检测和缓解方法。
#AI
https://blog.sshh.io/p/how-to-backdoor-large-language-models
https://github.com/sshh12/llm_backdoor?tab=readme-ov-file
Post #1406
3.55K
网络 网络安全笔记 @tsecrecord · 7.96K subscribers