Uncensored Open-Weight Models: Redistribution as the Persistence Layer
21 days ago
- 越来越多的参与者正在从开放权重的人工智能模型中移除安全护栏。
- 该研究概述了未经审查的模型的制作者、下游复制品以及应用。
- 从2024年1月到2026年3月,在HuggingFace上识别出3,471个原始的未经审查的模型。
- 每个模型平均被重新打包2.4次,其中三个参与者负责了所有8,164次压缩重新分发中的52%。
- 量化和跨账户、格式以及像Ollama这样的注册表的镜像使得模型即使在上游被移除后也能持续存在,并且更容易部署。
- 在1,643个集成了未经审查的大型语言模型的GitHub应用中,25%被归类为明确恶意。