全自动移除语言模型审查内容的工具,基于 abliteration 处理 transformer 模型。用 Python 实现,适合想让本地大模型减少内容限制的研究者与开发者,全程自动化,已获三万二千余星标。
Fully automatic censorship removal for language models
| 热度动量 | 25% | 10.0 | |
| 开发活跃 | 25% | 8.9 | |
| 社区响应 | 15% | 10.0 | |
| 文档质量 | 15% | 9.9 | |
| 发布节奏 | 10% | 4.7 | |
| 风险控制 | 10% | 10.0 |
评分由 公开的焚评公式 程序计算,数据来自 GitHub API,最近重算于 3 小时前。