Abliteration.ai
Abliteration.ai 是一个专为专业团队设计的LLM提供商,通过减少模型拒绝行为,让安全研究人员、红队、信任与安全团队及ML工程师能够运行敏感查询、测试AI应用漏洞、分类内容并大规模生成合成训练数据。
访问官方网站
扫码查看
Abliteration.ai是什么
Abliteration.ai 是一个面向专业团队的大语言模型(LLM)服务提供商,核心解决其他LLM提供商因过度拒绝行为而阻挡合法工作的问题。通过“abliteration”(消除拒绝)技术,该平台大幅降低模型对敏感查询的误拒率,同时保持安全基线。服务兼容OpenAI和Anthropic的API格式,用户只需修改一行base URL即可无缝迁移现有代码。平台专为以下场景设计:安全研究人员执行红队测试、信任与安全团队进行内容审核、ML工程师生成合成训练数据,以及任何需要与AI模型进行不受约束的合规交互的团队。

核心功能
- 拒绝行为削减模型:基于abliteration技术处理后的模型,能对敏感但合法的查询(如安全漏洞分析、对抗性测试)给出响应,而非直接拒绝。
- 双API兼容:同时支持OpenAI和Anthropic API标准,现有代码仅需修改一行base URL即可接入,无需重写逻辑。
- 作用域密钥控制:API层使用作用域密钥,每个项目可自定义使用策略,强制执行并记录所有决策,附带可审计的原因代码。
- 零数据保留选项:选择该选项后,提示词处理完即丢弃,绝不存储或用于训练,满足最高隐私要求。
- 大规模合成数据生成:支持批量生成分类、审核、评估等场景的训练数据,利用拒绝行为削减的模型获得更丰富的输出。
使用流程
- 注册并获取免费额度:访问平台后,直接使用免费层测试模型,无需预付费用。
- 修改base URL:在现有代码中,将API调用的base URL从OpenAI/Anthropic替换为Abliteration.ai提供的地址,一行代码即可完成迁移。
- 配置项目策略:为每个项目编写使用政策(usage policy),通过作用域密钥绑定到API层,实现精细控制。
- 发送请求并审计:所有请求均被记录,包含原因代码,支持事后审计。可选择零数据保留模式,确保提示词不存储。
- 按需付费:免费层测试后,按token计费,使用预付点数(永不过期),或选择每月$20起的订阅计划。
控制与合规
- 用户自定策略:每个项目独立编写使用政策,决定什么内容可以发送、模型如何响应,平台不预设任何内容过滤。
- API层强制实施:策略通过作用域密钥在API层面强制执行,确保每个请求都符合项目规则。
- 全日志审计:每一次决策(包括拒绝或允许)都记录原因代码,用户可随时审计,满足合规需求。
- 无数据训练:默认或选择零数据保留后,所有提示词处理完即丢弃,绝不用于模型微调或训练,保护敏感数据。
定价与数据隐私
| 计费方式 | 详情 |
|---|---|
| 免费层 | 包含一定量的免费token,用于测试模型效果,无需信用卡 |
| 按token付费 | 使用预付点数,点数永不过期,用多少扣多少,无隐藏费用 |
| 月付计划 | 从$20/月起,适用于更高使用量的团队 |
| 数据隐私 | 零数据保留选项确保提示词不被存储或用于训练;默认选项也承诺不将数据用于训练 |
用户可根据项目敏感度选择数据保留策略,所有计费透明,无自动续费陷阱。