Abliteration.ai — это API к языковой модели без встроенных отказов плюс шлюз политик, который решает, что этой модели можно, а что нельзя. Задумано для команд, которым стандартные LLM мешают работать: red team и лаборатории кибербезопасности, специалисты по trust & safety, ML-исследователи, генераторы обучающих датасетов, подрядчики в оборонке и госсекторе. Модель ответит на прикладные вопросы по безопасности и исследованиям, а рамки задаёт сама команда — через свою политику.
Подключение сводится к смене base URL. API совместим с OpenAI Chat Completions и Anthropic Messages, так что существующий SDK продолжит работать — меняете ключ и адрес https://api.abliteration.ai/v1, переписывать код не придётся. В консоли есть Playground со стримингом, документация и настройка обычных параметров: системный промпт, temperature, max tokens, top-p.
Отдельный блок — генерация обучающих данных. Описываете задачу словами, выбираете формат, и сервис соберёт размеченный датасет: диалоги для SFT, preference-пары, строки для эвалов, примеры для классификаторов и те пограничные случаи, которые другие модели писать откажутся. Выходные данные проходят проверку по схеме, выгружаются в JSONL под обучение OpenAI или сразу на Hugging Face. Собирать можно большими партиями — в демо на сайте, например, из описания задачи получается датасет на десять тысяч строк.
Policy Gateway — та часть, из-за которой всё это можно нести в комплаенс. Политики описываются как код, для каждого проекта свой ключ, а любой запрос к модели получит одно из пяти решений:
- allow — запрос попал в разрешённый профиль, например авторизованный offsec-ресёрч;
- refuse — сработало правило про харассмент или вред другим людям;
- redact — чувствительные данные вроде PHI маскируются до того, как дойдут до модели;
- rewrite — шлюз перепишет тон, сохранив смысл запроса;
- escalate — случай уходит на ручное решение.
Каждое решение сопровождается кодом причины и уходит в поток аудита — Splunk, Datadog, Elastic или ваш собственный S3. Хранение данных по умолчанию отключено, так что промпты не остаются на стороне сервиса.
Модель можно попробовать бесплатно, а по корпоративным сценариям есть прямой контакт с командой.