Загрузка...

Нейросети без цензуры (Uncensored LLMs)

Uncensored LLM (нецензурированная большая языковая модель) — это большая языковая модель, из которой убраны или ослаблены встроенные вендорские фильтры безопасности. Обычно это достигается дообучением исходной модели на датасете, из которого удалены типичные ответы-отказы («как ИИ, я не могу помочь с этим запросом» и подобные). В результате модель значительно реже отказывает пользователю и не подменяет ответ нравоучением, но рамки поведения при этом задают не встроенные фильтры вендора, а закон и правила площадки, на которой модель запущена.

Такие модели чаще всего делают на основе открытых (open-source) весов LLaMA, Mistral, Qwen и подобных, поскольку у закрытых коммерческих моделей типа GPT, Claude или Gemini доступа к весам для дообучения нет. Типичные примеры uncensored-версий: Dolphin, Nous Hermes, WizardLM-Uncensored. Из-за отсутствия встроенных ограничений публичные веб-сервисы такие модели предоставляют редко: чаще их запускают локально, через Ollama или LM Studio, беря на себя ответственность за использование.

Отсутствие вендорских фильтров смещает ответственность за результат с разработчика модели на пользователя: то, что закон и правила конкретного сервиса запрещают, остаётся запрещённым независимо от того, есть ли у модели встроенная цензура.

Подробнее в статье о нейросетях без цензуры.