Расцензуренную Qwen 3.8-27B выложили на Hugging Face и в ollama — 18 августа 2026 г. в 08:38:49.199
Расцензуренную Qwen 3.8-27B выложили на Hugging Face и в ollama 📋 huihui-ai выложили расцензуренную Qwen 3.8-27B. Базовая модель на спорные запросы отвечает «я не могу в этом помочь», а эта сборка отвечает по существу, потому что из её весов вычтены сами направления отказа. 🔧 Метод называется вырезанием отказов. У модели собирают два набора ответов: на вредные запросы она отказывает, на обычные отвечает. Разницу между ними считают вектором и вычитают из весов. Первые 15 слоёв не трогают, чтобы не повредить базовые знания. Модель мультимодальная и умеет рассуждать перед ответом. На выходе 27,3 млрд параметров в кванте Q4_K_M, контекст 256 тысяч токенов, около 18 ГБ на диске. 💡 Зачем это нужно. Внутренний цензор модели блокируют целый класс легитимных задач. Пентестерам нужны рабочие PoC-эксплойты и фишинговые сценарии, чтобы проверять собственную инфраструктуру, а базовая модель отказывает даже им. Аналитикам безопасности нужен разбор вредоносного кода и обфускации. Разработчикам LLM нужен агрессивный «оппонент» для проверки своих систем на устойчивость к обходу ограничений. Плюс креатив без фильтров: сценарии, литература и игры с острыми темами. У расцензуренной модели с этим всем проблем не возникает. 💼 Запустить проще всего через Ollama одной командой: ollama run huihui_ai/Qwen3.8-abliterated Но это квантованная версия на Q4. Полные веса лежат на Hugging Face в формате safetensors, если нужен другой движок или своя квантизация. Я попросил Гермеса нарезать для тестов nvfp4 и bf16 - он из HF весов сам все сконвертировал под мак (да, кванты можно больше не ждать, а нарезать Гермесом одним запросом) и взял себе как навык, теперь если нужно что-то сгенерить без цензуры - просто вызовет эту модель локально. ну, а если не хотите заморачиваться, - то просто ollama run huihui_ai/Qwen3.8-abliterated #Qwen #uncensored #abliterated ——— @tsingular

