Uncensored Local LLM Models
Модели для локального запуска без цензуры. Все данные остаются на вашем устройстве.
Модели
| Модель | Параметры | Активных (MoE) | Размер GGUF | RAM нужно | Статус |
|---|---|---|---|---|---|
| Qwen3.6-35B-A3B Aggressive | 35B | ~3B | ~15 ГБ (IQ4_XS) | ~16 ГБ | Основная |
| GPT-OSS-20B Aggressive | 20B | — | ~12 ГБ (MXFP4) | ~14 ГБ | Max uncensoring |
| Huihui-Qwen3.5-35B Abliterated | 35B | ~3B | ~15 ГБ | ~16 ГБ | Abliterated |
Веб-интерфейс и Telegram-бот
Веб-интерфейс (ChatGPT-style)
- URL: https://bot-three-rosy.vercel.app
- Пароль: uncensored2026
- Выбор моделей, загрузка файлов, streaming-ответы
- История чатов сохраняется в localStorage
Telegram-бот
- @mybiography_bot
- Доступ только по Telegram ID: 5450018125
- Команды: /start, /model, /clear, /status
Архитектура
MacBook (Ollama) <- cloudflared tunnel <- Vercel (Next.js) -> Telegram/Web UI
Требования
- macOS, Apple Silicon (M1+)
- Ollama (уже установлен)
- huggingface-cli (уже установлен)
- ~30 ГБ свободного места на диске для обеих моделей
Быстрый старт (через Ollama напрямую)
# Qwen3.6-35B Aggressive
ollama run hf.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive:Q4_K_M
# GPT-OSS-20B Aggressive
ollama run hf.co/HauhauCS/GPT-OSS-20B-Uncensored-HauhauCS-Aggressive
# Huihui-Qwen3.5-35B Abliterated
ollama run huihui_ai/qwen3.5-abliterated:35b
Полная установка (скачать GGUF локально + Ollama Modelfile)
1. Настройка HF токена
# ВАЖНО: используйте НОВЫЙ токен, старые скомпрометированы
# Создайте новый на https://huggingface.co/settings/tokens
huggingface-cli login
2. Скачивание моделей
# Qwen3.6-35B (IQ4_XS — оптимально для 18 ГБ RAM)
./download_qwen36.sh
# GPT-OSS-20B (MXFP4)
./download_gptoss20b.sh
# Huihui-Qwen3.5-35B (через Ollama напрямую)
./download_huihui.sh
3. Создание моделей в Ollama
./setup_ollama.sh
4. Запуск
# Qwen3.6-35B
ollama run qwen36-uncensored
# GPT-OSS-20B
ollama run gptoss20b-uncensored
Рекомендуемые настройки
Qwen3.6-35B (Thinking mode, по умолчанию)
- temperature=1.0, top_p=0.95, top_k=20, min_p=0, presence_penalty=1.5
Qwen3.6-35B (Coding/precise)
- temperature=0.6, top_p=0.95, top_k=20, min_p=0, presence_penalty=0
Qwen3.6-35B (Non-thinking mode)
- General: temperature=0.7, top_p=0.8, top_k=20, min_p=0, presence_penalty=1.5
- Reasoning: temperature=1.0, top_p=1.0, top_k=40, min_p=0, presence_penalty=2.0
Запуск веб-интерфейса и бота
Локально (dev)
cd bot
npm run dev # веб на http://localhost:3000
npm run telegram:polling # Telegram бот в режиме polling
Продакшн (Vercel + туннель)
# 1. Запустить Ollama
ollama serve
# 2. Открыть туннель к Ollama
cloudflared tunnel --url http://localhost:11434
# 3. Обновить OLLAMA_BASE_URL на Vercel (URL из туннеля)
vercel env rm OLLAMA_BASE_URL production --yes --token <token>
vercel env add OLLAMA_BASE_URL production --token <token> <<< "https://<tunnel-url>"
# 4. Деплой
vercel deploy --prod --yes --token <token>
# 5. Установить Telegram webhook
TELEGRAM_BOT_TOKEN=<token> node scripts/set-webhook.js https://bot-three-rosy.vercel.app
Источники
- Qwen3.6-35B: https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive
- GPT-OSS-20B: https://huggingface.co/HauhauCS/GPT-OSS-20B-Uncensored-HauhauCS-Aggressive
- Huihui-Qwen3.5-35B: https://huggingface.co/huihui-ai/Huihui-Qwen3.5-35B-A3B-abliterated
- Все модели HauhauCS: https://huggingface.co/HauhauCS/models
⚠️ Безопасность
- Токены HF, которые были в открытом виде в чате, нужно ОТЗВАТЬ и пересоздать
- https://huggingface.co/settings/tokens
- Vercel токен также скомпрометирован — пересоздайте на https://vercel.com/account/tokens
- Telegram бот токен скомпрометирован — пересоздайте через @BotFather
⚠️ Важно про туннель
URL trycloudflare.com меняется при каждом перезапуске туннеля. Для стабильной работы:
- Создайте named tunnel через Cloudflare Zero Trust
- Или используйте ngrok с фиксированным доменом (платный план)
- Или арендуйте VPS и запустите Ollama там