Uncensored Local LLM Models

Модели для локального запуска без цензуры. Все данные остаются на вашем устройстве.

Модели

Модель Параметры Активных (MoE) Размер GGUF RAM нужно Статус
Qwen3.6-35B-A3B Aggressive 35B ~3B ~15 ГБ (IQ4_XS) ~16 ГБ Основная
GPT-OSS-20B Aggressive 20B ~12 ГБ (MXFP4) ~14 ГБ Max uncensoring
Huihui-Qwen3.5-35B Abliterated 35B ~3B ~15 ГБ ~16 ГБ Abliterated

Веб-интерфейс и Telegram-бот

Веб-интерфейс (ChatGPT-style)

  • URL: https://bot-three-rosy.vercel.app
  • Пароль: uncensored2026
  • Выбор моделей, загрузка файлов, streaming-ответы
  • История чатов сохраняется в localStorage

Telegram-бот

  • @mybiography_bot
  • Доступ только по Telegram ID: 5450018125
  • Команды: /start, /model, /clear, /status

Архитектура

MacBook (Ollama) <- cloudflared tunnel <- Vercel (Next.js) -> Telegram/Web UI

Требования

  • macOS, Apple Silicon (M1+)
  • Ollama (уже установлен)
  • huggingface-cli (уже установлен)
  • ~30 ГБ свободного места на диске для обеих моделей

Быстрый старт (через Ollama напрямую)

# Qwen3.6-35B Aggressive
ollama run hf.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive:Q4_K_M

# GPT-OSS-20B Aggressive
ollama run hf.co/HauhauCS/GPT-OSS-20B-Uncensored-HauhauCS-Aggressive

# Huihui-Qwen3.5-35B Abliterated
ollama run huihui_ai/qwen3.5-abliterated:35b

Полная установка (скачать GGUF локально + Ollama Modelfile)

1. Настройка HF токена

# ВАЖНО: используйте НОВЫЙ токен, старые скомпрометированы
# Создайте новый на https://huggingface.co/settings/tokens
huggingface-cli login

2. Скачивание моделей

# Qwen3.6-35B (IQ4_XS — оптимально для 18 ГБ RAM)
./download_qwen36.sh

# GPT-OSS-20B (MXFP4)
./download_gptoss20b.sh

# Huihui-Qwen3.5-35B (через Ollama напрямую)
./download_huihui.sh

3. Создание моделей в Ollama

./setup_ollama.sh

4. Запуск

# Qwen3.6-35B
ollama run qwen36-uncensored

# GPT-OSS-20B
ollama run gptoss20b-uncensored

Рекомендуемые настройки

Qwen3.6-35B (Thinking mode, по умолчанию)

  • temperature=1.0, top_p=0.95, top_k=20, min_p=0, presence_penalty=1.5

Qwen3.6-35B (Coding/precise)

  • temperature=0.6, top_p=0.95, top_k=20, min_p=0, presence_penalty=0

Qwen3.6-35B (Non-thinking mode)

  • General: temperature=0.7, top_p=0.8, top_k=20, min_p=0, presence_penalty=1.5
  • Reasoning: temperature=1.0, top_p=1.0, top_k=40, min_p=0, presence_penalty=2.0

Запуск веб-интерфейса и бота

Локально (dev)

cd bot
npm run dev          # веб на http://localhost:3000
npm run telegram:polling  # Telegram бот в режиме polling

Продакшн (Vercel + туннель)

# 1. Запустить Ollama
ollama serve

# 2. Открыть туннель к Ollama
cloudflared tunnel --url http://localhost:11434

# 3. Обновить OLLAMA_BASE_URL на Vercel (URL из туннеля)
vercel env rm OLLAMA_BASE_URL production --yes --token <token>
vercel env add OLLAMA_BASE_URL production --token <token> <<< "https://<tunnel-url>"

# 4. Деплой
vercel deploy --prod --yes --token <token>

# 5. Установить Telegram webhook
TELEGRAM_BOT_TOKEN=<token> node scripts/set-webhook.js https://bot-three-rosy.vercel.app

Источники

⚠️ Безопасность

  • Токены HF, которые были в открытом виде в чате, нужно ОТЗВАТЬ и пересоздать
  • https://huggingface.co/settings/tokens
  • Vercel токен также скомпрометирован — пересоздайте на https://vercel.com/account/tokens
  • Telegram бот токен скомпрометирован — пересоздайте через @BotFather

⚠️ Важно про туннель

URL trycloudflare.com меняется при каждом перезапуске туннеля. Для стабильной работы:

  1. Создайте named tunnel через Cloudflare Zero Trust
  2. Или используйте ngrok с фиксированным доменом (платный план)
  3. Или арендуйте VPS и запустите Ollama там
Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support