File size: 2,927 Bytes
d507333 4ef91a7 d507333 4ef91a7 aed322d 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 aed322d 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 d507333 4ef91a7 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 | networks:
ai-network:
driver: bridge
services:
tabbyapi:
image: local/tabbyapi:exl3-fixed
container_name: tabby-tavern-tabbyapi-1
restart: unless-stopped
ports:
- 5000:5000
volumes:
- ./tabby_models:/app/models
- ./tabby_config/config.yml:/app/config.yml
- ./tabby_config/api_tokens.yml:/app/api_tokens.yml
environment:
- CUDA_VISIBLE_DEVICES=0
- CUDA_DEVICE_ORDER=PCI_BUS_ID
- NVIDIA_VISIBLE_DEVICES=all
- PYTORCH_CUDA_ALLOC_CONF=max_split_size_mb:128
- OMP_NUM_THREADS=8
- EXLLAMA_GPU_LAYERS=999
- EXLLAMA_KV_CACHE=q8_0
- EXLLAMA_FLASH_ATTENTION=1
deploy:
resources:
reservations:
devices:
- driver: nvidia
count: all
capabilities:
- gpu
- compute
- utility
shm_size: 16g
networks:
- ai-network
sillytavern:
image: ghcr.io/sillytavern/sillytavern:latest
container_name: tabby-tavern-sillytavern-1
restart: unless-stopped
ports:
- 8000:8000
volumes:
- ./sillytavern_config:/home/node/app/config
- ./sillytavern_data:/home/node/app/data
environment:
- WHITELIST_MODE=false
networks:
- ai-network
ollama:
image: ollama/ollama:latest
container_name: tabby-tavern-ollama-1
restart: unless-stopped
ports:
- 11434:11434
volumes:
- ./ollama_data:/root/.ollama
environment:
- CUDA_VISIBLE_DEVICES=0
- CUDA_DEVICE_ORDER=PCI_BUS_ID
- NVIDIA_VISIBLE_DEVICES=all
- OMP_NUM_THREADS=8
- OLLAMA_FLASH_ATTENTION=1
- OLLAMA_KV_CACHE_TYPE=q8_0
- OLLAMA_NUM_PARALLEL=1
deploy:
resources:
reservations:
devices:
- driver: nvidia
count: all
capabilities:
- gpu
- compute
- utility
shm_size: 16g
networks:
- ai-network
open-webui:
image: ghcr.io/open-webui/open-webui:main
container_name: tabby-tavern-open-webui-1
restart: unless-stopped
ports:
- 3000:8080
volumes:
- ./openwebui_data:/app/backend/data
environment:
- OLLAMA_BASE_URL=http://ollama:11434
networks:
- ai-network
searxng:
container_name: tabby-tavern-searxng-1
image: docker.io/searxng/searxng:latest
restart: unless-stopped
ports:
- 8080:8080
volumes:
- ./searxng_config:/etc/searxng
environment:
- SEARXNG_BASE_URL=http://localhost:8080/
- INSTANCE_NAME=Tabby-Tavern-Search
- UWSGI_WORKERS=4
- UWSGI_THREADS=4
cap_drop:
- ALL
cap_add:
- CHOWN
- SETGID
- SETUID
networks:
- ai-network
depends_on:
- searxng-redis
searxng-redis:
container_name: tabby-tavern-searxng-redis-1
image: docker.io/library/redis:alpine
command: redis-server --save "" --appendonly "no"
restart: unless-stopped
networks:
- ai-network
|