# Выборка диалогов для базы знаний Скрипты забирают диалоги отдела «Отдел по работе с клиентами» из аналитического Postgres (`superset_data`) — на них построены `kb/02_zabota_schedule.md` и `scenarios/zabota_scenarios.yaml`. | Скрипт | Что делает | |--------|------------| | `db_connect.R` | подключение к Postgres, при необходимости через SSH-туннель | | `topic_distribution.R` | распределение обращений отдела по темам за период | | `sample_dialogs.R` | стратифицированная по темам выборка диалогов, по файлу на тему | Запуск (из этой папки, переменные окружения — как в репозитории `analytics`): ```bash export DB_NAME=superset_data DB_USER=superset_data DB_PASSWORD=... export USE_SSH_TUNNEL=true SSH_HOST=... SSH_USER=... SSH_KEY=~/.ssh/id_rsa cd scripts/analytics Rscript topic_distribution.R LOOKBACK_DAYS=30 PER_TOPIC=14 Rscript sample_dialogs.R ``` Выгрузка по умолчанию идёт в `/tmp/zabota_sample` и **не коммитится**: это переписки клиентов. Телефоны маскируются при выгрузке, но остальные детали нет. В репозитории лежит только агрегат `data/topics_sampled.csv`.