AnatoliiG commited on
Commit ·
c23e8fc
1
Parent(s): d833d70
Update helpers.py
Browse files- src/utils/helpers.py +33 -27
src/utils/helpers.py
CHANGED
|
@@ -68,41 +68,47 @@ def web_search(query: str, max_results: int = 3) -> list:
|
|
| 68 |
|
| 69 |
|
| 70 |
def extract_search_query(text: str):
|
| 71 |
-
"""
|
| 72 |
if not text:
|
| 73 |
return None
|
| 74 |
|
| 75 |
-
# В
|
| 76 |
-
|
| 77 |
-
if not text_clean:
|
| 78 |
-
text_clean = text # Если ответ состоял только из тегов, ищем внутри них
|
| 79 |
|
| 80 |
-
|
| 81 |
-
|
| 82 |
-
|
| 83 |
-
|
| 84 |
-
data = json.loads(json_match.group(1))
|
| 85 |
-
# Проверяем флаг search (строго True)
|
| 86 |
-
if data.get("search") is True or str(data.get("search")).lower() == "true":
|
| 87 |
-
return data.get("query")
|
| 88 |
-
return None
|
| 89 |
|
| 90 |
-
|
| 91 |
-
|
| 92 |
-
|
| 93 |
-
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 94 |
if data.get("search") is True or str(data.get("search")).lower() == "true":
|
| 95 |
return data.get("query")
|
| 96 |
-
|
| 97 |
-
|
| 98 |
-
print(f"Ошибка парсинга JSON роутера: {e}")
|
| 99 |
|
| 100 |
-
#
|
| 101 |
-
if "
|
| 102 |
-
match = re.search(
|
|
|
|
|
|
|
| 103 |
if match:
|
| 104 |
-
|
| 105 |
-
|
| 106 |
-
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 107 |
|
| 108 |
return None
|
|
|
|
| 68 |
|
| 69 |
|
| 70 |
def extract_search_query(text: str):
|
| 71 |
+
"""Супер-надежный парсер запроса (с поддержкой XML, JSON и логов)."""
|
| 72 |
if not text:
|
| 73 |
return None
|
| 74 |
|
| 75 |
+
# ВЫВОДИМ В КОНСОЛЬ ТО, ЧТО РЕАЛЬНО ПОДУМАЛ РОУТЕР
|
| 76 |
+
print(f"\n--- [DEBUG] RAW ROUTER OUTPUT ---\n{text}\n---------------------------\n")
|
|
|
|
|
|
|
| 77 |
|
| 78 |
+
# 1. Очищаем от размышлений
|
| 79 |
+
clean = re.sub(r"<think>.*?</think>", "", text, flags=re.DOTALL).strip()
|
| 80 |
+
if not clean:
|
| 81 |
+
clean = text
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 82 |
|
| 83 |
+
# 2. Ищем XML-тег (наш новый основной метод)
|
| 84 |
+
xml_match = re.search(r"<search>(.*?)</search>", clean, re.IGNORECASE)
|
| 85 |
+
if xml_match:
|
| 86 |
+
return xml_match.group(1).strip()
|
| 87 |
+
|
| 88 |
+
# 3. Резерв на случай JSON
|
| 89 |
+
json_match = re.search(r"\{.*?\}", clean, re.DOTALL)
|
| 90 |
+
if json_match:
|
| 91 |
+
try:
|
| 92 |
+
data = json.loads(json_match.group(0))
|
| 93 |
if data.get("search") is True or str(data.get("search")).lower() == "true":
|
| 94 |
return data.get("query")
|
| 95 |
+
except:
|
| 96 |
+
pass
|
|
|
|
| 97 |
|
| 98 |
+
# 4. Резерв на случай "старых галлюцинаций" с массивами
|
| 99 |
+
if "search" in text.lower():
|
| 100 |
+
match = re.search(
|
| 101 |
+
r"(?:запрос|query|text)['\"]\s*:\s*['\"]([^'\"]+)['\"]", text, re.IGNORECASE
|
| 102 |
+
)
|
| 103 |
if match:
|
| 104 |
+
val = match.group(1)
|
| 105 |
+
val = re.sub(
|
| 106 |
+
r"^(?:🔍\s*)?(?:Поиск(?:\s*по\s*запросу)?|Search):\s*",
|
| 107 |
+
"",
|
| 108 |
+
val,
|
| 109 |
+
flags=re.IGNORECASE,
|
| 110 |
+
).strip()
|
| 111 |
+
if val and val.lower() not in ["no", "false", "none", "no_search"]:
|
| 112 |
+
return val
|
| 113 |
|
| 114 |
return None
|