Update page_files/categorized/Backend/PDF_DataExtraction.py
Browse files
page_files/categorized/Backend/PDF_DataExtraction.py
CHANGED
|
@@ -151,13 +151,8 @@ def get_gemini_model(api_key: str) -> str:
|
|
| 151 |
_run_startup_probes(_cached_gemini_model)
|
| 152 |
return _cached_gemini_model
|
| 153 |
|
| 154 |
-
|
| 155 |
-
|
| 156 |
-
GEMINI_API_URL = (
|
| 157 |
-
f"https://generativelanguage.googleapis.com/v1beta/"
|
| 158 |
-
f"models/{GEMINI_MODEL}:generateContent"
|
| 159 |
-
f"?key={GEMINI_API_KEY}"
|
| 160 |
-
)
|
| 161 |
|
| 162 |
# ββ OpenAI / GPT-4o βββββββββββββββββββββββββββββββββββββββββββββββββββββββββββ
|
| 163 |
GPT_MODEL = "gpt-4o"
|
|
@@ -2023,6 +2018,16 @@ def run_pipeline(
|
|
| 2023 |
doi_override: str = "",
|
| 2024 |
progress_callback: Any = None,
|
| 2025 |
) -> Tuple[pd.DataFrame, pd.DataFrame, pd.DataFrame, List[Chunk], List[str], Dict]:
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 2026 |
"""
|
| 2027 |
Full dual-LLM consensus pipeline.
|
| 2028 |
|
|
|
|
| 151 |
_run_startup_probes(_cached_gemini_model)
|
| 152 |
return _cached_gemini_model
|
| 153 |
|
| 154 |
+
GEMINI_MODEL = None
|
| 155 |
+
GEMINI_API_URL = None
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 156 |
|
| 157 |
# ββ OpenAI / GPT-4o βββββββββββββββββββββββββββββββββββββββββββββββββββββββββββ
|
| 158 |
GPT_MODEL = "gpt-4o"
|
|
|
|
| 2018 |
doi_override: str = "",
|
| 2019 |
progress_callback: Any = None,
|
| 2020 |
) -> Tuple[pd.DataFrame, pd.DataFrame, pd.DataFrame, List[Chunk], List[str], Dict]:
|
| 2021 |
+
global GEMINI_MODEL, GEMINI_API_URL
|
| 2022 |
+
if not GEMINI_MODEL:
|
| 2023 |
+
key = os.getenv("GEMINI_API_KEY", "")
|
| 2024 |
+
GEMINI_MODEL = get_gemini_model(key)
|
| 2025 |
+
GEMINI_API_URL = (
|
| 2026 |
+
f"https://generativelanguage.googleapis.com/v1beta/"
|
| 2027 |
+
f"models/{GEMINI_MODEL}:generateContent"
|
| 2028 |
+
f"?key={key}"
|
| 2029 |
+
)
|
| 2030 |
+
|
| 2031 |
"""
|
| 2032 |
Full dual-LLM consensus pipeline.
|
| 2033 |
|