Spaces:
Sleeping
Sleeping
Commit ·
38423b1
1
Parent(s): 0c24ea3
commit
Browse files- server/main.py +4 -4
- server/utils/RetrieveQuery.py +1 -1
server/main.py
CHANGED
|
@@ -58,10 +58,10 @@ async def lifespan(app:FastAPI):
|
|
| 58 |
groq_api_key= os.getenv("groq_api_key")
|
| 59 |
google_api_key= os.getenv("google_api_key")
|
| 60 |
|
| 61 |
-
primary_heavy_llm= ChatGroq(groq_api_key= groq_api_key,model_name="llama-3.3-70b-versatile",temperature=0.1,max_tokens=1024,timeout=10)
|
| 62 |
-
backup_heavy_llm1= ChatGroq(groq_api_key= groq_api_key,model_name="llama-3.1-8b-instant",temperature=0.1,max_tokens=1024,timeout=8)
|
| 63 |
-
backup_heavy_llm2= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-3.5-flash",temperature=0.1,max_tokens=1024,timeout=8)
|
| 64 |
-
backup_heavy_llm3= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-3.1-flash-lite",temperature=0.1,max_tokens=1024,timeout=8)
|
| 65 |
backup_heavy_llm4= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-2.5-flash",temperature=0.1,max_tokens=1024,timeout=8)
|
| 66 |
|
| 67 |
resilient_heavy_llm= primary_heavy_llm.with_fallbacks([backup_heavy_llm1,backup_heavy_llm2,backup_heavy_llm3,backup_heavy_llm4])
|
|
|
|
| 58 |
groq_api_key= os.getenv("groq_api_key")
|
| 59 |
google_api_key= os.getenv("google_api_key")
|
| 60 |
|
| 61 |
+
primary_heavy_llm= ChatGroq(groq_api_key= groq_api_key,model_name="llama-3.3-70b-versatile",temperature=0.1,max_tokens=1024,timeout=10,max_retries=0)
|
| 62 |
+
backup_heavy_llm1= ChatGroq(groq_api_key= groq_api_key,model_name="llama-3.1-8b-instant",temperature=0.1,max_tokens=1024,timeout=8,max_retries=0)
|
| 63 |
+
backup_heavy_llm2= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-3.5-flash",temperature=0.1,max_tokens=1024,timeout=8,max_retries=0)
|
| 64 |
+
backup_heavy_llm3= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-3.1-flash-lite",temperature=0.1,max_tokens=1024,timeout=8,max_retries=0)
|
| 65 |
backup_heavy_llm4= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-2.5-flash",temperature=0.1,max_tokens=1024,timeout=8)
|
| 66 |
|
| 67 |
resilient_heavy_llm= primary_heavy_llm.with_fallbacks([backup_heavy_llm1,backup_heavy_llm2,backup_heavy_llm3,backup_heavy_llm4])
|
server/utils/RetrieveQuery.py
CHANGED
|
@@ -38,7 +38,7 @@ def QueryRetriever(queries,vector_retriever,keyword_retriever,chunks_dict):
|
|
| 38 |
# sort on basis of values
|
| 39 |
rrf_scores= sorted(rrf_scores.items(), key=lambda item: item[1], reverse=True)
|
| 40 |
# select top 10 documents
|
| 41 |
-
for chunk_id,score in rrf_scores[:
|
| 42 |
if chunk_id in chunks_dict:
|
| 43 |
documents.append(final_documents[chunk_id])
|
| 44 |
|
|
|
|
| 38 |
# sort on basis of values
|
| 39 |
rrf_scores= sorted(rrf_scores.items(), key=lambda item: item[1], reverse=True)
|
| 40 |
# select top 10 documents
|
| 41 |
+
for chunk_id,score in rrf_scores[:5]:
|
| 42 |
if chunk_id in chunks_dict:
|
| 43 |
documents.append(final_documents[chunk_id])
|
| 44 |
|