WizardCoder2007 commited on
Commit
38423b1
·
1 Parent(s): 0c24ea3
Files changed (2) hide show
  1. server/main.py +4 -4
  2. server/utils/RetrieveQuery.py +1 -1
server/main.py CHANGED
@@ -58,10 +58,10 @@ async def lifespan(app:FastAPI):
58
  groq_api_key= os.getenv("groq_api_key")
59
  google_api_key= os.getenv("google_api_key")
60
 
61
- primary_heavy_llm= ChatGroq(groq_api_key= groq_api_key,model_name="llama-3.3-70b-versatile",temperature=0.1,max_tokens=1024,timeout=10)
62
- backup_heavy_llm1= ChatGroq(groq_api_key= groq_api_key,model_name="llama-3.1-8b-instant",temperature=0.1,max_tokens=1024,timeout=8)
63
- backup_heavy_llm2= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-3.5-flash",temperature=0.1,max_tokens=1024,timeout=8)
64
- backup_heavy_llm3= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-3.1-flash-lite",temperature=0.1,max_tokens=1024,timeout=8)
65
  backup_heavy_llm4= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-2.5-flash",temperature=0.1,max_tokens=1024,timeout=8)
66
 
67
  resilient_heavy_llm= primary_heavy_llm.with_fallbacks([backup_heavy_llm1,backup_heavy_llm2,backup_heavy_llm3,backup_heavy_llm4])
 
58
  groq_api_key= os.getenv("groq_api_key")
59
  google_api_key= os.getenv("google_api_key")
60
 
61
+ primary_heavy_llm= ChatGroq(groq_api_key= groq_api_key,model_name="llama-3.3-70b-versatile",temperature=0.1,max_tokens=1024,timeout=10,max_retries=0)
62
+ backup_heavy_llm1= ChatGroq(groq_api_key= groq_api_key,model_name="llama-3.1-8b-instant",temperature=0.1,max_tokens=1024,timeout=8,max_retries=0)
63
+ backup_heavy_llm2= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-3.5-flash",temperature=0.1,max_tokens=1024,timeout=8,max_retries=0)
64
+ backup_heavy_llm3= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-3.1-flash-lite",temperature=0.1,max_tokens=1024,timeout=8,max_retries=0)
65
  backup_heavy_llm4= ChatGoogleGenerativeAI(google_api_key= google_api_key,model="models/gemini-2.5-flash",temperature=0.1,max_tokens=1024,timeout=8)
66
 
67
  resilient_heavy_llm= primary_heavy_llm.with_fallbacks([backup_heavy_llm1,backup_heavy_llm2,backup_heavy_llm3,backup_heavy_llm4])
server/utils/RetrieveQuery.py CHANGED
@@ -38,7 +38,7 @@ def QueryRetriever(queries,vector_retriever,keyword_retriever,chunks_dict):
38
  # sort on basis of values
39
  rrf_scores= sorted(rrf_scores.items(), key=lambda item: item[1], reverse=True)
40
  # select top 10 documents
41
- for chunk_id,score in rrf_scores[:10]:
42
  if chunk_id in chunks_dict:
43
  documents.append(final_documents[chunk_id])
44
 
 
38
  # sort on basis of values
39
  rrf_scores= sorted(rrf_scores.items(), key=lambda item: item[1], reverse=True)
40
  # select top 10 documents
41
+ for chunk_id,score in rrf_scores[:5]:
42
  if chunk_id in chunks_dict:
43
  documents.append(final_documents[chunk_id])
44