singhankur01 commited on
Commit
fcd02f3
·
verified ·
1 Parent(s): a3578e5

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +15 -7
app.py CHANGED
@@ -28,6 +28,8 @@ from langchain.retrievers import ContextualCompressionRetriever
28
  from langchain.retrievers.document_compressors import CrossEncoderReranker
29
  from langchain_community.cross_encoders import HuggingFaceCrossEncoder
30
  from langchain.prompts import ChatPromptTemplate
 
 
31
 
32
  import os
33
  from sentence_transformers import SentenceTransformer
@@ -59,15 +61,21 @@ async def lifespan(app: FastAPI):
59
 
60
  if not GOOGLE_API_KEY:
61
  raise RuntimeError("CRITICAL: Missing GOOGLE_API_KEY in environment secrets!")
 
 
 
 
 
62
 
63
  # Load models into the shared dictionary
64
- ml_models["embedder"] = HuggingFaceEmbeddings(
65
- model_name="BAAI/bge-base-en-v1.5", #better but lil slower
66
- # model_name="intfloat/e5-large-v2", #lil faster but dont know response is slow
67
- encode_kwargs={
68
- "batch_size": 64,
69
- # "normalize_embeddings": True
70
- }
 
71
 
72
  )
73
  cross_encoder_model = HuggingFaceCrossEncoder(model_name="BAAI/bge-reranker-base")
 
28
  from langchain.retrievers.document_compressors import CrossEncoderReranker
29
  from langchain_community.cross_encoders import HuggingFaceCrossEncoder
30
  from langchain.prompts import ChatPromptTemplate
31
+ from langchain_nvidia_ai_endpoints.embeddings import NVIDIAEmbeddings
32
+ from langchain_nvidia_ai_endpoints.reranking import NVIDIARerank
33
 
34
  import os
35
  from sentence_transformers import SentenceTransformer
 
61
 
62
  if not GOOGLE_API_KEY:
63
  raise RuntimeError("CRITICAL: Missing GOOGLE_API_KEY in environment secrets!")
64
+ nvidia_api_key = os.getenv("nvidia_api_key")
65
+ print("🔑 gemini_api_key:", "FOUND" if nvidia_api_key else "NOT FOUND")
66
+
67
+ if not nvidia_api_key:
68
+ raise RuntimeError("CRITICAL: Missing GOOGLE_API_KEY in environment secrets!")
69
 
70
  # Load models into the shared dictionary
71
+ # ml_models["embedder"] = HuggingFaceEmbeddings(
72
+ # model_name="BAAI/bge-base-en-v1.5", #better but lil slower
73
+ # # model_name="intfloat/e5-large-v2", #lil faster but dont know response is slow
74
+ # encode_kwargs={
75
+ # "batch_size": 64,
76
+ # # "normalize_embeddings": True
77
+ # }
78
+ ml_models["embedder"] = NVIDIAEmbeddings(model="nvidia/nv-embedqa-e5-v5", nvidia_api_key=nvidia_api_key)
79
 
80
  )
81
  cross_encoder_model = HuggingFaceCrossEncoder(model_name="BAAI/bge-reranker-base")