Spaces:
Sleeping
Sleeping
Update app.py
Browse files
app.py
CHANGED
|
@@ -70,7 +70,7 @@ async def lifespan(app: FastAPI):
|
|
| 70 |
)
|
| 71 |
cross_encoder_model = HuggingFaceCrossEncoder(model_name="BAAI/bge-reranker-base")
|
| 72 |
# cross_encoder_model = HuggingFaceCrossEncoder(model_name="BAAI/bge-reranker-large")
|
| 73 |
-
ml_models["reranker_compressor"] = CrossEncoderReranker(model=cross_encoder_model, top_n=
|
| 74 |
ml_models["llm"] = ChatGoogleGenerativeAI(
|
| 75 |
model="gemini-1.5-pro",
|
| 76 |
api_key=GOOGLE_API_KEY,
|
|
@@ -164,12 +164,12 @@ async def run_hackrx(req: RunRequest):
|
|
| 164 |
)
|
| 165 |
|
| 166 |
# dense_retriever = vectorstore.as_retriever(search_type="mmr",search_kwargs={"k": 8})
|
| 167 |
-
dense_retriever = vectorstore.as_retriever(search_type="mmr",search_kwargs={"k":
|
| 168 |
|
| 169 |
|
| 170 |
# Create retrievers using the pre-loaded models from our ml_models dictionary
|
| 171 |
keyword_retriever = BM25Retriever.from_documents(chunks)
|
| 172 |
-
keyword_retriever.k =
|
| 173 |
# dense_retriever = Chroma.from_documents(documents=chunks, embedding=ml_models["embedder"]).as_retriever()
|
| 174 |
ensemble_retriever = EnsembleRetriever(retrievers=[keyword_retriever, dense_retriever], weights=[0.35, 0.65])
|
| 175 |
### to make it faster we are now using our built reranker thats why commenting the code below
|
|
|
|
| 70 |
)
|
| 71 |
cross_encoder_model = HuggingFaceCrossEncoder(model_name="BAAI/bge-reranker-base")
|
| 72 |
# cross_encoder_model = HuggingFaceCrossEncoder(model_name="BAAI/bge-reranker-large")
|
| 73 |
+
ml_models["reranker_compressor"] = CrossEncoderReranker(model=cross_encoder_model, top_n=6)
|
| 74 |
ml_models["llm"] = ChatGoogleGenerativeAI(
|
| 75 |
model="gemini-1.5-pro",
|
| 76 |
api_key=GOOGLE_API_KEY,
|
|
|
|
| 164 |
)
|
| 165 |
|
| 166 |
# dense_retriever = vectorstore.as_retriever(search_type="mmr",search_kwargs={"k": 8})
|
| 167 |
+
dense_retriever = vectorstore.as_retriever(search_type="mmr",search_kwargs={"k": 7 ,"lambda_mult": 0.5})
|
| 168 |
|
| 169 |
|
| 170 |
# Create retrievers using the pre-loaded models from our ml_models dictionary
|
| 171 |
keyword_retriever = BM25Retriever.from_documents(chunks)
|
| 172 |
+
keyword_retriever.k = 5
|
| 173 |
# dense_retriever = Chroma.from_documents(documents=chunks, embedding=ml_models["embedder"]).as_retriever()
|
| 174 |
ensemble_retriever = EnsembleRetriever(retrievers=[keyword_retriever, dense_retriever], weights=[0.35, 0.65])
|
| 175 |
### to make it faster we are now using our built reranker thats why commenting the code below
|