Spaces:
Sleeping
Sleeping
Update app.py
Browse files
app.py
CHANGED
|
@@ -207,10 +207,16 @@ async def run_hackrx(req: RunRequest):
|
|
| 207 |
docs = await ensemble_retriever.ainvoke(question)
|
| 208 |
doc_texts = [doc.page_content for doc in docs]
|
| 209 |
doc_embeddings = ml_models["embedder"].embed_documents(doc_texts)
|
| 210 |
-
sims = cosine_similarity([question_embeddings[q_idx]], doc_embeddings)[0]
|
| 211 |
-
|
| 212 |
-
|
| 213 |
-
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 214 |
return "\n\n".join(top_chunks)
|
| 215 |
# Retrieve and rerank all in parallel
|
| 216 |
retrieved_chunks_all = await asyncio.gather(
|
|
|
|
| 207 |
docs = await ensemble_retriever.ainvoke(question)
|
| 208 |
doc_texts = [doc.page_content for doc in docs]
|
| 209 |
doc_embeddings = ml_models["embedder"].embed_documents(doc_texts)
|
| 210 |
+
# sims = cosine_similarity([question_embeddings[q_idx]], doc_embeddings)[0]
|
| 211 |
+
query_embedding = question_embeddings[q_idx]
|
| 212 |
+
selected_indices = mmr_select(
|
| 213 |
+
query_embedding=query_embedding,
|
| 214 |
+
candidates=doc_embeddings,
|
| 215 |
+
k=6,
|
| 216 |
+
lambda_mult=0.6,
|
| 217 |
+
)
|
| 218 |
+
# top_indices = np.argsort(sims)[-top_k:][::-1]
|
| 219 |
+
top_chunks = [doc_texts[j] for j in selected_indices]
|
| 220 |
return "\n\n".join(top_chunks)
|
| 221 |
# Retrieve and rerank all in parallel
|
| 222 |
retrieved_chunks_all = await asyncio.gather(
|