Spaces:
Sleeping
A newer version of the Gradio SDK is available: 6.24.0
Service RAG (Retrieval-Augmented Generation) d'ILaaS
Vue d'ensemble
Le service RAG d'ILaaS permet d'enrichir les réponses des modèles de langage avec des informations provenant de documents externes. Ce service combine la récupération d'informations et la génération de texte pour fournir des réponses plus précises et contextualisées.
Intégration dans les applications existantes
Si vous utilisez un logiciel exploitant l'IA générative et qu'il permet de choisir l'URL du serveur d'IA, vous pouvez substituer les services d'OpenAI par les services d'ILaaS très simplement.
Prérequis
Après avoir demandé un accès à ILaaS, vous aurez reçu :
- Un token pour l'inférence
- Un token pour le RAG
Configuration
Pour intégrer le service RAG d'ILaaS, il vous suffira de :
- Configurer l'URL d'accès au service avec l'URL :
https://rag-ilaas.fr - Vous authentifier avec votre token RAG
Modèles par défaut
- Modèle d'embedding :
bge-m3 - Modèle de reranking :
bge-reranker-v2-m3
Intégration dans vos propres applications
Il est aussi possible de développer vos propres services utilisant le service de RAG d'ILaaS.
Documentation disponible
- Documentation de l'API : RAG API ILaaS - Swagger
- Documentation embeddings : ILaaS Embeddings PDF
Exemple de configuration
Consultez l'exemple de configuration de l'URL du service RAG et du token dans un programme, ici Open WebUI.
Document généré à partir de ilaas.fr - Dernière mise à jour : Juillet 2026