# Service RAG (Retrieval-Augmented Generation) d'ILaaS ## Vue d'ensemble Le service RAG d'ILaaS permet d'enrichir les réponses des modèles de langage avec des informations provenant de documents externes. Ce service combine la récupération d'informations et la génération de texte pour fournir des réponses plus précises et contextualisées. ## Intégration dans les applications existantes Si vous utilisez un logiciel exploitant l'IA générative et qu'il permet de choisir l'URL du serveur d'IA, vous pouvez substituer les services d'OpenAI par les services d'ILaaS très simplement. ### Prérequis Après avoir demandé un accès à ILaaS, vous aurez reçu : - Un token pour l'inférence - Un token pour le RAG ### Configuration Pour intégrer le service RAG d'ILaaS, il vous suffira de : 1. **Configurer l'URL d'accès** au service avec l'URL : `https://rag-ilaas.fr` 2. **Vous authentifier** avec votre token RAG ### Modèles par défaut - **Modèle d'embedding** : `bge-m3` - **Modèle de reranking** : `bge-reranker-v2-m3` ## Intégration dans vos propres applications Il est aussi possible de développer vos propres services utilisant le service de RAG d'ILaaS. ### Documentation disponible - **Documentation de l'API** : [RAG API ILaaS - Swagger](https://rag-api.ilaas.fr/docs#/) - **Documentation embeddings** : [ILaaS Embeddings PDF](https://www.ilaas.fr/wp-content/uploads/2026/05/ILaaS-Embeddings.pdf) ## Exemple de configuration Consultez l'exemple de configuration de l'URL du service RAG et du token dans un programme, ici Open WebUI. --- *Document généré à partir de [ilaas.fr](https://www.ilaas.fr/) - Dernière mise à jour : Juillet 2026*