Le RAG (génération augmentée par recherche) garde votre savoir dans un index interrogeable et le récupère au moment de la question ; le fine-tuning entraîne ce savoir dans les poids du modèle. Pour l’intelligence documentaire d’entreprise, les deux ne sont pas interchangeables — et pour la plupart des cas d’usage documentaires, le RAG est le bon défaut.
La comparaison
| RAG | Fine-tuning | |
|---|---|---|
| Nouveaux documents visibles | Immédiatement après ingestion | Seulement après réentraînement |
| Citations des sources | Natives — chaque réponse cite des passages | Impossible — le savoir est diffusé dans les poids |
| Contrôle d’accès | Applicable par document à la requête | Aucun — le modèle sait ce qu’il sait, pour tous |
| Effacer le savoir d’un document | Suppression de l’index | Pratiquement impossible sans réentraînement |
| Risque d’hallucination | Réduit — ancré dans le texte retrouvé | Persiste ; le modèle répond avec assurance depuis des poids périmés |
| Coût initial | Ingestion & indexation | Entraînements, évaluation, redéploiement à chaque mise à jour |
| Idéal pour | Faits, documents, politiques, contrats | Style, format, comportement de domaine |
L’angle conformité tranche généralement
Sous le droit de la protection des données (nLPD/RGPD), le fine-tuning sur des données personnelles est un champ de mines : les données s’incrustent irréversiblement dans les poids, les droits d’effacement deviennent inapplicables, le contrôle d’accès par utilisateur impossible. Le RAG garde les données dans un stockage gouverné où chiffrement, ACL, rétention et effacement restent applicables — c’est pourquoi les industries suisses régulées déploient du RAG, pas des modèles d’entreprise fine-tunés.
Quand le fine-tuning (ou les deux) a du sens
Le fine-tuning mérite son coût quand vous avez besoin d’un comportement constant plutôt que de savoir : un format de rapport précis, un ton maison, une tâche de classification étroite. Le schéma d’entreprise le plus solide : un modèle de base capable + RAG pour le savoir, avec éventuellement un léger tuning pour le format — jamais le fine-tuning comme entrepôt de savoir.
Ce que fait SovraRAG
SovraRAG est une plateforme RAG par conviction : recherche hybride avec graphe de connaissances, raisonnement agentique multi-étapes pour les questions complexes, ACL par document et réponses citées — sur infrastructure 100% suisse, avec un chiffrement par client que l’opérateur ne peut pas contourner.