Modèles et fournisseurs d’IA
DirectCase génère des réponses et des résumés au moyen de modèles d’IA tiers et auto-hébergés. Cette page constitue la liste officielle et constamment à jour des fournisseurs d’IA avec lesquels nous travaillons et des modèles utilisés par le Service, y compris la manière dont chacun traite vos données. Elle est intégrée par référence à nos Conditions générales en tant que « Documentation relative aux modèles d’IA ».
Vue d’ensemble
Chaque modèle ci-dessous est associé à l’une des trois catégories de traitement des données décrivant ce qu’il advient de vos invites et des réponses du modèle chez le fournisseur :
Cette page est générée à partir du même registre que celui lu par notre application ; elle reflète donc les modèles effectivement en production. Vos droits contractuels relatifs à ces fournisseurs et modèles sont définis dans les Conditions générales ; le traitement de vos données à caractère personnel est régi par la Politique de confidentialité et l’ATD. Vous recherchez plutôt le connecteur de recherche ? Consultez la Documentation du connecteur MCP.
Catégories de traitement des données
Conservation nulle des données
Le fournisseur ne conserve au repos ni vos invites (Entrée) ni les réponses du modèle (Sortie) après le renvoi de la réponse et ne les utilise pas à des fins d’entraînement. Le traitement transitoire en mémoire, limité à la durée de la requête, ne constitue pas une conservation ; dans notre configuration ZDR, la mise en cache des invites et la journalisation des abus sont en outre désactivées, et le traitement est limité à l’UE. La ZDR décrit le traitement effectué par le fournisseur : DirectCase conserve néanmoins l’historique de vos conversations dans l’application (supprimé après 90 jours, conformément à l’ATD).
Auto-hébergé · Conservation nulle des données
Le modèle est un modèle à poids ouverts entièrement exploité par DirectCase sur une infrastructure que nous contrôlons ; il applique également une conservation nulle des données : vos invites et les sorties du modèle sont traitées en mémoire uniquement pendant la durée de la requête et ne sont jamais conservées au repos, journalisées ni utilisées à des fins d’entraînement. Elles ne parviennent jamais à un fournisseur tiers de modèles d’IA. L’hébergeur GPU fournit uniquement la puissance de calcul brute ; il n’intervient pas en qualité de fournisseur de modèles et n’accède pas à vos données en tant que service. Il figure dans notre ATD en tant que sous-traitant ultérieur d’infrastructure. DirectCase conserve néanmoins l’historique de vos conversations dans l’application (supprimé après 90 jours, conformément à l’ATD).
Standard
Le modèle s’exécute via l’API du fournisseur conformément à ses conditions commerciales. Les fournisseurs peuvent conserver les données d’API pendant une durée limitée (généralement à des fins de surveillance des abus), comme indiqué dans leurs politiques d’utilisation des données, mais ils n’utilisent pas les données d’API de niveau professionnel pour entraîner leurs modèles. Si votre mission exige que les invites ne soient jamais conservées par un fournisseur tiers, choisissez un modèle à conservation nulle des données ou auto-hébergé.
Fournisseurs
Les fournisseurs participant à la fourniture des fonctionnalités d’IA, avec des liens vers les conditions qui les régissent. Les fournisseurs qualifiés de sous-traitants ultérieurs figurent également dans le tableau des sous-traitants ultérieurs de notre ATD (Annexe A des Conditions).
| Fournisseur | Données traitées dans | Rôle | Sous-traitant ultérieur | Conditions |
|---|---|---|---|---|
| Google LLC (Google Cloud Vertex AI) Traitement dans l’UE disponible : la configuration à conservation nulle des données s’exécute dans un projet Vertex AI dédié dans l’UE, avec résidence des données et traitement ML dans l’UE. | Global routing (standard) / EU (Zero Data Retention project) | Fournisseur de modèles d’IA | Oui | |
| OpenAI, Inc. | USA | Fournisseur de modèles d’IA | Oui | |
| Anthropic, PBC | USA | Fournisseur de modèles d’IA | Oui | |
| DirectCase s.r.o. (self-hosted) Modèles à poids ouverts entièrement exploités par DirectCase (vLLM). Les invites et les sorties ne parviennent jamais à un fournisseur tiers de modèles ; la puissance de calcul GPU est louée auprès de RunPod uniquement à titre d’infrastructure. | EU | Exploitant de modèles auto-hébergés | Non | |
| RunPod, Inc. Fournit la puissance de calcul GPU pour les modèles auto-hébergés de DirectCase. Infrastructure uniquement : aucun accès aux invites ou aux sorties en qualité de fournisseur de modèles ; les poids et l’inférence sont exploités par DirectCase. | EU | Infrastructure GPU | Oui | |
| Hetzner Online GmbH Hébergement principal de l’application et des données (indiqué dans l’ATD de DirectCase). N’est pas un fournisseur de modèles d’IA. | EU | Infrastructure d’hébergement | Oui | |
| Amazon Web Services, Inc. Infrastructure cloud auxiliaire (indiquée dans l’ATD de DirectCase). N’est pas un fournisseur de modèles d’IA. | EU | Infrastructure d’hébergement | Oui |
Modèles
Les modèles actuellement disponibles dans le Service, regroupés par fournisseur. Les offres dans lesquelles un modèle est disponible sont indiquées pour chaque modèle ; consultez Disponibilité par offre pour la matrice complète.
Google Cloud Vertex AI
Les modèles Gemini s’exécutent sur Google Cloud Vertex AI (jamais dans les applications Gemini grand public ni via l’API développeur gratuite). Nous exploitons deux projets Google Cloud distincts : un projet standard avec routage mondial et un projet dédié dans l’UE, configuré pour la conservation nulle des données et servant exclusivement le modèle ZDR.
gemini-3.8-flash Par défaut Recommandé Modèle de pointe rapide de Google exécuté sur Google Cloud Vertex AI. Modèle par défaut et recommandé, il offre un raisonnement juridique robuste sur de longs documents avec une faible latence.
gemini-3.8-flash Le même Gemini 3.8 Flash, fourni depuis un projet Vertex AI dédié dans l’UE et configuré pour la conservation nulle des données : mise en cache des invites et journalisation des abus désactivées, avec résidence des données et traitement ML dans l’UE. Aucun basculement entre fournisseurs : si le modèle est indisponible, la requête échoue au lieu de sortir du périmètre ZDR.
OpenAI
Les modèles GPT sont accessibles via l’API OpenAI conformément aux conditions commerciales d’OpenAI. Les données d’API ne sont pas utilisées pour entraîner les modèles d’OpenAI.
gpt-5.6-terra Modèle phare d’OpenAI via l’API OpenAI. Sa grande fenêtre de contexte convient à l’examen de plusieurs documents.
Anthropic
Les modèles Claude sont accessibles via l’API Anthropic conformément aux conditions commerciales d’Anthropic. Les données d’API ne sont pas utilisées pour entraîner les modèles d’Anthropic.
claude-sonnet-5 Claude d’Anthropic via l’API Anthropic. Rédaction et analyse rigoureuses, fidèles aux citations.
DirectCase self-hosted
Modèles à poids ouverts que nous exécutons nous-mêmes avec vLLM sur une infrastructure GPU louée. DirectCase contrôle les poids, la pile d’inférence et les journaux ; aucun fournisseur tiers de modèles d’IA n’intervient. Conservation nulle des données : les invites et les sorties sont traitées uniquement en mémoire et ne sont jamais conservées, journalisées ni utilisées à des fins d’entraînement.
qwen3.8-27b Modèle à poids ouverts entièrement exploité par DirectCase sur notre propre infrastructure GPU (vLLM). Conservation nulle des données : les invites et les sorties sont traitées uniquement en mémoire et ne sont jamais conservées, journalisées ni utilisées à des fins d’entraînement ; elles ne parviennent jamais à un fournisseur tiers de modèles — l’hébergeur GPU fournit uniquement la puissance de calcul. Aucun basculement entre fournisseurs : si le modèle est indisponible, la requête échoue au lieu d’envoyer vos données à un fournisseur tiers.
Modèles internes
Modèles utilitaires utilisés en arrière-plan par le Service (pour nommer les fils de discussion). Ils traitent le même contenu conversationnel selon les mêmes conditions du fournisseur et les mêmes engagements de non-entraînement que les modèles de conversation.
| Modèle | Modèle du fournisseur | Finalité | Traitement des données |
|---|---|---|---|
| Qwen 3.8 (chat titles) | qwen3.8-27b | Internal utility model that names chat threads. Self-hosted: only the first 10,000 characters of the opening message are used, and on timeout the title falls back to a local heuristic — never to a cloud model. | Auto-hébergé · Conservation nulle des données |
Lieu de conservation de vos données
Le lieu d’exécution des modèles ne représente qu’une partie de la situation : voici où DirectCase conserve lui-même vos données :
- Application et bases de données
- L’application DirectCase, ses bases de données (y compris l’historique de vos conversations) et le corpus de sources juridiques fonctionnent sur l’infrastructure Hetzner dans l’UE.
- Fichiers que vous téléversez
- Stockés dans Amazon S3 au sein de l’UE.
- Sauvegardes
- Les sauvegardes des bases de données sont chiffrées selon AES-256 avant de quitter notre infrastructure et stockées dans Amazon S3 au sein de l’UE.
- Modèles auto-hébergés
- Exécutés sur une capacité GPU louée auprès de RunPod dans l’UE. DirectCase exploite le modèle, le serveur d’inférence et ses journaux ; l’hébergeur GPU fournit uniquement la puissance de calcul.
Mise en cache des invites
La mise en cache des invites conserve des états de calcul intermédiaires afin d’éviter de retraiter un contexte répété. Elle ne signifie jamais que vos données sont partagées avec d’autres clients : les caches sont limités au compte DirectCase auprès du fournisseur. Catégories utilisées sur cette page :
- Mise en cache implicite
- Le fournisseur peut mettre en cache de manière transparente les préfixes d’invite répétés afin de réduire la latence et les coûts. Les entrées du cache ont une courte durée de vie et sont limitées à notre projet.
- Mise en cache désactivée
- Toute mise en cache des invites est désactivée au niveau du projet. Aucun élément de votre requête n’est réutilisé d’une requête à l’autre.
- En mémoire uniquement
- Le serveur d’inférence conserve des états clé-valeur transitoires dans la mémoire GPU pendant le traitement des requêtes. Rien n’est écrit sur disque ; la mémoire est recyclée en continu.
- Aucune mise en cache
- Aucune mise en cache des invites n’est utilisée pour ce modèle.
Disponibilité par offre
| Modèle | Basic | Pro | Premium | Enterprise |
|---|---|---|---|---|
| Gemini 3.8 Flash | ✓ | ✓ | ✓ | ✓ |
| Gemini 3.8 Flash · Zero Data Retention | — | — | — | ✓ |
| GPT-5.6 Terra | — | — | ✓ | ✓ |
| Claude 5 Sonnet | — | — | ✓ | ✓ |
| Qwen 3.8 · Zero Data Retention | — | ✓ | ✓ | ✓ |
Comportement de basculement
Si le modèle cloud standard sélectionné est temporairement indisponible, le Service peut réessayer votre requête de manière transparente avec un autre modèle de pointe afin de ne pas interrompre votre travail. L’ordre de basculement est le suivant :
- 1 Gemini 3.8 Flash →
- 2 GPT-5.6 Terra →
- 3 Claude 5 Sonnet
- Le basculement s’applique uniquement entre les modèles cloud standard ci-dessus.
- Les modèles à conservation nulle des données et les modèles auto-hébergés ne basculent jamais vers un autre fournisseur : si le modèle sélectionné est indisponible, la requête échoue au lieu d’envoyer vos données hors du périmètre choisi.
FAQ
- Quel modèle dois-je choisir ?
- Le modèle par défaut (recommandé) offre le meilleur équilibre entre qualité, rapidité et coût pour la recherche juridique. Choisissez le modèle à conservation nulle des données lorsqu’un mandat ou les recommandations de votre ordre professionnel exigent que les invites ne soient jamais conservées par un fournisseur tiers ; choisissez le modèle auto-hébergé lorsque les données ne doivent parvenir à aucun fournisseur d’IA tiers — il applique également une conservation nulle des données et est exploité par DirectCase. Aucun des deux ne bascule jamais vers un autre fournisseur.
- Que garantit réellement la conservation nulle des données ?
- Le fournisseur ne conserve au repos ni vos invites ni les réponses du modèle après le renvoi de la réponse, ne les utilise pas à des fins d’entraînement et, dans notre configuration, la mise en cache des invites est désactivée et le traitement est limité à l’UE. Cela ne modifie pas les données conservées par DirectCase lui-même (l’historique de vos conversations, supprimé après 90 jours conformément à l’ATD).
- Les fournisseurs d’IA entraînent-ils leurs modèles sur mes données ?
- Non. Nos contrats et configurations avec chaque fournisseur excluent tout entraînement sur votre contenu, et la même interdiction s’impose à DirectCase lui-même — voir les Conditions générales et l’ATD.
- L’hébergeur GPU voit-il mes invites destinées aux modèles auto-hébergés ?
- L’hébergeur GPU nous loue du matériel ; les poids du modèle, le serveur d’inférence et ses journaux sont exploités par DirectCase. L’hébergeur n’intervient pas en qualité de fournisseur de modèles. Il figure dans notre ATD en tant que sous-traitant ultérieur d’infrastructure, comme nos autres hébergeurs.
- Que se passe-t-il lorsque les modèles figurant sur cette page changent ?
- L’ajout, le retrait ou la mise à niveau d’un modèle d’un fournisseur déjà indiqué ici constitue une mise à jour opérationnelle : cette page est mise à jour et vos droits restent inchangés. Le recours à un nouveau fournisseur d’IA appelé à traiter vos données, ou le retrait du statut de conservation nulle des données d’un modèle, constitue une modification substantielle : nous en informons les utilisateurs concernés par courriel au moins 30 jours à l’avance, avec un droit de résiliation, conformément aux Conditions générales.