On this page
Documentation relative aux modèles d’IA

Modèles et fournisseurs d’IA

DirectCase génère des réponses et des résumés au moyen de modèles d’IA tiers et auto-hébergés. Cette page constitue la liste officielle et constamment à jour des fournisseurs d’IA avec lesquels nous travaillons et des modèles utilisés par le Service, y compris la manière dont chacun traite vos données. Elle est intégrée par référence à nos Conditions générales en tant que « Documentation relative aux modèles d’IA ».

Vue d’ensemble

Chaque modèle ci-dessous est associé à l’une des trois catégories de traitement des données décrivant ce qu’il advient de vos invites et des réponses du modèle chez le fournisseur :

Cette page est générée à partir du même registre que celui lu par notre application ; elle reflète donc les modèles effectivement en production. Vos droits contractuels relatifs à ces fournisseurs et modèles sont définis dans les Conditions générales ; le traitement de vos données à caractère personnel est régi par la Politique de confidentialité et l’ATD. Vous recherchez plutôt le connecteur de recherche ? Consultez la Documentation du connecteur MCP.

Catégories de traitement des données

Conservation nulle des données

Le fournisseur ne conserve au repos ni vos invites (Entrée) ni les réponses du modèle (Sortie) après le renvoi de la réponse et ne les utilise pas à des fins d’entraînement. Le traitement transitoire en mémoire, limité à la durée de la requête, ne constitue pas une conservation ; dans notre configuration ZDR, la mise en cache des invites et la journalisation des abus sont en outre désactivées, et le traitement est limité à l’UE. La ZDR décrit le traitement effectué par le fournisseur : DirectCase conserve néanmoins l’historique de vos conversations dans l’application (supprimé après 90 jours, conformément à l’ATD).

Auto-hébergé · Conservation nulle des données

Le modèle est un modèle à poids ouverts entièrement exploité par DirectCase sur une infrastructure que nous contrôlons ; il applique également une conservation nulle des données : vos invites et les sorties du modèle sont traitées en mémoire uniquement pendant la durée de la requête et ne sont jamais conservées au repos, journalisées ni utilisées à des fins d’entraînement. Elles ne parviennent jamais à un fournisseur tiers de modèles d’IA. L’hébergeur GPU fournit uniquement la puissance de calcul brute ; il n’intervient pas en qualité de fournisseur de modèles et n’accède pas à vos données en tant que service. Il figure dans notre ATD en tant que sous-traitant ultérieur d’infrastructure. DirectCase conserve néanmoins l’historique de vos conversations dans l’application (supprimé après 90 jours, conformément à l’ATD).

Standard

Le modèle s’exécute via l’API du fournisseur conformément à ses conditions commerciales. Les fournisseurs peuvent conserver les données d’API pendant une durée limitée (généralement à des fins de surveillance des abus), comme indiqué dans leurs politiques d’utilisation des données, mais ils n’utilisent pas les données d’API de niveau professionnel pour entraîner leurs modèles. Si votre mission exige que les invites ne soient jamais conservées par un fournisseur tiers, choisissez un modèle à conservation nulle des données ou auto-hébergé.

Fournisseurs

Les fournisseurs participant à la fourniture des fonctionnalités d’IA, avec des liens vers les conditions qui les régissent. Les fournisseurs qualifiés de sous-traitants ultérieurs figurent également dans le tableau des sous-traitants ultérieurs de notre ATD (Annexe A des Conditions).

Fournisseur Données traitées dans Rôle Sous-traitant ultérieur Conditions
Google LLC (Google Cloud Vertex AI)

Traitement dans l’UE disponible : la configuration à conservation nulle des données s’exécute dans un projet Vertex AI dédié dans l’UE, avec résidence des données et traitement ML dans l’UE.

Global routing (standard) / EU (Zero Data Retention project) Fournisseur de modèles d’IA Oui
OpenAI, Inc. USA Fournisseur de modèles d’IA Oui
Anthropic, PBC USA Fournisseur de modèles d’IA Oui
DirectCase s.r.o. (self-hosted)

Modèles à poids ouverts entièrement exploités par DirectCase (vLLM). Les invites et les sorties ne parviennent jamais à un fournisseur tiers de modèles ; la puissance de calcul GPU est louée auprès de RunPod uniquement à titre d’infrastructure.

EU Exploitant de modèles auto-hébergés Non
RunPod, Inc.

Fournit la puissance de calcul GPU pour les modèles auto-hébergés de DirectCase. Infrastructure uniquement : aucun accès aux invites ou aux sorties en qualité de fournisseur de modèles ; les poids et l’inférence sont exploités par DirectCase.

EU Infrastructure GPU Oui
Hetzner Online GmbH

Hébergement principal de l’application et des données (indiqué dans l’ATD de DirectCase). N’est pas un fournisseur de modèles d’IA.

EU Infrastructure d’hébergement Oui
Amazon Web Services, Inc.

Infrastructure cloud auxiliaire (indiquée dans l’ATD de DirectCase). N’est pas un fournisseur de modèles d’IA.

EU Infrastructure d’hébergement Oui

Modèles

Les modèles actuellement disponibles dans le Service, regroupés par fournisseur. Les offres dans lesquelles un modèle est disponible sont indiquées pour chaque modèle ; consultez Disponibilité par offre pour la matrice complète.

Google Cloud Vertex AI

Les modèles Gemini s’exécutent sur Google Cloud Vertex AI (jamais dans les applications Gemini grand public ni via l’API développeur gratuite). Nous exploitons deux projets Google Cloud distincts : un projet standard avec routage mondial et un projet dédié dans l’UE, configuré pour la conservation nulle des données et servant exclusivement le modèle ZDR.

Gemini 3.8 Flash gemini-3.8-flash Par défaut Recommandé
Standard

Modèle de pointe rapide de Google exécuté sur Google Cloud Vertex AI. Modèle par défaut et recommandé, il offre un raisonnement juridique robuste sur de longs documents avec une faible latence.

Mise en cache implicite Routage mondial (peut inclure les États-Unis) BasicProPremiumEnterprise
Gemini 3.8 Flash · Zero Data Retention gemini-3.8-flash
Conservation nulle des données

Le même Gemini 3.8 Flash, fourni depuis un projet Vertex AI dédié dans l’UE et configuré pour la conservation nulle des données : mise en cache des invites et journalisation des abus désactivées, avec résidence des données et traitement ML dans l’UE. Aucun basculement entre fournisseurs : si le modèle est indisponible, la requête échoue au lieu de sortir du périmètre ZDR.

Mise en cache désactivée Hébergé dans l’UE Enterprise Aucun basculement entre fournisseurs

OpenAI

Les modèles GPT sont accessibles via l’API OpenAI conformément aux conditions commerciales d’OpenAI. Les données d’API ne sont pas utilisées pour entraîner les modèles d’OpenAI.

GPT-5.6 Terra gpt-5.6-terra
Standard

Modèle phare d’OpenAI via l’API OpenAI. Sa grande fenêtre de contexte convient à l’examen de plusieurs documents.

Aucune mise en cache Hébergé aux États-Unis PremiumEnterprise

Anthropic

Les modèles Claude sont accessibles via l’API Anthropic conformément aux conditions commerciales d’Anthropic. Les données d’API ne sont pas utilisées pour entraîner les modèles d’Anthropic.

Claude 5 Sonnet claude-sonnet-5
Standard

Claude d’Anthropic via l’API Anthropic. Rédaction et analyse rigoureuses, fidèles aux citations.

Aucune mise en cache Hébergé aux États-Unis PremiumEnterprise

DirectCase self-hosted

Modèles à poids ouverts que nous exécutons nous-mêmes avec vLLM sur une infrastructure GPU louée. DirectCase contrôle les poids, la pile d’inférence et les journaux ; aucun fournisseur tiers de modèles d’IA n’intervient. Conservation nulle des données : les invites et les sorties sont traitées uniquement en mémoire et ne sont jamais conservées, journalisées ni utilisées à des fins d’entraînement.

Qwen 3.8 · Zero Data Retention qwen3.8-27b
Auto-hébergé · Conservation nulle des données

Modèle à poids ouverts entièrement exploité par DirectCase sur notre propre infrastructure GPU (vLLM). Conservation nulle des données : les invites et les sorties sont traitées uniquement en mémoire et ne sont jamais conservées, journalisées ni utilisées à des fins d’entraînement ; elles ne parviennent jamais à un fournisseur tiers de modèles — l’hébergeur GPU fournit uniquement la puissance de calcul. Aucun basculement entre fournisseurs : si le modèle est indisponible, la requête échoue au lieu d’envoyer vos données à un fournisseur tiers.

En mémoire uniquement Hébergé dans l’UE ProPremiumEnterprise Aucun basculement entre fournisseurs

Modèles internes

Modèles utilitaires utilisés en arrière-plan par le Service (pour nommer les fils de discussion). Ils traitent le même contenu conversationnel selon les mêmes conditions du fournisseur et les mêmes engagements de non-entraînement que les modèles de conversation.

Modèle Modèle du fournisseur Finalité Traitement des données
Qwen 3.8 (chat titles) qwen3.8-27b Internal utility model that names chat threads. Self-hosted: only the first 10,000 characters of the opening message are used, and on timeout the title falls back to a local heuristic — never to a cloud model. Auto-hébergé · Conservation nulle des données

Lieu de conservation de vos données

Le lieu d’exécution des modèles ne représente qu’une partie de la situation : voici où DirectCase conserve lui-même vos données :

Application et bases de données
L’application DirectCase, ses bases de données (y compris l’historique de vos conversations) et le corpus de sources juridiques fonctionnent sur l’infrastructure Hetzner dans l’UE.
Fichiers que vous téléversez
Stockés dans Amazon S3 au sein de l’UE.
Sauvegardes
Les sauvegardes des bases de données sont chiffrées selon AES-256 avant de quitter notre infrastructure et stockées dans Amazon S3 au sein de l’UE.
Modèles auto-hébergés
Exécutés sur une capacité GPU louée auprès de RunPod dans l’UE. DirectCase exploite le modèle, le serveur d’inférence et ses journaux ; l’hébergeur GPU fournit uniquement la puissance de calcul.

Mise en cache des invites

La mise en cache des invites conserve des états de calcul intermédiaires afin d’éviter de retraiter un contexte répété. Elle ne signifie jamais que vos données sont partagées avec d’autres clients : les caches sont limités au compte DirectCase auprès du fournisseur. Catégories utilisées sur cette page :

Mise en cache implicite
Le fournisseur peut mettre en cache de manière transparente les préfixes d’invite répétés afin de réduire la latence et les coûts. Les entrées du cache ont une courte durée de vie et sont limitées à notre projet.
Mise en cache désactivée
Toute mise en cache des invites est désactivée au niveau du projet. Aucun élément de votre requête n’est réutilisé d’une requête à l’autre.
En mémoire uniquement
Le serveur d’inférence conserve des états clé-valeur transitoires dans la mémoire GPU pendant le traitement des requêtes. Rien n’est écrit sur disque ; la mémoire est recyclée en continu.
Aucune mise en cache
Aucune mise en cache des invites n’est utilisée pour ce modèle.

Disponibilité par offre

Modèle BasicProPremiumEnterprise
Gemini 3.8 Flash
Gemini 3.8 Flash · Zero Data Retention
GPT-5.6 Terra
Claude 5 Sonnet
Qwen 3.8 · Zero Data Retention

Comportement de basculement

Si le modèle cloud standard sélectionné est temporairement indisponible, le Service peut réessayer votre requête de manière transparente avec un autre modèle de pointe afin de ne pas interrompre votre travail. L’ordre de basculement est le suivant :

  1. 1 Gemini 3.8 Flash
  2. 2 GPT-5.6 Terra
  3. 3 Claude 5 Sonnet
  • Le basculement s’applique uniquement entre les modèles cloud standard ci-dessus.
  • Les modèles à conservation nulle des données et les modèles auto-hébergés ne basculent jamais vers un autre fournisseur : si le modèle sélectionné est indisponible, la requête échoue au lieu d’envoyer vos données hors du périmètre choisi.

FAQ

Quel modèle dois-je choisir ?
Le modèle par défaut (recommandé) offre le meilleur équilibre entre qualité, rapidité et coût pour la recherche juridique. Choisissez le modèle à conservation nulle des données lorsqu’un mandat ou les recommandations de votre ordre professionnel exigent que les invites ne soient jamais conservées par un fournisseur tiers ; choisissez le modèle auto-hébergé lorsque les données ne doivent parvenir à aucun fournisseur d’IA tiers — il applique également une conservation nulle des données et est exploité par DirectCase. Aucun des deux ne bascule jamais vers un autre fournisseur.
Que garantit réellement la conservation nulle des données ?
Le fournisseur ne conserve au repos ni vos invites ni les réponses du modèle après le renvoi de la réponse, ne les utilise pas à des fins d’entraînement et, dans notre configuration, la mise en cache des invites est désactivée et le traitement est limité à l’UE. Cela ne modifie pas les données conservées par DirectCase lui-même (l’historique de vos conversations, supprimé après 90 jours conformément à l’ATD).
Les fournisseurs d’IA entraînent-ils leurs modèles sur mes données ?
Non. Nos contrats et configurations avec chaque fournisseur excluent tout entraînement sur votre contenu, et la même interdiction s’impose à DirectCase lui-même — voir les Conditions générales et l’ATD.
L’hébergeur GPU voit-il mes invites destinées aux modèles auto-hébergés ?
L’hébergeur GPU nous loue du matériel ; les poids du modèle, le serveur d’inférence et ses journaux sont exploités par DirectCase. L’hébergeur n’intervient pas en qualité de fournisseur de modèles. Il figure dans notre ATD en tant que sous-traitant ultérieur d’infrastructure, comme nos autres hébergeurs.
Que se passe-t-il lorsque les modèles figurant sur cette page changent ?
L’ajout, le retrait ou la mise à niveau d’un modèle d’un fournisseur déjà indiqué ici constitue une mise à jour opérationnelle : cette page est mise à jour et vos droits restent inchangés. Le recours à un nouveau fournisseur d’IA appelé à traiter vos données, ou le retrait du statut de conservation nulle des données d’un modèle, constitue une modification substantielle : nous en informons les utilisateurs concernés par courriel au moins 30 jours à l’avance, avec un droit de résiliation, conformément aux Conditions générales.
Des questions sur un fournisseur, un modèle ou la conservation nulle des données pour votre organisation ? Nous contacter. Les dispositions contractuelles figurent dans les Conditions générales.