On this page
Dokumentation des KI-Modells

KI-Modelle und Anbieter

DirectCase erstellt Antworten und Zusammenfassungen mithilfe von KI-Modellen externer Anbieter und selbst gehosteten Modellen. Diese Seite enthält die maßgebliche, stets aktuelle Liste der KI-Anbieter, mit denen wir zusammenarbeiten, sowie der vom Dienst verwendeten Modelle – einschließlich Angaben dazu, wie jedes Modell Ihre Daten verarbeitet. Sie ist durch Verweis als „Dokumentation der KI-Modelle“ Bestandteil unserer Allgemeinen Geschäftsbedingungen.

Überblick

Jedes unten aufgeführte Modell ist mit einer von drei Datenverarbeitungsklassen gekennzeichnet, die beschreiben, was mit Ihren Eingabeaufforderungen und den Antworten des Modells beim Anbieter passiert:

Diese Seite wird aus derselben Registrierung generiert, die unsere Anwendung liest, sodass sie die tatsächlich in Produktion befindlichen Modelle widerspiegelt. Ihre vertraglichen Rechte im Zusammenhang mit diesen Anbieter und Modellen sind im Allgemeine Geschäftsbedingungen dargelegt; Die Art und Weise, wie wir personenbezogene Daten verarbeiten, wird durch das Datenschutzrichtlinie und das DPA abgedeckt. Suchen Sie stattdessen nach dem Forschungskonnektor? Siehe Dokumentation des MCP-Konnektors.

Datenverarbeitungsklassen

Keine Datenaufbewahrung

Der Anbieter speichert Ihre Eingabeaufforderungen (Eingabe) oder die Antworten des Modells (Ausgabe) nicht dauerhaft, nachdem die Antwort zurückgegeben wurde, und verwendet sie nicht für das Training. Eine vorübergehende In-Memory-Verarbeitung, die nur für die Dauer der Anfrage erfolgt, gilt nicht als Aufbewahrung; Für unsere ZDR-Konfiguration ist außerdem das Prompt-Caching deaktiviert, die Missbrauchsprotokollierung deaktiviert und die Verarbeitung an die EU gebunden. Beachten Sie, dass ZDR die Vorgehensweise des Anbieters beschreibt – DirectCase selbst speichert weiterhin Ihren Gesprächsverlauf in der App (laut DPA nach 90 Tagen gelöscht).

Selbstgehostet · Keine Datenaufbewahrung

Das Open-Weights-Modell wird vollständig von DirectCase auf einer von uns kontrollierten Infrastruktur betrieben und erfüllt ebenfalls Zero Data Retention: Ihre Prompts und die Modellausgaben werden nur für die Dauer der Anfrage im Arbeitsspeicher verarbeitet und niemals dauerhaft gespeichert, protokolliert oder zum Training verwendet. Sie erreichen keinen externen KI-Modellanbieter. Der GPU-Host stellt ausschließlich Rechenleistung bereit, übernimmt keine Modellanbieterrolle und hat keinen dienstbezogenen Zugriff auf Ihre Daten; im DPA ist er als Infrastruktur-Unterauftragsverarbeiter aufgeführt. DirectCase selbst speichert weiterhin Ihren Gesprächsverlauf in der App (gemäß DPA wird er nach 90 Tagen gelöscht).

Standard

Das Modell läuft auf der API des Anbieter zu dessen Geschäftsbedingungen. Anbieter können API-Daten für einen begrenzten Zeitraum aufbewahren (normalerweise zur Missbrauchsüberwachung), wie in ihren verknüpften Datennutzungsrichtlinien beschrieben, verwenden jedoch keine API-Daten der Unternehmensebene zum Trainieren ihrer Modelle. Wenn Ihr Auftrag erfordert, dass Eingabeaufforderungen niemals von einem Drittanbieter aufbewahrt werden, wählen Sie ein Modell ohne Datenaufbewahrung oder ein selbstgehostetes Modell.

Anbieter

Die Anbieter, die an der Bereitstellung von KI-Funktionen beteiligt sind, mit Links zu den jeweils geltenden Bedingungen. Anbieter, die als Unterauftragsverarbeiter gekennzeichnet sind, erscheinen auch in der Unterauftragsverarbeitertabelle unserer DPA (Anhang A der Geschäftsbedingungen).

Anbieter Daten verarbeitet in Rolle Unterauftragsverarbeiter Bedingungen
Google LLC (Google Cloud Vertex AI)

EU-Verarbeitung verfügbar: Die Zero Data Retention-Konfiguration läuft in einem dedizierten EU-Vertex-KI-Projekt mit EU-Datenresidenz und EU-ML-Verarbeitung.

Global routing (standard) / EU (Zero Data Retention project) Anbieter von KI-Modellen Ja
OpenAI, Inc. USA Anbieter von KI-Modellen Ja
Anthropic, PBC USA Anbieter von KI-Modellen Ja
DirectCase s.r.o. (self-hosted)

Open-Weights-Modelle, die vollständig von DirectCase (vLLM) betrieben werden. Eingabeaufforderungen und Ausgaben erreichen niemals einen externen Modellanbieter; GPU-Rechenleistung wird von RunPod nur als Infrastruktur gemietet.

EU Selbstgehosteter Betreiber Nein
RunPod, Inc.

Bietet GPU-Rechenleistung für selbstgehostete DirectCase-Modelle. Nur Infrastruktur – kein Zugriff des Modellanbieters auf Eingabeaufforderungen oder Ausgaben; Gewichtungen und Inferenz werden von DirectCase verwaltet.

EU GPU-Infrastruktur Ja
Hetzner Online GmbH

Primäres Anwendungs- und Datenhosting (aufgeführt im DirectCase DPA). Kein Anbieter von KI-Modellen.

EU Hosting-Infrastruktur Ja
Amazon Web Services, Inc.

Unterstützende Cloud-Infrastruktur (aufgeführt im DirectCase DPA). Kein Anbieter von KI-Modellen.

EU Hosting-Infrastruktur Ja

Modelle

Die derzeit im Service verfügbaren Modelle, gruppiert nach Anbieter. Die Pläne, für die ein Modell verfügbar ist, werden pro Modell angezeigt. Die vollständige Matrix finden Sie unter Verfügbarkeit nach Plan.

Google Cloud Vertex AI

Gemini-Modelle laufen auf Google Cloud Vertex AI (niemals die Gemini-Apps für Verbraucher oder die kostenlose Entwickler-API). Wir betreiben zwei separate Google Cloud-Projekte: ein Standardprojekt mit globalem Routing und ein dediziertes EU-Projekt, das für Zero Data Retention konfiguriert ist und ausschließlich das ZDR-Modell bedient.

Gemini 3.8 Flash gemini-3.8-flash Standard Empfohlen
Standard

Das Fast-Frontier-Modell von Google läuft auf Google Cloud Vertex AI. Das standardmäßige und empfohlene Modell – starke rechtliche Argumentation bei langen Dokumenten mit geringer Latenz.

Implizites Caching Globales Routing (kann die USA umfassen) BasicProPremiumEnterprise
Gemini 3.8 Flash · Zero Data Retention gemini-3.8-flash
Keine Datenaufbewahrung

Derselbe Gemini 3.8 Flash, bereitgestellt von einem speziellen EU-Vertex-KI-Projekt, das für Zero Data Retention konfiguriert ist: Prompt-Caching deaktiviert und Missbrauchsprotokollierung deaktiviert, mit EU-Datenresidenz und EU-ML-Verarbeitung. Kein herstellerübergreifender Fallback – wenn das Modell nicht verfügbar ist, schlägt die Anfrage fehl, anstatt die ZDR-Grenze zu verlassen.

Caching deaktiviert Gehostet in der EU Enterprise Kein herstellerübergreifender Fallback

OpenAI

Der Zugriff auf GPT-Modelle erfolgt über die OpenAI-API gemäß den Geschäftsbedingungen von OpenAI. API-Daten werden nicht zum Trainieren der OpenAI-Modelle verwendet.

GPT-5.6 Terra gpt-5.6-terra
Standard

Das Flaggschiffmodell von OpenAI über die OpenAI-API. Großes Kontextfenster, geeignet für die Überprüfung mehrerer Dokumente.

Kein Caching Gehostet in den USA PremiumEnterprise

Anthropic

Der Zugriff auf Claude-Modelle erfolgt über die Anthropic-API zu den kommerziellen Bedingungen von Anthropic. API-Daten werden nicht zum Trainieren der Modelle von Anthropic verwendet.

Claude 5 Sonnet claude-sonnet-5
Standard

Claude von Anthropic über die Anthropic-API. Sorgfältige, quellen- und zitattreue Entwürfe und Analysen.

Kein Caching Gehostet in den USA PremiumEnterprise

DirectCase self-hosted

Open-Weights-Modelle betreiben wir selbst mit vLLM auf einer gemieteten GPU-Infrastruktur. DirectCase steuert die Gewichte, den Inferenzstapel und die Protokolle; Zu keinem Zeitpunkt ist ein Drittanbieter von KI-Modellen involviert. Keine Datenaufbewahrung: Eingabeaufforderungen und Ausgaben werden nur im Speicher verarbeitet und niemals gespeichert, protokolliert oder für Training verwendet.

Qwen 3.8 · Zero Data Retention qwen3.8-27b
Selbstgehostet · Keine Datenaufbewahrung

Ein Open-Weights-Modell, das vollständig von DirectCase auf unserer eigenen GPU-Infrastruktur (vLLM) betrieben wird. Keine Datenaufbewahrung: Eingabeaufforderungen und Ausgaben werden nur im Speicher verarbeitet und niemals gespeichert, protokolliert oder für Training verwendet. Sie erreichen nie einen externen Modellanbieter – der GPU-Host stellt nur Rechenleistung bereit. Kein herstellerübergreifender Fallback – wenn das Modell nicht verfügbar ist, schlägt die Anfrage fehl, anstatt Ihre Daten an einen Drittanbieter zu senden.

Nur im Speicher Gehostet in der EU ProPremiumEnterprise Kein herstellerübergreifender Fallback

Interne Modelle

Hilfsmodelle, die der Dienst im Hintergrund verwendet (etwa zur Benennung von Chat-Threads). Sie verarbeiten dieselben Gesprächsinhalte zu denselben Anbieterbedingungen und mit denselben Zusagen, Daten nicht zum Training zu verwenden, wie die Chatmodelle.

Modell Anbietermodell Zweck Datenverarbeitung
Qwen 3.8 (chat titles) qwen3.8-27b Internal utility model that names chat threads. Self-hosted: only the first 10,000 characters of the opening message are used, and on timeout the title falls back to a local heuristic — never to a cloud model. Selbstgehostet · Keine Datenaufbewahrung

Wo Ihre Daten gespeichert sind

Der Ort, an dem die Modelle ausgeführt werden, ist nur die halbe Miete – hier speichert DirectCase selbst Ihre Daten:

Anwendung und Datenbanken
Die DirectCase-Anwendung, ihre Datenbanken (einschließlich Ihres Gesprächsverlaufs) und das Rechtsquellenkorpus laufen auf der Hetzner-Infrastruktur in der EU.
Dateien, die Sie hochladen
Gespeichert in Amazon S3 in der EU.
Backups
Datenbanksicherungen werden AES-256-verschlüsselt, bevor sie unsere Infrastruktur verlassen, und in Amazon S3 in der EU gespeichert.
Selbstgehostete Modelle
Läuft auf GPU-Kapazität, die wir von RunPod in der EU mieten. DirectCase betreibt das Modell, den Inferenzserver und dessen Protokolle; der GPU-Host stellt ausschließlich Rechenleistung bereit.

Prompt-Caching

Beim Prompt-Caching werden Zwischenzustände der Berechnungen gespeichert, sodass wiederholter Kontext nicht erneut verarbeitet werden muss. Caching bedeutet niemals, dass Ihre Daten mit anderen Kunden geteilt werden – Caches sind auf das Konto von DirectCase beim Anbieter beschränkt. Die auf dieser Seite verwendeten Klassen:

Implizites Caching
Der Anbieter kann wiederholte Aufforderungspräfixe transparent zwischenspeichern, um Latenz und Kosten zu reduzieren. Cache-Einträge sind kurzlebig und auf unser Projekt beschränkt.
Caching deaktiviert
Das gesamte Prompt-Caching ist auf Projektebene deaktiviert. Nichts über Ihre Anfrage wird in mehreren Anfragen wiederverwendet.
Nur im Speicher
Der Inferenzserver speichert während der Verarbeitung von Anforderungen vorübergehende Schlüsselwertzustände im GPU-Speicher. Es wird nichts auf die Festplatte geschrieben; Der Speicher wird kontinuierlich recycelt.
Kein Caching
Für dieses Modell wird kein Prompt-Caching verwendet.

Verfügbarkeit nach Plan

Modell BasicProPremiumEnterprise
Gemini 3.8 Flash
Gemini 3.8 Flash · Zero Data Retention
GPT-5.6 Terra
Claude 5 Sonnet
Qwen 3.8 · Zero Data Retention

Fallback-Verhalten

Wenn das von Ihnen ausgewählte Standard-Cloud-Modell vorübergehend nicht verfügbar ist, kann der Dienst Ihre Anfrage transparent mit einem anderen Frontier-Modell erneut versuchen, sodass Ihre Arbeit nicht unterbrochen wird. Die Fallback-Reihenfolge lautet:

  1. 1 Gemini 3.8 Flash
  2. 2 GPT-5.6 Terra
  3. 3 Claude 5 Sonnet
  • Der Fallback gilt nur zwischen den oben genannten Standard-Cloud-Modellen.
  • Die Zero Data Retention- und Self-Hosted-Modelle greifen nie auf einen anderen Anbieter zurück – wenn das von Ihnen ausgewählte Modell nicht verfügbar ist, schlägt die Anfrage fehl, anstatt Ihre Daten über die von Ihnen gewählte Grenze hinaus zu senden.

FAQ

Welches Modell soll ich wählen?
Das Standardmodell (empfohlen) bietet das beste Gleichgewicht zwischen Qualität, Geschwindigkeit und Kosten für Rechtsrecherchen. Wählen Sie das Modell „Zero Data Retention“, wenn ein Mandat oder die Richtlinien Ihrer Rechtsanwaltskammer erfordern, dass Eingabeaufforderungen niemals von einem Drittanbieter gespeichert werden. Wählen Sie das selbstgehostete Modell, wenn die Daten überhaupt keinen KI-Drittanbieter erreichen dürfen – es ist ebenfalls Zero Data Retention und wird von DirectCase betrieben. Keines der beiden Modelle greift jemals auf einen anderen Anbieter zurück.
Was garantiert Zero Data Retention eigentlich?
Der Anbieter speichert nach Rückgabe der Antwort weder Ihre Prompts noch die Antworten des Modells dauerhaft, verwendet sie nicht zum Training und hat in unserer Konfiguration das Prompt-Caching deaktiviert sowie die Verarbeitung auf die EU beschränkt. Dies ändert nichts daran, was DirectCase selbst speichert (Ihren Gesprächsverlauf, der gemäß DPA nach 90 Tagen gelöscht wird).
Trainieren die KI-Anbieter anhand meiner Daten?
Nein. Unsere Verträge und Konfigurationen mit allen Anbietern schließen ein Training mit Ihren Inhalten aus. Dasselbe Verbot gilt auch für DirectCase selbst; siehe Allgemeine Geschäftsbedingungen und DPA.
Sieht der GPU-Host meine Eingabeaufforderungen für selbstgehostete Modelle?
Der GPU-Host vermietet uns Hardware; Die Modellgewichte, der Inferenzserver und seine Protokolle werden von DirectCase betrieben. Der Host hat keine Modellanbieterrolle. Es ist wie unsere anderen Hosting-Anbieter in unserem DPA als Infrastruktur-Unterauftragsverarbeiter aufgeführt.
Was passiert, wenn sich die Modelle auf dieser Seite ändern?
Das Hinzufügen, Entfernen oder Upgraden eines Modells von einem hier bereits aufgeführten Anbieter ist eine betriebliche Aktualisierung – diese Seite wird aktualisiert und an Ihren Rechten ändert sich nichts. Die Beauftragung eines neuen KI-Anbieters, der Ihre Daten verarbeiten würde, oder der Entzug des Zero Data Retention-Status von einem Modell stellt eine wesentliche Änderung dar: Wir benachrichtigen betroffene Benutzer mindestens 30 Tage im Voraus per E-Mail mit einem Kündigungsrecht, wie in den Allgemeinen Geschäftsbedingungen dargelegt.
Fragen zu einem Anbieter, einem Modell oder Zero Data Retention für Ihre Organisation? Kontaktieren Sie uns. Vertragsdetails finden Sie im Allgemeine Geschäftsbedingungen.