AI-modeller och leverantörer
DirectCase genererar svar och sammanfattningar med AI-modeller från tredje parter och självhostade AI-modeller. Denna sida är den auktoritativa och alltid aktuella förteckningen över de AI-leverantörer vi samarbetar med och de modeller som tjänsten använder — inklusive hur varje modell hanterar dina data. Den införlivas genom hänvisning i våra allmänna villkor som "AI-modelldokumentationen".
Översikt
Varje modell nedan är märkt med en av tre klasser för datahantering som beskriver vad som händer med dina prompter och modellens svar hos leverantören:
Denna sida genereras från samma register som vår applikation läser, så den återspeglar de modeller som faktiskt används i produktion. Dina avtalsenliga rättigheter kring dessa leverantörer och modeller anges i Allmänna villkor; hur vi behandlar personuppgifter omfattas av Integritetspolicy och DPA. Söker du i stället forskningskopplingen? Se Dokumentation för MCP-kopplingen.
Klasser för datahantering
Zero Data Retention
Leverantören lagrar inte dina prompter (Input) eller modellens svar (Output) i viloläge efter att svaret har returnerats och använder dem inte för träning. Tillfällig behandling i minnet, som endast existerar under begärans varaktighet, räknas inte som lagring; för vår ZDR-konfiguration är promptcaching dessutom inaktiverat och loggning för missbruksövervakning bortvald, och behandlingen är låst till EU. Observera att ZDR beskriver leverantörens hantering — DirectCase självt lagrar fortfarande din konversationshistorik i appen (raderas efter 90 dagar enligt DPA).
Självhostad · Zero Data Retention
Modellen är en modell med öppna vikter som drivs helt av DirectCase på infrastruktur som vi kontrollerar, och den har även Zero Data Retention: dina prompter och modellens utdata behandlas endast i minnet under begärans varaktighet och lagras aldrig i viloläge, loggas inte och används inte för träning. De når aldrig en AI-modellleverantör från tredje part. GPU-värden tillhandahåller endast rå beräkningskapacitet — den har ingen roll som modellleverantör och ingen åtkomst till dina data som tjänst; den anges som ett underbiträde för infrastruktur i vår DPA. Liksom för varje klass lagrar DirectCase självt fortfarande din konversationshistorik i appen (raderas efter 90 dagar enligt DPA).
Standard
Modellen körs på leverantörens API enligt leverantörens affärsvillkor. Leverantörer kan lagra API-data under en begränsad period (vanligtvis för missbruksövervakning) enligt vad som beskrivs i deras länkade policyer för dataanvändning, men använder inte API-data från företagsnivå för att träna sina modeller. Om ditt uppdrag kräver att prompter aldrig lagras av en tredjepartsleverantör, välj en modell med Zero Data Retention eller en självhostad modell.
Leverantörer
Leverantörerna som medverkar till AI-funktionerna, med länkar till de villkor som reglerar var och en av dem. Leverantörer som är markerade som underbiträden visas också i underbiträdestabellen i vår DPA (bilaga A till villkoren).
| Leverantör | Data behandlas i | Roll | Underbiträde | Villkor |
|---|---|---|---|---|
| Google LLC (Google Cloud Vertex AI) Behandling inom EU är tillgänglig: konfigurationen för Zero Data Retention körs i ett dedikerat EU-projekt i Vertex AI med datalagring och ML-behandling inom EU. | Global routing (standard) / EU (Zero Data Retention project) | AI-modellleverantör | Ja | |
| OpenAI, Inc. | USA | AI-modellleverantör | Ja | |
| Anthropic, PBC | USA | AI-modellleverantör | Ja | |
| DirectCase s.r.o. (self-hosted) Modeller med öppna vikter som drivs helt av DirectCase (vLLM). Prompter och utdata når aldrig en AI-modellleverantör från tredje part; GPU-kapacitet hyrs från RunPod uteslutande som infrastruktur. | EU | Operatör för självhostade modeller | Nej | |
| RunPod, Inc. Tillhandahåller GPU-kapacitet för modeller som DirectCase själv hostar. Endast infrastruktur — ingen modellleverantör har åtkomst till prompter eller utdata; vikter och inferens drivs av DirectCase. | EU | GPU-infrastruktur | Ja | |
| Hetzner Online GmbH Primär hosting av applikation och data (anges i DirectCases DPA). Inte en AI-modellleverantör. | EU | Hostinginfrastruktur | Ja | |
| Amazon Web Services, Inc. Stödjande molninfrastruktur (anges i DirectCases DPA). Inte en AI-modellleverantör. | EU | Hostinginfrastruktur | Ja |
Modeller
Modellerna som för närvarande är tillgängliga i tjänsten, grupperade efter leverantör. De abonnemang som en modell är tillgänglig på visas för varje modell; se Tillgänglighet per abonnemang för den fullständiga matrisen.
Google Cloud Vertex AI
Gemini-modeller körs på Google Cloud Vertex AI (aldrig i Gemini-apparna för konsumenter eller det kostnadsfria utvecklar-API:t). Vi driver två separata Google Cloud-projekt: ett standardprojekt med global dirigering och ett dedikerat EU-projekt konfigurerat för Zero Data Retention som uteslutande betjänar ZDR-modellen.
gemini-3.8-flash Standard Rekommenderad Googles snabba, avancerade modell som körs på Google Cloud Vertex AI. Standardmodellen och den rekommenderade modellen — stark juridisk slutledningsförmåga för långa dokument med låg latens.
gemini-3.8-flash Samma Gemini 3.8 Flash, som tillhandahålls från ett dedikerat EU-projekt i Vertex AI konfigurerat för Zero Data Retention: promptcaching är inaktiverad och loggning för missbruksövervakning har valts bort, med datalagring och ML-behandling inom EU. Ingen återgång mellan leverantörer — om modellen inte är tillgänglig misslyckas begäran i stället för att lämna ZDR-gränsen.
OpenAI
GPT-modeller nås via OpenAI API enligt OpenAI:s affärsvillkor. API-data används inte för att träna OpenAI:s modeller.
gpt-5.6-terra OpenAI:s flaggskeppsmodell via OpenAI API. Stort kontextfönster lämpat för granskning av flera dokument.
Anthropic
Claude-modeller nås via Anthropic API enligt Anthropics kommersiella villkor. API-data används inte för att träna Anthropics modeller.
claude-sonnet-5 Anthropics Claude via Anthropic API. Omsorgsfull, källtrogen utformning och analys.
DirectCase self-hosted
Modeller med öppna vikter som vi själva kör med vLLM på hyrd GPU-infrastruktur. DirectCase kontrollerar vikterna, inferensstacken och loggarna; ingen AI-modellleverantör från tredje part är involverad vid något tillfälle. Zero Data Retention: prompter och utdata behandlas endast i minnet och lagras, loggas eller används aldrig för träning.
qwen3.8-27b En modell med öppna vikter som drivs helt av DirectCase på vår egen GPU-infrastruktur (vLLM). Zero Data Retention: prompter och utdata behandlas endast i minnet och lagras eller loggas aldrig och används aldrig för träning; de når aldrig en AI-modellleverantör från tredje part — GPU-värden tillhandahåller endast beräkningskapacitet. Ingen återgång mellan leverantörer — om modellen inte är tillgänglig misslyckas begäran i stället för att dina data skickas till en tredjepartsleverantör.
Interna modeller
Verktygsmodeller som tjänsten använder bakom kulisserna (namngivning av chatttrådar). De behandlar samma konversationsinnehåll enligt samma leverantörsvillkor och samma åtaganden om att inte träna på data som chattmodellerna.
| Modell | Leverantörsmodell | Syfte | Datahantering |
|---|---|---|---|
| Qwen 3.8 (chat titles) | qwen3.8-27b | Internal utility model that names chat threads. Self-hosted: only the first 10,000 characters of the opening message are used, and on timeout the title falls back to a local heuristic — never to a cloud model. | Självhostad · Zero Data Retention |
Var dina data finns
Var modellerna körs är bara halva bilden — här lagrar DirectCase självt dina data:
- Applikation och databaser
- DirectCase-applikationen, dess databaser (inklusive din konversationshistorik) och korpusen med juridiska källor körs på Hetzner-infrastruktur i EU.
- Filer som du laddar upp
- Lagras i Amazon S3 i EU.
- Säkerhetskopior
- Databassäkerhetskopior AES-256-krypteras innan de lämnar vår infrastruktur och lagras i Amazon S3 i EU.
- Självhostade modeller
- Körs på GPU-kapacitet som hyrs från RunPod i EU. DirectCase driver modellen, inferensservern och dess loggar; GPU-värden tillhandahåller endast beräkningskapacitet.
Promptcaching
Promptcaching lagrar mellanliggande beräkningstillstånd så att upprepad kontext inte behöver bearbetas på nytt. Caching innebär aldrig att dina data delas med andra kunder — cachar är begränsade till DirectCases konto hos leverantören. De klasser som används på denna sida:
- Implicit caching
- Leverantören kan transparent cacha upprepade promptprefix för att minska fördröjning och kostnad. Cacheposter är kortlivade och begränsade till vårt projekt.
- Caching inaktiverad
- All promptcaching är inaktiverad på projektnivå. Ingenting i din begäran återanvänds mellan begäranden.
- Endast i minnet
- Inferensservern behåller tillfälliga nyckel-värdetillstånd i GPU-minnet medan begäranden bearbetas. Ingenting skrivs till disk; minnet återvinns kontinuerligt.
- Ingen caching
- Ingen promptcaching används för denna modell.
Tillgänglighet per abonnemang
| Modell | Basic | Pro | Premium | Enterprise |
|---|---|---|---|---|
| Gemini 3.8 Flash | ✓ | ✓ | ✓ | ✓ |
| Gemini 3.8 Flash · Zero Data Retention | — | — | — | ✓ |
| GPT-5.6 Terra | — | — | ✓ | ✓ |
| Claude 5 Sonnet | — | — | ✓ | ✓ |
| Qwen 3.8 · Zero Data Retention | — | ✓ | ✓ | ✓ |
Återgångsbeteende
Om den vanliga molnmodellen du har valt tillfälligt inte är tillgänglig kan tjänsten transparent försöka din begäran igen med en annan ledande modell, så att ditt arbete inte avbryts. Återgångsordningen är:
- 1 Gemini 3.8 Flash →
- 2 GPT-5.6 Terra →
- 3 Claude 5 Sonnet
- Återgång gäller endast mellan de vanliga molnmodellerna ovan.
- Modellerna med Zero Data Retention och de självhostade modellerna återgår aldrig till en annan leverantör — om modellen du har valt inte är tillgänglig misslyckas begäran i stället för att skicka dina data utanför den gräns du valt.
Vanliga frågor
- Vilken modell ska jag välja?
- Standardmodellen (rekommenderad) erbjuder den bästa balansen mellan kvalitet, hastighet och kostnad för juridisk forskning. Välj modellen med Zero Data Retention när ett uppdrag eller din advokatsamfunds vägledning kräver att prompter aldrig lagras av en tredjepartsleverantör; välj den självhostade modellen när data inte alls får nå någon AI-leverantör från tredje part — även den har Zero Data Retention och drivs av DirectCase. Ingen av dem återgår någonsin till en annan leverantör.
- Vad garanterar Zero Data Retention egentligen?
- Att leverantören varken lagrar dina prompter eller modellens svar i viloläge efter att svaret har returnerats, inte använder dem för träning och — i vår konfiguration — har inaktiverat promptcaching och låst behandlingen till EU. Detta ändrar inte vad DirectCase självt lagrar (din konversationshistorik, som raderas efter 90 dagar enligt DPA).
- Tränar AI-leverantörerna på mina data?
- Nej. Våra avtal och konfigurationer med varje leverantör utesluter träning på ditt innehåll, och samma förbud är bindande för DirectCase självt — se de allmänna villkoren och DPA.
- Ser GPU-värden mina prompter för självhostade modeller?
- GPU-värden hyr ut hårdvara till oss; modellvikterna, inferensservern och dess loggar drivs av DirectCase. Värden har ingen roll som modellleverantör. Den anges som en underbiträdesleverantör för infrastruktur i vår DPA, precis som våra övriga hostingleverantörer.
- Vad händer när modellerna på denna sida ändras?
- Att lägga till, ta bort eller uppgradera en modell från en leverantör som redan anges här är en driftsuppdatering — denna sida uppdateras och inget förändras beträffande dina rättigheter. Att anlita en ny AI-leverantör som skulle behandla dina data, eller att återkalla Zero Data Retention-status för en modell, är en väsentlig förändring: vi underrättar berörda användare via e-post minst 30 dagar i förväg med rätt att säga upp avtalet, enligt de allmänna villkoren.