Cervus KI

Ihre KI.
Für Ihr Unternehmen.

Die einfache Art, KI im Unternehmen einzusetzen.
In Europa gehosted, DSGVO-konform und ohne großen technischen Aufwand.

DSGVO · EU AI Act · kein Training mit Ihren Daten · Context bis 256k

Unsere Modelle

Sorgfältig ausgewählte Modelle. Die hier aufgeführten Modelle entsprechen unserem aktuellen Angebot. Durch die laufende Evaluierung neuer KI-Modelle wächst und verbessert sich die Auswahl kontinuierlich.
qwen3.6-35b-a3bPreview

Unser Allrounder für den deutschsprachigen Raum: agentische Workflows, logisches Reasoning, riesiger Kontext. Die erste Wahl für die meisten Use-Cases.

Context
256K
Features
ReasoningTools
Sprachen
Deutsch, Englisch, Französisch und 70 weitere
gemma-4-26b-a4b-itPreview

Effizientes Modell für agentische Tasks bei geringerem Ressourcenbedarf, breite Sprachabdeckung.

Context
256K
Features
ReasoningTools
Sprachen
Deutsch, Englisch, Französisch, Chinesisch, Japanisch, Koreanisch
gpt-oss-120bPopular

Leistungsstark für komplexe, englischsprachige Aufgaben und anspruchsvolles Reasoning.

Context
128K
Features
ReasoningTools
Sprachen
Englisch
qwen3-embedding-8bPopular

Embeddings für semantische Suche, RAG und Klassifizierung. Das Fundament für KI auf Ihren eigenen Daten.

Context
Embedding
Features
Embeddings
Sprachen
Deutsch, Englisch, Französisch und 70 weitere

Tarife

Sofort loslegen

Kostenlos testen

0 €/2 Wochen

Erstmal unverbindlich ausprobieren, voller Zugang.

  • Context bis 14K
  • Tokens: 5 Mio. gesamt
  • Requests/Min: 20
  • Parallele Sessions: 2
  • Alle Modelle
  • OpenAI-kompatible Schnittstelle
  • Hosting EU, DSGVO
Jetzt kostenlos starten
Einstieg

Pro

60 €/Monat

Für kleine Teams und erste produktive Use-Cases.

  • Context bis 32K
  • Tokens: 40 Mio./Monat
  • Requests/Min: 60
  • Parallele Sessions: 6
  • Alle Modelle
  • OpenAI-kompatible Schnittstelle
  • Hosting EU, DSGVO
  • E-Mail-Support
Jetzt bestellen
Empfohlen

Business

225 €/Monat

Volle Leistung für produktive Workflows.

  • Context bis 256K
  • Tokens: 150 Mio./Monat
  • Requests/Min: 150
  • Parallele Sessions: 15
  • Alle Modelle
  • OpenAI-kompatible Schnittstelle
  • Hosting EU, DSGVO
  • Prio-Support und Onboarding
Jetzt bestellen
Individuell

Ihr Wunsch

Auf Anfrage

Dediziert, On-Prem, künftig API mit Token-Abrechnung.

  • Context individuell
  • Dedizierte GPU
  • Eigene oder dedizierte Modelle
  • Sessions nach Bedarf
  • Abrechnung per Abo oder (künftig) Token
  • Hosting EU oder On-Prem
  • Technischer Ansprechpartner
Anfragen

Token-Angaben gelten für die Standard-Modelle. Das Reasoning-Flagship verbraucht 2,5x.

Sagen Sie uns, welches Modell Sie brauchen.

Wir richten Ihren Zugang ein, die ersten zwei Wochen sind kostenlos. Unverbindlich, ohne Risiko. Noch unsicher? Wir empfehlen Ihnen das passende Modell für Ihren Anwendungsfall.

Modell anfragen

Erste zwei Wochen kostenlos · keine Vorab-Bindung

Welches Modell passt zu mir?

Für die meisten Fälle im deutschsprachigen Raum empfehlen wir qwen3.6. Schreiben Sie uns Ihren Anwendungsfall, wir beraten Sie.

Wo liegen meine Daten?

In Europa. Ihre Daten verlassen den europäischen Rechtsraum nicht.

Werden meine Eingaben zum Training genutzt?

Nein. Wir trainieren keine Modelle mit Ihren Eingaben und speichern sie nicht.

Funktioniert das mit meinen vorhandenen Werkzeugen?

Ja. Unsere Schnittstelle spricht den OpenAI-Standard und läuft mit n8n, Make und eigenen Anwendungen.