Souveräne KI-Infrastruktur

The Sovereign
AI Gateway.

Ein Endpunkt zu allen KI-Modellen, betrieben in Europa, mit nutzungsbasierter Abrechnung.

Mit 5 € Startguthaben direkt loslegen.

Souveränes Modell-Routing Eine OpenAI-kompatible Anfrage erreicht noirdoc über api.noirdoc.de/v1, wird gegen Regeln geprüft, maskiert und protokolliert und zu den Anbietern unter Vertrag geroutet: Azure, Google Vertex, IONOS, weber.cloud, AKI.IO, Infercom, TensorX — weitere EU-Anbieter folgen. Deine Anwendung api.noirdoc.de/v1 noirdoc Regeln · Maskierung · Protokoll Azure Google Vertex IONOS weber.cloud AKI.IO Infercom TensorX + EU-Anbieter
Schnittstelle zu allen Modellen
1 Schnittstelle zu allen Modellen
Zeile Code zur Integration
1 Zeile Code zur Integration
Monate Wartezeit auf Verträge
0 Monate Wartezeit auf Verträge

01 · Kontrolle

Startet wie ein Prototyp.
Skaliert bis Enterprise-Compliance.

Einmal integriert, entscheidest du jederzeit neu, welches Modell du wo nutzt und was es kosten darf.

Enterprise Quotas.

Rechenkapazität in Europa ist begrenzt. Mit uns startest du direkt mit Enterprise Availability.

eigener Start
über noirdoc

Deterministic Failover.

Automatischer Wechsel bei Ausfall — strikt innerhalb deiner Compliance-Leitplanken.

IONOS → AKI.IO

Hard EU Residency.

Geografisch garantierte Endpunkte. Kein stilles Routing in Ausweichregionen.

EU-Hosted

Granular Budgeting.

Automatische Hard Caps pro Key für saubere Kostenrechnung pro Projekt oder Kunde.

310 € belegt Cap · 500 €

So sieht das im Account aus

key_mandanten

Anbieter
nur mit § 203-Vereinbarung
Region
Deutschland
Maskierung
an
Limit 500 € / Monat

key_entwicklung

Modelle
nur Open Source
Region
EU
Maskierung
aus
Limit 50 € / Monat

key_marketing

Anbieter
alle im Katalog
Modelle
alle frei
Maskierung
aus
Limit 2.000 € / Monat

Modelle & Provider

Ein Zugang zu einer großen Modellauswahl.

Die OpenAI-kompatible API ermöglicht den Zugriff auf Modelle verschiedener Provider — mit transparenter Datenresidenz. Wir ersetzen eigene Konten und Verträge durch einen zentralisierten Zugang.

GPT-5 GPT-OSS Gemini Llama Qwen Mistral Gemma DeepSeek GLM Kimi Apertus FLUX Whisper

52 Modelle · 7 Anbieter · Residenz DE/EU

Integration

Drop-In Replacement für alle OpenAI kompatible Anwendungen.

Nach einmaliger Konfiguration übernehmen wir das Routing, alles andere ist wie gehabt.

  • Kompatibel mit allen OpenAI-SDKs
  • Keys können auf Provider und/oder Modelle beschränkt werden
  • Smartes Routing inklusive
Zur Quickstart-Doku →
python · openai sdk api.noirdoc.de/v1
from openai import OpenAI

client = OpenAI(
    # eine Zeile — mehr nicht
    base_url="https://api.noirdoc.de/v1",
    api_key=os.environ["NOIRDOC_KEY"],
)

response = client.chat.completions.create(
    model="gpt-5.4",  # Anbieter & Modell
    messages=[{"role": "user", "content": "Hallo"}],
)

02 · Compliance

Gebaut für Verschwiegenheit.

AVV, Verschwiegenheitserklärung und Zero Data Retention sind bei uns Standard — damit sogar Anwälte, Steuerberater und Ärzte bedenkenlos arbeiten können.

ZERO RETENTION § 203 AVV

By Contract.

AVV nach DSGVO und Verschwiegenheitserklärung nach § 203 StGB gehören zum Standardvertrag. Erfüllen Anbieter die Anforderungen für Berufsgeheimnisträger nicht, filtern wir sie raus.

  • AVV · beim Zugang
  • § 203 · gegengezeichnet
  • deutsches Recht

By Architecture.

Durch Zero Data Retention werden Inhalte bei uns nicht gespeichert und nicht fürs Training genutzt. Jede Anfrage wird protokolliert und auf Wunsch werden personenbezogene Daten zu <<PERSON_1>> maskiert, bevor sie das Modell erreichen.

Mask Docs →

03 · Preise

Listenpreis ohne Aufschlag.

Du zahlst nur, was du benutzt — und auch nur zu den Listenpreisen der Anbieter.

Live-Abrechnung.

Kosten sind minutengenau sichtbar im Account.

ABRECHNUNG 14:02 · Luna 0,42 14:03 · Llama 0,03 14:05 · Sol 1,88 14:05 · Kimi 0,11 14:06 · Luna 0,01

Budget pro API-Key.

Jeder API-Key bekommt ein Budget, bei dem wir Kosten sofort stoppen.

Limit · 500 € mvp_staging verbraucht · 312 €

Günstigere Modelle.

Nun nutze das richtige Modell für den jeweiligen Task.

−45 %
Aufschlag, Grundgebühr, Mindestabnahme
0 € Aufschlag, Grundgebühr, Mindestabnahme
für AVV und § 203-Vereinbarung
0 € für AVV und § 203-Vereinbarung
Base-URL zurücktauschen, fertig
Kein Lock-in Base-URL zurücktauschen, fertig

Der Katalog.

41 Modelle

€ · 1M Token Input Cache Read Cache Write Output
GPT-5.6 Sol Azure · EU
3,88 0,388 4,85 19,37 ab 272K Input-Token ab 272K 7,76 0,776 9,70 29,06

Stärkstes Modell der GPT-5.6-Familie — extended Reasoning, agentische Workflows und Code für anspruchsvollste Workloads.

GPT-5.6 Terra Azure · EU
1,95 0,195 2,44 11,60 ab 272K Input-Token ab 272K 3,90 0,39 4,88 17,46

Ausgewogenes Modell der 5.6-Familie — Leistung auf GPT-5.5-Niveau zu deutlich geringeren Kosten.

GPT-5.6 Luna Azure · EU
0,20 0,02 0,25 1,18 ab 272K Input-Token ab 272K 0,40 0,04 0,50 1,77

Schnellstes und günstigstes 5.6-Modell — für hohe Volumina und latenzkritische Anwendungen.

GPT-5.4 Azure · EU
2,43 0,243 — 14,53 ab 272K Input-Token ab 272K 4,86 0,486 — 21,80

Frontier-Modell für anspruchsvolles Reasoning, agentische Workflows und komplexe Produktionslasten.

GPT-5.4 mini Azure · EU
0,73 0,075 — 4,35

Kompakte GPT-5.4-Variante für hohe Durchsätze zu geringen Kosten — solide bei Standardaufgaben.

GPT-5 mini Azure · EU
0,26 0,0256 — 1,99

Kompakte GPT-5-Variante für hohe Durchsätze zu geringen Kosten — solide bei Standardaufgaben.

Qwen3-Coder-Next (80B) IONOS · DE
0,15 — — 0,80

Spezialisiertes Code-Modell für Generierung, Refactoring und agentische Dev-Workflows.

FLUX.1 [schnell] IONOS · DE
0,032 pro Bild

Schnelle Text-zu-Bild-Generierung — auf kurze Wartezeiten und hohe Volumina ausgelegt.

FLUX.2 [klein] IONOS · DE
0,001 0,014 pro erste Mpx

Neue FLUX-Generation für Text-zu-Bild — kompaktes Modell für schnelle Bildgenerierung.

FLUX.2 [klein] weber.cloud · DE
0,005 pro Bild

Neue FLUX-Generation für Text-zu-Bild — kompaktes Modell für schnelle Bildgenerierung.

FLUX.2 [klein] Edit weber.cloud · DE
0,01 pro Bild

Bildbearbeitung der FLUX.2-Reihe — gezielte Änderungen an bestehenden Bildern per Prompt.

Whisper Azure · EU
0,0065 pro Minute

OpenAIs Spracherkennung — robuste Transkription über viele Sprachen und Akzente hinweg.

TTS Azure · EU
13,18 pro 1M Zeichen

OpenAIs Sprachsynthese — natürlich klingende Stimmen für Vorlesefunktionen, Ansagen und Assistenten.

TTS HD Azure · EU
31,90 pro 1M Zeichen

Text-zu-Sprache in höherer Audioqualität — für Produktionen, in denen die Stimme im Vordergrund steht.

Whisper Large v3 Infercom · EU
0,10 pro Minute

OpenAIs Spracherkennung — robuste Transkription über viele Sprachen und Akzente hinweg.

Paraphrase Multilingual MPNet IONOS · DE
0,01 pro 1M Token

Mehrsprachige Embeddings für Ähnlichkeitssuche und RAG — kompakt und schnell.

BGE Large EN v1.5 IONOS · DE
0,015 pro 1M Token

Starke englische Embeddings für hochwertige Retrieval-Pipelines.

BGE-M3 IONOS · DE
0,02 pro 1M Token

Mehrsprachiges Embedding-Modell mit langem Kontext — vielseitig für RAG.

Qwen3-VL Embedding-8B IONOS · DE
0,10 pro 1M Token

Großes multimodales Embedding-Modell für anspruchsvolle Such- und RAG-Anwendungen.

Qwen3-VL Reranker-8B IONOS · DE
0,04 pro 1M Token

Reranker für präzisere Treffer in RAG-Pipelines — ordnet Suchergebnisse neu.

E5 Mistral 7B Infercom · EU
0,13 pro 1M Token

Embedding-Modell auf Mistral-7B-Basis — hochwertige Vektoren für Retrieval und RAG-Pipelines.

Jetzt loslegen.

Mit 5 € Startguthaben direkt auf alle Modelle zugreifen. Fragen vorab klärt der Vertrieb im Gespräch.

Anmelden →

Unser Angebot richtet sich ausschließlich an Gewerbetreibende, nicht an Endverbraucher. Alle Preise verstehen sich zuzüglich gesetzlicher Umsatzsteuer.

Was uns antreibt

Souverän sein, bedeutet
nicht abhängig zu sein.

Künstliche Intelligenz entscheidet künftig mit — über Prozesse, Mandate, Diagnosen, ganze Branchen. Wer sie unkontrolliert nutzt, liefert sich mit seinen Daten und Know-How an wenige Konzerne außerhalb Europas aus.

Fortschritt darf keine Frage der Abhängigkeit sein. Deshalb bauen wir noirdoc — von München aus, damit jedes Unternehmen KI sicher und flexibel einsetzen kann.

Kontakt

Bereit für den nächsten Schritt?

Egal welche Modelle und welche Residenz du brauchst — wir machen es möglich.

Jetzt loslegen →

Fragen vorab? Vertrieb kontaktieren oder schreib uns: hello@noirdoc.de — wir antworten in der Regel innerhalb eines Werktags.