Modelle und Anbieter.
Modelle wie GPT, Gemini, Qwen, DeepSeek und Claude laufen bei uns in Rechenzentren in Deutschland und der EU.
Anbieter.
Über einen Endpunkt erhältst du Zugriff auf verschiedene Anbieter.
Über Microsoft Azure nutzt du die Modelle von OpenAI, von GPT bis Whisper. Microsoft stellt sie über die OpenAI-Partnerschaft in der EU Data Zone bereit.
- Residenz
- EU-Datenresidenz über Azure Foundry
Über Google Vertex AI nutzt du die Gemini-Modelle von Google. Vertex AI ist die Unternehmensplattform, über die Google seine Modelle mit EU-Endpunkt bereitstellt.
- Residenz
- EU-Datenresidenz über Vertex AI
IONOS gehört zu den großen deutschen Cloud-Anbietern und betreibt im AI Model Hub offene Modelle. Im Katalog stehen davon Sprachmodelle, Embeddings und Bildmodelle unter einem deutschen Vertrag.
- Residenz
- Deutsche Rechenzentren
weber.cloud betreibt Rechenzentren und Hardware in eigener Hand und stellt darauf offene Modelle bereit. Sprach- und Bildmodelle laufen auf souveräner Infrastruktur, die dem Betreiber selbst gehört.
- Residenz
- Eigene Rechenzentren in Deutschland
AKI.IO ist ein Inferenz-Anbieter aus Berlin mit GPU-Infrastruktur in der EU. Ein großer Teil der offenen Sprachmodelle im Katalog läuft auf dieser Infrastruktur.
- Residenz
- EU-Rechenzentren
Infercom ist ein Inferenz-Anbieter aus Luxemburg für offene Modelle. Sprachmodelle, Transkription und Embeddings laufen dort unter einem europäischen Vertrag.
- Residenz
- EU-Rechenzentren
TensorX ist ein Inferenz-Anbieter aus Dublin mit Infrastruktur in Irland und Finnland. Kimi K3 von Moonshot AI kommt über diese Route in den Katalog.
- Residenz
- EU-Rechenzentren (Irland, Finnland)
Modelle.
Viele Modelle bieten wir über mehrere Anbieter an, welcher es wird, legst du pro API-Key fest.
OpenAI
Stärkstes Modell der GPT-5.6-Familie — extended Reasoning, agentische Workflows und Code für anspruchsvollste Workloads.
Ausgewogenes Modell der 5.6-Familie — Leistung auf GPT-5.5-Niveau zu deutlich geringeren Kosten.
Schnellstes und günstigstes 5.6-Modell — für hohe Volumina und latenzkritische Anwendungen.
Frontier-Modell für anspruchsvolles Reasoning, agentische Workflows und komplexe Produktionslasten.
Kompakte GPT-5.4-Variante für hohe Durchsätze zu geringen Kosten — solide bei Standardaufgaben.
Kompakte GPT-5-Variante für hohe Durchsätze zu geringen Kosten — solide bei Standardaufgaben.
OpenAIs open-weight Modell — frontiernahes Reasoning bei voller Deployment-Kontrolle.
OpenAIs Spracherkennung — robuste Transkription über viele Sprachen und Akzente hinweg.
OpenAIs Sprachsynthese — natürlich klingende Stimmen für Vorlesefunktionen, Ansagen und Assistenten.
Claude
AnthropicAnthropics Mythos-Klasse — für autonome Wissensarbeit, lange Refactorings und agentische Abläufe über viele Schritte.
Anthropics stärkstes Opus-Modell — für langlaufende Agenten, komplexe Migrationen und anspruchsvollste Reasoning-Aufgaben.
Das Arbeitspferd der Claude-Familie — starkes Coding und Reasoning zu einem sehr guten Preis-Leistungs-Verhältnis.
Schnellstes Claude-Modell — für hohe Volumina, Klassifikation und latenzkritische Anwendungen.
Gemini und Gemma
GoogleGoogles Flash-Modell der aktuellen Gemini-Generation — auf Tempo und hohe Durchsätze ausgelegt.
Kompakte Flash-Variante für einfache, sehr häufige Aufgaben — auf niedrige Latenz getrimmt.
Ältere Flash-Lite-Generation — stabil für bestehende Integrationen und einfache Massenaufgaben.
Googles offene Reihe als effizientes MoE — günstig für Chat und einfache Tool-Aufgaben.
Googles offene Gemma-Reihe in der 31B-Instruct-Variante — solider Generalist für Chat und Textarbeit.
Llama
MetaKleines, schnelles Llama — ideal für günstige, latenzkritische Massenaufgaben.
Robuster Open-Weight-Generalist mit gutem Preis-Leistungs-Verhältnis für breite Workloads.
Größtes Llama-Modell — höchste Qualität für komplexe Aufgaben, DE-gehostet.
Mistral
Mistral AI, ParisEuropäisches Flaggschiff von Mistral — leistungsstarker Generalist für breite Produktionslasten.
Mittelgroßer Allrounder — verlässliche Qualität für alltägliche Text- und Chataufgaben.
Kompaktes Mistral-Modell mit 128k-Kontext — solide für Chat und Zusammenfassungen.
Qwen
Alibaba CloudKompaktes Qwen-Modell mit 27B Parametern — ausgewogener Generalist für Chat, Reasoning und Tool-Aufrufe.
Effizientes Qwen-MoE — stark bei Mehrsprachigkeit und Reasoning zu niedrigen Kosten.
Großes Qwen-MoE mit 122B Parametern, davon rund 10B aktiv — starkes Reasoning bei schlankem Rechenaufwand.
Spezialisiertes Code-Modell für Generierung, Refactoring und agentische Dev-Workflows.
Großes multimodales Embedding-Modell für anspruchsvolle Such- und RAG-Anwendungen.
Reranker für präzisere Treffer in RAG-Pipelines — ordnet Suchergebnisse neu.
DeepSeek
Schnelle Variante der DeepSeek-V4-Reihe — Generalist mit Stärken bei Code und Analyse.
GLM
Zhipu AIGroßes offenes Modell der GLM-Reihe — auf anspruchsvolles Reasoning und agentische Aufgaben ausgelegt.
Kimi
Moonshot AIAktuelle Generation der Kimi-Reihe von Moonshot AI — großes Reasoning-Modell für agentische Aufgaben.
Apertus
Swiss AI InitiativeOffenes Schweizer Modell, transparent trainiert — guter Generalist mit europäischem Fokus.
FLUX
Black Forest Labs, FreiburgNeue FLUX-Generation für Text-zu-Bild — kompaktes Modell für schnelle Bildgenerierung.
Bildbearbeitung der FLUX.2-Reihe — gezielte Änderungen an bestehenden Bildern per Prompt.
Schnelle Text-zu-Bild-Generierung — auf kurze Wartezeiten und hohe Volumina ausgelegt.
BGE
BAAIMehrsprachiges Embedding-Modell mit langem Kontext — vielseitig für RAG.
Starke englische Embeddings für hochwertige Retrieval-Pipelines.
Sentence-Transformers
UKP Lab, TU DarmstadtMehrsprachige Embeddings für Ähnlichkeitssuche und RAG — kompakt und schnell.
In dieser Kategorie ist derzeit kein Modell gelistet.
Unser Angebot richtet sich ausschließlich an Gewerbetreibende, nicht an Endverbraucher.
Jetzt loslegen.
Mit 5 € Startguthaben direkt auf alle Modelle zugreifen. Fragen vorab klärt der Vertrieb im Gespräch.