Gemini 3.1 Flash Lite.
Gemini 3.1 Flash Lite ist das multimodale Effizienzmodell von Google für niedrige Latenz und hohe Volumina, mit Text, Bild, Video, Audio und PDF als Eingabe. Es eignet sich für leichte agentische Abläufe und einfache Datenextraktion, mit wählbaren Thinking-Stufen für den Ausgleich zwischen Kosten und Qualität.
- Rechenzentren in der EU
- § 203 Verschwiegenheit
- Zero Retention
- Listenpreise
from openai import OpenAI
client = OpenAI(
# eine Zeile — mehr nicht
base_url="https://api.noirdoc.de/v1",
api_key=os.environ["NOIRDOC_KEY"],
)
response = client.chat.completions.create(
model="gemini-3.1-flash-lite", # Anbieter & Modell
messages=[{"role": "user", "content": "Hallo"}],
) Anbieter.
Gemini 3.1 Flash Lite bieten wir über diese Anbieter an.
Governance.
Je API-Key legst du fest, welche Anbieter, Regionen und Modelle erlaubt sind.
So sieht das im Account aus →- Region
-
EU über Google Vertex
- § 203 StGB
-
Verschwiegenheit vereinbart bei Google Vertex
Ein Key mit der Regel „nur mit § 203-Vereinbarung“ kann dieses Modell nutzen.
- Gewichte
-
Proprietär
Ein Key mit der Regel „nur Open Source“ erreicht dieses Modell nicht.
Weitere Modelle.
Googles Flash-Modell der aktuellen Gemini-Generation — auf Tempo und hohe Durchsätze ausgelegt.
Kompakte Flash-Variante für einfache, sehr häufige Aufgaben — auf niedrige Latenz getrimmt.
Googles offene Reihe als effizientes MoE — günstig für Chat und einfache Tool-Aufgaben.
Googles offene Gemma-Reihe in der 31B-Instruct-Variante — solider Generalist für Chat und Textarbeit.
Jetzt loslegen.
Mit 5 € Startguthaben direkt auf alle Modelle zugreifen. Fragen vorab klärt der Vertrieb im Gespräch.