Inference
EN

KI-Inferenz,
entwickelt für Europa.

Hauptsitz Deutschland 100% EU-Datenresidenz

Open-Weight-KI-Modelle auf GPUs in der EU.

Zero Data Retention standardmäßig Chat Completions werden nicht gespeichert. Wir verarbeiten sie im Arbeitsspeicher und verwerfen sie danach. Wir trainieren nicht mit Ihren Daten.
Kostenloses Konto erstellen 100K Tokens/Monat kostenlos
// Modelle + Preise

Modellkatalog

Wir hosten Open-Weight-Modelle von Mistral, Google und IBM für Reasoning, Coding und mehrsprachige Aufgaben. Offene Gewichte, Hosting in Europa, und Ihre Anfragen bleiben in der EU.

Alle Modelle laufen auf modernen NVIDIA-Chips oder neueren. Sie zahlen pro Million Tokens, und jedes Modell hat einen Free Tier.


Dense
Mistral Medium 3.5 128B
Input: 1,10 € · Output: 6,10 €
Mistral Medium 3.5 128B
76
GPT-5 Mini
72
Sonnet 4.5
75
Gemini 3 Fl.
61
Mistral Medium 3.1
37

Mixture of Experts
Mistral Small 4 119B-6.5B
Input: 0,15 € · Output: 0,45 €
Mistral Small 4 119B-6.5B
66
GPT-5 Nano
47
Haiku 4.5
65
Gemini 3.1 FL
60
Mistral Small 3.2
26

Dense
Gemma 4 31B
Input: 0,15 € · Output: 0,35 €
Gemma 4 31B
74
GPT-5 Mini
72
Sonnet 4.5
75
Gemini 3 Fl.
61
Mistral Medium 3.1
37

Mixture of Experts
Gemma 4 26B-A4B
Input: 0,10 € · Output: 0,30 €
Gemma 4 26B-A4B
67
GPT-5 Nano
47
Haiku 4.5
65
Gemini 3.1 FL
60
Mistral Small 3.2
26

Dense
Granite 4.1 30B
Input: 0,25 € · Output: 1,30 €
Granite 4.1 30B
69
GPT-5 Mini
72
Haiku 4.5
65
Gemini 3 Fl.
61
Mistral Medium 3.1
37
Free tier
100K Tokens/Monat Alle Modelle 10 Anf./Min. Keine Kreditkarte nötig

Preise in EUR, zzgl. MwSt.

// für Teams, die mehr brauchen

Business-Tarif

Fester Monatspreis, reservierte Kapazität wenn Sie sie brauchen, und ein echtes SLA. Ein Plan für alle Nodion.ai-Produkte.

Business
500,00 € /Monat

Preise in EUR, zzgl. MwSt.

Managed KI-Infrastruktur für Unternehmen
  • 50M Tokens/Monat inklusive
  • Dedizierte GPU-Kapazität mit priorisiertem Routing
  • Modell-LTS: 12 Monate Verfügbarkeitsgarantie
  • Früher Zugang zu neuen Modellen
  • 99,5% Uptime-SLA
  • Dedizierter Support und Onboarding
Kostenlos starten
// Erste Schritte

API-Dokumentation

Nodion.ai spricht die OpenAI API. Richten Sie Ihr bestehendes SDK oder Tool auf unsere Base URL, und es sollte einfach funktionieren.

# Base URL
https://api.nodion.ai/v1
# Example: curl
curl https://api.nodion.ai/v1/chat/completions \
  -H "Authorization: Bearer $NODION_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemma4-31b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Unterstützt: /v1/chat/completions, /v1/models. Streaming, Tool Use und JSON-Modus inklusive.

// warum das wichtig ist
DSGVO-konform. Wir sind ein deutsches Unternehmen mit GPUs in Deutschland, Schweden und Finnland. Ihre Daten bleiben in der EU, Punkt.
Nordische grüne Energie. Unsere Cluster laufen mit erneuerbarer Energie. Das kalte Klima hilft bei der Kühlung und hält den Verbrauch niedrig.
Keine US-Abhängigkeit. Europäisches Hosting, Open-Weight-Modelle und keine Bindung an einen US-Hyperscaler.
Nur Open Weight. Wir betreiben nur Modelle mit offenen Gewichten. Sie wissen, welches Modell Ihre Anfragen bearbeitet, können den Stack nachvollziehen und die Ausgaben selbst prüfen.
OpenAI-kompatible API. Tauschen Sie die Base URL in Ihrer bestehenden Integration aus, und Sie laufen auf europäischer Infrastruktur.

Bereit loszulegen?

100K kostenlose Tokens pro Monat. Keine Kreditkarte erforderlich. Alle Modelle inklusive.

Kostenloses Konto erstellen