PREISE — SOUVERÄNE KI

Souveräne KI.
Transparente Preise.

Zwei Wege, Frontier-KI einzusetzen, ohne die Kontrolle über Ihre Daten aufzugeben: Modelle über die IG1 AI API nutzen oder Ihre eigene FullStack AI Plattform betreiben.

IG1 AI API Souveräne API

IG1 AI API

Frontier-Modelle über eine souveräne API, gehostet in Frankreich. Keine Infrastruktur einzurichten: Ihre Anwendungen verbinden sich sofort.

Monatliches Abonnement

100 €/ Monat
  • Enthaltene Nutzung100 €
  • Darüber hinausToken-Preise
  • Monatliche ObergrenzePasst sich Ihrem Abonnement an1 000 €
  • MindestabnahmeKeine
FullStack AI Dedizierte Plattform

FullStack AI

Ihre eigene private KI-Plattform: souveräne Infrastruktur, intelligente Software und Expertensupport, sicher und skalierbar bereitgestellt.

Ab

$3,500/Monat
  • Auf Ihrer InfrastrukturPublic Cloud oder Ihre Hardware$3,500 /Monat
  • Auf unserer InfrastrukturNvidia-GPU$4,900 /Monat
  • IndividuellMaßgeschneiderte BereitstellungAuf Anfrage

IG1 AI API

Planbare Basis.
Zahlen Sie nur, was Sie nutzen.

Ein pauschales Monatsabonnement mit enthaltener Nutzung, Token-Preise darüber hinaus und eine Obergrenze, die Sie kontrollieren. Ruhige Monate bleiben günstig, intensive Monate bleiben gedeckelt.

01

100 € / Monat

Pauschales Abonnement mit 100 € Nutzung über alle Modelle des Katalogs.

02

Token-Preise

Über das enthaltene Kontingent hinaus wird die Nutzung zu den unten veröffentlichten Preisen abgerechnet.

03

Obergrenze 1 000 €

Gilt für das Abonnement zu 100 € und steigt mit höheren Tarifen. Ist sie erreicht, pausiert der Zugang bis zum nächsten Abrechnungszeitraum. Darüber hinaus wird Ihnen nie etwas berechnet.

04

Abrechnung am 1.

Mehrverbrauch des Vormonats zusammen mit dem Abonnement für den kommenden Monat, per SEPA-Lastschrift oder hinterlegter Karte.

Mehr Kapazität nötig?

Für Teams mit höherem Bedarf gibt es höhere Monatstarife mit größerem Kontingent und höherer Obergrenze.

Vertrieb kontaktieren
Modellpreise

Unsere Modelle

Transparente Preise pro Token. Alle Modelle sind souverän, in Frankreich gehostet, ohne versteckte Gebühren und ohne Mindestabnahme.

Sprachmodelle

Modell Beschreibung 1 Mio. Input-Tokens 1 Mio. Output-Tokens
GLM-5.3-FlashSeptember 2026 Nativ multimodales effizientes Frontier-Modell (Video, Bild, Text, Datei) für Reasoning, Code und agentische Workflows. Max. Kontext: 1M Tokens, 128K Ausgabe. 0,40 €Gecachter Input: 0,09 € 1,30 €
Qwen3.5-122B-A10B Effizientes Hochleistungsmodell für Produktiv-Chat, Code und Reasoning. Standard-Instruct-Profil. 0,60 € 2,50 €
Qwen3.5-122B-A10B Creative Wie Qwen3.5-122B-A10B, mit Hyperparametern für kreative Ideenfindung, Synthese und hochwertige Inhaltserstellung. 0,60 € 2,50 €
Qwen3.5-122B-A10B Thinking Wie Qwen3.5-122B-A10B, mit erzwungenem Thinking-Modus für strukturiertes Reasoning und Analyse. Max. Kontext: 256K Tokens. 0,60 € 2,50 €
Qwen3.5-122B-A10B Thinking Coder Qwen3.5-122B-A10B, konfiguriert für fortgeschrittenes Coding, Architektur, Refactoring, Debugging und Entwicklungs-Workflows mit erzwungenem Thinking. 0,60 € 2,50 €
Qwen3.8-Flash-NextSeptember 2026 Nächste mittlere Größenklasse, die Qwen3.5-122B-A10B für Produktiv-Chat, Code und mehrstufige Dialoge ablösen wird. 0,60 € 2,50 €
Qwen3.8-27BSeptember 2026 Kompaktes Modell der neuesten Generation für Produktiv-Chat, Code, Extraktion und mehrstufige Dialoge. Standard-Instruct-Profil. 0,60 € 2,50 €
Qwen3.8-27B CreativeSeptember 2026 Wie Qwen3.8-27B, mit Hyperparametern für kreative Ideenfindung, Synthese und hochwertige Content-Generierung. 0,60 € 2,50 €
Qwen3.8-27B ThinkingSeptember 2026 Wie Qwen3.8-27B mit erzwungenem Thinking für strukturiertes Reasoning und Analyse. 0,60 € 2,50 €
Qwen3.8-27B Thinking CoderSeptember 2026 Qwen3.8-27B, konfiguriert für fortgeschrittenes Coding, Refactoring, Debugging und Entwicklungs-Workflows mit erzwungenem Thinking. 0,60 € 2,50 €
BGE-m3 Text-Embeddings für RAG und semantische Suche. 0,05 € —
BGE-reranker-v2-m3 Reranking zur Optimierung von Suchergebnissen. 0,30 € —
Dokument Wandelt beliebige Dokumente in Markdown um, damit ein LLM sie nutzen kann. Nützlich für CAG – Cached RAG einschließlich Vision-RAG-Anwendungsfällen. Dokumentbilder werden nach IG1-Standard als Text beschrieben. — 2,00 €

Bildmodelle

Modell Beschreibung 1 Mio. Input-Tokens 1 Mio. Output-Tokens
Qwen Image Bildgenerierung. Die Token-Zahl richtet sich nach Bildauflösung und Qualitätsstufe. 0,60 € 2,50 €
Qwen Image PE Bildgenerierung mit Prompt-Optimierung durch ein LLM. Die Prompt-Optimierung nutzt Qwen3.5-122B-A10B (separat abgerechnet). Die Token-Zahl richtet sich nach Auflösung und Qualitätsstufe. 0,60 € 2,50 €
Qwen Image Edit Bildbearbeitung. Die Token-Zahl richtet sich nach Auflösung und Qualitätsstufe von Quell- und Zielbild. 0,60 € 2,50 €
Qwen Image Edit PE Bildbearbeitung mit Prompt-Optimierung durch ein LLM. Die Prompt-Optimierung nutzt Qwen3.5-122B-A10B (separat abgerechnet). Die Token-Zahl richtet sich nach Auflösung und Qualität von Quell- und Zielbild. 0,60 € 2,50 €

FullStack AI

Ihre eigene
souveräne KI-Plattform.

Wählen Sie das Betriebsmodell, das zu Ihnen passt. Jederzeit skalierbar.

Auf Ihrer Infrastruktur

Ab

$3,500 /Monat

In der Public Cloud oder auf Ihrer Hardware

Jetzt starten
Empfohlen
Auf unserer Infrastruktur

Ab

$4,900 /Monat

Auf Nvidia-GPU

Jetzt starten
Individuell
Individuell

Kontaktieren Sie uns für ein individuelles Angebot

Kontakt aufnehmen

FAQ

Preise & Abrechnung

Alles zu Abonnement und Abrechnung der IG1 AI API.

Wie funktioniert die Preisgestaltung?
Zwei Bestandteile. Ein pauschales Abonnement zu 100 € / Monat, das 100 € Nutzung über alle Modelle des Katalogs einschließt. Darüber hinaus wird die Nutzung zu den veröffentlichten Token-Preisen abgerechnet (GLM 5.3 Flash zu 0,40 € Input, 0,09 € gecachtem Input und 1,30 € Output; Qwen3.5-122B-A10B und Qwen3.8-27B zu 0,60 € / 2,50 €), bis zu einer monatlichen Obergrenze von 1 000 € beim Abonnement zu 100 € (die Obergrenze passt sich Ihrem Tarif an). Keine versteckten Gebühren.
Was passiert, wenn ich meine Obergrenze erreiche?
Ihre monatliche Obergrenze liegt beim Abonnement zu 100 € bei 1 000 € und steigt mit höheren Tarifen. Ist sie erreicht, pausiert der Zugang bis zum nächsten Abrechnungszeitraum — oder bis Sie diesen Betrag begleichen. Über die von Ihnen gesetzte Obergrenze hinaus wird Ihnen nie etwas berechnet. Wenn Sie sie regelmäßig erreichen, sprechen wir über eine Anhebung Ihres Limits.
Wie wird der Mehrverbrauch abgerechnet?
Am 1. jedes Monats rechnen wir den Mehrverbrauch des Vormonats — also die Nutzung über Ihr enthaltenes Kontingent hinaus — gemeinsam mit dem Abonnement für den kommenden Monat ab. Die Zahlung erfolgt per SEPA-Lastschrift oder hinterlegter Karte.
Warum ein Abonnement plus nutzungsbasierte Abrechnung?
Sie erhalten die Planbarkeit einer festen monatlichen Basis und die Flexibilität, bei Bedarf zu skalieren — ohne Nachverhandlung. Ruhige Monate bleiben günstig, intensive Monate bleiben gedeckelt. Sie zahlen nur, was Sie nutzen — bis zu einer Obergrenze, die Sie selbst festlegen.
Kann ich einen höheren Tarif buchen?
Ja. Für Teams mit höherem Bedarf gibt es höhere monatliche Abostufen — mit größerem enthaltenem Kontingent und höherer Obergrenze. Sprechen Sie mit dem Vertrieb, um eine zu Ihrem Volumen passende Vereinbarung zu treffen.
Gibt es eine kostenlose Testphase?
Sprechen Sie uns auf Optionen für ein Pilotprogramm an.

Unsicher, welche Option
zu Ihnen passt?

Erzählen Sie uns von Ihren Workloads. Unser Team hilft Ihnen, die richtige Lösung zu dimensionieren: API, dedizierte Plattform oder beides.

Vertrieb kontaktieren sales@ig1.com