IG1 AI API
FRONTIER-MODELL KIMI K2.6 — JETZT VERFÜGBAR

Kimi K2.6
Souveräne Frontier-KI.

Frontier-Reasoning, Codegenerierung,
Long-Context-Analyse und agentische Workflows über eine souveräne API.
Keine Datenspeicherung. Kein Kompromiss. Keine Daten, die Ihr Unternehmen verlassen.

API-Schlüssel anfordern Vertrieb kontaktieren
SCROLLEN

Sicherheit, Compliance & Zertifizierungen

DSGVO

DSGVO-konform

EU AI Act

EU-AI-Act-konform

Souveräne KI

KI zu 100 % souverän

Kein Training

Kein Training der Modelle

Weltklasse-Modelle

Weltklasse-Modelle


Produktpräsentation

Die IG1 AI API
in Aktion.

Sehen Sie unsere Keynote und erfahren Sie, wie die IG1 AI API Weltklasse-KI-Performance mit vollständiger Datensouveränität liefert — bei bis zu 3× geringeren Kosten.


Performance

Kimi K2.6
Leistungsindikatoren.

Die offiziellen Benchmarks von Kimi K2.6 zeigen modernstes Coding, langfristige Aufgabenausführung, Agentenschwarm-Workflows und starkes multimodales Reasoning.

AIME 2026

96.4% Reasoning-Benchmark

Kimi K2.6 erzielt in der offiziellen Benchmark-Tabelle von Moonshot AI einen sehr starken AIME-2026-Wert und bestätigt damit mathematisches Reasoning auf Frontier-Niveau.

  • Benchmark-Ergebnis im Thinking-Modus
  • Starkes Lösen komplexer Probleme
  • Keine Datenspeicherung, vollständig souverän
  • Frontier-Reasoning über die IG1 AI API

Kontextfenster

262K Tokens

Kimi K2.6 unterstützt offiziell eine Kontextlänge von 262.144 Tokens und eignet sich damit für lange Dokumente, große Codebasen und mehrstufige Agenten-Workflows.

  • Offizielle Kontextlänge von 262.144 Tokens
  • Long-Context-Analyse von Dokumenten und Code
  • 89,6 % bei LiveCodeBench v6

Agentenschwarm

300 Sub-Agenten

Kimi K2.6 erweitert Agentenschwarm-Workflows für koordinierte Recherche, Analyse, Inhaltserstellung, Präsentationen, Tabellen und Websites.

  • Bis zu 4.000 koordinierte Schritte
  • Autonome Ausführung über lange Zeiträume
  • Wiederverwendbare Skills aus Dokumenten

Frontier-Modell

Kimi K2.6.
Das neue Flaggschiff.

Kimi K2.6 wird zum Frontier-Modell der IG1 AI API: eine High-End-Engine für Reasoning und Coding, ausgelegt auf komplexe Unternehmensaufgaben, bereitgestellt mit souveräner Inferenz und transparenter Preisgestaltung pro Token.

Modell Positionierung Ideal für Von IG1 AI angeboten
Kleines Modell Kompakt Einfache Automatisierung Nein
Effizientes Frontier-Modell Effizient Schnelle Enterprise-Workloads ✓ Qwen 3.5 122B-A10B
Frontier-Modell Kimi K2.6 Weltklasse-Reasoning, Code und Agenten ✓ Ja

Was Kimi K2.6 in der Praxis verändert

Kimi K2.6 ist für Aufgaben gebaut, bei denen Qualität, Präzision und Ausdauer mehr zählen als eine schnelle Standardantwort. Hier zeigt sich der Unterschied sofort:

Analyse langer Verträge

Kimi K2.6 verfolgt Querverweise, verschachtelte Klauseln, Ausnahmen und Definitionen über sehr lange Dokumente hinweg und hält die finale Antwort im Gesamtkontext verankert.

Codegenerierung über mehrere Dateien

Von der Architekturplanung bis zu Implementierungsdetails ist Kimi K2.6 auf kohärente Entwicklung über mehrere Dateien, Refactoring, Debugging und Product-to-Code-Workflows ausgelegt.

Reasoning unter mehreren Randbedingungen

Budget, Zeitplan, Stack, Compliance, Sicherheit, UX, Skalierbarkeit: Kimi K2.6 hält gleichzeitige Randbedingungen präsent und übersetzt sie in klare Entscheidungen.

Komplexe Anweisungen über langen Kontext

Bei langen Prompts mit verschachtelten Anforderungen ist Kimi K2.6 das Modell der Wahl, wenn die Antwort bis zum Ende der Generierung jeder Anweisung treu bleiben muss.

Warum Kimi K2.6 wählen?

Setzen Sie Kimi K2.6 ein, wenn die Aufgabe strategisch ist: anspruchsvolles Reasoning, Produktideen, fortgeschrittenes Coding, agentische Planung, tiefgehende Analysen und Dokumente, bei denen kleine Fehler teuer werden. Es ist der Premium-Weg im IG1-AI-Katalog.

Zwei Frontier-Wege, eine souveräne API

Kimi K2.6 ist das Frontier-Flaggschiff zu 1,20 € / 1 Mio. Input-Tokens und 5,00 € / 1 Mio. Output-Tokens. Qwen 3.5 122B-A10B ist die effiziente Hochleistungsoption für Produktiv-Workloads.


Effizientes Frontier-Modell

Qwen 3.5 122B-A10B.
Frontier-Leistung zu Produktionskosten.

Kimi K2.6 ist das Flaggschiff. Qwen 3.5 122B-A10B ist die Innovation für hohe Volumina: ein großes Mixture-of-Experts-Modell, das starkes Reasoning, Coding und multimodale Workflows mit deutlich besserer Kosteneffizienz liefert.

122B gesamt, 10B aktiv

Die A10B-Architektur aktiviert pro Token nur einen Bruchteil des Gesamtmodells. Sie erhalten die Wissensbasis eines großen Modells bei deutlich geringerem Inferenz-Fußabdruck.

Halber Token-Preis von Kimi

Mit 0,60 € Input und 2,50 € Output je 1 Mio. Tokens ist Qwen 3.5 122B-A10B für Produktivlast, interne Copiloten und kostensensible Agenten-Pipelines gemacht.

Produktionsreife Vielseitigkeit

Nutzen Sie es für Chat, Coding-Unterstützung, OCR-/Vision-Workflows, strukturierte Extraktion, Zusammenfassungen und werkzeugnutzende Agenten, wenn Premium-Reasoning auf Kimi-Niveau nicht erforderlich ist.

Long-Context-Arbeitstier

Qwen 3.5 122B-A10B hält das Long-Context-Versprechen für Unternehmen und gibt Teams zugleich ein Modell an die Hand, das sie breit für wiederkehrende Workloads einsetzen können, ohne jede Anfrage zum Premiumpreis abzurechnen.

Anwendungsfall Empfohlenes Modell Warum
Anspruchsvolles Reasoning, strategisches Coding, komplexe Agenten Kimi K2.6 Maximale Leistungsfähigkeit
Produktiv-Chat, Extraktion, Copiloten, Agenten mit hohem Volumen Qwen 3.5 122B-A10B Bestes Verhältnis von Leistung und Kosten
Hybrides Routing Kimi + Qwen Kimi nur einsetzen, wenn die Aufgabe es rechtfertigt

Anwendungsfälle

Was bedeutet das
für Ihr Team?

Jeder in Ihrem Team kann KI nutzen — nicht nur Ihre Ingenieure. Marketing, Vertrieb, Analysten, Entwickler. Die IG1 AI API holt Sie dort ab, wo Sie stehen.

Chat

Binden Sie dialogfähige KI in jede Anwendung ein. Bauen Sie intelligente Assistenten, Support-Bots und interaktive Workflows.

Code

Liefern Sie Features schneller mit KI-gestützter Entwicklung. Code generieren, prüfen, refaktorieren und debuggen — im Enterprise-Maßstab.

Zusammenfassen

Verwandeln Sie Tausende Dokumente in umsetzbare Erkenntnisse. Unternehmenswissen extrahieren, verdichten und im großen Maßstab analysieren.

Erstellen

Erzeugen Sie Inhalte und Analysen im großen Maßstab. Von Marketingtexten bis zu Finanzberichten — KI-gestützte Erstellung für jede Abteilung.


Datensouveränität

Und was ist mit
Ihren Daten?

Die Frage, die jedes Unternehmen stellt. Genau dafür ist die IG1 AI API gebaut. Ihr Security-Team sagt Ja. Ihre Rechtsabteilung sagt Ja. Und Sie können sicher und schnell vorangehen.

Keine Datenspeicherung

Ihre Prompts werden verarbeitet und sofort gelöscht. Nichts wird gespeichert, nichts protokolliert.

Kein Modelltraining

Wir verwenden Ihre Daten niemals zum Training von Modellen. Ihr geistiges Eigentum gehört Ihnen.

100 % souverän

Ihre Daten verlassen die Grenzen Ihres Unternehmens nie. Vollständig konform mit DSGVO, EU AI Act und ISO 27001.

Datenverarbeitung: Ihr Prompt → IG1 AI API verarbeitet → sofort gelöscht

Ihr Prompt

IG1 AI verarbeitet

Sofort gelöscht

Keine Logs • Keine Speicherung • Kein Training


Fortgeschrittene Fähigkeiten

Nicht nur Compliance.
Echte Leistungsfähigkeit.

Die IG1 AI API geht weiter. Enterprise-KI, gebaut für Ihre Arbeitsweise.

Erweitertes Denken

Komplexes, mehrstufiges Reasoning für anspruchsvolle Problemlösungen. Chain-of-Thought-Verarbeitung für nuancierte Unternehmensszenarien — auf Basis des Frontier-Modells Kimi K2.6, dort wo kleinere Modelle über lange Argumentationsketten die Kohärenz verlieren. Tiefes Reasoning, volle Souveränität, keine Datenspeicherung.

Websuche & Werkzeugnutzung

Integrierte Echtzeit-Websuche und vernetzte Workflows. Lassen Sie Ihre KI-Agenten mit externen Werkzeugen und Datenquellen interagieren.

Sichere Computernutzung

Codeausführung und sichere Computernutzung für echte agentische Automatisierung. Lassen Sie KI gefahrlos in Sandbox-Umgebungen arbeiten.


Open-Weight-Modelle

Angetrieben von den
besten offenen Modellen.

Wir setzen auf die leistungsstärksten heute verfügbaren Open-Weight-Modelle. Keine Anbieterabhängigkeit. Volle Transparenz.

Kimi

Kimi K2.6 Frontier

von Moonshot AI — Peking, China

Frontier-LLM & Coding

Premium-Reasoning, Code, Produktplanung, Long-Context-Analyse und agentische Workflows.

Qwen

Qwen 3.5

von Alibaba Cloud — Hangzhou, China

122B-A10B-LLM

Effizientes Hochleistungsmodell für Produktiv-Chat, Code, Reasoning und mehrstufige Dialoge.

Qwen

Qwen Image

von Alibaba Cloud — Hangzhou, China

Vision & Multimodalität

Bildverständnis, visuelle Analyse und multimodales Reasoning für Unternehmens-Workflows.

Qwen

Qwen3-VL-Embedding-8B SOTA

von Alibaba Cloud — Hangzhou, China

Multimodales Embedding

Modernstes Retrieval mit multimodalen Embeddings und dynamischen Dimensionen bis 4096 — weit über Textencoder mit fester Größe hinaus.

BGE

von BAAI — Peking, China

Schnelles Embedding & Reranking

Schnelle Text-Embeddings mit fester Dimension und Reranking — eine Qualitätsreferenz für semantische Suche und RAG-Pipelines mit hohem Durchsatz.


Modellpreise

Unsere Modelle

Transparente Preise pro Token. Alle Modelle sind souverän, in Frankreich gehostet, ohne versteckte Gebühren und ohne Mindestabnahme.

Sprachmodelle

Modell Beschreibung 1 Mio. Input-Tokens 1 Mio. Output-Tokens
Kimi K2.6 Universelles Frontier-Modell für Reasoning, Text, Code, OCR/Vision und komplexe Unternehmens-Workflows. Max. Kontext: 256K Tokens. 1,20 € 5,00 €
Kimi K2.6 Thinking Wie Kimi K2.6, mit erzwungenem Thinking-Modus für tiefes, mehrstufiges Reasoning. Max. Kontext: 256K Tokens. 1,20 € 5,00 €
Qwen3.5-122B-A10B Effizientes Hochleistungsmodell für Produktiv-Chat, Code und Reasoning zu geringeren Kosten. Standard-Instruct-Profil. 0,60 € 2,50 €
Qwen3.5-122B-A10B Creative Wie Qwen3.5-122B-A10B, mit Hyperparametern für kreative Ideenfindung, Synthese und hochwertige Inhaltserstellung. 0,60 € 2,50 €
Qwen3.5-122B-A10B Thinking Wie Qwen3.5-122B-A10B, mit erzwungenem Thinking-Modus für strukturiertes Reasoning und Analyse. Max. Kontext: 256K Tokens. 0,60 € 2,50 €
Qwen3.5-122B-A10B Thinking Coder Qwen3.5-122B-A10B, konfiguriert für fortgeschrittenes Coding, Architektur, Refactoring, Debugging und Entwicklungs-Workflows mit erzwungenem Thinking. 0,60 € 2,50 €
BGE-m3 Text-Embeddings für RAG und semantische Suche. 0,05 €
BGE-reranker-v2-m3 Reranking zur Optimierung von Suchergebnissen. 0,30 €
Dokument Wandelt beliebige Dokumente in Markdown um, damit ein LLM sie nutzen kann. Nützlich für CAG – Cached RAG einschließlich Vision-RAG-Anwendungsfällen. Dokumentbilder werden nach IG1-Standard als Text beschrieben. 2,00 €

Bildmodelle

Modell Beschreibung 1 Mio. Input-Tokens 1 Mio. Output-Tokens
Qwen Image Bildgenerierung. Die Token-Zahl richtet sich nach Bildauflösung und Qualitätsstufe. 0,60 € 2,50 €
Qwen Image PE Bildgenerierung mit Prompt-Optimierung durch ein LLM. Die Prompt-Optimierung nutzt Qwen3.5-122B-A10B (separat abgerechnet). Die Token-Zahl richtet sich nach Auflösung und Qualitätsstufe. 0,60 € 2,50 €
Qwen Image Edit Bildbearbeitung. Die Token-Zahl richtet sich nach Auflösung und Qualitätsstufe von Quell- und Zielbild. 0,60 € 2,50 €
Qwen Image Edit PE Bildbearbeitung mit Prompt-Optimierung durch ein LLM. Die Prompt-Optimierung nutzt Qwen3.5-122B-A10B (separat abgerechnet). Die Token-Zahl richtet sich nach Auflösung und Qualität von Quell- und Zielbild. 0,60 € 2,50 €

Preise

Weltklasse-Performance.
3× geringere Kosten.

Bis zu 3× günstiger als US-Hyperscaler. Mit der IG1 AI API muss keine Infrastruktur aufgebaut werden. Anwendungen verbinden sich sofort, und die Einsparungen beginnen ab Tag eins.

Mit dem Vertrieb sprechen
Eigenbetrieb IG1 AI API
GPU-CAPEX 500.000 – 1 Mio. $ $0
Spezialisiertes Personal ~200.000 $ / Jahr $0
Infrastruktur Monate für den Aufbau Sofort
F&E-Aufwand Erheblich Keiner
Time to Value 6–12 Monate Ab Tag eins

Jetzt starten

Nutzen Sie die IG1 AI API
ab heute.

Zugangsschlüssel anfordern. In Minuten integrieren. Schnell testen. Sicher skalieren.

1. Schlüssel erhalten

Fordern Sie Ihre API-Zugangsschlüssel bei unserem Team an.

2. Integrieren

Verbinden Sie sich in Minuten über unsere OpenAI-kompatible API.

3. Skalieren

Schnell testen, iterieren und sicher skalieren.


FAQ

Häufig gestellte
Fragen.

Alles Wissenswerte zur IG1 AI API — Souveränität, Modelle, Preise und Einstieg.

Souveränität & Sicherheit

Wo werden meine Daten gehostet?
Ausschließlich in eigenen Rechenzentren von IG1 in Frankreich, auf Hardware von Dell Technologies und NVIDIA. Ihre Daten verlassen unsere europäische Infrastruktur nie.
Speichern oder verwenden Sie meine Daten zum Modelltraining?
Nein. Keine Datenspeicherung. Kein Training mit Daten. Keine Datenweitergabe. Sobald Ihre Anfrage verarbeitet ist, ist sie weg. Punkt.
Ist IG1 AI DSGVO-konform?
Ja. Ebenso mit ISO 27001 und dem EU AI Act. Unsere souveräne, in der EU gehostete Architektur mit strikter Zusicherung der Nichtspeicherung ist auf Compliance by Default ausgelegt.
Worin unterscheidet sich das von ChatGPT, Claude oder Gemini?
OpenAI, Anthropic und Google sind US-Unternehmen und unterliegen US-Recht (einschließlich CLOUD Act). Ihre Daten laufen über US-Infrastruktur und können dort gespeichert werden. Bei IG1 AI bleiben Ihre Daten in Frankreich, unter europäischem Recht — ohne Speicherung, ohne Weitergabe, ohne Training.

Modelle & Performance

Welche Modelle setzt IG1 AI ein?
Wir betreiben die besten verfügbaren Open-Weight-Modelle, angeführt von Kimi K2.6 für Frontier-Reasoning, Coding und agentische Workflows. Der Katalog umfasst außerdem Qwen3.5-122B-A10B für effiziente Hochleistungs-Sprachaufgaben, Qwen3-VL-Embedding-8B und BGE für Embeddings und Reranking sowie Qwen Image für die Bildgenerierung.
Kann ich wählen, welches Modell genutzt wird?
Ja. Wählen Sie Kimi K2.6 für Premium-Frontier-Reasoning und -Coding, Qwen3.5-122B-A10B für kosteneffiziente Produktiv-Workloads oder die spezialisierten Embedding- und Reranking-Modelle Qwen3-VL-Embedding-8B / BGE sowie Qwen Image für besondere Aufgaben.
Sind Ihre Modelle quantisiert?
Ja — bewusst und so gewählt, dass die Qualität erhalten bleibt. Wo eine Version mit höherer Präzision existiert (z. B. bei Qwen), liefern wir FP8 aus: Der Qualitätsverlust ist vernachlässigbar, während GPU-Speicher und Kosten etwa halbiert werden — der richtige technische Kompromiss. Manche Frontier-Modelle erscheinen ausschließlich quantisiert — Kimi K2.6 wird nativ in INT4 ausgeliefert, es gibt also keine höherpräzise Variante. Was wir nie tun: aggressive Low-Bit-Quantisierung, die die schwierigsten Aufgaben verschlechtern würde (mehrstufiges Reasoning, komplexe Dokumentenanalyse, umfangreiche Codegenerierung). Die von uns veröffentlichten Benchmarkwerte entsprechen genau der Präzision, die wir im Produktivbetrieb ausliefern.

Preise & Abrechnung

Wie funktioniert die Preisgestaltung?
Zwei Bestandteile. Ein pauschales Abonnement zu 100 € / Monat, das 100 € Nutzung über alle Modelle des Katalogs einschließt. Darüber hinaus wird die Nutzung zu den veröffentlichten Token-Preisen abgerechnet (Kimi K2.6 zu 1,20 € Input / 5,00 € Output, Qwen3.5-122B-A10B zu 0,60 € / 2,50 €), bis zu einer monatlichen Obergrenze von 1 000 €. Keine versteckten Gebühren.
Was passiert, wenn ich meine Obergrenze erreiche?
Ihre monatliche Obergrenze liegt bei 1 000 €. Ist sie erreicht, pausiert der Zugang bis zum nächsten Abrechnungszeitraum — oder bis Sie die 1 000 € begleichen. Über die von Ihnen gesetzte Obergrenze hinaus wird Ihnen nie etwas berechnet. Wenn Sie sie regelmäßig erreichen, sprechen wir über eine Anhebung Ihres Limits.
Wie wird der Mehrverbrauch abgerechnet?
Am 1. jedes Monats rechnen wir den Mehrverbrauch des Vormonats — also die Nutzung über Ihr enthaltenes Kontingent hinaus — gemeinsam mit dem Abonnement für den kommenden Monat ab. Die Zahlung erfolgt per SEPA-Lastschrift oder hinterlegter Karte.
Warum ein Abonnement plus nutzungsbasierte Abrechnung?
Sie erhalten die Planbarkeit einer festen monatlichen Basis und die Flexibilität, bei Bedarf zu skalieren — ohne Nachverhandlung. Ruhige Monate bleiben günstig, intensive Monate bleiben gedeckelt. Sie zahlen nur, was Sie nutzen — bis zu einer Obergrenze, die Sie selbst festlegen.
Kann ich einen höheren Tarif buchen?
Ja. Für Teams mit höherem Bedarf gibt es höhere monatliche Abostufen — mit größerem enthaltenem Kontingent und höherer Obergrenze. Sprechen Sie mit dem Vertrieb, um eine zu Ihrem Volumen passende Vereinbarung zu treffen.
Gibt es eine kostenlose Testphase?
Sprechen Sie uns auf Optionen für ein Pilotprogramm an.

Einstieg

Wie lange dauert die Einrichtung?
Auf Ihrer Seite ist keinerlei Infrastruktur einzurichten. Sie können noch am selben Tag live gehen.
Brauche ich ein technisches Team, um IG1 AI zu nutzen?
Nein. IG1 AI ist für jedes Team gemacht — Marketing, Vertrieb, HR, Recht, Analyse und Entwicklung. Wer eine Chat-Oberfläche bedienen kann, kann IG1 AI nutzen.
Kann ich IG1 AI in meine bestehenden Tools integrieren?
Ja. IG1 AI bietet API-Zugang, kompatibel mit gängigen KI-Chat-Anwendungen (Msty, Open WebUI) und IDE-Integrationen für Entwickler. Binden Sie Ihre bestehenden Workflows an, ohne Ihre Werkzeuge zu wechseln.
Was, wenn eine bessere KI-Plattform erscheint?
Keine Bindung. Monatliche Abrechnung ohne Mindestlaufzeit bedeutet: Sie können jederzeit gehen. Da wir jedoch laufend auf die besten Open-Weight-Modelle aktualisieren, sind Sie ohne Wechsel immer an der Spitze.

TECHNOLOGIEPARTNER

Getragen von Branchenführern

Wir arbeiten mit den weltweit führenden Technologieanbietern zusammen, um souveräne KI-Infrastruktur in Enterprise-Qualität bereitzustellen.

NVIDIA

NVIDIA

GPU-Infrastrukturpartner für unsere KI-Inferenz- und Trainings-Workloads. NVIDIA Accelerated Computing ermöglicht Echtzeit-Model-Serving mit unerreichter Performance.

Dell Technologies

Dell Technologies

Partner für Enterprise-Server und -Storage, der das On-Premise-Hardware-Rückgrat für souveräne KI-Deployments liefert — sicher, skalierbar und für den Produktivbetrieb gebaut.

Mehr über unsere Partnerschaften erfahren

2026 ist KI kein
Wettbewerbsvorteil mehr.
Sie ist der Standard.

Alle haben Zugang zu Modellen. Die eigentliche Frage lautet: Bauen Sie schneller? Bauen Sie klüger? Ihre Wettbewerber tun es bereits.

IG1 AI API von Iguana Solutions — Weltklasse-KI-Performance, vollständig souverän, sofort verfügbar.