Sicherheit, Compliance & Zertifizierungen
DSGVO-konform
EU-AI-Act-konform
KI zu 100 % souverän
Kein Training der Modelle
Weltklasse-Modelle
Produktpräsentation
Sehen Sie unsere Keynote und erfahren Sie, wie die IG1 AI API Weltklasse-KI-Performance mit vollständiger Datensouveränität liefert — bei bis zu 3× geringeren Kosten.
Die offiziellen Benchmarks von GLM 5.3 Flash zeigen führendes agentisches Coding, langfristige Terminal-Ausführung, ein Kontextfenster von einer Million Tokens und native multimodale Eingabe.
Terminal-Bench 2.1
GLM 5.3 Flash erreicht in der offiziellen Benchmark-Tabelle von Z.ai 84,3 auf Terminal-Bench 2.1 und liegt damit bei der agentischen Terminal-Ausführung auf dem Niveau der stärksten proprietären Modelle.
Kontextfenster
GLM 5.3 Flash unterstützt offiziell ein Kontextfenster von einer Million Tokens und bis zu 128K Ausgabe-Tokens und eignet sich damit für lange Dokumente, große Codebasen und mehrstufige Agenten-Workflows.
Nativ multimodal
GLM 5.3 Flash ist das erste nativ multimodale Modell der GLM-5-Reihe: Video-, Bild-, Text- und Datei-Eingabe in einer Sparse-MoE-Architektur mit 18 Milliarden aktiven Parametern.
Ein gefilmtes Kundenstatement: EasyBourse berichtet, wie souveräne KI seinen Teams hilft, die Softwareentwicklung zu skalieren.
Auf YouTube ansehenWir setzen auf die leistungsstärksten heute verfügbaren Open-Weight-Modelle. Keine Anbieterabhängigkeit. Volle Transparenz.
GLM 5.3 Flash Frontier
von Z.ai — Peking, China
Effizientes Frontier-LLM
Das Flaggschiff unseres Katalogs für Reasoning, Code und agentische Workflows – und sein niedrigster Token-Preis.
Qwen 3.5
von Alibaba Cloud — Hangzhou, China
122B-A10B-LLM
Effizientes Hochleistungsmodell für Produktiv-Chat, Code, Reasoning und mehrstufige Dialoge.
Qwen Image
von Alibaba Cloud — Hangzhou, China
Vision & Multimodalität
Bildverständnis, visuelle Analyse und multimodales Reasoning für Unternehmens-Workflows.
Qwen3-VL-Embedding-8B SOTA
von Alibaba Cloud — Hangzhou, China
Multimodales Embedding
Modernstes Retrieval mit multimodalen Embeddings und dynamischen Dimensionen bis 4096 — weit über Textencoder mit fester Größe hinaus.
BGE
von BAAI — Peking, China
Schnelles Embedding & Reranking
Schnelle Text-Embeddings mit fester Dimension und Reranking — eine Qualitätsreferenz für semantische Suche und RAG-Pipelines mit hohem Durchsatz.
Zwei Modelle kommen auf unsere souveräne Infrastruktur: Sie decken die kompakte und die mittlere Stufe ab.
Qwen 3.8 Flash Next September 2026
von Alibaba Cloud — Hangzhou, China
Mittelgroßes LLM
Die nächste mittlere Größenklasse, die Qwen 3.5 122B-A10B für Produktiv-Chat, Code und mehrstufige Dialoge ablösen wird.
Qwen 3.8 27B September 2026
von Alibaba Cloud — Hangzhou, China
Dichtes 27B-LLM
Kompaktes dichtes Modell der neuesten Generation für Produktiv-Chat, Code, Extraktion und mehrstufige Dialoge.
Transparente Preise pro Token. Alle Modelle sind souverän, in Frankreich gehostet, ohne versteckte Gebühren und ohne Mindestabnahme.
| Modell | Beschreibung | 1 Mio. Input-Tokens | 1 Mio. Output-Tokens |
|---|---|---|---|
| Nativ multimodales effizientes Frontier-Modell (Video, Bild, Text, Datei) für Reasoning, Code und agentische Workflows. Max. Kontext: 1M Tokens, 128K Ausgabe. | 0,40 €Gecachter Input: 0,09 € | 1,30 € | |
| Effizientes Hochleistungsmodell für Produktiv-Chat, Code und Reasoning. Standard-Instruct-Profil. | 0,60 € | 2,50 € | |
| Wie Qwen3.5-122B-A10B, mit Hyperparametern für kreative Ideenfindung, Synthese und hochwertige Inhaltserstellung. | 0,60 € | 2,50 € | |
| Wie Qwen3.5-122B-A10B, mit erzwungenem Thinking-Modus für strukturiertes Reasoning und Analyse. Max. Kontext: 256K Tokens. | 0,60 € | 2,50 € | |
| Qwen3.5-122B-A10B, konfiguriert für fortgeschrittenes Coding, Architektur, Refactoring, Debugging und Entwicklungs-Workflows mit erzwungenem Thinking. | 0,60 € | 2,50 € | |
| Nächste mittlere Größenklasse, die Qwen3.5-122B-A10B für Produktiv-Chat, Code und mehrstufige Dialoge ablösen wird. | 0,60 € | 2,50 € | |
| Kompaktes Modell der neuesten Generation für Produktiv-Chat, Code, Extraktion und mehrstufige Dialoge. Standard-Instruct-Profil. | 0,60 € | 2,50 € | |
| Wie Qwen3.8-27B, mit Hyperparametern für kreative Ideenfindung, Synthese und hochwertige Content-Generierung. | 0,60 € | 2,50 € | |
| Wie Qwen3.8-27B mit erzwungenem Thinking für strukturiertes Reasoning und Analyse. | 0,60 € | 2,50 € | |
| Qwen3.8-27B, konfiguriert für fortgeschrittenes Coding, Refactoring, Debugging und Entwicklungs-Workflows mit erzwungenem Thinking. | 0,60 € | 2,50 € | |
| BGE-m3 | Text-Embeddings für RAG und semantische Suche. | 0,05 € | — |
| BGE-reranker-v2-m3 | Reranking zur Optimierung von Suchergebnissen. | 0,30 € | — |
| Dokument | Wandelt beliebige Dokumente in Markdown um, damit ein LLM sie nutzen kann. Nützlich für CAG – Cached RAG einschließlich Vision-RAG-Anwendungsfällen. Dokumentbilder werden nach IG1-Standard als Text beschrieben. | — | 2,00 € |
| Modell | Beschreibung | 1 Mio. Input-Tokens | 1 Mio. Output-Tokens |
|---|---|---|---|
| Bildgenerierung. Die Token-Zahl richtet sich nach Bildauflösung und Qualitätsstufe. | 0,60 € | 2,50 € | |
| Bildgenerierung mit Prompt-Optimierung durch ein LLM. Die Prompt-Optimierung nutzt Qwen3.5-122B-A10B (separat abgerechnet). Die Token-Zahl richtet sich nach Auflösung und Qualitätsstufe. | 0,60 € | 2,50 € | |
| Bildbearbeitung. Die Token-Zahl richtet sich nach Auflösung und Qualitätsstufe von Quell- und Zielbild. | 0,60 € | 2,50 € | |
| Bildbearbeitung mit Prompt-Optimierung durch ein LLM. Die Prompt-Optimierung nutzt Qwen3.5-122B-A10B (separat abgerechnet). Die Token-Zahl richtet sich nach Auflösung und Qualität von Quell- und Zielbild. | 0,60 € | 2,50 € |
Zugangsschlüssel anfordern. In Minuten integrieren. Schnell testen. Sicher skalieren.
1. Schlüssel erhalten
Fordern Sie Ihre API-Zugangsschlüssel bei unserem Team an.
2. Integrieren
Verbinden Sie sich in Minuten über unsere OpenAI-kompatible API.
3. Skalieren
Schnell testen, iterieren und sicher skalieren.
Alles Wissenswerte zur IG1 AI API — Souveränität, Modelle, Preise und Einstieg.
Souveränität & Sicherheit
Modelle & Performance
Preise & Abrechnung
Einstieg