Sécurité, Conformité & Certifications
Conforme RGPD
Conforme EU AI Act
IA 100% Souveraine
Aucun Entraînement des Modèles
Modèles de Classe Mondiale
Présentation Produit
Regardez notre keynote pour découvrir comment IG1 AI API offre des performances IA de classe mondiale avec une souveraineté totale des données — à un coût jusqu'à 3x inférieur.
Les benchmarks officiels de GLM 5.3 Flash mettent en avant un codage agentique de premier plan, une exécution en terminal à long horizon, un contexte d'un million de tokens et une entrée multimodale native.
Terminal-Bench 2.1
GLM 5.3 Flash obtient 84.3 sur Terminal-Bench 2.1 dans le tableau de benchmarks officiel de Z.ai, au niveau des meilleurs modèles propriétaires sur l'exécution agentique en terminal.
Fenêtre de Contexte
GLM 5.3 Flash prend en charge une fenêtre de contexte officielle d'un million de tokens et jusqu'à 128K tokens en sortie, ce qui le rend adapté aux longs documents, aux grandes bases de code et aux workflows d'agents multi-étapes.
Multimodal Natif
GLM 5.3 Flash est le premier modèle nativement multimodal de la série GLM-5 : vidéo, image, texte et fichiers en entrée, dans une architecture MoE creuse à 18 milliards de paramètres actifs.
Un témoignage filmé : EasyBourse raconte comment l'IA souveraine aide ses équipes à passer à l'échelle en développement logiciel.
Regarder sur YouTubeTirant parti des modèles open-weight les plus puissants disponibles aujourd'hui. Aucun verrouillage fournisseur. Transparence totale.
GLM 5.3 Flash Frontière
par Z.ai — Pékin, Chine
LLM de frontière efficiente
Le modèle phare de notre catalogue pour le raisonnement, le code et les workflows agentiques — et son prix par token le plus bas.
Qwen 3.5
par Alibaba Cloud — Hangzhou, Chine
LLM 122B-A10B
Modèle efficient et haute performance pour le chat de production, le code, le raisonnement et les workflows multi-tours.
Qwen Image
par Alibaba Cloud — Hangzhou, Chine
Vision & Multimodal
Compréhension d'images, analyse visuelle et raisonnement multimodal pour les workflows d'entreprise.
Qwen3-VL-Embedding-8B SOTA
par Alibaba Cloud — Hangzhou, Chine
Embedding Multimodal
Récupération à l'état de l'art avec des embeddings multimodaux et des dimensions dynamiques jusqu'à 4096 — bien au-delà des encodeurs de texte à taille fixe.
BGE
par BAAI — Pékin, Chine
Embedding & Reranking Rapides
Embeddings de texte rapides à dimension fixe et reranking — une référence de qualité pour la recherche sémantique à haut débit et les pipelines RAG.
Deux modèles arrivent sur notre infrastructure souveraine : ils couvrent le palier compact et le palier moyen.
Qwen 3.8 Flash Next Septembre 2026
par Alibaba Cloud — Hangzhou, Chine
LLM de Taille Moyenne
Le prochain palier de taille moyenne, appelé à remplacer Qwen 3.5 122B-A10B pour le chat de production, le code et les workflows multi-tours.
Qwen 3.8 27B Septembre 2026
par Alibaba Cloud — Hangzhou, Chine
LLM dense 27B
Modèle dense compact de dernière génération pour le chat de production, le code, l'extraction et les workflows multi-tours.
Tarification au token transparente. Tous les modèles sont souverains, hébergés en France, sans frais cachés ni engagement minimum.
| Modèle | Description | 1M Tokens Input | 1M Tokens Output |
|---|---|---|---|
| Modèle de frontière efficiente nativement multimodal (vidéo, image, texte, fichier) pour le raisonnement, le code et les workflows agentiques. Contexte max : 1M tokens, sortie 128K. | 0,40 €Entrée en cache : 0,09 € | 1,30 € | |
| Modèle efficient et haute performance pour le chat de production, le code et le raisonnement. Profil instruct par défaut. | 0,60 € | 2,50 € | |
| Identique à Qwen3.5-122B-A10B avec des hyperparamètres optimisés pour l'idéation créative, la synthèse et la génération de contenu de haute qualité. | 0,60 € | 2,50 € | |
| Identique à Qwen3.5-122B-A10B avec le mode thinking imposé pour un raisonnement et une analyse structurés. Contexte max : 256K tokens. | 0,60 € | 2,50 € | |
| Qwen3.5-122B-A10B configuré pour le codage avancé, l'architecture, le refactoring, le débogage et les workflows de développement en mode thinking imposé. | 0,60 € | 2,50 € | |
| Prochain palier de taille moyenne, appelé à remplacer Qwen3.5-122B-A10B pour le chat de production, le code et les workflows multi-tours. | 0,60 € | 2,50 € | |
| Modèle compact de dernière génération pour le chat de production, le code, l'extraction et les workflows multi-tours. Profil instruct par défaut. | 0,60 € | 2,50 € | |
| Identique à Qwen3.8-27B avec des hyperparamètres réglés pour l'idéation créative, la synthèse et la génération de contenu de haute qualité. | 0,60 € | 2,50 € | |
| Identique à Qwen3.8-27B avec le mode thinking imposé pour le raisonnement structuré et l'analyse. | 0,60 € | 2,50 € | |
| Qwen3.8-27B configuré pour le codage avancé, le refactoring, le débogage et les workflows de développement en mode thinking imposé. | 0,60 € | 2,50 € | |
| BGE-m3 | Embeddings de texte pour le RAG et la recherche sémantique. | 0,05 € | N/A |
| BGE-reranker-v2-m3 | Reranking pour l'optimisation des résultats de recherche. | 0,30 € | N/A |
| Document | Convertit n'importe quel document en Markdown pour être utilisé par un LLM. Utile pour le CAG – Cached RAG, y compris les cas d'usage de RAG vision. Les images des documents utilisent IG1 Standard pour être décrites en texte. | N/A | 2,00 € |
| Modèle | Description | 1M Tokens Input | 1M Tokens Output |
|---|---|---|---|
| Génération d'images. Nombre de tokens basé sur la résolution et le niveau de qualité de l'image. | 0,60 € | 2,50 € | |
| Génération d'images avec Prompt Enhancing par LLM. L'amélioration du prompt utilise Qwen3.5-122B-A10B (facturé séparément). Nombre de tokens basé sur la résolution et le niveau de qualité. | 0,60 € | 2,50 € | |
| Édition d'images. Nombre de tokens basé sur la résolution et le niveau de qualité des images source et générée. | 0,60 € | 2,50 € | |
| Édition d'images avec Prompt Enhancing par LLM. L'amélioration du prompt utilise Qwen3.5-122B-A10B (facturé séparément). Nombre de tokens basé sur la résolution et la qualité des images source et générée. | 0,60 € | 2,50 € |
Obtenez vos clés d'accès. Intégrez en quelques minutes. Testez rapidement. Passez à l'échelle en toute confiance.
1. Obtenir les Clés
Demandez vos clés d'accès API à notre équipe.
2. Intégrer
Connectez-vous en quelques minutes avec notre API compatible OpenAI.
3. Passer à l'Échelle
Testez vite, itérez et passez à l'échelle en toute confiance.
Tout ce que vous devez savoir sur IG1 AI API — souveraineté, modèles, tarification et démarrage.
Souveraineté & Sécurité
Modèles & Performance
Tarification & Facturation
Démarrage