Seguridad, Conformidad y Certificaciones
Conforme con RGPD
Conforme con el Reglamento de IA de la UE
IA 100% Soberana
Sin Entrenamiento de Modelos
Modelos de Clase Mundial
Presentación del Producto
Mira nuestra presentación keynote para descubrir cómo IG1 AI API ofrece un rendimiento de IA de clase mundial con plena soberanía de los datos — con un coste hasta 3 veces menor.
Los benchmarks oficiales de GLM 5.3 Flash destacan una programación agéntica de primer nivel, una ejecución en terminal de horizonte largo, un contexto de un millón de tokens y una entrada multimodal nativa.
Terminal-Bench 2.1
GLM 5.3 Flash obtiene 84,3 en Terminal-Bench 2.1 en la tabla oficial de benchmarks de Z.ai, a la altura de los mejores modelos propietarios en ejecución agéntica en terminal.
Ventana de Contexto
GLM 5.3 Flash admite una ventana de contexto oficial de un millón de tokens y hasta 128K tokens de salida, lo que lo hace idóneo para documentos largos, grandes bases de código y flujos de trabajo de agentes de múltiples pasos.
Multimodal Nativo
GLM 5.3 Flash es el primer modelo nativamente multimodal de la serie GLM-5: entrada de vídeo, imagen, texto y archivos en una arquitectura MoE dispersa con 18.000 millones de parámetros activos.
Un testimonio filmado: EasyBourse cuenta cómo la IA soberana ayuda a sus equipos a escalar el desarrollo de software.
Ver en YouTubeAprovechando los modelos de pesos abiertos más potentes disponibles hoy. Sin dependencia de proveedor. Transparencia total.
GLM 5.3 Flash Frontera
por Z.ai — Pekín, China
LLM de frontera eficiente
El modelo buque insignia de nuestro catálogo para razonamiento, código y flujos de trabajo agénticos — y su precio por token más bajo.
Qwen 3.5
por Alibaba Cloud — Hangzhou, China
LLM 122B-A10B
Modelo eficiente de alto rendimiento para chat de producción, código, razonamiento y flujos de trabajo multironda.
Qwen Image
por Alibaba Cloud — Hangzhou, China
Visión y Multimodal
Comprensión de imágenes, análisis visual y razonamiento multimodal para flujos de trabajo empresariales.
Qwen3-VL-Embedding-8B SOTA
por Alibaba Cloud — Hangzhou, China
Embedding Multimodal
Recuperación de última generación con embeddings multimodales y dimensiones dinámicas de hasta 4096 — mucho más allá de los codificadores de texto de tamaño fijo.
BGE
por BAAI — Pekín, China
Embedding y Reranking Rápidos
Embeddings de texto rápidos y de dimensión fija, y reranking — una referencia de calidad para búsqueda semántica y pipelines RAG de alto rendimiento.
Dos modelos llegan a nuestra infraestructura soberana: cubren el nivel compacto y el nivel medio.
Qwen 3.8 Flash Next Septiembre 2026
por Alibaba Cloud — Hangzhou, China
LLM de Tamaño Medio
El próximo nivel de tamaño medio, destinado a sustituir a Qwen 3.5 122B-A10B para el chat de producción, el código y los flujos de trabajo multironda.
Qwen 3.8 27B Septiembre 2026
por Alibaba Cloud — Hangzhou, China
LLM denso de 27B
Modelo denso compacto de última generación para chat de producción, código, extracción y flujos de trabajo multironda.
Precios transparentes por token. Todos los modelos son soberanos, alojados en Francia, sin tarifas ocultas y sin compromiso mínimo.
| Modelo | Descripción | 1M Tokens de Entrada | 1M Tokens de Salida |
|---|---|---|---|
| Modelo de frontera eficiente nativamente multimodal (vídeo, imagen, texto, archivos) para el razonamiento, el código y los flujos de trabajo agénticos. Contexto máx.: 1M tokens, salida 128K. | 0,40 €Entrada en caché: 0,09 € | 1,30 € | |
| Modelo eficiente de alto rendimiento para chat de producción, código y razonamiento. Perfil instruct por defecto. | 0,60 € | 2,50 € | |
| Igual que Qwen3.5-122B-A10B con hiperparámetros ajustados para la ideación creativa, la síntesis y la generación de contenido de alta calidad. | 0,60 € | 2,50 € | |
| Igual que Qwen3.5-122B-A10B con el modo de razonamiento forzado para un razonamiento y análisis estructurados. Contexto máximo: 256K tokens. | 0,60 € | 2,50 € | |
| Qwen3.5-122B-A10B configurado para programación avanzada, arquitectura, refactorización, depuración y flujos de trabajo de desarrollo con razonamiento forzado. | 0,60 € | 2,50 € | |
| Próximo nivel de tamaño medio, destinado a sustituir a Qwen3.5-122B-A10B para el chat de producción, el código y los flujos de trabajo multironda. | 0,60 € | 2,50 € | |
| Modelo compacto de última generación para chat de producción, código, extracción y flujos de trabajo multironda. Perfil instruct por defecto. | 0,60 € | 2,50 € | |
| Igual que Qwen3.8-27B con hiperparámetros ajustados para la ideación creativa, la síntesis y la generación de contenido de alta calidad. | 0,60 € | 2,50 € | |
| Igual que Qwen3.8-27B con el modo de razonamiento forzado para razonamiento estructurado y análisis. | 0,60 € | 2,50 € | |
| Qwen3.8-27B configurado para programación avanzada, refactorización, depuración y flujos de trabajo de desarrollo con razonamiento forzado. | 0,60 € | 2,50 € | |
| BGE-m3 | Embeddings de texto para RAG y búsqueda semántica. | 0,05 € | N/A |
| BGE-reranker-v2-m3 | Reranking para la optimización de resultados de búsqueda. | 0,30 € | N/A |
| Document | Convierte cualquier documento a Markdown para ser usado por un LLM. Útil para CAG – RAG en caché, incluidos casos de uso de RAG con visión. Las imágenes de documentos usan IG1 Standard para ser descritas como texto. | N/A | 2,00 € |
| Modelo | Descripción | 1M Tokens de Entrada | 1M Tokens de Salida |
|---|---|---|---|
| Generación de imágenes. El recuento de tokens se basa en la resolución y el nivel de calidad de la imagen. | 0,60 € | 2,50 € | |
| Generación de imágenes con mejora de prompts por LLM. La mejora de prompts usa Qwen3.5-122B-A10B (se factura por separado). El recuento de tokens se basa en la resolución y el nivel de calidad. | 0,60 € | 2,50 € | |
| Edición de imágenes. El recuento de tokens se basa en la resolución y el nivel de calidad de la imagen de origen y de la generada. | 0,60 € | 2,50 € | |
| Edición de imágenes con mejora de prompts por LLM. La mejora de prompts usa Qwen3.5-122B-A10B (se factura por separado). El recuento de tokens se basa en la resolución y la calidad de la imagen de origen y de la generada. | 0,60 € | 2,50 € |
Consigue tus claves de acceso. Integra en minutos. Prueba rápido. Escala con confianza.
1. Consigue las Claves
Solicita tus claves de acceso a la API a nuestro equipo.
2. Integra
Conéctate en minutos con nuestra API compatible con OpenAI.
3. Escala
Prueba rápido, itera y escala con confianza.
Todo lo que necesitas saber sobre IG1 AI API — soberanía, modelos, precios y cómo empezar.
Soberanía y Seguridad
Modelos y Rendimiento
Precios y Facturación
Cómo Empezar