Sicurezza, Conformità & Certificazioni
Conforme al GDPR
Conforme all'EU AI Act
IA 100% Sovrana
Nessun addestramento dei modelli
Modelli di classe mondiale
Presentazione del prodotto
Guarda la nostra presentazione keynote per scoprire come IG1 AI API offre performance IA di classe mondiale con una sovranità totale dei dati — a un costo fino a 3x inferiore.
I benchmark ufficiali di GLM 5.3 Flash evidenziano coding agentico ai vertici, esecuzione da terminale su orizzonti lunghi, un contesto da un milione di token e input multimodale nativo.
Terminal-Bench 2.1
GLM 5.3 Flash ottiene 84.3 su Terminal-Bench 2.1 nella tabella di benchmark ufficiale di Z.ai, allineato ai migliori modelli proprietari nell'esecuzione agentica da terminale.
Finestra di contesto
GLM 5.3 Flash supporta una finestra di contesto ufficiale da un milione di token e fino a 128K token in output, rendendolo adatto a documenti lunghi, codebase di grandi dimensioni e workflow di agenti multi-step.
Multimodale nativo
GLM 5.3 Flash è il primo modello nativamente multimodale della serie GLM-5: input video, immagini, testo e file in un'architettura MoE sparsa con 18 miliardi di parametri attivi.
Una testimonianza filmata: EasyBourse racconta come l'IA sovrana aiuta i suoi team a scalare lo sviluppo software.
Guarda su YouTubeSfruttiamo i modelli open-weight più potenti disponibili oggi. Nessun lock-in del fornitore. Piena trasparenza.
GLM 5.3 Flash Frontiera
di Z.ai — Pechino, Cina
LLM di frontiera efficiente
Il modello flagship del nostro catalogo per ragionamento, codice e workflow agentici — e il suo prezzo per token più basso.
Qwen 3.5
di Alibaba Cloud — Hangzhou, Cina
LLM 122B-A10B
Modello efficiente ad alte prestazioni per chat, codice, ragionamento e workflow multi-turn di produzione.
Qwen Image
di Alibaba Cloud — Hangzhou, Cina
Vision & multimodale
Comprensione delle immagini, analisi visiva e ragionamento multimodale per i workflow aziendali.
Qwen3-VL-Embedding-8B SOTA
di Alibaba Cloud — Hangzhou, Cina
Embedding multimodale
Recupero allo stato dell'arte con embedding multimodali e dimensioni dinamiche fino a 4096 — ben oltre gli encoder testuali a dimensione fissa.
BGE
di BAAI — Pechino, Cina
Embedding & reranking veloci
Embedding di testo veloci a dimensione fissa e reranking — un riferimento di qualità per la ricerca semantica ad alto throughput e le pipeline RAG.
Due modelli stanno per arrivare sulla nostra infrastruttura sovrana: coprono la fascia compatta e la fascia media.
Qwen 3.8 Flash Next Settembre 2026
di Alibaba Cloud — Hangzhou, Cina
LLM di taglia media
La prossima fascia di taglia media, destinata a sostituire Qwen 3.5 122B-A10B per chat, codice e workflow multi-turn di produzione.
Qwen 3.8 27B Settembre 2026
di Alibaba Cloud — Hangzhou, Cina
LLM denso da 27B
Modello denso compatto di ultima generazione per chat di produzione, codice, estrazione e workflow multi-turn.
Prezzi trasparenti per token. Tutti i modelli sono sovrani, ospitati in Francia, senza costi nascosti e senza impegno minimo.
| Modello | Descrizione | 1M token di input | 1M token di output |
|---|---|---|---|
| Modello di frontiera efficiente nativamente multimodale (video, immagini, testo, file) per ragionamento, codice e workflow agentici. Contesto max: 1M token, output 128K. | 0,40 €Input in cache: 0,09 € | 1,30 € | |
| Modello efficiente ad alte prestazioni per chat, codice e ragionamento di produzione. Profilo instruct predefinito. | 0,60 € | 2,50 € | |
| Come Qwen3.5-122B-A10B con iperparametri ottimizzati per l'ideazione creativa, la sintesi e la generazione di contenuti di alta qualità. | 0,60 € | 2,50 € | |
| Come Qwen3.5-122B-A10B con modalità thinking imposta per ragionamento e analisi strutturati. Contesto massimo: 256K token. | 0,60 € | 2,50 € | |
| Qwen3.5-122B-A10B configurato per coding avanzato, architettura, refactoring, debugging e workflow di sviluppo con thinking imposta. | 0,60 € | 2,50 € | |
| Prossima fascia di taglia media, destinata a sostituire Qwen3.5-122B-A10B per chat, codice e workflow multi-turn di produzione. | 0,60 € | 2,50 € | |
| Modello compatto di ultima generazione per chat di produzione, codice, estrazione e workflow multi-turn. Profilo instruct predefinito. | 0,60 € | 2,50 € | |
| Identico a Qwen3.8-27B con iperparametri ottimizzati per ideazione creativa, sintesi e generazione di contenuti di alta qualità. | 0,60 € | 2,50 € | |
| Identico a Qwen3.8-27B con thinking imposta per ragionamento strutturato e analisi. | 0,60 € | 2,50 € | |
| Qwen3.8-27B configurato per coding avanzato, refactoring, debugging e workflow di sviluppo con thinking imposta. | 0,60 € | 2,50 € | |
| BGE-m3 | Embedding di testo per RAG e ricerca semantica. | 0,05 € | N/A |
| BGE-reranker-v2-m3 | Reranking per l'ottimizzazione dei risultati di ricerca. | 0,30 € | N/A |
| Document | Converte qualsiasi documento in Markdown da utilizzare con un LLM. Utile per i casi d'uso CAG – Cached RAG incluso il vision RAG. Le immagini dei documenti utilizzano IG1 Standard per essere descritte come testo. | N/A | 2,00 € |
| Modello | Descrizione | 1M token di input | 1M token di output |
|---|---|---|---|
| Generazione di immagini. Conteggio dei token basato sulla risoluzione e sul livello di qualità dell'immagine. | 0,60 € | 2,50 € | |
| Generazione di immagini con Prompt Enhancing tramite LLM. Il miglioramento del prompt utilizza Qwen3.5-122B-A10B (fatturato separatamente). Conteggio dei token basato sulla risoluzione e sul livello di qualità. | 0,60 € | 2,50 € | |
| Editing di immagini. Conteggio dei token basato sulla risoluzione e sul livello di qualità dell'immagine sorgente e generata. | 0,60 € | 2,50 € | |
| Editing di immagini con Prompt Enhancing tramite LLM. Il miglioramento del prompt utilizza Qwen3.5-122B-A10B (fatturato separatamente). Conteggio dei token basato sulla risoluzione e sulla qualità dell'immagine sorgente e generata. | 0,60 € | 2,50 € |
Ottieni le tue chiavi di accesso. Integra in pochi minuti. Testa velocemente. Scala con fiducia.
1. Ottieni le chiavi
Richiedi le tue chiavi di accesso API al nostro team.
2. Integra
Connettiti in pochi minuti con la nostra API compatibile con OpenAI.
3. Scala
Testa velocemente, itera e scala con fiducia.
Tutto ciò che devi sapere su IG1 AI API — sovranità, modelli, prezzi e come iniziare.
Sovranità & sicurezza
Modelli & performance
Prezzi & fatturazione
Come iniziare