Groq
Cloud di inferenza che esegue modelli aperti di linguaggio, da voce a testo e da testo a voce su hardware proprio (LPU) tramite un’API compatibile con OpenAI, con fatturazione per token.
Categoria: Sviluppo e Codice · Framework per agenti e RAG
Funzioni
Groq e un cloud di inferenza con la propria architettura LPU (Language Processing Unit) per tempi di risposta molto rapidi su modelli aperti di linguaggio, voce in testo e testo in voce. L'accesso API gratuito con limiti di velocita piu bassi semplifica l'onboarding.
I modelli open source popolari tra cui Llama, Gemma e Whisper sono direttamente disponibili. Il modello a pagamento per utilizzo offre basso costo per token e minuto di voce. Groq Playground consente test diretti nel browser senza sforzo di configurazione.
- Cloud di inferenza per modelli aperti di linguaggio, voce in testo e testo in voce
- Accesso API gratuito con limiti di velocita piu bassi
- Prezzo basso per token e per minuto di voce nel modello a pagamento per utilizzo
- Architettura LPU (Language Processing Unit) per tempi di risposta molto rapidi
- Supporto per modelli open source popolari (Llama, Gemma, Whisper e altri)
- Groq Playground per test diretti nel browser
Prezzi e piani
| Livello | Prezzo | Periodo | Cosa include |
|---|---|---|---|
| Free Plan | gratis | - | accesso gratuito all’API con limiti di frequenza più bassi esempi dei limiti Free pubblicati: openai/gpt-oss-120b e openai/gpt-oss-20b, ciascuno 30 richieste al minuto, 1.000 richieste al giorno, 8.000 token al minuto, 200.000 token al giorno groq/compound e groq/compound-mini, ciascuno 30 richieste al minuto, 250 al giorno, 70.000 token al minuto whisper-large-v3 e whisper-large-v3-turbo, ciascuno 20 richieste al minuto, 2.000 al giorno, 7.200 secondi di audio all’ora, 28.800 al giorno senza Batch né Flex Processing |
| Developer Plan | gratis | fatturazione mensile in seguito | testo del fornitore: 'When you upgrade, there's no immediate charge - you'll be billed for tokens at month-end or when you reach progressive billing thresholds' è necessario un metodo di pagamento valido: carta di credito, conto bancario USA o addebito SEPA limiti di frequenza più alti, chat di supporto, Flex Service Tier, Batch Processing, limiti di spesa fatturazione a scaglioni al raggiungimento di 1 $, 10 $, 100 $, 500 $ e 1.000 $ di uso cumulato; oltre 1.000 $ di uso a vita, solo fatturazione mensile le fatture sotto 0,50 $ non vengono emesse è possibile tornare a Free in qualsiasi momento |
| Modellpreis openai/gpt-oss-120b | 0,15 $ Input / 0,60 $ Output | per 1 milione di token | finestra di contesto 131.072 token, massimo 65.536 token di output dato del fornitore sulla velocità: circa 500 token al secondo limite di frequenza Developer 250.000 token al minuto, 1.000 richieste al minuto |
| Modellpreis openai/gpt-oss-20b | 0,075 $ Input / 0,30 $ Output | per 1 milione di token | finestra di contesto 131.072 token, massimo 65.536 token di output dato del fornitore sulla velocità: circa 1.000 token al secondo limite di frequenza Developer 250.000 token al minuto, 1.000 richieste al minuto |
| Modellpreis openai/gpt-oss-safeguard-20b (Preview) | 0,075 $ Input / 0,30 $ Output | per 1 milione di token | finestra di contesto 131.072 token limite di frequenza Developer 150.000 token al minuto, 1.000 richieste al minuto modello Preview, non pensato per la produzione |
| Modellpreis qwen/qwen3.6-27b (Preview) | 0,60 $ Input / 3,00 $ Output | per 1 milione di token | finestra di contesto 131.072 token, massimo 16.384 token di output, file fino a 20 MB |
| Modellpreis qwen/qwen3.8-27b (Preview) | 0,80 $ Input / 4,00 $ Output | per 1 milione di token | finestra di contesto 131.042 token, massimo 16.384 token di output, file fino a 20 MB |
| Modellpreis whisper-large-v3 (Spracherkennung) | 0,111 $ | per ora audio | file fino a 100 MB limite di frequenza Developer 200.000 secondi di audio all’ora, 300 richieste al minuto |
| Modellpreis whisper-large-v3-turbo (Spracherkennung) | 0,04 $ | per ora audio | limite di frequenza Developer 400.000 secondi di audio all’ora, 400 richieste al minuto |
| Modellpreis canopylabs/orpheus-v1-english (Sprachausgabe, Preview) | 22,00 $ | 1 milione di caratteri | finestra di contesto 4.000 token limite di frequenza Developer 50.000 token al minuto, 250 richieste al minuto |
| Modellpreis canopylabs/orpheus-arabic-saudi (Sprachausgabe, Preview) | 40,00 $ | 1 milione di caratteri | finestra di contesto 4.000 token limite di frequenza Developer 50.000 token al minuto, 250 richieste al minuto |
| Modellpreis meta-llama/llama-prompt-guard-2-22m und -86m (Preview) | 0,03 $ Input und Output (22M) bzw. 0,04 $ Input und Output (86M) | per 1 milione di token | finestra di contesto 512 token limite di frequenza Developer 30.000 token al minuto, 100 richieste al minuto |
| modelli Enterprise (llama-3.1-8b-instant, llama-3.3-70b-versatile, minimaxai/minimax-m2.7) | su richiesta | - | la tabella dei modelli indica esplicitamente 'Contact Sales' per il prezzo e il limite di frequenza di questi modelli |
| Performance Tier (Enterprise) | su richiesta | - | testo del fornitore: 'Performance is delivered as provisioned throughput: you purchase input and output capacity bundles and pay for that provisioned capacity rather than per-token usage. Reach out to inquire about pricing.' SLA di disponibilità del 99,9% e garanzia di latenza del 99% secondo il contratto solo per i piani Enterprise, lunghezza di contesto sotto 8.192 token modelli disponibili: openai/gpt-oss-120b, openai/gpt-oss-20b, llama-3.3-70b-versatile |
Limiti
Accessibile agli utenti europei. Per le FAQ di fatturazione, Groq accetta esplicitamente l'addebito SEPA accanto a carte di credito (Visa, MasterCard, American Express, Discover) e conti bancari statunitensi - SEPA è il percorso di pagamento europeo, quindi i clienti europei sono soddisfatti. Il fornitore gestisce i propri data center nell'UE (EU-1 Vantaa, Finlandia) e nel Regno Unito (EU-2 London). C'è un livello libero con limiti di tasso pubblicati; il livello di sviluppo richiede un metodo di pagamento valido. Groq è un'azienda statunitense; La politica sulla privacy afferma: "Groq si trova negli Stati Uniti, e mantiene le operazioni di elaborazione in varie giurisdizioni globali." Pagina di documentazione 'Your Data', verbatim: 'Di default, Groq non conserva i dati dei clienti per le richieste di inferenza.' verbatim: i dati vengono mantenuti solo 'Se si utilizzano funzionalità che richiedono la conservazione dei dati per funzionare (ad esempio, lavori in batch, ottimizzazione e LoRAs)' o 'Se necessario per proteggere l'affidabilità della piattaforma (ad esempio, per risolvere guasti del sistema o indagare abusi)'; tali registri sono 'ritenuti per un massimo di 30 giorni, a meno che non sia legalmente necessario mantenere più a lungo' e possono essere spenti. Sulla posizione di archiviazione, verbatim: 'Tutti i dati dei clienti sono conservati in Google Cloud Platform (GCP) secchi situati negli Stati Uniti. Groq mantiene rigidi controlli di accesso e standard di sicurezza come dettagliati nel Groq Trust Center. Se applicabile, i Clienti possono fare affidamento su clausole contrattuali standard (SCC) per i trasferimenti tra paesi terzi e Stati Uniti' Inoltre: 'Tutti i clienti possono abilitare Zero Data Retention (ZDR) nelle impostazioni di Data Controls'.
Strumenti simili
FAQ
Groq è disponibile gratuitamente?
Sì. È previsto un piano gratuito permanente, non una prova a tempo.
Dove ha sede il fornitore di Groq?
Groq, Inc., con sede in USA. Per il trattamento dei dati vale il contratto del fornitore.
Groq è ancora attivo?
Attivo. Groq si descrive come il "sopramier neocloud per un'inferenza rapida" e afferma che gestisce 13 data center in quattro continenti, tra cui EU-1 in Vantaa (Finlandia) e EU-2 a Londra (UK). L'offerta dello sviluppatore è GroqCloud su console.groq.com; la pagina della piattaforma nomina inoltre i blocchi edificio GroqMetal (infrastruttura), GroqCore (inferenza) e GroqAssured (controllo delle imprese). L'ex pagina groq.com/pricing ora reindirizza alla homepage; i prezzi vivono nella documentazione della console.
Quanti piani sono documentati per Groq?
Il catalogo documenta 14 piani con prezzo, periodo di fatturazione e funzionalità incluse.
Per quale caso d’uso è classificato Groq?
Groq è elencato nel catalogo nella categoria «Sviluppo e Codice».
Da dove provengono i dati su Groq?
Prezzi, limiti e dati del prodotto sono documentati in base alla pagina ufficiale indicata del fornitore.
Come confrontiamo
Confrontiamo accesso gratuito, ingresso a pagamento, limiti del piano, funzioni e le fonti ufficiali indicate. I dati senza fonte restano non pubblicati.
Comparono solo voci confermate. Prezzi, piani e limiti vengono dalle pagine ufficiali indicate. Le assenze restano non pubblicate. Gli elenchi dei risultati sono alfabetici per impostazione predefinita e possono passare a Gratuito prima; nessuna opzione è una classifica di qualità. Prevale sempre la pagina del fornitore.
Redazione e verifica: team di AI Compare
Fonti
- https://groq.com/
- https://groq.com/platform
- https://groq.com/legal
- https://groq.com/privacy-policy
- https://console.groq.com/docs/models
- https://console.groq.com/docs/billing-faqs
- https://console.groq.com/docs/rate-limits
- https://console.groq.com/docs/performance-tier
- https://console.groq.com/docs/your-data
Visita il sito (apre in una nuova scheda)
Dato non aggiornato? Le pagine dei fornitori cambiano senza preavviso. Segnala un errore