Groq
Nuvem de inferência que executa modelos abertos de linguagem, de fala para texto e de texto para fala em hardware próprio (LPU) por uma API compatível com a OpenAI, com cobrança por token.
Categoria: Desenvolvimento e Código · Frameworks de agentes e RAG
Funções
O Groq e uma nuvem de inferencia com sua propria arquitetura LPU (Language Processing Unit) para tempos de resposta muito rapidos em modelos abertos de linguagem, fala para texto e texto para fala. O acesso API gratuito com limites de taxa mais baixos simplifica o onboarding.
Modelos de codigo aberto populares incluindo Llama, Gemma e Whisper estao diretamente disponiveis. O modelo de pagamento por uso oferece baixo custo por token e minuto de fala. O Groq Playground permite testes diretos no navegador sem esforco de configuracao.
- Nuvem de inferencia para modelos abertos de linguagem, fala para texto e texto para fala
- Acesso API gratuito com limites de taxa mais baixos
- Preco baixo por token e por minuto de fala no modelo de pagamento por uso
- Arquitetura LPU (Language Processing Unit) para tempos de resposta muito rapidos
- Suporte para modelos de codigo aberto populares (Llama, Gemma, Whisper e outros)
- Groq Playground para testes diretos no navegador
Preços e planos
| Plano | Preço | Período | O que está incluído |
|---|---|---|---|
| Free Plan | grátis | - | acesso gratuito à API com limites de taxa mais baixos exemplos dos limites Free publicados: openai/gpt-oss-120b e openai/gpt-oss-20b, cada um 30 solicitações por minuto, 1.000 solicitações por dia, 8.000 tokens por minuto, 200.000 tokens por dia groq/compound e groq/compound-mini, cada um 30 solicitações por minuto, 250 por dia, 70.000 tokens por minuto whisper-large-v3 e whisper-large-v3-turbo, cada um 20 solicitações por minuto, 2.000 por dia, 7.200 segundos de áudio por hora, 28.800 por dia sem Batch nem Flex Processing |
| Developer Plan | grátis | cobrança mensal depois | texto do fornecedor: 'When you upgrade, there's no immediate charge - you'll be billed for tokens at month-end or when you reach progressive billing thresholds' é necessário um método de pagamento válido: cartão de crédito, conta bancária dos EUA ou débito SEPA limites de taxa mais altos, chat de suporte, Flex Service Tier, Batch Processing, limites de gasto faturamento em faixas ao atingir uso acumulado de 1 $, 10 $, 100 $, 500 $ e 1.000 $; a partir de 1.000 $ de uso vitalício, apenas faturamento mensal faturas abaixo de 0,50 $ não são emitidas é possível voltar ao Free a qualquer momento |
| Modellpreis openai/gpt-oss-120b | 0,15 $ Input / 0,60 $ Output | por 1 milhão de tokens | janela de contexto 131.072 tokens, máximo 65.536 tokens de saída dado do fornecedor sobre velocidade: cerca de 500 tokens por segundo limite de taxa Developer 250.000 tokens por minuto, 1.000 solicitações por minuto |
| Modellpreis openai/gpt-oss-20b | 0,075 $ Input / 0,30 $ Output | por 1 milhão de tokens | janela de contexto 131.072 tokens, máximo 65.536 tokens de saída dado do fornecedor sobre velocidade: cerca de 1.000 tokens por segundo limite de taxa Developer 250.000 tokens por minuto, 1.000 solicitações por minuto |
| Modellpreis openai/gpt-oss-safeguard-20b (Preview) | 0,075 $ Input / 0,30 $ Output | por 1 milhão de tokens | janela de contexto 131.072 tokens limite de taxa Developer 150.000 tokens por minuto, 1.000 solicitações por minuto modelo Preview, não destinado à produção |
| Modellpreis qwen/qwen3.6-27b (Preview) | 0,60 $ Input / 3,00 $ Output | por 1 milhão de tokens | janela de contexto 131.072 tokens, máximo 16.384 tokens de saída, arquivos até 20 MB |
| Modellpreis qwen/qwen3.8-27b (Preview) | 0,80 $ Input / 4,00 $ Output | por 1 milhão de tokens | janela de contexto 131.042 tokens, máximo 16.384 tokens de saída, arquivos até 20 MB |
| Modellpreis whisper-large-v3 (Spracherkennung) | 0,111 $ | por hora de áudio | arquivos até 100 MB limite de taxa Developer 200.000 segundos de áudio por hora, 300 solicitações por minuto |
| Modellpreis whisper-large-v3-turbo (Spracherkennung) | 0,04 $ | por hora de áudio | limite de taxa Developer 400.000 segundos de áudio por hora, 400 solicitações por minuto |
| Modellpreis canopylabs/orpheus-v1-english (Sprachausgabe, Preview) | 22,00 $ | 1 milhão de caracteres | janela de contexto 4.000 tokens limite de taxa Developer 50.000 tokens por minuto, 250 solicitações por minuto |
| Modellpreis canopylabs/orpheus-arabic-saudi (Sprachausgabe, Preview) | 40,00 $ | 1 milhão de caracteres | janela de contexto 4.000 tokens limite de taxa Developer 50.000 tokens por minuto, 250 solicitações por minuto |
| Modellpreis meta-llama/llama-prompt-guard-2-22m und -86m (Preview) | 0,03 $ Input und Output (22M) bzw. 0,04 $ Input und Output (86M) | por 1 milhão de tokens | janela de contexto 512 tokens limite de taxa Developer 30.000 tokens por minuto, 100 solicitações por minuto |
| modelos Enterprise (llama-3.1-8b-instant, llama-3.3-70b-versatile, minimaxai/minimax-m2.7) | sob consulta | - | a tabela de modelos indica explicitamente 'Contact Sales' para o preço e o limite de taxa destes modelos |
| Performance Tier (Enterprise) | sob consulta | - | texto do fornecedor: 'Performance is delivered as provisioned throughput: you purchase input and output capacity bundles and pay for that provisioned capacity rather than per-token usage. Reach out to inquire about pricing.' SLA de disponibilidade de 99,9% e garantia de latência de 99% conforme o contrato somente para planos Enterprise, comprimento de contexto abaixo de 8.192 tokens modelos disponíveis: openai/gpt-oss-120b, openai/gpt-oss-20b, llama-3.3-70b-versatile |
Limites
Acessível aos utilizadores europeus. Pelas perguntas frequentes de cobrança, Groq aceita explicitamente débito SEPA juntamente com cartões de crédito (Visa, MasterCard, American Express, Discover) e contas bancárias dos EUA - SEPA é a rota de pagamento europeia, Assim, os clientes europeus são atendidos. O fornecedor gere os seus próprios centros de dados na UE (EU-1 Vantaa, Finlândia) e no Reino Unido (EU-2 Londres). Existe um nível livre com limites de taxa publicados; o nível do desenvolvedor requer um método de pagamento válido. Groq é uma empresa dos EUA; a política de privacidade afirma: "Groq está localizado nos Estados Unidos, e mantém operações de processamento em várias jurisdições globais. verbatim: 'Por padrão, Groq não retém dados do cliente para pedidos de inferência.' Excepções, verbatim: os dados são retidos apenas 'Se você usar recursos que exigem retenção de dados para funcionar (por exemplo, trabalhos em lotes, «Se necessário para proteger a fiabilidade da plataforma (por exemplo, Resolver as falhas do sistema ou investigar os abusos)». tais toros são "retidos por até 30 dias, a menos que legalmente necessários para manter mais tempo" e podem ser desligados. No local de armazenamento, verbatim: 'Todos os dados do cliente são retidos em baldes da Google Cloud Platform (GCP) localizados nos Estados Unidos. Groq mantém rigorosos controles de acesso e padrões de segurança detalhados no Centro de Confiança Groq. Quando aplicável, Os clientes podem confiar em cláusulas contratuais padrão (SCCs) para transferências entre países terceiros e os EUA' Além disso: "Todos os clientes podem habilitar a retenção de dados zero (ZDR) em configurações de controles de dados".
Ferramentas semelhantes
FAQ
O Groq tem uma opção gratuita?
Sim. Há um plano gratuito permanente, não um teste por tempo limitado.
Onde fica a sede do fornecedor do Groq?
Groq, Inc., com sede em EUA. Para o tratamento de dados vale o contrato do fornecedor.
O Groq ainda está ativo?
Activo. Groq descreve-se como a "neonuvem premier para inferência rápida" e afirma que opera 13 centros de dados em quatro continentes, incluindo a UE-1 em Vantaa (Finlândia) e a UE-2 em Londres (Reino Unido). O desenvolvedor que oferece é GroqCloud no console.groq.com; a página da plataforma também nomeia os blocos de construção GroqMetal (infraestrutura), GroqCore (inferência) e GroqAssured (controle empresarial). A antiga página groq.com/pricing agora redireciona para a página inicial; os preços vivem na documentação do console.
Quantos planos estão documentados para Groq?
O catálogo documenta 14 planos com preço, período de cobrança e recursos incluídos.
Para qual caso de uso o Groq está categorizado?
O Groq aparece no catálogo na categoria “Desenvolvimento e Código”.
De onde vêm os dados sobre o Groq?
Preços, limites e dados do produto são documentados com base na página oficial indicada do fornecedor.
Como comparamos
Comparamos acesso grátis, entrada paga, limites do plano, funções e as fontes oficiais indicadas. Dados sem fonte ficam como não publicados.
Só entram registros confirmados. Preços, planos e limites vêm de páginas oficiais indicadas. Ausências ficam como não publicados. As listas de resultados são alfabéticas por padrão e podem ser alteradas para Gratuito primeiro; nenhuma opção é um ranking de qualidade. A página do fornecedor prevalece.
Redação e verificação: equipe da AI Compare
Fontes
- https://groq.com/
- https://groq.com/platform
- https://groq.com/legal
- https://groq.com/privacy-policy
- https://console.groq.com/docs/models
- https://console.groq.com/docs/billing-faqs
- https://console.groq.com/docs/rate-limits
- https://console.groq.com/docs/performance-tier
- https://console.groq.com/docs/your-data
Visitar site (abre em uma nova aba)
Dado desatualizado? As páginas dos fornecedores mudam sem aviso. Reportar um erro