AI Compare AI Compare

Veja preços, funções e limites.

Região de preços
Automático
Idioma
PT

Groq

Nuvem de inferência que executa modelos abertos de linguagem, de fala para texto e de texto para fala em hardware próprio (LPU) por uma API compatível com a OpenAI, com cobrança por token.

Acesso gratuitoPlano gratuito
Pago a partir deDeveloper Plantexto do fornecedor: 'When you upgrade, there's no immediate charge - you'll be billed for tokens at month-end or when you reach progressive …

Categoria: Desenvolvimento e Código · Frameworks de agentes e RAG

Funções

O Groq e uma nuvem de inferencia com sua propria arquitetura LPU (Language Processing Unit) para tempos de resposta muito rapidos em modelos abertos de linguagem, fala para texto e texto para fala. O acesso API gratuito com limites de taxa mais baixos simplifica o onboarding.

Modelos de codigo aberto populares incluindo Llama, Gemma e Whisper estao diretamente disponiveis. O modelo de pagamento por uso oferece baixo custo por token e minuto de fala. O Groq Playground permite testes diretos no navegador sem esforco de configuracao.

Preços e planos

PlanoPreçoPeríodoO que está incluído
Free Plangrátis-acesso gratuito à API com limites de taxa mais baixos
exemplos dos limites Free publicados: openai/gpt-oss-120b e openai/gpt-oss-20b, cada um 30 solicitações por minuto, 1.000 solicitações por dia, 8.000 tokens por minuto, 200.000 tokens por dia
groq/compound e groq/compound-mini, cada um 30 solicitações por minuto, 250 por dia, 70.000 tokens por minuto
whisper-large-v3 e whisper-large-v3-turbo, cada um 20 solicitações por minuto, 2.000 por dia, 7.200 segundos de áudio por hora, 28.800 por dia
sem Batch nem Flex Processing
Developer Plangrátiscobrança mensal depoistexto do fornecedor: 'When you upgrade, there's no immediate charge - you'll be billed for tokens at month-end or when you reach progressive billing thresholds'
é necessário um método de pagamento válido: cartão de crédito, conta bancária dos EUA ou débito SEPA
limites de taxa mais altos, chat de suporte, Flex Service Tier, Batch Processing, limites de gasto
faturamento em faixas ao atingir uso acumulado de 1 $, 10 $, 100 $, 500 $ e 1.000 $; a partir de 1.000 $ de uso vitalício, apenas faturamento mensal
faturas abaixo de 0,50 $ não são emitidas
é possível voltar ao Free a qualquer momento
Modellpreis openai/gpt-oss-120b0,15 $ Input / 0,60 $ Outputpor 1 milhão de tokensjanela de contexto 131.072 tokens, máximo 65.536 tokens de saída
dado do fornecedor sobre velocidade: cerca de 500 tokens por segundo
limite de taxa Developer 250.000 tokens por minuto, 1.000 solicitações por minuto
Modellpreis openai/gpt-oss-20b0,075 $ Input / 0,30 $ Outputpor 1 milhão de tokensjanela de contexto 131.072 tokens, máximo 65.536 tokens de saída
dado do fornecedor sobre velocidade: cerca de 1.000 tokens por segundo
limite de taxa Developer 250.000 tokens por minuto, 1.000 solicitações por minuto
Modellpreis openai/gpt-oss-safeguard-20b (Preview)0,075 $ Input / 0,30 $ Outputpor 1 milhão de tokensjanela de contexto 131.072 tokens
limite de taxa Developer 150.000 tokens por minuto, 1.000 solicitações por minuto
modelo Preview, não destinado à produção
Modellpreis qwen/qwen3.6-27b (Preview)0,60 $ Input / 3,00 $ Outputpor 1 milhão de tokensjanela de contexto 131.072 tokens, máximo 16.384 tokens de saída, arquivos até 20 MB
Modellpreis qwen/qwen3.8-27b (Preview)0,80 $ Input / 4,00 $ Outputpor 1 milhão de tokensjanela de contexto 131.042 tokens, máximo 16.384 tokens de saída, arquivos até 20 MB
Modellpreis whisper-large-v3 (Spracherkennung)0,111 $por hora de áudioarquivos até 100 MB
limite de taxa Developer 200.000 segundos de áudio por hora, 300 solicitações por minuto
Modellpreis whisper-large-v3-turbo (Spracherkennung)0,04 $por hora de áudiolimite de taxa Developer 400.000 segundos de áudio por hora, 400 solicitações por minuto
Modellpreis canopylabs/orpheus-v1-english (Sprachausgabe, Preview)22,00 $1 milhão de caracteresjanela de contexto 4.000 tokens
limite de taxa Developer 50.000 tokens por minuto, 250 solicitações por minuto
Modellpreis canopylabs/orpheus-arabic-saudi (Sprachausgabe, Preview)40,00 $1 milhão de caracteresjanela de contexto 4.000 tokens
limite de taxa Developer 50.000 tokens por minuto, 250 solicitações por minuto
Modellpreis meta-llama/llama-prompt-guard-2-22m und -86m (Preview)0,03 $ Input und Output (22M) bzw. 0,04 $ Input und Output (86M)por 1 milhão de tokensjanela de contexto 512 tokens
limite de taxa Developer 30.000 tokens por minuto, 100 solicitações por minuto
modelos Enterprise (llama-3.1-8b-instant, llama-3.3-70b-versatile, minimaxai/minimax-m2.7)sob consulta-a tabela de modelos indica explicitamente 'Contact Sales' para o preço e o limite de taxa destes modelos
Performance Tier (Enterprise)sob consulta-texto do fornecedor: 'Performance is delivered as provisioned throughput: you purchase input and output capacity bundles and pay for that provisioned capacity rather than per-token usage. Reach out to inquire about pricing.'
SLA de disponibilidade de 99,9% e garantia de latência de 99% conforme o contrato
somente para planos Enterprise, comprimento de contexto abaixo de 8.192 tokens
modelos disponíveis: openai/gpt-oss-120b, openai/gpt-oss-20b, llama-3.3-70b-versatile

Limites

Acessível aos utilizadores europeus. Pelas perguntas frequentes de cobrança, Groq aceita explicitamente débito SEPA juntamente com cartões de crédito (Visa, MasterCard, American Express, Discover) e contas bancárias dos EUA - SEPA é a rota de pagamento europeia, Assim, os clientes europeus são atendidos. O fornecedor gere os seus próprios centros de dados na UE (EU-1 Vantaa, Finlândia) e no Reino Unido (EU-2 Londres). Existe um nível livre com limites de taxa publicados; o nível do desenvolvedor requer um método de pagamento válido. Groq é uma empresa dos EUA; a política de privacidade afirma: "Groq está localizado nos Estados Unidos, e mantém operações de processamento em várias jurisdições globais. verbatim: 'Por padrão, Groq não retém dados do cliente para pedidos de inferência.' Excepções, verbatim: os dados são retidos apenas 'Se você usar recursos que exigem retenção de dados para funcionar (por exemplo, trabalhos em lotes, «Se necessário para proteger a fiabilidade da plataforma (por exemplo, Resolver as falhas do sistema ou investigar os abusos)». tais toros são "retidos por até 30 dias, a menos que legalmente necessários para manter mais tempo" e podem ser desligados. No local de armazenamento, verbatim: 'Todos os dados do cliente são retidos em baldes da Google Cloud Platform (GCP) localizados nos Estados Unidos. Groq mantém rigorosos controles de acesso e padrões de segurança detalhados no Centro de Confiança Groq. Quando aplicável, Os clientes podem confiar em cláusulas contratuais padrão (SCCs) para transferências entre países terceiros e os EUA' Além disso: "Todos os clientes podem habilitar a retenção de dados zero (ZDR) em configurações de controles de dados".

Ferramentas semelhantes

FAQ

O Groq tem uma opção gratuita?

Sim. Há um plano gratuito permanente, não um teste por tempo limitado.

Onde fica a sede do fornecedor do Groq?

Groq, Inc., com sede em EUA. Para o tratamento de dados vale o contrato do fornecedor.

O Groq ainda está ativo?

Activo. Groq descreve-se como a "neonuvem premier para inferência rápida" e afirma que opera 13 centros de dados em quatro continentes, incluindo a UE-1 em Vantaa (Finlândia) e a UE-2 em Londres (Reino Unido). O desenvolvedor que oferece é GroqCloud no console.groq.com; a página da plataforma também nomeia os blocos de construção GroqMetal (infraestrutura), GroqCore (inferência) e GroqAssured (controle empresarial). A antiga página groq.com/pricing agora redireciona para a página inicial; os preços vivem na documentação do console.

Quantos planos estão documentados para Groq?

O catálogo documenta 14 planos com preço, período de cobrança e recursos incluídos.

Para qual caso de uso o Groq está categorizado?

O Groq aparece no catálogo na categoria “Desenvolvimento e Código”.

De onde vêm os dados sobre o Groq?

Preços, limites e dados do produto são documentados com base na página oficial indicada do fornecedor.

Como comparamos

Comparamos acesso grátis, entrada paga, limites do plano, funções e as fontes oficiais indicadas. Dados sem fonte ficam como não publicados.

Só entram registros confirmados. Preços, planos e limites vêm de páginas oficiais indicadas. Ausências ficam como não publicados. As listas de resultados são alfabéticas por padrão e podem ser alteradas para Gratuito primeiro; nenhuma opção é um ranking de qualidade. A página do fornecedor prevalece.

Redação e verificação: equipe da AI Compare

Fontes

Visitar site (abre em uma nova aba)

Dado desatualizado? As páginas dos fornecedores mudam sem aviso. Reportar um erro