Groq
Nube de inferencia que ejecuta modelos abiertos de lenguaje, de voz a texto y de texto a voz sobre hardware propio (LPU) a través de una API compatible con OpenAI, con facturación por token.
Categoría: Desarrollo y Código · Frameworks de agentes y RAG
Funciones
Groq es una nube de inferencia con su propia arquitectura LPU (Unidad de Procesamiento de Lenguaje) para tiempos de respuesta muy rapidos en modelos abiertos de lenguaje, voz a texto y texto a voz. El acceso API gratuito con limites de velocidad mas bajos simplifica la incorporacion.
Los modelos de codigo abierto populares, incluidos Llama, Gemma y Whisper, estan disponibles directamente. El modelo de pago por uso ofrece bajo costo por token y minuto de voz. Groq Playground permite pruebas directas en el navegador sin esfuerzo de configuracion.
- Nube de inferencia para modelos abiertos de lenguaje, voz a texto y texto a voz
- Acceso API gratuito con limites de velocidad mas bajos
- Precio bajo por token y por minuto de voz en modelo de pago por uso
- Arquitectura LPU (Unidad de Procesamiento de Lenguaje) para tiempos de respuesta muy rapidos
- Soporte para modelos de codigo abierto populares (Llama, Gemma, Whisper y otros)
- Groq Playground para pruebas directas en el navegador
Precios y planes
| Plan | Precio | Periodo | Qué incluye |
|---|---|---|---|
| Free Plan | gratis | - | acceso gratuito a la API con límites de tasa más bajos ejemplos de los límites Free publicados: openai/gpt-oss-120b y openai/gpt-oss-20b, cada uno 30 solicitudes por minuto, 1.000 solicitudes por día, 8.000 tokens por minuto, 200.000 tokens por día groq/compound y groq/compound-mini, cada uno 30 solicitudes por minuto, 250 por día, 70.000 tokens por minuto whisper-large-v3 y whisper-large-v3-turbo, cada uno 20 solicitudes por minuto, 2.000 por día, 7.200 segundos de audio por hora, 28.800 por día sin Batch ni Flex Processing |
| Developer Plan | gratis | facturación mensual después | texto del proveedor: 'When you upgrade, there's no immediate charge - you'll be billed for tokens at month-end or when you reach progressive billing thresholds' hace falta un método de pago válido: tarjeta de crédito, cuenta bancaria de EE. UU. o adeudo SEPA límites de tasa más altos, chat de soporte, Flex Service Tier, Batch Processing, límites de gasto facturación por tramos al alcanzar un uso acumulado de 1 $, 10 $, 100 $, 500 $ y 1.000 $; a partir de 1.000 $ de uso vitalicio, solo facturación mensual no se emiten facturas por debajo de 0,50 $ es posible volver a Free en cualquier momento |
| Modellpreis openai/gpt-oss-120b | 0,15 $ Input / 0,60 $ Output | por 1 millón de tokens | ventana de contexto 131.072 tokens, máximo 65.536 tokens de salida dato del proveedor sobre velocidad: unos 500 tokens por segundo límite de tasa Developer 250.000 tokens por minuto, 1.000 solicitudes por minuto |
| Modellpreis openai/gpt-oss-20b | 0,075 $ Input / 0,30 $ Output | por 1 millón de tokens | ventana de contexto 131.072 tokens, máximo 65.536 tokens de salida dato del proveedor sobre velocidad: unos 1.000 tokens por segundo límite de tasa Developer 250.000 tokens por minuto, 1.000 solicitudes por minuto |
| Modellpreis openai/gpt-oss-safeguard-20b (Preview) | 0,075 $ Input / 0,30 $ Output | por 1 millón de tokens | ventana de contexto 131.072 tokens límite de tasa Developer 150.000 tokens por minuto, 1.000 solicitudes por minuto modelo Preview, no pensado para producción |
| Modellpreis qwen/qwen3.6-27b (Preview) | 0,60 $ Input / 3,00 $ Output | por 1 millón de tokens | ventana de contexto 131.072 tokens, máximo 16.384 tokens de salida, archivos hasta 20 MB |
| Modellpreis qwen/qwen3.8-27b (Preview) | 0,80 $ Input / 4,00 $ Output | por 1 millón de tokens | ventana de contexto 131.042 tokens, máximo 16.384 tokens de salida, archivos hasta 20 MB |
| Modellpreis whisper-large-v3 (Spracherkennung) | 0,111 $ | por hora de audio | archivos hasta 100 MB límite de tasa Developer 200.000 segundos de audio por hora, 300 solicitudes por minuto |
| Modellpreis whisper-large-v3-turbo (Spracherkennung) | 0,04 $ | por hora de audio | límite de tasa Developer 400.000 segundos de audio por hora, 400 solicitudes por minuto |
| Modellpreis canopylabs/orpheus-v1-english (Sprachausgabe, Preview) | 22,00 $ | 1 millón de caracteres | ventana de contexto 4.000 tokens límite de tasa Developer 50.000 tokens por minuto, 250 solicitudes por minuto |
| Modellpreis canopylabs/orpheus-arabic-saudi (Sprachausgabe, Preview) | 40,00 $ | 1 millón de caracteres | ventana de contexto 4.000 tokens límite de tasa Developer 50.000 tokens por minuto, 250 solicitudes por minuto |
| Modellpreis meta-llama/llama-prompt-guard-2-22m und -86m (Preview) | 0,03 $ Input und Output (22M) bzw. 0,04 $ Input und Output (86M) | por 1 millón de tokens | ventana de contexto 512 tokens límite de tasa Developer 30.000 tokens por minuto, 100 solicitudes por minuto |
| modelos Enterprise (llama-3.1-8b-instant, llama-3.3-70b-versatile, minimaxai/minimax-m2.7) | a consultar | - | la tabla de modelos indica explícitamente 'Contact Sales' para el precio y el límite de tasa de estos modelos |
| Performance Tier (Enterprise) | a consultar | - | texto del proveedor: 'Performance is delivered as provisioned throughput: you purchase input and output capacity bundles and pay for that provisioned capacity rather than per-token usage. Reach out to inquire about pricing.' SLA de disponibilidad del 99,9 % y garantía de latencia del 99 % según contrato solo para planes Enterprise, longitud de contexto por debajo de 8.192 tokens modelos disponibles: openai/gpt-oss-120b, openai/gpt-oss-20b, llama-3.3-70b-versatile |
Límites
Accesible a los usuarios europeos. Por la facturación FAQ, Groq acepta explícitamente el débito SEPA junto con tarjetas de crédito (Visa, MasterCard, American Express, Discover) y cuentas bancarias de Estados Unidos - SEPA es la ruta de pago europea, por lo que los clientes europeos son atendidos. El proveedor dirige sus propios centros de datos en la UE (EU-1 Vantaa, Finlandia) y el Reino Unido (EU-2 London). Hay un nivel libre con límites de tarifas publicados; el nivel de desarrollador requiere un método de pago válido. Groq es una empresa estadounidense; la política de privacidad establece: 'Groq se encuentra en los Estados Unidos, y mantiene operaciones de procesamiento en varias jurisdicciones globales.' Página de documentación 'Sus datos', verbatim: 'Por defecto, Groq no conserva datos de clientes para solicitudes de inferencia.' Excepciones, verbatim: los datos se retienen solamente 'Si utiliza características que requieren la retención de datos para funcionar (por ejemplo, trabajos de lote, ajuste fino y LoRAs)' o 'Si es necesario para proteger la fiabilidad de las plataformas (por ejemplo, para resolver fallos del sistema o investigar abusos)'; tales registros son 'retenidos por hasta 30 días, a menos que legalmente requerido para retener más tiempo' y puede ser apagado. En la ubicación de almacenamiento, verbatim: 'Todos los datos del cliente se conservan en los cubos de Google Cloud Platform (GCP) ubicados en los Estados Unidos. Groq mantiene estrictos controles de acceso y estándares de seguridad como se detalla en el Centro Fiduciario Groq. Cuando sea aplicable, los clientes pueden confiar en cláusulas contractuales estándar (SCCs) para transferencias entre terceros países y EE.UU.' Adicionalmente: "Todos los clientes pueden permitir la retención de datos cero (ZDR) en la configuración de Controles de datos.' La política de privacidad no menciona el uso de entradas de los clientes para el entrenamiento de modelos.
Herramientas similares
FAQ
¿Groq tiene una opción gratuita?
Sí. Hay un plan gratuito permanente, no una prueba limitada.
¿Dónde tiene su sede el proveedor de Groq?
Groq, Inc., con sede en EE. UU.. Para el tratamiento de datos rige el contrato del proveedor.
¿Groq sigue activo?
Activo. Groq se describe como el " neocloud más cercano para la inferencia rápida" y afirma que opera 13 centros de datos en cuatro continentes, incluyendo la UE-1 en Vantaa (Finlandia) y la UE-2 en Londres (Reino Unido). La oferta de desarrolladores es GroqCloud en console.groq.com; la página de la plataforma nombres adicionales los bloques de construcción GroqMetal (infraestructura), GroqCore (inferencia) y GroqAssured (control de la empresa). La antigua página groq.com/pricing ahora redirige a la página principal; los precios viven en la documentación de la consola.
¿Cuántos planes hay documentados para Groq?
El catálogo documenta 14 planes con precio, periodo de facturación y prestaciones incluidas.
¿Para qué caso de uso está clasificado Groq?
Groq figura en el catálogo dentro de «Desarrollo y Código».
¿De dónde proceden los datos sobre Groq?
Los precios, límites y datos del producto se documentan con la página oficial indicada del proveedor.
Cómo comparamos
Comparamos acceso gratis, entrada de pago, límites del plan, funciones y las fuentes oficiales indicadas. Lo no verificado queda como no publicado.
Solo aparecen entradas confirmadas. Precios, planes y límites vienen de páginas oficiales indicadas. Lo ausente queda como no publicado. Las listas de resultados son alfabéticas por defecto y pueden cambiarse a Gratis primero; ninguna opción es un ranking de calidad. Gana siempre la página del proveedor.
Redacción y verificación: equipo de AI Compare
Fuentes
- https://groq.com/
- https://groq.com/platform
- https://groq.com/legal
- https://groq.com/privacy-policy
- https://console.groq.com/docs/models
- https://console.groq.com/docs/billing-faqs
- https://console.groq.com/docs/rate-limits
- https://console.groq.com/docs/performance-tier
- https://console.groq.com/docs/your-data
Visitar sitio (se abre en una pestaña nueva)
¿Dato desactualizado? Las páginas de los proveedores cambian sin aviso. Reportar un error