Groq
Inferenz-Cloud, die offene Sprach-, Sprach-zu-Text- und Text-zu-Sprache-Modelle über eine OpenAI-kompatible API auf eigener Hardware (LPU) ausfuehrt und pro Token abrechnet.
Kategorie: Development & Code · Agent- & RAG-Frameworks
Funktionen
Groq ist eine Inferenz-Cloud mit eigener LPU (Language Processing Unit)-Architektur fuer sehr schnelle Antwortzeiten bei offenen Sprach-, Sprache-zu-Text- und Text-zu-Sprache-Modellen. Kostenloser API-Zugang mit niedrigeren Rate-Limits erleichtert den Einstieg.
Populaere Open-Source-Modelle wie Llama, Gemma und Whisper sind direkt abrufbar. Das Pay-as-you-go-Modell bietet niedrige Kosten pro Token und Sprachminute. Der Groq Playground ermoeglicht direktes Testen im Browser ohne Einrichtungsaufwand.
- Inferenz-Cloud fuer offene Sprach-, Sprache-zu-Text- und Text-zu-Sprache-Modelle
- Kostenloser API-Zugang mit niedrigeren Rate-Limits
- Niedriger Preis pro Token und pro Sprachminute im Pay-as-you-go-Modell
- LPU (Language Processing Unit)-Architektur fuer sehr schnelle Antwortzeiten
- Unterstuetzung populaerer Open-Source-Modelle (Llama, Gemma, Whisper u.a.)
- Groq Playground fuer direktes Testen im Browser
Preise und Pläne
| Stufe | Preis | Zeitraum | Was enthalten ist |
|---|---|---|---|
| Free Plan | kostenlos | - | kostenloser Zugang zur API mit niedrigeren Ratenlimits Beispiele der veroeffentlichten Free-Limits: openai/gpt-oss-120b und openai/gpt-oss-20b je 30 Anfragen pro Minute, 1.000 Anfragen pro Tag, 8.000 Tokens pro Minute, 200.000 Tokens pro Tag groq/compound und groq/compound-mini je 30 Anfragen pro Minute, 250 pro Tag, 70.000 Tokens pro Minute whisper-large-v3 und whisper-large-v3-turbo je 20 Anfragen pro Minute, 2.000 pro Tag, 7.200 Audiosekunden pro Stunde, 28.800 pro Tag kein Batch- oder Flex-Processing |
| Developer Plan | kostenlos | monatliche Abrechnung danach | Anbieterwortlaut: 'When you upgrade, there's no immediate charge - you'll be billed for tokens at month-end or when you reach progressive billing thresholds' gueltige Zahlungsmethode nötig: Kreditkarte, US-Bankkonto oder SEPA-Lastschrift höhere Ratenlimits, Chat-Support, Flex-Service-Tier, Batch-Processing, Ausgabenlimits Staffelabrechnung bei kumulierter Nutzung von 1 $, 10 $, 100 $, 500 $ und 1.000 $; ab 1.000 $ Lebenszeitnutzung nur noch monatliche Abrechnung Rechnungen unter 0,50 $ werden nicht gestellt jederzeit Rueckstufung auf Free möglich |
| Modellpreis openai/gpt-oss-120b | 0,15 $ Input / 0,60 $ Output | pro 1 Mio. Tokens | Kontextfenster 131.072 Tokens, maximal 65.536 Ausgabetokens Anbieterangabe zur Geschwindigkeit: rund 500 Tokens pro Sekunde Developer-Ratenlimit 250.000 Tokens pro Minute, 1.000 Anfragen pro Minute |
| Modellpreis openai/gpt-oss-20b | 0,075 $ Input / 0,30 $ Output | pro 1 Mio. Tokens | Kontextfenster 131.072 Tokens, maximal 65.536 Ausgabetokens Anbieterangabe zur Geschwindigkeit: rund 1.000 Tokens pro Sekunde Developer-Ratenlimit 250.000 Tokens pro Minute, 1.000 Anfragen pro Minute |
| Modellpreis openai/gpt-oss-safeguard-20b (Preview) | 0,075 $ Input / 0,30 $ Output | pro 1 Mio. Tokens | Kontextfenster 131.072 Tokens Developer-Ratenlimit 150.000 Tokens pro Minute, 1.000 Anfragen pro Minute Preview-Modell, nicht für den Produktivbetrieb vorgesehen |
| Modellpreis qwen/qwen3.6-27b (Preview) | 0,60 $ Input / 3,00 $ Output | pro 1 Mio. Tokens | Kontextfenster 131.072 Tokens, maximal 16.384 Ausgabetokens, Dateien bis 20 MB |
| Modellpreis qwen/qwen3.8-27b (Preview) | 0,80 $ Input / 4,00 $ Output | pro 1 Mio. Tokens | Kontextfenster 131.042 Tokens, maximal 16.384 Ausgabetokens, Dateien bis 20 MB |
| Modellpreis whisper-large-v3 (Spracherkennung) | 0,111 $ | pro Audiostunde | Dateien bis 100 MB Developer-Ratenlimit 200.000 Audiosekunden pro Stunde, 300 Anfragen pro Minute |
| Modellpreis whisper-large-v3-turbo (Spracherkennung) | 0,04 $ | pro Audiostunde | Developer-Ratenlimit 400.000 Audiosekunden pro Stunde, 400 Anfragen pro Minute |
| Modellpreis canopylabs/orpheus-v1-english (Sprachausgabe, Preview) | 22,00 $ | 1 Mio. Zeichen | Kontextfenster 4.000 Tokens Developer-Ratenlimit 50.000 Tokens pro Minute, 250 Anfragen pro Minute |
| Modellpreis canopylabs/orpheus-arabic-saudi (Sprachausgabe, Preview) | 40,00 $ | 1 Mio. Zeichen | Kontextfenster 4.000 Tokens Developer-Ratenlimit 50.000 Tokens pro Minute, 250 Anfragen pro Minute |
| Modellpreis meta-llama/llama-prompt-guard-2-22m und -86m (Preview) | 0,03 $ Input und Output (22M) bzw. 0,04 $ Input und Output (86M) | pro 1 Mio. Tokens | Kontextfenster 512 Tokens Developer-Ratenlimit 30.000 Tokens pro Minute, 100 Anfragen pro Minute |
| Enterprise-Modelle (llama-3.1-8b-instant, llama-3.3-70b-versatile, minimaxai/minimax-m2.7) | auf Anfrage | - | Die Modelltabelle weist für diese Modelle bei Preis und Ratenlimit ausdrücklich 'Contact Sales' aus |
| Performance Tier (Enterprise) | auf Anfrage | - | Anbieterwortlaut: 'Performance is delivered as provisioned throughput: you purchase input and output capacity bundles and pay for that provisioned capacity rather than per-token usage. Reach out to inquire about pricing.' 99,9 % Verfuegbarkeits-SLA und 99 % Latenzgarantie laut Vertrag nur für Enterprise-Pläne, Kontextlaenge unter 8.192 Tokens verfuegbare Modelle: openai/gpt-oss-120b, openai/gpt-oss-20b, llama-3.3-70b-versatile |
Limits
Für europäische Nutzer zugänglich. Groq akzeptiert laut Billing-FAQ ausdrücklich SEPA-Lastschrift neben Kreditkarten (Visa, MasterCard, American Express, Discover) und US-Bankkonten - SEPA ist der europäische Zahlweg, europäische Kunden sind also vorgesehen. Der Anbieter betreibt eigene Rechenzentren in der EU (EU-1 Vantaa, Finnland) und in Grossbritannien (EU-2 London). Es gibt einen kostenlosen Free-Tarif mit veroeffentlichten Ratenlimits, für den Developer-Tarif ist eine gueltige Zahlungsmethode nötig. Groq ist ein US-Unternehmen; die Datenschutzerklärung schreibt: 'Groq is located in the United States, and maintains processing operations in various global jurisdictions.' Dokumentationsseite 'Your Data', wörtlich: 'By default, Groq does not retain customer data for inference requests.' Ausnahmen wörtlich: Daten werden nur zurueckgehalten, 'If you use features that require data retention to function (e.g., batch jobs, fine-tuning and LoRAs)' oder 'If needed to protect platform reliability (e.g., to troubleshoot system failures or investigate abuse)'; solche Protokolle werden 'retained for up to 30 days, unless legally required to retain longer' und können abgeschaltet werden. Zum Speicherort wörtlich: 'All customer data is retained in Google Cloud Platform (GCP) buckets located in the United States. Groq maintains strict access controls and security standards as detailed in the Groq Trust Center. Where applicable, Customers can rely on standard contractual clauses (SCCs) for transfers between third countries and the U.S.' Zusätzlich: 'All customers may enable Zero Data Retention (ZDR) in Data Controls settings.' Die Datenschutzerklärung nennt keine Verwendung von Kundeneingaben zum Modelltraining.
Ähnliche Tools
FAQ
Gibt es Groq kostenlos?
Ja. Ein dauerhaft kostenloser Plan ist ausgewiesen, keine befristete Testphase.
Wo sitzt der Anbieter von Groq?
Groq, Inc. mit Sitz in USA. Für Auftragsverarbeitung und Datenschutz ist der Vertrag des Anbieters maßgeblich.
Wie wird Groq abgerechnet?
Fuer europaeische Nutzer zugaenglich. Groq akzeptiert laut Billing-FAQ ausdruecklich SEPA-Lastschrift neben Kreditkarten (Visa, MasterCard, American Express, Discover) und US-Bankkonten - SEPA ist der europaeische Zahlweg, europaeische Kunden sind also vorgesehen. Der Anbieter betreibt eigene Rechenzentren in der EU (EU-1 Vantaa, Finnland) und in Grossbritannien (EU-2 London). Es gibt einen kostenlosen Free-Tarif mit veroeffentlichten Ratenlimits, fuer den Developer-Tarif ist eine gueltige Zahlungsmethode noetig. Groq ist ein US-Unternehmen; die Datenschutzerklaerung schreibt: 'Groq is located in the United States, and maintains processing operations in various global jurisdictions.'. Groq ist eine US-amerikanische API-Plattform; ob eine EUR/CHF-Ansicht existiert, ließ sich diese Sitzung nicht verifizieren, da die Preisseite technisch nicht auslesbar war.
Ist Groq noch aktiv?
Aktiv. Groq bezeichnet sich selbst als 'premier neocloud for fast inference' und betreibt nach eigener Angabe 13 Rechenzentren auf vier Kontinenten, darunter EU-1 in Vantaa (Finnland) und EU-2 in London (Grossbritannien). Entwicklerangebot ist GroqCloud über console.groq.com; die Plattformseite nennt zusätzlich die Bausteine GroqMetal (Infrastruktur), GroqCore (Inferenz) und GroqAssured (Enterprise-Steuerung). Die früher unter groq.com/pricing erreichbare Preisseite leitet inzwischen auf die Startseite um; die Preise stehen in der Konsolendokumentation.
Wie viele Tarife sind für Groq dokumentiert?
Im Katalog sind 14 Tarife mit Preis, Zeitraum und enthaltenen Leistungen dokumentiert.
Für welchen Einsatzbereich ist Groq eingeordnet?
Groq ist im Katalog dem Bereich „Development & Code“ zugeordnet.
Woher stammen die Angaben zu Groq?
Preise, Limits und Produktangaben werden gegen die angegebene offizielle Anbieterseite dokumentiert.
So vergleichen wir
Wir vergleichen kostenlosen Zugang, bezahlten Einstieg, Planlimits, Funktionen und die genannten offiziellen Quellen. Unbelegte Angaben bleiben als nicht angegeben markiert.
Nur bestätigte Einträge erscheinen im Katalog. Preise, Pläne und Limits kommen aus genannten offiziellen Anbieterseiten. Fehlt eine Angabe, bleibt sie als nicht angegeben markiert. Ergebnislisten sind standardmäßig alphabetisch und lassen sich auf Kostenlos zuerst umstellen; beides ist keine Qualitätswertung. Maßgeblich ist immer die Anbieterseite.
Redaktion und Prüfung: AI Compare Team
Quellen
- https://groq.com/
- https://groq.com/platform
- https://groq.com/legal
- https://groq.com/privacy-policy
- https://console.groq.com/docs/models
- https://console.groq.com/docs/billing-faqs
- https://console.groq.com/docs/rate-limits
- https://console.groq.com/docs/performance-tier
- https://console.groq.com/docs/your-data
Zur Website (öffnet in neuem Tab)
Angabe veraltet? Anbieterseiten ändern sich ohne Ankündigung. Fehler melden