Vergleich KI Vergleich KI

Preise, Funktionen und Limits prüfen.

Preisregion
Automatisch
Sprache
DE

Groq

Inferenz-Cloud, die offene Sprach-, Sprach-zu-Text- und Text-zu-Sprache-Modelle über eine OpenAI-kompatible API auf eigener Hardware (LPU) ausfuehrt und pro Token abrechnet.

KostenlosKostenloser Plan
Bezahlt abDeveloper PlanAnbieterwortlaut: 'When you upgrade, there's no immediate charge - you'll be billed for tokens at month-end or when you reach progressive billing …

Kategorie: Development & Code · Agent- & RAG-Frameworks

Funktionen

Groq ist eine Inferenz-Cloud mit eigener LPU (Language Processing Unit)-Architektur fuer sehr schnelle Antwortzeiten bei offenen Sprach-, Sprache-zu-Text- und Text-zu-Sprache-Modellen. Kostenloser API-Zugang mit niedrigeren Rate-Limits erleichtert den Einstieg.

Populaere Open-Source-Modelle wie Llama, Gemma und Whisper sind direkt abrufbar. Das Pay-as-you-go-Modell bietet niedrige Kosten pro Token und Sprachminute. Der Groq Playground ermoeglicht direktes Testen im Browser ohne Einrichtungsaufwand.

Preise und Pläne

StufePreisZeitraumWas enthalten ist
Free Plankostenlos-kostenloser Zugang zur API mit niedrigeren Ratenlimits
Beispiele der veroeffentlichten Free-Limits: openai/gpt-oss-120b und openai/gpt-oss-20b je 30 Anfragen pro Minute, 1.000 Anfragen pro Tag, 8.000 Tokens pro Minute, 200.000 Tokens pro Tag
groq/compound und groq/compound-mini je 30 Anfragen pro Minute, 250 pro Tag, 70.000 Tokens pro Minute
whisper-large-v3 und whisper-large-v3-turbo je 20 Anfragen pro Minute, 2.000 pro Tag, 7.200 Audiosekunden pro Stunde, 28.800 pro Tag
kein Batch- oder Flex-Processing
Developer Plankostenlosmonatliche Abrechnung danachAnbieterwortlaut: 'When you upgrade, there's no immediate charge - you'll be billed for tokens at month-end or when you reach progressive billing thresholds'
gueltige Zahlungsmethode nötig: Kreditkarte, US-Bankkonto oder SEPA-Lastschrift
höhere Ratenlimits, Chat-Support, Flex-Service-Tier, Batch-Processing, Ausgabenlimits
Staffelabrechnung bei kumulierter Nutzung von 1 $, 10 $, 100 $, 500 $ und 1.000 $; ab 1.000 $ Lebenszeitnutzung nur noch monatliche Abrechnung
Rechnungen unter 0,50 $ werden nicht gestellt
jederzeit Rueckstufung auf Free möglich
Modellpreis openai/gpt-oss-120b0,15 $ Input / 0,60 $ Outputpro 1 Mio. TokensKontextfenster 131.072 Tokens, maximal 65.536 Ausgabetokens
Anbieterangabe zur Geschwindigkeit: rund 500 Tokens pro Sekunde
Developer-Ratenlimit 250.000 Tokens pro Minute, 1.000 Anfragen pro Minute
Modellpreis openai/gpt-oss-20b0,075 $ Input / 0,30 $ Outputpro 1 Mio. TokensKontextfenster 131.072 Tokens, maximal 65.536 Ausgabetokens
Anbieterangabe zur Geschwindigkeit: rund 1.000 Tokens pro Sekunde
Developer-Ratenlimit 250.000 Tokens pro Minute, 1.000 Anfragen pro Minute
Modellpreis openai/gpt-oss-safeguard-20b (Preview)0,075 $ Input / 0,30 $ Outputpro 1 Mio. TokensKontextfenster 131.072 Tokens
Developer-Ratenlimit 150.000 Tokens pro Minute, 1.000 Anfragen pro Minute
Preview-Modell, nicht für den Produktivbetrieb vorgesehen
Modellpreis qwen/qwen3.6-27b (Preview)0,60 $ Input / 3,00 $ Outputpro 1 Mio. TokensKontextfenster 131.072 Tokens, maximal 16.384 Ausgabetokens, Dateien bis 20 MB
Modellpreis qwen/qwen3.8-27b (Preview)0,80 $ Input / 4,00 $ Outputpro 1 Mio. TokensKontextfenster 131.042 Tokens, maximal 16.384 Ausgabetokens, Dateien bis 20 MB
Modellpreis whisper-large-v3 (Spracherkennung)0,111 $pro AudiostundeDateien bis 100 MB
Developer-Ratenlimit 200.000 Audiosekunden pro Stunde, 300 Anfragen pro Minute
Modellpreis whisper-large-v3-turbo (Spracherkennung)0,04 $pro AudiostundeDeveloper-Ratenlimit 400.000 Audiosekunden pro Stunde, 400 Anfragen pro Minute
Modellpreis canopylabs/orpheus-v1-english (Sprachausgabe, Preview)22,00 $1 Mio. ZeichenKontextfenster 4.000 Tokens
Developer-Ratenlimit 50.000 Tokens pro Minute, 250 Anfragen pro Minute
Modellpreis canopylabs/orpheus-arabic-saudi (Sprachausgabe, Preview)40,00 $1 Mio. ZeichenKontextfenster 4.000 Tokens
Developer-Ratenlimit 50.000 Tokens pro Minute, 250 Anfragen pro Minute
Modellpreis meta-llama/llama-prompt-guard-2-22m und -86m (Preview)0,03 $ Input und Output (22M) bzw. 0,04 $ Input und Output (86M)pro 1 Mio. TokensKontextfenster 512 Tokens
Developer-Ratenlimit 30.000 Tokens pro Minute, 100 Anfragen pro Minute
Enterprise-Modelle (llama-3.1-8b-instant, llama-3.3-70b-versatile, minimaxai/minimax-m2.7)auf Anfrage-Die Modelltabelle weist für diese Modelle bei Preis und Ratenlimit ausdrücklich 'Contact Sales' aus
Performance Tier (Enterprise)auf Anfrage-Anbieterwortlaut: 'Performance is delivered as provisioned throughput: you purchase input and output capacity bundles and pay for that provisioned capacity rather than per-token usage. Reach out to inquire about pricing.'
99,9 % Verfuegbarkeits-SLA und 99 % Latenzgarantie laut Vertrag
nur für Enterprise-Pläne, Kontextlaenge unter 8.192 Tokens
verfuegbare Modelle: openai/gpt-oss-120b, openai/gpt-oss-20b, llama-3.3-70b-versatile

Limits

Für europäische Nutzer zugänglich. Groq akzeptiert laut Billing-FAQ ausdrücklich SEPA-Lastschrift neben Kreditkarten (Visa, MasterCard, American Express, Discover) und US-Bankkonten - SEPA ist der europäische Zahlweg, europäische Kunden sind also vorgesehen. Der Anbieter betreibt eigene Rechenzentren in der EU (EU-1 Vantaa, Finnland) und in Grossbritannien (EU-2 London). Es gibt einen kostenlosen Free-Tarif mit veroeffentlichten Ratenlimits, für den Developer-Tarif ist eine gueltige Zahlungsmethode nötig. Groq ist ein US-Unternehmen; die Datenschutzerklärung schreibt: 'Groq is located in the United States, and maintains processing operations in various global jurisdictions.' Dokumentationsseite 'Your Data', wörtlich: 'By default, Groq does not retain customer data for inference requests.' Ausnahmen wörtlich: Daten werden nur zurueckgehalten, 'If you use features that require data retention to function (e.g., batch jobs, fine-tuning and LoRAs)' oder 'If needed to protect platform reliability (e.g., to troubleshoot system failures or investigate abuse)'; solche Protokolle werden 'retained for up to 30 days, unless legally required to retain longer' und können abgeschaltet werden. Zum Speicherort wörtlich: 'All customer data is retained in Google Cloud Platform (GCP) buckets located in the United States. Groq maintains strict access controls and security standards as detailed in the Groq Trust Center. Where applicable, Customers can rely on standard contractual clauses (SCCs) for transfers between third countries and the U.S.' Zusätzlich: 'All customers may enable Zero Data Retention (ZDR) in Data Controls settings.' Die Datenschutzerklärung nennt keine Verwendung von Kundeneingaben zum Modelltraining.

Ähnliche Tools

FAQ

Gibt es Groq kostenlos?

Ja. Ein dauerhaft kostenloser Plan ist ausgewiesen, keine befristete Testphase.

Wo sitzt der Anbieter von Groq?

Groq, Inc. mit Sitz in USA. Für Auftragsverarbeitung und Datenschutz ist der Vertrag des Anbieters maßgeblich.

Wie wird Groq abgerechnet?

Fuer europaeische Nutzer zugaenglich. Groq akzeptiert laut Billing-FAQ ausdruecklich SEPA-Lastschrift neben Kreditkarten (Visa, MasterCard, American Express, Discover) und US-Bankkonten - SEPA ist der europaeische Zahlweg, europaeische Kunden sind also vorgesehen. Der Anbieter betreibt eigene Rechenzentren in der EU (EU-1 Vantaa, Finnland) und in Grossbritannien (EU-2 London). Es gibt einen kostenlosen Free-Tarif mit veroeffentlichten Ratenlimits, fuer den Developer-Tarif ist eine gueltige Zahlungsmethode noetig. Groq ist ein US-Unternehmen; die Datenschutzerklaerung schreibt: 'Groq is located in the United States, and maintains processing operations in various global jurisdictions.'. Groq ist eine US-amerikanische API-Plattform; ob eine EUR/CHF-Ansicht existiert, ließ sich diese Sitzung nicht verifizieren, da die Preisseite technisch nicht auslesbar war.

Ist Groq noch aktiv?

Aktiv. Groq bezeichnet sich selbst als 'premier neocloud for fast inference' und betreibt nach eigener Angabe 13 Rechenzentren auf vier Kontinenten, darunter EU-1 in Vantaa (Finnland) und EU-2 in London (Grossbritannien). Entwicklerangebot ist GroqCloud über console.groq.com; die Plattformseite nennt zusätzlich die Bausteine GroqMetal (Infrastruktur), GroqCore (Inferenz) und GroqAssured (Enterprise-Steuerung). Die früher unter groq.com/pricing erreichbare Preisseite leitet inzwischen auf die Startseite um; die Preise stehen in der Konsolendokumentation.

Wie viele Tarife sind für Groq dokumentiert?

Im Katalog sind 14 Tarife mit Preis, Zeitraum und enthaltenen Leistungen dokumentiert.

Für welchen Einsatzbereich ist Groq eingeordnet?

Groq ist im Katalog dem Bereich „Development & Code“ zugeordnet.

Woher stammen die Angaben zu Groq?

Preise, Limits und Produktangaben werden gegen die angegebene offizielle Anbieterseite dokumentiert.

So vergleichen wir

Wir vergleichen kostenlosen Zugang, bezahlten Einstieg, Planlimits, Funktionen und die genannten offiziellen Quellen. Unbelegte Angaben bleiben als nicht angegeben markiert.

Nur bestätigte Einträge erscheinen im Katalog. Preise, Pläne und Limits kommen aus genannten offiziellen Anbieterseiten. Fehlt eine Angabe, bleibt sie als nicht angegeben markiert. Ergebnislisten sind standardmäßig alphabetisch und lassen sich auf Kostenlos zuerst umstellen; beides ist keine Qualitätswertung. Maßgeblich ist immer die Anbieterseite.

Redaktion und Prüfung: AI Compare Team

Quellen

Zur Website (öffnet in neuem Tab)

Angabe veraltet? Anbieterseiten ändern sich ohne Ankündigung. Fehler melden