Groq
자체 하드웨어(LPU)에서 공개 언어·STT·TTS 모델을 OpenAI 호환 API로 돌리고 토큰으로 과금하는 추론 클라우드.
분야: 개발과 코드 · 에이전트와 RAG 프레임워크
기능
Groq는 오픈 LLM(대규모 언어 모델), 음성 텍스트 변환, 텍스트 음성 변환 모델에서 매우 빠른 응답 시간을 위한 자체 LPU(언어 처리 장치) 아키텍처를 가진 추론 클라우드입니다. 낮은 속도 제한의 무료 API 액세스로 온보딩이 쉬워집니다.
Llama, Gemma, Whisper를 포함한 인기 오픈 소스 모델을 직접 이용할 수 있습니다. 종량제 모델은 토큰당 및 음성 분당 낮은 비용을 제공합니다. Groq Playground로 설정 없이 브라우저에서 직접 테스트할 수 있습니다.
- 오픈 언어, 음성 텍스트 변환, 텍스트 음성 변환 모델을 위한 추론 클라우드
- 낮은 속도 제한의 무료 API 액세스
- 종량제 모델에서 토큰당 및 음성 분당 저렴한 가격
- 매우 빠른 응답 시간을 위한 LPU(언어 처리 장치) 아키텍처
- 인기 오픈 소스 모델 지원(Llama, Gemma, Whisper 등)
- 브라우저 기반 직접 테스트를 위한 Groq Playground
가격과 요금제
| 단계 | 가격 | 기간 | 포함 내용 |
|---|---|---|---|
| Free Plan | 무료 | - | 한도가 더 낮은 무료 API 공개 Free 한도 예: openai/gpt-oss-120b와 openai/gpt-oss-20b 각 분당 요청 30, 하루 1,000, 분당 토큰 8,000, 하루 200,000 groq/compound와 groq/compound-mini 각 분당 요청 30, 하루 250, 분당 토큰 70,000 whisper-large-v3와 whisper-large-v3-turbo 각 분당 요청 20, 하루 2,000, 시간당 오디오 7,200초, 하루 28,800 Batch·Flex Processing 없음 |
| Developer Plan | 무료 | 월간 청구 이후 | 업체 문구: 'When you upgrade, there's no immediate charge - you'll be billed for tokens at month-end or when you reach progressive billing thresholds' 유효 결제 수단 필요: 신용카드, 미국 은행 계좌 또는 SEPA 자동이체 더 높은 Rate Limit, 채팅 지원, Flex 서비스 단계, Batch Processing, 지출 한도 누적 이용 1$, 10$, 100$, 500$, 1,000$에서 계단 청구. 생애 이용 1,000$부터는 월 청구만 0.50$ 미만 청구서는 내지 않음 언제든 Free로 내릴 수 있음 |
| Modellpreis openai/gpt-oss-120b | 0,15 $ Input / 0,60 $ Output | 당 1 M 토큰 | 컨텍스트 창 131,072 토큰, 출력 최대 65,536 토큰 업체 속도: 초당 약 500 토큰 Developer Rate Limit 분당 토큰 250,000, 분당 요청 1,000 |
| Modellpreis openai/gpt-oss-20b | 0,075 $ Input / 0,30 $ Output | 당 1 M 토큰 | 컨텍스트 창 131,072 토큰, 출력 최대 65,536 토큰 업체 속도: 초당 약 1,000 토큰 Developer Rate Limit 분당 토큰 250,000, 분당 요청 1,000 |
| Modellpreis openai/gpt-oss-safeguard-20b (Preview) | 0,075 $ Input / 0,30 $ Output | 당 1 M 토큰 | 컨텍스트 창 131,072 토큰 Developer Rate Limit 분당 토큰 150,000, 분당 요청 1,000 Preview 모델, 프로덕션용이 아님 |
| Modellpreis qwen/qwen3.6-27b (Preview) | 0,60 $ Input / 3,00 $ Output | 당 1 M 토큰 | 컨텍스트 창 131,072 토큰, 출력 최대 16,384 토큰, 파일 최대 20MB |
| Modellpreis qwen/qwen3.8-27b (Preview) | 0,80 $ Input / 4,00 $ Output | 당 1 M 토큰 | 컨텍스트 창 131,042 토큰, 출력 최대 16,384 토큰, 파일 최대 20MB |
| Modellpreis whisper-large-v3 (Spracherkennung) | 0,111 $ | 오디오 시간당 | 파일 최대 100MB Developer Rate Limit 시간당 오디오 200,000초, 분당 요청 300 |
| Modellpreis whisper-large-v3-turbo (Spracherkennung) | 0,04 $ | 오디오 시간당 | Developer Rate Limit 시간당 오디오 400,000초, 분당 요청 400 |
| Modellpreis canopylabs/orpheus-v1-english (Sprachausgabe, Preview) | 22,00 $ | 1 M 문자 | 컨텍스트 창 4,000 토큰 Developer Rate Limit 분당 토큰 50,000, 분당 요청 250 |
| Modellpreis canopylabs/orpheus-arabic-saudi (Sprachausgabe, Preview) | 40,00 $ | 1 M 문자 | 컨텍스트 창 4,000 토큰 Developer Rate Limit 분당 토큰 50,000, 분당 요청 250 |
| Modellpreis meta-llama/llama-prompt-guard-2-22m und -86m (Preview) | 0,03 $ Input und Output (22M) bzw. 0,04 $ Input und Output (86M) | 당 1 M 토큰 | 컨텍스트 창 512 토큰 Developer Rate Limit 분당 토큰 30,000, 분당 요청 100 |
| Enterprise 모델 (llama-3.1-8b-instant, llama-3.3-70b-versatile, minimaxai/minimax-m2.7) | 별도 문의 | - | 모델 표는 이 모델들의 가격과 Rate Limit을 분명히 'Contact Sales'로 적음 |
| Performance Tier (Enterprise) | 별도 문의 | - | 업체 문구: 'Performance is delivered as provisioned throughput: you purchase input and output capacity bundles and pay for that provisioned capacity rather than per-token usage. Reach out to inquire about pricing.' 계약상 가용성 SLA 99.9%, 지연 보장 99% Enterprise 요금제만, 컨텍스트 8,192 토큰 미만 가능 모델: openai/gpt-oss-120b, openai/gpt-oss-20b, llama-3.3-70b-versatile |
한도
유럽 사용자에 대한 액세스. 청구 FAQ 당, Groq는 명시적으로 신용 카드 (Visa, 마스터 카드 미국 익스프레스, 발견) 및 미국 은행 계정 - SEPA는 유럽 지불 경로, 그래서 유럽 고객은 catered. 공급자는 EU (EU-1 Vantaa, 핀란드) 및 영국 (EU-2 London)의 자체 데이터 센터를 실행합니다. 무료 계층이 발행 된 비율 제한이 있습니다. 개발자 계층은 유효한 지불 방법을 요구합니다. Groq는 미국 회사입니다; 개인 정보 보호 정책 국가 : 'Groq는 미국에 있습니다, 다양한 글로벌 관할 구역에서 처리 운영을 유지한다. 문서 페이지 '당신의 데이터', verbatim: '기본값으로, Groq는 방해 요청을 위해 고객 데이터를 유지하지 않습니다. 예외, verbatim : 데이터는 '기능에 데이터 보유를 필요로하는 기능을 사용하는 경우 (예 : 일괄 작업, 미세 조정 및 LoRAs) 또는 '플랫폼 신뢰성을 보호하기 위해 필요한 경우 (예 : 문제 해결 시스템 실패 또는 학대 조사; 이러한 로그는 더 이상 유지해야 할 경우 30 일 동안 유지됩니다. 저장 위치에, verbatim: '모든 고객 자료는 미국에 있는 구글 클라우드 플랫폼 (GCP) 물통에서 유지됩니다. Groq는 Groq Trust Center에 상세하게 엄격한 액세스 제어 및 보안 표준을 유지합니다. 현재 위치 고객은 세 번째 국가와 미국 간의 전송을 위해 표준 계약 조항 (SCCs)에 의존 할 수 있습니다. 또한 : '모든 고객은 데이터 제어 설정에서 Zero Data Retention (ZDR)을 활성화 할 수 있습니다.' 개인 정보 보호 정책은 모델 교육을위한 고객 입력의 사용은 없습니다.
비슷한 도구
FAQ
Groq을(를) 무료로 쓸 수 있나요?
네. 기간 한정 체험이 아니라 상시 무료 요금제가 공개되어 있습니다.
Groq 공급사는 어디에 있나요?
Groq, Inc., 소재지는 미국. 데이터 처리와 개인정보 조건은 공급사 계약이 우선합니다.
Groq은(는) 현재도 제공되나요?
활동. Groq는 'premier neocloud for fast inference'라고 설명하며, 4개의 대륙에 13개의 데이터 센터를 운영합니다. Vantaa (핀란드)의 EU-1 및 런던 (영국)의 EU-2를 포함하여. 개발자 오퍼는 콘솔에서 GroqCloud입니다.console.groq.com; 플랫폼 페이지는 건물 블록 GroqMetal (infrastructure), GroqCore (inference) 및 GroqAssured (enterprise control)를 추가로 지명합니다. 이전 groq.com/pricing 페이지는 이제 홈페이지에 리디렉션; 콘솔 문서의 가격.
Groq에는 몇 개의 요금제가 문서화되어 있나요?
카탈로그에는 가격, 청구 기간 및 포함 기능을 갖춘 14개 요금제가 문서화되어 있습니다.
Groq은(는) 어떤 사용 사례로 분류되나요?
Groq은(는) 카탈로그에서 “개발과 코드” 범주에 분류됩니다.
Groq에 관한 정보는 어디에서 왔나요?
가격, 한도 및 제품 정보는 표시된 공급사의 공식 페이지를 기준으로 문서화됩니다.
비교 방법
무료 이용, 유료 진입, 플랜 한도, 기능, 기재된 공식 출처를 비교합니다. 근거 없는 수치는 미공개로 둡니다.
확인된 항목만 공개합니다. 가격·플랜·한도는 기재된 공식 페이지에서 옵니다. 없는 수치는 미공개입니다. 결과 목록은 기본적으로 가나다/알파벳순이며 ‘무료 먼저’로 바꿀 수 있습니다. 어느 쪽도 품질 순위가 아닙니다. 최종 기준은 공급자 페이지입니다.
편집 및 확인: AI Compare 팀
출처
- https://groq.com/
- https://groq.com/platform
- https://groq.com/legal
- https://groq.com/privacy-policy
- https://console.groq.com/docs/models
- https://console.groq.com/docs/billing-faqs
- https://console.groq.com/docs/rate-limits
- https://console.groq.com/docs/performance-tier
- https://console.groq.com/docs/your-data
오래된 숫자인가요? 공식 페이지는 예고 없이 바뀝니다. 오류 신고