Together AI
Plataforma cloud em que os desenvolvedores usam modelos de IA abertos por API, os afinam e os executam em GPUs alugadas.
Categoria: Desenvolvimento e Código · Frameworks de agentes e RAG
Funções
Together AI é uma nuvem para modelos abertos: inferência via API (interface de programação de aplicações), fine-tuning e GPUs alugadas (graphics processing units). Serverless cobra por tokens; Batch custa metade da inferência em tempo real. Entradas em cache saem mais baratas.
Dedicated Inference isola GPUs. Clusters e Provisioned Throughput (PTU) reservam capacidade. Together publica preços em dólares dos EUA; a página de preços não nomeia região da UE. A lista completa de tokens e GPU está na visão de preços.
- Usar, afinar e hospedar modelos abertos em GPUs alugadas
- Inferência serverless mais Batch API pela metade do preço em tempo real
- GPUs single-tenant dedicadas com autoscaling para modelos próprios
- Clusters de GPU reservados (H100, H200 e outros) e provisioned throughput
- Além de texto: imagem, vídeo, áudio, transcrição, embeddings, rerank e moderação
- Fine-tuning (LoRA ou completo), code sandbox e shared filesystem
Preços e planos
| Plano | Preço | Período | O que está incluído |
|---|---|---|---|
| Serverless Inference (Pay-as-you-go) | $0.03 | após o consumo | exemplos por 1 milhão de tokens (entrada/saída): gpt-oss-20B 0,05 / 0,20 USD; LFM2.5-8B-A1B 0,03 / 0,12 USD; gpt-oss-120B 0,15 / 0,60 USD; Llama 3.3 70B 1,04 / 1,04 USD; Qwen3.7-Max 1,25 / 3,75 USD; Kimi K3 3,00 / 15,00 USD a entrada em cache é mais barata, p. ex. Kimi K3 0,30 USD em vez de 3,00 USD um modelo está listado a 0,00 USD: Ternary Bonsai 27B Batch API pela metade do preço da inferência em tempo real outras modalidades: imagem, vídeo, áudio, transcrição, embeddings, rerank, moderação |
| Dedicated Inference | $5.49 / $8.99 | por GPU e hora, sob demanda | instâncias GPU de tenant único com desempenho garantido suporte a modelos próprios, autoscaling H200, B300, GB200 NVL72 e GB300 NVL72 só sob consulta; capacidade reservada só sob consulta |
| GPU Clusters | $3.99 / $5.99 / $8.19 | por GPU e hora, sob demanda | H100 reservado: 3,69 USD (7-30 dias), 3,45 USD (31-90 dias), 3,19 USD (91-180 dias) H200 reservado: 4,99 / 4,15 / 3,99 USD B200 reservado: 7,99 / 7,79 / 6,79 USD 181+ dias e GB200/GB300/B300 sob consulta |
| Provisioned Throughput (PTU) | $0.05 | por PTU e minuto | capacidade reservada em throughput units; os tokens por minuto entregues dependem do modelo MiniMax M3: 166.667 TPM de entrada, 833.333 TPM em cache, 41.667 TPM de saída por PTU Kimi K3: 16.667 / 166.667 / 3.333 TPM por PTU GLM-5.2: 35.714 / 192.308 / 11.364 TPM por PTU |
| Fine-Tuning, Sandbox und Storage | $0.48 | após o consumo | Supervised Fine-Tuning por 1 milhão de tokens: até 16B 0,48 USD (LoRA) / 0,54 USD (Full); 17B-69B 1,50 / 1,65 USD; 70-100B 2,90 / 3,20 USD Direct Preference Optimization por 1 milhão de tokens: até 16B 1,20 / 1,35 USD; 17B-69B 3,75 / 4,12 USD; 70-100B 7,25 / 8,00 USD valor mínimo por job de fine-tuning: 4,00 USD Code Sandbox: 0,0446 USD por hora de vCPU, 0,0149 USD por hora de GiB RAM Code Interpreter: 0,03 USD por sessão (60 minutos) Shared Filesystem: 0,16 USD por GiB e mês |
Limites
Together AI é um fornecedor americano e publica preços em dólares americanos. Os nomes das páginas de preços não são região de dados da UE. De acordo com a política de privacidade, o fornecedor não usa dados do cliente para treinar seus próprios modelos sem o opt-in explícito e consentimento. Os dados podem ser processados fora do país do usuário. No modo de retenção de dados zero, o fornecedor diz que entradas e saídas não são armazenadas e não são usadas para treinamento de modelos, melhoria de produtos ou outros fins secundários.
Ferramentas semelhantes
FAQ
O Together AI tem uma opção gratuita?
Não. As páginas do fornecedor não publicam acesso gratuito.
Onde fica a sede do fornecedor do Together AI?
Together Computer, Inc., com sede em EUA. Para o tratamento de dados vale o contrato do fornecedor.
O Together AI ainda está ativo?
Activo. Plataforma em nuvem para clusters de inferência, ajuste fino e GPU; apenas faturamento baseado no uso, sem níveis de assinatura.
Quantos planos estão documentados para Together AI?
O catálogo documenta 5 planos com preço, período de cobrança e recursos incluídos.
Para qual caso de uso o Together AI está categorizado?
O Together AI aparece no catálogo na categoria “Desenvolvimento e Código”.
De onde vêm os dados sobre o Together AI?
Preços, limites e dados do produto são documentados com base na página oficial indicada do fornecedor.
Como comparamos
Comparamos acesso grátis, entrada paga, limites do plano, funções e as fontes oficiais indicadas. Dados sem fonte ficam como não publicados.
Só entram registros confirmados. Preços, planos e limites vêm de páginas oficiais indicadas. Ausências ficam como não publicados. As listas de resultados são alfabéticas por padrão e podem ser alteradas para Gratuito primeiro; nenhuma opção é um ranking de qualidade. A página do fornecedor prevalece.
Redação e verificação: equipe da AI Compare
Fontes
- https://www.together.ai/pricing
- https://docs.together.ai/docs/billing-credits
- https://www.together.ai/privacy
Visitar site (abre em uma nova aba)
Dado desatualizado? As páginas dos fornecedores mudam sem aviso. Reportar um erro