Together AI
Plataforma cloud en la que los desarrolladores usan modelos de IA abiertos por API, los afinan y los ejecutan en GPU alquiladas.
Categoría: Desarrollo y Código · Frameworks de agentes y RAG
Funciones
Together AI es una nube para modelos abiertos: inferencia vía API (interfaz de programación de aplicaciones), fine-tuning y GPUs alquiladas (graphics processing units). Serverless cobra por tokens; Batch cuesta la mitad de la inferencia en tiempo real. Las entradas en caché salen más baratas.
Dedicated Inference aísla GPUs. Clusters y Provisioned Throughput (PTU) reservan capacidad. Together publica precios en dólares EE.UU.; la página de precios no nombra región UE. La lista completa de tokens y GPU está en la vista de precios.
- Usar, afinar y alojar modelos abiertos en GPUs alquiladas
- Inferencia serverless más Batch API a mitad del precio en tiempo real
- GPUs single-tenant dedicadas con autoscaling para modelos propios
- Clusters GPU reservados (H100, H200 y más) y provisioned throughput
- Además de texto: imagen, vídeo, audio, transcripción, embeddings, rerank y moderación
- Fine-tuning (LoRA o completo), code sandbox y shared filesystem
Precios y planes
| Plan | Precio | Periodo | Qué incluye |
|---|---|---|---|
| Serverless Inference (Pay-as-you-go) | $0.03 | después del consumo | Ejemplos por 1M tokens (input/output): gpt-oss-20B USD 0.05 / 0.20; LFM2.5-8B-A1B USD 0.03 / 0.12; gpt-oss-120B USD 0.15 / 0.60; Llama 3.3 70B USD 1.04 / 1.04; Qwen3.7-Max USD 1.25 / 3.75; Kimi K3 USD 3.00 / 15.00 la entrada en caché es más barata, p. ej. Kimi K3 0,30 USD en vez de 3,00 USD un modelo está listado a 0,00 USD: Ternary Bonsai 27B Batch API a la mitad del precio de la inferencia en tiempo real otras modalidades: imagen, vídeo, audio, transcripción, embeddings, rerank, moderación |
| Dedicated Inference | $5.49 / $8.99 | por GPU y hora, bajo demanda | instancias GPU de tenant único con rendimiento garantizado soporte de modelos propios, autoscaling H200, B300, GB200 NVL72 y GB300 NVL72 solo bajo pedido; capacidad reservada solo bajo pedido |
| GPU Clusters | $3.99 / $5.99 / $8.19 | por GPU y hora, bajo demanda | H100 reservado: 3,69 USD (7-30 días), 3,45 USD (31-90 días), 3,19 USD (91-180 días) H200 reservado: 4,99 / 4,15 / 3,99 USD B200 reservado: 7,99 / 7,79 / 6,79 USD 181+ días y GB200/GB300/B300 bajo pedido |
| Provisioned Throughput (PTU) | $0.05 | por PTU y minuto | capacidad reservada en throughput units; los tokens por minuto entregados dependen del modelo MiniMax M3: 166.667 TPM de entrada, 833.333 TPM en caché, 41.667 TPM de salida por PTU Kimi K3: 16.667 / 166.667 / 3.333 TPM por PTU GLM-5.2: 35.714 / 192.308 / 11.364 TPM por PTU |
| Fine-Tuning, Sandbox und Storage | $0.48 | después del consumo | Ajuste supervisado por 1M tokens: hasta 16B USD 0.48 (LoRA) / 0.54 (full); 17B-69B 1.50 / 1.65; 70-100B 2.90 / 3.20 Optimización de preferencia directa por 1M tokens: hasta 16B USD 1.20 / 1.35; 17B-69B 3.75 / 4.12; 70-100B 7.25 / 8.00 importe mínimo por trabajo de fine-tuning: 4,00 USD Code Sandbox: 0,0446 USD por hora de vCPU, 0,0149 USD por hora de GiB RAM Code Interpreter: 0,03 USD por sesión (60 minutos) Shared Filesystem: 0,16 USD por GiB y mes |
Límites
Together AI es un vendedor estadounidense y publica precios en dólares estadounidenses. La página de precios no denomina región de datos de la UE. De acuerdo con la política de privacidad, el proveedor no utiliza los datos de los clientes para formar sus propios modelos sin el consentimiento explícito y el opt-in. Los datos pueden ser procesados fuera del país del usuario. En el modo Zero Data Retention, el proveedor dice que los insumos y salidas no se almacenan y no se utilizan para la formación modelo, la mejora del producto u otros fines secundarios.
Herramientas similares
FAQ
¿Together AI tiene una opción gratuita?
No. Las páginas del proveedor no publican ningún acceso gratuito.
¿Dónde tiene su sede el proveedor de Together AI?
Together Computer, Inc., con sede en EE. UU.. Para el tratamiento de datos rige el contrato del proveedor.
¿Together AI sigue activo?
Activo. Plataforma de nube para grupos de inferencia, ajuste y GPU; facturación basada en el uso solamente, sin nivel de suscripción.
¿Cuántos planes hay documentados para Together AI?
El catálogo documenta 5 planes con precio, periodo de facturación y prestaciones incluidas.
¿Para qué caso de uso está clasificado Together AI?
Together AI figura en el catálogo dentro de «Desarrollo y Código».
¿De dónde proceden los datos sobre Together AI?
Los precios, límites y datos del producto se documentan con la página oficial indicada del proveedor.
Cómo comparamos
Comparamos acceso gratis, entrada de pago, límites del plan, funciones y las fuentes oficiales indicadas. Lo no verificado queda como no publicado.
Solo aparecen entradas confirmadas. Precios, planes y límites vienen de páginas oficiales indicadas. Lo ausente queda como no publicado. Las listas de resultados son alfabéticas por defecto y pueden cambiarse a Gratis primero; ninguna opción es un ranking de calidad. Gana siempre la página del proveedor.
Redacción y verificación: equipo de AI Compare
Fuentes
- https://www.together.ai/pricing
- https://docs.together.ai/docs/billing-credits
- https://www.together.ai/privacy
Visitar sitio (se abre en una pestaña nueva)
¿Dato desactualizado? Las páginas de los proveedores cambian sin aviso. Reportar un error