









Together AI es una Nube de Aceleración de IA que proporciona una plataforma integral para todo el ciclo de vida de la IA generativa. Ofrece inferencia rápida, ajuste fino y capacidades de entrenamiento para modelos de IA generativa utilizando APIs fáciles de usar y una infraestructura altamente escalable. Los usuarios pueden ejecutar y ajustar modelos de código abierto, entrenar y desplegar modelos a gran escala en su Nube de Aceleración de IA y clústeres de GPU escalables, y optimizar rendimiento y costo. La plataforma admite más de 200 modelos de IA generativa en varias modalidades como chat, imágenes, código y más, con APIs compatibles con OpenAI.
Los usuarios pueden interactuar con Together AI a través de APIs fáciles de usar para inferencia sin servidor o desplegar modelos en hardware personalizado a través de puntos finales dedicados. El ajuste fino está disponible a través de comandos simples o controlando hiperpárametros a través de la API. Se pueden solicitar clústeres de GPU para entrenamiento a gran escala. La plataforma también ofrece una interfaz web, API o CLI para iniciar o detener puntos finales y gestionar servicios. Están disponibles entornos de ejecución de código para construir y ejecutar tareas de desarrollo de IA.
Más contacto, visite la página de contacto(https://www.together.ai/contact)
Together AI Nombre de la empresa: Together AI .
Together AI Dirección de la empresa: San Francisco, CA 94114.
Más información sobre Together AI, visite la página acerca de nosotros(https://www.together.ai/about) .
Enlace de precios de Together AI: https://www.together.ai/pricing
Enlace de Linkedin de Together AI: https://www.linkedin.com/company/togethercomputer
Enlace de Twitter de Together AI: https://twitter.com/togethercompute

Inferencia Sin Servidor
Varía según el modelo y el recuento de tokens
Los precios son por 1 millón de tokens (entrada y salida para Chat, Multimodal, Lenguaje, Código; solo entrada para Embedding; tamaño de imagen/pasos para modelos de Imagen). La inferencia por lotes está disponible con un descuento introductorio del 50%. Los precios específicos de los modelos oscilan entre $0.06 y $7.00 por 1 millón de tokens, dependiendo del tamaño y tipo del modelo.
Puntos Finales Dedicados
Varía según el tipo de GPU, por minuto/hora
Despliega modelos en puntos finales de GPU personalizables con facturación por minuto. Soporta varias GPUs de NVIDIA como RTX-6000, L40, A100, H100, H200. Los precios oscilan entre $0.025/minuto ($1.49/hora) para RTX-6000/L40 hasta $0.083/minuto ($4.99/hora) para H200.
Ajuste Fino
Por 1 millón de tokens procesados
La fijación de precios se basa en el tamaño del modelo, el tamaño del conjunto de datos y el número de épocas. El ajuste fino supervisado (LoRA) oscila entre $0.48 y $2.90 por 1 millón de tokens. El ajuste fino completo oscila entre $0.54 y $3.20 por 1 millón de tokens. DPO (LoRA) oscila entre $1.20 y $7.25 por 1 millón de tokens. DPO (Full FT) oscila entre $1.35 y $8.00 por 1 millón de tokens.
Clústeres de GPU de Together
A partir de $1.30/hora
Clústeres de última generación con GPUs NVIDIA Blackwell y Hopper (H200, H100, A100) para un óptimo entrenamiento e inferencia de IA. H200 empieza en $2.09/h, H100 en $1.75/h, A100 en $1.30/h. Los precios de GB200 y B200 requieren contacto.
Ejecución de Código
Por hora o por sesión
Together Code Sandbox se precisa por vCPU ($0.0446/hora) y por GiB RAM ($0.0149/hora). El Intérprete de Código de Together se precisa por sesión ($0.03 por 60 minutos).
Para conocer los precios más recientes, visite este enlace: https://www.together.ai/pricing




Escucha en redes sociales