









Together AI é uma Nuvem de Aceleração de IA que fornece uma plataforma completa para todo o ciclo de vida da IA generativa. Oferece inferência rápida, ajuste fino e capacidades de treinamento para modelos de IA generativa usando APIs fáceis de usar e infraestrutura altamente escalável. Os usuários podem executar e ajustar modelos de código aberto, treinar e implantar modelos em grande escala em sua Nuvem de Aceleração de IA e clusters de GPU escaláveis, além de otimizar desempenho e custo. A plataforma suporta mais de 200 modelos de IA generativa em várias modalidades, como chat, imagens, código e mais, com APIs compatíveis com o OpenAI.
Os usuários podem interagir com Together AI através de APIs fáceis de usar para inferência serverless ou implantar modelos em hardware personalizado via endpoints dedicados. O ajuste fino está disponível através de comandos simples ou controlando hiperparâmetros via API. Clusters de GPU podem ser solicitados para treinamento em grande escala. A plataforma também oferece uma interface web, API ou CLI para iniciar ou parar endpoints e gerenciar serviços. Ambientes de execução de código estão disponíveis para construir e executar tarefas de desenvolvimento de IA.
Mais contato, visite a página de contato(https://www.together.ai/contact)
Together AI Nome da empresa: Together AI .
Together AI Endereço da empresa: San Francisco, CA 94114.
Mais sobre Together AI, visite a página sobre nós(https://www.together.ai/about) .
Link de preços de Together AI: https://www.together.ai/pricing
Link de Linkedin de Together AI: https://www.linkedin.com/company/togethercomputer
Link de Twitter de Together AI: https://twitter.com/togethercompute

Inferência Serverless
Varia por modelo e contagem de tokens
Os preços são por 1 milhão de tokens (entrada e saída para Chat, Multimodal, Linguagem, Código; apenas entrada para Embedding; tamanho/imagens para modelos de Imagem). A inferência em lote está disponível com um desconto introdutório de 50%. Preços específicos de modelos variam de $0,06 a $7,00 por 1M de tokens dependendo do tamanho e tipo do modelo.
Endpoints Dedicados
Varia por tipo de GPU, por minuto/hora
Implante modelos em endpoints de GPU personalizáveis com faturamento por minuto. Suporta várias GPUs NVIDIA como RTX-6000, L40, A100, H100, H200. Os preços variam de $0,025/minuto ($1,49/hora) para RTX-6000/L40 a $0,083/minuto ($4,99/hora) para H200.
Ajuste Fino
Por 1M de Tokens processados
A precificação é baseada no tamanho do modelo, no tamanho do conjunto de dados e no número de épocas. Ajuste fino supervisionado (LoRA) varia de $0,48 a $2,90 por 1M de tokens. Ajuste fino completo varia de $0,54 a $3,20 por 1M de tokens. DPO (LoRA) varia de $1,20 a $7,25 por 1M de tokens. DPO (Ajuste Fino Completo) varia de $1,35 a $8,00 por 1M de tokens.
Clusters de GPU Together
A partir de $1,30/hora
Clusters de última geração com GPUs NVIDIA Blackwell e Hopper (H200, H100, A100) para treinamento e inferência de IA otimizados. H200 começa a $2,09/h, H100 a $1,75/h, A100 a $1,30/h. Os preços de GB200 e B200 requerem contato.
Execução de Código
Por hora ou por sessão
O Together Code Sandbox é precificado por vCPU ($0,0446/hora) e por GiB de RAM ($0,0149/hora). O Together Code Interpreter é precificado por sessão ($0,03 por 60 minutos).
Para obter os preços mais recentes, visite este link: https://www.together.ai/pricing




Escuta de mídias sociais