









A FlexAI é uma plataforma de infraestrutura de IA nativa para agentes que disponibiliza inferência gerida para mais de 20 modelos de pesos abertos através de uma única chave de API compatível com a OpenAI. Suporta cargas de trabalho de texto, visão, código, raciocínio, embeddings, voz, áudio e geração de imagens. Os utilizadores podem começar com acesso a modelos sem servidor e, posteriormente, escalar para endpoints de GPU dedicados, fine-tuning e implementações de cloud privada de IA em ambientes VPC, locais ou isolados. A FlexAI também disponibiliza ferramentas para agentes, como chamadas de ferramentas, streaming, saídas estruturadas, aprovações, governação e registos de auditoria.
Experimente as demonstrações de texto e geração de imagens diretamente no navegador, sem criar uma conta. Quando estiver pronto para desenvolver, crie uma chave de API, aponte um SDK compatível com a OpenAI para https://api.flex.ai/v1 e selecione um modelo do catálogo. Utilize a inferência sem servidor para cargas de trabalho variáveis e, à medida que a utilização cresce, passe para endpoints de GPU dedicados ou implementações de cloud privada de IA.

Starter
10 $/mês em créditos gratuitos durante os primeiros 3 meses
É necessário um cartão no momento da inscrição. Inclui 2 lugares de trabalho, uma API compatível com a OpenAI, acesso ao playground e endpoints dedicados mediante pedido. Após o período introdutório, aplica-se um modelo de pagamento conforme a utilização.
Serverless Token Factory
Pagamento conforme a utilização
Preços de utilização por modelo. Os modelos de texto começam nos 0,01 $ por milhão de tokens para embeddings. As tarifas de exemplo incluem 0,018 $ por milhão de tokens de entrada e 0,030 $ por milhão de tokens de saída para o Mistral Nemo, 0,0005 $ por imagem para o FLUX.1 [schnell] e 0,00067 $ por minuto para o Whisper Large V3 Turbo.
Essential
Crédito correspondente de 100 $
Deposite 100 $ para receber 200 $ em crédito. Inclui 8 lugares, suporte para concorrência e múltiplas frações, uma chamada de arquitetura após gastar 50 $, apoio de engenharia de soluções, HIPAA e DORA. A disponibilidade em regime self-service está planeada.
Endpoints dedicados
A partir de 1,50 $ por hora de GPU
Os preços sob demanda para GPUs dedicadas incluem L40S a 1,50 $/hora, A100 a 1,80 $/hora, H100 a 2,10 $/hora, H200 a 3,15 $/hora e B200 a 6,25 $/hora. A faturação é calculada por minuto.
AI Factory e Enterprise personalizados
Contacte-nos para obter preços
Implementações de cloud privada de IA na FlexAI ou no hardware do cliente, incluindo opções em VPC, locais e isoladas, redundância geográfica, apoio dedicado ao cliente e preços personalizados por carga de trabalho.


100.00%

Escuta de mídias sociais