









FlexAI est une plateforme d’infrastructure IA conçue pour les agents, qui fournit une inférence managée pour plus de 20 modèles à poids ouverts via une seule clé API compatible avec OpenAI. Elle prend en charge les charges de travail de texte, vision, code, raisonnement, embeddings, parole, audio et génération d’images. Les utilisateurs peuvent commencer avec un accès serverless aux modèles, puis passer à des endpoints GPU dédiés, au fine-tuning et à des déploiements de cloud IA privé dans un VPC, sur site ou dans des environnements isolés d’Internet. FlexAI propose également des outils pour agents, tels que l’appel d’outils, le streaming, les sorties structurées, les validations, la gouvernance et les pistes d’audit.
Testez directement dans votre navigateur les démos de génération de texte et d’images, sans créer de compte. Lorsque vous êtes prêt à développer, créez une clé API, configurez un SDK compatible avec OpenAI sur https://api.flex.ai/v1 et sélectionnez un modèle dans le catalogue. Utilisez l’inférence serverless pour les charges variables, puis passez à des endpoints GPU dédiés ou à des déploiements de cloud IA privé lorsque votre utilisation augmente.

Starter
10 $/mois de crédits gratuits pendant les 3 premiers mois
Une carte bancaire est requise lors de l’inscription. Comprend 2 sièges d’espace de travail, une API compatible avec OpenAI, l’accès au playground et des endpoints dédiés à la demande. Après la période promotionnelle, la facturation s’effectue à l’usage.
Serverless Token Factory
Paiement à l’usage
Tarification à l’usage selon le modèle. Les modèles de texte commencent à 0,01 $ par million de tokens pour les embeddings. Exemples de tarifs : Mistral Nemo à 0,018 $ par million de tokens d’entrée et 0,030 $ par million de tokens de sortie, FLUX.1 [schnell] à 0,0005 $ par image et Whisper Large V3 Turbo à 0,00067 $ par minute.
Essential
Crédit abondé de 100 $
Déposez 100 $ pour recevoir 200 $ de crédit. Comprend 8 sièges, la prise en charge de la concurrence et des fractions multiples, un échange d’architecture après 50 $ de dépenses, un accompagnement par des ingénieurs solutions, ainsi que la conformité HIPAA et DORA. La disponibilité en libre-service est prévue prochainement.
Endpoints dédiés
À partir de 1,50 $ par heure de GPU
La tarification à la demande des GPU dédiés comprend : L40S à 1,50 $/heure, A100 à 1,80 $/heure, H100 à 2,10 $/heure, H200 à 3,15 $/heure et B200 à 6,25 $/heure. La facturation est calculée à la minute.
AI Factory et offres Entreprise personnalisées
Nous contacter pour connaître les tarifs
Déploiements de cloud IA privé sur FlexAI ou sur le matériel du client, avec des options VPC, sur site et isolées d’Internet, une redondance géographique, un accompagnement client dédié et une tarification personnalisée selon les charges de travail.


100.00%

Écoute des médias sociaux