









FlexAI 是一个原生支持智能体的 AI 基础设施平台,通过一个兼容 OpenAI 的 API 密钥,为用户提供 20 多种开放权重模型的托管推理服务。平台支持文本、视觉、代码、推理、嵌入、语音、音频和图像生成等工作负载。用户可以先使用无服务器模型服务,随后根据需求扩展到专用 GPU 端点、模型微调,以及在 VPC、本地部署或物理隔离环境中的私有 AI 云部署。FlexAI 还提供智能体工具,包括工具调用、流式传输、结构化输出、审批、治理和审计追踪。
无需注册即可直接在浏览器中试用文本和图像生成演示。准备开始构建应用后,创建 API 密钥,将兼容 OpenAI 的 SDK 指向 https://api.flex.ai/v1,并从模型目录中选择模型。对于用量波动的工作负载,可以使用无服务器推理;随着使用量增长,再迁移到专用 GPU 端点或私有 AI 云部署。

入门版
前 3 个月每月可获得 10 美元免费额度
注册时需要绑定银行卡。包含 2 个工作区席位、兼容 OpenAI 的 API、Playground,以及按需使用的专用端点。优惠期结束后,按实际使用量付费。
无服务器 Token Factory
按实际使用量付费
按照不同模型的用量计费。文本模型价格最低为每百万 Token 0.01 美元的嵌入模型。示例价格包括:Mistral Nemo 的输入 Token 每百万 0.018 美元、输出 Token 每百万 0.030 美元;FLUX.1 [schnell] 每张图像 0.0005 美元;Whisper Large V3 Turbo 每分钟 0.00067 美元。
基础版
100 美元匹配额度
存入 100 美元可获得 200 美元额度。包含 8 个席位、并发和多分片支持;消费满 50 美元后提供架构咨询、解决方案工程支持、HIPAA 和 DORA。自助服务计划即将推出。
专用端点
每 GPU 小时 1.50 美元起
按需专用 GPU 价格包括:L40S 每小时 1.50 美元、A100 每小时 1.80 美元、H100 每小时 2.10 美元、H200 每小时 3.15 美元、B200 每小时 6.25 美元。按分钟计费。
定制 AI Factory 和企业版
联系销售获取报价
在 FlexAI 或客户硬件上部署私有 AI 云,支持 VPC、本地部署和物理隔离环境,并提供异地冗余、专属客户成功服务和定制化工作负载定价。

社交媒体聆听