









FlexAI는 하나의 OpenAI 호환 API 키로 20개 이상의 오픈 웨이트 모델에 대한 관리형 추론을 제공하는 에이전트 네이티브 AI 인프라 플랫폼입니다. 텍스트, 비전, 코드, 추론, 임베딩, 음성, 오디오, 이미지 생성 워크로드를 지원합니다. 사용자는 서버리스 모델 액세스로 시작한 뒤, 사용량이 늘어나면 전용 GPU 엔드포인트, 파인튜닝, VPC·온프레미스·에어갭 환경을 아우르는 프라이빗 AI 클라우드 배포로 확장할 수 있습니다. 또한 FlexAI는 툴 호출, 스트리밍, 구조화된 출력, 승인, 거버넌스, 감사 추적과 같은 에이전트 도구를 제공합니다.
가입하지 않고도 브라우저에서 텍스트 및 이미지 생성 데모를 바로 사용해 볼 수 있습니다. 실제 개발을 시작하려면 API 키를 생성하고 OpenAI 호환 SDK가 https://api.flex.ai/v1을 가리키도록 설정한 다음, 모델 카탈로그에서 모델을 선택하세요. 변동성이 큰 워크로드에는 서버리스 추론을 사용하고, 사용량이 증가하면 전용 GPU 엔드포인트 또는 프라이빗 AI 클라우드 배포로 전환할 수 있습니다.

Starter
첫 3개월 동안 매월 $10 상당의 무료 크레딧
가입 시 카드 등록이 필요합니다. 워크스페이스 좌석 2개, OpenAI 호환 API, 플레이그라운드 액세스 및 필요 시 전용 엔드포인트를 제공합니다. 프로모션 기간 이후에는 사용량에 따라 요금이 부과됩니다.
Serverless Token Factory
사용량에 따른 종량제
모델별 사용량 기준 요금제입니다. 텍스트 모델은 임베딩 기준 토큰 100만 개당 $0.01부터 시작합니다. 예시 요금은 Mistral Nemo 입력 토큰 100만 개당 $0.018, 출력 토큰 100만 개당 $0.030, FLUX.1 [schnell] 이미지당 $0.0005, Whisper Large V3 Turbo 분당 $0.00067입니다.
Essential
$100 매칭 크레딧
$100를 예치하면 $200 크레딧을 받을 수 있습니다. 좌석 8개, 동시성 및 멀티 프랙셔널 지원, $50 사용 후 아키텍처 상담, 솔루션 엔지니어링 지원, HIPAA 및 DORA를 포함합니다. 셀프서비스 제공은 예정되어 있습니다.
Dedicated Endpoints
GPU 시간당 $1.50부터
온디맨드 전용 GPU 요금은 L40S 시간당 $1.50, A100 시간당 $1.80, H100 시간당 $2.10, H200 시간당 $3.15, B200 시간당 $6.25부터 시작합니다. 요금은 분 단위로 측정됩니다.
Custom AI Factory and Enterprise
문의 필요
FlexAI 또는 고객 하드웨어에서 제공하는 프라이빗 AI 클라우드 배포를 지원합니다. VPC, 온프레미스 및 에어갭 옵션, 지역 중복성, 전담 고객 성공 지원 및 맞춤형 워크로드 요금이 포함됩니다.

소셜 리스닝