









FlexAI là nền tảng hạ tầng AI dành cho tác nhân, cung cấp dịch vụ suy luận được quản lý cho hơn 20 mô hình có trọng số mở thông qua một khóa API tương thích với OpenAI. Nền tảng hỗ trợ các workload về văn bản, hình ảnh, lập trình, suy luận, embedding, giọng nói, âm thanh và tạo ảnh. Người dùng có thể bắt đầu với quyền truy cập mô hình serverless, sau đó mở rộng lên các endpoint GPU chuyên dụng, tinh chỉnh mô hình và triển khai đám mây AI riêng tư trong VPC, tại chỗ hoặc môi trường cách ly hoàn toàn. FlexAI cũng cung cấp các công cụ cho tác nhân như gọi công cụ, streaming, đầu ra có cấu trúc, phê duyệt, quản trị và nhật ký kiểm toán.
Dùng thử trực tiếp các bản demo tạo văn bản và hình ảnh trên trình duyệt mà không cần đăng ký. Khi sẵn sàng xây dựng ứng dụng, hãy tạo khóa API, trỏ SDK tương thích với OpenAI đến https://api.flex.ai/v1 và chọn một mô hình trong danh mục. Sử dụng suy luận serverless cho các workload biến động, sau đó chuyển sang endpoint GPU chuyên dụng hoặc triển khai đám mây AI riêng tư khi nhu cầu tăng lên.

Starter
10 USD/tháng dưới dạng tín dụng miễn phí trong 3 tháng đầu
Cần có thẻ thanh toán khi đăng ký. Bao gồm 2 chỗ ngồi trong workspace, API tương thích với OpenAI, quyền truy cập playground và endpoint chuyên dụng theo nhu cầu. Sau thời gian ưu đãi, dịch vụ được tính theo mức sử dụng.
Serverless Token Factory
Thanh toán theo mức sử dụng
Tính phí theo mức sử dụng của từng mô hình. Các mô hình văn bản có giá từ 0,01 USD cho mỗi một triệu token đối với embedding. Ví dụ: Mistral Nemo có giá 0,018 USD cho mỗi một triệu token đầu vào và 0,030 USD cho mỗi một triệu token đầu ra; FLUX.1 [schnell] có giá 0,0005 USD mỗi hình ảnh; Whisper Large V3 Turbo có giá 0,00067 USD mỗi phút.
Essential
Tín dụng đối ứng 100 USD
Nạp 100 USD để nhận 200 USD tín dụng. Bao gồm 8 chỗ ngồi, hỗ trợ đồng thời và đa phân mảnh, một buổi tư vấn kiến trúc sau khi chi tiêu 50 USD, hỗ trợ kỹ thuật giải pháp, HIPAA và DORA. Hình thức tự phục vụ đang được lên kế hoạch.
Endpoint chuyên dụng
Từ 1,50 USD mỗi giờ GPU
Giá GPU chuyên dụng theo nhu cầu bao gồm L40S ở mức 1,50 USD/giờ, A100 ở mức 1,80 USD/giờ, H100 ở mức 2,10 USD/giờ, H200 ở mức 3,15 USD/giờ và B200 ở mức 6,25 USD/giờ. Tính phí theo từng phút.
AI Factory và Enterprise tùy chỉnh
Liên hệ để nhận báo giá
Triển khai đám mây AI riêng tư trên FlexAI hoặc phần cứng của khách hàng, bao gồm VPC, tại chỗ và môi trường cách ly hoàn toàn, dự phòng theo khu vực địa lý, hỗ trợ thành công khách hàng chuyên dụng và mức giá workload tùy chỉnh.


100.00%

Lắng nghe mạng xã hội