









Mô hình Hathora cung cấp một nền tảng để xây dựng các tác nhân giọng nói trên các mô hình mã nguồn mở hoặc đóng với không cần DevOps. Nền tảng này cung cấp ASR (Nhận diện Giọng nói Tự động), TTS (Chuyển văn bản thành giọng nói), và mô hình LLM (Mô hình Ngôn ngữ Lớn) với độ trễ thấp chạy ở 14 khu vực cho độ trễ cực thấp. Người dùng có thể bắt đầu ngay lập tức trên các điểm cuối chia sẻ và nâng cấp lên cơ sở hạ tầng dành riêng cho các yêu cầu về quyền riêng tư, tuân thủ hoặc VPC. Nền tảng cho phép người dùng khám phá, thử nghiệm và triển khai các mô hình sẵn sàng để sản xuất, mang theo các mô hình hoặc containers tùy chỉnh của họ và sử dụng công cụ 'Chain' cho các quy trình AI giọng nói tương tác.
Để sử dụng Mô hình Hathora, trước tiên hãy khám phá các mô hình bằng cách duyệt qua các mô hình STT, TTS và LLM mã nguồn mở được chọn lọc cho các trường hợp sử dụng AI giọng nói. Tiếp theo, thử nghiệm các mô hình ngay lập tức trong các hộp cát tương tác hoặc thay thế chúng một cách liền mạch trong công cụ Chain. Cuối cùng, triển khai nhanh chóng bằng cách sử dụng tài liệu đã được cung cấp cho Pipecat, LiveKit và truy cập API trực tiếp.





Lắng nghe mạng xã hội