









Together AI ist eine AI Acceleration Cloud, die eine End-to-End-Plattform für den gesamten generativen KI-Lebenszyklus bietet. Sie bietet schnelle Inferenz-, Feinabstimmungs- und Trainingsmöglichkeiten für generative KI-Modelle mit benutzerfreundlichen APIs und einer äußerst skalierbaren Infrastruktur. Benutzer können Open-Source-Modelle ausführen und feinabstimmen, Modelle in ihrer AI Acceleration Cloud und skalierbaren GPU-Clustern trainieren und bereitstellen sowie Leistung und Kosten optimieren. Die Plattform unterstützt über 200 generative KI-Modelle in verschiedenen Modalitäten wie Chat, Bilder, Code und mehr, mit OpenAI-kompatiblen APIs.
Benutzer können mit Together AI über benutzerfreundliche APIs für serverlose Inferenz interagieren oder Modelle auf benutzerdefinierter Hardware über dedizierte Endpunkte bereitstellen. Feinabstimmung ist über einfache Befehle oder durch Steuerung der Hyperparameter über die API möglich. GPU-Cluster können für das großangelegte Training angefordert werden. Die Plattform bietet auch eine Web-Benutzeroberfläche, API oder CLI, um Endpunkte zu starten oder zu stoppen und Dienste zu verwalten. Code-Ausführungsumgebungen sind verfügbar, um KI-Entwicklungsaufgaben zu erstellen und auszuführen.
Weitere Informationen zu Kontakt finden Sie auf der Kontaktseite (https://www.together.ai/contact)
Together AI Firmenname: Together AI .
Together AI Firmenadresse: San Francisco, CA 94114.
Weitere Informationen zu Together AI finden Sie auf der Über uns-Seite (https://www.together.ai/about) .
Together AI Preislink: https://www.together.ai/pricing
Together AI Linkedin link: https://www.linkedin.com/company/togethercomputer
Together AI Twitter link: https://twitter.com/togethercompute

Serverless Inference
Variiert je nach Modell und Token-Anzahl
Preise gelten pro 1 Million Tokens (Eingabe und Ausgabe für Chat, Multimodal, Sprache, Code; nur Eingabe für Einbettungen; Bildgröße/Schritte für Bildmodelle). Batch-Inferenz ist zu einem Einführungspreis von 50 % Rabatt verfügbar. Die spezifischen Modellpreise reichen von $0.06 bis $7.00 pro 1 Million Tokens, abhängig von Modellgröße und -typ.
Dedizierte Endpunkte
Variiert je nach GPU-Typ, pro Minute/Stunde
Bereitstellung von Modellen auf anpassbaren GPU-Endpunkten mit minutengenauer Abrechnung. Unterstützt verschiedene NVIDIA-GPUs wie RTX-6000, L40, A100, H100, H200. Die Preise reichen von $0.025 pro Minute ($1.49 pro Stunde) für RTX-6000/L40 bis $0.083 pro Minute ($4.99 pro Stunde) für H200.
Feinabstimmung
Pro 1 Million Tokens verarbeitet
Die Preise basieren auf Modellgröße, Datensatzgröße und Anzahl der Epochen. Supervised Fine-tuning (LoRA) liegt zwischen $0.48 und $2.90 pro 1 Million Tokens. Vollständige Feinabstimmung liegt zwischen $0.54 und $3.20 pro 1 Million Tokens. DPO (LoRA) liegt zwischen $1.20 und $7.25 pro 1 Million Tokens. DPO (Voll FT) liegt zwischen $1.35 und $8.00 pro 1 Million Tokens.
Together GPU-Cluster
Ab $1.30 pro Stunde
State-of-the-art Cluster mit NVIDIA Blackwell und Hopper GPUs (H200, H100, A100) für optimales KI-Training und -Inference. H200 beginnt bei $2.09 pro Stunde, H100 bei $1.75 pro Stunde, A100 bei $1.30 pro Stunde. Preise für GB200 und B200 erfordern Kontakt.
Code-Ausführung
Pro Stunde oder pro Sitzung
Together Code Sandbox wird pro vCPU ($0.0446 pro Stunde) und pro GiB RAM ($0.0149 pro Stunde) in Rechnung gestellt. Together Code Interpreter wird pro Sitzung in Rechnung gestellt ($0.03 für 60 Minuten).
Die aktuellen Preise finden Sie unter diesem Link: https://www.together.ai/pricing




Social Media Listening