Verwaltete Modell-Endpunkte
Rufen Sie unterstützte Modelle auf, ohne Container bereitzustellen, GPU-Hardware auszuwählen oder ein privates Modell-Deployment zu warten.
- Keine vom Kunden verwalteten Inferenzserver
- Dokumentierte Modell-Endpunkte
- Ein Authentifizierungsmuster
Nutzen Sie das Modell, ohne das Deployment zu betreiben