connections
GET /v1/inference/deployments
The organisation's model deployments and what is actually serving.
Authentification
Envoyez une clé d'API en tant que jeton du porteur (bearer token). Cet endpoint n'indique pas de permission spécifique dans la spécification, attribuez donc à votre clé le minimum requis et vérifiez la réponse plutôt que de faire des suppositions.
Cet endpoint ne prend aucun identifiant d'organisation. Votre clé identifie déjà l'organisation à laquelle elle appartient, et la réponse y est limitée.
Essayer
Remplacez tout ce qui se trouve entre crochets par vos propres valeurs, et le espace réservé à la clé par une clé de votre tableau de bord.
curl -X GET https://api.zinndigital.com/v1/inference/deployments \
-H "Authorization: Bearer zdk_live_…"Connecté ? La console d'API de votre tableau de bord saisit votre véritable ID d'organisation ainsi que votre propre clé, et exécute la requête sur l'API de production afin que vous puissiez voir la réponse réelle. Ouvrir ce point de terminaison dans la console API
Détails
Model endpoints on the customer's own inference account. ⛔ replicas is what was asked for and ready_replicas is what is serving. A screen showing only the first reports a healthy deployment that is answering nothing. ready_replicas is null when the provider did not report readiness at all — which is not the same as zero. state includes degraded (some replicas up, some not) and deleting (being torn down, and possibly still holding GPUs). Neither is rounded onto a neighbour: a degraded deployment reported as running hides missing capacity, and a deleting one reported as stopped implies it has stopped costing money.
Réponse
| Nom | Type | Obligatoire | Qu'est-ce que c'est |
|---|---|---|---|
deployments | InferenceDeployment[] | Oui | — |
Erreurs que cet point de terminaison peut renvoyer
401 · 429