Passer au contenu principal
Après avoir entraîné un modèle avec Serverless RL, il est automatiquement disponible pour l’inférence. Pour envoyer des requêtes à votre modèle entraîné, vous avez besoin de : Le point de terminaison du modèle utilise le schéma suivant :
Le schéma se compose de :
  • du nom de votre entité W&B (équipe)
  • du nom du projet associé à votre modèle
  • du nom du modèle entraîné
  • de l’étape d’entraînement du modèle que vous souhaitez déployer (il s’agit généralement de l’étape où le modèle a obtenu les meilleurs résultats lors de vos évaluations)
Par exemple, si votre équipe W&B s’appelle email-specialists, que votre projet s’appelle mail-search, que votre modèle entraîné s’appelle agent-001 et que vous souhaitez le déployer à l’étape 25, le point de terminaison ressemble à ceci :
Une fois que vous disposez de votre point de terminaison, vous pouvez l’intégrer à vos flux de travail d’inférence habituels. Les exemples suivants montrent comment envoyer des requêtes d’inférence à votre modèle entraîné à l’aide d’une requête cURL ou du SDK d’OpenAI pour Python.

cURL

SDK d’OpenAI