Exporter des données
- Exporter des données : récupérez un dataframe pour effectuer une analyse personnalisée dans un notebook Jupyter. Une fois les données explorées, vous pouvez synchroniser vos résultats en créant un nouveau run d’analyse et en enregistrant les résultats, par exemple :
wandb.init(job_type="analysis") - Mettre à jour des Runs existants : vous pouvez mettre à jour les données enregistrées pour un run W&B. Par exemple, vous pouvez vouloir mettre à jour la configuration d’un ensemble de runs afin d’y inclure des informations supplémentaires, comme l’architecture ou un hyperparamètre qui n’avait pas été enregistré à l’origine.
Exporter les données d’un run
Vous pouvez également modifier ou mettre à jour les données de runs passés. Par défaut, une seule instance d’un objet API met en cache toutes les requêtes réseau. Si votre cas d’utilisation nécessite des informations en temps réel dans un script en cours d’exécution, appelez
api.flush() pour obtenir des valeurs mises à jour.
Interroger plusieurs runs
- DataFrame et CSV
- Style MongoDB
Ce script d’exemple recherche un projet et génère un CSV des runs avec leur nom, leur configuration et leurs statistiques de synthèse. Remplacez
<entity> et <project> par votre entité W&B et le nom de votre projet, respectivement.api.runs renvoie un objet Runs itérable qui se comporte comme une liste. Par défaut, l’objet charge 50 runs à la fois, séquentiellement et selon les besoins, mais vous pouvez modifier le nombre chargé par page avec l’argument nommé per_page.
api.runs accepte également un argument nommé order. L’ordre par défaut est -created_at. Pour trier les résultats par ordre croissant, indiquez +created_at. Vous pouvez également trier par des valeurs de config ou de synthèse. Par exemple, summary.val_acc ou config.experiment_name.
Gestion des erreurs
wandb.CommError est levée. Vous pouvez examiner l’exception d’origine via l’attribut exc.
Obtenir le nom et l’ID d’un run pendant un run actif
wandb.init(), vous pouvez accéder depuis votre script à l’ID aléatoire du run ou à son nom lisible, comme ceci :
- ID unique du run (hachage de 8 caractères) :
run.id - Nom aléatoire du run (lisible) :
run.name
- ID du run : laissez le hachage généré tel quel. Il doit être unique parmi les runs de votre projet.
- Nom du run : il doit être court, lisible et de préférence unique, afin que vous puissiez distinguer les différentes lignes sur vos graphiques.
- Notes du run : c’est l’endroit idéal pour ajouter une brève description de ce que vous faites dans ce run. Vous pouvez les définir avec
wandb.init(notes="your notes here") - Tags du run : utilisez les tags du run pour suivre des éléments de manière dynamique, puis utilisez des filtres dans l’UI pour n’afficher dans votre tableau que les runs qui vous intéressent. Vous pouvez définir les tags depuis votre script, puis les modifier dans l’UI, à la fois dans le tableau des Runs et dans l’onglet Vue d’ensemble de la page du run. Voir les instructions détaillées ici.
Exemples d’utilisation de l’API publique
Lire les métriques d’un run
run.log({"accuracy": acc}) pour un run enregistré sous "<entity>/<project>/<run_id>".
Lire des métriques spécifiques d’un run
keys. Le nombre d’échantillons par défaut lors de l’utilisation de run.history() est de 500. Les étapes enregistrées qui n’incluent pas de métrique spécifique apparaîtront dans le dataframe de sortie sous la forme de NaN. L’argument keys fera en sorte que l’API échantillonne plus fréquemment les étapes qui incluent les clés de métrique listées.
Comparer deux runs
run1 et run2.
Mettre à jour les métriques d’un run après la fin du run
accuracy d’un run précédent à 0.9 :
Renommer une métrique dans un run terminé
Le changement de nom d’une colonne s’applique uniquement aux tableaux. Les graphiques continueront d’utiliser les noms d’origine des métriques.
Mettre à jour la configuration d’un run existant
Exporter l’utilisation des ressources système vers un fichier CSV
Obtenir des données de métriques non échantillonnées
run.scan_history(). Voici un exemple qui télécharge tous les points de données loss enregistrés dans l’historique.
Obtenir des données paginées dans l’historique
run.scan_history(). L’historique non échantillonné inclut chaque enregistrement de l’historique du run. En revanche, la vue échantillonnée de run.history() peut omettre certains enregistrements.
Le paramètre page_size contrôle le nombre maximum d’enregistrements d’historique récupérés par requête API et vaut par défaut 1000. Si les requêtes sont lentes ou expirent, essayez une taille de page plus petite. Des pages plus petites peuvent réduire le risque d’expiration, mais nécessitent davantage de requêtes API.
Le paramètre keys permet de filtrer indépendamment les métriques renvoyées.
Exporter les métriques de tous les runs d’un projet dans un fichier CSV
<entity> et <project> par votre entité W&B et le nom de votre projet, respectivement.
Obtenir l’heure de début d’un run
Importer des fichiers dans un run terminé
Télécharger un fichier d’un run
Télécharger tous les fichiers d’un run
Obtenir les runs d’un balayage spécifique
Obtenir le meilleur run d’un balayage
best_run correspond au run présentant la meilleure métrique, telle que définie par le paramètre metric dans la configuration du balayage.
Télécharger le fichier du meilleur modèle depuis un balayage
model.h5.