
Installer les prérequis
autotrain-advanced et wandb.
- Ligne de commande
- Notebook
pass@1 sur les benchmarks GSM8k.
Préparez le jeu de données
text, utilisée pour l’entraînement. Les données de la colonne text doivent respecter le format ### Human: Question?### Assistant: Answer.. Consultez un exemple dans timdettmers/openassistant-guanaco.
Cependant, le jeu de données MetaMathQA contient les colonnes query, response et type. Commencez par prétraiter ce jeu de données. Supprimez la colonne type et fusionnez le contenu des colonnes query et response dans une nouvelle colonne text, au format ### Human: Query?### Assistant: Response.. Le jeu de données obtenu, rishiraj/guanaco-style-metamath, est ensuite utilisé pour l’entraînement.
Entraîner avec autotrain
autotrain advanced depuis la ligne de commande ou un notebook. Utilisez l’argument --log, ou --log wandb pour journaliser vos résultats dans un run. L’argument --log wandb active l’intégration W&B pour ce run.
Remplacez <huggingface-token> par votre jeton d’accès Hugging Face et <huggingface-repository-address> par l’adresse du dépôt cible (par exemple, your-username/your-repo).
- Ligne de commande
- Notebook
