Vai al contenuto

Edizione sperimentalePrima selezione di fonti e guide

Come funziona
supervenio.
Menu e sezioni
Ricerca & community

Segnalazione automatica

Hugging Face: training asincrono GRPO con LoRA su HF Jobs, sincronizzazione dell'adattatore tramite bucket

Un post del blog di Hugging Face descrive un progetto che addestra un adattatore LoRA con AsyncGRPOTrainer di TRL (v1.14) sincronizzando solo l'adattatore verso vLLM, senza NCCL: trainer e repliche vLLM girano come Job separati e lo scambio avviene tramite un Storage Bucket montato come filesystem, con un proxy che inoltra le richieste. Gli autori riportano cinque esecuzioni passate da 3 h 27 min a 53 min per 500 step.

Fonte originale: Hugging Face — blog (si apre in una nuova scheda)2 min di letturaScheda compilata il

Data di pubblicazione riportata dalla fonte: . Non indica l’entrata in vigore di una norma.

Sintesi automatica di una fonte primaria, sottoposta a controlli automatici. Consulta il documento originale per il contesto completo.

La segnalazione

Un post del blog di Hugging Face descrive un progetto che addestra un adattatore LoRA con AsyncGRPOTrainer di TRL (v1.14) sincronizzando solo l'adattatore verso vLLM, senza NCCL: trainer e repliche vLLM girano come Job separati e lo scambio avviene tramite un Storage Bucket montato come filesystem, con un proxy che inoltra le richieste. Gli autori riportano cinque esecuzioni passate da 3 h 27 min a 53 min per 500 step.

Come leggere questa scheda

Le dichiarazioni sono attribuite alla fonte. Questa scheda non certifica prestazioni, conformita o stato di vigenza di norme e non sostituisce una valutazione professionale.