Vai al contenuto

Edizione sperimentalePrima selezione di fonti e guide

Come funziona
supervenio.
Menu e sezioni
La biblioteca pratica

Segnalazione automatica

Audio8 ASR Infinite: modello di riconoscimento vocale in streaming continuo per cinese e inglese

Modello di riconoscimento automatico del parlato pensato per trascrivere audio in streaming con bassa latenza. Supporta cinese e inglese, offre un orologio audio selezionabile e un ritardo di trascrizione configurabile, e grazie a una finestra KV scorrevole mantiene memoria e latenza costanti anche in esercizio continuo. Include un rilevatore semantico dei turni di parola.

Fonte originale: Hugging Face — modelli AI (si apre in una nuova scheda)2 min di letturaScheda compilata il

Attività del repository o del modello riportata dalla piattaforma:

Segnalazione automatica di una risorsa pubblicata da terzi. Il conteggio misura stelle o apprezzamenti sulla piattaforma alla data indicata; non certifica qualità o sicurezza.

Uso pratico

Trascrizione continua e in tempo reale di flussi audio lunghi, ad esempio sottotitoli o verbalizzazione di conversazioni, con controllo del compromesso tra rapidità e accuratezza. Distribuito come pesi completi da usare con Transformers o con deploy Docker basato su vLLM.

Compatibilità dichiarata

Non dichiarata nella documentazione consultata

Licenza e accesso

apache-2.0

Prima di usare o installare

Controlla il codice o la scheda originale, la licenza, i permessi richiesti e i dati che la risorsa può consultare. Le stelle e i like non sono una verifica di sicurezza.