Vai al contenuto

Edizione sperimentalePrima selezione di fonti e guide

Come funziona
supervenio.
Menu e sezioni
La biblioteca pratica

Segnalazione automatica

DeepSeek-V4.1-Flash: modello multimodale MoE con compressione della KV cache

Modello multimodale Mixture-of-Experts da 552 miliardi di parametri di backbone, con contesto fino a un milione di token, che elabora nativamente immagini e testo e genera testo in modo autoregressivo. La compressione della cache KV e l'attenzione sparsa riducono i costi su carichi agentici con molti input, con attività dichiarata image-text-to-text.

Fonte originale: Hugging Face — modelli AI (si apre in una nuova scheda)2 min di letturaScheda compilata il

Attività del repository o del modello riportata dalla piattaforma:

Segnalazione automatica di una risorsa pubblicata da terzi. Il conteggio misura stelle o apprezzamenti sulla piattaforma alla data indicata; non certifica qualità o sicurezza.

Uso pratico

Impiegabile in attività di analisi e generazione su documenti e immagini, inclusi carichi agentici lunghi, dove il contenuto visivo e testuale va elaborato insieme entro contesti estesi.

Compatibilità dichiarata

Non dichiarata nella documentazione consultata

Licenza e accesso

mit

Prima di usare o installare

Controlla il codice o la scheda originale, la licenza, i permessi richiesti e i dati che la risorsa può consultare. Le stelle e i like non sono una verifica di sicurezza.