Segnalazione automatica
DeepSeek-V4.1-Flash: modello multimodale MoE con compressione della KV cache
Modello multimodale Mixture-of-Experts da 552 miliardi di parametri di backbone, con contesto fino a un milione di token, che elabora nativamente immagini e testo e genera testo in modo autoregressivo. La compressione della cache KV e l'attenzione sparsa riducono i costi su carichi agentici con molti input, con attività dichiarata image-text-to-text.
Attività del repository o del modello riportata dalla piattaforma:
Segnalazione automatica di una risorsa pubblicata da terzi. Il conteggio misura stelle o apprezzamenti sulla piattaforma alla data indicata; non certifica qualità o sicurezza.
Uso pratico
Impiegabile in attività di analisi e generazione su documenti e immagini, inclusi carichi agentici lunghi, dove il contenuto visivo e testuale va elaborato insieme entro contesti estesi.
Compatibilità dichiarata
Non dichiarata nella documentazione consultata
Licenza e accesso
mit
Prima di usare o installare
Controlla il codice o la scheda originale, la licenza, i permessi richiesti e i dati che la risorsa può consultare. Le stelle e i like non sono una verifica di sicurezza.