Passa al contenuto principale

Hugging Face Hub

Libre WebUI si integra con Hugging Face in due modi:

  • Accesso tramite il plugin del provider agli Inference Providers di Hugging Face.
  • Esplorazione dell'Hub all'interno dell'app per i modelli compatibili, compresi i modelli GGUF che possono essere scaricati tramite Ollama.

Configurare il plugin del provider​

Crea un token di accesso Hugging Face con autorizzazione per l'inferenza, quindi aggiungilo nelle Impostazioni oppure come variabile di ambiente:

HUGGINGFACE_API_KEY=hf_...

Abilita il plugin Hugging Face in Impostazioni > Plugin.

Funzionalità​

A seconda della disponibilità del modello e del provider, Hugging Face può offrire:

  • Modelli di chat/completamento
  • Sintesi vocale
  • Generazione di immagini
  • Embedding
  • Trascrizione vocale

Disponibilità, prezzi e routing di Hugging Face possono cambiare in base al modello. Controlla la pagina del modello e l'interfaccia dei provider Hugging Face per conoscere lo stato corrente.

Browser dei modelli​

Il browser integrato nell'app consente di:

  • Cercare per nome del modello o autore.
  • Filtrare per attività.
  • Ordinare per tendenza, download, Mi piace, data di creazione o data di aggiornamento.
  • Esaminare lo stato di accesso limitato del modello.
  • Scaricare tramite Ollama i file GGUF compatibili, quando supportati.

Il browser recupera i metadati dell'Hub tramite il proxy del backend e memorizza nella cache i risultati per migliorare le prestazioni. Il backend richiede una sessione Libre attiva per l'esplorazione dell'Hub e soltanto un amministratore corrente può cancellare la cache condivisa dei modelli.

GGUF e Ollama​

Per l'inferenza locale, cerca modelli in formato GGUF. Libre WebUI può usare riferimenti di modello hf.co/... compatibili con Ollama quando un repository offre file GGUF idonei.

Schema di esempio:

ollama run hf.co/owner/model-repo:tag

Quando possibile, usa l'interfaccia: riduce gli errori di copia e incolla e mantiene visibili i metadati del modello.

Routing degli Inference Provider​

Il router compatibile con OpenAI di Hugging Face supporta gli ID dei modelli dell'Hub. Alcune route supportano suffissi o preferenze del provider. Poiché queste caratteristiche cambiano nel tempo, consulta la documentazione aggiornata di Hugging Face e il browser dei modelli nell'app per conoscere gli ID esatti.

Modelli con accesso limitato​

Alcuni modelli richiedono di accettare condizioni prima dell'uso:

  1. Apri la pagina del modello su Hugging Face.
  2. Accetta la licenza o le condizioni.
  3. Verifica che il token disponga dell'accesso.
  4. Riprova da Libre WebUI.

I modelli con accesso limitato possono apparire nei risultati prima che il token sia autorizzato a eseguirli.

Risoluzione dei problemi​

Non autorizzato

  • Controlla il valore del token.
  • Verifica che il token disponga delle autorizzazioni per l'inferenza.
  • Se usi credenziali per utente, verifica che la chiave sia salvata per l'utente corrente.

Modello non disponibile

  • Controlla la pagina del modello su Hugging Face.
  • Prova la route di un altro provider, se disponibile.
  • Verifica di aver accettato le condizioni di accesso limitato.

Il download GGUF non riesce

  • Verifica che il repository contenga file GGUF.
  • Prova il riferimento hf.co/... esatto in un terminale con Ollama.
  • Usa una quantizzazione più piccola se lo spazio su disco o la memoria sono limitati.

Documentazione correlata​