Ugrás a fő tartalomra

AI-modellek használata

A Libre WebUI helyi Ollama és pluginos cloud modelleket használ egy workspace-ben. A Model Manager telepített/futó Ollama, live Library, Hugging Face GGUF és Cloud elemeket mutat.

Első modell​

ModellMire jóTipikus igény
gemma4:12bGyors általános chat16 GB RAM vagy 8 GB VRAM
qwen3.8:27bChat, kód, többnyelvű32 GB RAM vagy 16–24 GB VRAM
gemma4:26bErős MoE chat24 GB RAM vagy 16 GB VRAM
gemma4:31bLegjobb dense helyi chat32 GB RAM vagy 24 GB VRAM
nomic-embed-textDokumentum-embeddingKis helyi modell

Nagy 30B/70B/MoE több memóriát kér. Kezdje kicsiben és növelje stabil futás után.

Model Manager​

A Settings → Models alatt letöltés névvel, live Library-keresés, futó modellek leállítása/törlése, az összes telepített Ollama-modell frissítése egyetlen művelettel, GGUF és Cloud letöltés. A UI kezeli a :cloud/-cloud suffixet.

Katalógus és láthatóság​

A Settings → Defaults alatti Model Catalog minden modellt provider badge-dzsel és kereséssel listáz; az alapértelmezett modellt a katalógus fölött választja ki, ezzel indulnak az új chatek. Az admin csillaggal a katalógus és az alapértelmezett-modell menü elejére tűzhet egy modellt: több csillagnál a legutóbb megjelölt kerül előre, a csillag levétele visszaadja a kézi vagy a provider szerinti helyet. Admin szemkapcsolóval el is rejthet modellt mások elől. Ez kuráció, nem authorization boundary; admin mindent lát.

Helyi és cloud​

MódElőnyHátrány
Helyi OllamaPrivát, letöltés után offline, fix költségCPU/GPU/RAM függő
Ollama CloudIsmert flow helyi hardverlimit nélkülCloud és hálózat kell
Provider pluginTöbb managed modellKeys, ár és privacy policy

Helyi modell privát munkához, plugin nagyobb hosted feladathoz.

Alapértelmezett vision modell​

Válasszon a Settings → Defaults → Specialized Models → Vision Model alatt. Képet tartalmazó kör — új, korábbi vagy incognito history — oda kerül, text-only a session modelhez.

Felhasználónkénti, automatikus, csendes. Use the current chat model kikapcsolja. A kép jelenlétét nézi, nem a session képességét.

Pontos provider identity mentődik, ezért azonos név nem foglalható el. Ha elvész, a képet tartalmazó kör hibára fut. Válassza ki újra a modellt a Settings → Defaults → Specialized Models → Vision Model alatt; a hangos hiba szándékos, nincs csendes helyettesítés.

Work-modellek​

  • Telepített Ollama tools capabilityvel.
  • Ollama Cloud.
  • Aktív chat/completion plugin pontos modellel és admin credentiallel.

Az adapter OpenAI, Anthropic vagy Gemini, exact provider type/ID mentve task/run mellett. Azonos név nem térít el, tools elutasítása hibázik fallback nélkül.

Helyi Ollama helyben tartja a kérést. Remote provider megkapja Work system promptot, conversationt, tool definitions/results, amelyekben source, output és directories lehetnek. Volumes és credentials hoston maradnak, de file content tool resultként távozhat.

Egy run sok calls. Sensitive project előtt pricing, retention, training ellenőrzése.

Hardverútmutató​

RendszerModellMegjegyzés
CPU, 8–16 GB RAM1B–4BKönnyű chat
8 GB VRAM4B–8B quantizedJó kezdet
12–16 GB VRAM8B–14B quantizedNapi használat
24 GB VRAM14B–32B quantizedErős workstation
48 GB+ VRAM/unified memory32B–70B quantizedNagy kísérletek

Q4 praktikus alap, Q8 több memória/jobb minőség.

Feladatajánlások​

FeladatIrány
Gyors chatgemma4:12b és kis aktuális
KódQwen Coder, Codestral, provider coding
ReasoningNagy Qwen/Gemma vagy provider reasoning
VisionLLaVA, Qwen VL vagy provider vision
Dokumentumnomic-embed-text vagy más embedding
TTSQwen3-TTS vagy Kyutai TTS

A providernevek változnak; használjon discoveryt vagy exact dashboard ID-t.

Prompt és beállítás​

  • Temperature, token, context, penalties az Advanced generation settings alatt.
  • 0.1-0.3 tényszerű, 0.5-0.7 normál, 0.8+ kreatív.
  • Tartsa ésszerűen a contextet és használjon perszonát tartós paraméterhez.

Hibaelhárítás​

Pull hiba: ollama list, terminal, disk, Cloud suffix kezelése.

Lassú: kisebb modell/quantization, ollama ps, GPU appok bezárása, kisebb context.

Memória: Q8→Q4, 14B→8B, csak szükséges modell; Dockerben GPU/Ollama host.

Kapcsolódó dokumentáció​