मुख्य कंटेंट तक स्किप करें

Hugging Face Hub

दो तरीके उपलब्ध हैं:

  • Hugging Face Inference Providers प्लगइन;
  • अनुप्रयोग में Hub ब्राउज़र, जिसमें Ollama के लिए GGUF भी है।

प्लगइन विन्यास​

Inference अनुमति वाला टोकन बनाएँ:

HUGGINGFACE_API_KEY=hf_...

इसे सेटिंग्स > प्लगइन में सक्रिय करें।

क्षमताएँ​

मॉडल और प्रदाता के अनुसार चैट/completion, TTS, चित्र, embedding और STT उपलब्ध होते हैं। वर्तमान मॉडल पृष्ठ और अंतराफलक जाँचें।

मॉडल ब्राउज़र​

नाम या लेखक से खोज, कार्य filter, sorting, gated स्थिति और Ollama द्वारा GGUF download उपलब्ध हैं। Metadata server proxy से होकर cache होता है; Libre session आवश्यक है और shared cache केवल administrator साफ कर सकता है।

GGUF और Ollama​

स्थानीय inference के लिए GGUF खोजें। Libre hf.co/... संदर्भ स्वीकार करता है:

ollama run hf.co/owner/model-repo:tag

अंतराफलक त्रुटियाँ घटाता और metadata दिखाता है।

Inference Provider routing​

OpenAI-compatible router Hub ID तथा कभी-कभी provider suffix/प्राथमिकता स्वीकार करता है। नवीन आधिकारिक documentation देखें।

प्रतिबंधित मॉडल​

मॉडल पृष्ठ खोलें, शर्तें स्वीकारें, token जाँचें और पुनः प्रयास करें। अनुमति मिलने से पहले मॉडल दिखाई दे सकता है।

समस्या निवारण​

Token और inference permissions, मॉडल पृष्ठ, शर्तें, GGUF की उपलब्धता और सही hf.co/... संदर्भ जाँचें। संसाधन कम हों तो छोटी quantization चुनें।

संबंधित दस्तावेज़​