ข้ามไปยังเนื้อหาหลัก

Hugging Face Hub

มีสองวิธี:

  • plugin Hugging Face Inference Providers
  • browser Hub ในแอป รวม GGUF สำหรับ Ollama

ตั้งค่า Plugin​

สร้าง token ที่มีสิทธิ์ inference:

HUGGINGFACE_API_KEY=hf_...

เปิดใช้ใน การตั้งค่า > Plugin

ความสามารถ​

Chat/completion, TTS, รูปภาพ, embedding และ STT ขึ้นกับโมเดลและ provider ตรวจหน้าของโมเดลและ UI ล่าสุด

Browser โมเดล​

ค้นหาตามชื่อ/ผู้เขียน filter งาน เรียงลำดับ ดูสถานะ gated และ download GGUF ผ่าน Ollama Metadata ผ่าน server proxy และ cache ต้องมีเซสชัน Libre และมีเพียง administrator ที่ล้าง cache ร่วมได้

GGUF และ Ollama​

สำหรับ inference local ให้ค้นหา GGUF Libre รองรับอ้างอิง hf.co/...:

ollama run hf.co/owner/model-repo:tag

UI ลดข้อผิดพลาดและแสดง metadata

Routing ของ Inference Provider​

Router ที่เข้ากันได้กับ OpenAI รองรับ ID Hub และบางครั้ง suffix/preference ของ provider ใช้เอกสารทางการล่าสุด

โมเดล Gated​

เปิดหน้าโมเดล ยอมรับเงื่อนไข ตรวจ token แล้วลองใหม่ โมเดลอาจแสดงก่อนอนุญาต

การแก้ปัญหา​

ตรวจ token และสิทธิ์ inference หน้าโมเดล เงื่อนไข GGUF และอ้างอิง hf.co/... ที่ตรง หากทรัพยากรน้อยให้ใช้ quantization เล็กลง

เอกสารที่เกี่ยวข้อง​