📖 llama-cpp

Alle Artikel in dieser Kategorie

4 Artikel

GPU-Power — Von 10 auf 100 Tokens pro Sekunde

Von Dr. Cassian Holt, Senior Architect bei Fleet Data & System Consulting Schwierigkeit: 🟡 MittelLesezeit: 30 MinutenHands-on Zeit: 30 MinutenVoraussetzungen: Teil 1-3 abgeschlossen, dedizierte GPU (NVIDIA, AMD oder Apple Silicon) 📚 Serie: Lokale KI mit llama.cpp Teil Thema Status 1…
Weiterlesen →