Wer Large Language Models lokal mit Programmen wie LM Studio, Ollama oder llama.cpp betreibt, stößt relativ schnell auf Bezeichnungen wie: Dahinter verbergen sich zwei besonders wichtige Techniken moderner Large Language Models: Beide Techniken verfolgen also das Ziel, große Modelle effizienter
Quantisierung und Mixture of Experts: Wie moderne LLMs effizienter werden


