Was ist Ollama?
Ollama betreibt große Sprachmodelle lokal auf dem eigenen Rechner.
- Einfache Installation und Bedienung
- Modelle laufen ohne Cloud
- Daten bleiben lokal
Installation unter Linux
Ein Befehl genügt: curl -fsSL https://ollama.com/install.sh | sh
- Auch für macOS und Windows verfügbar
- Danach läuft der Ollama-Dienst im Hintergrund
Ollama als API
Ollama stellt eine lokale API bereit (Port 11434) – nutzbar aus eigenen Anwendungen.
- Anbindung an eigene Skripte/Tools
- Grundlage für Oberflächen wie Open WebUI
Eigene Modelle anpassen
Ein Modelfile beschreibt, wie ein Modell sich verhalten soll.
- Basis-Modell, System-Prompt und Parameter festlegen
- ollama create baut daraus ein benanntes Modell
- Praktisch für feste Rollen, z. B. einen Übersetzer
Systemanforderungen
RAM/VRAM
Muss zur Modellgröße passen – sonst wird es sehr langsam.
GPU
Beschleunigt die Ausgabe stark – ist aber kein Muss.
- Kleinere, quantisierte Modelle laufen auch auf dem Notebook
- Mehrere Modelle parallel geladen kosten entsprechend Speicher