Sprachmodelle (LLMs) sind die Motoren hinter Chatbots wie ChatGPT. Sie sagen das nächste Wort voraus – und daraus entstehen ganze Antworten, Texte und Zusammenfassungen.
Große Cloud-Modelle
- Beispiele: GPT-4, Claude, Gemini
- Laufen auf riesigen Servern, sehr leistungsfähig
- Mehr Kontext, bessere Argumentation, aber Daten gehen in die Cloud
Lokale Modelle
- Beispiele: LLaMA, Qwen, Mistral (via Ollama / llama.cpp)
- Laufen auf der eigenen Hardware – privat und offline
- Brauchen je nach Größe eine GPU; mit Quantisierung (GGUF) oft schon auf 8–16 GB RAM
Welches brauchst du?
Cloud: Wenn Qualität und Kreativität zählen – und du keine sensiblen Daten eingibst. Lokal: Wenn Privatsphäre wichtig ist oder du ohne Internet arbeiten willst.