my_voice_assistant_v3/scripts/llm-server
Dieter Schlüter 317ad2ff97 feat(llm): Make-Targets zum Wechseln des LLM-Backends (Ollama <-> llama.cpp)
- scripts/llm-server/switch-llm.sh: gibt GPU des anderen Backends frei
  (llama.cpp-Container stoppen bzw. Ollama-Modelle entladen, Dienst bleibt),
  startet das gewünschte Backend, passt LOCAL_LLM_* in .env an und startet
  das Gateway (als Dienst) neu bzw. weist auf manuellen Neustart hin.
- Makefile: Targets `llm-ollama` / `llm-llamacpp` (Modell via OLLAMA_MODEL=...).
- Doku §4.7 + Schnellbefehle §4.0: Make-Targets als empfohlener Weg, inkl.
  Erklärung warum der Gateway-Neustart nötig ist (Makefile exportiert .env als
  Env-Variablen -> Vorrang vor .env-Datei).

Getestet: Round-Trip ollama -> llamacpp -> ollama; llama.cpp 2,3s, gemma3 warm.

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-06-20 15:56:42 +02:00
..
start-llm-server.sh feat(llm): lokales llama.cpp-Modell (va_llm) als zentrale, sprachoptimierte KI 2026-06-18 02:57:57 +02:00
status-llm-server.sh feat(llm): lokales llama.cpp-Modell (va_llm) als zentrale, sprachoptimierte KI 2026-06-18 02:57:57 +02:00
stop-llm-server.sh feat(llm): lokales llama.cpp-Modell (va_llm) als zentrale, sprachoptimierte KI 2026-06-18 02:57:57 +02:00
switch-llm.sh feat(llm): Make-Targets zum Wechseln des LLM-Backends (Ollama <-> llama.cpp) 2026-06-20 15:56:42 +02:00