refactor: start-single.sh → start-coding-server.sh, stop-servers.sh → stop-coding-server.sh

Konsistente Benennung: Server-Skripte beschreiben ihre Funktion (coding-server),
nicht das spezifische Modell oder die Architektur. Alle Referenzen in Extension,
Tests, README und BEDIENUNGSANLEITUNG aktualisiert.

Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
This commit is contained in:
Dieter Schlüter 2026-06-15 05:45:36 +02:00
commit 3f66d4a387
6 changed files with 40 additions and 40 deletions

View file

@ -52,7 +52,7 @@ der Judge kritisiert direkt und konkret, der Coder repariert ohne Widerspruch.
```bash
cd ~/pi_coder
./start-single.sh
./start-coding-server.sh
```
Ausgabe bei Erfolg:
@ -95,8 +95,8 @@ pi
Der Server läuft standardmäßig auf **GPU 1** (überschreibbar):
```bash
./start-single.sh # GPU 1 (Standard)
GPU_DEVICE=0 ./start-single.sh # GPU 0
./start-coding-server.sh # GPU 1 (Standard)
GPU_DEVICE=0 ./start-coding-server.sh # GPU 0
```
Auf einem System mit mehreren GPUs empfiehlt es sich, GPU 0 (Display) freizuhalten
@ -112,7 +112,7 @@ nvidia-smi --query-gpu=index,name,memory.used,memory.free --format=csv
```bash
cd ~/pi_coder
./start-single.sh
./start-coding-server.sh
```
Erwartete Ausgabe:
@ -127,7 +127,7 @@ Dauer: bis zu 5 Minuten. Danach ist das Modell im VRAM und sofort antwortbereit.
### Server stoppen
```bash
./stop-servers.sh
./stop-coding-server.sh
```
### Status prüfen
@ -141,7 +141,7 @@ Dauer: bis zu 5 Minuten. Danach ist das Modell im VRAM und sofort antwortbereit.
Falls die GGUF-Datei an einem anderen Ort liegt:
```bash
HF_HOME=/mnt/daten/huggingface ./start-single.sh
HF_HOME=/mnt/daten/huggingface ./start-coding-server.sh
```
---
@ -856,7 +856,7 @@ Die Checkboxen werden automatisch abgehakt:
ls $HF_HOME/models/qwen3/
# Oder mit explizitem Pfad starten:
HF_HOME=/korrekter/pfad ./start-single.sh
HF_HOME=/korrekter/pfad ./start-coding-server.sh
```
### Server startet nicht / HTTP nicht erreichbar
@ -872,7 +872,7 @@ HF_HOME=/korrekter/pfad ./start-single.sh
docker logs coding_model | tail -50
# Suche nach: "CUDA out of memory" oder "failed to allocate"
```
→ Kontext reduzieren: `-c 65536` statt `-c 262144` in `start-single.sh`
→ Kontext reduzieren: `-c 65536` statt `-c 262144` in `start-coding-server.sh`
2. GPU nicht verfügbar:
```bash
@ -880,15 +880,15 @@ HF_HOME=/korrekter/pfad ./start-single.sh
# GPU 1 testen:
docker run --gpus '"device=1"' --rm nvidia/cuda:12.0-base nvidia-smi
# Andere GPU testen:
GPU_DEVICE=0 ./start-single.sh
GPU_DEVICE=0 ./start-coding-server.sh
```
3. Port 8001 bereits belegt:
```bash
ss -tlnp | grep 8001
docker ps -a # alter Container noch vorhanden?
./stop-servers.sh
./start-single.sh
./stop-coding-server.sh
./start-coding-server.sh
```
### "Agent is already processing a prompt"