refactor: start-single.sh → start-coding-server.sh, stop-servers.sh → stop-coding-server.sh
Konsistente Benennung: Server-Skripte beschreiben ihre Funktion (coding-server), nicht das spezifische Modell oder die Architektur. Alle Referenzen in Extension, Tests, README und BEDIENUNGSANLEITUNG aktualisiert. Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
This commit is contained in:
parent
2b0ca79dca
commit
3f66d4a387
6 changed files with 40 additions and 40 deletions
|
|
@ -52,7 +52,7 @@ der Judge kritisiert direkt und konkret, der Coder repariert ohne Widerspruch.
|
|||
|
||||
```bash
|
||||
cd ~/pi_coder
|
||||
./start-single.sh
|
||||
./start-coding-server.sh
|
||||
```
|
||||
|
||||
Ausgabe bei Erfolg:
|
||||
|
|
@ -95,8 +95,8 @@ pi
|
|||
Der Server läuft standardmäßig auf **GPU 1** (überschreibbar):
|
||||
|
||||
```bash
|
||||
./start-single.sh # GPU 1 (Standard)
|
||||
GPU_DEVICE=0 ./start-single.sh # GPU 0
|
||||
./start-coding-server.sh # GPU 1 (Standard)
|
||||
GPU_DEVICE=0 ./start-coding-server.sh # GPU 0
|
||||
```
|
||||
|
||||
Auf einem System mit mehreren GPUs empfiehlt es sich, GPU 0 (Display) freizuhalten
|
||||
|
|
@ -112,7 +112,7 @@ nvidia-smi --query-gpu=index,name,memory.used,memory.free --format=csv
|
|||
|
||||
```bash
|
||||
cd ~/pi_coder
|
||||
./start-single.sh
|
||||
./start-coding-server.sh
|
||||
```
|
||||
|
||||
Erwartete Ausgabe:
|
||||
|
|
@ -127,7 +127,7 @@ Dauer: bis zu 5 Minuten. Danach ist das Modell im VRAM und sofort antwortbereit.
|
|||
### Server stoppen
|
||||
|
||||
```bash
|
||||
./stop-servers.sh
|
||||
./stop-coding-server.sh
|
||||
```
|
||||
|
||||
### Status prüfen
|
||||
|
|
@ -141,7 +141,7 @@ Dauer: bis zu 5 Minuten. Danach ist das Modell im VRAM und sofort antwortbereit.
|
|||
Falls die GGUF-Datei an einem anderen Ort liegt:
|
||||
|
||||
```bash
|
||||
HF_HOME=/mnt/daten/huggingface ./start-single.sh
|
||||
HF_HOME=/mnt/daten/huggingface ./start-coding-server.sh
|
||||
```
|
||||
|
||||
---
|
||||
|
|
@ -856,7 +856,7 @@ Die Checkboxen werden automatisch abgehakt:
|
|||
ls $HF_HOME/models/qwen3/
|
||||
|
||||
# Oder mit explizitem Pfad starten:
|
||||
HF_HOME=/korrekter/pfad ./start-single.sh
|
||||
HF_HOME=/korrekter/pfad ./start-coding-server.sh
|
||||
```
|
||||
|
||||
### Server startet nicht / HTTP nicht erreichbar
|
||||
|
|
@ -872,7 +872,7 @@ HF_HOME=/korrekter/pfad ./start-single.sh
|
|||
docker logs coding_model | tail -50
|
||||
# Suche nach: "CUDA out of memory" oder "failed to allocate"
|
||||
```
|
||||
→ Kontext reduzieren: `-c 65536` statt `-c 262144` in `start-single.sh`
|
||||
→ Kontext reduzieren: `-c 65536` statt `-c 262144` in `start-coding-server.sh`
|
||||
|
||||
2. GPU nicht verfügbar:
|
||||
```bash
|
||||
|
|
@ -880,15 +880,15 @@ HF_HOME=/korrekter/pfad ./start-single.sh
|
|||
# GPU 1 testen:
|
||||
docker run --gpus '"device=1"' --rm nvidia/cuda:12.0-base nvidia-smi
|
||||
# Andere GPU testen:
|
||||
GPU_DEVICE=0 ./start-single.sh
|
||||
GPU_DEVICE=0 ./start-coding-server.sh
|
||||
```
|
||||
|
||||
3. Port 8001 bereits belegt:
|
||||
```bash
|
||||
ss -tlnp | grep 8001
|
||||
docker ps -a # alter Container noch vorhanden?
|
||||
./stop-servers.sh
|
||||
./start-single.sh
|
||||
./stop-coding-server.sh
|
||||
./start-coding-server.sh
|
||||
```
|
||||
|
||||
### "Agent is already processing a prompt"
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue