refactor: Single-GPU-Betrieb + System-Prompt-Rollen + /optimize-Bugfixes
Single-GPU-Umstellung: - models.json auf ein Modell qwen3.5-single kollabiert; tote Provider (llama-cpp, llama-cpp-coder, llama-cpp-judge) entfernt - Coder/Judge-Rolle via before_agent_start-Hook (Persona als System-Prompt) statt Modellwechsel; switchModel -> ensureSingleModel + selectRole - Dual-GPU-Skripte entfernt (start-coder/judge/servers.sh); stop/status auf Single-Container reduziert /optimize-Bugfixes: - Crash behoben: ctx.ui.select positional aufrufen (verursachte "Cannot read properties of undefined (reading 'length')" bei SHIP/version) - PASS WITH CONCERNS loest jetzt eine Coder-Fix-Runde aus; nur sauberes PASS gilt als bestanden (--approve-concerns bleibt Opt-out) - Quick-Judge abgeschafft: immer voller Judge ab Runde 1 - Loop-Erkennung greift auch ohne Blocker-Abschnitt Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
parent
3cf9ef928b
commit
ca85c45a39
5 changed files with 129 additions and 273 deletions
|
|
@ -30,5 +30,4 @@ check_server() {
|
|||
}
|
||||
|
||||
echo "=== LLaMA-Server Status ==="
|
||||
check_server "qwen36-27b-coder" 8001 "qwen3.5-coder"
|
||||
check_server "qwen36-27b-judge" 8002 "qwen3.5-judge"
|
||||
check_server "qwen36-27b-single" 8001 "qwen3.5-single"
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue