first commit

This commit is contained in:
Dieter Schlüter 2026-06-16 02:21:26 +02:00
commit 670c6082a6
5 changed files with 886 additions and 2 deletions

View file

@ -176,6 +176,8 @@ python3 assistant.py [OPTIONEN]
|---|---|---|
| `--backend NAME` | `llama` | Backend: `llama` \| `ollama` \| `openai` |
| `--model NAME` | auto | Modellname (bei llama.cpp: automatisch vom Server) |
| `--api-url URL` | — | Überschreibt die Backend-URL (beliebiger OpenAI-kompatibler Endpunkt) |
| `--api-key KEY` | — | API-Key (überschreibt `OPENAI_API_KEY` / Backend-Default) |
| `--system TEXT` | (eingebaut) | System-Prompt für den Assistenten |
| `--history N` | `10` | Maximale Anzahl gespeicherter Gesprächsrunden |
@ -265,6 +267,10 @@ Vollständige Sink-Namen aus `pactl list sinks short` können direkt verwendet w
## 9. LLM-Backend konfigurieren
Der Assistent spricht mit jedem LLM, das die **OpenAI Chat-Completions API**
implementiert. Mit `--api-url` und `--api-key` kann der Endpunkt frei
überschrieben werden — das `--backend`-Flag wählt nur den Verbindungs-Default.
### llama.cpp (Standard)
```bash
@ -273,8 +279,13 @@ python3 assistant.py --backend llama
```
Der Modellname wird automatisch vom Server abgefragt.
Anderen Port oder Host angeben:
### Ollama
```bash
python3 assistant.py --backend llama --api-url http://192.168.1.10:8001/v1
```
### Ollama (lokal)
```bash
# Ollama muss laufen: ollama serve
@ -282,6 +293,14 @@ python3 assistant.py --backend ollama --model llama3.2
python3 assistant.py --backend ollama --model mistral
```
### Ollama (remote / anderer Rechner)
```bash
python3 assistant.py --backend ollama \
--api-url http://mein-server:11434/v1 \
--model llama3.2
```
### OpenAI
```bash
@ -290,6 +309,66 @@ python3 assistant.py --backend openai --model gpt-4o-mini
python3 assistant.py --backend openai --model gpt-4o
```
### OpenRouter (viele Modelle über eine API)
[OpenRouter](https://openrouter.ai) bietet Zugang zu hunderten Modellen
(Mistral, Llama, Gemma, Claude, GPT-4 u. v. m.) über eine einheitliche API.
```bash
export OPENROUTER_API_KEY=sk-or-...
python3 assistant.py \
--backend openai \
--api-url https://openrouter.ai/api/v1 \
--model mistralai/mistral-7b-instruct
```
Andere beliebte OpenRouter-Modelle:
- `meta-llama/llama-3.1-8b-instruct:free` (kostenlos)
- `google/gemma-3-27b-it`
- `anthropic/claude-3.5-haiku`
Den API-Key unter `https://openrouter.ai/keys` erstellen.
### Groq (sehr schnelle Inferenz)
```bash
export GROQ_API_KEY=gsk_...
python3 assistant.py \
--backend openai \
--api-url https://api.groq.com/openai/v1 \
--model llama-3.1-70b-versatile
```
### LM Studio
```bash
# LM Studio muss mit aktiviertem lokalen Server laufen (Port 1234)
python3 assistant.py --backend llama --api-url http://localhost:1234/v1
```
### Together AI
```bash
export TOGETHER_API_KEY=...
python3 assistant.py \
--backend openai \
--api-url https://api.together.xyz/v1 \
--model meta-llama/Llama-3-8b-chat-hf
```
### Allgemeines Prinzip
Jeder Provider, der `/v1/chat/completions` mit `stream=true` unterstützt,
funktioniert mit:
```bash
python3 assistant.py \
--backend openai \
--api-url https://<provider>/v1 \
--model <modellname> \
--api-key <api-key>
```
---
## 10. Sprache und Stimme