first commit
This commit is contained in:
parent
01ca5d7a00
commit
670c6082a6
5 changed files with 886 additions and 2 deletions
|
|
@ -176,6 +176,8 @@ python3 assistant.py [OPTIONEN]
|
|||
|---|---|---|
|
||||
| `--backend NAME` | `llama` | Backend: `llama` \| `ollama` \| `openai` |
|
||||
| `--model NAME` | auto | Modellname (bei llama.cpp: automatisch vom Server) |
|
||||
| `--api-url URL` | — | Überschreibt die Backend-URL (beliebiger OpenAI-kompatibler Endpunkt) |
|
||||
| `--api-key KEY` | — | API-Key (überschreibt `OPENAI_API_KEY` / Backend-Default) |
|
||||
| `--system TEXT` | (eingebaut) | System-Prompt für den Assistenten |
|
||||
| `--history N` | `10` | Maximale Anzahl gespeicherter Gesprächsrunden |
|
||||
|
||||
|
|
@ -265,6 +267,10 @@ Vollständige Sink-Namen aus `pactl list sinks short` können direkt verwendet w
|
|||
|
||||
## 9. LLM-Backend konfigurieren
|
||||
|
||||
Der Assistent spricht mit jedem LLM, das die **OpenAI Chat-Completions API**
|
||||
implementiert. Mit `--api-url` und `--api-key` kann der Endpunkt frei
|
||||
überschrieben werden — das `--backend`-Flag wählt nur den Verbindungs-Default.
|
||||
|
||||
### llama.cpp (Standard)
|
||||
|
||||
```bash
|
||||
|
|
@ -273,8 +279,13 @@ python3 assistant.py --backend llama
|
|||
```
|
||||
|
||||
Der Modellname wird automatisch vom Server abgefragt.
|
||||
Anderen Port oder Host angeben:
|
||||
|
||||
### Ollama
|
||||
```bash
|
||||
python3 assistant.py --backend llama --api-url http://192.168.1.10:8001/v1
|
||||
```
|
||||
|
||||
### Ollama (lokal)
|
||||
|
||||
```bash
|
||||
# Ollama muss laufen: ollama serve
|
||||
|
|
@ -282,6 +293,14 @@ python3 assistant.py --backend ollama --model llama3.2
|
|||
python3 assistant.py --backend ollama --model mistral
|
||||
```
|
||||
|
||||
### Ollama (remote / anderer Rechner)
|
||||
|
||||
```bash
|
||||
python3 assistant.py --backend ollama \
|
||||
--api-url http://mein-server:11434/v1 \
|
||||
--model llama3.2
|
||||
```
|
||||
|
||||
### OpenAI
|
||||
|
||||
```bash
|
||||
|
|
@ -290,6 +309,66 @@ python3 assistant.py --backend openai --model gpt-4o-mini
|
|||
python3 assistant.py --backend openai --model gpt-4o
|
||||
```
|
||||
|
||||
### OpenRouter (viele Modelle über eine API)
|
||||
|
||||
[OpenRouter](https://openrouter.ai) bietet Zugang zu hunderten Modellen
|
||||
(Mistral, Llama, Gemma, Claude, GPT-4 u. v. m.) über eine einheitliche API.
|
||||
|
||||
```bash
|
||||
export OPENROUTER_API_KEY=sk-or-...
|
||||
python3 assistant.py \
|
||||
--backend openai \
|
||||
--api-url https://openrouter.ai/api/v1 \
|
||||
--model mistralai/mistral-7b-instruct
|
||||
```
|
||||
|
||||
Andere beliebte OpenRouter-Modelle:
|
||||
- `meta-llama/llama-3.1-8b-instruct:free` (kostenlos)
|
||||
- `google/gemma-3-27b-it`
|
||||
- `anthropic/claude-3.5-haiku`
|
||||
|
||||
Den API-Key unter `https://openrouter.ai/keys` erstellen.
|
||||
|
||||
### Groq (sehr schnelle Inferenz)
|
||||
|
||||
```bash
|
||||
export GROQ_API_KEY=gsk_...
|
||||
python3 assistant.py \
|
||||
--backend openai \
|
||||
--api-url https://api.groq.com/openai/v1 \
|
||||
--model llama-3.1-70b-versatile
|
||||
```
|
||||
|
||||
### LM Studio
|
||||
|
||||
```bash
|
||||
# LM Studio muss mit aktiviertem lokalen Server laufen (Port 1234)
|
||||
python3 assistant.py --backend llama --api-url http://localhost:1234/v1
|
||||
```
|
||||
|
||||
### Together AI
|
||||
|
||||
```bash
|
||||
export TOGETHER_API_KEY=...
|
||||
python3 assistant.py \
|
||||
--backend openai \
|
||||
--api-url https://api.together.xyz/v1 \
|
||||
--model meta-llama/Llama-3-8b-chat-hf
|
||||
```
|
||||
|
||||
### Allgemeines Prinzip
|
||||
|
||||
Jeder Provider, der `/v1/chat/completions` mit `stream=true` unterstützt,
|
||||
funktioniert mit:
|
||||
|
||||
```bash
|
||||
python3 assistant.py \
|
||||
--backend openai \
|
||||
--api-url https://<provider>/v1 \
|
||||
--model <modellname> \
|
||||
--api-key <api-key>
|
||||
```
|
||||
|
||||
---
|
||||
|
||||
## 10. Sprache und Stimme
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue