feat: schwerwiegende KI-Funde dürfen ROT auslösen (konfigurierbar)
Bisher war das KI-Level hart auf Gelb gedeckelt — auch injizierte
Pornografie oder strafbare/diffamierende Inhalte lösten nie Rot aus.
Das unterschätzt echte Notfälle (Sicherheits- + Rechts-/Reputationsrisiko).
Neu: kategoriebasierter Grave-Override in score_ai_findings. Nur Kategorien
aus red_categories (default ["pornography","defamation_illegal"]) lösen Rot
aus, und nur bei Schwere ≥ red_min_severity (high) UND Konfidenz ≥
red_min_confidence (0.9). Alle anderen Kategorien (Spam, Off-Topic,
Propaganda, Widerspruch) bleiben höchstens Gelb. Die Punktsumme allein
ergibt weiterhin nie Rot. red_categories: [] stellt das alte Verhalten her.
Begründung für die konservative Schwelle: LLM-Konfidenzen sind nicht
perfekt kalibriert — nur die gravierendsten Fälle dürfen die volle
ROT-Dringlichkeit ("Dienstleister informieren, nichts freigeben") tragen.
Rot fließt über die bestehende _worst_level-Verdrahtung automatisch ins
Gesamt-Level + Exit-Code 2; gilt auch für Bildfunde (OCR).
Tests: 237 grün (+7 Rot-Gate, bestehender Cap-Test auf Punktsumme-Logik
umgestellt). Config + Template + README + Bedienungsanleitung aktualisiert.
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
parent
d06e3d3dfd
commit
a8dcaabf7c
6 changed files with 98 additions and 15 deletions
|
|
@ -644,8 +644,8 @@ angewendet — falsch-positive Alarme durch dynamische CMS-Inhalte werden so unt
|
|||
| Kaputte **externe** Links (4xx/5xx) | Ja, mit `check-ext-links` | Kein Score, nur Report |
|
||||
| UA-basiertes Cloaking (Googlebot sieht anderen Inhalt) | Ja, mit `cloak-check` | Score 40–60 |
|
||||
| Veränderungen in JS/CSS/Bildern (Inhalt) | Ja, mit `check-assets` | Score 20–40 |
|
||||
| Problematischer Text (Pornografie, Propaganda, Spam, Off-Topic) | Ja, mit KI-Analyse | Score 20–50, auf Gelb gedeckelt |
|
||||
| Problematische Bildinhalte + Text im Bild (OCR) | Ja, mit KI-Analyse | Score ≥ 40, auf Gelb gedeckelt |
|
||||
| Problematischer Text (Pornografie, Propaganda, Spam, Off-Topic) | Ja, mit KI-Analyse | Gelb; Pornografie/strafbar bei hoher Schwere+Konfidenz → Rot |
|
||||
| Problematische Bildinhalte + Text im Bild (OCR) | Ja, mit KI-Analyse | Gelb; Pornografie/strafbar bei hoher Schwere+Konfidenz → Rot |
|
||||
| IP-basiertes Cloaking | Nein | Nur Google Search Console kann das erkennen |
|
||||
| Serverseitige Code-Änderungen | Nein | Nur sichtbare HTML-Ausgabe |
|
||||
|
||||
|
|
@ -871,10 +871,25 @@ Dadurch kann die Analyse bei **jedem** Scan mitlaufen und kostet an den meisten
|
|||
|
||||
### Wirkung auf die Ampel
|
||||
|
||||
KI-Funde sind **auf Gelb gedeckelt** — sie lösen niemals allein ROT aus. ROT bleibt den
|
||||
harten Integritäts-Signalen (Webshell, versteckte Inhalte) vorbehalten. Nur Funde mit
|
||||
ausreichender Sicherheit (Konfidenz ≥ `ai_confidence_min`, Standard 0,7) und mindestens
|
||||
mittlerer Schwere werden gewertet — das hält Fehlalarme niedrig.
|
||||
KI-Funde sind grundsätzlich **auf Gelb gedeckelt** — mit einer bewussten Ausnahme: die
|
||||
**schwerwiegendsten Kategorien** (Pornografie, strafbar/diffamierend) lösen bei **hoher
|
||||
Schwere + hoher Konfidenz** ROT aus. Alle anderen Kategorien (Spam, themenfremde Werbung,
|
||||
Propaganda, Widerspruch) bleiben höchstens Gelb. Nur Funde mit ausreichender Sicherheit
|
||||
(Konfidenz ≥ `ai_confidence_min`, Standard 0,7) und mindestens mittlerer Schwere werden
|
||||
überhaupt gewertet — das hält Fehlalarme niedrig.
|
||||
|
||||
Die ROT-Eskalation ist konfigurierbar:
|
||||
|
||||
```yaml
|
||||
ai_analysis:
|
||||
red_categories: ["pornography", "defamation_illegal"] # nur diese dürfen Rot auslösen
|
||||
red_min_severity: "high" # mindestens diese Schwere
|
||||
red_min_confidence: 0.9 # mindestens diese Konfidenz
|
||||
```
|
||||
|
||||
Mit `red_categories: []` bleibt die KI wie früher immer höchstens Gelb. Hintergrund: KI-
|
||||
Konfidenzen sind nicht perfekt kalibriert, daher dürfen nur die gravierendsten Fälle die
|
||||
volle ROT-Dringlichkeit („Dienstleister informieren, nichts freigeben") auslösen.
|
||||
|
||||
Fehlt der API-Key oder schlägt eine Abfrage fehl, wird die Analyse **übersprungen** und der
|
||||
Scan läuft unverändert weiter. Die KI kann den normalen Betrieb nie blockieren.
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue