From 33c94e5c209b08ea61305733d776587009764292 Mon Sep 17 00:00:00 2001 From: =?UTF-8?q?Dieter=20Schl=C3=BCter?= Date: Sun, 14 Jun 2026 20:13:56 +0200 Subject: [PATCH] =?UTF-8?q?docs:=20TASK.md=20=E2=80=94=20Review=20#4=20(un?= =?UTF-8?q?ver=C3=A4ndert,=20266=20Tests=20OK,=20M1+M2=20offen)?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- TASK.md | 18 ++++++++++++++++++ 1 file changed, 18 insertions(+) diff --git a/TASK.md b/TASK.md index cf0e18a..43a3af0 100644 --- a/TASK.md +++ b/TASK.md @@ -65,3 +65,21 @@ M1 + M2 fixen → dann **PASS**. - Score-Logik an Thresholds: korrekt ✅ - Whitelist Subdomain-Handling: korrekt ✅ - Logging (keine Secrets): korrekt ✅ + +## Review #4 (frisch) + +**Urteil:** PASS WITH CONCERNS (unverändert) + +### Status +- Tests: 266/266 grün ✅ +- Module: 11/11 importierbar ✅ +- Pipeline: bredelar.info 🟢 Score 0, 46 Seiten ✅ +- M1 + M2: **unverändert** (jamulix.de Config-Bug + crawler.py Code-Bug) + +### Neue Checks (alle OK) +- _worst_level Logik: korrekt ✅ +- _crawl_and_extract bei 0 Seiten: korrekt ✅ +- extract_page bei langem HTML (1MB): korrekt ✅ +- extract_page bei vielen Links (1000): korrekt ✅ +- compare_snapshots Performance (1000 Seiten): 0.005s ✅ +- compare_snapshots vergleicht text, nicht text_hash: korrekt ✅