cbazza
|
de9c529333
|
chore: env-Dateien pro Tool, README aktualisiert, list/delete dokumentiert
- .gitignore: env-Dateien explizit ausgeschlossen
- ingest.py: load_dotenv auf .env.ingest umgestellt
- ingest_anythingllm.py: load_dotenv auf .env.anythingllm umgestellt
- README: Dateistruktur, list/delete Befehle dokumentiert
|
2026-04-29 10:32:36 +02:00 |
|
cbazza
|
af5cba7001
|
docs: list und delete Befehle mit Beispielausgabe dokumentiert
|
2026-04-29 10:30:09 +02:00 |
|
cbazza
|
4dcdf8880d
|
README.md aktualisiert
escape Zeichen entfernt, damit die Darstellung richtig ist
|
2026-04-29 10:24:59 +02:00 |
|
cbazza
|
978a1c0108
|
Architekturbild hinzugefügt
|
2026-04-29 10:19:58 +02:00 |
|
cbazza
|
2c58ac73cb
|
docs: README aktualisiert – ingest_V2, extractor, normalizer dokumentiert
|
2026-04-29 10:19:18 +02:00 |
|
cbazza
|
495831fb69
|
feat: extractor, normalizer, ingest v2 – OCR pipeline funktioniert
|
2026-04-29 10:13:15 +02:00 |
|
cbazza
|
4fea148d61
|
feat: v2 pipeline mit OCR + KI-Normalisierung
- extractor.py: Text-Extraktion für MD/TXT/PDF/DOCX/Bilder inkl. OCR (Tesseract)
- normalizer.py: KI-Normalisierung via Claude Haiku (Typ-Erkennung) + Sonnet (Transformation)
- ingest.py: Vollpipeline v2 mit watch, delete, dry-run, quality-min Flags
- ingest_anythingllm.py: Einfaches Script v1 (nur MD/TXT/PDF, kein OCR)
- README.md: Alle drei Tools dokumentiert
|
2026-04-28 11:21:53 +02:00 |
|
cbazza
|
e7bb3b60b4
|
first commit
|
2026-02-27 10:59:36 +01:00 |
|