# Werkzeugkasten — Foto, OCR, Vision
Eine kompakte Übersicht aller Tools, die wir am 24./25. Juni 2026 evaluiert haben — strukturiert nach was es macht / wo es läuft / Kosten / wer sieht die Daten.
1. Foto-Archiv mit Auto-Tagging
| Tool | Was es macht | Wo es läuft | Kosten | Daten bleiben | Status | |—|—|—|—|—|—| | Immich | Foto-Manager + KI-Tags + Gesichter + Mobile App | Blackcover (Docker) | 0 € | Lokal | Sehr aktiv | | PhotoPrism | Foto-Manager + KI-Tags + Karten + Metadaten | Blackcover (Docker) | 0 € (Premium 5 €/Mon optional) | Lokal | Aktiv | | digiKam | Desktop-Foto-Manager + Tags + Gesichter + Profi-Edits | Blackcover Desktop | 0 € | Lokal | Sehr aktiv | | A-Eye | Auto-Beschreibung + Auto-Tag + Rename via lokaler Vision-LLM | Blackcover + Ollama | 0 € | Lokal | Aktiv |
2. OCR / Text-aus-Bild
| Tool | Was es macht | Wo es läuft | Kosten | Daten bleiben | Stärke | |—|—|—|—|—|—| | PaddleOCR | OCR + Tabellen-Struktur (PP-Structure) | Blackcover (Python) | 0 € | Lokal | Tabellen / Rechnungen | | Tesseract | Klassischer OCR, gedruckter Text | Blackcover (lokal) | 0 € | Lokal | Schnell, einfach | | Surya 2 | OCR + Layout-Analyse, modern | Blackcover (Python) | 0 € | Lokal | Formulare / Layout | | TrOCR | Handschrift via Transformer | Blackcover (Python/HF) | 0 € | Lokal | Handschrift | | Transkribus | Handschrift, hochpräzise (HTR) | Cloud + Desktop | Freemium, dann € | Cloud | Historische Handschrift | | OCR.space | OCR via API | Cloud | Gratis 25k Req/Mon (≤1 MB) | Cloud | Schnell, einfache API | | Mindee / Docsumo | Rechnungs-Felder strukturiert | Cloud | Freemium, dann € | Cloud | Buchhaltung |
3. Bildbetrachter / Manager (Bridge-Ersatz, Altlast wegsortieren OHNE KI)
| Tool | Was es macht | Wo es läuft | Kosten | Bridge-ähnlich? | |—|—|—|—|—| | digiKam | Tags, Sterne, Stapel, EXIF, Gesichter, Karten | Blackcover Desktop | 0 € | Ja, mehr Profi | | XnView MP | Schneller Browser, Stapel-Rename, Convert | Blackcover/Win/Mac | 0 € (privat) | Ja, sehr Bridge-Feeling | | Geeqie | Sehr schneller Linux-Bildbetrachter mit Stapel-Ops | Blackcover | 0 € | Schlanker | | Shotwell | GNOME-Default, einfach, gut für Hand-Sort | Blackcover | 0 € | Nein, simpler | | Adobe Bridge CS6 | DVD-Erbe — auf Linux nur via Wine, fragil | Blackcover via Wine | Lizenz bezahlt | Original |
4. Lokale Vision-LLMs (für Nacht-Batch auf BC/SC)
| Modell via Ollama | Größe | RAM-Bedarf | Was es kann | Geschwindigkeit | |—|—|—|—|—| | llava:7b | 4 GB | 8 GB+ | Bildbeschreibung allgemein | Mittel | | llava:13b | 8 GB | 16 GB+ | Bessere Beschreibung + OCR-Hilfe | Langsamer | | qwen2-vl:7b | 5 GB | 10 GB+ | Top für Text-in-Bild, multilingual | Mittel | | minicpm-v | 5 GB | 10 GB+ | Klein + schnell, überraschend stark | Schnell | | moondream:1.8b | 1.7 GB | 4 GB+ | Mini, für Massen-Batch über Nacht | Sehr schnell |
Blackcover (24 GB RAM) → llava:13b oder qwen2-vl:7b als Sweetspot, moondream für die Millionen-Altlast über Nacht.
Strategischer Befund
– Aktuelle Bilder: im laufenden Workflow analysieren (Norman + Mensch-Feedback). – Altlast (100.000-Millionen Bilder): lokal mit normaler Sortier-Logik (digiKam / XnView / Geeqie) + nachts Ollama-Vision drüber (moondream / minicpm-v wegen Speed). – Handschrift-Notizen: bestehender Workflow Papierheft + Formatvorgaben + Mensch-Feedback ausbauen. – Rechnungen: PaddleOCR lokal (PP-Structure) → Ollama-Llama3 klassifiziert. Optional Mindee/Docsumo wenn Buchhaltung professionell wird. – Bridge-Lizenz: XnView MP ist der pragmatische Nachfolger.
Entstanden im Test-Strang vom 24./25. Juni 2026 mit Nexus (Gemini Web NK), siehe begleitender Bericht „I/O-Bühne, Plus-Wirklichkeit“ (Teil 1) und der WP-Beitrag „Foto-Archiv und OCR auf eigener Hardware“.