Eine robuste Medien+OCR-Pipeline bauen, obwohl Datenqualität und DB-Formate je nach Quelle stark variieren.
Aufgaben
- Worker-basierte OCR-Stufe mit Python-Tools einführen.
- Koordinatenvalidierung und Abstandsrouten mit konfigurierbaren Präzisionen umsetzen.
- Medien und OCR-Artefakte in stabiler Object-Storage-Struktur speichern.
- Langläufer-Jobs mit Queue/Retry und Observability absichern.