Toolkatalog: Vision, OCR und Dokumentenerkennung
← Vorheriges Kapitel · Inhaltsverzeichnis · Nächstes Kapitel →
Kapitel 136 von 158
8 ausgewählte Einträge · Name anklicken für die offizielle Quelle. Keine Rangliste und keine betriebliche Freigabeliste.
| Tool / Anbieter | Details |
|---|---|
| OpenAI Vision | Typischer Zweck: Bildinhalte mit Sprachmodellen auswerten. Zugang / Einordnung: API / ChatGPT |
| Google Cloud Vision | Typischer Zweck: Bilderkennung und OCR. Zugang / Einordnung: API |
| Amazon Rekognition | Typischer Zweck: Bilder und Videos analysieren. Zugang / Einordnung: API |
| Amazon Textract | Typischer Zweck: Text und Strukturen aus Dokumenten erfassen. Zugang / Einordnung: API |
| Azure Vision | Typischer Zweck: Visuelle Analyse im Microsoft-Umfeld. Zugang / Einordnung: API |
| ABBYY | Typischer Zweck: Dokumentenerfassung und intelligente Verarbeitung. Zugang / Einordnung: Anbieterprodukte |
| Roboflow | Typischer Zweck: Eigene Computer-Vision-Anwendungen entwickeln. Zugang / Einordnung: Plattform |
| Tesseract | Typischer Zweck: Offene OCR-Engine zur Texterkennung. Zugang / Einordnung: Lokal / Bibliothek |
„Web“ nennt einen möglichen Einstieg und bedeutet nicht, dass keine API existiert. Nur ausdrücklich genannte Schnittstellen sind hier als solche eingeordnet. Funktionen, Tarife, Regionen, Nutzungsrechte und Datenverarbeitung vor dem Einsatz prüfen.
Quellen und Links
- developers.openai.com – images-vision
- cloud.google.com – vision
- aws.amazon.com
- aws.amazon.com
- azure.microsoft.com – vision
- www.abbyy.com
- roboflow.com
- github.com – tesseract
← Vorheriges Kapitel · Inhaltsverzeichnis · Nächstes Kapitel →