Spezialdienste für Sprache, Bilder und Vision
← Vorheriges Kapitel · Inhaltsverzeichnis · Nächstes Kapitel →
Kapitel 116 von 158
| Aufgabe / Beispiel | Anbindung und möglicher Einsatz |
|---|---|
| Übersetzen: DeepL | API für Übersetzungen; offizieller MCP-Server verfügbar. Beispiel: freigegebenes Produktwissen mit passender Fachterminologie übersetzen. |
| OCR: Google Cloud Vision | OCR erkennt Text in Bildern. Beispiel: Text aus einem fotografierten Etikett auslesen und zur Prüfung anzeigen. |
| Vision: OpenAI | Bildinhalte mit Textfragen analysieren. Beispiel: auf einem Foto sichtbare Merkmale beschreiben. Keine sichere Diagnose oder garantierte Artikelidentifikation. |
| Bilder erzeugen: OpenAI Images | Bilder per API erzeugen oder bearbeiten. Beispiel: eine Illustration für eine Schulung vorbereiten. |
| Medien gestalten: Magnific | Plattform für Bild-, Video- und Audioaufgaben, einschließlich Upscaling; API und MCP verfügbar. Beispiel: freigegebene Kampagnenbilder aufbereiten und Varianten erstellen. |
Drei Begriffe, drei Aufgaben
OCR liest Schrift. Vision interpretiert Bildinhalte. Generierung erstellt neue Inhalte. Für eine Artikelnummer auf einem Foto kann OCR genügen; für eine verständliche Bildbeschreibung ist Vision passender. Ein neu generiertes Produktbild muss besonders sorgfältig mit dem echten Produkt verglichen werden.
Ein zusätzlicher Spezialdienst lohnt sich, wenn Qualität, Fachfunktionen oder die Einbindung einen nachgewiesenen Vorteil bringen. Für gelegentliche Übersetzungen oder Bildfragen zuerst die vorhandene freigegebene Umgebung testen.
DeepL API | DeepL MCP | Cloud Vision | OpenAI Vision | OpenAI Images | Magnific [QR21]
Quellen und Links
- developers.deepl.com – quickstart
- developers.deepl.com – deepl-mcp-server
- docs.cloud.google.com – docs
- developers.openai.com – images-vision
- developers.openai.com – image-generation
- www.magnific.com
← Vorheriges Kapitel · Inhaltsverzeichnis · Nächstes Kapitel →