Bildverstehen

Bilder, Scans, Formulare und Screenshots zusammen mit Text auswerten.

Der Router ordnet eine Aufgabe den möglichen Modellen zu und wendet dann Ihre Richtlinie an: zuerst Region, dann Preis, dann das Modell mit dem besser dokumentierten Ergebnis.

Nur Modelle, deren Karte die Modalität Vision führt, sind zulässig; ein reines Textmodell wird abgelehnt, nicht stillschweigend genutzt, und reine Textextraktion geht an das OCR-Modell.

{"model":"llmeu-auto","messages":[{"role":"user","content":"…"}],"llmeu":{"task":"vision"}}

Empfohlen

Noch kein eigener Endpunkt
Kein eigener Endpunkt bedient diese Aufgabe bisher. Die unten aufgeführten Modelle sind als Referenz katalogisiert und laufen zu den Bedingungen ihres Anbieters.

Der europäische Modell-Katalog