Bildverstehen
Bilder, Scans, Formulare und Screenshots zusammen mit Text auswerten.
Der Router ordnet eine Aufgabe den möglichen Modellen zu und wendet dann Ihre Richtlinie an: zuerst Region, dann Preis, dann das Modell mit dem besser dokumentierten Ergebnis.
Nur Modelle, deren Karte die Modalität Vision führt, sind zulässig; ein reines Textmodell wird abgelehnt, nicht stillschweigend genutzt, und reine Textextraktion geht an das OCR-Modell.
{"model":"llmeu-auto","messages":[{"role":"user","content":"…"}],"llmeu":{"task":"vision"}}
Empfohlen
Noch kein eigener Endpunkt
Kein eigener Endpunkt bedient diese Aufgabe bisher. Die unten aufgeführten Modelle sind als Referenz katalogisiert und laufen zu den Bedingungen ihres Anbieters.