GLM-OCR

Z.ai (Zhipu AI)

Nur im Katalog Offene Gewichte

Souveränität und Hosting

Nur im Katalog

Dieses Modell ist als Referenz katalogisiert. Es wird noch nicht bei LLM EU gehostet, und kein Endpunkt aus erster Hand bedient es hier. Anfragen dazu gehen direkt an den Anbieter, zu dessen eigenen Bedingungen.

Zusammenfassung

GLM-OCR ist ein kleines multimodales Modell zur Textextraktion aus Dokumenten, aufgebaut aus einem CogViT-Vision-Encoder und einem GLM-0.5B-Sprachdecoder. Der Anbieter nennt rund 0,9B Parameter, während die veröffentlichten Safetensors 1,33B umfassen; die Konfiguration erlaubt 131.072 Textpositionen. Es steht unter MIT und läuft für Massenextraktion unter vLLM, SGLang oder Ollama.

Technische Daten

Anbieter
Z.ai (Zhipu AI) (CN)
Kontextfenster
131k
Modellparameter
1.33B
Modalitäten
vision
Lizenz
mit · licence
Offene Gewichte
yes
Veröffentlichungsdatum
30. Jan. 2026
Aufgaben
vision, rag, legal-draft, cheap, summarization

Sprachen

Stark: zh, en

Ausreichend: de, fr, es, ru, ja, ko

Sprachen

Stark

  • zh
  • en

Ausreichend

  • de
  • fr
  • es
  • ru
  • ja
  • ko

Nicht verifiziert: Der Anbieter hat diese Angabe nicht belegt. — a language is listed as strong only where a source claims it; the card links the evidence where one exists.

Wann einsetzen

Stärken

  • purpose-built document OCR rather than general vision
  • runs on modest hardware and through common inference servers
  • MIT licence

Grenzen

  • text extraction only; it is not a general chat or reasoning model
  • vendor parameter count (0.9B) differs from the published safetensors total (1.33B)
  • no OCR benchmark has been run by LLM EU