Wann sollte ich das ändern?
- Beim erstmaligen Einrichten – um konsistente Standards für alle Spaces zu setzen
- Wenn die Qualität der Dokumentenextraktion nicht zufriedenstellend ist
- Wenn neue Parser-Versionen verfügbar sind und getestet werden sollen
- Wenn bestimmte Dokumenttypen (z.B. gescannte PDFs) besser verarbeitet werden sollen
Bereiche
Die Parser-Konfiguration ist in zwei Abschnitte unterteilt: Dokumentenverarbeitung — Parser für Dateien, die in den Bereich Daten → Dokumente hochgeladen werden. Diese werden durch die Parsing Engine verarbeitet, in Chunks zerlegt und für die Hybrid Search indexiert. Chat-Dokumentenverarbeitung — Parser für Dateien, die direkt als Anhang in einem Chat hochgeladen werden. Diese werden für den aktuellen Chat-Kontext verarbeitet.Parser pro Dateityp
Word-Dokument
PowerPoint
Excel
Bild
Markdown
Text
CSV
Vererbung
Die hier gewählten Parser bilden den Org-Standard. Space-Admins können in ihren Space-Einstellungen pro Dateityp einen anderen Parser wählen. Das ist sinnvoll, wenn ein Space hauptsächlich mit einem bestimmten Dokumenttyp arbeitet (z.B. ein Space für gescannte Verträge, der durchgängigmistral_ocr benötigt).
Auswirkungen
- Änderungen am Org-Parser wirken sich auf neue Dokumente in allen Spaces aus, die keinen eigenen Parser-Override haben.
- Bereits verarbeitete Dokumente werden nicht automatisch neu geparst – dafür muss das Dokument erneut hochgeladen werden.
Detaillierte Beschreibungen der einzelnen Parser und ihrer Eignung finden Sie auch in den Space-Einstellungen → Parser.
