Retrieval-Augmented Generation über eine Vektordatenbank: Die Bestände werden in Abschnitte zerlegt, wobei das Chunking auf die Dokumentenstruktur abgestimmt wird — Randnummern, Absätze und Aktenzeichen bleiben zusammen, statt mitten im Satz zu enden.
Abgerufen wird über eine Hybridsuche aus semantischer und Volltextsuche, damit Aktenzeichen und Paragraphen exakt getroffen werden und nicht nur thematisch ähnliche Stellen. Ein anschließendes Re-Ranking sortiert die Treffer, und jede Antwort führt die Belegstelle mit.
Angebunden werden DATEV-Ablagen, Dokumentenmanagementsysteme und Dateifreigaben; für eingescannte Bestände läuft eine Texterkennung (OCR) vorweg. Die Berechtigungen werden aus dem bestehenden System übernommen und bei jeder einzelnen Anfrage geprüft.