open_taki
KI-gestützte Dokumentenanalyse als Drop-in-Ersatz für Apache Tika: OCR, Zusammenfassung, Klassifikation und Transkription auf eigener Infrastruktur.

open_taki ist die Dokumentenanalyse-Engine des OpenCore-Stacks (OpenCloud + OpenCosmos) und ersetzt Apache Tika als Dokumentenanalyse-Schicht. Statt eines 1-GB-Java-Monolithen mit CPU-basiertem OCR ist es eine kompakte Go-Anwendung, die Sprachmodelle für das Verständnis von Dokumenten einsetzt. F17 baut auf open_taki auf — die Referenzrichtung ist F17 → open_taki, nicht umgekehrt. open_taki ist eigenständig einsetzbar; F17 ist eine Anwendung auf dieser Basis. open_taki extrahiert aus Dokumenten (PDF, Office, Bilder, Audio) Text, Entitäten (Namen, Daten, Beträge), Zusammenfassungen und Dokumenttypen. Es beschreibt Bildinhalte, transkribiert Audio (Whisper) und liefert die Metadaten, die die Volltext- und Semantiksuche der KOSMOS Edition mit füllt. Die Sprachmodelle laufen auf eigener Hardware (GPU-Server) und werden über microllm angesteuert — keine Daten verlassen die eigene Infrastruktur.
Software-Details
25.08.26
05.09.26
beta
0.9.1
AGPL-3.0-or-later
Jetzt Nutzung sichtbar machen!
Letzte Aktualisierung: