aTrain
Offline und DSGVO-konforme Transkription von Sprachaufnahmen mit lokalen Whisper-Machine-Learning-Modellen.





aTrain transkribiert Sprachaufnahmen automatisch mit modernen Machine-Learning-Modellen, ohne dass Daten hochgeladen werden. Entwickelt wurde die Software von Forschenden am Center for Data Science in Business and Society der Universität Graz und getestet von Forschenden am Know-Center Graz.
Die gesamte Verarbeitung läuft vollständig offline auf dem eigenen Gerät. Weder Aufnahmen noch Transkriptionen werden ins Internet übertragen. Das hilft Forschenden, Datenschutzanforderungen aus ethischen Richtlinien zu erfüllen und rechtliche Vorgaben wie die DSGVO einzuhalten.
aTrain bietet eine benutzerfreundliche Oberfläche für die faster-whisper-Implementierung des Whisper-Modells von OpenAI und liefert hohe Transkriptionsqualität in 99 Sprachen. Ein optionaler Sprechererkennungsmodus auf Basis von pyannote.audio ordnet jedem Textabschnitt eine sprechende Person zu. Die Transkripte lassen sich direkt in die gängigen Werkzeuge zur qualitativen Analyse importieren, ATLAS.ti, MAXQDA und NVivo. Per Klick auf einen Zeitstempel wird das zugehörige Audio abgespielt.
aTrain läuft auf der CPU oder, für eine deutliche Beschleunigung, auf einer CUDA-fähigen NVIDIA-GPU. Die Software wird über Flathub für Linux und den Microsoft Store für Windows bereitgestellt und ist zusätzlich als Kommandozeilen-Werkzeug für automatisierte Transkriptions-Pipelines installierbar.
Software-Details
06.10.26
06.10.26
stable
- windows
- linux
1.5.0
AGPL-3.0-or-later
Jetzt Nutzung sichtbar machen!
Letzte Aktualisierung: