In diesem Artikel
Eine der besten Möglichkeiten, Audacity-Aufnahmen automatisch zu transkribieren, ist Sonix, das nach Sprechern sortierte und mit Zeitstempeln versehene Transkripte liefert, mit bis zu 99% Genauigkeit und kann eine einstündige Datei in weniger als fünf Minuten verarbeiten. Für eine kostenlose Offline-Transkription, bei der keine Dateien hochgeladen werden müssen, ist das in Audacity integrierte OpenVINO-Whisper-Plugin die führende Audacity-native Option, die vollständig auf Ihrem eigenen Computer läuft.
Es gibt zwei bewährte Methoden, um Audacity-Aufnahmen im Jahr 2026 automatisch zu transkribieren. Die erste läuft vollständig auf Ihrem Computer unter Verwendung des kostenlosen OpenVINO-Whisper-Plugins von Audacity: keine Uploads, kein Abonnement, kein Konto erforderlich. Beim zweiten Weg exportieren Sie Ihre Datei und laden sie bei Sonix hoch, woraufhin Sie in weniger als fünf Minuten ein hochpräzises, nach Sprechern gekennzeichnetes und mit Zeitstempeln versehenes Transkript erhalten, mit Exportoptionen für DOCX, PDF, SRT, VTT und über 30 weitere Formate. Sonix unterstützt die nativen Formate von Audacity Direkt im AU-Format, sodass kein Konvertierungsschritt erforderlich ist.
Dieser Leitfaden behandelt beide Methoden von Anfang bis Ende: Voraussetzungen, Schritt-für-Schritt-Anleitungen und eine Einschätzung, welcher Ansatz am besten zu Ihrem Arbeitsablauf passt. Basierend auf unserer Bewertung beider Methoden ist Sonix die bessere Wahl für alle, die Unterstützung für mehrere Sprecher, professionelle Exportformate oder eine Genauigkeit von bis zu 99% bei sauberem Audiomaterial benötigen.
Kurz gesagt: Exportieren Sie Ihre Audacity-Aufnahme als MP3 oder WAV und laden Sie sie auf Sonix, wählen Sie die Sprache aus und klicken Sie auf „Transkription starten“. Bei einer 60-minütigen Datei erhalten Sie in weniger als fünf Minuten ein nach Sprechern sortiertes und mit Zeitstempeln versehenes Transkript (je nach Bedingungen bis zu 10-mal schneller als in Echtzeit). Für die Offline-Transkription verwenden Sie das kostenlose OpenVINO-Whisper-Plugin von Audacity („Analysieren“ > „OpenVINO Whisper Transcription“). Eine vollständige Schritt-für-Schritt-Anleitung für beide Methoden finden Sie weiter unten.
Wichtigste Erkenntnisse
- Audacity verfügt über eine kostenlose, integrierte Transkriptionsfunktion über das OpenVINO-Whisper-Plugin: Diese läuft vollständig auf Ihrem eigenen Computer, ohne dass Dateien hochgeladen werden müssen.
- Das OpenVINO-Plugin erfordert einen Download von mehreren GB (die Größe variiert je nach Modellauswahl: Das Basismodell ist kleiner als 1 GB; die Vollinstallation mit allen Modellen kann mehr als 6 GB umfassen), eine manuelle Einrichtung und erzeugt eine Rohdatei mit Beschriftungen anstelle von formatiertem, absatzfertigem Text.
- Sonix unterstützt das native AU-Format von Audacity direkt, sodass Sie den Exportschritt komplett überspringen können
- Sonix verarbeitet eine 60-minütige Aufnahme bis zu 10-mal schneller (eine einstündige Datei kann je nach Bedingungen in weniger als fünf Minuten fertig sein) mit einer Genauigkeit von bis zu 99% bei sauberem Audiomaterial über 53+ Sprachen
- Die KI-basierte Sprecher-Diarisierung kennzeichnet die Äußerungen jedes Sprechers im Transkript automatisch: Eine manuelle Kennzeichnung ist nicht erforderlich.
- Sonix exportiert nach Über 30 Formate, darunter DOCX, PDF, SRT, VTT und reiner Text: bereit für YouTube, Premiere oder juristische Unterlagen
- Von Google, Stanford und ESPN geschätzt, mit Über 6,2 Millionen Nutzer die mehr als 14,2 Millionen Stunden Audio transkribiert haben (laut Sonix)
Schnelle Schritte zur automatischen Transkription mit Audacity
Methode 1: Kostenlos und offline (Audacity OpenVINO Whisper-Plugin)
- Laden Sie das OpenVINO-KI-Plugin von audacityteam.org herunter und installieren Sie es.
- Öffne deine Audacity-Aufnahme und wähle die Audiodatei aus (Strg+A)
- Gehe zu Analysieren > OpenVINO Whisper-Transkription
- Wählen Sie eine Whisper-Modellgröße aus und legen Sie die Sprache manuell fest
- Klicken Sie auf Bewerben: Das Transkript wird als Untertitel-Spur unterhalb der Audiospur angezeigt
- Exportieren über Datei > Exportieren > Sonstiges > Etiketten exportieren (SRT, VTT oder Klartext)
Methode 2: Cloud, 99% genau (Sonix)
- Exportieren Sie Ihre Aufnahme aus Audacity als MP3 oder WAV, oder überspringen Sie diesen Schritt ganz, da Sonix die Dateiformat .AU direkt unterstützt.
- Laden Sie die Datei hoch unter sonix.ai
- Wählen Sie die Aufnahmesprache aus Über 53 unterstützte Optionen
- Klicken Sie auf Mit der Transkription beginnen: Eine 60-minütige Datei liefert in weniger als fünf Minuten ein mit Markierungen versehenes Transkript
- Im synchronisierten Browser-Editor von Sonix anzeigen und bearbeiten
- Als DOCX, PDF, SRT, VTT oder in über 30 weiteren Formaten exportieren
Was Sie vor dem Start benötigen
Für Methode 1 (das in Audacity integrierte OpenVINO-Whisper-Plugin)
- Eine aktuelle Audacity-Version, die auf Ihrem Windows-, macOS- oder Linux-Computer installiert ist (verwenden Sie die in den Versionshinweisen des OpenVINO-Plugins empfohlene Version; aktuelle Audacity-Versionen gehören zur 3.7.x-Reihe)
- Das OpenVINO-KI-Plugin für Audacity, heruntergeladen von der offiziellen Audacity-Plugin-Seite unter audacityteam.org
- Eine in Audacity geöffnete Audioaufnahme
- Ausreichende Rechenleistung: Die mittleren und großen Whisper-Modelle benötigen mehr CPU-/GPU-Ressourcen
Für Methode 2 (Export und Hochladen auf Sonix)
- Eine in Audacity aufgenommene Audiodatei (oder eine bereits exportierte MP3-, WAV-, M4A-, AU-, FLAC-, OGG- oder AAC-Datei)
- A Sonix-Konto: Die kostenlose Testversion umfasst 30 Minuten Transkription, ohne dass eine Kreditkarte erforderlich ist.
- Kenntnisse der Sprache(n), die in der Aufnahme gesprochen wird/werden
Verfügt Audacity über eine integrierte Transkriptionsfunktion?
Ja. Seit der Einführung des OpenVINO-KI-Plugins unterstützt Audacity die gerätebasierte Transkription auf Basis des „Whisper“-Modells von OpenAI. Das Plugin wird direkt in Audacity installiert und fügt einen neuen Analyseeffekt namens OpenVINO Whisper-Transkription im Menü „Analysieren“. Die Transkription läuft vollständig auf Ihrem eigenen Computer: Es ist keine Internetverbindung erforderlich, es werden keine Audiodaten von Ihrem Rechner übertragen, und es fallen keine minutengenauen Gebühren an.
Die integrierte Methode schreibt das Transkript in eine Titel anzeigen unterhalb der Audio-Wellenform. Jede Phrase wird als mit einem Zeitstempel versehene Beschriftung angezeigt, die Sie bearbeiten und als SRT-, VTT- oder Klartextdatei exportieren können, und zwar mithilfe von Datei > Exportieren > Sonstiges > Etiketten exportieren.
Die meisten Fachleute, die Audacity-Audiotranskriptionen in großem Umfang benötigen oder auf Sprecher-Diarisierung, Unterstützung für mehr als 53 Sprachen, eine synchronisierte Bearbeitungsoberfläche oder den Export in Word und PDF angewiesen sind, nutzen jedoch neben Audacity einen speziellen automatisierten Transkriptionsdienst und nicht nur das Plugin allein.
Methode 1: Kostenlose Offline-Transkription (OpenVINO Whisper)
Diese Methode läuft vollständig auf Ihrem Computer. Kein Konto, keine Uploads, kein Abonnement. Ideal für einzelne Sprecher, klare Tonqualität und den Offline-Einsatz.
Schritt 1: Installieren Sie das OpenVINO-KI-Plugin für Audacity
- Rufen Sie die Seite „OpenVINO AI Effects for Audacity“ auf audacityteam.org auf
- Laden Sie das Installationsprogramm für Ihr Betriebssystem herunter (Windows, macOS und Linux werden alle unterstützt)
- Führen Sie das Installationsprogramm aus: Es legt die Plugin-Dateien automatisch im Plugin-Verzeichnis von Audacity ab.
- Audacity starten oder neu starten
- Öffnen Sie das Menü „Analysieren“: Sie sollten nun Folgendes sehen OpenVINO Whisper-Transkription sowie die aufgeführten damit verbundenen KI-Effekte
Falls der Menüpunkt nicht angezeigt wird, gehen Sie zu Extras > Plugin-Manager, suchen Sie die OpenVINO-Einträge und klicken Sie auf Aktivieren, und starten Sie Audacity neu.
Schritt 2: Rauschen vor der Transkription reduzieren
Whisper liefert die besten Ergebnisse bei sauberen Audioaufnahmen. Entfernen Sie vor der Transkription Störgeräusche aus der Audiodatei:
- Wähle den gesamten Ton auf der Spur aus (Strg+A oder Cmd+A)
- Gehe zu Effekt > OpenVINO-Audio-Rauschunterdrückung (wird mit dem Plugin-Paket installiert)
- Wende den Effekt an und warte, bis er verarbeitet ist
- Spielen Sie die Aufnahme ein paar Sekunden zurück, um zu überprüfen, ob die Hintergrundgeräusche reduziert wurden.
Wird dieser Schritt bei Aufnahmen mit starken Hintergrundgeräuschen (Lüfterbrummen, Raumhall, Windgeräusche von draußen) übersprungen, verringert sich die Transkriptionsgenauigkeit messbar.
Schritt 3: Wählen Sie Ihre Audiodatei aus und starten Sie die Transkription mit Whisper
- Wählen Sie den Audiobereich aus, den Sie transkribieren möchten: Drücken Sie Strg+A, um die gesamte Spur auszuwählen, oder ziehen Sie mit der Maus, um einen bestimmten Abschnitt auszuwählen.
- Gehe zu Analysieren > OpenVINO Whisper-Transkription
- Wählen Sie im sich öffnenden Dialogfeld Ihre Einstellungen aus:
- Modellgröße: „base“ ist am schnellsten für einwandfreies Englisch; „small“ oder „medium“ bewältigen Akzente und nicht-englische Sprachen besser; „large“ ist am genauesten, aber am langsamsten
- Sprache: Stellen Sie diese Option manuell ein, insbesondere bei kurzen Clips, um zu verhindern, dass Whisper die Sprache falsch erkennt.
- Anfangsaufforderung (optional): Geben Sie Eigennamen, Markennamen oder Fachbegriffe ein, damit Whisper diese im gesamten Transkript korrekt schreibt.
- Sprecher-Diarisierung: Aktivieren Sie diese Option, wenn Sie eine Kennzeichnung der Sprecher benötigen (erfordert das Modell „small.en-tdrz“, das experimentelle Diarisierung enthält).
- Klicken Sie auf Bewerben und warten, bis das Modell die Audiodaten verarbeitet hat
Sobald die Transkription abgeschlossen ist, wird eine neue Beschriftungsspur mit dem Titel Transkription wird unterhalb der Audio-Wellenform angezeigt. Jede Beschriftung enthält einen Ausschnitt aus dem Audiomaterial, der anhand des Zeitstempels mit der Wellenform synchronisiert ist.
Schritt 4: Exportieren Sie das Transkript aus Audacity
- Klicken Sie auf eine beliebige Stelle in der Beschriftungsspur, um diese auszuwählen
- Gehe zu Datei > Exportieren > Sonstiges > Etiketten exportieren
- Wählen Sie Ihr Format aus:
- SRT: für Videobearbeiter und YouTube-Untertitel
- WebVTT: für webbasierte Mediaplayer
- Klartext (.txt): für Dokumente, Notizen und die Suche
- Geben Sie der Datei einen Namen und speichern Sie sie
Die exportierte Datei enthält jede Phrase mit ihrem Start- und Endzeitstempel, sodass sie direkt in einen Videobearbeitungsprogramm eingefügt oder als Untertiteldatei hochgeladen werden kann.
Methode 1 auf einen Blick
- Kosten: Kostenlos
- Plugin herunterladen: Mehrere GB (Basismodell: unter 1 GB; vollständige Installation mit allen Modellen: 6 GB+)
- Verarbeitung: Auf dem Gerät (Ihrer Hardware)
- Sprachen: 99
- Sprecher-Diarisierung: Experimentell (nur auf Englisch, maximal 2 Sprecher)
- Ausgabe: Als SRT, VTT oder einfachen Text exportierter Untertitel-Track
- Datenschutz: Vollständig lokal: Die Audiodaten verlassen Ihren Computer zu keinem Zeitpunkt
- Am besten geeignet für: Klarer Klang über einen einzigen Lautsprecher, offline, in Umgebungen mit Luftspalt
Methode 2: Cloud-Transkription mit Sonix (99% genau)
Dies ist die zuverlässigste Methode, wenn Sie Audacity-Aufnahmen automatisch und in großem Umfang transkribieren müssen. Sie bietet eine höhere Genauigkeit bei Aufnahmen mit mehreren Sprechern und unterstützt 53+ Sprachen, und erstellt Transkripte, die sich für juristische Unterlagen, die Weiterverwendung von Inhalten oder den Austausch im Team eignen, mit vollständiger Diarisierung von KI-Sprechern und in über 30 Formate exportieren. Sonix ist die führende Cloud-Transkriptionsplattform, auf die Google, Stanford und ESPN vertrauen.
Schritt 1: Exportieren Sie Ihre Audacity-Aufnahme
Wenn Sie mit einer bearbeiteten Version Ihrer Aufnahme arbeiten möchten, anstatt die unbearbeitete AU-Projektdatei hochzuladen, exportieren Sie diese zunächst aus Audacity:
- Gehen Sie in Audacity zu Datei > Audio exportieren
- Wählen Sie Ihr Format aus: MP3 (komprimiert, kleinere Datei) oder WAV (unkomprimiert, höchste Qualität)
- Legen Sie die Qualitätseinstellungen fest und benennen Sie die Datei
- Klicken Sie auf Exportieren und auf Ihrem Computer speichern
Alternativ können Sie das native Format von Audacity hochladen .AU Direktes Formatieren in Sonix ohne Exportschritt: Sonix unterstützt neben allen gängigen Audio- und Videoformaten auch AU-Dateien.
Schritt 2: Lade deine Audiodatei auf Sonix hoch
- Gehen Sie auf sonix.ai und melden Sie sich an (oder starten Sie Ihre 30-minütige kostenlose Testphase: keine Kreditkarte erforderlich)
- Klicken Sie auf Hochladen auf dem Sonix-Dashboard
- Wählen Sie Ihre Audacity-Audiodatei auf Ihrem Computer aus oder importieren Sie sie direkt aus Google Drive oder Dropbox, falls Sie Ihre Aufnahmen dort gespeichert haben
- Sonix unterstützt MP3, WAV, M4A, AU, FLAC, OGG, AAC und die meisten anderen Audio- und Videoformate.
Schritt 3: Sprache auswählen und mit der Transkription beginnen
- Nach dem Hochladen fordert Sonix Sie auf, die Sprache in der Aufnahme gesprochen
- Wählen Sie aus Über 53 unterstützte Sprachen: Sonix verarbeitet automatisch Fachvokabular, Eigennamen und fachspezifische Terminologie in allen diesen Bereichen
- Klicken Sie auf Mit der Transkription beginnen
Sonix verarbeitet Dateien bis zu 10-mal schneller. Eine 60-minütige Audacity-Aufnahme kann, je nach den gegebenen Bedingungen, in weniger als fünf Minuten eine vollständige Transkription liefern.
Schritt 4: Überprüfen, bearbeiten und exportieren
Sonix öffnet das fertige Transkript in seiner synchronisierten Bearbeitungsoberfläche. Jedes Wort ist mit dem entsprechenden Zeitstempel in der Audioaufnahme verknüpft: Klicken Sie auf ein beliebiges Wort, um direkt zu diesem Zeitpunkt in der Aufnahme zu springen.
Wichtigste Funktionen des Sonix-Editors:
- Diarisierung von AI-Sprechern: Sonix erkennt Sprecherwechsel automatisch und kennzeichnet die Äußerungen der einzelnen Sprecher im gesamten Transkript. Bei einem Interview mit zwei Personen bedeutet dies, dass jeder Wortwechsel sauber voneinander getrennt wird, ohne dass eine manuelle Kennzeichnung erforderlich ist.
- Zeitstempel auf Wortebene: Jedes einzelne Wort ist mit einem auf die Millisekunde genauen Zeitstempel versehen, was für die Synchronisation von Untertiteln und für rechtliche Unterlagen nützlich ist.
- Bearbeitung im Browser: Korrigieren Sie ein beliebiges Wort im synchronisierten Editor, und die Änderung wird gleichzeitig in allen Exportformaten übernommen.
- Suche: Verwenden Sie Strg+F, um ein beliebiges Wort oder eine beliebige Wortgruppe sofort in einem Transkript beliebiger Länge zu finden.
So exportieren Sie Ihr fertiges Transkript:
- Klicken Sie auf die Exportieren Schaltfläche oben rechts im Editor
- Wählen Sie Ihr Format aus:
- DOCX oder PDF: für Berichte, Dokumentation und den Austausch
- SRT oder VTT: für Videountertitel (YouTube, Premiere Pro, Final Cut, DaVinci Resolve)
- Klartext: für Notiz-Apps, CMS-Uploads oder KI-Tools
- Über 30 weitere Formate: einschließlich JSON mit Zeitstempeln, für Entwickler und Datenpipelines
Sonix' Seite „Integrationen“ listet alle direkten Anbindungen auf, darunter Adobe Premiere Pro, Final Cut Pro und Hindenburg Journalist – gängige Arbeitsabläufe für Audacity-Nutzer, die Audiodateien in professionelle Bearbeitungsprogramme übertragen.
Methode 2 auf einen Blick
- Benutzer: Über 6,2 Millionen Nutzer (Berichtet von Sonix)
- Kosten: $10/Std. Standardtarif; Abonnementtarife ab $25/Monat (zusätzliche Stunden werden bei allen Tarifen mit $10/Stunde abgerechnet)
- Kostenlose Testversion: 30 Minuten, keine Kreditkarte erforderlich
- Genauigkeit: bis zu 99% Genauigkeit
- Sprachen: 53+
- Sprecher-Diarisierung: Vollständige KI-basierte Sprecher-Diarisierung in allen Tarifen
- Ausgabe: Über 30 Formate: DOCX, PDF, SRT, VTT, JSON und weitere Formate
- Sicherheit: SOC 2 Typ II-zertifiziert; AES-256-Verschlüsselung; HIPAA-konform über Medical Sonix (BAA verfügbar)
- Am besten geeignet für: Aufnahmen mit mehreren Sprechern, professionelle Qualität, Einhaltung von Unternehmensrichtlinien
Welche Methode passt zu Ihrem Arbeitsablauf?
Mit beiden Methoden können Sie Audacity-Aufnahmen automatisch transkribieren. Welche Methode die richtige ist, hängt von Ihren Anforderungen an die Genauigkeit, dem Umfang der Aufnahmen, den Datenschutzanforderungen sowie davon ab, ob Sie Funktionen wie Sprecher-Diarisierung oder den Export in verschiedene Formate benötigen. Bei unserer Bewertung beider Optionen schneidet Sonix in Bezug auf Genauigkeit und Ausgabequalität durchweg besser ab als das lokale Plugin, während das OpenVINO Whisper-Plugin die beste kostenlose und vollständig offline nutzbare Option darstellt.
Audacity OpenVINO Whisper-Plugin:
- Kosten: Kostenlos
- Genauigkeit: Gut für einen klaren Klang
- Sprachen: 99 (Whisper-Basismodell)
- Sprecher-Diarisierung: Experimentell (TDRZ-Modell)
- Verarbeitungsgeschwindigkeit: Das hängt von Ihrer Hardware ab
- Exportformate: SRT, VTT, TXT
- Bearbeitungsoberfläche: Audacity-Label-Spur
- Datenschutz / Offline: Vollständig lokal, keine Uploads
- Am besten geeignet für: Ein Lautsprecher, offline, kein Budget
Sonix Automatisierte Transkription:
- Kosten: $10/Std. Standardtarif; Abonnementmodelle ab $25/Monat
- Genauigkeit: bis zu 99% Genauigkeit
- Sprachen: 53+
- Sprecher-Diarisierung: Vollständige Diarisierung von Sprachausgaben mittels KI
- Verarbeitungsgeschwindigkeit: Bis zu 10-mal schneller als in Echtzeit (weniger als fünf Minuten pro Stunde Audio)
- Exportformate: Über 30 Formate: DOCX, PDF, SRT, VTT, TXT, JSON und weitere Formate
- Bearbeitungsoberfläche: Synchronisierter Browser-Editor
- Datenschutz / Offline: Cloud-basiert; SOC 2 Typ II-zertifiziert; AES-256-Verschlüsselung; HIPAA-konform über Medical Sonix
- Am besten geeignet für: Mehrkanal-Wiedergabe, hohe Genauigkeit, professionelle Ausgabe
Für Solo-Podcaster, Forscher mit einmaligen Aufnahmen oder alle, die in einer vollständig isolierten Umgebung arbeiten, erledigt die integrierte OpenVINO-Methode die Aufgabe ohne jeglichen externen Dienst. Für Teams, Content-Workflows, den Journalismus, juristische Dokumentationen oder jedes Projekt, bei dem die Sprecherkennzeichnung und Flexibilität beim Export eine Rolle spielen, bietet Sonix die Genauigkeit und die Workflow-Funktionen, die rohe Audacity-Kennzeichnungsspuren nicht bieten.
Häufige Fehler, die es zu vermeiden gilt
- Keine Rauschunterdrückung vor der Transkription. Hintergrundgeräusche, selbst ein leises Brummen oder Raumhall, beeinträchtigen die Transkriptionsgenauigkeit bei beiden Methoden erheblich. Wenden Sie vor dem Exportieren oder Ausführen von Whisper immer eine Rauschunterdrückung in Audacity an. Sowohl der in Audacity integrierte Effekt „Rauschunterdrückung“ (Effekt > Rauschunterdrückung) als auch der OpenVINO-AI-Rauschunterdrückungseffekt funktionieren gut; die KI-Rauschunterdrückung ist bei Aufnahmen mit starken Störungen effektiver.
- Ein mehrspuriges Audacity-Projekt hochladen, ohne es abzumischen. Audacity-Projekte (.AUP3) können mehrere Spuren enthalten, darunter verschiedene Mikrofonkanäle, Hintergrundmusik und Soundeffekte. Vergewissern Sie sich vor der Transkription, dass Sie mit einer einzigen, abgemischten Audiodatei arbeiten. Verwenden Sie Spuren > Mischen > Mischen und Rendern in Audacity vor dem Exportieren.
- Die falsche Spracheinstellung wurde ausgewählt. Bei beiden Methoden führt die manuelle Angabe der Aufnahmesprache zu genaueren Ergebnissen als die automatische Erkennung, insbesondere bei kurzen Clips, Fachvokabular oder Aufnahmen, die mit Stille beginnen. Wählen Sie die Sprache daher immer explizit aus.
- Überspringen des Schritts zur Sprecher-Diarisierung bei Aufnahmen mit mehreren Personen. Wenn Ihre Audacity-Aufnahme ein Interview, eine Podiumsdiskussion oder eine Besprechung mit mehreren Sprechern enthält, führt die Verwendung einer Methode ohne KI-basierte Sprecher-Diarisierung zu einem einzigen, ununterbrochenen Textblock, der schwer lesbar und nur schwer den einzelnen Sprechern zuzuordnen ist. Aktivieren Sie die Diarisierung in den Whisper-Einstellungen oder verwenden Sie Sonix, das die Sprecher-Diarisierung automatisch auf jedes Transkript anwendet.
- Der Export erfolgt in einem für den nachgelagerten Anwendungsfall ungeeigneten Format. SRT-Dateien sind für Videountertitel gedacht: Fügen Sie sie nicht in ein Word-Dokument ein. Bei einfachem Text gehen die Zeitstempel verloren: Verwenden Sie ihn daher nicht für den Import von Untertiteln. Passen Sie das Exportformat an das Ziel an: SRT oder VTT für Videos, DOCX oder PDF für Dokumentationen, TXT für Arbeitsabläufe mit einfachem Text.
Tipps für bessere Ergebnisse bei der automatischen Transkription
Das Audiomaterial vor der Transkription vorbearbeiten.
Die Rauschunterdrückungstechniken in Audacity, darunter Noise Gates, Entzerrung und Kompression, verbessern direkt die Genauigkeit der automatisierten Transkription. Die Erfassung eines 30-sekündigen Rauschprofils, gefolgt von einer Rauschunterdrückung und einem sanften Hochpassfilter (zum Herausfiltern von tieffrequenten Brummgeräuschen), ist der Standard-Vorverarbeitungsablauf für Interviewaufnahmen. Wenden Sie diese Effekte vor der Transkription mit einer der beiden Methoden an.
Verwenden Sie die „Initial Prompt“-Funktion für Markennamen und Fachbegriffe.
Whisper (über das Feld „Initial Prompt“) und Sonix verarbeiten Eigennamen und Fachbegriffe genauer, wenn ein kurzer Kontexthinweis angegeben wird. Bei einem Produktinterview lassen sich durch die Eingabe des Firmennamens, der Produktnamen und der Branchenbegriffe als „Initial Prompt“ häufige Rechtschreibfehler im endgültigen Transkript vermeiden.
Legen Sie ein benutzerdefiniertes Vokabular für wiederkehrende Begriffe fest.
Wenn Sie regelmäßig Audacity-Aufnahmen in einem speziellen Fachgebiet wie Medizin, Recht oder Technik transkribieren, können Sie mit der Funktion „Benutzerdefiniertes Vokabular“ von Sonix Begriffe festlegen, die stets auf eine bestimmte Weise transkribiert werden sollen, um Inkonsistenzen bei großen Dateimengen zu vermeiden.
Batch-Upload für Workflows mit hohem Datenaufkommen.
Wenn Sie täglich Audacity-Aufnahmen erstellen, beispielsweise Podcast-Interviews, Kundengespräche oder Tonaufnahmen vor Ort, unterstützt Sonix das Hochladen mehrerer Dateien auf einmal. Ziehen Sie mehrere Dateien gleichzeitig per Drag & Drop in das Programm, und alle werden parallel verarbeitet. Sonix’s API unterstützt außerdem automatisierte Upload-Pipelines für Teams, die Transkripte ohne manuelle Schritte in eine Datenbank oder ein CMS übertragen müssen.
Nutzen Sie Zeitstempel für die Wiederverwendung von Inhalten.
Jedes Sonix-Transkript enthält Zeitstempel auf Wortebene. Für Podcast-Redakteure bedeutet dies, dass sie im Transkript nach einem bestimmten Zitat suchen, sich den Zeitstempel notieren und in Audacity direkt zu diesem Zeitpunkt springen können, um präzise Schnitte vorzunehmen, ohne die gesamte Aufnahme durchlaufen zu müssen.
Anmerkung zur Übersetzung.
Sonix' Übersetzungsfunktion wandelt ein fertiges Transkript in 54+ Sprachen direkt in der Plattform. Übersetzungen sind verfügbar und werden separat zum gleichen Stundensatz wie die Transkription abgerechnet.
Endgültiges Urteil
Es gibt keine einheitliche Methode, die für jeden Audacity-Arbeitsablauf gleichermaßen geeignet ist. Hier erfahren Sie, wie Sie entscheiden können, welche Methode Sie für die automatische Transkription von Audacity-Aufnahmen wählen sollten:
- Für Offline-Transkription von sauberen Aufnahmen mit einem einzigen Sprecher, Das OpenVINO-Whisper-Plugin von Audacity ist genau das Richtige. Es ist kostenlos, absolut privat und erfordert keinen externen Dienst. Es eignet sich für Solo-Podcast-Aufnahmen, Vorlesungsaufzeichnungen und alle Arbeitsabläufe, bei denen die Audiodaten Ihren Computer nie verlassen. Das OpenVINO-Plugin ist die einzige vollständig lokal funktionierende Transkriptionsoption, die in Audacity integriert ist.
- Für Aufnahmen mit mehreren Sprechern, professionelle Ergebnisse oder Arbeitsabläufe mit hohem Arbeitsaufkommen, Sonix ist die umfassendste Lösung. Das Programm liefert in weniger als fünf Minuten 99%-genaue, durch KI mit Sprechern gekennzeichnete und vollständig formatierte Transkripte – ohne Bereinigung der Label-Spuren, ohne manuelle Sprecherkennzeichnung und exportbereit für Word, PDF, YouTube oder Ihren Videobearbeitungsprogramm. Die manuelle Transkription erfordert in der Regel 4 bis 6 Stunden pro Stunde Audioaufnahme; Sonix automatisiert diesen Vorgang in wenigen Minuten, wie im Detail beschrieben unter Die Transkriptionsressourcen von Sonix.
- Für Teams im Gesundheitswesen, im Rechtsbereich oder in den Medien Für Unternehmen, die neben automatisierter Transkription auch Sicherheit auf Unternehmensniveau benötigen, ist Sonix die erste Wahl. Sonix ist SOC 2 Typ II, HIPAA-konform über Medical Sonix (BAA verfügbar) und verschlüsselt alle Dateien mit AES-256. Organisationen wie Stanford, Google und ESPN nutzen es für sensible Aufzeichnungen.
Wenn Sie in erster Linie schnelle, präzise und formatierte Transkripte von Audacity-Aufnahmen benötigen, ohne den Aufwand für die Installation eines umfangreichen Plugins, ist Sonix die umfassendste Lösung.
Nächste Schritte
Beide in diesem Leitfaden behandelten Methoden automatisieren den manuellen Aufwand bei der Transkription von Audioaufnahmen. Für die schnelle Offline-Transkription von klarer Audioaufnahme mit einem einzigen Sprecher übernimmt das OpenVINO-Plugin diese Aufgabe ohne externe Dienste. Für die hochpräzise Transkription von Aufnahmen mit mehreren Sprechern, Unterstützung für 53+ Sprachen, KI-basierte Sprecherzuordnung und Export in die Formate, die Ihr Workflow tatsächlich benötigt – Sonix ist der schnellere und umfassendere Weg.
Da Sie nun wissen, wie Sie Audacity-Aufnahmen automatisch transkribieren können, wählen Sie die Methode, die zu Ihrer Konfiguration passt, und sparen Sie sich ab 2026 stundenlange manuelle Transkriptionsarbeit.
Sonix kostenlos testen: 30 Minuten, keine Kreditkarte erforderlich.
Entdecken Der gesamte Funktionsumfang von Sonix, darunter Übersetzungen in mehr als 54 Sprachen, automatische Zusammenfassungen und direkte Integrationen mit Premiere Pro, Final Cut Pro und Audacity.
Häufig gestellte Fragen
Kann Audacity Audiodateien von Haus aus in Text umwandeln?
Ja. Wenn das kostenlose OpenVINO-KI-Plugin installiert ist, kann Audacity Audioaufnahmen mithilfe des „Whisper“-Modells von OpenAI direkt in der App in Text umwandeln. Das Transkript wird als mit Zeitstempeln versehene Beschriftungsspur angezeigt. Diese Funktion ist für Windows, macOS und Linux (über das OpenVINO-KI-Plugin) verfügbar. Verwenden Sie die in den Versionshinweisen des OpenVINO-Plugins empfohlene Audacity-Version; aktuelle Versionen gehören zur 3.7.x-Reihe.
Welche Audioformate unterstützt Sonix aus Audacity?
Sonix unterstützt direkt das native .AU-Format von Audacity sowie MP3, WAV, M4A, AAC, FLAC, OGG und die meisten anderen gängigen Audio- und Videoformate. Sie können Dateien direkt von Ihrem Computer hochladen oder aus Google Drive oder Dropbox importieren.
Wie genau ist die automatische Transkription nach dem Sonix-Verfahren?
Sonix liefert bis zu 99% Genauigkeit quer durch 53+ Sprachen. Das in Audacity integrierte „Whisper“-Plugin liefert auch bei sauberen Aufnahmen mit nur einem Sprecher gute Ergebnisse. Die Genauigkeit beider Methoden nimmt bei Hintergrundgeräuschen, sich überschneidenden Sprechern oder starken Akzenten ab, weshalb eine Rauschunterdrückung vor der Transkription dringend empfohlen wird, unabhängig davon, welche Methode Sie verwenden.
Unterstützt Sonix die Sprecher-Diarisierung?
Ja. Sonix wendet automatisch eine KI-basierte Sprecher-Diarisierung auf jede hochgeladene Aufnahme an. Das Programm erkennt Sprecherwechsel und kennzeichnet die Äußerungen jedes Sprechers im gesamten Transkript, ohne dass eine manuelle Konfiguration erforderlich ist. Das „Whisper“-Plugin von Audacity bietet ebenfalls eine experimentelle Sprecher-Diarisierung über das Modell „small.en-tdrz“ an, unterstützt jedoch nur Englisch und maximal zwei Sprecher.
Ist Sonix sicher genug für vertrauliche Aufnahmen?
Ja. Sonix ist SOC 2 Typ II, HIPAA-konform über Medical Sonix (BAA verfügbar) und verschlüsselt alle Dateien mit AES-256-Verschlüsselung sowohl im Ruhezustand als auch während der Übertragung. Unternehmen aus den Bereichen Gesundheitswesen, Rechtswesen, Medien und Forschung, darunter Stanford, Google und Adobe, nutzen Sonix zur Transkription sensibler Audioaufnahmen.
Die weltweit genaueste KI-Transkription
Sonix transkribiert Ihre Audio- und Videodateien in Minutenschnelle - mit einer Genauigkeit, die Sie vergessen lässt, dass es sich um einen automatisierten Vorgang handelt.