Diktiergerät transkribieren — vom Gerät zur Textdatei, ohne Formatchaos

Ob klassisches Diktiergerät von Olympus (heute OM System), Philips oder Grundig, Sony-Voice-Recorder oder Field-Recorder wie Zoom H-Serie und Tascam: Die Aufnahme ist schnell gemacht, der Weg zum Text scheitert oft am Dateiformat. Diese Seite zeigt dir, welche Formate dein Gerät speichert, was du mit DSS, DS2 und WMA machst, wie du Dateien per USB überträgst und welche Einstellungen am Gerät die Transkription verbessern. Wie du so diktierst, dass wenig Nacharbeit anfällt, steht unter Diktat in Text umwandeln.

Welches Format speichert dein Gerät?

Das hängt vom Hersteller, vom Modell und von den Einstellungen ab. Grob lassen sich die Geräte in zwei Gruppen teilen: Voice-Recorder und Field-Recorder speichern meist MP3 oder WAV, die du direkt hochladen kannst. Professionelle Diktiergeräte für Praxis und Kanzlei nutzen dagegen häufig die Diktierformate DSS oder DS2. Diese werden von Scriptivo nicht unterstützt und müssen vorher umgewandelt werden.

Die tatsächlichen Formate hängen vom Modell und den Einstellungen ab. Im Zweifel hilft ein Blick auf die Dateiendung.
Gerätetyp (Beispiele)Typische FormateDirekt hochladen?
Profi-Diktiergeräte (Olympus/OM System, Philips, Grundig)DSS, DS2, oft zusätzlich MP3 oder WAV wählbarNur MP3/WAV. DSS/DS2 vorher umwandeln
Voice-Recorder (z. B. Sony, Olympus/OM System)MP3, bei älteren Modellen auch WMAMP3 ja, WMA vorher umwandeln
Field-Recorder (Zoom H-Serie, Tascam)WAV, teils MP3Ja
Smartphone-RekorderM4A, MP3, AACJa

DSS, DS2 und WMA: So wandelst du um

Für DSS- und DS2-Dateien ist die Software des Herstellers der zuverlässigste Weg. Je nach Gerät und Software-Version ist das zum Beispiel die Dictation-Management-Software von Olympus bzw. OM System oder Philips SpeechExec. Dort kannst du Aufnahmen in der Regel als MP3 oder WAV exportieren oder konvertieren. Welche Menüpunkte es genau gibt, unterscheidet sich je nach Version, schau im Zweifel in die Anleitung deines Geräts.

Noch einfacher: Viele Profi-Geräte lassen sich in den Einstellungen direkt auf MP3 oder WAV umstellen. Wenn du keine Workflow-Funktionen der Diktiersoftware brauchst (etwa Weiterleitung an ein Sekretariat), spart dir das die Umwandlung komplett.

Ältere Sony-Recorder und manche Windows-Tools speichern als WMA. Auch dieses Format musst du vorher in MP3 oder M4A umwandeln. Eine Anleitung findest du unter WMA zu Text.

Stell dein Gerät, wenn möglich, dauerhaft auf MP3 oder WAV um. Dann kannst du jede neue Aufnahme ohne Zwischenschritt hochladen.

Schritt für Schritt: Vom Diktiergerät zum Text

  1. Gerät per USB verbinden — Schließ das Gerät per USB-Kabel an. Die meisten Recorder erscheinen als Laufwerk im Explorer oder Finder. Alternativ nimmst du die Speicherkarte heraus und steckst sie in einen Kartenleser.
  2. Aufnahmen finden und kopieren — Die Dateien liegen meist in Ordnern wie „RECORDER“, „VOICE“ oder nach Ordnern A bis E sortiert. Kopiere sie auf deinen Rechner, statt direkt vom Gerät hochzuladen.
  3. Format prüfen und ggf. umwandeln — Endet die Datei auf .mp3, .wav oder .m4a, bist du fertig. Bei .dss, .ds2 oder .wma wandelst du sie zuerst um.
  4. Hochladen und Sprache wählen — Lade die Datei bei Scriptivo hoch und stell die Sprache manuell ein. Mit Pro kannst du bis zu 10 Dateien gleichzeitig hochladen, praktisch für die Diktate einer ganzen Woche.
  5. Korrigieren und exportieren — Prüfe Namen, Zahlen und Fachbegriffe im Editor und exportiere: kostenlos als TXT, mit Pro als DOCX für Word oder als PDF.

Die richtigen Einstellungen am Gerät

  • Format und Bitrate — Wähle MP3 mit mindestens 128 kbps oder WAV. Sehr niedrige Bitraten oder Langzeit-Modi sparen Speicher, verschlechtern aber die Erkennung.
  • Mikrofonempfindlichkeit — Viele Geräte haben Modi wie „Diktat“ (niedrige Empfindlichkeit, nah am Mund) und „Konferenz“ bzw. „Meeting“ (hohe Empfindlichkeit, ganzer Raum). Für Einzeldiktate ist der Diktat-Modus richtig, sonst nimmst du viel Raumgeräusch mit.
  • Sprachaktivierung (VOR/VCVA) — Die automatische Aufnahme bei Sprache kann Wortanfänge abschneiden. Für saubere Transkripte lieber manuell starten.
  • Low-Cut-Filter und Rauschunterdrückung — Falls vorhanden, reduzieren sie tiefes Brummen und Lüftergeräusche.
  • Stereo oder Mono — Für ein einzelnes Diktat reicht Mono. Für Besprechungen mit mehreren Personen bringt ein Stereo-Recorder in der Tischmitte meist mehr.

Diktate aus Praxis und Kanzlei

Gerade Profi-Diktiergeräte werden in Arztpraxen und Kanzleien genutzt. Zu den Besonderheiten dort, von Fachbegriffen bis zu Schweigepflicht und Datenschutz, findest du eigene Seiten: Arzt-Diktat transkribieren und Anwalt-Diktat transkribieren. Scriptivo ist kein zertifiziertes medizinisches oder juristisches Dokumentationssystem und keine Praxis- oder Kanzleisoftware. Prüfe vor dem Upload von Patienten- oder Mandantendaten deine Schweigepflicht (§ 203 StGB) und deine datenschutzrechtlichen Pflichten, etwa ob ein Auftragsverarbeitungsvertrag nötig ist; frag bei Bedarf beim Support (support@scriptivo.de) nach.

Scriptivo überträgt Dateien verschlüsselt, nutzt sie nicht zum KI-Training und du kannst Transkripte samt Audio jederzeit löschen. Betreiber und Dienstleister sitzen in den USA, Details in der Datenschutzerklärung. Brauchst du eine rein lokale Verarbeitung, ist ein lokal installiertes Tool die bessere Wahl, siehe noScribe-Alternative.

Nimmst du mit dem Recorder Besprechungen oder Interviews auf, trennt die Sprechererkennung ab Pro die Stimmen automatisch. Denk daran, dass alle Beteiligten der Aufnahme zustimmen müssen (§ 201 StGB).

Teste es mit einer MP3 oder WAV von deinem Gerät: 1 Datei pro Tag bis 30 Minuten kostenlos, ohne Anmeldung. Viele Diktate auf einmal? Mit Pro lädst du 10 Dateien gleichzeitig hoch, Details auf der Preisseite.

Jetzt kostenlos transkribieren

Lade die MP3 oder WAV von deinem Diktiergerät jetzt hoch: bis 30 Minuten kostenlos, ohne Anmeldung. DSS, DS2 und WMA bitte vorher umwandeln.

Datei hierher ziehen oder klicken

Audio oder Video · bis 30 Min. · 500 MB (MP4/MOV-Videos beliebig groß)

Alle Formate

MP3, WAV, M4A, MP4, MOV, OGG, FLAC, WEBM, MPEG, AAC, MKV, AVI

Kostenlos: 1 Datei pro Tag, bis 30 Min., TXT-Export, Whisper Turbo. Mit Pro: Whisper large-v3, alle Exporte & KI-Tools

Häufige Fragen

Nein. DSS und DS2 müssen vorher in MP3 oder WAV umgewandelt werden, am besten mit der Software deines Geräteherstellers. Alternativ stellst du das Gerät, falls möglich, direkt auf MP3- oder WAV-Aufnahme um.

WMA wird nicht direkt unterstützt. Wandle die Datei in MP3 oder M4A um, eine Anleitung steht unter WMA zu Text. Neuere Sony-Modelle nehmen meist direkt in MP3 auf.

Ja, mit Pro, dem 7-Tage-Pass oder Business lädst du bis zu 10 Dateien gleichzeitig hoch. Kostenlos ist 1 Transkription pro Tag bis 30 Minuten möglich.

MP3 mit mindestens 128 kbps oder WAV. Für Einzeldiktate den Diktat-Modus mit niedriger Mikrofonempfindlichkeit, für Besprechungen den Konferenz-Modus. Sprachaktivierung besser ausschalten.

Hier geht es um das Gerät: Formate, Übertragung und Einstellungen. Wie du richtig diktierst und typische Fehler im Diktat-Transkript findest, erklärt die Seite Diktat in Text umwandeln.

Nein. Satzzeichen setzt Scriptivo automatisch; gesprochene Befehle werden wörtlich mittranskribiert. Entferne sie bei Bedarf per Suchen-und-Ersetzen.

Mit Pro exportierst du direkt als DOCX oder PDF. Kostenlos erhältst du eine TXT-Datei, deren Inhalt du in Word einfügst.

Weitere Anwendungsfälle

Mehr aus deinen Aufnahmen herausholen

Unbegrenzte Transkriptionen, KI-Zusammenfassung und Export in alle Formate — ab 14,99 €/Monat.