Wie erkennt man, mit welcher Qualität eine Sprachnotiz aufgenommen wurde?
Kurz gesagt: Die App zeigt es nirgends direkt an, weil es nichts anzuzeigen gibt — die Einstellung wurde nicht als Notiz an der Datei gespeichert, sie wurde einmal benutzt, um die Datei zu erzeugen. Es folgt ein Weg, es in einer Minute zu schätzen, und ein Weg, es sicher zu wissen.
Das kommt auf, sobald eine Bibliothek etwas Geschichte hat. Die Qualitätseinstellung wurde irgendwann geändert — vielleicht absichtlich, vielleicht aus Versehen beim Durchtippen der Einstellungen — und jetzt gibt es einen Ordner voller Aufnahmen, ohne dass sich allein aus der Liste ablesen lässt, welche von vor und welche von nach der Änderung stammen. Das will man aus nachvollziehbaren Gründen wissen: aus Neugier, um zu entscheiden, was gefahrlos neu aufgenommen werden kann, oder schlicht um zu verstehen, warum eine Datei größer ist als eine andere gleicher Länge.
Warum es kein Etikett zum Nachsehen gibt
Eine Einstellung wie Standard, Hoch oder Ultra ist keine Eigenschaft, die sich die App zu einer Aufnahme merkt, so wie sie sich einen Titel oder ein Datum merkt. Sie ist eine Anweisung dafür, wie die nächste Datei aufgenommen wird — mit welcher Abtastrate das Mikrofonsignal gemessen wird — und diese Anweisung wird genau einmal benutzt, in dem Moment, in dem auf Aufnahme getippt wird. Sobald die Datei geschrieben ist, liegt die Abtastrate nicht als Bildunterschrift daneben, die die App später erneut lesen könnte; sie ist in die Audiodaten selbst eingebacken, ähnlich wie die Auflösung eines Fotos eine Eigenschaft des Bildes ist und keine separat gespeicherte Notiz. Es bleibt nichts übrig, das ein Detailbildschirm anzeigen könnte, weil die Einstellung ihre einzige Aufgabe schon erledigt hat und wieder verschwunden ist.
Genau deshalb kann eine Bibliothek Aufnahmen in verschiedenen Stufen nebeneinander enthalten, ohne dass etwas kaputt wirkt. Jede Datei trägt einfach die Abtastrate, die an dem Tag aktiv war, an dem sie aufgenommen wurde, und nichts in der App behandelt das als fehlende Information: Wiedergabe, Suche und Transkription müssen die Stufe nicht kennen, um ihre Arbeit zu tun, also wurde nie etwas gebaut, um sie anzuzeigen.
Der ungefähre Weg: Vergleich mit einer frischen Referenz
Eine feste Zahl für Megabyte pro Minute bei einer bestimmten Stufe lässt sich nicht nachschlagen, weil AAC ein komprimiertes Format ist und wie kompakt das Ergebnis ausfällt, davon abhängt, was tatsächlich aufgenommen wurde, nicht nur von der Abtastrate. Was sich machen lässt: sich heute, auf demselben Telefon, eine eigene Referenz bauen. Einen kurzen Clip aufnehmen — ein, zwei Minuten normales Sprechen, keine Stille — bei jeder der drei Einstellungen, und die Dateigröße jeweils in der Dateien-App oder im Teilen-Menü prüfen. Jede Größe durch die Länge in Minuten teilen ergibt drei Zahlen, eine pro Stufe, die wirklich zu diesem Telefon gehören statt irgendwo geliehen zu sein.
Dieselbe Rechnung für die zu identifizierende Aufnahme durchführen — ihre Größe geteilt durch ihre Länge — und sehen, welcher der drei frischen Zahlen sie am nächsten kommt. Exakt wird das nicht, weil die alte Aufnahme nicht dieselbe Sprache enthielt wie der heutige Testclip, aber der Abstand zwischen 22,05 kHz, 44,1 kHz und 48 kHz ist groß genug, dass eine in Standard aufgenommene Datei selten in die Nähe einer in Ultra aufgenommenen kommt. Es ist ein Vergleich, keine Messung, und meist reicht er, um eine gemischte Bibliothek in „wahrscheinlich Standard" und „wahrscheinlich nicht" zu sortieren.
Der exakte Weg: die tatsächliche Abtastrate der Datei auslesen
Für eine sichere Antwort statt einer Annäherung: Die Abtastrate ist nicht versteckt, sie wird einfach nirgends in der Dateien-App von iOS selbst angezeigt. Die Aufnahme als ihre originale .m4a-Datei exportieren und auf einem Computer öffnen, in einem Medienplayer oder Datei-Inspektor, der Audioformat-Details anzeigt statt nur einen Dateinamen und eine Größe. Ein solches Werkzeug liest die Zahl direkt aus der Datei und nennt sie unumwunden, meist als Wert in Hz direkt neben dem Codec-Namen.
Mit dieser Zahl in der Hand ist die Zuordnung zu einer Stufe exakt statt angenähert: 22.050 Hz ist Standard, 44.100 Hz ist Hoch, 48.000 Hz ist Ultra. Hier gibt es nicht die Unschärfe, die bei der Dateigröße besteht, weil die Abtastrate keine Schätzung von irgendetwas ist — sie ist der buchstäbliche Wert, mit dem die Aufnahme erfasst wurde, unverändert beim Exportieren, Teilen oder Verschieben der Datei an einen beliebigen anderen Ort.
Warum es sich selten lohnt, dem nachzugehen
Es lohnt sich, ehrlich zu sein, was die Antwort tatsächlich bringt, sobald man sie hat. Die Stufe, in der eine Aufnahme gemacht wurde, hat keinen Einfluss darauf, ob sie sich gut transkribieren lässt, wie sie bei der Wiedergabe klingt oder ob sie bei einer Suche auftaucht — all das verhält sich in Standard, Hoch und Ultra identisch, weil keine der drei Stufen etwas anderes berührt als die Feinheit, mit der das Signal beim Eingang gemessen wurde. Und eine Aufnahme, die sich als Standard herausstellt, lässt sich im Nachhinein auf keine Weise, die echtes Detail hinzufügt, in Hoch oder Ultra verwandeln; sie nachträglich hochzurechnen interpoliert nur zwischen bereits vorhandenen Punkten, ohne irgendetwas zurückzuholen, das die ursprüngliche Aufnahme nie gemessen hat. Die Stufe zu bestimmen, ist also eher eine Sache der Neugier oder einer Speicherplatz-Bestandsaufnahme als eine Reparatur — und das ist in Ordnung. Nicht jede Frage braucht eine praktische Konsequenz, um es wert zu sein, beantwortet zu werden.
Wie Voice Studio damit umgeht
Voice Studio zeigt aus dem oben genannten Grund nirgends in der App ein Qualitäts-Etikett pro Aufnahme an: Die Einstellung wird einmal angewendet, bei der Aufnahme, und nichts bei Wiedergabe, Suche oder Transkription muss sie danach kennen, um korrekt zu funktionieren. Beide oben beschriebenen Methoden funktionieren genau wie geschildert, weil die App eine Datei im Nachhinein nie neu kodiert — Teilen oder Exportieren einer Aufnahme gibt exakt die .m4a-Datei heraus, mit der aufgenommen wurde, Abtastrate inklusive, sodass ein Computer, der diese Datei liest, den echten, originalen Wert sieht und nichts auf dem Weg Verändertes. Die Qualitätseinstellung selbst lässt sich jederzeit ändern, ist nicht Pro vorbehalten, und gilt immer nur für die nächste Aufnahme.
Häufige Fragen
Zeigt Voice Studio an, mit welcher Qualitätseinstellung eine Aufnahme gemacht wurde?
Nein, dafür gibt es nirgends in der App ein Etikett. Die Abtastrate wird im Moment der Aufnahme in die Datei eingebacken, statt als separate Notiz gespeichert zu werden, die die App später anzeigen könnte.
Lässt sich die Qualitätsstufe allein am Klang der Aufnahme erkennen?
Nicht zuverlässig, und bei Sprache überhaupt nicht. Die Unterschiede zwischen Standard, Hoch und Ultra liegen in einem Frequenzbereich weit über dem, was eine gesprochene Stimme braucht, sodass die drei Stufen bei normaler Wiedergabe gleich klingen.
Was ist der schnellste Weg zu einer ungefähren Einschätzung?
Heute bei jeder der drei Einstellungen einen kurzen frischen Clip aufnehmen, die Dateigröße jeweils durch die Länge in Minuten teilen und diese drei Zahlen mit derselben Rechnung für die fragliche Aufnahme vergleichen. Die Stufe, der sie am nächsten kommt, ist meist die richtige.
Wie kommt man an die exakte Antwort statt an eine Schätzung?
Die Aufnahme als originale .m4a-Datei exportieren und auf einem Computer in einem Werkzeug öffnen, das Audioformat-Details anzeigt. Die genannte Abtastrate ordnet sich direkt einer Stufe zu: 22.050 Hz ist Standard, 44.100 Hz ist Hoch, 48.000 Hz ist Ultra.
In Voice Studio ausprobieren
Voice Studio nimmt auf, transkribiert im iPhone selbst und legt jede Notiz nach Zeit und Ort ab — damit der Gedanke aus dem Auto auch nächsten Monat noch auffindbar ist.
Kostenloser Download · iPhone und iPad · iOS 16.4 oder neuer