Wiele informacji przekazywanych w trakcie rozmów ma znaczenie głównie w chwili, gdy padają dokładnie sprecyzowane słowa. Prędzej czy później pamięć uczestników może być niepełna, a ponowne odsłuchiwanie długiego pliku na prawdę często utrudnia szybkie odnalezienie potrzebnego fragmentu. Z tego powodu przygotowywana jest transkrypcja nagrań, czyli przeniesienie treści wypowiadanej w materiale audio albo wideo do formy pisemnej.
W zależności od rodzaju nagrania zapis może dotyczyć jednej osoby lub wieloosobowej rozmowy, a trudność pracy zmienia się wraz z jakością dźwięku. Przeciwnie wygląda materiał z wyraźną wymową i jednym rozmówcą, a inaczej spotkanie, podczas którego głosy nakładają się na siebie. Znaczenie mają także pauzy, urwane zdania, powtórzenia i fragmenty wypowiadane niewyraźnie (warto także zobaczyć: transkrypcja do sądu cennik). W takich wypadkach nie trzeba automatycznie zastępować niezrozumiałych słów swoją interpretacją, ponieważ nawet niewielka zmiana może wpłynąć na sens całej wypowiedzi.
Szczególnego znaczenia nabiera zapis materiału, który ma zostać zastosowany w sprawie formalnej. Transkrypcja do sądu powinna być przygotowywana z uwzględnieniem charakteru nagrania oraz celu, któremu ma służyć dokument. Istotne może być dokładne wskazanie rozmówców, zachowanie kolejności wypowiedzi a także możliwość odnalezienia konkretnego miejsca w materiale źródłowym. Przy dłuższych nagraniach pomocne są oznaczenia czasu, ponieważ pozwalają sprawdzić, z jakiego fragmentu pochodzi dana część zapisu. Nie zawsze prawidłowe jest również poprawianie języka osób mówiących. Wypowiedzi ustne różnią się od tekstu pisanego, dlatego występują w nich niedociągnięcia, powtórzenia czy zdania rozpoczęte i niedokończone. Ich nadmierne wygładzanie może spowodować, że dokument przestanie wiernie przedstawiać przebieg rozmowy. Sposób opracowania powinien zatem wynikać z tego, czego wymaga dokładnie sprecyzowane użycie materiału.
W praktyce bardzo dużo czasu może zająć nie samo wpisywanie słów, lecz rozstrzyganie miejsc problematycznych. Użyteczny stenogram nie powinien opierać się na zgadywaniu, gdy nagranie nie daje możliwość jednoznacznie ustalić wypowiedzi. Szum uliczny, odgłosy urządzeń, rozmowy prowadzone w tle czy duża odległość od mikrofonu potrafią sprawić, że pojedyncze słowo staje się skomplikowane do rozpoznania. Jeszcze większym wyzwaniem są sytuacje, w których rozmówcy mówią jednocześnie. Wtedy konieczne może być wielokrotne odsłuchanie krótkiego fragmentu i ranking go z kontekstem całej rozmowy. Kontekst pomaga zrozumieć wypowiedź, ale nie powinien być traktowany jako podstawa do dopisywania treści, której w rzeczywistości nie słychać. W dokumentach o charakterze formalnym zwłaszcza ważne jest rozdzielenie tego, co wynika wprost z nagrania, od tego, co mogłoby być tylko domysłem osoby wykonującej zapis.
Znaczenie ma także sposób przygotowania materiału przed rozpoczęciem pracy. Oryginalne nagranie powinno pozostać dostępne, ponieważ zapis tekstowy nie zastępuje źródła i w razie konieczności może wymagać porównania z konkretnym fragmentem audio albo wideo. Przydatne okazuje się również zachowanie jednolitego sposobu oznaczania osób, czasu a także fragmentów, których nie można wnikliwie odczytać. W sytuacji kilku godzin materiału warto zwracać uwagę na ciągłość zapisu, ponieważ zmiana oznaczenia jednego rozmówcy może w późniejszym czasie utrudnić interpretację całego dokumentu. Na prawdę istotna jest także jakość samego pliku. Kompresja, bardzo cichy dźwięk albo nagranie zrealizowane z sporej odległości mogą ograniczać dokładność zapisu niezależnie od sposobu jego opracowania. Dlatego przy ocenie gotowego dokumentu trzeba brać pod uwagę nie tylko i wyłącznie formę tekstu, lecz też możliwości i ograniczenia materiału, z którego został on sporządzony.
Więcej: stenogram.