Как расшифровать интервью: от записи до цитаты
Расшифровать интервью — это не только получить текст, но и сохранить путь от каждой цитаты обратно к звуку. Ниже порядок работы для журналистов, редакторов, UX-исследователей и студентов: запись и согласие, автоматический черновик, проверка, цитаты, обезличивание и хранение.
Чтение примерно 10 мин · обновлено 2026-09-28
Сначала решите, зачем нужен текст
От цели зависит всё остальное: как записывать, какой вариант расшифровки делать, что проверять и сколько хранить. Одна и та же часовая беседа для газетной заметки, для диссертации и для продуктового исследования превращается в три разных документа.
Решите это до встречи. Из дословного текста очищенный делается обычной редактурой, а обратно — только повторным прослушиванием всей записи.
| Задача | Какой текст нужен | Что проверять в первую очередь | Формат |
|---|---|---|---|
| Интервью для СМИ | Очищенный, цитаты сверены дословно | Цитаты, имена, должности, цифры | DOCX |
| Диссертация, качественное исследование | Дословный по методике проекта | Смену говорящего, оговорки, паузы, если они входят в анализ | DOCX или TXT для программы кодирования |
| UX-интервью с пользователем | Очищенный с таймкодами | Формулировки проблем и оценок, названия продуктов, реплики модератора | DOCX, CSV или Markdown для заметок команды |
| Видеоинтервью, подкаст | Текст и субтитры | Имена в титрах, синхронизацию с картинкой | SRT или VTT |
Запись: что настроить до начала разговора
Главное правило — микрофон ближе к тому, кого вы будете цитировать. Телефон на столе между вами в тихой комнате обычно даёт разборчивый текст; тот же телефон в кармане пиджака или у открытого окна — нет. Музыка в кафе, пустая переговорка с голыми стенами и кондиционер над головой отнимают больше слов, чем любая разница между приложениями-диктофонами.
Сделайте пробу на месте: 20–30 секунд разговора, прослушайте их в наушниках. Если собеседника слышно хуже, чем вас, передвиньте телефон к нему. Для встречи, которую нельзя повторить, включайте запись на двух устройствах: второй файл выручит, если первый оборвётся на звонке или окажется заглушён.
Онлайн-интервью записывайте средствами самой платформы. Zoom при локальной записи кладёт в папку встречи файл audio_only.m4a, а в настройках можно включить отдельную дорожку на каждого участника. Телемост сохраняет запись в WebM. Раздельные дорожки полезны для спорных мест, но для общего текста с репликами обоих собеседников загружайте общий файл встречи.
Во время разговора отмечайте время ключевых ответов в блокноте: «14:30 — про увольнение». Пять таких пометок потом приведут к нужным цитатам быстрее, чем поиск по тексту.
Согласие на запись
Предупредите собеседника, что разговор записывается, и зафиксируйте согласие в самой записи — первой фразой после включения диктофона. Так согласие и материал хранятся вместе, и через полгода не придётся искать переписку.
Для журналиста порядок использования скрытой записи описан в законе о СМИ (статья 50), а редакционные стандарты нередко строже закона. В исследовании согласие обычно оформляют письменно: что записывается, у кого будет доступ, сколько хранится запись и как будут цитировать участника. Требования этического комитета, университета или заказчика важнее любых общих советов.
Это не юридическая консультация. Если ситуация спорная — скрытая запись, голоса третьих лиц, публикация персональных данных, — спросите юриста редакции или организации до публикации, а не после.
Дословно или очищенно
Дословная расшифровка сохраняет всё: «э-э», повторы, оборванные фразы, самопоправки. Она нужна, когда анализируют саму речь и когда цитату могут оспорить. Очищенная убирает шум устной речи и читается как текст, но не меняет смысл, порядок мыслей и степень уверенности говорящего.
Практичный компромисс для редакции — очищенный текст целиком и дословная сверка только тех фрагментов, которые пойдут в кавычки. В исследовании режим задаёт методика; запишите его в шапку документа, чтобы через год было понятно, с чем работали аналитики.
Автоматическое распознавание даёт третий вариант — машинный черновик. Он ближе к дословному, но не равен ему: модель может пропустить междометие, съесть повтор или расставить знаки препинания по-своему. Отдельного переключателя «дословно или очищенно» в Транскрибе нет: очищенную версию делает редактор.
Автоматическая расшифровка: что она даёт и сколько стоит
Вручную час интервью обычно набирают за 4–6 часов — это распространённая отраслевая оценка, а не норматив: чистая запись со спокойной речью идёт быстрее, шумная и с перебиваниями — дольше. Автоматическое распознавание переносит основное время с набора на проверку.
В Транскрибе загрузите файл или вставьте ссылку на публичный ролик VK Видео или Rutube. Для интервью включите в настройках разделение по голосам: в тексте появятся метки «Спикер 1», «Спикер 2» и таймкоды реплик. Русскую речь распознаёт открытая модель GigaAM v3 от Сбера; как она выглядит рядом с Whisper на публичном бенчмарке, разобрано в отдельной статье.
Цена считается по длительности записи: 3 ₽ за минуту при разовой оплате, то есть 180 ₽ за часовое интервью. В пакетах минута дешевле — от 1,83 ₽/мин, или около 110 ₽ за час. Купленные минуты не сгорают, подписки нет. До оплаты можно бесплатно расшифровать фрагмент до 60 секунд и посмотреть, как сервис справляется именно с вашим диктофоном и вашим собеседником.
Если интервью несколько, соберите их в проект: сервис заранее покажет общую длительность и сумму.
Что проверять руками
Машинный текст ошибается не равномерно, а в предсказуемых местах. Не вычитывайте всё с одинаковым вниманием: пройдите по списку ниже, остальное читайте как обычный текст и возвращайтесь к звуку там, где фраза звучит неестественно.
- Имена и фамилии. Модель пишет то, что слышит, и незнакомую фамилию может превратить в похожее слово. Попросите собеседника в начале записи назвать имя, фамилию и должность — этот фрагмент станет эталоном написания.
- Числа, даты, суммы и проценты. «Пятнадцать» и «пятьдесят» на плохой записи легко путаются. Любое число, которое попадёт в материал, сверяйте по звуку.
- Термины, аббревиатуры, названия компаний и продуктов. Составьте короткий глоссарий до расшифровки и пройдитесь поиском по каждому слову.
- Отрицания и оговорки. Пропущенное «не» или потерянное «пока» переворачивает смысл, а текст при этом остаётся гладким и не вызывает подозрений.
- Одновременная речь. Когда собеседники перебивают друг друга, слова одного могут попасть в реплику другого, а короткое «да» — не тому спикеру.
- Начало и конец записи. Там говорят на ходу, в стороне от микрофона — а нередко звучит и «это не под запись».
Проверка и правка на странице расшифровки
На странице готового текста есть поиск, а клик по таймкоду включает запись с нужного места — сверять можно без отдельного плеера и ручной перемотки. Правки вносятся прямо в реплики в режиме редактирования и сохраняются в расшифровке.
Спикеров там же можно переименовать: «Спикер 1» становится «Анной Петровой» или кодом «У07», и новые имена попадают в скачанные документы. Для исследования сразу ставьте коды участников, а не имена.
Спикеры: где метки ошибаются
Автоматическое разделение по голосам опирается на тембр и паузы и не знает, кто есть кто. Сначала сопоставьте метки с людьми по первым репликам, затем проверьте три типа мест: сразу после перебиваний, после длинного монолога одного собеседника и там, где голоса похожи.
Если интервью вели двое, решите заранее, нужно ли их различать в тексте или хватит общей роли «Интервьюер». В разговоре на троих и больше спорных реплик обычно прибавляется — закладывайте на спикеров больше времени.
Для онлайн-разговоров на Mac есть бета-версия приложения Транскрибы: оно записывает ваш микрофон и звук собеседников прямо с компьютера, без бота, который подключается к звонку. Постороннего «ассистента» в списке участников не будет, но предупредить собеседника о записи всё равно нужно.
Таймкоды и поиск цитат
Таймкод — это адрес цитаты. Пока каждый важный фрагмент связан со временем в исходном файле, любую фразу можно переслушать за секунды: редактору, который сомневается, юристу, который проверяет, или вам самим через год.
Порядок, который экономит время: прочитайте текст целиком и отметьте кандидатов в цитаты, затем каждого переслушайте с 10–15 секундами до и после и только потом переносите в материал. Держите таймкод рядом с цитатой в черновике до самой публикации.
На странице расшифровки для этого есть блок «Интервью для редактора». Он предлагает черновой план из реплик с вопросами, помогает найти и отметить до 20 цитат и скачивает Word: сверху план и выбранные цитаты с таймкодами, ниже полный текст. План собран из выдержек самого текста, а не пересказан нейросетью, поэтому заголовки стоит поправить вручную.
Как проверить цитату перед публикацией
Цитата может быть дословно точной и всё равно искажать смысл. Прежде чем ставить кавычки, ответьте на четыре вопроса.
- Это слова именно этого человека? Проверьте говорящего по голосу, а не по метке.
- На какой вопрос он отвечал? «Да, безусловно» в ответ на наводящий вопрос и на нейтральный — разные цитаты.
- Что прозвучало до и после? Условие («если бюджет утвердят»), оговорка («я не уверен, но…») или отрицание в соседней фразе меняют вес сказанного.
- Что вы убрали? Сокращение внутри цитаты обозначайте и не склеивайте части разных ответов в одну фразу.
| Как в записи | Как нельзя цитировать | Почему |
|---|---|---|
| «Если бюджет утвердят, откроем филиал весной» | «Откроем филиал весной» | Потеряно условие |
| «Я бы не сказал, что проект провалился, но сроки сорваны» | «Проект провалился, сроки сорваны» | Отрицание превратилось в утверждение |
| Ответ на вопрос «Вы жалеете о решении?» — «Иногда» | «Иногда жалею о решении» | Без вопроса реплика получила чужие слова |
Согласование цитат
Согласовывать ли цитаты с собеседником — вопрос редакционной политики и договорённостей, а не техники. Если согласуете, отправляйте фрагмент вместе с таймкодом и сохраняйте версии до и после правок собеседника: при споре станет видно, что было сказано, а что добавлено позже.
Обезличивание для исследований
В UX- и академических исследованиях в отчёт попадают цитаты, а не люди. Обезличивайте копию текста, а исходную расшифровку и запись храните отдельно с ограниченным доступом.
Одного имени мало. Человека выдают должность и работодатель, город, редкие события («когда нас в марте купил конкурент»), имена коллег и родственников, названия внутренних систем. Заменяйте их обобщениями в квадратных скобках: [участник 3], [крупный банк], [региональный центр].
Ищите по основе слова, а не по полному имени: «Марина», «Марину» и «Мариной» — три разные строки, и автозамена одной формы пропустит остальные. Таблицу соответствия кодов и людей держите отдельно от текстов.
Если методика или договор запрещают передавать записи внешним сервисам, выясните, где идёт обработка. В Транскрибе исходники хранятся в Cloud.ru, но распознавание выполняется за пределами российского контура. При строгих требованиях к локализации выбирайте локальную модель на своём компьютере.
Какой формат скачать
Одну и ту же расшифровку можно скачать в разных форматах, повторно платить за это не нужно. Выбирайте по тому, что будет с текстом дальше.
| Формат | Когда нужен |
|---|---|
| DOCX | Редактура, комментарии, согласование с редактором или научным руководителем |
| TXT с таймкодами и спикерами | Импорт в программы качественного анализа, сравнение версий, архив, который откроется чем угодно |
| TXT сплошным текстом | Чтение и отправка собеседнику, когда таймкоды мешают |
| SRT, VTT | Субтитры к видеоинтервью; VTT — для веб-плееров |
| Печать и отправка без правок | |
| Markdown, CSV, JSON | Заметки в Obsidian или Notion, таблица реплик в Excel, обработка скриптом |
Где и как хранить записи
Исходный файл — главный документ интервью. Сохраните его под понятным именем с датой и не редактируйте: обрезку, шумоподавление и конвертацию делайте в копии. Держите две копии в разных местах, например на рабочем диске и в облаке организации.
Срок хранения определите заранее. В исследовании его обычно задаёт форма согласия, в редакции — внутренние правила на случай претензий к публикации. Когда срок вышел, удаляйте всё сразу: запись, расшифровку и рабочие копии.
Если текст нужен коллеге, в Транскрибе можно создать ссылку на расшифровку без аудио: она действует 30 дней, её можно отозвать раньше. Когда материал больше не нужен в сервисе, удалите его из истории.
Сколько времени закладывать
Замерьте время на первом интервью серии: сколько ушло на проверку, спикеров и цитаты. Для остальных записей того же формата эта цифра будет надёжнее любой общей оценки.
| Этап | Вручную | С автоматической расшифровкой |
|---|---|---|
| Набор текста | Ориентир — 4–6 часов на час записи | Ожидание обработки без вашего участия |
| Имена, числа, термины | Проверяются по ходу набора | Проход по списку и поиску; время зависит от звука |
| Спикеры | Размечаются по ходу набора | Сопоставить метки и проверить перебивания |
| Цитаты | Переслушать каждую | Переслушать каждую — этот шаг не автоматизируется |
Голосовые ответы и короткие комментарии
Часть комментариев приходит не на встрече, а голосовыми в мессенджере. Их удобно переслать боту @TranskribaBot: он вернёт текст в чат, а длинную расшифровку пришлёт файлом. Сами голосовые сохраните — это такой же исходник, как запись встречи.
Чек-лист: от записи до цитаты
Скопируйте список в заметки перед первым интервью серии и проходите его для каждой записи.
- Цель текста определена: публикация, исследование или архив
- Выбран режим: дословный, очищенный или очищенный с дословной сверкой цитат
- Собеседник предупреждён, согласие есть в записи или в подписанной форме
- Пробная запись прослушана в наушниках, микрофон стоит ближе к собеседнику
- Запись идёт на два устройства, у онлайн-встречи сохранён общий файл
- Во время разговора помечено время ключевых ответов
- Исходник сохранён без изменений в двух местах
- Составлен список имён, терминов и чисел для проверки
- Метки спикеров сопоставлены с людьми или кодами участников
- Каждая цитата переслушана с контекстом, рядом с ней стоит таймкод
- Для исследования копия обезличена, таблица кодов хранится отдельно
- Скачан нужный формат, срок хранения и удаления записан
Частые вопросы
Сколько времени занимает расшифровка часового интервью?
Вручную — ориентировочно 4–6 часов только на набор. С автоматическим распознаванием набор заменяется ожиданием обработки, а работа сводится к проверке имён, чисел, спикеров и цитат; её длительность зависит от качества звука и количества цитат.
Нужно ли переслушивать всю запись после автоматической расшифровки?
Не обязательно целиком. Переслушайте места из списка проверки — имена, числа, перебивания, начало и конец записи — и каждую цитату для публикации. Фраза, которая при чтении звучит неестественно, тоже повод вернуться к звуку по таймкоду.
Как расшифровать глубинное интервью для UX-исследования?
Запишите разговор с согласием участника, получите текст с таймкодами и разделением по голосам, замените метки спикеров кодами, обезличьте копию и отберите цитаты с таймкодами для отчёта. Формулировки пользователя не улучшайте: в исследовании важны его собственные слова.
Можно ли расшифровать интервью, записанное на телефон?
Да. Файл из диктофона смартфона загружается как есть, конвертировать его не нужно. Перед длинной записью сделайте короткую пробу в том же месте: так станет понятно, хватает ли расстояния до собеседника.