ИИ-транскрибация

Транскрибация аудио и видео
в текст, готовый к работе

Загрузите запись — получите текст с таймкодами и разделением по спикерам прямо из аудио. И тут же попросите саммари, задачи или перевод в том же чате.

Спикеры и таймкоды из аудиоФайлы до 2 часовПримерно первый час — бесплатноОплата в рублях

Как выглядит результат

Реальный формат вывода — диапазон таймкода, спикер, реплика — и что чат делает с ним дальше.

planerka-2026-08-05.m4a32:41 · русский · 3 спикера
00:12–00:19Спикер 1Давайте по релизу. Что с интеграцией оплаты — успеваем к пятнице?
00:19–00:31Спикер 2Бэкенд готов, остался вебхук. Если Марина отдаст макеты сегодня, к четвергу закрою.
00:31–00:40Спикер 3Макеты отдам после обеда, там правки по формам ввода.
00:40–00:52Спикер 1Тогда фиксируем: релиз в пятницу, за вебхук отвечает Игорь.

Формат вывода показан как есть: диапазон таймкода, спикер, реплика. Записи выше — демонстрационные.

Собери задачи и договорённости из этой записи
Задачи и решения
  • Игорь — доделать вебхук оплаты, до четверга
  • Марина — передать макеты форм ввода, сегодня после обеда
  • Релиз в пятницу — решение зафиксировано на 00:40
Или попросить

Кому и для чего

Запись — это сырьё. Работа начинается после расшифровки.

Блогеры и подкастеры

Выпуск превращается в шоу-ноуты, главы и статью. Таймкоды берутся из аудио, поэтому разметка глав реально совпадает.

Бизнес и продажи

Звонки, переговоры и планёрки становятся решениями, ответственными и письмом-итогом, а не полотном текста, которое никто не перечитает.

Исследования и HR

Интервью с болями, точными цитатами и таймкодом, откуда цитата взята. Несколько интервью сводятся в одну таблицу.

Обучение и курсы

Лекции и вебинары становятся конспектом, вопросами для проверки и текстом субтитров — по ним можно искать, а не пересматривать видео.

Что попросить после расшифровки

Нажмите на любой запрос — откроется чат с уже выбранным агентом транскрибации.

Что делает транскрибация

Структурированный вывод — и чат, который продолжает с ним работать.

Настоящие метки спикеров

Кто говорит — определяется по аудио, а не додумывается чатом. Надёжно для 2–6 голосов в одной записи.

Таймкод у каждой реплики

Каждая строка идёт с диапазоном [мм:сс–мм:сс], измеренным по аудио: можно вернуться ровно к нужному месту.

Саммари и задачи

Попросите резюме, решения, ответственных или возражения — у чата уже есть вся расшифровка целиком.

24 языка

Язык определяется автоматически или указывается вручную. Перевод расшифровки — в том же сообщении.

Текст, который заберёте с собой

Расшифровка сохраняется документом (обычный текст или Markdown), а субтитры выдаются SRT-текстом для вставки в .srt.

Просто загрузите файл

MP3, MP4, WAV, M4A, OGG, WebM. Крупные файлы сжимаются прямо в браузере перед загрузкой, поэтому длинные записи доходят.

Как это работает

Три шага от записи до результата, который можно применить.

01

Загрузите файл

Перетащите аудио или видео прямо в чат. Назовите имена и термины — они распознаются правильно.

02

Получите структурированную расшифровку

Распознавание возвращает спикеров и диапазоны таймкодов, чат раскладывает их в читаемые строки.

03

Продолжайте в том же чате

Саммари, задачи, перевод, субтитры или документ — попросите то, ради чего запись и делалась.

Twelver против альтернатив

Отдельный сервис транскрибации заканчивается на тексте. А работа с этого места только начинается.

TwelverСервис транскрибацииФрилансер
Спикеры и таймкоды
Вопросы к записи после расшифровкиОграниченно
Саммари, задачи, переводОграниченно
Дальше: документы, презентация, озвучка, видео
ОплатаОдин баланс, по минутам записиПодписка или пакеты минутЗа час записи
СрокиМинутыМинутыДень и больше

FAQ

MP3, MP4, WAV, M4A, OGG, WebM и большинство распространённых форматов. Загружается сам файл; если он слишком большой, браузер сожмёт его перед отправкой, поэтому длинные записи доходят целиком.
Нет. Агент расшифровывает только загруженные файлы и честно об этом скажет, а не сделает вид, что скачал. Сохраните аудио или видео и перетащите файл в чат.
Кто говорит, определяет модель распознавания речи, а не догадка чата — в тексте это метки «Спикер 1», «Спикер 2». Надёжно для 2–6 голосов; запись с одним голосом возвращается сплошным текстом, без искусственного деления.
Чёткая речь на поддерживаемом языке расшифровывается с пунктуацией и обычно не требует правки. Сильные акценты, перебивающие друг друга спикеры и шумное помещение снижают точность — так же, как у любого другого движка и у живого транскрибатора.
Расшифровку можно сохранить документом — обычным текстом или Markdown, — а таймкоды чат переоформит в SRT-субтитры текстом, который вы вставите в .srt-файл. Экспорта в DOCX и готового .srt-файла нет.
Русский, английский, испанский, немецкий, французский, португальский, итальянский, польский, украинский и ещё 20+. Язык определяется автоматически, а расшифровку можно перевести в том же чате.
Жёсткого ограничения нет, файлы до 2 часов обрабатываются хорошо. Более длинные записи занимают на несколько минут больше.
Транскрибация считается по длительности записи, а не по размеру файла: один и тот же час стоит одинаково при любом битрейте. Бесплатного стартового баланса хватает примерно на первый час вместе с ответом чата. Актуальные ставки — в блоке с ценами выше.

Готовы расшифровать запись?

Первая запись — бесплатно. Карта не нужна.

Уже в RuStore

Twelver — теперь и в приложении

Расшифровывайте аудио и видео в текст прямо с телефона.

Доступно в RuStoreДоступно в RuStore

Версия для iPhone уже в работе — поставьте +1, если ждёте.