Сashsound AI
Полный анализ
Узнать BPM
Узнать тональность
Slowed + Reverb
Настроение бита
Аудио конвертер
Ускорить трек
Извлеч стемыFree trial
Удалить вокалFree trial
ТранскрибацияFree trial
Блог
Сashsound AI
Полный анализ
Узнать BPM
Узнать тональность
Slowed + Reverb
Настроение бита
Аудио конвертер
Ускорить трек
Извлеч стемыFree trial
Удалить вокалFree trial
ТранскрибацияFree trial
Блог

Транскрибация аудио и видео в текст

Расшифровка речи в текст с помощью AI. Поддержка 90+ языков, диаризация спикеров, таймкоды и AI-саммари. Загрузите файл или вставьте ссылку на видео.
Free trial
1 Кэшкоин / минута аудио

Тестируйте транскрибацию бесплатно в режиме free trial. Кэшкоины подключим чуть позже.

Распознавать спикеров (диаризация) — обработка займёт больше времени

Перетащите файл сюда или

MP3, WAV, OGG, FLAC, M4A, AAC, WEBM, MP4, MKV, AVI, MOV

Возможности

90+ языков

Автоопределение языка и поддержка более 90 языков распознавания

Диаризация спикеров

Автоматическое разделение речи по спикерам с возможностью переименования

Быстрая обработка

1 час аудио за 30–60 секунд на мощных GPU-серверах

Экспорт без боли

TXT, SRT, VTT и JSON уже готовы, DOCX, PDF и XLSX скоро подтянем

Генерация субтитров

SRT и VTT уже работают, ASS и тонкие настройки субтитров скоро добавим

AI-саммари и чат

Краткое резюме, AI-чат по расшифровке и отчёты по ролям

Как это работает

1

Загрузите файл

Перетащите аудио или видео файл, либо вставьте ссылку на видео

2

AI обрабатывает

Whisper large-v3 распознаёт речь, определяет спикеров и расставляет таймкоды

3

Получите результат

Копируйте текст, скачивайте доступные форматы и забирайте субтитры без лишней боли

Поддерживаемые форматы

Аудио

MP3WAVOGGFLACM4AWMAAACWEBM

Видео

MP4MKVAVIMOV

Платформы

YouTubeVK VideoRutubeДзенTikTok

Часто задаваемые вопросы