STT (распознавание речи)
Преобразование звучащей речи в текст.
Speech-to-Text расшифровывает аудио и видео. Ключевые характеристики — точность на нужном языке, разделение говорящих и расстановка таймкодов. Открытая модель Whisper сделала качественную транскрибацию бесплатной и доступной локально.
Связанные термины
Хотите не только понять термин, но и выбрать инструмент? Откройте каталог нейросетей с фильтрами по доступу и цене.