Аудіо та відео в текст і резюме — автоматична транскрипція мовлення, виділення ключових моментів і очищення мовлення
Або виберіть будь-який аудіо/відео файл (OGG, MP3, WAV, FLAC, M4A, MP4, WebM)
Лекція, зустріч або запис голосу обробляються безпосередньо на вашому пристрої.
Перша транскрипція завантажує вибрану автономну модель Whisper один раз, а потім її кешують. Ваш файл ніколи не залишає ваш пристрій.
📖 Словник конкретних термінів і імен (необов'язково)
Без нього рідкісні імена, назви та професійні терміни розпізнаються як подібні повсякденні слова: ім'я колеги розпадається на два загальних слова, бренд перетворюється на випадковий іменник, лекційний термін - на звичну нісенітницю. Перелічіть тут такі слова, розділивши їх комами, і модель розпізнає їх точніше. Решта мовлення не змінюється: нічого не опускається та не примусово збігається зі списком.
Швидкий набір:
20–30 слів працюють краще, ніж довгий список: модель читає лише початок підказки та пропускає решту.
Ім'я чи термін розпізнано неправильно?