Аудіо та відео в текст і резюме — автоматична транскрипція мовлення, виділення ключових моментів і очищення мовлення

📂

Або виберіть будь-який аудіо/відео файл (OGG, MP3, WAV, FLAC, M4A, MP4, WebM)

Лекція, зустріч або запис голосу обробляються безпосередньо на вашому пристрої.

Перша транскрипція завантажує вибрану автономну модель Whisper один раз, а потім її кешують. Ваш файл ніколи не залишає ваш пристрій.

📖 Словник конкретних термінів і імен (необов'язково)

Без нього рідкісні імена, назви та професійні терміни розпізнаються як подібні повсякденні слова: ім'я колеги розпадається на два загальних слова, бренд перетворюється на випадковий іменник, лекційний термін - на звичну нісенітницю. Перелічіть тут такі слова, розділивши їх комами, і модель розпізнає їх точніше. Решта мовлення не змінюється: нічого не опускається та не примусово збігається зі списком.

Швидкий набір:

20–30 слів працюють краще, ніж довгий список: модель читає лише початок підказки та пропускає решту.

Усе працює локально — ваші файли ніколи не залишають ваш комп’ютер Знайшли помилку чи є ідея? [email protected]