অডিও এবং ভিডিও থেকে টেক্সট এবং সারাংশ — স্বয়ংক্রিয় স্পিচ ট্রান্সক্রিপশন, কী পয়েন্ট এক্সট্রাকশন এবং স্পিচ ক্লিনআপ

📂

অথবা যেকোনো অডিও/ভিডিও ফাইল নির্বাচন করুন (OGG, MP3, WAV, FLAC, M4A, MP4, WebM)

বক্তৃতা, মিটিং বা ভয়েস রেকর্ডিং সরাসরি আপনার ডিভাইসে প্রক্রিয়া করা হয়।

প্রথম ট্রান্সক্রিপশন একবার নির্বাচিত অফলাইন হুইস্পার মডেল ডাউনলোড করে, তারপর এটি ক্যাশে করা হয়। আপনার ফাইল কখনই আপনার ডিভাইস ছেড়ে যায় না।

📖 নির্দিষ্ট পদ এবং নামের শব্দভান্ডার (ঐচ্ছিক)

এটি ছাড়া, বিরল নাম, শিরোনাম এবং পেশাদার পদগুলি একই রকম দৈনন্দিন শব্দ হিসাবে স্বীকৃত হয়: একজন সহকর্মীর নাম দুটি সাধারণ শব্দে বিভক্ত হয়, একটি ব্র্যান্ড একটি এলোমেলো বিশেষ্যে পরিণত হয়, একটি বক্তৃতা শব্দটি পরিচিত অর্থহীনতায় পরিণত হয়। কমা দ্বারা পৃথক করা এই ধরনের শব্দগুলি এখানে তালিকাভুক্ত করুন, এবং মডেল তাদের আরও সঠিকভাবে চিনবে। বাকি বক্তৃতা অপ্রভাবিত: কিছুই বাদ দেওয়া হয় না বা তালিকার সাথে মেলাতে বাধ্য হয়।

দ্রুত সেট:

20-30 শব্দ একটি দীর্ঘ তালিকার চেয়ে ভাল কাজ করে: মডেলটি শুধুমাত্র প্রম্পটের শুরুতে পড়ে এবং বাকিগুলি ফেলে দেয়।

সবকিছু স্থানীয়ভাবে চলে — আপনার ফাইলগুলি কখনই আপনার কম্পিউটার ছেড়ে যায় না একটি বাগ পাওয়া বা একটি ধারণা আছে? [email protected]