मुफ्त, बिना पंजीकरण के, कोई वॉटरमार्क नहीं। एक घंटे की ऑडियो फ़ाइल में लगभग दो मिनट लगते हैं.
आपके पास कोई फ़ाइल नहीं है? नीचे एक लिंक पेस्ट करें। यूट्यूब लिंक उपशीर्षकों का अनुवाद 16 भाषाओं में किया जा सकता है।
एक लिंक पेस्ट करें यूट्यूब लिंक और यह कुछ ही सेकंड में वापस आ जाता है — और यदि उस वीडियो में कोई उपशीर्षक नहीं हैं, तो भी हम उसे ट्रांसक्राइब करते हैं, जो कि अधिकांश उपकरणों के लिए मुश्किल होता है। साक्षात्कार, व्याख्यान, पॉडकास्ट, वॉयस मेमो: प्रत्येक 60 मिनट तक की फाइलें, किसी खाते की आवश्यकता नहीं, वॉटरमार्क नहीं।
कोई भी सामान्य ऑडियो या वीडियो प्रारूप। ट्रांसक्रिप्शन तुरंत शुरू होता है: किसी खाते की आवश्यकता नहीं, ईमेल की आवश्यकता नहीं, दैनिक सीमा नहीं।
एक स्पीच-रिकॉग्निशन मॉडल (व्हिस्पर) हमारे जीपीयू पर इसे ट्रांसक्राइब करता है, भाषा को स्वचालित रूप से पहचानता है और जब एक से अधिक आवाजें हों तो लेबल करता है कि कौन बोल रहा है, आमतौर पर वास्तविक समय से भी तेज।
सादा ट्रांसक्रिप्ट TXT के रूप में और टाइम-कोडेड उपशीर्षक SRT और VTT के रूप में प्राप्त करें। आपका अपलोड स्वचालित रूप से हटा दिया जाता है।
इस पृष्ठ पर जो कुछ भी है वह संपूर्ण टूल है, कोई परीक्षण संस्करण नहीं। एक पास ट्रांसक्रिप्शन को नहीं बदलता और न ही ट्रांसक्रिप्ट को बेहतर बनाता है — यह केवल उस चीज़ में सुधार करता है जो आप ट्रांसक्रिप्ट के साथ करते हैं। बाद में.
यह संपूर्ण उपकरण है, परीक्षण संस्करण नहीं। सदस्यता के साथ मिलने वाले मॉडल और प्रतिलिपि समान हैं — यहां कुछ भी बंद नहीं किया गया है।
यह कार्य पोलर द्वारा किया जाता है, जो हमारा भुगतान प्रदाता है — वे भुगतान और वैट का प्रबंधन करते हैं। यहां कोई खाता बनाने की आवश्यकता नहीं है: आपका पास इस ब्राउज़र में संग्रहीत रहता है।
यूट्यूब, रील्स और टिकटॉक के लिए एसआरटी/वीटीटी कैप्शन: प्रति मिनट भुगतान किए बिना पहुंच और व्यापक दर्शकों तक पहुंचने का तरीका।
रिकॉर्ड किए गए साक्षात्कारों, बैठकों और व्याख्यानों को खोज योग्य पाठ में बदलें जिसे आप उद्धृत कर सकते हैं और सरसरी तौर पर पढ़ सकते हैं, वक्ता के अनुसार विभाजित किया गया ताकि आप जान सकें कि किसने क्या कहा।
प्रत्येक एपिसोड के लिए विस्तृत प्रतिलिपि ताकि आप इसे शो नोट्स और एसईओ के लिए उपयोग कर सकें: आपके एपिसोड में बोले गए हर शब्द को अनुक्रमित किया जा सकता है।
हाँ: कोई खाता नहीं, कोई वॉटरमार्क नहीं, प्रति मिनट शुल्क या दैनिक सीमा नहीं, और यह मुफ़्त टूल परीक्षण संस्करण नहीं है—यह समाप्त नहीं होता है और यह यहाँ मौजूद अन्य सभी उपकरणों की तरह ही काम करता है। विज्ञापन जीपीयू को चालू रखने में मदद करते हैं। एक वैकल्पिक अतिरिक्त सुविधा उपलब्ध है 5 यूरो का मासिक पास जिसमें मीटिंग नोट्स, वास्तविक वक्ता के नाम, वर्ड एक्सपोर्ट और उच्च सीमाएँ शामिल हैं। इससे आपको अधिक सुविधाएँ मिलती हैं ताकि आप अपने ट्रांसक्रिप्शन के साथ बेहतर काम कर सकें, न कि बेहतर ट्रांसक्रिप्शन प्राप्त करें।
इसे हमारे सर्वर पर संसाधित किया जाता है और जैसे ही यह पूरा हो जाता है, तुरंत हटा दिया जाता है; परिणाम 45 मिनट के भीतर मिटा दिए जाते हैं। कुछ भी संग्रहीत, साझा या प्रशिक्षण के लिए उपयोग नहीं किया जाता है। कृपया देखें गोपनीयता नीति.
हम व्हिस्पर लार्ज-v3 का उपयोग करते हैं, जो सर्वश्रेष्ठ ओपन स्पीच-रिकॉग्निशन मॉडलों में से एक है। स्पष्ट भाषण को बहुत सटीक रूप से ट्रांसक्राइब किया जाता है; भारी उच्चारण, क्रॉसटॉक, पृष्ठभूमि शोर या खराब रिकॉर्डिंग किसी भी टूल के लिए अधिक कठिन होते हैं। हमेशा इसकी त्वरित समीक्षा करें।
हाँ। जब यह एक से अधिक आवाज़ें सुनता है, तो यह स्वचालित रूप से ट्रांसक्रिप्शन को वक्ताओं में विभाजित कर देता है, अधिकतम आठ वक्ताओं तक, और इसके लिए कुछ भी चालू करने की आवश्यकता नहीं होती है। यही कारण है कि किसी साक्षात्कार या मीटिंग रिकॉर्डिंग को पढ़ने योग्य बनाया जा सकता है, बजाय कि एक लंबे पाठ के ब्लॉक के। लेबल का अनुमान एआई द्वारा लगाया जाता है, इसलिए क्रॉसटॉक या बहुत समान आवाज़ों पर उन्हें जल्दी से जांच लें।
हाँ। अपलोड करने से पहले "एक संपादित या उपशीर्षक वाला संस्करण भी बनाएं" पर टिक करें और आपको हर अभद्र शब्द के साथ एक दूसरी फ़ाइल वापस मिलेगी, जिसे बीप किया गया, म्यूट किया गया या काट दिया गया होगा। — इसके अलावा, यदि आप चाहें तो, "उम" और लंबी चुप्पी को भी हटाया जा सकता है। आप पहले टाइमस्टैम्प के साथ पूरी सूची देख सकते हैं और किसी भी शब्द को छोड़ सकते हैं। अधिक जानकारी अभद्र शब्दों को हटाना और अनावश्यक शब्दों को हटाना.
लगभग 100 भाषाएँ, स्वचालित रूप से पता लगाई जाती हैं (या आप कोई एक चुन सकते हैं)। ऑडियो और वीडियो: MP3, WAV, M4A, FLAC, OGG, MP4, MOV, MKV, WEBM और अन्य, अधिकतम 2 जीबी और 60 मिनट तक।
हाँ, सीधे वीडियो अपलोड करें और SRT या VTT फ़ाइल डाउनलोड करें। SRT को अपने वीडियो के बगल में रखें या इसे YouTube पर कैप्शन के रूप में अपलोड करें।
हाँ। इंस्टाग्राम, टिकटॉक, व्हाट्सएप और अधिकांश टीवी एक अलग उपशीर्षक फ़ाइल को अनदेखा करते हैं, इसलिए अपलोड करने से पहले "एक संपादित या उपशीर्षक वाला संस्करण भी बनाएं" पर टिक करें, तीन शैलियों (क्लासिक, बॉक्स या बड़ा) में से किसी एक को चुनें और टेक्स्ट के साथ एक MP4 डाउनलोड करें जो चित्र में एकीकृत हो।कोई संपादक स्थापित करने की आवश्यकता नहीं है, कोई वॉटरमार्क नहीं है, और आपकी मूल फ़ाइल अपरिवर्तित रहती है। पूरी मार्गदर्शिका: किसी भी वीडियो में उपशीर्षक कैसे जोड़ें.
यह हमारा सहयोगी उपकरण है: StemGrab जो आवाज़, ड्रम, बास और वाद्य संगीत को अलग करता है, और यह भी मुफ़्त है।
जब कोई व्यक्ति स्पष्ट रूप से अंग्रेजी बोल रहा होता है, तो मॉडल लगभग सौ शब्दों में से अठानबे शब्द सही ढंग से पहचान लेता है — हमने स्वच्छ भाषण पर 1.94% शब्द त्रुटियाँ मापीं। तीन चीजें सबसे अधिक समस्या पैदा करती हैं। पहला, एक साथ दो लोगों का बोलना, क्योंकि मॉडल को उनमें से किसी एक को चुनना होता है। दूसरा, माइक्रोफ़ोन से दूरी, क्योंकि बैठक की मेज के दूसरी तरफ रखे फोन में आवाज़ की तुलना में कमरे की ध्वनि अधिक आती है। और तीसरा, असामान्य शब्दावली: नाम, ब्रांड, तकनीकी शब्द और संक्षिप्त रूप संदर्भ से अनुमान लगाए जाते हैं, इसलिए कोई ऐसा उपनाम जिसे मॉडल ने पहले कभी नहीं देखा है, वह कुछ ऐसा बन जाता है जो केवल उसी तरह लगता है। अधिकांश लोगों की अपेक्षा से बेहतर तरीके से मजबूत लहजे को संभाला जाता है; पृष्ठभूमि संगीत को इससे भी बदतर तरीके से संभाला जाता है।
वाक् पहचान के लिए GPU समय की आवश्यकता होती है, और अधिकांश मुफ़्त ट्रांसक्राइबर इस समय को क्लाउड सेवा से प्रति मिनट ऑडियो के हिसाब से किराए पर लेते हैं — यही कारण है कि तीन फ़ाइलें प्रतिदिन और बीस मिनट की सीमा निर्धारित की गई है। हम हार्डवेयर के मालिक हैं: उसी ग्राफ़िक्स कार्ड हमारे अन्य उपकरणों को नीदरलैंड में चलाते हैं, इसलिए एक अतिरिक्त रिकॉर्डिंग की लागत बिजली होती है, न कि कोई बिल, और पृष्ठ पर विज्ञापन इसकी भरपाई करते हैं। यही कारण है कि फ़ाइलें अठानबे मिनट तक लंबी और दो गीगाबाइट तक हो सकती हैं, जितनी चाहें उतनी, बिना किसी खाते या ईमेल पते के।