स्क्राइबग्रैब

किसी भी ऑडियो या वीडियो को बदलें टेक्स्ट और उपशीर्षक में

मुफ्त, बिना पंजीकरण के, कोई वॉटरमार्क नहीं। एक घंटे की ऑडियो फ़ाइल में लगभग दो मिनट लगते हैं.

आपके पास कोई फ़ाइल नहीं है? नीचे एक लिंक पेस्ट करें। यूट्यूब लिंक उपशीर्षकों का अनुवाद 16 भाषाओं में किया जा सकता है।

या एक लिंक पेस्ट करें
अपलोड किया जा रहा है…

एक लिंक पेस्ट करें यूट्यूब लिंक और यह कुछ ही सेकंड में वापस आ जाता है — और यदि उस वीडियो में कोई उपशीर्षक नहीं हैं, तो भी हम उसे ट्रांसक्राइब करते हैं, जो कि अधिकांश उपकरणों के लिए मुश्किल होता है। साक्षात्कार, व्याख्यान, पॉडकास्ट, वॉयस मेमो: प्रत्येक 60 मिनट तक की फाइलें, किसी खाते की आवश्यकता नहीं, वॉटरमार्क नहीं।

रिकॉर्डिंग से लेकर ट्रांसक्रिप्ट तक

1. एक फ़ाइल अपलोड करें

कोई भी सामान्य ऑडियो या वीडियो प्रारूप। ट्रांसक्रिप्शन तुरंत शुरू होता है: किसी खाते की आवश्यकता नहीं, ईमेल की आवश्यकता नहीं, दैनिक सीमा नहीं।

2. यह उपकरण इसे लिखता है

एक स्पीच-रिकॉग्निशन मॉडल (व्हिस्पर) हमारे जीपीयू पर इसे ट्रांसक्राइब करता है, भाषा को स्वचालित रूप से पहचानता है और जब एक से अधिक आवाजें हों तो लेबल करता है कि कौन बोल रहा है, आमतौर पर वास्तविक समय से भी तेज।

3. डाउनलोड करें

सादा ट्रांसक्रिप्ट TXT के रूप में और टाइम-कोडेड उपशीर्षक SRT और VTT के रूप में प्राप्त करें। आपका अपलोड स्वचालित रूप से हटा दिया जाता है।

17 सेकंड, कुछ भी नहीं काटा गया: एक रिकॉर्डिंग डाली जाती है और एक ट्रांसक्रिप्ट के रूप में वापस आती है, जिसमें TXT, SRT और VTT डाउनलोड करने के लिए तैयार हैं।
ऑडियो ट्रांसक्राइब करें ट्रांसक्रिप्ट.txt 00:00 चैनल में आपका फिर से स्वागत है। 00:04 आज हम तीन अलग-अलग किफायती माइक्रोफ़ोन का परीक्षण कर रहे हैं।
बोले गए शब्दों को साफ, समयबद्ध टेक्स्ट में बदलता है: ट्रांसक्रिप्ट हर पंक्ति के लिए एक टाइमस्टैम्प रखता है।

तीन प्रकार की रिकॉर्डिंग

रचनाकार

वीडियो उपशीर्षक

यूट्यूब, रील्स और टिकटॉक के लिए एसआरटी/वीटीटी कैप्शन: प्रति मिनट भुगतान किए बिना पहुंच और व्यापक दर्शकों तक पहुंचने का तरीका।

कार्य और अध्ययन

साक्षात्कार और व्याख्यान

रिकॉर्ड किए गए साक्षात्कारों, बैठकों और व्याख्यानों को खोज योग्य पाठ में बदलें जिसे आप उद्धृत कर सकते हैं और सरसरी तौर पर पढ़ सकते हैं, वक्ता के अनुसार विभाजित किया गया ताकि आप जान सकें कि किसने क्या कहा।

पॉडकास्ट

शो नोट्स

प्रत्येक एपिसोड के लिए विस्तृत प्रतिलिपि ताकि आप इसे शो नोट्स और एसईओ के लिए उपयोग कर सकें: आपके एपिसोड में बोले गए हर शब्द को अनुक्रमित किया जा सकता है।

ट्रांसक्रिप्शन से संबंधित प्रश्न

क्या यह वास्तव में मुफ़्त है?

हाँ: कोई खाता नहीं, कोई वॉटरमार्क नहीं, प्रति मिनट शुल्क या दैनिक सीमा नहीं, और यह मुफ़्त टूल परीक्षण संस्करण नहीं है—यह समाप्त नहीं होता है और यह यहाँ मौजूद अन्य सभी उपकरणों की तरह ही काम करता है। विज्ञापन जीपीयू को चालू रखने में मदद करते हैं। एक वैकल्पिक अतिरिक्त सुविधा उपलब्ध है 5 यूरो का मासिक पास जिसमें मीटिंग नोट्स, वास्तविक वक्ता के नाम, वर्ड एक्सपोर्ट और उच्च सीमाएँ शामिल हैं। इससे आपको अधिक सुविधाएँ मिलती हैं ताकि आप अपने ट्रांसक्रिप्शन के साथ बेहतर काम कर सकें, न कि बेहतर ट्रांसक्रिप्शन प्राप्त करें।

मेरे फ़ाइल के साथ क्या होता है?

इसे हमारे सर्वर पर संसाधित किया जाता है और जैसे ही यह पूरा हो जाता है, तुरंत हटा दिया जाता है; परिणाम 45 मिनट के भीतर मिटा दिए जाते हैं। कुछ भी संग्रहीत, साझा या प्रशिक्षण के लिए उपयोग नहीं किया जाता है। कृपया देखें गोपनीयता नीति.

इसकी सटीकता कितनी है?

हम व्हिस्पर लार्ज-v3 का उपयोग करते हैं, जो सर्वश्रेष्ठ ओपन स्पीच-रिकॉग्निशन मॉडलों में से एक है। स्पष्ट भाषण को बहुत सटीक रूप से ट्रांसक्राइब किया जाता है; भारी उच्चारण, क्रॉसटॉक, पृष्ठभूमि शोर या खराब रिकॉर्डिंग किसी भी टूल के लिए अधिक कठिन होते हैं। हमेशा इसकी त्वरित समीक्षा करें।

क्या यह बताता है कि कौन बोल रहा है?

हाँ। जब यह एक से अधिक आवाज़ें सुनता है, तो यह स्वचालित रूप से ट्रांसक्रिप्शन को वक्ताओं में विभाजित कर देता है, अधिकतम आठ वक्ताओं तक, और इसके लिए कुछ भी चालू करने की आवश्यकता नहीं होती है। यही कारण है कि किसी साक्षात्कार या मीटिंग रिकॉर्डिंग को पढ़ने योग्य बनाया जा सकता है, बजाय कि एक लंबे पाठ के ब्लॉक के। लेबल का अनुमान एआई द्वारा लगाया जाता है, इसलिए क्रॉसटॉक या बहुत समान आवाज़ों पर उन्हें जल्दी से जांच लें।

क्या यह अभद्र भाषा को हटा सकता है?

हाँ। अपलोड करने से पहले "एक संपादित या उपशीर्षक वाला संस्करण भी बनाएं" पर टिक करें और आपको हर अभद्र शब्द के साथ एक दूसरी फ़ाइल वापस मिलेगी, जिसे बीप किया गया, म्यूट किया गया या काट दिया गया होगा। — इसके अलावा, यदि आप चाहें तो, "उम" और लंबी चुप्पी को भी हटाया जा सकता है। आप पहले टाइमस्टैम्प के साथ पूरी सूची देख सकते हैं और किसी भी शब्द को छोड़ सकते हैं। अधिक जानकारी अभद्र शब्दों को हटाना और अनावश्यक शब्दों को हटाना.

कौन सी भाषाएँ और फ़ाइलें?

लगभग 100 भाषाएँ, स्वचालित रूप से पता लगाई जाती हैं (या आप कोई एक चुन सकते हैं)। ऑडियो और वीडियो: MP3, WAV, M4A, FLAC, OGG, MP4, MOV, MKV, WEBM और अन्य, अधिकतम 2 जीबी और 60 मिनट तक।

क्या मैं किसी वीडियो के लिए उपशीर्षक प्राप्त कर सकता हूँ?

हाँ, सीधे वीडियो अपलोड करें और SRT या VTT फ़ाइल डाउनलोड करें। SRT को अपने वीडियो के बगल में रखें या इसे YouTube पर कैप्शन के रूप में अपलोड करें।

क्या आप उपशीर्षकों को स्वयं वीडियो में डाल सकते हैं?

हाँ। इंस्टाग्राम, टिकटॉक, व्हाट्सएप और अधिकांश टीवी एक अलग उपशीर्षक फ़ाइल को अनदेखा करते हैं, इसलिए अपलोड करने से पहले "एक संपादित या उपशीर्षक वाला संस्करण भी बनाएं" पर टिक करें, तीन शैलियों (क्लासिक, बॉक्स या बड़ा) में से किसी एक को चुनें और टेक्स्ट के साथ एक MP4 डाउनलोड करें जो चित्र में एकीकृत हो।कोई संपादक स्थापित करने की आवश्यकता नहीं है, कोई वॉटरमार्क नहीं है, और आपकी मूल फ़ाइल अपरिवर्तित रहती है। पूरी मार्गदर्शिका: किसी भी वीडियो में उपशीर्षक कैसे जोड़ें.

क्या आपको किसी गाने को अलग-अलग भागों में विभाजित करने की आवश्यकता है?

यह हमारा सहयोगी उपकरण है: StemGrab जो आवाज़, ड्रम, बास और वाद्य संगीत को अलग करता है, और यह भी मुफ़्त है।

सटीकता वास्तव में कहाँ कम हो जाती है?

जब कोई व्यक्ति स्पष्ट रूप से अंग्रेजी बोल रहा होता है, तो मॉडल लगभग सौ शब्दों में से अठानबे शब्द सही ढंग से पहचान लेता है — हमने स्वच्छ भाषण पर 1.94% शब्द त्रुटियाँ मापीं। तीन चीजें सबसे अधिक समस्या पैदा करती हैं। पहला, एक साथ दो लोगों का बोलना, क्योंकि मॉडल को उनमें से किसी एक को चुनना होता है। दूसरा, माइक्रोफ़ोन से दूरी, क्योंकि बैठक की मेज के दूसरी तरफ रखे फोन में आवाज़ की तुलना में कमरे की ध्वनि अधिक आती है। और तीसरा, असामान्य शब्दावली: नाम, ब्रांड, तकनीकी शब्द और संक्षिप्त रूप संदर्भ से अनुमान लगाए जाते हैं, इसलिए कोई ऐसा उपनाम जिसे मॉडल ने पहले कभी नहीं देखा है, वह कुछ ऐसा बन जाता है जो केवल उसी तरह लगता है। अधिकांश लोगों की अपेक्षा से बेहतर तरीके से मजबूत लहजे को संभाला जाता है; पृष्ठभूमि संगीत को इससे भी बदतर तरीके से संभाला जाता है।

अन्य मुफ़्त ट्रांसक्राइबरों में दैनिक सीमा क्यों नहीं है?

वाक् पहचान के लिए GPU समय की आवश्यकता होती है, और अधिकांश मुफ़्त ट्रांसक्राइबर इस समय को क्लाउड सेवा से प्रति मिनट ऑडियो के हिसाब से किराए पर लेते हैं — यही कारण है कि तीन फ़ाइलें प्रतिदिन और बीस मिनट की सीमा निर्धारित की गई है। हम हार्डवेयर के मालिक हैं: उसी ग्राफ़िक्स कार्ड हमारे अन्य उपकरणों को नीदरलैंड में चलाते हैं, इसलिए एक अतिरिक्त रिकॉर्डिंग की लागत बिजली होती है, न कि कोई बिल, और पृष्ठ पर विज्ञापन इसकी भरपाई करते हैं। यही कारण है कि फ़ाइलें अठानबे मिनट तक लंबी और दो गीगाबाइट तक हो सकती हैं, जितनी चाहें उतनी, बिना किसी खाते या ईमेल पते के।

स्क्राइबग्रैब का उपयोग करने के लोकप्रिय तरीके