Read Aloud और PDF से ऑडियोबुक
pdf को ऑडियोबुक या किसी भी दस्तावेज़ को बोले गए ऑडियो में बदलें — Read Aloud MP3 बनाती है, Document to Audiobook चैप्टर वाली M4B बनाती है, सब डिवाइस पर।
1FileTool में PDF से ऑडियोबुक कन्वर्ज़न दो क्लिक है: दस्तावेज़ AI Tools › Document to Audiobook पर ड्रॉप करें तो आपको चैप्टर मार्क वाली M4B मिलती है जो किसी भी ऑडियोबुक ऐप में चलती है, या दस्तावेज़ या टेक्स्ट की सीधी MP3 के लिए Read Aloud चुनें। स्पीच डिवाइस पर बनती है — आवाज़ डाउनलोड होने के बाद कोई इंटरनेट शामिल नहीं।
पहले अपनी ओरिजिनल फ़ाइलें सुरक्षित करें
Replace source डिफ़ॉल्ट ऑन है: आउटपुट ओरिजिनल फ़ाइल को ओवरराइट करती है और कोई बैकअप नहीं रखा जाता। साथ चलने से पहले, Settings › General खोलें और Replace source ऑफ करें, या एक अलग आउटपुट फ़ोल्डर चुनें।
ऑडियो फ़ाइलें आपके आउटपुट फ़ोल्डर में नई फ़ाइलों के रूप में लिखी जाती हैं; स्रोत दस्तावेज़ कभी नहीं बदलती।
दोनों टूल
| टूल | इनपुट | आउटपुट |
|---|---|---|
| Read Aloud | PDF, Markdown या सादा टेक्स्ट | MP3 स्पीच — "Turn a document or text into natural speech (MP3)" |
| Document to Audiobook | PDF या Markdown | चैप्टर मार्क वाली M4B, या MP3 — "PDF or Markdown to a chaptered M4B audiobook" |
दोनों AI Tools के अंदर हैं। दस्तावेज़ ड्रॉप करें, आवाज़ चुनें, चलाएं — ऑडियो फ़ाइल आपके आउटपुट फ़ोल्डर में आती है।
आवाज़ें
आवाज़ें Piper मॉडल हैं जो एक बार डाउनलोड होते हैं (लगभग 60–120 MB प्रत्येक) और फिर पूरी तरह ऑफ़लाइन चलते हैं:
| आवाज़ | उच्चारण | साइज़ | नोट |
|---|---|---|---|
| Lessac | US English | ~63 MB | सुझाया गया डिफ़ॉल्ट |
| Amy | US English | ~63 MB | |
| Alan | British English | ~63 MB | |
| Ryan | US English | ~121 MB | उच्चतम गुणवत्ता, बनाने में धीमा |
प्रति रन एक बार आवाज़ चुनें; मॉडल अगले के लिए डिस्क पर रहता है।
फ़ॉर्मैट और चैप्टर
Document to Audiobook एक Output format विकल्प देती है — ऐप का अपना संकेत: "M4B carries chapters, MP3 plays anywhere."
- M4B को चैप्टर मार्क मिलते हैं जो दस्तावेज़ के हेडिंग से लिए गए — Markdown
##सेक्शन या पहचाने गए PDF सेक्शन — ताकि प्लेयर उनके बीच कूद सकें। - MP3 एक सीधा ट्रैक है जो अधिकतम प्लेयर संगतता के लिए libmp3lame V3 गुणवत्ता पर एनकोड हुआ।
Markdown पहले बोलने योग्य टेक्स्ट में सपाट किया जाता है, इसलिए markup अक्षर कभी ज़ोर से नहीं पढ़े जाते।
सीमाएं
- फ्री प्लान: आवाज़ें पहले ~600 अक्षर प्रीव्यू करती हैं — अपग्रेड से पहले आवाज़ आज़माने के लिए काफ़ी।
- Pro: पूरी लंबाई के दस्तावेज़।
- स्पीच एक दिशा में जाती है। कोई transcription या सबटाइटल जेनरेशन नहीं — ऑडियो को टेक्स्ट में बदलना फ़ीचर नहीं।