PDF से CSV

स्थिति आधारित टेक्स्ट पंक्तियों को उद्धरण चिह्नों वाले CSV डेटा में निर्यात करें।

PDF फ़ाइलें चुनें

फ़ाइलें यहाँ छोड़ें या नीचे का बटन इस्तेमाल करें।

अधिकतम 100 MB कुल · फ़ाइलें आपके डिवाइस पर रहती हैं

विषय सूचीअनुभाग: 13

PDF से CSV क्या निकालता है?

स्प्रेडशीट समीक्षा या डेटा आयात के लिए स्थिति आधारित PDF टेक्स्ट पंक्तियाँ CSV फ़ाइल में निर्यात करें। निर्यातक सेल को उद्धरण चिह्नों में रखता है और भीतर के उद्धरण चिह्न दोगुने करता है, ताकि निकाले गए वर्ण वैध CSV फ़ील्ड के भीतर रहें।

चौड़ा अंतर स्तंभों का संकेत दे सकता है, लेकिन तालिका की संरचना सिद्ध नहीं करता। सामान्य स्प्रेडशीट प्रक्रियाओं में निष्क्रिय रखने के लिए फ़ॉर्मूले जैसे मानों की शुरुआत में अपॉस्ट्रॉफ़ी लगाई जाती है। इससे उनका दिखाई देने वाला टेक्स्ट रूप बदल सकता है और आयात करते समय इसका ध्यान रखना चाहिए।

PDF से CSV की सुविधाएँ

फ़ील्ड विभाजक चुनें

अगले एप्लिकेशन की आयात सेटिंग के अनुरूप अल्पविराम, अर्धविराम या टैब से अलग फ़ील्ड निर्यात करें।

सेल टेक्स्ट में उद्धरण और एस्केप

फ़ील्ड उद्धरण चिह्नों में रखे जाते हैं और भीतर के उद्धरण चिह्न दोगुने होते हैं, ताकि विवरण के भीतर के अल्पविराम उसी फ़ील्ड में रहें।

पंक्ति और स्तंभ की सीमाएँ समायोजित करें

रिपोर्ट का मुद्रित अंतर गलत सेल बनाए तो संरेखण सहन सीमा, स्तंभ अंतर और छोड़े जाने वाले हाशिये बदलें।

निष्क्रिय फ़ॉर्मूले जैसे मान

फ़ॉर्मूले जैसे वर्णों से शुरू होने वाले सेल में अपॉस्ट्रॉफ़ी लगती है। आयात किए गए डेटा की मैपिंग करते समय इस उपसर्ग की समीक्षा करें।

PDF पंक्तियों को CSV में क्यों निर्यात करें?

मुद्रित रिकॉर्ड को ऐसे गंतव्य में ले जाने के लिए CSV उपयोगी है जो विभाजक वाला टेक्स्ट स्वीकार करता हो, जैसे माल सूची आयात या डेटाबेस की अस्थायी तैयारी तालिका। XLSX कार्यपुस्तिका के विपरीत इसमें शीट टैब, रंग या फ़ॉर्मूले नहीं होते। हर स्रोत पृष्ठ अलग वर्कशीट पर रखना हो तो PDF से Excel इस्तेमाल करें; गंतव्य को रिकॉर्ड की एक धारा चाहिए तो CSV इस्तेमाल करें।

PDF से CSV कौन इस्तेमाल करता है?

डेटा स्थानांतरण विशेषज्ञ

पुरानी PDF सूची से अस्थायी आयात फ़ाइल तैयार करें। समीक्षित डेटा स्थानांतरित करने से पहले दोहराए गए शीर्षक हटाएँ, रिकॉर्ड की संख्या जाँचें और परीक्षण आयात में मैपिंग जाँचें।

खरीद विश्लेषक

तुलना तालिका के लिए आपूर्तिकर्ता की PDF अनुसूची से मदें निकालें। पुष्टि करें कि इकाई, मात्रा और कीमत अलग फ़ील्ड हों तथा विवरण के उद्धरण चिह्न बने रहें।

विश्वविद्यालय प्रयोगशाला सहायक

डेटा सुधार अभ्यास के लिए टेक्स्ट आधारित माप तालिका प्राप्त करें। बिना बदले निर्यात किए गए सेल PDF से मिलाएँ और विश्लेषण वातावरण में जाँचे गए मानों को संख्यात्मक प्रकारों में बदलें।

PDF तालिका के टेक्स्ट को CSV में कैसे बदलें?

  1. पंक्तियों में व्यवस्थित चुनने योग्य टेक्स्ट वाला PDF चुनें। पहले उसके तालिका पृष्ठों का छोटा नमूना निर्यात करें।
  2. CSV विभाजक चुनें। आवश्यकतानुसार छोड़े जाने वाले हाशिये, पंक्ति सहन सीमा और स्तंभ अंतर बदलें।
  3. रूपांतरण करें और CSV डाउनलोड करें। आयात संवाद खोलने से पहले टेक्स्ट फ़ाइल जाँचें।
  4. फ़ील्ड की संख्या, शीर्षक, अपॉस्ट्रॉफ़ी उपसर्ग और विभाजक सेटिंग की पुष्टि करें। रिकॉर्ड के छोटे समूह पर जाँचें कि गंतव्य तारीखों और संख्याओं को कैसे सँभालता है।

स्रोत फ़ाइल चुनें

चयन योग्य टेक्स्ट वाली PDF तालिका चुनें।

बड़ा करने के लिए स्क्रीनशॉट चुनें।
PDF से CSV, चरण 1: चयन योग्य टेक्स्ट वाली PDF तालिका चुनें।

टूल की सेटिंग जाँचें

पृष्ठ, विभाजक और पंक्तियों या कॉलम का अनुमान लगाने की सेटिंग चुनें।

बड़ा करने के लिए स्क्रीनशॉट चुनें।
PDF से CSV, चरण 2: पृष्ठ, विभाजक और पंक्तियों या कॉलम का अनुमान लगाने की सेटिंग चुनें।

परिणाम डाउनलोड करें और जाँचें

CSV डाउनलोड करें और रिकॉर्ड आयात करने से पहले फ़ील्ड जाँचें।

बड़ा करने के लिए स्क्रीनशॉट चुनें।
PDF से CSV, चरण 3: CSV डाउनलोड करें और रिकॉर्ड आयात करने से पहले फ़ील्ड जाँचें।

स्क्रीनशॉट इन उपकरणों को सुरक्षित नमूना फ़ाइलों के साथ दिखाते हैं। आपकी फ़ाइल का नाम, पृष्ठ संख्या और सेटिंग अलग हो सकती हैं।

कई पंक्तियों में फैला लेबल अतिरिक्त पंक्ति बन जाता है

अंतिम मद का लेबल दूसरी पंक्ति में जाता है। निर्यात डेटा उसका अगला हिस्सा अलग पंक्ति में रखता है, इसलिए स्प्रेडशीट रिकॉर्ड के रूप में इस्तेमाल करने से पहले समीक्षा चाहिए।

स्रोत: तीन मद और एक कुल

मूल तालिका में तीन मद पंक्तियाँ और 65.00 का कुल है। एक मद का लेबल दो पंक्तियों में फैला है।

वास्तविक स्रोत तालिका में दो-पंक्ति का मद लेबल और खाली कोशिकाओं वाली कुल पंक्ति।

परिणाम: वास्तविक निर्यात की गई कोशिकाएँ

ये कोशिकाएँ डाउनलोड की गई फ़ाइल से पढ़ी गईं। अंतिम लेबल का अगला हिस्सा अलग पंक्ति है।

वास्तविक निर्यात कोशिकाएँ, जिनमें दो पंक्तियों में गए लेबल से बनी अतिरिक्त पंक्ति शामिल है।
शीर्षक सहित पंक्तियाँ
6
निर्यात किए स्तंभ
4
कुल मान
65.00

इस्तेमाल की गई सेटिंग: पृष्ठ 1; ऊपर के 170 pt और नीचे के 340 pt छोड़ें; पंक्ति सहनशीलता 3 pt; स्तंभ अंतर 18 pt। CSV में अल्पविराम हैं।

स्थिति के आधार पर निकालने से मिले हुए रिकॉर्ड या सूत्र दोबारा नहीं बनते। अरबी नमूने में संरेखण से अतिरिक्त स्तंभ भी बनते हैं। गणना से पहले हर पंक्ति PDF से मिलाएँ।

जाँच की तारीख: . मूल सुरक्षित नमूने संस्करण 3.16.0 से स्थानीय Chromium में संसाधित किए गए; यह वास्तविक सेवा की होस्टिंग के प्रदर्शन का मापदंड नहीं है।

सेटिंग और आउटपुट की जाँच

सेटिंगक्या अपेक्षा रखें
स्वीकार्य इनपुटPDF
प्रसंस्करण का स्थानआपका ब्राउज़र
फ़ाइल का चयनएक इनपुट फ़ाइल
इनपुट का आकारकुल 100 MB; डिकोड किए गए चित्रों और पृष्ठों की पिक्सेल सीमाएँ भी हैं
पृष्ठों का चयनप्रति काम अधिकतम 200 चुने हुए पृष्ठ। पृष्ठ फ़ील्ड खाली छोड़ने का अर्थ सभी पृष्ठ तभी है जब PDF में 200 या कम पृष्ठ हों; लंबे दस्तावेज़ के लिए अलग-अलग सीमाएँ इस्तेमाल करें।

केवल चित्र वाली तालिका में निर्यात करने के लिए टेक्स्ट पंक्तियाँ नहीं होतीं। OCR से उसे पहचानें और CSV तैयार करने से पहले अंक तथा अंतर जाँचें।

निर्यात से पहले तालिका बेहतर करें

लंबी रिपोर्ट का प्रसंस्करण करने से पहले एक प्रतिनिधि पृष्ठ निर्यात करें। शीर्षक या पादलेख अतिरिक्त रिकॉर्ड बन जाए तो ऊपर या नीचे का छोड़ा जाने वाला हाशिया बढ़ाएँ; ये नियंत्रण PDF पॉइंट इस्तेमाल करते हैं, जिसमें 72 पॉइंट प्रति इंच होते हैं। पास-पास के फ़ील्ड मिल जाएँ तो स्तंभ अंतर सीमा घटाएँ, या विवरण कई सेल में बँट जाए तो बढ़ाएँ। कई पंक्तियों में फैला पता कई निकाली गई पंक्तियों में आ सकता है, इसलिए अंतिम सेटिंग चुनने से पहले ऐसा कम से कम एक रिकॉर्ड जाँचें।

गंतव्य द्वारा अर्थ निकाले जाने से पहले रिकॉर्ड जाँचें

चुने गए पृष्ठों की पंक्तियाँ डेटाबेस स्कीमा दोबारा बनाए बिना जोड़ी जाती हैं। इसलिए दोहराया गया स्तंभ शीर्षक रिकॉर्ड बन सकता है, और खाली सेल यह नहीं बताता कि डेटा अनुपस्थित है या जानबूझकर खाली है। बिना संपादित निर्यात सँभालें, हाथ से किए गए सुधार दर्ज करें और पूरा डेटासेट स्वीकार करने से पहले छोटा परीक्षण आयात करें। =, +, @ या – से शुरू होने वाले मान में सुरक्षा अपॉस्ट्रॉफ़ी जुड़ सकती है, जिसमें ऋणात्मक दिखने वाली राशि भी शामिल है; गंतव्य को हूबहू स्ट्रिंग या संख्यात्मक मान चाहिए तो इसे सोच-समझकर सँभालें।

PDF से CSV में आने वाली समस्याएँ

स्थितिक्या करें
विवरण कई स्तंभों में बँट जाते हैंअंतर सीमा बढ़ाएँ और प्रतिनिधि पृष्ठ फिर आज़माएँ।
आयात के बाद पहचानकर्ताओं के शुरुआती शून्य गायब हो जाते हैंस्प्रेडशीट या डेटाबेस एप्लिकेशन में उस स्तंभ को टेक्स्ट के रूप में आयात करें।
कई तालिकाओं के ढाँचे अलग हैंउन्हें अलग-अलग बदलें, फिर डेटा जोड़ने से पहले शीर्षक और स्तंभों का क्रम मिलाएँ।

व्यावहारिक उदाहरण और अंतिम जाँच

मान लें कि विवरण में खाता कोड 00127 और राशि -45.50 छपी है। शून्य बचाने के लिए खाता कोड स्तंभ को टेक्स्ट के रूप में आयात करें। जाँचें कि निर्यात की गई राशि के आगे सुरक्षा अपॉस्ट्रॉफ़ी लगी है या नहीं, फिर गंतव्य में जाँचे गए मान को सोच-समझकर बदलें। लेन-देन का कुल विवरण से मिलाएँ और सामग्री निकाले जाने के प्रमाण के रूप में मूल CSV सँभालें।

अक्सर पूछे जाने वाले प्रश्न

क्या PDF के फ़ॉर्मूले निर्यात के बाद चल सकते हैं?

संभावित फ़ॉर्मूले जैसे मानों के आगे अपॉस्ट्रॉफ़ी लगाई जाती है। फिर भी किसी एप्लिकेशन में आयात करने से पहले अविश्वसनीय डेटा की समीक्षा करें।

क्या किसी विशेष पृष्ठ की सामग्री निकाल सकते हैं?

हाँ। उसकी वास्तविक पृष्ठ संख्या दर्ज करें। असंबंधित पंक्तियाँ घटाने और सुधार आसान करने के लिए सीमित पृष्ठ सीमा इस्तेमाल करें।

कौन सी आयात सेटिंग चुनें?

UTF-8, उद्धरण चिह्नों वाले टेक्स्ट फ़ील्ड और निर्यात में चुना गया वही विभाजक इस्तेमाल करें: अल्पविराम, अर्धविराम या टैब। पुष्टि करें कि आयात पूर्वावलोकन में हर मान अपेक्षित स्तंभ में है। शुरुआती शून्य वाले पहचानकर्ता टेक्स्ट के रूप में रखें और फ़ॉर्मूला सुरक्षा की किसी अपॉस्ट्रॉफ़ी का ध्यान रखें।

ऋण या धन चिह्न के आगे अपॉस्ट्रॉफ़ी क्यों जुड़ गई?

निर्यात उन मानों के आगे उपसर्ग लगाता है जिन्हें फ़ॉर्मूला समझा जा सकता है, जिसमें -, +, = या @ से शुरू होने वाली स्ट्रिंग शामिल हैं। नियंत्रित आयात में वह सुरक्षा हटाने से पहले स्रोत और वांछित डेटा प्रकार जाँचें; पहचानकर्ता टेक्स्ट के रूप में रखें।

क्या कई PDF तालिकाएँ एक CSV में रख सकते हैं?

चुने गए पृष्ठों की पंक्तियाँ अलग शीट टैब या स्वचालित तालिका पहचान के बिना एक फ़ाइल में जुड़ती हैं। अलग स्तंभ संरचना वाली तालिकाएँ अलग निर्यात करें, या प्रति पृष्ठ अलग वर्कशीट से जाँच आसान हो तो PDF से Excel इस्तेमाल करें।

संबंधित टूल और मार्गदर्शिकाएँ

आगे इनका इस्तेमाल करें: PDF से Excel, Excel से PDF, PDF में टेक्स्ट पहचानें (OCR)।