URL Extractor
टेक्स्ट या HTML से सभी HTTP और HTTPS URL निकालें, डुप्लिकेट हटाने और सेपरेटर विकल्पों सहित
इनपुट टेक्स्ट
विभाजक:
इस टूल के बारे में
URL एक्सट्रैक्टर किसी भी टेक्स्ट ब्लॉक को स्कैन करता है और http:// या https:// से शुरू होने वाले सभी URL निकालता है। पथ, क्वेरी पैरामीटर और फ्रैगमेंट सहित पूर्ण URL को संभालता है।
डुप्लीकेट URL हटाने और आउटपुट विभाजक चुनने के विकल्प शामिल हैं। HTML, मार्कडाउन, लॉग या कोई भी टेक्स्ट पेस्ट करें। सभी प्रसंस्करण ब्राउज़र में स्थानीय रूप से चलता है।
कैसे उपयोग करें
- URL वाला टेक्स्ट इनपुट में पेस्ट करें या सैंपल क्लिक करें।
- समान URL को डुप्लीकेट हटाने के लिए टॉगल करें।
- आउटपुट विभाजक चुनें।
- निकाले गए URL सूची को कॉपी करें।
उपयोग के मामले
SEO विश्लेषक लिंक ऑडिट के लिए पेज के HTML से सभी URL निकालते हैं। डेवलपर लॉग फ़ाइलों से वेबहुक URL प्राप्त करते हैं। QA इंजीनियर परीक्षण के लिए सर्वर लॉग से API एंडपॉइंट निकालते हैं।
अक्सर पूछे जाने वाले प्रश्न
- क्या यह गैर-HTTP URL (ftp://, mailto:) निकालता है? — वर्तमान में केवल http:// और https:// URL निकाले जाते हैं क्योंकि ये अधिकांश उपयोग मामलों को कवर करते हैं।
- क्या यह HTML href विशेषताओं के साथ काम करता है? — हाँ। कच्चा HTML पेस्ट करें और एक्सट्रैक्टर href="...", src="..." और इनलाइन टेक्स्ट में URL खोजेगा।
- यदि URL में कोष्ठक हों तो? — URL के अंत में कोष्ठक को अनुगामी विराम चिह्न के रूप में हटा दिया जाता है। बीच में कोष्ठक वाले URL (जैसे विकिपीडिया लिंक) सही ढंग से निकाले जाते हैं।
- क्या आकार की कोई सीमा है? — नहीं। सभी प्रसंस्करण ब्राउज़र-साइड रेगेक्स मिलान है और बड़े इनपुट को संभालता है।