2022 में मैंने एक क्लायंट को £40,000 खर्च करते हुए एक लोकल सर्विसेज़ डायरेक्टरी बनाते देखा। बहुत सुंदर डिजाइन। 80,000 पेजेज़ एक स्वच्छ Airtable बेस से ऑटो-जेनरेट किए गए। मार्च में लॉन्च किया। जून तक इसके 214 इंडेक्सड पेजेज़ थे और बिल्कुल कुछ भी रैंक नहीं कर रहा था। समस्या विचार नहीं था — डायरेक्टरीज़ अभी भी कुछ ही प्रोग्रामेटिक SEO प्लेज़ में से एक हैं जो गंभीर ऑर्गेनिक ट्रैफिक में बदल सकती हैं। समस्या यह थी कि वे तकनीकी रूप से सब कुछ सही और रणनीतिक रूप से गलत करते थे।
यह पोस्ट वह गलती न करने के बारे में है।
---
2026 में डायरेक्टरी के लिए "प्रोग्रामेटिक SEO" असल में क्या मायने रखता है
लोग इस फ्रेज़ को ऐसे फेंकते हैं जैसे यह एक चीज़ है। यह नहीं है। एक डायरेक्टरी के लिए विशेष रूप से, प्रोग्रामेटिक SEO का मतलब है सैकड़ों या हज़ारों लोकेशन-, कैटेगरी-, या ऐट्रिब्यूट-स्कोप्ड पेजेज़ एक एकल टेम्पलेट और एक स्ट्रक्चर्ड डेटा सोर्स से जेनरेट करना, और इस तरीके से करना जहाँ हर पेज Google को उसे एक हैंड-राइटन कंपीटीटर के ऊपर रैंक करने का कारण देता है।
वह आखिरी हिस्सा है जहाँ ज्यादातर डायरेक्टरीज असफल हो जाती हैं।
2026 का वर्ज़न यह गेम 2019 की तुलना में कठिन है। Google की Helpful Content सिस्टम देर 2023 से कोर रैंकिंग एल्गोरिदम में बेक किया गया है, जिसका मतलब है कि थिन टेम्पलेटेड पेजेज़ को सिर्फ पेज लेवल पर नहीं, बल्कि साइट लेवल पर डाउनवेट किया जाता है। एक खराब बैच आपके पूरे डोमेन को टैंक कर सकता है। मैंने इसे देखा है। Seahawk के पास देर 2023 में एक ट्रैवल एग्रीगेटर प्रोजेक्ट था जहाँ 12,000 सिटी पेजेज़, प्रत्येक में लगभग 90 शब्द और एक लिस्टिंग्स टेबल था, लॉन्च के आठ हफ्तों के भीतर पूरे डोमेन की क्रॉल बजट को फर्श पर ला दिया।
तो बेसलाइन बार ऊँचा है। लेकिन मौका अभी भी बहुत बड़ा है।
---
डेटा लेयर ही सब कुछ है
ऐसे स्रोत से शुरुआत करें जिसमें गहराई हो, सिर्फ व्यापक न हो
ज्यादातर डायरेक्टरी बिल्डर यह पूछते हैं "मैं 50,000 लिस्टिंग्स कैसे पाऊँ?" उन्हें यह पूछना चाहिए "मैं वास्तव में हर लिस्टिंग के बारे में क्या जानता हूँ जो किसी और को नहीं पता?"
मैं छोटे-मझोले प्रोजेक्ट्स के लिए (100k records से कम) Airtable इस्तेमाल करता हूँ और बड़े प्रोजेक्ट्स के लिए Supabase या एक straightforward PostgreSQL setup। टूल का मायने कम है — schema ही मायने रखता है। आपके डेटाबेस में हर listing में ऐसे fields होने चाहिए जो differentiated page content जनरेट कर सकें। सिर्फ नाम, पता, फोन नहीं। सोचिए: स्थापना का साल, कीमत की रेंज, औसत review sentiment, verified reviews की संख्या, specialisms, आखिरी बार verify किया गया दिन, शहर के केंद्र से दूरी, physical location है या remote-only।
ज्यादा फील्ड्स = ऑन-पेज डिफरेंशिएशन के लिए ज्यादा एंगल्स। बस इतना ही।
स्क्रेपिंग बनाम लाइसेंस्ड डेटा बनाम यूजर-सबमिटेड
ईमानदारी से कहूँ तो तीनों की अपनी भूमिका है, और मैंने तीनों का इस्तेमाल किया है।
- Scraped data तेज़ और सस्ता है लेकिन जल्दी ही degraded हो जाता है। मैंने 2021 में एक UK accountants directory चलाया था जो Companies House data को scrape करता था। 14 महीनों में 23% records stale हो गए।
- Licensed डेटा फ़ीड्स (Dun & Bradstreet, Yext, या वर्टिकल-स्पेसिफिक APIs सोचें) महँगे होते हैं लेकिन सटीक होते हैं। लायक़ है अगर आपका monetisation मॉडल इसे सपोर्ट करता हो।
- User-submitted listings धीरे शुरू होती हैं लेकिन freshness signals बनाती हैं जिन्हें Google reward करता है। पहले दिन से ही "claim your listing" flow जोड़ें, भले ही आपके पास दो सौ listings हों।
जो डायरेक्टरीज़ 18-24 महीनों में ट्रैफिक को कंपाउंड करती हैं, वे लगभग हमेशा वह होती हैं जो लाइसेंस्ड सीड डेटा को चल रहे यूज़र कंट्रिब्यूशन के साथ मिक्स करती हैं।
---
Template Architecture: जिस बारे में कोई बात नहीं करता
यहाँ वह चीज़ है जिसे अधिकांश ट्यूटोरियल छोड़ते हैं। एक प्रोग्रामेटिक डायरेक्टरी के बीच अंतर जो रैंक करती है और एक जो विनाश में फ़िल्टर हो जाती है, आमतौर पर डेटा लेवल पर नहीं, टेम्पलेट लेवल पर होता है।
एक टेम्पलेट काफी नहीं है
आपको कम से कम तीन टेम्पलेट टियर्स की ज़रूरत है:
- Hub पेजेज़, "Best Solicitors in London" स्टाइल। उच्च कंपटीशन, एडिटोरियल टोन, मैनुअली क्यूरेटेड या हेवली एनरीच्ड। ये वह पेजेज़ हैं जहाँ आप लिंक पॉइंट करते हैं।
- Category × location पेजेज़, "Family Law Solicitors in Manchester"। मिड-टेल। ये अधिक टेम्पलेटेड हो सकते हैं लेकिन कम से कम एक डायनामिक सेक्शन की जरूरत है जो सच में यूनीक डेटा खींचता है (रिव्यू काउंट्स, एवरेज फी ब्रैकेट, नोटेबल लिस्टिंग्स)।
- इंडिविजुअल लिस्टिंग पेजेज़, लीफ नोड्स। ये डेटा रिचनेस से ज़िंदा या मर जाते हैं। अगर हर लिस्टिंग पेज के पास 60-शब्द का एक समान डिस्क्रिप्शन और एक फोन नंबर है, तो Google यह जल्दी समझ जाएगा।
मैंने इस split को पिछले दो साल में चार directory प्रोजेक्ट्स पर test किया है। जिनके पास clear three-tier hierarchy था वो flat architectures से consistently बेहतर प्रदर्शन करते रहे Google Search Console impression data में पहले 90 दिनों में। कोई coincidence नहीं है।
डायनामिक कंटेंट ब्लॉक जो असल में मदद करते हैं
पेजों को AI-जेनरेटेड बॉयलरप्लेट से भरना बंद करो। इसकी जगह टेम्पलेट लॉजिक बनाओ जो यह खींचे:
- एक ही पोस्टकोड डिस्ट्रिक्ट में रिलेटेड लिस्टिंग
- आपनी एनालिटिक्स से "Also viewed" कैटेगरी
- एक "last updated" टाइमस्टैम्प जो सच में एक्यूरेट हो (JS द्वारा इंजेक्ट किया गया आज की तारीख नहीं)
- यूजर रिव्यू स्निपेट्स, भले ही आपके पास सिर्फ तीन रिव्यूज़ हों, तीन असली वाले शून्य फेक वालों को हरा देते हैं।
इसका मकसद यह है कि जो कोई भी किसी लीफ-नोड लिस्टिंग पेज पर आए, वह ऐसी कोई चीज़ लेकर जाए जो वह Google पर खुद से नहीं खोज सकता था।
---
Internal Linking: आपका सबसे कम इस्तेमाल किया जाने वाला Ranking Lever
मैं साफ कहूँ। ज़्यादातर programmatic directories में आंतरिक linking बहुत ख़राब होती है। पेज मौजूद होते हैं। वे कहीं उपयोगी की ओर इशारा नहीं करते। Google का crawler एक बार आता है, एक dead-end देखता है, और पूरी subdirectory को कम प्राथमिकता देता है।
एक directory के लिए सही internal linking architecture कुछ इस तरह दिखता है:
- होमपेज → शीर्ष हब पेज (मैन्युअली क्यूरेटेड, 8-15 लिंक)
- Hub pages → category × location pages (dynamic, listing count के आधार पर)
- श्रेणी × स्थान पेज → व्यक्तिगत लिस्टिंग (पेजिनेटेड, अधिकतम 20-25 प्रति पेज)
- व्यक्तिगत लिस्टिंग → संबंधित श्रेणी × स्थान पेज (2-3 संदर्भ लिंक)
- Individual listings → "nearby" listings एक distance-based query के ज़रिए
वह अंतिम वाला, नियरबाय लिस्टिंग्स, अंडररेटेड है। यह आपकी लीफ नोड्स के अंदर एक क्रॉलेबल वेब बनाता है जो Googlebot को साइट के माध्यम से आगे बढ़ाए रखता है बजाय hub में वापस उछाले। मैंने यह बर्मिंघम में एक डेंटल डायरेक्टरी के लिए एक क्लायंट पर शुरुआती 2024 में लागू किया और GSC से क्रॉल रेट छः हफ्तों के भीतर 3.4x ऊपर चला गया।
लॉन्च करने से पहले Screaming Frog से अपने link graph को audit करें, बाद में नहीं। free tier 500 URLs तक handle करता है, जो आपके templates पर एक sanity check के लिए काफी है।
---
बड़े पैमाने पर इंडेक्सेशन को संभालना बिना जले-कटे
Google आपके 80,000 पेजों में से सभी को इंडेक्स नहीं करेगा। इसे स्वीकार करें। इसके साथ काम करें।
जो व्यावहारिक दृष्टिकोण मैं उपयोग करता हूँ:
- लॉन्च के दिन sitemap में केवल अपने hub और category × location पेज सबमिट करें
- Google को लीफ नोड्स को sitemap के माध्यम से नहीं, इंटरनल लिंक्स के माध्यम से खोजने दें
- noindex का इस्तेमाल aggressively करें thin, duplicate, या low-data listing pages पर जब तक आप उन्हें enrich न कर सकें।
- GSC में एक क्रॉल बजट रिपोर्ट सेट अप करें (Settings → Crawl Stats) और पहले तीन महीनों में सप्ताह में एक बार इसे देखें
noindex की सलाह को हमेशा pushback मिलती है। "लेकिन मैं चाहता हूँ कि सभी पेज indexed हों!" हाँ। और Google भी चाहता है कि सभी अच्छे हों। आप 40,000 thin pages indexed नहीं रख सकते और साथ ही एक healthy domain authority भी नहीं रख सकते। एक चुनो।
एक बात और: pagination। जहाँ उपयुक्त हो वहाँ proper rel="next" और rel="prev" इस्तेमाल करें, लेकिन यह भी सोचें कि क्या आपको paginated category pages की जरूरत है। तीन हालिया प्रोजेक्ट्स पर मैंने paginated listings को JS-loaded "show more" approach से बदला (crawlers के लिए static fallback के साथ) और 60 दिनों में GSC में cleaner indexation patterns देखे।
---
स्केल पर कंटेंट एनरिचमेंट अपना दिमाग खोए बिना
सही है। तो आपने स्वीकार कर लिया कि पतले पेजें मौत हैं। आप वास्तव में 20,000 लिस्टिंग पेजों को कंटेंट राइटर्स की टीम के बिना कैसे समृद्ध करते हैं?
कुछ अप्रोचेज जो व्यावहारिक रूप से काम करती हैं:
- संरचित समीक्षा एकत्रीकरण। Google Business Profile डेटा को उनके API के माध्यम से खींचें, या जहाँ ToS अनुमति दे वहाँ Trustpilot या Yelp से (सावधानी से) स्क्रैप करें। संरचित डेटा के रूप में प्रदर्शित एक स्टार रेटिंग + समीक्षा गणना भी मापने योग्य अंतर जोड़ता है।
- स्वचालित ताज़गी सिग्नल। एक स्क्रिप्ट लिखें जो आपकी लिस्टिंग्स को साप्ताहिक रूप से चेक करे और देखे कि व्यवसाय की वेबसाइट, फोन, या पता बदला है या नहीं। रिकॉर्ड को अपडेट करें। पेज पर "अंतिम सत्यापित" तारीख दिखाएँ। इसी एक चीज़ ने हमारी कानूनी डायरेक्टरी पर बाउंस रेट को 18% कम कर दिया — लोग मौजूदा डेटा पर भरोसा करते हैं।
- LLM-सहायक सारांश, सावधानी से उपयोग किए गए। मैं GPT-4 का उपयोग उन लिस्टिंग्स के लिए संरचित सारांश जेनरेट करने के लिए करता हूँ जहाँ हमारे पास पर्याप्त कच्चा डेटा है। लेकिन प्रॉम्प्ट उस लिस्टिंग के लिए विशिष्ट डेटा फील्ड्स तक कड़ाई से सीमित है, यह जेनेरिक विवरण नहीं बना रहा है। और हर सारांश को लाइव जाने से पहले एक समानता जांच (मैं पूरे कॉर्पस के विरुद्ध एक बुनियादी कोसाइन समानता स्क्रिप्ट का उपयोग करता हूँ) के माध्यम से फ़िल्टर किया जाता है ताकि लगभग-डुप्लिकेट आउटपुट को पकड़ा जा सके।
---
आपका मुद्रीकरण मॉडल SEO आर्किटेक्चर को परिभाषित करता है
यह बात लोगों को हैरान करती है। आप निर्देशिका से पैसे कमाने की योजना कैसे बनाते हैं, इसका सीधा असर इस बात पर पड़ता है कि आप किन पृष्ठों को प्राथमिकता देते हैं, आपको कितनी डेटा गहराई चाहिए, और क्या आप वह सामग्री समृद्धि करने का खर्च उठा सकते हैं जो रैंकिंग के लिए आवश्यक है।
मैंने तीन मॉडल देखे हैं जो लगातार काम करते हैं:
- सशुल्क सूचियाँ / विशेष प्लेसमेंट। सरल। व्यवसाय उच्च दिखाई देने या बेहतर प्रोफाइल के साथ दिखाई देने के लिए भुगतान करते हैं। इसे मार्केटप्लेस डायनामिक्स बनाने के लिए फ्री टियर को बढ़ाने के लिए प्रोत्साहित करता है।
- लीड जेनरेशन। आप पूछताछ फॉर्म सबमिशन कैप्चर करते हैं और उन्हें व्यवसायों को बेचते हैं। प्रति कन्वर्ज़न में अधिक राजस्व मिलता है, लेकिन फॉर्म भरवाने के लिए आवश्यक विश्वास अर्जित करने के लिए काफी समृद्ध लिस्टिंग पेजों की जरूरत पड़ती है।
- सहयोगी / रेफरल। सॉफ्टवेयर, वित्त या आतिथ्य जैसी वर्टिकल में अच्छी तरह से काम करता है जहां स्थापित सहयोगी कार्यक्रम हैं। SaaS टूल श्रेणियों में आला डायरेक्टरी इस मॉडल पर £10k-£30k/माह तक पहुंच सकती हैं यदि कीवर्ड लक्ष्यीकरण सही है।
अपने मॉडल को चुनें इससे पहले कि आप अपने टेम्पलेट्स डिजाइन करें। एक लीड-जेन डायरेक्टरी को दिन एक से ही हर लिस्टिंग पेज में विश्वास सिग्नल और कनवर्जन एलिमेंट्स बने हुए चाहिए, उन्हें बाद में जोड़ना हमेशा जितना लगता है उससे ज्यादा गड़बड़ होता है।
---
FAQ
क्या Google के 2024 एल्गोरिदम अपडेट के बाद प्रोग्रामेटिक SEO अभी भी काम करता है?
हाँ, लेकिन "काफी अच्छा" के लिए थ्रेशहोल्ड पिछले दो साल पहले की तुलना में काफी ज्यादा है। मार्च 2024 के Google कोर अपडेट ने बहुत सारी पतली प्रोग्रामेटिक साइट्स को कड़ा झटका दिया, विशेष रूप से उन जो टेम्पलेटेड AI कंटेंट पर बिना कोई अनोखा डेटा के निर्भर थे। जेनुइन डेटा गहराई और स्पष्ट एंटिटी संबंधों वाली साइट्स इससे ठीक रहीं। कुछ वर्टिकल्स में, उन साइट्स ने वास्तव में जमीन हासिल की जैसे पतली प्रतियोगियों को फ़िल्टर किया गया।
मुझे पहले दिन कितने पेज लॉन्च करने चाहिए?
जितने की जरूरत हो Google को concept दिखाने के लिए। मैं 50,000 पतले पेजों की तुलना में 500 सच में अच्छे पेज लॉन्च करना पसंद करूँ। पहले अपने hub pages और टॉप 20 category × location combinations बनाएँ। उन्हें indexed करवाएँ, कुछ शुरुआती ranking signals पाएँ, फिर बाकी को बैच में roll out करें। पहले महीने में 100,000 पेजों तक जल्दबाजी करना लगभग हमेशा गलती होती है।
मुझे कौन सा CMS या tech stack इस्तेमाल करना चाहिए?
ज्यादातर क्लाइंट्स के लिए मैं अभी भी WordPress का उपयोग करता हूँ एक कस्टम पोस्ट टाइप के साथ और ACF Pro डेटाबेस से खींच रहा है। यह चमकदार नहीं है लेकिन यह बनाने में तेज़ है, सौंपना आसान है, और SEO के लिए प्लगइन इकोसिस्टम (विशेष रूप से Rank Math) परिपक्व है। उच्च-स्केल प्रोजेक्ट्स के लिए, 50,000 पेजों से अधिक, मैं आम तौर पर Next.js और PostgreSQL या Supabase बैकएंड के साथ हेडलेस जाता हूँ। Next.js में SSG/ISR क्षमताएं स्केल पर क्रॉल व्यवहार को स्वच्छ रखने के लिए वास्तव में उपयोगी हैं।
एक programmatic directory ranking करने से पहले कितना समय लगता है?
वास्तविकता में? सार्थक ट्रैफिक के लिए छः से नौ महीने, यह मानते हुए कि आपने आर्किटेक्चर सही किया है और आप एक ऐसे वर्टिकल में हैं जहाँ Google स्पष्ट रूप से बड़ी स्थापित ब्रांड्स को प्राथमिकता नहीं दे रहा है। मैंने असाधारण मामलों को चार महीने में गति पकड़ते देखा है और निराशाजनक लोगों को 18 महीने लेते देखा है। वह चर जो सबसे ज्यादा मायने रखता है, ईमानदारी से, विषयगत प्राधिकार है — आपकी साइट दिन एक से एक विशिष्ट वर्टिकल में विशेषज्ञता कितनी स्पष्ट रूप से स्थापित करती है।
---
डायरेक्टरी SEO प्लेबुक मर नहीं गई है। इसे बस Google ने ठीक से मूल्य-भेदभाव किया है। 2023-24 में जिन ऑपरेटर्स को जला गया वे ज्यादातर मूल्य के बजाय मात्रा के लिए निर्माण कर रहे थे। पहले मूल्य के लिए बनाएँ, गहरा डेटा, ईमानदार समृद्धि, एक लिंक आर्किटेक्चर जो सम्मान करे कि Google वास्तव में कैसे क्रॉल करता है, और मात्रा समय के साथ खुद का ख्याल रखती है। यह हमेशा से ऐसा ही है।
