एक क्लाइंट ने मुझे पिछले नवंबर में फोन किया, बेहद नाराज़। उसकी साइट एक काफी प्रतिस्पर्धी SaaS शब्द के लिए Google पर #2 पर रैंक कर रही थी। ट्रैफिक ठीक था। लेकिन उसका मुख्य प्रतियोगी, एक कम परिपक्व साइट जिसका डोमेन अथॉरिटी आधा था, जब भी कोई ChatGPT या Perplexity से इस कैटेगरी के बारे में पूछता था, तो हमेशा नाम से सामने आता था। बस उद्धृत नहीं। नामित। सुझाए गए। मैंने दो सप्ताह उस प्रतियोगी की कंटेंट को अलग करने में लगाए और जो मुझे मिला उसने पूरी तरह बदल दिया कि मैं ऑप्टिमाइज़ेशन के बारे में कैसे सोचता हूँ।
AI-नेटिव सर्च एक रैंकिंग सिस्टम नहीं है। यह एक पुनर्प्राप्ति और संश्लेषण प्रणाली है। और इन दोनों चीजों को बहुत अलग दृष्टिकोण की आवश्यकता है।
यहाँ वह है जो मैंने पिछले साल शायद 40 के करीब क्लाइंट साइट्स पर इसे काम करने के बाद जोड़ा है।
---
AI सर्च Google से अलग क्यों काम करता है
Google पेजों को रैंक करता है। Perplexity और ChatGPT Search जवाबों को सोर्स करते हैं। यह फर्क थिएरिटिकल लगता है लेकिन यह बदल देता है कि आपको क्या करना चाहिए।
जब कोई Perplexity में सवाल टाइप करता है, तो सिस्टम ऐसा कंटेंट ढूंढ रहा होता है जिसे वह आत्मविश्वास के साथ कोट कर सके। इसे चाहिए specificity, साफ attribution, और ऐसा prose जो अपने असली कॉन्टेक्स्ट से निकालने के बाद भी सही रहे। एक पैराग्राफ जो अलग से भी ठीक लगे। एक स्टेटिस्टिक जिसका नाम दिया गया सोर्स हो। एक डेफिनिशन जिसे समझने के लिए उससे पहले के पाँच पैराग्राफ न पढ़ने पड़ें।
Google साल भर में बनाए गए authority सिग्नल को रिवार्ड करता है। AI search तुरंत legibility को रिवार्ड करता है। दोनों ओवरलैप करते हैं, लेकिन लोग जितना सोचते हैं उतना नहीं।
शुरुआती 2024 में, Seahawk का एक fintech क्लाइंट था जिसकी साइट technically बेहतरीन थी। तेज़, अच्छे से लिंक्ड, मजबूत E-E-A-T सिग्नल। Perplexity ने इसे basically कभी cite नहीं किया। हमने असल prose को देखा और समस्या दस मिनट में मिल गई: साइट पर हर जवाब context-heavy editorial के अंदर दफन था जिसे शुरुआत से पढ़ना पड़ता था। Standalone पैराग्राफ का कोई मतलब नहीं था। हमने तीन pillar pages को दो हफ्ते में restructure किया और citations छः हफ्ते में आने लग गए।
---
सही Crawlers से पहले Index हो जाइए
किसी भी चीज़ से पहले, यह चेक कीजिए कि Bing आपकी साइट को सही से crawl कर रहा है। यह अजीब लगता है अगर आप Google-first दुनिया में रह रहे हैं, लेकिन ChatGPT Search Bing के index पर बना है। अगर Bing आपको नहीं देख सकता, तो ChatGPT लगभग निश्चित रूप से आपको cite नहीं करेगा।
Bing Webmaster Tools में जाइए और अपनी साइट को verify कीजिए अगर आपने यह पहले नहीं किया है। अपना sitemap submit कीजिए। Crawl diagnostics चेक कीजिए। मुझे लगभग 30% साइट्स मिली हैं जिन्हें हम audit करते हैं, जिन्होंने या तो Bing को कभी submit ही नहीं किया या उनके पास पुराने sitemaps हैं जो अब URLs पर point करते हैं जो redirect हो गए हैं।
Perplexity अपना खुद का crawler चलाता है, PerplexityBot। अपनी robots.txt फाइल चेक कीजिए और यह सुनिश्चित कीजिए कि आप गलती से इसे block नहीं कर रहे। मुझे इस साल यह सही गलती तीन बार दिखी, एक बार ऐसी साइट पर जो महीनों से सोच रही थी कि Perplexity उन्हें cite क्यों नहीं करता जबकि वे organically अच्छे से rank कर रहे थे।
वह robots.txt चेक जो 90 सेकंड लगता है
- अपने ब्राउज़र में
yourdomain.com/robots.txtपर जाएं - किसी भी
Disallowनियम को खोजें जोUser-agent: *पर लागू होते हैं या विशेष रूप सेPerplexityBotयाGPTBotपर लागू होते हैं - अगर आप किसी पुराने सुरक्षा प्लगइन या माइग्रेशन से कोई व्यापक disallow नियम देखते हैं, तो उन्हें ठीक करें
OpenAI ने GPTBot पर दस्तावेज़ प्रकाशित किया है अगर आप यह देखना चाहते हैं कि इसे कैसे चुनिंदा रूप से अनुमति दें या ब्लॉक करें।
---
लेख नहीं, उत्तर लिखें
यह उस नवंबर वाली क्लायंट कॉल के बाद मेरे खुद के कंटेंट वर्कफ़्लो में किया गया सबसे बड़ा बदलाव है। और ईमानदारी से कहूँ तो इसे अपने भीतर लेने में मुझसे जितना समय लगना चाहिए था उससे अधिक समय लगा।
ज्यादातर वेब कंटेंट एक यात्रा के रूप में लिखा जाता है। परिचय, संदर्भ, बिल्डअप, उत्तर, निष्कर्ष। यह संरचना उस किसी के लिए ठीक काम करती है जिसने Google के माध्यम से आपका लेख खोजा है और इसे शुरू से अंत तक पढ़ रहा है। यह किसी ऐसे AI के लिए काम नहीं करता जो किसी विशिष्ट सवाल के लिए उद्धरण योग्य जवाब के लिए स्कैन कर रहा है।
AI मॉडल्स को वो चाहते हैं जिसे मैं "answer-first paragraphs" कहता हूँ। अंतर्निहित सवाल का सीधा जवाब पहले या दूसरे वाक्य में आता है। सहायक संदर्भ इसके बाद आता है। सिर्फ लेख के स्तर पर नहीं, हर पैराग्राफ़ में उल्टे पिरामिड जैसा सोचें।
bounce rate के बारे में एक पैराग्राफ़ के इन दोनों ओपनिंग की तुलना करें:
जब उपयोगकर्ता आपकी वेबसाइट पर पहुंचते हैं, तो पहली कुछ सेकंड में उनका व्यवहार आपको बहुत कुछ बताता है कि आपकी सामग्री resonating कर रही है या नहीं। इसे समझने के लिए सबसे अधिक चर्चित मेट्रिक्स में से एक bounce rate है, जो...
Bounce rate उन sessions का प्रतिशत है जहां एक उपयोगकर्ता एक page देखता है और बिना किसी और interaction के चला जाता है। एक content page पर 70% से ऊपर की rate आमतौर पर उस ad या search result के बीच relevance mismatch को signal करती है जो उन्हें वहां लाया था और जो उन्हें वास्तव में मिला।
संस्करण B को उठाया जा सकता है और उद्धरण के रूप में उपयोग किया जा सकता है। संस्करण A नहीं कर सकता। संस्करण B लिखें।
---
Structured Data अभी भी मायने रखता है (शायद पहले से कहीं अधिक)
मुझे पता है कि structured data वर्षों से "महत्वपूर्ण" रहा है और बहुत सारे लोगों ने इसे ignore कर दिया है। ठीक है। लेकिन AI citation के लिए विशेष रूप से, इसे फिर से देखना काबिल है।
Schema.org markup AI systems को आपके page के दावों, इसे किसने लिखा, यह कब publish हुआ, और कौन सी organisation इसके पीछे है — इसका एक machine-readable summary देता है। Perplexity विशेष रूप से मेरे testing में author और organisation schema को काफी heavy weight देता दिख रहा है। एक Person schema जिसका real jobTitle हो, एक linked sameAs जो LinkedIn या Wikipedia profile की ओर point करे, और एक Organization schema जिसका url और foundingDate हो — यह magic नहीं है लेकिन यह signal देता है कि एक real entity ने accountable identity के साथ content बनाया है।
Seahawk client work के लिए, मैं deploy करने से पहले schema को validate करने के लिए Google's Rich Results Test का उपयोग करता हूं। दो मिनट लगते हैं। इसके काबिल है।
वे types जो citation visibility के लिए सबसे अधिक मायने रखते हैं:
ArticleयाBlogPostingजिसमेंdatePublishedऔरdateModifiedहो- व्यक्ति जिसके पास नाम, jobTitle, url,
sameAsहो - संगठन जिसके पास नाम, url,
logoहो - किसी भी पृष्ठ के लिए
FAQPageजिसमें असली Q&A संरचना हो - चरण-दर-चरण निर्देशात्मक सामग्री के लिए
HowTo
इसे नकली न बनाएँ। अगर आप एक FAQ स्कीमा प्रकाशित करते हैं लेकिन असली पृष्ठ में पठनीय Q&A सामग्री नहीं है, तो AI सिस्टम को यह जल्दी ही समझ आ जाएगा।
---
विषय की चौड़ाई नहीं, गहराई बनाएँ
AI उद्धरण पूलों के बारे में यह बात है: वे छोटे हैं। Perplexity पूरे इंडेक्स से समान रूप से नहीं खींच रहा है। यह उन स्रोतों से भारी रूप से खींचता है जिन्हें यह विशिष्ट विषयों पर अधिकृत मानता है। और वह अधिकार केवल डोमेन-स्तर पर नहीं है। यह विषय-क्लस्टर-स्तर पर है।
मैंने छोटी साइटों को संकीर्ण विषयों पर बार-बार उद्धृत होते देखा है, बस इसलिए कि उनके पास उस एक विषय पर 15 अच्छी तरह से लिखे गए, कसकर केंद्रित टुकड़े थे। इसी बीच एक बड़ी साइट जिसमें 800 लेख हैं और शायद उस विषय पर 5 हैं, पूरी तरह नजरअंदाज कर दी गई।
ऐसे विषय को चुनें जिसके आप वास्तव में मालिक बनना चाहते हैं। फिर दस अलग-अलग क्षेत्रों में चौड़ाई की जगह उस दिशा में गहराई बनाएँ। पिछली वसंत में एक B2B क्लाइंट के लिए, हमने पहचाना कि उनका असली अंतर WooCommerce स्टोरों के लिए WordPress प्रदर्शन अनुकूलन था। हमने सामान्य "शीर्ष 10 प्लगइन्स" सामग्री प्रकाशित करना बंद कर दिया और इसके बजाय तीन महीनों में उस एक संकीर्ण विषय पर 18 केंद्रित टुकड़े बनाए। संबंधित क्वेरीज़ पर Perplexity उद्धरण उपस्थिति लगभग शून्य से चौथे महीने तक शायद 40% परीक्षण क्वेरीज़ में दिखाई देने तक बढ़ गई।
"विषयगत गहराई" व्यावहार में वास्तव में कैसी दिखती है
यह केवल अधिक लेख प्रकाशित करना नहीं है। यह है:
- क्लस्टर के भीतर हर स्पष्ट अनुवर्ती प्रश्न का उत्तर देना
- वर्णनात्मक एंकर टेक्स्ट के साथ सामग्री के बीच लगातार लिंक करना
- अपने मुख्य लेखों को हर 90 दिन में ताज़ा डेटा या बदली हुई सिफारिशों के साथ अपडेट करना
- अस्पष्ट रहने के बजाय विशिष्ट संस्करण संख्याएं, उपकरण नाम और वास्तविक परिणाम शामिल करना
---
आपकी लेखक पहचान को अपनी साइट के बाहर मौजूद होना चाहिए
AI सिस्टम केवल आपकी साइट का अलग से आकलन नहीं करते। वे क्रॉस-रेफ़रेंस करते हैं। अगर मैं कहता हूँ कि मैं 9 साल के अनुभव के साथ एक लंदन-आधारित डेवलपर हूँ और वे LinkedIn पर, पॉडकास्ट प्रकटन पर, अतिथि लेख में, प्रेस उल्लेख में पुष्टि के संकेत पा सकते हैं, तो दावा विश्वसनीय हो जाता है। अगर वह दावा केवल मेरी अपनी साइट के About पृष्ठ पर मौजूद है, तो यह कहीं अधिक कमजोर है।
यह इसीलिए है कि मैं ग्राहकों को ऐसी चीजें करने के लिए चुपचाप प्रेरित कर रहा हूँ जो SEO से ज्यादा PR जैसी लगती हैं। उद्योग साइटों पर अतिथि लेख। राउंड-अप लेखों में उद्धृत होना। पॉडकास्ट प्रकटन, यहाँ तक कि छोटे भी। आपकी विशेषज्ञता के क्षेत्र में Wikipedia संपादन (वास्तव में, जहाँ उपयुक्त हो)। LinkedIn सामग्री जो अनुक्रमित हो।
इसमें कुछ नया नहीं है। लेकिन अब इसका महत्व ज्यादा है क्योंकि AI सिस्टम entity resolution का एक संस्करण कर रहे हैं: वे यह पुष्टि करने की कोशिश कर रहे हैं कि दावा करने वाला व्यक्ति या संगठन वास्तविक और विश्वसनीय है, केवल यह नहीं कि उस व्यक्ति या संगठन के बारे में कोई पृष्ठ मौजूद है।
जो भी हो, मैंने 2023 के अंत में विशेष रूप से इसी कारण से अपनी व्यक्तिगत साइट पर अधिक लिखना शुरू किया। ट्रैफिक के लिए नहीं। indexed, attributable विचारों का एक trail बनाने के लिए जो AI सिस्टम यह जांचते समय पा सकें कि क्या "Gautam Khorana from Seahawk Media" एक वास्तविक व्यक्ति है जिसके पास वास्तविक expertise है।
---
Freshness Signals और Update Cycle
Perplexity विशेष रूप से तेजी से बदलने वाले विषयों पर हाल ही में अपडेट की गई content को प्राथमिकता देता है। मैंने इस pattern को स्पष्ट रूप से देखा है जब कुछ भी AI tools, SaaS pricing, या नियामक परिवर्तनों को छूता है। 2022 का एक लेख जिसे तब से छुआ नहीं गया है, भले ही वह बहुत अच्छा हो, एक औसत दर्जे के लेख को citations हार देता है जिसे तीन हफ्ते पहले अपडेट किया गया था।
अपने calendar पर reminder सेट करें। हर 90 दिन में, अपने top 10 pages पर वापस जाएं और कुछ वास्तविक अपडेट करें: एक statistic, एक tool recommendation, एक pricing figure, एक date reference। अपने schema में dateModified को भी बदलें। केवल cosmetic edits न करें। content को वास्तव में बेहतर बनाएं।
अगर आप WordPress का उपयोग कर रहे हैं, तो PublishPress Revisions plugin इसे manage करने के लिए ठीक है। या बस इसे एक content audit spreadsheet में build करें। Low-tech काम करता है।
---
FAQ
क्या domain authority अभी भी AI citations के लिए मायने रखता है?
यह एक कारक है लेकिन प्रमुख नहीं है। मैंने DA 20 वाली साइटों को DA 70 वाली साइटों के ऊपर विशिष्ट क्वेरीज़ पर उद्धृत होते देखा है क्योंकि छोटी साइट के पास उसी विषय पर स्पष्ट, अधिक उद्धरणीय उत्तर थे। स्थापित प्राधिकार आपको विचार के दायरे में लाने में मदद करती है लेकिन यह अस्पष्ट या खराब संरचित कंटेंट को बचा नहीं सकती।
क्या मुझे विशेष रूप से ChatGPT के लिए लिखना चाहिए बनाम Perplexity, या एक रणनीति काफी है?
एक रणनीति इसका अधिकांश हिस्सा कवर करती है। सिद्धांत समान हैं: स्पष्ट उत्तर, वास्तविक लेखक पहचान, उचित क्रॉल एक्सेस, विषय गहराई। मुख्य व्यावहारिक अंतर यह है कि ChatGPT Bing के इंडेक्स पर अधिक भारी निर्भर है, इसलिए Bing Webmaster Tools वहाँ अधिक मायने रखता है। Perplexity के लिए, ताजेपन का संकेत मजबूत लगता है। अन्यथा, एक बार अनुकूलित करें और यह दोनों में काम करता है।
परिणाम देखने में कितना समय लगता है?
ईमानदारी से कहें तो, यह बेहद बदलता रहता है। मैंने जो fintech क्लाइंट का उल्लेख किया था उसे पुनर्संरचना के बाद छह सप्ताह लगे। WooCommerce क्लाइंट को सुसंगत प्रकाशन के चार महीने लगे। मैंने साइटें भी देखी हैं जो एक अवरुद्ध क्रॉलर को ठीक करने के तीन सप्ताह के भीतर उद्धृत होने लगीं। कोई विश्वसनीय समयरेखा नहीं है। काम करो, हर कुछ हफ्तों में मैनुअल टेस्ट क्वेरीज़ के साथ अपनी प्रगति जाँचो, समायोजन करो।
मैं जाँचने के लिए कौन से टूल्स उपयोग कर सकता हूँ कि मुझे उद्धृत किया जा रहा है?
मैनुअल क्वेरीज़ अभी भी सबसे विश्वसनीय तरीका है। अपने विषय क्षेत्र में 10-15 टेस्ट सवालों का एक सुसंगत सेट उपयोग करें और उन्हें साप्ताहिक रूप से Perplexity और ChatGPT Search में चलाएँ। स्केल के लिए, कुछ एजेंसियाँ Brandwatch जैसे टूल्स या यहाँ तक कि कस्टम स्क्रिप्ट्स का उपयोग करना शुरू कर रही हैं जो उद्धरण आवृत्ति को ट्रैक करने के लिए Perplexity API को हिट करती हैं। कोई पूरी तरह स्वचालित समाधान अभी मौजूद नहीं है जिसे मैं उत्पादन-तैयार कहूँ।
मेरी साइट उद्धृत की जा रही है लेकिन कुछ भी उपयोगी के लिए नहीं। मैं इसे कैसे ठीक करूँ?
देखो कि कौन से पेज उद्धृत हो रहे हैं और AI उन्हें खींचते समय कौन सा सवाल जवाब दे रहा है। आमतौर पर पेज गलत क्वेरी के लिए रैंक कर रहा है क्योंकि वह विषय से अस्पष्ट है। ध्यान को कस करो। प्रति पेज एक स्पष्ट विषय, प्रति सेक्शन एक स्पष्ट उत्तर। जितना अधिक सर्जिकल रूप से विशिष्ट कोई पेज है, उतना अधिक संभावना है कि वह सही चीज़ के लिए उद्धृत हो।
---
नौ साल बाद, करीब 12,000 साइट्स के बाद भी, मूलभूत सिद्धांत वही रहते हैं। पठनीय बनें। विश्वसनीय बनें। खोजे जाने लायक बनें। माध्यम बदलता है। अंतर्निहित तर्क नहीं।
