robots.txt या एक bot-blocking नियम crawler को अस्वीकार कर रहा है।
यह पेज उन विफलताओं को कवर करता है जिनके error message या details में उल्लेख है कि सोशल नेटवर्क media को डाउनलोड नहीं कर सका, आमतौर पर
facebookexternalhit, robots.txt, "Restricted by robots.txt", "HTTP error code 403", या Meta error 2207052 का संदर्भ देते हुए। Instagram code 138 पर aspect-ratio या format त्रुटियों के लिए, इसके बजाय Instagram Media Guidelines या Threads Media Guidelines देखें।लक्षण
जब crawler अवरुद्ध होता है, तो आपको ऐसी त्रुटियाँ दिखाई देंगी:Error 440 (primary)
Instagram Error 138 (fallback — less specific upstream response)
Threads Error 379
Code 440 इस विफलता के लिए समर्पित Ayrshare code है और इसका message स्पष्ट रूप से
facebookexternalhit और robots.txt का नाम लेता है — यदि आप 440 देखते हैं, तो आप सही पेज पर हैं। Code 138 उसी मूल कारण के लिए उत्सर्जित किया जाता है जब upstream response कम विशिष्ट होती है; 138 का उपयोग aspect-ratio / format मुद्दों के लिए भी किया जाता है, इसलिए media-fetch variant details में "Restricted by robots.txt" या "HTTP error code 403" द्वारा पहचाना जा सकता है। Code 379 में details फ़ील्ड शामिल नहीं है — यदि Threads Instagram 440 या 138 के साथ विफल होता है, तो मूल कारण आमतौर पर वही होता है।ऐसा क्यों होता है
जब आप Ayrshare के माध्यम से Instagram या Threads पर प्रकाशित करते हैं, तो Meta के servers आपके द्वारा प्रदान किए गए URL से आपका media प्राप्त करते हैं। यह server-side fetchfacebookexternalhit User-Agent का उपयोग करती है। यदि आपके सर्वर का robots.txt इस crawler को अनुमति नहीं देता — या एक WAF/bot-protection नियम इसे अवरुद्ध करता है — तो Meta फ़ाइल को डाउनलोड नहीं कर सकता और publish विफल हो जाती है।
Facebook Page publishing एक अलग ingestion path का उपयोग करता है, यही कारण है कि वही mediaUrl Facebook के लिए काम कर सकता है लेकिन Instagram और Threads के लिए विफल हो सकता है।
समाधान: अपना robots.txt अपडेट करें
अनुशंसित: Meta को स्पष्ट रूप से अनुमति दें, अन्य को खुला रखें
अपनीrobots.txt फ़ाइल में ये नियम जोड़ें:
robots.txt
उन्नत: केवल social publishers तक सीमित करें
यदि आप अधिकांश crawlers को अवरुद्ध करना चाहते हैं लेकिन सोशल मीडिया प्लेटफ़ॉर्म को अनुमति देना चाहते हैं:robots.txt
सत्यापित करें कि Meta आपके URL को प्राप्त कर सकता है
अपनी पोस्ट को पुनः प्रयास करने से पहले, सत्यापित करें कि Meta का crawler अब आपके media तक पहुँच सकता है। इस कमांड को चलाएँ,$URL को अपने पूर्ण media URL से बदलें:
- स्वस्थ response: body में binary data के साथ HTTP 200 या 206।
- अवरुद्ध response: HTTP 403 या एक खाली/HTML error पेज।
Meta के दस्तावेज़ के अनुसार,
robots.txt परिवर्तनों को Meta के crawler cache के माध्यम से प्रचारित होने में 24 घंटे तक लग सकते हैं। यदि सत्यापन सफल होता है लेकिन आपकी पोस्ट अभी भी विफल होती है, तो प्रतीक्षा करें और बाद में पुनः प्रयास करें।यदि यह इसे ठीक नहीं करता है
यदि आपनेrobots.txt अपडेट किया है और curl कमांड से सत्यापित किया है लेकिन फिर भी विफलताएँ देख रहे हैं:
- 24-घंटे का प्रसार विलंब — Meta
robots.txtको cache करता है। परिवर्तन करने के बाद पुनः प्रयास करने से पहले 24 घंटे तक प्रतीक्षा करें। - WAF या bot-fight नियम — Cloudflare Bot Fight Mode, AWS WAF managed bot rule groups, और समान सेवाएँ Meta के crawler IP ranges को अवरुद्ध कर सकती हैं भले ही
robots.txtइसे अनुमति दे। अपने WAF logs की जाँच करें औरfacebookexternalhitके लिए एक अपवाद जोड़ें। - Hotlink protection / Referer जाँच — कुछ CDN data-center IPs से या बिना वैध
Refererheader के अनुरोधों को अवरुद्ध करते हैं। Meta के crawler को whitelist करें या media paths के लिए hotlink protection अक्षम करें। - Signed-URL / presigned-URL समाप्ति — यदि आपके media URL में एक expiration timestamp है (S3 presigned URLs के साथ सामान्य), तो सुनिश्चित करें कि यह Meta के crawler द्वारा फ़ेच करने से पहले समाप्त न हो। scheduled पोस्ट के लिए, ऐसे URL जनरेट करें जो scheduled समय के बाद भी लंबे समय तक मान्य रहें।
- Managed media hosting — यदि आप Cloudinary, Imgix, या समान सेवा का उपयोग करते हैं जहाँ आप
robots.txtसंपादित नहीं कर सकते, तो Meta/Facebook crawler allow-list setting के लिए उनके दस्तावेज़ की जाँच करें।
- error response से विफल
postId - ऊपर दिए गए
curlसत्यापन कमांड का output - आपकी
robots.txtसामग्री
