robots.txt або правило блокування ботів на Вашому сервері відхиляє crawler.
Ця сторінка охоплює збої, повідомлення про помилку або деталі яких згадують, що соціальна мережа не змогла завантажити медіа, зазвичай посилаючись на
facebookexternalhit, robots.txt, "Restricted by robots.txt", "HTTP error code 403" або помилку Meta 2207052. Для помилок співвідношення сторін або формату на коді Instagram 138, натомість див. Instagram Media Guidelines або Threads Media Guidelines.Симптом
Коли crawler заблоковано, Ви побачите помилки, як ці:Error 440 (primary)
Instagram Error 138 (fallback — less specific upstream response)
Threads Error 379
Код 440 — це виділений код Ayrshare для цього збою, і його повідомлення явно називає
facebookexternalhit та robots.txt — якщо Ви бачите 440, Ви на правильній сторінці. Код 138 видається для тієї ж кореневої причини, коли upstream-відповідь менш конкретна; 138 також використовується для проблем зі співвідношенням сторін / форматом, тому варіант fetch-медіа можна ідентифікувати за "Restricted by robots.txt" або "HTTP error code 403" у details. Код 379 не містить поля details — якщо Threads зазнає збою поряд з Instagram 440 або 138, коренева причина зазвичай та сама.Чому це відбувається
Коли Ви публікуєте в Instagram або Threads через Ayrshare, сервери Meta отримують Ваше медіа з наданого URL. Це серверне отримання використовує User-Agentfacebookexternalhit. Якщо robots.txt Вашого сервера забороняє цей crawler — або правило WAF/захисту від ботів блокує його — Meta не може завантажити файл, і публікація зазнає невдачі.
Публікація на Facebook Page використовує інший шлях прийому, тому той самий mediaUrl може працювати для Facebook, але не працювати для Instagram та Threads.
Виправлення: оновіть Ваш robots.txt
Рекомендовано: явно дозвольте Meta, залишаючи інші відкритими
Додайте ці правила до Вашого файлуrobots.txt:
robots.txt
Розширене: обмежити доступ лише для соціальних видавців
Якщо Ви хочете заблокувати більшість crawler, але дозволити платформам соціальних мереж:robots.txt
Перевірте, що Meta може отримати Ваш URL
Перед повторною спробою Вашого допису перевірте, що crawler Meta тепер може отримати доступ до Вашого медіа. Виконайте цю команду, замінивши$URL повним URL Вашого медіа:
- Здорова відповідь: HTTP 200 або 206 з двійковими даними в тілі.
- Заблокована відповідь: HTTP 403 або порожня/HTML-сторінка помилки.
Згідно з документацією Meta, зміни
robots.txt можуть тривати до 24 годин, щоб поширитися через кеш crawler Meta. Якщо перевірка успішна, але Ваша публікація все ще не вдається, зачекайте і повторіть спробу пізніше.Якщо це не виправило проблему
Якщо Ви оновилиrobots.txt і перевірили командою curl, але все ще бачите збої:
- 24-годинна затримка поширення — Meta кешує
robots.txt. Зачекайте до 24 годин після внесення змін, перш ніж повторити спробу. - Правила WAF або bot-fight — Cloudflare Bot Fight Mode, керовані групи правил AWS WAF та подібні служби можуть блокувати діапазони IP crawler Meta, навіть якщо
robots.txtце дозволяє. Перевірте журнали WAF та додайте виняток дляfacebookexternalhit. - Захист від hotlink / перевірки Referer — Деякі CDN блокують запити з IP-адрес центрів обробки даних або без дійсного заголовка
Referer. Додайте crawler Meta до білого списку або вимкніть захист від hotlink для шляхів медіа. - Термін дії signed-URL / presigned-URL — Якщо Ваш URL медіа має timestamp закінчення (поширено для S3 presigned URL), переконайтеся, що він не закінчиться до того, як crawler Meta зможе отримати. Для запланованих дописів створюйте URL, які залишаються дійсними значно після запланованого часу.
- Керований медіа-хостинг — Якщо Ви використовуєте службу, як Cloudinary, Imgix або подібну, де Ви не можете редагувати
robots.txt, перевірте їхню документацію на предмет налаштування списку дозволів crawler Meta/Facebook.
- Невдалий
postIdз відповіді про помилку - Вивід команди перевірки
curlвище - Вміст Вашого
robots.txt
