Соберите правильный robots.txt галочками - с готовыми пресетами для CMS, картой сайта и блокировкой ИИ-краулеров. Без ошибок в синтаксисе.
/robots.txtБесплатный онлайн-генератор robots.txt создаёт корректный файл инструкций для поисковых роботов (Яндекс, Google, Bing, DuckDuckGo) и ИИ-сканеров (GPTBot, ClaudeBot, PerplexityBot). Помогает настроить правила индексации сайта, закрыть технические разделы и указать путь к Sitemap без ошибок в синтаксисе.
Файл robots.txt располагается в корневой директории сайта и первым читается поисковыми пауками и нейросетевыми краулерами. Некорректные правила могут привести к выпадению страниц из поиска или к индексации служебных дублей.
| Платформа | Ключевые Disallow | Дополнительно |
|---|---|---|
| WordPress | /wp-admin/, /wp-includes/, /*?* | Allow: /wp-admin/admin-ajax.php |
| 1С-Битрикс | /bitrix/, /personal/, /search/ | Sitemap: https://site.ru/sitemap.xml |
| OpenCart | /admin/, /system/, /*?route= | Каталог + фильтры вне индекса |
| Tilda / Readymag | Настраивается в панели | Указание корректного Sitemap |
| Блокировка ИИ | User-agent: GPTBot, User-agent: ClaudeBot | Disallow: / - запрет сканирования |
Строго в корневом каталоге сайта, доступ по адресу https://yourdomain.com/robots.txt. Прописные буквы или другое имя (например, Robots.TXT) недопустимы.
Disallow: /admin/ запрещает сканирование раздела. Allow: /admin/public/ открывает доступ к конкретной вложенной папке внутри закрытого раздела.
В конце файла добавляется полная ссылка: Sitemap: https://site.ru/sitemap.xml. Если карт несколько, директива Sitemap указывается отдельной строкой для каждой.
Directive Disallow закрывает сканирование, но не гарантирует отсутствие в индексе, если на страницу ведут внешние ссылки. Для полного исключения используйте <meta name="robots" content="noindex, nofollow">.