
Разбор · 07.10.2026
Robots.txt согласуют с публичными разделами сайта, а агенты проверяют правила перед выпуском
Что принять у разработчика: правила обхода, согласование с sitemap и проверки каждого хоста. Пример vibecoding.ru: инженер ведёт машину агентов и принимает работу по факту.
Текст подготовлен машиной агентов под надзором инженера vibecoding.ru · факты проверены 7 октября 2026
Robots.txt для сайта принимают вместе с правилами публичных и служебных разделов: ответ «файл работает» ещё не доказывает, что витрина открыта, а кабинет защищён.
ИИ-агенту можно поручить сверку этих правил перед выпуском; покажем, какие доказательства принять у разработчика на примере нашего сайта, без клиентского кейса.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
1. Сначала согласуют назначение разделов, потом директивы.
Что должен делать robots.txt для бизнеса? Давать поисковым роботам правила обхода. RFC 9309 отделяет эти правила от авторизации.
Каталог продукта нужен в поиске, кабинет нужен после входа. Публичная служебная страница может открываться всем, но не участвовать в поиске.
Такие решения согласует владелец раздела. Ответственность за ошибки остаётся у людей, даже если файл подготовил агент.
обход, поиск и доступ принимают по разным доказательствам.
RFC 9309; Google Search Central, robots.txt и noindex; документация проверена 07.10.2026. Средства выбирают по назначению раздела.
Disallow не гарантирует исчезновение адреса из поиска. Google может узнать URL из чужой ссылки, даже когда обход содержимого запрещён.
Для публичной страницы с noindex робот должен прочитать само правило. Если путь закрыт в robots.txt, Google его не увидит.
Личные данные ради noindex не открывают. Их защищают авторизацией, а поведение поиска проверяют отдельной задачей.
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Правила роботов | RFC 9309, Google Crawling Infrastructure, Google Search Central и Яндекс Вебмастер. Отдельно сверены область действия, noindex, совпадение путей и назначение sitemap | 2026-10-07 |
| Живой сайт | HTTPS-ответы robots.txt витрины и кабинета, общий sitemap, /open и /services, 7 октября, 23:00 МСК. Ответы двух файлов правил: 200, текст. В 23:09 подтверждён конфликт /payment и публичного /payments | 2026-10-07 |
| Устройство проверок | Прочитаны генератор robots.txt, тесты по хостам, общий список служебных зон и проверка реестра страниц. Тесты в этом заходе не запускались; полный состав предлагаемой приёмки не объявляем уже работающим | 2026-10-07 |
| Истории машины | Записи 7 и 8 июля, 12 августа 2026 сверены с первичными журналами. В июльской записи защита запросов предложена как исправление, её выпуск там не подтверждён | 2026-10-07 |
| Граница опыта | Клиентского кейса этой услуги нет. Пример статьи: машина агентов на vibecoding.ru. Влияние на поисковый трафик не измеряли | 2026-10-07 |
2. Robots.txt и sitemap берут правила из одной карты сайта.
Как избежать противоречия между robots.txt и sitemap? Хранить назначение разделов в одном месте. Иначе одна правка закроет страницу, а другая продолжит приглашать робота её обойти.
Sitemap перечисляет адреса, которые сайт предлагает поисковику. Google рекомендует включать туда страницы, которые нужны в результатах поиска.
У нас общий список служебных зон используется в robots.txt и при сборке sitemap. Это устройство машины на vibecoding.ru, а не замер клиентского проекта.
витрина и кабинет имеют разные правила.
живые robots.txt двух хостов и sitemap.xml, 07.10.2026, 23:00 МСК; устройство и тесты сверены с кодом в тот же день.
Проверка нужна и на появление публичного раздела. Файл с одними запретами не обнаружит, что новая статья забыта в карте сайта.
Наш тест сопоставляет публичные страницы с реестром адресов. Отдельный тест требует, чтобы robots.txt покрывал общий список служебных зон.
Общий список ещё не гарантирует согласованное поведение. На нашем сайте 7 октября запрет /payment захватывал публичный /payments, который присутствовал в sitemap.
запрет /payment закрывает публичный /payments.
живые robots.txt и sitemap, 07.10.2026, 23:00 МСК; повторная проверка адресов 23:09 МСК. Результат выведен по правилам совпадения путей Google и дополнительно сверен простым разбором файла. Посещений поискового робота этим замером не подтверждаем.
3. Витрину и кабинет проверяют по разным хостам.
Почему одного файла недостаточно? Google применяет robots.txt к хосту, протоколу и порту, с которых его получил. Поддомен кабинета не наследует правила основного сайта.
У vibecoding.ru витрина открыта для обхода, а app.vibecoding.ru закрыт целиком. Один шаблон «запретить всё» для обоих хостов закрыл бы и витрину.
В наших тестах отдельно заданы основной хост, кабинет и снятый учебный хост. Локальный адрес кабинета тоже получает его закрытые правила.
каждый хост проверяют отдельно.
код проверок, прочитан 07.10.2026. Живые ответы проверены только у витрины и app-хоста; тесты в этом заходе не запускались.
Работающая функция ещё не доказывает работающий адрес. В выпуске нужно получить robots.txt по HTTPS и сверить итоговый ответ после перенаправлений.
Ответ 200 принимают вместе с содержимым. Страница ошибки или форма входа под этим кодом не становится файлом правил.
У нас оба публичных адреса robots.txt вернули 200 и текст правил 7 октября. Это подтверждает ответы этих адресов, а не состояние всех страниц сайта.
4. Агент сверяет правила с ожидаемым поведением адресов.
Что поручить агенту перед выпуском? Согласованную карту и список ожидаемых результатов. Формулировка «сделать правильный robots.txt» оставляет ему решение, какие страницы нужны бизнесу.
Правила для ИИ-агентов задают границы работы. Для этого файла граница конкретна: агент предлагает изменения, а назначение разделов утверждает руководитель.
Постановку задачи агенту дополняют адресами по обе стороны запрета. Для кабинета проверяют корень и вложенную страницу, для витрины оставляют положительный пример.
расхождение с картой останавливает выпуск.
предлагаемый состав приёмки на основе RFC 9309, Google, Яндекс Вебмастера и проверок vibecoding.ru; 07.10.2026. Это не отчёт о запуске всех этих проверок в нашем конвейере.
Строка «Disallow есть» слишком слаба для приёмки. В Google более конкретное разрешение может выиграть у общего запрета.
Именная группа Googlebot тоже требует своего сценария. Она не наследует общую группу со звёздочкой: нужен разбор результата для робота, а не поиск строки в файле.
Проверку закрепляют в конвейере как условие выпуска. Совет в переписке забывается, а расхождение с ожидаемым адресом должно останавливать правку.
Истории нашей машины объясняют, зачем это разделение. Обход, список публичных адресов и чтение служебных данных ломались по разным причинам.
Поломки закрепляют требования к приёмке.
07.07
Ревью обнаружило чтение служебных агрегатов через публичные запросы в обход защиты экрана. Урок для приёмки: проверять доступ к самим данным; запрет обхода этого не доказывает. Запись того дня предлагала исправление, но не подтверждала его выпуск.
08.07
Аудит обнаружил пропущенные новости и подборки в sitemap, а /admin не был запрещён в robots.txt. Теперь общий список служебных зон используют оба механизма; тест сверяет покрытие.
12.08
SEO-аудит выявил отсутствие объявления новостной карты в robots.txt. Добавили вторую строку Sitemap, а тест закрепил обе карты.
записи наших журналов по указанным датам, сверены 07.10.2026; нынешние правила и тесты прочитаны в коде. Приватные файлы не цитируются.
5. Выпуск принимают по протоколу и наблюдают после выкладки.
Кто принимает результат? Инженер сверяет протокол с назначением разделов. Обязанности руководителя разработки и агентов здесь разделены: машина проверяет, человек решает, что публиковать.
Протокол содержит хост, адрес, ожидание и фактический ответ. Формулировка «всё зелёное» не показывает, проверяли ли вообще кабинет.
На открытой странице машины показана роль инженера: правила он пишет заранее, работу принимает по факту. Проверки помогают принять решение, но не определяют назначение раздела.
После выкладки проверяют те же адреса на боевом сайте. Отдельно смотрят, что поисковик увидел при следующем обходе, в его инструментах для вебмастера.
Если появилось расхождение, к нему добавляют воспроизводимую проверку. Так найденная ошибка возвращается в правила следующего выпуска, а не остаётся замечанием в отчёте.
Принятая правка и поисковый результат имеют разные сроки. Загрузка sitemap сама по себе не гарантирует индексирования: это отдельно оговорено в документации Google.
сигнал после выкладки меняет следующую проверку.
предлагаемый порядок наблюдения после выпуска; доступность, кэширование и ограничения sitemap описаны Google и Яндексом, проверено 07.10.2026. Это последовательность действий, не замер их скорости.
6. Заказывают согласование и приёмку, а не отдельный текстовый файл.
Что включить в заказ разработчику? Перечень хостов, согласованную карту разделов и доказательства её исполнения. Тогда результат можно принять по адресам, даже если код написал агент.
Ручные списки в нескольких местах создают технический долг сайта. После переименования раздела приходится вспоминать, где ещё остались старые правила.
Для постоянного потока изменений эту работу можно включить в подписку на разработку. На 7 октября тариф «Один проект» стоит 250 000 ₽ в месяц, один поток работы.
заказ завершают картой, правилами и протоколом.
предложенный объём заказа; цена и один поток сверены с живой /services, 07.10.2026, 23:00 МСК. Страница не обещает отдельный тариф или срок для robots.txt.
Разовая настройка файла не требует месячной подписки. Она уместна, когда у сайта есть очередь доработок и кому-то нужно вести их дальше.
Если в компании некому согласовать такую приёмку, следующий шаг: тест для руководителя. Он помогает разобрать работу отдела с агентами, но не сканирует robots.txt.
Своего клиентского кейса этой услуги у нас нет. Пример статьи: машина агентов на vibecoding.ru; перечисленные проверки можно использовать как предмет обсуждения с вашей разработкой.
7. Частые вопросы
Где должен лежать robots.txt?+
В корне нужного хоста по адресу /robots.txt. Файл в папке раздела не задаёт правила всему сайту; поддомен проверяют отдельно.
Можно ли убрать страницу из поиска через Disallow?+
Запрет обхода не гарантирует удаления URL из поиска. Для публичной страницы используют noindex, который робот должен прочитать; закрытые данные защищают авторизацией.
Нужно ли писать noindex в robots.txt?+
Для Google правило noindex задают в HTML страницы или HTTP-заголовке X-Robots-Tag. В robots.txt оно не поддерживается.
Достаточно ли генератора robots.txt онлайн?+
Генератор подготовит файл, но не согласует назначение разделов и не проверит выдачу данных без входа. Для приёмки нужны конкретные адреса и ожидаемые результаты.
Роботы поиска и агенты для кода исполняют одни правила?+
Нет. Поисковый робот читает robots.txt перед обходом сайта. Агент для кода читает задачу и правила разработки, затем готовит файл и проверки.
Гарантирует ли sitemap попадание в поиск?+
Нет. Google называет подачу карты сигналом, который не гарантирует даже её загрузку. Сверка карты устраняет противоречия сайта, но не обещает поисковый трафик.
Источники
- RFC 9309: Robots Exclusion Protocol (сентябрь 2022) — стандарт
- Google: How Google interprets the robots.txt specification — официальная документация
- Google Search Central: Introduction to robots.txt — официальная документация
- Google Search Central: Block Search indexing with noindex — официальная документация
- Google Search Central: Build and submit a sitemap — официальная документация
- Яндекс Вебмастер: Использование файла robots.txt — официальная документация
- Яндекс Вебмастер: Использование файла Sitemap — официальная документация
- Правила обхода витрины vibecoding.ru — живой ответ сайта
- Правила обхода кабинета app.vibecoding.ru — живой ответ сайта
- Общая карта публичных адресов vibecoding.ru — живой ответ сайта
- Открытая страница машины агентов — наш сайт
- Разработка по подписке: условия «Один проект» — наш сайт
Запомнить
1. Согласуйте назначение разделов до правки robots.txt.
2. Разделяйте обход, исключение из поиска и защиту данных.
3. Сверяйте robots.txt и sitemap с одной картой сайта по каждому хосту.
4. Принимайте протокол с адресами и результатами, затем проверяйте боевой ответ.
5. Каждое найденное расхождение превращайте в проверку следующего выпуска.