Сайт для ИИ-агентов: что это значит в 2026 году и что я сделал на своём
«Сайт для ИИ-агентов» — это сайт, с которого программа-помощник может забрать факты и запустить нужную функцию, не разбирая вёрстку и не кликая по пикселям. Практически это четыре вещи: страница отдаётся не только в HTML, но и в чистом markdown по запросу; в robots.txt написано, что можно делать с содержимым; цены размечены так, что их можно сравнить; формы подписаны, чтобы агент понял, что куда вводить. Ни одна из этих вещей сегодня не обязательна и трафика сама по себе не приносит. Стоит она часы работы — поэтому я сделал всё это на своём сайте и рассказываю, что получилось и что не получилось.
Откуда вообще взялась эта тема
В 2025 году спорили о том, как попасть в ответ нейросети. В 2026-м появился следующий слой: ассистент не только рассказывает о вас, но и пытается что-то на вашем сайте сделать — найти цену, сравнить с другими, заполнить форму. Для этого он либо читает HTML целиком, тратя на разметку и скрипты больше токенов, чем на текст, либо пользуется тем, что сайт даёт ему явно.
Отсюда — набор молодых соглашений и целая полка бесплатных проверок готовности сайта к агентам: Is Agentic от Vercel и Is It Agent Ready от Cloudflare. В рунете я таких сервисов не нашёл, и русскоязычных объяснений — тоже.
Заодно тему подогрел Яндекс: 29 июня 2026 года он представил платформу для создания ИИ-агентов в Алисе AI и пообещал, что «первые внешние партнёры получат возможность создавать агентов до конца года». Условий и документации на день написания статьи нет — поэтому всё, что ниже, про открытые соглашения, а не про Алису.
Что именно проверяют
| Что | Зачем агенту | Статус на 4 сентября 2026 |
|---|---|---|
Markdown по заголовку Accept | тот же текст без разметки и скриптов — дешевле читать | согласование содержимого описано в RFC 9110, тип text/markdown — в RFC 7763; это действующие стандарты |
Content-Signal в robots.txt | владелец сайта отдельно говорит, что можно: поиск, ответ ИИ, обучение | политика Cloudflare от 24 сентября 2025 года, не стандарт |
| Карточка MCP-сервера | описание функций, которые сайт даёт вызвать | черновик SEP-2127 в рабочей группе Model Context Protocol |
| Аннотации форм (WebMCP) | агент понимает, что куда вводить, вместо угадывания по вёрстке | черновик рабочей группы W3C, поддержка в браузерах экспериментальная |
| Честный код 404 | не считать, что на сайте существует любой адрес | обычный HTTP, никаких новых стандартов |
| Цены в разметке | сравнить ваше предложение с другими | schema.org, давно и всеми поддерживается |
Насколько это редко: Cloudflare
17 апреля 2026 года разобрал
200 000 самых посещаемых доменов мира. Markdown по Accept отдают 3,9% сайтов,
предпочтения по использованию содержимого в robots.txt объявили 4%, а карточки
MCP-серверов и каталоги API вместе встретились меньше чем на 15 сайтах из всех
двухсот тысяч.
Что я сделал на своём сайте
Полное описание с адресами и командами живёт на отдельной странице — «Для ИИ-агентов». Здесь коротко, по делу.
Markdown-двойник каждой страницы
Запросите любую страницу с заголовком Accept: text/markdown — придёт чистый
markdown: заголовки, списки, таблицы, абсолютные ссылки. Ни навигации, ни
скриптов. Проверить можно одной командой:
curl -sI -H "Accept: text/markdown" https://jernovoi.ru/ceny
В ответе должны быть Content-Type: text/markdown; charset=utf-8 и
Vary: Accept. Второй заголовок важнее, чем кажется: без него кэш-посредник
однажды отдаст человеку markdown, а агенту — HTML.
Отдельная тонкость — дубли для поиска. Двойник несёт заголовок Link с
указанием канонического HTML-адреса; эту форму понимают и Яндекс, и Google.
А вот запрет индексации я на двойник ставить не стал: документация Google прямо
не рекомендует закрывать noindex-ом страницу, у которой уже указан
канонический адрес — два сигнала конфликтуют.
Content-Signal в robots.txt
Одна строка рядом с правилами для роботов: search=yes, ai-input=yes. Это
значит «содержимое можно показывать в поиске и брать в ответ нейросети».
Третий сигнал, ai-train (обучение моделей), я намеренно не указал: по
документации отсутствие сигнала означает, что владелец использование и не
разрешает, и не запрещает, а это решение владельца бизнеса, а не разработчика.
MCP-сервер только для чтения
По адресу /mcp работает сервер Model Context Protocol: ассистент может
спросить список услуг с вилками цен, получить текст страницы, поискать по сайту
и посчитать вилку стоимости по анкете калькулятора. У сервера нет ни одного
инструмента записи — ни заявок, ни писем, ни изменения данных, — и нет
авторизации, потому что он отдаёт только то, что и так опубликовано.
Это осознанный принцип, а не недоделка: читать можно, действовать — человек. Цена ошибки автономного агента в чужой заявке выше, чем польза от автоматической отправки.
Аннотации форм и калькулятора
Форма заявки и поле «проверить сайт» помечены атрибутами из черновика WebMCP: имя инструмента, описание, подписи полей. Атрибута автоматической отправки на них нет — без него браузер обязан передать управление человеку. Галочку согласия на обработку персональных данных агент не ставит: это подтверждает человек сам.
Калькулятор формой не является, поэтому его функция объявлена вторым способом, из той же спецификации: страница регистрирует инструмент «посчитать вилку», и он тоже только считает — ничего не сохраняет и никуда не переходит.
Честная 404 и цены в разметке
На несуществующий адрес сайт отвечает кодом 404, а не «страница есть». Звучит банально, но 200-й код на любом адресе — частая находка: тогда и поисковый робот, и агент считают, что на сайте существует всё что угодно.
Цены наконец попали в разметку. Раньше я их туда не клал, считая, что Offer
требует точной суммы, — оказалось, неверно: у schema.org для вилки есть
PriceSpecification с minPrice и maxPrice. Числа берутся из той же
конфигурации цен, из которой печатаются на странице, так что разойтись они не
могут. Про разметку подробнее — в разборе
«Schema.org простыми словами».
Что показали внешние проверки
Перед началом работ, 4 сентября 2026 года, я прогнал jernovoi.ru через оба
бесплатных чекера, а вечером того же дня, после выкатки, — ещё раз:
| Проверка | До правок (утро) | После выкатки (вечер) |
|---|---|---|
| Vercel Is Agentic | 77 из 100, «готов, но с заметными пробелами» | 91 из 100, «крепкая техническая база» |
| Cloudflare Is It Agent Ready | уровень 1 из 5, «базовое присутствие в вебе» | уровень 1 из 5, но из тринадцати проверок прошли ещё три: markdown по Accept, заголовки Link, карточка MCP |
Что у меня не проходило утром: markdown по Accept, Content-Signal, карточка
MCP-сервера, заголовки Link, разметка WebMCP. Ровно это и было сделано.
Почему у Cloudflare уровень не вырос. До второго уровня чекеру не хватает одной
проверки — Content-Signal, а её он вечером не увидел: в его улике лежал
утренний robots.txt без директивы. Причина на моей стороне: сервер отдавал этот
файл с разрешением кэшировать его год (так по умолчанию делает Next.js со
статическим ответом), и прокси чекера запомнил старую версию. Срок я сократил
до часа; когда их кэш обновится, требование закроется само — проверю позже и
допишу. Урок общий: заголовок Cache-Control у robots.txt стоит проверять,
прежде чем удивляться чужому отчёту.
Что не проходит по-прежнему и почему: тело ответа 404 у меня в HTML, а Vercel
хочет видеть короткий markdown с указателями; раздел «когда обращаться к сайту»
в llms.txt чекер не распознал — выяснять его эвристику я не стал; страницы
/about, /contact, /privacy под английскими адресами заводить ради галочки
не буду — они есть под русскими; в разметке Person на главной нет url и
jobTitle — мелочь, добавлю следующим обновлением.
Проверить текущий результат можно самому, ничего не устанавливая:
npx is-agentic jernovoi.ru --json
и открыть isitagentready.com, вписав туда адрес. Свой сайт проверяется так же — и, скорее всего, покажет уровень 1: это норма для 2026 года, а не приговор.
Отдельно скажу про честность самих чекеров: они смотрят только ту страницу, чей адрес вы им дали. Аннотации форм у меня живут на страницах с формами, а не на главной, — значит, в отчёте по главной этот пункт останется красным, хотя разметка на сайте есть. Такие мелочи стоит держать в голове, прежде чем относиться к оценке как к диагнозу.
Нужно ли это вашему бизнесу прямо сейчас
Честно: в большинстве случаев — нет, и уж точно не в первую очередь. Если на сайте нет текста без скриптов, нет внятных заголовков и цен, а формы не работают на телефоне, никакая карточка MCP-сервера не поможет. Сначала — база; про неё у меня есть разбор GEO и честный ответ про llms.txt.
Что из списка выше окупается почти всем и без всякой моды на агентов:
- Код 404 вместо 200 — чинит битые ссылки и мусор в индексе.
- Цены в разметке — их читают и поисковики, и ассистенты, и это не про будущее, а про сегодня.
- Текст в HTML, а не в скриптах — самая частая причина, по которой сайт «невидим» для машин.
Остальное — эксперимент на переднем крае. Я вложился в него потому, что это часы работы и ноль риска для посетителя: ни одна из перечисленных вещей не меняет то, что видит человек.
Коротко
- Сайт для агентов — это машиночитаемые поверхности рядом с обычной страницей, а не отдельный сайт и не переделка.
- Действующий стандарт из всего набора один — согласование содержимого по
Accept(RFC 9110 и RFC 7763). Остальное — черновики и политики отдельных компаний. - По данным Cloudflare на апрель 2026 года markdown по
Acceptотдают 3,9% сайтов из мирового топ-200 000, карточку MCP-сервера — меньше 15 сайтов. - Мой сайт умеет всё перечисленное; MCP-сервер сознательно только читает — заявку отправляет человек.
- Начинать стоит не с этого: сначала текст в HTML, честная 404 и цены в разметке.
Частые вопросы
Это как-то повлияет на позиции в поиске?
Прямых подтверждений нет ни у кого, и обещать я не буду. Косвенно помогают две вещи из списка: честный код 404 (меньше мусора в индексе) и цены в разметке schema.org — их поисковики читают давно. Markdown-двойник на позиции не влияет, он про стоимость чтения для ассистента; чтобы он не создал дублей, у него указан канонический адрес HTML-страницы.
Агент сможет оформить заказ на моём сайте?
На моём — нет, и это моё решение: у MCP-сервера нет инструментов записи, а у форм нет атрибута автоматической отправки. Технически сделать так можно, но тогда вы отвечаете за заявки, которые оставила программа: за ошибки в данных, за согласие на обработку персональных данных и за случайные дубли. Пока стандарты в черновиках, я считаю правильным оставить последний шаг человеку.
Сколько это стоит сделать на обычном сайте?
Зависит от того, на чём сайт собран. Content-Signal в robots.txt и честная 404 — это минуты на любой платформе. Цены в разметке — час-два, если цены вообще есть на сайте текстом. Markdown-двойники и MCP-сервер требуют доступа к коду: на конструкторе их обычно не сделать. Отдельной услуги «подготовка к агентам» у меня нет — это часть работы по видимости в ИИ-ответах.
А если стандарт изменится и всё придётся переделывать?
Скорее всего, часть изменится: WebMCP и карточка MCP-сервера — черновики, и имена атрибутов уже менялись. Поэтому я держу всё это в одном месте кода и проверяю имена по первоисточникам, а не по статьям в интернете. Переделка — несколько часов, а не переписывание сайта. Это и есть причина, по которой я называю происходящее заделом, а не продуктом.
Как проверить свой сайт, не разбираясь в командной строке?
Откройте экспресс-аудит и вставьте адрес — в блоке «Видимость в
ИИ-ответах» будут те же пять наблюдений: markdown по Accept, карточка
MCP-сервера, разметка WebMCP, ответ на несуществующий адрес и цены в разметке.
Отчёт появится на экране, без регистрации и без контактов.
Проверить свой сайт
Статья статьёй, а как с этим на вашем сайте? Проверю публичную страницу и покажу наблюдения — без регистрации и контактов.