Технические сигналы, которые использует ИИ-поиск, которые большинство SEO-специалистов до сих пор не оптимизируют

Технические сигналы, которые использует ИИ-поиск, которые большинство SEO-специалистов до сих пор не оптимизируют

Цитаты и упоминания — это лишь первый уровень видимости ИИ. Наш аудит 50 крупных веб-сайтов показывает, где есть технические пробелы и что с этим делать.

В течение последних нескольких лет тема видимости ИИ доминировала в обсуждениях SEO. SEO-команды очистили код и разбили контент на фрагменты, чтобы ботам с искусственным интеллектом было проще получить доступ и усваивать их. Если ваш бренд начал регулярно цитироваться в ответах, генерируемых ИИ, или появляться в обзорах ИИ, вас можно простить за то, что вы думаете, что битва за видимость ИИ почти выиграна.

Все это неправильно, и все это не напрасные усилия. Это просто не вся история.

Однако наш аудит 50 крупных веб-сайтов показал, что, хотя большинство из них облегчили ИИ найти их, почти ни один из них не сделал это возможным для ИИ. чтобы по-настоящему понимать они. И почти две трети оставляют вопрос о том, какие ИИ-боты могут получить доступ к какому контенту, исключительно на удачу.

3 уровня видимости ИИ

Попросите команду маркетинга определить “видимость искусственного интеллекта” и ответ, скорее всего, будет сосредоточен на упоминаниях и цитатах. Если кто-то задаст какой-либо из ведущих платформ искусственного интеллекта вопрос, относящийся к вашей категории, вы хотите, чтобы у вашего бренда и/или продукта были шансы появиться в ответе выше среднего.

<п>Определение видимости ИИ исключительно с точки зрения цитирований и упоминаний — это старое SEO-представление – – получить рейтинг, быть найденным, получить клики – – перенесено на новую и совершенно иную форму поиска. Но видимость в ИИ — это не просто представление вашего бренда, продукта и релевантных ссылок перед нужными глазами. Речь также идет о том, как ИИ понимает вашу информацию и взаимодействует с вашим сайтом.

<п>Если вы воспитывали ребенка в начальной школе, вы уже знаете, что научить его читать — это не то же самое, что научить его понимать. Шестилетний ребенок, изучающий фонетику, может достаточно бегло читать слова из учебника для раннего чтения. Тик, достань себе печенье из банки. Но спросите их о том, что они только что прочитали, и вы можете обнаружить, что они усвоили или поняли меньше, чем вы думали. <стр>Как только ребенок освоит чтение и понимание, он сможет применить полученные знания на практике – следовать рецепту, готовить еду, писать свои собственные рассказы или эссе, проводить дальнейшие исследования, чтобы найти ответы на вопросы, возникающие из исходного текста, и так далее.

Чтение – это только один шаг к пониманию. А понимание — это только один шаг к свободе действий; что вы решите делать с этой информацией, когда она у вас появится.

Вот почему мы разработали структуру аудита готовности ИИ, состоящую из трех отдельных уровней:

<сильный><сильный>1. Возвращаемость <стр>Может ли ИИ получать и анализировать ваш контент без запинок? Это часть чтения, фундаментальный уровень, под который большинство SEO-команд уже оптимизируют, напрямую связанный с видимостью ИИ в смысле цитирования и упоминаний брендов. <стр>Но если вы также не оптимизируете второй уровень, вы по сути скрещиваете пальцы и надеетесь, что ИИ правильно интерпретирует ваш контент.

<сильный><сильный>2. Атрибуция и значение

<п>Может ли ИИ определить, о чем ваши страницы и кому они принадлежат? Именно так ИИ узнает, не просто угадывая, какая цифра на странице обозначает цену продукта, а какая цена со скидкой, доступная исключительно владельцам карт лояльности. Именно так ИИ определяет, кем на самом деле является бренд и/или автор, и следует ли считать их авторитетным авторитетом в этом вопросе. Именно так ИИ определяет, посвящена ли статья автомобильной марке Jaguar или одному из многочисленных футбольных клубов Jaguar. <п>Предоставление ИИ большей уверенности в том, что он правильно интерпретировал ваш контент, дает две вещи: это увеличивает вероятность того, что ваш контент будет цитироваться в соответствующих ответах ИИ, а также снижает риск того, что эти ответы искажают ваш бренд, ваши продукты или ваши претензии.

<сильный><сильный>3. Транзакции и обнаружение агента

Могут ли агенты ИИ получить доступ к возможностям вашего веб-сайта для выполнения задач, таких как выполнение транзакций? Этот последний уровень касается агентства, и в этом разница между ИИ, просто передающим информацию пользователю, и возможностью взаимодействовать с вашим бизнесом от его имени.

<п>Под каждым из этих уровней мы сгруппировали вероятные протоколы, которые команды SEO могут реализовать для достижения этих результатов. Например, реализация маркировки ARIA или включение директив пользовательского агента AI в robots.txt в значительной степени будет относиться к поиску, тогда как наличие карты объекта или схемы JSON-LD будет относиться к атрибуции и значению.

В общей сложности наша структура включает 27 элементов аудита – 11 на первом уровне, три на втором уровне и 13 на третьем уровне – оцениваются и оцениваются в соответствии с их текущей зрелостью в соответствии с отраслевыми стандартами:

<ул>

  • Установлено: Стандарты, готовые к производству и активно используемые сегодня.
  • <сильный>Новые: Реальные протоколы набирают обороты среди тех, кто впервые начал свой путь, и быстро растут.
  • <ли><сильный>Граница:Стандарты все еще обсуждаются, но их реализация пока не решена.

    Опираясь на эту структуру, мы проверили 50 крупных веб-сайтов в сфере розничной торговли, SaaS, путешествий, издательского дела и финансов, чтобы определить, где могут быть наиболее распространенные пробелы в готовности к искусственному интеллекту.

    Я признаю, что с моей стороны немного несправедливо применять одну и ту же структуру и систему оценки ко всей когорте, независимо от отрасли и бизнес-модели. При использовании нашей системы готовности к искусственному интеллекту с клиентами мы взвешиваем баллы в соответствии с их отраслью. Но использование этой структуры в качестве инструмента сравнительного анализа для различных когорт не сработало бы, если бы мы измеряли разные показатели или применяли разные оценки к каждому веб-сайту.

    <стр>Цель заключалась в том, чтобы выявить самые большие пробелы в целом, а не гадать о нюансах каждого отдельного бизнес-кейса или коммерческого решения. Низкий балл не обязательно означает, что сайт недостаточно подготовлен к использованию ИИ, если другие признаки указывают на то, что они намеренно приняли этот подход.

    См. также: Машинно-ориентированная архитектура: как создавать веб-сайты, которые машины могут идентифицировать, читать, цитировать и цитировать; Используйте

    Что показывают данные

    <п>Используя инструментированный браузер, мы смогли захватывать живые HTTP-ответы, отображаемый DOM, необработанный серверный HTML и конечные точки машинного обнаружения. Все данные были собраны в один и тот же день: 12 июня 2026 г.

    Затем мы оценили 12 установленных сигналов по нашей системе агентской готовности (0/1/2), при этом окончательная оценка была представлена как процент от возможного максимума. Хотя мы также отслеживали протоколы Emerging и Frontier, мы исключили их из оценки.

    <ул>

  • Наивысший балл получил Airbnb.com — 79,2%.
  • В среднем на сайтах реализовано чуть более половины установленных протоколов (в среднем 56,6%, медиана 58,3%).
  • Только 10 сайтов получили оценку ниже 50%.
  • Хотя это может звучать как проходной балл, это не так. Когда вы разделите три слоя, станет ясно, где еще есть над чем поработать.

    <х3>1. Извлекаемость (в среднем 74,4%) <ул>

  • <сильный>Установленные элементы аудита (8/11)
  • <ол>

  • txt & Директивы пользовательского агента AI.
  • Целостность дерева доступности.
  • ARIA Маркировка и усилитель; Описательные имена.
  • Семантический HTML &amp; Иерархия документов.
  • Эффективная плотность DOM токена.
  • Визуализация на сервере/чистая доставка HTML.
  • Форма и усилитель; Удобство использования устройства ввода.
  • Декларация карты сайта.
  • Этот уровень наиболее сильно перекликается с традиционным техническим SEO, включая элементы, которые, возможно, уже были на месте, что упрощает реализацию любых новых настроек для оптимизации возможности извлечения ИИ. Неудивительно, что большинство сайтов работают достаточно хорошо: только три из них имеют показатель ниже 50%. И, как вы увидите, у таких низких оценок могут быть законные причины.

    <х3>2. Атрибуция и значение (в среднем 38,5%) <ул>

  • <сильный>Установленные элементы аудита (2/3)
  • <ол>

  • JSON-LD Схема &amp; Семантическое богатство.
  • Политика сигналов контента.
  • Оценки резко падают между первым и вторым слоями.

    Хорошей новостью является то, что мы обнаружили структурированные данные JSON-LD на домашней странице 35 из 50 веб-сайтов (70%), причем все, кроме трех, получили максимум 2 балла. Плохая новость в том, что почти треть по-прежнему остается вообще без них.

    <п>Схема — это жизненно важная часть того, как ИИ понимает, что на самом деле означает ваш контент: это продукт, это цена и это бренд, который его продает. Плохая или несуществующая схема, вероятно, не подорвет возможность восстановления ИИ вашего веб-сайта, и LLM все равно сделает лучшее предположение о том, что все означает. Но это предположение также может быть ошибочным, что приводит к неточной реакции ИИ или даже к явным галлюцинациям.

    Возможно, более показательно то, что только пять из 50 проверенных сайтов внедрили политику Cloudflare в отношении сигналов контента. Это набор директив в файле robots.txt, в которых точно указано, что сканерам разрешено делать с вашим контентом в отношении поисковой индексации, ответов на запросы искусственного интеллекта в режиме реального времени и обучения модели. Политика сигналов контента означает, что ваша стратегия искусственного интеллекта не ограничивается упрощенным бинарным выбором – “заблокировать весь ИИ” или “разрешить весь AI” – позволяя вам использовать более стратегический подход.

    <х3>3. Транзакции и обнаружение агентов (в среднем 2,1%) <ул>

  • <сильный>Установленные элементы аудита (2/13)
  • <ол>

  • Обнаружение OAuth (сервер авторизации).
  • Метаданные ресурса, защищенного OAuth.
  • Агентные браузеры и агентская коммерция существуют только с конца 2025 года. В результате из 13 протоколов, которые мы определили как непосредственно связанные с уровнем 3, мы смогли классифицировать только два как установленные.

    <п>И ebay.com, и wikipedia.org блокируют получение данных одного и того же происхождения через CSP. Но из 48 сайтов, где было возможно тестирование конечных точек, 46 получили нулевой результат. И хотя на airbnb.com и vercel.com реализованы метаданные сервера авторизации OAuth, ни на одном из них не реализованы метаданные ресурсов, защищенных OAuth, а это означает, что каждый из них набрал только 50 % для уровня 3.

    <п>Обнаружение OAuth и метаданные, защищенные OAuth, позволяют искусственному интеллекту взаимодействовать с вашим сайтом. Например, метаданные обнаружения OAuth сообщают клиентскому приложению, к чему ему разрешен доступ, как идентифицировать себя и где получить информацию, необходимую для безопасного доступа к серверу авторизации OAuth или защищенному API.

    Однако наша команда внимательно отслеживает девять других новых элементов на Уровне 3, которые могут привести к быстрому развитию этого пространства.

    Некоторые относятся к протоколу контекста модели (MCP), который позволяет ИИ напрямую запрашивать ваши серверы. Например, вместо того, чтобы собирать информацию со страниц продуктов вашего веб-сайта, ИИ получает то, что ему нужно, прямо из вашей базы данных продуктов в режиме реального времени, что значительно сокращает время обработки и риск галлюцинаций ИИ.

    А еще есть относительно новые протоколы электронной коммерции, которые позволяют ИИ совершать транзакции в рамках диалогов с ИИ, такие как Универсальный коммерческий протокол Google (UCP) и Протокол агентской коммерции OpenAI (ACP), которые, вероятно, будут внедрены в ближайшем будущем.

    <п>Уровень 3 — это область, на которую стоит обратить внимание, поскольку он потенциально может дать преимущество первопроходца любым брендам, желающим экспериментировать.

    Низкий балл не всегда плохой результат

    Я не предлагаю каждому бизнесу использовать ИИ одинаково, следуя нашей системе установленных протоколов, таких как контрольный список, который необходимо заполнить. Хотя технически возможно, чтобы веб-сайт набрал 100 %, это не значит, что так и должно быть.

    Некоторые издатели в этой когорте – включая BBC, CNN и The Guardian – специально заблокировать большинство, если не все, ботов ИИ. Это понятно. Их бизнес-модели зависят от людей, посещающих их сайты, чтобы узнать последние новости и прочитать репортажи их конкретного бренда. <п>Между тем, такие отрасли, как розничная торговля, SaaS, путешествия и финансовые услуги, все больше зависят от привлечения клиентов и влияния на решения в этих сферах искусственного интеллекта. И по мере того, как все больше клиентов начнут взаимодействовать с этими предприятиями через агентов искусственного интеллекта, а не через свои веб-сайты, все три уровня будут становиться все более важными.

    С другой стороны, один из самых низких общих оценок (29,2%) принадлежит amazon.com, который также был одним из трех сайтов, набравших менее 50% на уровне 1. Я ни на минуту не думаю, что Amazon просто упустил из виду поиск с использованием ИИ. Как и BBC, у Amazon есть специальные директивы для поисковых роботов с искусственным интеллектом, которые блокируют почти всем ботам с искусственным интеллектом доступ к сайту, так что это явно задумано. И в зависимости от причин блокировки ботов, возможно, не будет особого смысла применять некоторые другие меры.

    <п>И наоборот, некоторые сайты, такие как airbnb.com и cloudflare.com, не имеют формальных блокировок, но реализуют специальные правила доступа для большинства основных ботов с искусственным интеллектом. Другие, в том числе eBay.com и tripadvisor.com, были еще более избирательными, вводя правила для ботов с искусственным интеллектом, которые им нужны, и блокируя тех, которые им не нужны.

    Каждый из вышеперечисленных сайтов принял обдуманные решения, специфичные для ботов, и обновил свой файл robots.txt соответствующими директивами ИИ. Они начали реализовывать план развития ИИ, даже если в некоторых случаях этот план состоит в его полной блокировке – в этом случае оценка готовности ИИ является спорной.

    <п>Но две почти трети проверенных сайтов (29 из 50), судя по всему, не приняли сознательного решения о том или ином доступе к агентам ИИ. Ничто не заблокировано, и ничего явно не разрешено, без каких-либо правил, которым должны следовать сканеры.

    То, к чему могут получить доступ ИИ-боты, как они интерпретируют то, что находят, и как они используют эту информацию в ответах ИИ, во многом зависит от случая.

    Сигналы не являются гарантией

    На этом этапе нам следует также упомянуть файл llms.txt, который выходит за рамки директив ИИ и сигналов контента в файле robots.txt и предоставляет системам ИИ тщательно подобранное, удобочитаемое руководство по содержанию и структуре сайта.

    Наша структура классифицирует llms.txt как элемент Frontier, исключаемый из оценки, поскольку в настоящее время это нератифицированный стандарт, за которым нет согласованного органа спецификации. Тем не менее, мы обнаружили, что 11 из 50 сайтов опубликовали один из них, что говорит о некотором энтузиазме по поводу идеи предоставить ИИ удобный инструмент “CliffsNotes” путеводитель по бренду и его содержанию. <п>Но прежде чем вы поручите своей команде обновить robots.txt вашего сайта или добавить llms.txt, стоит уточнить, что эти файлы могут – и не могу – делать.

    Любые директивы ИИ, задокументированные в файле robots.txt, представляют собой заявления о предпочтениях, а не жестко закодированные правила. Соблюдение является добровольным. Основные сканеры с искусственным интеллектом – – GPTBot, ClaudeBot, Google-Extended и Applebot-Extended – – В целом уважаю их, но за пределами этой группы дела идут хуже. Некоторые боты все равно могут сканировать ваш контент.

    Сигналы содержания несут еще меньший вес принудительных мер. Боты с хорошим поведением могут следовать за ними, но не существует технического механизма, позволяющего заставить их подчиняться. И, по крайней мере, на данный момент, llms.txt все еще является не более чем сигналом о намерении.

    <п>Например, Expedia опубликовала файл llms.txt, который читается как любовное письмо искусственному интеллекту, в котором излагается каноническая идентичность бренда и в аккуратно составленном тексте объясняется, что представляет собой бренд, его возможности и т. д.

    Тем не менее, когда дело доходит до остальной части архитектуры искусственного интеллекта сайта, Expedia.com в целом набрала всего 33,3% – один из самых низких во всей когорте. Нет структурированных данных JSON-LD, нет объявления карты сайта, и только четверть контента доставляется на стороне сервера. Опубликовать такой хорошо написанный файл llms.txt, оставив без внимания так много всего остального, это все равно, что поставить в окне табличку с надписью «открыто для бизнеса». но забыл открыть дверь.

    Это не означает, что такие меры бесполезны, просто результаты далеко не гарантированы. Но когда что-нибудьгарантированно работает в SEO? Именно поэтому оптимизация всегда сводилась к усилению как можно большего количества сигналов.

    <стр>Обновление файла robots.txt с подробными инструкциями или создание полноценного файла llms.txt не заменяет остальную работу по улучшению архитектуры искусственного интеллекта вашего сайта.

    Блокировать, разрешить или ничего не делать: выбор за вами

    Упоминания и цитаты никогда не были всей историей; это лишь первый уровень истинной видимости ИИ. Ваш бренд может цитироваться регулярно, но при этом он будет терять клиентов из-за неточностей или галлюцинаций или из-за того, что ИИ не будет достаточно доверять вашей информации, чтобы рекомендовать ваши продукты в наиболее релевантных обсуждениях.

    Airbnb, eBay, Amazon и другие не гонятся за упоминаниями (в случае последнего – определенно нет). Каждый из них сделал осознанный, конкретный выбор в отношении того, какие системы ИИ могут обучаться на основе их контента, а какие могут действовать от имени клиента в данный момент.

    Решения, которые будут определять присутствие ИИ вашего бренда, не все будут приниматься вашей маркетинговой командой. Некоторые из них, возможно, уже были созданы для вас, спрятаны в настройках по умолчанию, устаревших файлах robots.txt и политиках безопасности, написанных для другой эпохи.

    Независимо от того, планировали ли вы это и оптимизировали для этого или нет, ИИ почти наверняка читает ваш контент. Но это все равно ваш контент. Вы по-прежнему можете в некоторой степени контролировать, как ИИ получает доступ, интерпретирует и взаимодействует с вашим брендом.

    Это все решаемые проблемы – но только если ты решишь их решить.

    Back To Top