<стр>Один показатель, один издатель, один полностью документированный метод и цифры, отличающиеся в 30 раз. Никто не лгал, и это то, что стоит понять.п>
Коэффициент количества посетителей Anthropic составляет 70 900 к одному, 38 000 к одному, 23 951 к одному, 11 122 к одному, 10 300 к одному, 4 580 к одному и 2 237 к одному. Каждая из этих цифр принадлежит Cloudflare. Каждая была опубликована примерно за 13 месяцев. Два из них заявляют об одном и том же месяце и отличаются примерно в 17 раз.
. <п>Если вы не отслеживаете количество ссылок, которые вы сканируете, вся идея умещается в один абзац. Каждая компания, занимающаяся искусственным интеллектом, использует сканеры, которые извлекают страницы с вашего сайта. Некоторые из этих платформ также отправляют вам посетителей, когда человек читает ответ и переходит к источнику под ним. Соотношение сравнивает эти два показателя. Сколько страниц заняла платформа и сколько людей она отправила обратно. Пять к одному означает, что было получено пять страниц и возвращен один посетитель. Семьдесят тысяч к одному означает, что он принес семьдесят тысяч и вернул одну.
<п>Оно существует, потому что старая договоренность сломалась. Поисковый робот забирал ваши страницы и взамен отправлял вам трафик, и эта торговля была экономической основой для публикации чего-либо в открытой сети. Системы искусственного интеллекта отвечают на месте, поэтому прием продолжался, а отправка обратно в основном не прекращалась. Это соотношение является самым чистым выражением того, насколько однобоким стал этот обмен, поэтому он быстро распространился, появился в колодах и начал принимать реальные решения о том, какие краулеры пройдут через дверь.
Он все еще растет. На своей майской конференции разработчиков Google заявила, что количество пользователей AI Mode превысило миллиард в месяц и что количество запросов «увеличивается более чем вдвое каждый квартал с момента запуска». представлена как история о полезности, а не о том, куда эти ответы перестают направлять людей. Имейте в виду вторую цифру. Удвоение каждый квартал без указания базовой базы — это темп роста, который вы не можете использовать. Это та же самая проблема, о которой говорится в этой статье: она находится внутри объявления, которое задает его масштаб.
Очевидная мысль о дисбалансе заключается в том, что кто-то был небрежен или кто-то вращался. Это прочтение неправильное, и оно более комфортно, чем то, что произошло. Cloudflare опубликовал четкую метрику, полностью задокументировал метод и раскрыл свои ограничения в сообщении, в котором он был представлен. Числа по-прежнему разбросаны по порядку величины, потому что отношение — это числитель, а не знаменатель, а внутри него расположены четыре знаменателя, которые почти никто не переносит вперед, цитируя число.
Метод не тот, где это ломается
<п>На прошлой неделе я писал о контенте поставщиков, ссылаясь на источники, которых, как оказалось, не существует. Это более сложная версия той же проблемы, и я хочу заранее прояснить разницу. Здесь каждый источник реален, издатель заслуживает доверия, а документация общедоступна. Сбой все равно произошел.
<п>Cloudflare представила соотношение сканирования и перехода в июле 2025 года и ясно изложила расчет. Возьмите общее количество запросов от пользовательских агентов, связанных с данной платформой, на которые ответом был HTML. Разделите это на общее количество запросов на HTML-контент, где заголовок Referer содержал имя хоста, связанное с этой платформой. Нормализовать до одного реферала. Вот и вся формула, опубликованная, недвусмысленная и воспроизводимая любым, у кого есть журналы сервера.
Они также опубликовали части, которые подрывают их собственные показатели, а это больше, чем у большинства компаний. Ниже показано, что происходит с хорошо построенным номером после того, как он покидает здание.
4 Знаменатели в 1 слой
<п>Первый знаменатель — это окно. В сообщении о запуске Cloudflare период выборки составлял с 19 по 26 июня 2025 года, одна неделя, и Anthropic вышел с соотношением 70 900 к одному, а Mistral — с соотношением 0,1 к одному, отправляя 10 рефералов на каждый запрос на сканирование. В отдельном посте в том же месяце цифра Anthropic за июнь 2025 года составляет 73 000 к одному, OpenAI — 1700 к одному, а Google сканирует примерно 14 раз на одного реферала. Тот же издатель, тот же месяц, разные окна, разные цифры. В дальнейшем вы теперь найдете квартальные, ежемесячные, скользящие 28-дневные и недельные показатели, циркулирующие рядом друг с другом, как будто они представляют собой одно и то же измерение.
<п>Какое значение имеет окно? Cloudflare сообщила, что соотношение Google меняется на 19,4% еженедельно, объясняя это падением сканирования GoogleBot, которое началось в определенный день. Решение о планировании сканирования увеличило опубликованное число на пятую за семь дней. Два аналитика, добросовестно выбирающие разные окна, дадут разные ответы, и оба будут правы.
Во-вторых, какого бота вы посчитали. Cloudflare заявляет, что обучающий сканер платформы и его сканер пользовательских запросов, работающие под разными пользовательскими агентами, для анализа объединяются под одним именем платформы. Эти два поведения не имеют ничего общего. Человек потребляет в больших масштабах и ничего не возвращает по замыслу. Другой извлекает информацию по требованию и может предоставить цитату. В совокупности фигура платформы не описывает ни того, ни другого. Это также делает стандартное сравнение с Google структурно необоснованным, поскольку некоторые операторы используют парки гусеничных машин, разделенных по назначению, а другие используют унифицированные, поэтому агрегат измеряет разные типы объектов с каждой стороны.
Третье – чьи сайты. Cloudflare видит трафик, проходящий через Cloudflare. Это огромная выборка, и все же выборка, взвешенная по свойствам, которые за ней стоят. Когда один аналитик измерил один и тот же показатель для сети Cloudflare и для своей собственной небольшой коммерческой группы за тот же период, соотношение одной платформы примерно удвоилось. Только состав панели изменил ситуацию.
4-й имеет значение
<п>Знаменатель – это не рефералы. Это рефералы заявили о себе.
Реферал участвует в расчете только в том случае, если запрос содержит заголовок Referer, называющий платформу. Cloudflare прямо заявляет, что трафик, передаваемый родным приложением Клода, не включает этот заголовок, и что, по их мнению, то же самое справедливо и для других провайдеров. нативные приложения, а поскольку подсчет рефералов охватывает только веб-инструменты, расчеты могут завышать коэффициенты. Их слова о размере этого искажения: Неясно, насколько сильно.
<стр>Прочитай это еще раз. Компания, публикующая метрику, в сообщении, анонсирующем ее, заявила, что в знаменателе отсутствует неизвестное количество того, что он должен подсчитывать, на платформах, использование которых все чаще происходит именно в том месте, которое не учитывается. Это не сноска. Это заявление о том, что метрика имеет планку погрешности, которую никто не может измерить, и раскрыто единственной стороной, которая может это знать.
<п>Пятое решение показывает, сколько суждений заключено в простой формуле. Cloudflare исключает реферальный трафик из собственной сети Google на том основании, что предварительная загрузка, основанная на правилах спекуляции, не является потреблением контента человеком. Это защита. Это тоже призыв, и другой аналитик мог бы сделать это по-другому и получить другую цифру Google, не ошибившись.
Что раздевается по пути вниз
Так что предостережения существовали и были опубликованы открытым языком источником в момент публикации. К тому времени, когда эти цифры достигают слайда в ежеквартальном обзоре, ни одна из них не прилагается.
<п>Я не называю анализы, из которых я извлек эти семь цифр. Модель имеет значение, а издатели — нет, и большинство из них были резюмированы добросовестно. Этот механизм стоит описать, потому что это не мошенничество и не ошибка. Каждый пересказ сжимает. В первом случае оговорка о нативном приложении исключается, поскольку это усложняет заголовок. Второй удаляет окно, потому что число более приемлемо без прикрепленного диапазона дат. Третий читает второе, видит чистую цифру с достоверной атрибуцией и повторяет ее. Четыре шага от источника — и у вас есть целое число, название компании и полная уверенность.
<п>В одном из этих семи содержалось явное предупреждение о том, что коэффициенты привязаны к конкретному окну и никогда не должны усредняться по периодам, и что цифры не являются одновременно реальными и не универсальными. Тот выполнил свою работу правильно. Он находится в тех же результатах поиска, что и те, которых нет, и выглядит идентично.
Решения уже принимаются от этого
<п>Это было бы академической жалобой, если бы число было декоративным. Это не. Издатели используют коэффициенты сканирования и перехода, чтобы решить, какие сканеры с искусственным интеллектом разрешить, а какие заблокировать. Именно для этого Cloudflare создала метрику для поддержки и разумного ее использования. Маркетинговые команды используют те же цифры, чтобы доказать, что реферальный трафик ИИ не стоит использовать. Оба решения трудно отменить, потому что мы все знаем, что как только решение принято, очень сложно поднять его и снова рассмотреть по разным причинам.
Теперь сопоставьте четыре знаменателя с этим. Если большая часть рефералов платформы поступает через собственное приложение, не отправляющее заголовок Referer, соотношение завышает дисбаланс на величину, которую никто не определил количественно. Если на рисунке объединены обучающий сканер и сканер, обрабатывающий запросы пользователей, возможно, вы блокируете того, кто мог бы вас процитировать, чтобы остановить того, кто никогда бы этого не сделал. Если оно пришло из окна, где этот оператор выполнял интенсивный тренировочный проход, вы создаете полупостоянную политику из временного всплеска.
<п>Разброс должен заставить любого осторожно действовать в отношении одной фигуры. На той же неделе на одной платформе было около 70 900 к одному; другой измерял 0,1 к одному, отправляя 10 переходов на каждую запрошенную страницу. Это не разница округлений по категориям. Эти коэффициенты описывают индивидуальные решения по продукту в отдельных компаниях в отдельные моменты, и рассматривать любое из них как стабильное свойство платформы — это ошибка категории.
Что на самом деле от вас требуется
Общая идея неудобна, потому что она применима далеко за пределами коэффициентов гусеничного сканирования и применима к цифрам, которым вы сейчас можете верить.
<п>Фигура без окна, группировки и границы коллекции не является фигурой. Это форма, похожая на одну. Эти три вещи не являются предостережениями, связанными с числом; они — то, что его строит, и ряд, отделенный от них, не был упрощен. Его сделали непригодным для использования, хотя он по-прежнему выглядит пригодным для использования, что хуже, чем быть явно неправильным, потому что в комнате оспариваются явно неправильные числа.с>
Это дает вам бесплатный тест, который быстро дисквалифицирует. Когда кто-нибудь вручит вам измерение, спросите, какой период оно охватывает, что было сгруппировано для его получения и где остановился сбор. Это не составит труда. Если эти три ответа не доступны сразу, тот, кто держит число, тоже не знает, что оно означает, и вы оба собираетесь что-то решить на основе формы.
Я бы распространил это на целую категорию. Мы находимся в ситуации, когда многие компании поставляют измерительные продукты в видимость ИИ, и я один из них, так что взвесьте это соответствующим образом. Те, кто стоит ваших денег, сообщат вам свое окно, свою группу и свои границы, даже не спрашивая, как это сделал Cloudflare. Те, которые не будут просить вас доверять номеру, который они не определили. Cloudflare раскрыла все три, но экосистеме все же удалось потерять их при передаче. Продавец, который никогда их не раскрывает, даже не дает вам чего терять.
Вопрос заключается не в том, является ли число точным. Большинство цифр в этой статье точны (насколько я могу судить). Это то, знаете ли вы, какое число посчитало, а что нет.
Если вы столкнулись с показателем в этом разделе, который развалился после того, как вы спросили, что было в знаменателе, оставьте комментарий или свяжитесь напрямую. Мне бы хотелось увидеть больше примеров, и конкретные из них более полезны, чем общий аргумент.
Этот пост был первоначально опубликован на сайте Duane Forrester Decodes.
