Долгое время наш сервис показывал клиенту пять чисел разом. Балл по SEO, готовность к нейросетям, контент, безопасность, КПД, а сбоку ещё цитируемость. В карточке это выглядело как «SEO 53, GEO 39, citation 0%».
Человек, который это видит, не понимает ни что каждое число значит, ни за что хвататься первым. Мы честно думали, что чем больше измерено, тем полезнее. Оказалось наоборот. Пять шкал не складываются в картину, они друг друга гасят. Пять шкал — это отсутствие шкалы.
Теперь их две, и вместе с ними мы выкладываем всё, что за ними стоит. Веса разделов, пороги каждой проверки, формулу сборки балла. Ниже разбор того, как это устроено и почему открытая таблица нам ничего не стоит.
Граница проходит по нашей ответственности
Первая шкала называется Здоровьем сайта. Всё, что она меряет, находится на самом сайте, и всё, что там падает, чинится руками. За неё мы отвечаем.
Вторая называется Заметностью в ответах и меряется опросом нейросетей от лица клиента. Это уже не свойство сайта, а состояние внешней среды. Мы её замеряем и не гарантируем, и в продукте обязаны говорить «замерили», а не «обеспечим».
Граница между шкалами проведена ровно по тому, что мы обещаем и чего не обещаем. Это не косметика в интерфейсе, это про то, за что с нас можно спрашивать.
Обе шкалы от нуля до ста. Буквы к баллам такие: от 90 и выше A, от 75 до 89 B, от 60 до 74 C, от 40 до 59 D, ниже сорока E. Число нужно, чтобы сравнивать «до» и «после», буква — чтобы запомнить и назвать вслух в разговоре.
Сто баллов Здоровья и как они разложены
Шесть разделов, сумма ровно сотня.
- Доступность для машин — 20 баллов. Робот дошёл, прочитал, и ему не запретили.
- Теги и метаданные — 18. Страница представилась правильно.
- Машиночитаемость — 15. Факты о бизнесе машина разбирает однозначно.
- Содержание и грамотность — 17. Есть что читать, и написано без ошибок.
- Скорость и вес — 10. Страница открывается.
- Доверие и право — 20. Видно, кто вы, и вы не нарушаете закон.
Внутри каждого раздела проверки со своими весами и с описанными порогами. Скажем, HTTPS даёт три балла, и проходной результат означает валидный сертификат, до конца которого не меньше двух недель. Меньше двух недель — половина веса. Нет HTTPS или сертификат невалиден — ноль. Так расписан каждый пункт, все сорок с лишним.
Считается всё скучно и предсказуемо. Пройденная проверка идёт с коэффициентом единица, спорная с половиной, проваленная с нулём. Сумма набранного делится на сумму весов и умножается на сто.
Одна цифра без второй врёт
К баллу мы всегда показываем вторую цифру, покрытие. Выглядит это как «74 балла, проверено 82% пунктов».
Причина простая. Часть проверок мы иногда не делаем. Скорость требует внешнего вызова, и на бесплатной проверке весь этот раздел уходит в пропуск. Лицензия проверяется только там, где ниша лицензируется, а для парикмахерской пункт бессмысленный. Пропущенные пункты выкидываются из знаменателя, и балл считается по тому, что действительно смотрели.
Вот тут и нужна вторая цифра. Без неё восемьдесят баллов по половине проверок неотличимы от восьмидесяти по всем. Формула ИКС Яндекса не опубликована, и претензия к нему у нас ровно эта: число есть, а из чего оно собрано, не видно. Повторять это самим было бы странно.
Есть ещё потолки. Если сайт не отвечает вовсе, выше двадцати баллов он не получит, что бы ни было в разметке. Нет HTTPS, запрещены ИИ-боты, текст рисуется скриптом и в исходном коде его нет — потолок шестьдесят. Без потолков шкала лжёт красиво: сайт с идеальной разметкой и запретом для GPTBot набирал бы восемьдесят пять, при том что ни одна нейросеть его не прочтёт вообще.
И рядом с каждой проваленной проверкой стоит цена вопроса в баллах, сколько вернётся, если это починить. Считается формулой, а не вписывается руками. Списки ошибок без ответа «что чинить первым» мы видели у всех, кого смотрели, и это, пожалуй, главное, чего рынку не хватает.
Два раздела, которых мы ни у кого не нашли
Грамотность в аудитах сайтов не проверяет никто. А цена ошибки на странице услуг измеряется не в баллах поисковой системы, а в доверии человека, который её заметил.
Правила тут пришлось выписывать отдельно, иначе проверка начнёт врать. Считается доля ошибок на тысячу слов, а не их количество, чтобы длинный текст не наказывался за длину. Обязателен словарь исключений с брендами, именами, латиницей и профессиональными словечками, и пополняется он при каждой ложной сработке. В отчёт идёт не число, а конкретное слово с адресом страницы, потому что «на /uslugi написано „консультацыя“» действует в сто раз сильнее, чем «найдено 4 ошибки».
Над буквой «ё» мы спорили дольше, чем над всем остальным разделом. Формально «еж» вместо «ёж» ошибка. Практически же половина рунета живёт без «ё», включая уважаемые издания, и подсвечивать это клиенту значит утопить настоящие находки в мусоре. Решили не считать. Заодно не считаем тире вместо дефиса и запятую в тех местах, где спорят сами справочники. Остаются только однозначные словарные ошибки, зато на них можно ткнуть пальцем и не спорить.
Второй раздел про право. Реквизиты, контакты не только формой обратной связи, политика обработки данных со ссылкой на 152-ФЗ, галочка согласия у каждой формы, оферта, авторство. Проверяется мгновенно и бесплатно, а поломано у большинства сайтов малого бизнеса.
Форма сбора данных без согласия — это нарушение 152-ФЗ с настоящим штрафом, а не гигиеническая мелочь. Человек, которому это показали за минуту и даром, обычно запоминает нас навсегда.
Почему llms.txt стоит два балла из ста
В нашем прежнем отчёте по готовности к нейросетям файл llms.txt весил шестнадцать баллов из ста. Мы его ставили клиентам и продавали как ценность.
Потом появились данные. Google открыто пишет, что файл игнорирует. Ahrefs разобрал логи 137 210 доменов и обнаружил, что 97% опубликованных файлов не получили ни одного запроса (исследование). Из тех трёх процентов, что кто-то читал, крупнейшими читателями оказались обучающий краулер и кодовый агент, а не ChatGPT с Perplexity.
Мы поставили ему два балла. Файл остался в пакете, он копеечный и вреда не приносит, но продавать его как рычаг нельзя.
Похожая история с разметкой Schema.org, и здесь мы обязаны быть точными в том, чей это замер. Ahrefs отследил 1 885 страниц, на которые добавили JSON-LD, и сравнил их с 4 000 контрольных. Цитируемость в Google AI Overviews у размеченных изменилась на −4,6% относительно контрольной группы, то есть не выросла, а просела (исследование). Замер этот чужой. Своего по AI Overviews у нас нет ни одного, и писать «в наших замерах» мы не станем. Оговорка к нему тоже важная: мерили на страницах, которые и без разметки уже цитировались, так что про сайты, которых нейросети не видят вовсе, это ничего не говорит.
Разметку мы из методики не выкинули, она занимает десять баллов из пятнадцати в разделе машиночитаемости и решает другую задачу. Но обещать за неё цитируемость перестали.
Странно рекламировать собственные понижения весов, а мы считаем их лучшим доводом за методику. Таблица, из которой ничего не убирают, обычно составлена продавцом.
Ноль, который мы сами и посчитали
Во второй шкале, Заметности, сорок баллов из ста дают за то, называют ли клиента вообще, двадцать за ссылку на его домен в ответе, пятнадцать за то, как называют, ещё пятнадцать за верность фактов и десять за долю на фоне конкурентов.
Самый продающий пункт тут четвёртый. Фраза «нейросеть говорит, что вы работаете до шести, а вы до девяти» действует на владельца сильнее любого процента.
А правило номер один в этой шкале появилось из нашей же ошибки. В знаменатель идут только те вопросы, на которые движок реально ответил. Сбой — это пропуск, а не ноль. Мы наступили на это в полный рост: тридцать ошибок движка из тридцати показывались клиенту как «упоминания 0%», потому что код считал строку с ошибкой обычным ответом без упоминания. Теперь ошибки исключены из знаменателя, а если отвеченных вопросов меньше пяти, балл не выводится вовсе, вместо него честное «замер не удался».
Ноль сам по себе результат законный и частый, ничего страшного в нём нет. Страшно, когда ноль нарисовали мы.
Движки в этой шкале взвешены не поровну, а по доле российской аудитории. Алиса и YandexGPT дают 0,40, GigaChat 0,30, ChatGPT 0,20, DeepSeek 0,10. Если ответили не все, веса нормируются по фактически ответившим, и к баллу прикладывается подпись, чем именно замерено. Усреднять поровну нельзя, это подгонка картины под то, к чему у тебя есть доступ.
И источники мы называем по именам. «Замерено по тридцати вопросам в Алисе и GigaChat» — так можно. «По одной из пяти нейросетей» — так нет.
Скопировать таблицу можно за вечер
Теперь про то, почему всё это отдаётся даром.
Пороги, которые вы прочли выше, поставлены по внешним ориентирам, по документации Google, по WCAG, по 152-ФЗ. До первого массового прогона они предварительные, и мы это пишем прямо в документе. Балл, на котором все подряд получают от тридцати пяти до сорока пяти, бесполезен: он не отличает плохой сайт от среднего, а клиент после исправлений не видит роста и перестаёт верить и баллу, и нам.
Поэтому после первой сотни проверок начинается калибровка. Смотрим распределение по каждой проверке отдельно. Пункт, который проходят все, — балласт, вес ему вниз или вон из методики. Пункт, который валят все, — либо порог задран, либо это отраслевая болезнь, и тогда про неё надо писать статью. Пороги двигаем так, чтобы медиана легла в район шестидесяти и был живой разброс. Десять сайтов с ручной разметкой держим эталоном: меняем вес, гоняем эталон, смотрим, не поехало ли. Дальше версия 1.1 и публикация того, что и почему изменилось.
Вот здесь и ответ. Таблицу весов можно скопировать за вечер. Прогнать сотню сайтов и узнать, где на самом деле стоят пороги, за вечер нельзя. Ценность не в документе, а в его откалиброванности, и она не копируется. Так что публикуем целиком, ничего не теряя.
Почему это не ГОСТ
Назвать методику ГОСТом было бы соблазнительно и глупо. Обозначение защищённое, стандарты выпускаются через технический комитет Росстандарта, и самоназвание подорвало бы ровно ту достоверность, которую мы продаём.
Сейчас это открытая методика оценки состояния сайта, версия 1.0. После калибровки её можно оформить стандартом организации: ГОСТ Р 1.4-2004 прямо разрешает юрлицам выпускать собственные СТО, форма настоящая и ничего выдумывать не надо. Дальше видно будет.
Место при этом пустует. Lighthouse меряет одну страницу и говорит про производительность. Ahrefs показывает ошибки обхода. WCAG про доступность для людей с ограничениями. Формула ИКС закрыта. Целостной публичной методики «состояние сайта», которую можно взять, прочитать и оспорить построчно, мы не нашли ни у кого.
Вместо метода на рынке принято называть количество. «Аудит по сорока параметрам», «бесплатный разбор по восемнадцати пунктам». Мы и сами едва не пошли этой дорожкой, в черновиках объявлений у нас стояло «27 параметров», и читателю это число не сообщало ровно ничего. Параметр параметру рознь. Один ловит отсутствующий заголовок, другой форму, которая собирает персональные данные без согласия. Пока не показаны веса и пороги, любое такое число остаётся просто числом.
Спорьте построчно
Полную методику с таблицами всех проверок, порогов и формул мы выложим отдельной страницей с постоянным адресом. Обновляться она будет с номерами версий и со списком того, что изменилось.
Мы заранее знаем, что часть весов расставлена неудачно. Узнаем мы об этом после сотни прогонов, а тот, кто держит руками десятки сайтов, может увидеть это прямо сейчас. Напишите, где мы неправы, с доводом. Поправим и укажем, чья была правка.
TehFin (tehfin.com), проверяем сайты на видимость в нейросетях. Чужие исследования названы по именам и со ссылками, собственные ограничения указаны там же, где и результаты.
Проверьте свой сайт по этой же методике
Балл от 0 до 100 с буквой, список поломок и порядок починки. Ответ в Телеграме за несколько секунд, бесплатно.
Проверить свой сайт