98 из 100 по готовности к нейросетям и ноль упоминаний
2026-08-04 · TehFin
Я занимаюсь проверкой сайтов на видимость в нейросетях. Логично было начать с себя — и результат оказался таким, что о нём стоит рассказать целиком, вместе с провалом.
Сайту год. Технические проверки дают почти максимум. Упоминаний в сети — ноль. Ни один ИИ-ассистент не называет нас, когда его прямо спрашивают о людях нашей профессии. Ниже — что именно измерено, чем измерено и какой из этого следует вывод.
Что показывает техническая проверка
- Здоровье сайта — 89 / 100
- Готовность к нейросетям — 98 / 100
- robots.txt — ИИ-роботы разрешены поимённо
- llms.txt — есть
- Разметка Schema.org — на месте
В robots.txt поимённо открыты GPTBot, ClaudeBot, PerplexityBot и другие. По любому чек-листу, который сегодня продают под вывеской «оптимизация под ИИ», сайт сделан правильно. Пунктов, которые можно было бы дозакрыть, почти не осталось.
Роботы действительно приходят
Это не гипотеза, это журналы сервера за 14 суток. Я проверял не по строке User-Agent — её подделывает кто угодно, — а по адресам, сверяя их с официальными списками владельцев.
- GPTBot (OpenAI) — адреса 74.7.x
- ClaudeBot (Anthropic) — адреса 216.73.216.0/22
- Googlebot — подтверждён обратным DNS
- bingbot — подтверждён обратным DNS
Адреса сверены с openai.com/gptbot.json и claude.com/crawling/bots.json.
Итог: двери открыты, гости заходят, всё прочитано.
И при этом нейросети нас не знают
Шесть запросов к ГигаЧату вида «посоветуй, к кому обратиться» — формулировки разные, смысл один. Нас не назвали ни разу. Ноль из шести.
Поиск по названию компании выдаёт финскую пиццерию TehFin Oy. Она старше, она в индексе, а мы — нет.
Как мы поймали нейросеть на выдумке
Это самая интересная часть, и она не про нас, а про то, как вообще устроен ответ модели, когда знать ей нечего.
В одном из прогонов ГигаЧат назвал семь компаний. Я проверил каждую. Три из семи не существуют:
- «Webline-Studio» — не находится
- «SECLAB» — не находится
- «Digital Solutions Group» — не находится
А Kokoc, Demis Group и «Ашманов и партнёры» — настоящие лидеры рынка — не названы ни разу. При этом модель знает их прекрасно: на прямой вопрос «что ты знаешь о Kokoc Group» отвечает подробно и по делу. Но в ответ на «посоветуй, к кому обратиться» не вспоминает их вообще.
Тот же вопрос трижды подряд дал ещё более честную картину: в трёх прогонах не названо ни одной компании. Только категории — «SEO-агентства», «фрилансеры», «профильные студии».
Вывод, который я делаю из этого: у модели нет устойчивой связи между задачей и конкретными исполнителями на нашем рынке. Когда связи нет, она либо уходит в категории, либо собирает правдоподобное имя из частотных кусков — «webline», «studio», «solutions group». Попасть в такой ответ техническими средствами невозможно, потому что ответ не опирается ни на какой источник.
Цифра, которая объясняет всё остальное
Веб-архив — грубый, но честный индикатор того, сколько следов домен оставил в сети.
- наш домен — 4 страницы
- SeoProfy — 8 420 страниц
- Ingate — 10 450 страниц
Первая сохранённая страница нашего домена — 14 июля 2025 года. Разница с лидерами — в две с половиной тысячи раз. Вот и весь ответ на вопрос «почему нас не знают». Не в robots.txt дело.
Почему техническая часть не спасает: три измерения не наши
Мне важно было понять, я один такой или это системно. Данные говорят — системно.
llms.txt почти никто не читает. Ahrefs разобрал логи 137 210 доменов и обнаружил, что 97% опубликованных файлов llms.txt не получили ни одного запроса. Из тех 3%, что читали, крупнейшие читатели — не ChatGPT и не Perplexity, а обучающий краулер и кодовый агент. (ahrefs.com/blog/llmstxt-study)
Разметка не добавляет цитируемости. Ahrefs отследил 1 885 страниц, на которые добавили JSON-LD, и сравнил с 4 000 контрольных. Цитируемость в Google AI Overviews у «размеченных» изменилась на −4,6% относительно контрольной группы. Не выросла — упала, и результат статистически значим. (ahrefs.com/blog/schema-ai-citations)
Google говорит это прямым текстом в документации: «Вам не нужно создавать новые машиночитаемые файлы, AI-текстовые файлы, разметку или Markdown, чтобы появиться в Google Поиске (включая его генеративные возможности), поскольку Google Search их не использует». (developers.google.com/search/docs/appearance/ai-features)
Я не жалею о потраченном на технику времени — сайт от этого стал лучше и быстрее. Но продавать это как «оптимизацию под нейросети» — значит продавать воздух. Мой собственный результат 98/100 при нуле упоминаний — тому доказательство.
Что по данным действительно влияет
Aggarwal et al., KDD 2024 («GEO: Generative Engine Optimization», Принстон и IIT Delhi) — контролируемый эксперимент примерно на 10 000 запросов. Работают не файлы, а содержание текста: добавление статистики, прямых цитат и ссылок на источники поднимает видимость в генеративных ответах до +40%. Keyword stuffing даёт ноль. (arxiv.org/abs/2311.09735)
«Ашманов и партнёры» замерили источники нейроответов Алисы: доля сайтов вне топ-10 органики Яндекса за период с августа 2025 по январь 2026 сократилась вчетверо — с 40% до 10%. То есть до 90% цитируемого приходится на органический топ, а вероятность попасть в ответ заметно падает уже после пятой позиции. (sostav.ru)
Здесь важная оговорка, и я обязан её сделать, раз уж выше разбирал чужие исследования по строгости. В публикации не раскрыт объём выборки — сколько запросов и доменов легло в основу этих процентов, из текста неизвестно. У Ahrefs выборка названа (137 210 доменов, 1 885 страниц против 4 000 контрольных), у Принстона названа (около 10 000 запросов), здесь — нет. Направление я считаю верным, оно совпадает и с моими наблюдениями, и со здравым смыслом. Но точность самих процентов без методики проверить нельзя, и подавать их как истину в последней инстанции я не буду.
Отдельная ирония: «Ашманов и партнёры» — одна из тех компаний, которую ГигаЧат не назвал ни разу. При том, что именно они это исследование и провели.
Главный вывод
Техническая готовность и известность — разные вещи, и первая без второй не работает.
Готовность — это про то, сможет ли робот прочитать сайт, если придёт. Известность — про то, всплывёт ли имя в ответе, когда никто никуда не ходит и модель отвечает из того, что уже усвоила. Первое я закрыл на 98 из 100. Второго у меня нет вообще, и никакой robots.txt этого не заменит.
Что из этого следует лично для меня. Файлы уже лежат, трогать их не надо. Дальше — только то, что даёт следы: тексты с числами, замерами и ссылками на первоисточники; публикации на площадках, которые индексируются; попадание в органику, потому что через неё нейросети и берут источники. Медленно, без гарантий, без единой кнопки.
Через полгода вернусь с новыми замерами. Если ничего не изменится — напишу и об этом тоже.
Автор — TehFin (tehfin.com), проверяем сайты на видимость в нейросетях. Все цифры по нашему сайту получены на нём же, логи и прогоны сохранены.