"Как ChatGPT Deep Research анализирует ваш сайт: что показывают журналы событий" – исследование от Peec AI.
"Вот как ChatGPT Deep Research читает страницу:
• Он собирает информацию в три этапа: чтение сниппетов Bing → открытие страницы и беглое ознакомление → более глубокое чтение.
• Он работает на основе трех команд браузера (поиск, открытие, поиск) и никогда не использует клики (в текстовом браузере Deep Research).
• Каждое открытие возвращает ограниченное окно текста (~5–6 тыс. символов). Ссылки вверху страницы занимают этот объем, поэтому навигация может вытеснять ваш контент.
• Сниппеты Bing короткие (~285 символов максимум), что примерно соответствует всему пространству, которое вы получаете для открытия.
• Наиболее распространенный триггер повторного чтения — это поиск по ключевому слову: агент повторно открывает страницу, расположенную на строке, соответствующей найденному значению, в 95% случаев в нашем образце.
• Он переходит по ссылкам, включая ваши внутренние, чтобы найти то, что не было сказано на странице.
• Он считывает альтернативный текст изображения как обычный контент и пропускает изображения, у которых его нет.
• topn контролирует глубину поиска (количество результатов на запрос), что отличается от ширины поиска (количество запросов).
• Он читает гораздо больше, чем цитирует (прочтение не означает отсутствие цитирования).
• В логах видны его оценки доверия к домену, а некоторые виды контента просто блокируются или становятся нечитаемыми."