X опенсорснули рекомендательный алгоритм платформы – For You
https://github.com/xai-org/x-algorithm
По сравнению с прошлым релизом, объем кода вырос в 10-15 раз. И если ранее это был просто скелет, то сейчас можно смотреть на точные веса действий, скоринг аккаунтов, модели анализа медиа и все остальное. Не раскрыли только системы, определяющие, нарушает ли пост правила, но это сделано осознанно
Full разбор каждой строчки кода ниже:
Главный вывод: алгоритм продвигает посты, которые вызывают активное общение и пересылки, но одновременно режет повторы, негативные реакции, спам и опасный контент.
https://github.com/xai-org/x-algorithm
По сравнению с прошлым релизом, объем кода вырос в 10-15 раз. И если ранее это был просто скелет, то сейчас можно смотреть на точные веса действий, скоринг аккаунтов, модели анализа медиа и все остальное. Не раскрыли только системы, определяющие, нарушает ли пост правила, но это сделано осознанно
Full разбор каждой строчки кода ниже:
— Лента «Для вас» собирается заново при каждом открытии.
— Посты берутся от подписок и из рекомендаций незнакомых аккаунтов.
— Система учитывает лайки, ответы, репосты, просмотры, переходы, подписки, жалобы, блокировки и время чтения.
— Phoenix сначала находит подходящие посты среди миллионов, затем подробно оценивает лучшие варианты.
— Для каждого поста модель прогнозирует: поставишь ли ты лайк, ответишь, поделишься, подпишешься или пожалуешься.
— Итоговая оценка поста складывается из этих прогнозов с разными весами.
— Самые сильные плюсы: копирование ссылки +20, ответ взаимному подписчику +20, отправка в личку +5, цитирование +5, подписка на автора +4.
— Лайк весит всего +0,5, обычный репост +1.
— Самые сильные минусы: жалоба −234, скрытие автора −58,8, «не интересно» −43,2, блокировка −31,2.
— Поэтому содержательные ответы и пересылки ценнее простых лайков.
— Оригинальные посты людей, с которыми у тебя взаимная подписка, получают сильный бонус.
— Посты незнакомых аккаунтов по умолчанию получают понижение примерно на 25%.
— Тематические рекомендации от незнакомых аккаунтов понижаются примерно на 50%.
— Несколько постов одного автора подряд постепенно теряют вес.
— Новые и ещё мало изученные авторы могут получить небольшой пробный охват.
— Посты старше 48 часов обычно исключаются из основной подборки.
— Удаляются повторы, уже просмотренные посты, заблокированные авторы, скрытые слова и неподходящие ответы или репосты.
— Отдельный механизм перемешивает похожие публикации, чтобы лента не состояла из одной темы.
— После ранжирования работает независимая проверка безопасности: показать, скрыть за предупреждением или полностью убрать.
— Для постов от неподписок правила строже: спам, NSFW, опасные ссылки, насилие и метка «не продвигать» чаще полностью убирают.
— Отдельные модели ищут ботов, накрутку, массовый спам, скоординированные аккаунты и автоматически созданный мусор.
— Репутация аккаунта рассчитывается по сети подписок, лайков и репостов, похожим на PageRank способом.
— Изображения, видео и текст отдельно проверяются на взрослый контент и другие нарушения.
— Grox использует языковые и мультимодальные модели для анализа безопасности, спама в ответах и смысла публикаций.
— Реклама, рекомендации аккаунтов и служебные блоки добавляются уже после ранжирования постов.
— Значения могут отличаться у разных пользователей из-за A/B-тестов и динамических настроек.
— Репозиторий не раскрывает всё: отсутствуют некоторые антиспам-правила и точные Grox-промпты, а опасные для раскрытия пороги заменены заглушками.
— Production-данных и обученных моделей в репозитории нет, поэтому полностью воспроизвести живую ленту X только по этому коду нельзя.
Главный вывод: алгоритм продвигает посты, которые вызывают активное общение и пересылки, но одновременно режет повторы, негативные реакции, спам и опасный контент.