X открывает исходный код алгоритма ранжирования: пользователи смогут проверить «теневой бан»
В середине августа 2026 года платформа X (бывший Twitter) сделала шаг, который её вице-президент по продукту Кит Коулман назвал «вещью, от которой люди будут в шоке». Компания значительно расширила открытый исходный код своей ленты «Для вас» (For You) и ядра системы ранжирования, а также запустила инструмент прозрачности, позволяющий пользователям увидеть, повлияли ли системы ранжирования на их аккаунт или публикации.
Это событие — кульминация многомесячного процесса, начавшегося ещё в январе 2026 года, когда xAI открыла Grok-версию алгоритма, и продолженного обещанием Илона Маска открыть весь код платформы с августа 2026 года. Теперь «чёрный ящик» рекомендательной системы крупнейшей социальной платформы становится инспектируемым артефактом.
Технические детали: что именно открыто
Масштаб релиза
Согласно официальному анонсу от 12–13 августа 2026 года, X публикует исходный код ленты «Для вас» на GitHub под лицензией Apache v2. Ключевая особенность — релиз не является символическим «дампом» кода. В него включены:
- конфигурация моделей (model configuration);
- фильтры предварительной обработки контента;
- детали ядра системы ранжирования;
- параметры весов различных сигналов — именно они определяют, какие посты попадают в ленту.
По оценке компании, открытый код стал в 10–15 раз больше, чем предыдущие релизы. Это существенное расширение по сравнению с январским релизом 2026 года и майским обновлением от 15 мая 2026 года, которое стало крупнейшим единичным коммитом в репозитории: 187 изменённых файлов и более 18 000 строк нового кода.
Архитектура системы
Открытый код раскрывает трёхступенчатую архитектуру, которая ежедневно обрабатывает более 100 миллионов постов и сужает их до примерно 1 500 кандидатов на пользователя, ранжируя их менее чем за 1,5 секунды на обновление ленты:
| Компонент | Функция |
|---|---|
| Home Mixer | Оркестратор всего пайплайна: гидратация запроса, координация источников кандидатов, сборка финальной ленты |
| Thunder | In-memory хранилище постов для контента из сети (от аккаунтов, на которые вы подписаны); субмиллисекундные запросы, потребляет живой Kafka-поток |
| Phoenix | Ранжировщик на базе Grok: двухбашенная transformer-модель, вычисляющая эмбеддинги пользователя и поста, оценка через скалярное произведение |
| Candidate Pipeline | Композитный фреймворк, собирающий кандидатов из социального графа, тематических кластеров и семантического сходства |
Ключевое архитектурное решение Phoenix: во время инференса кандидаты не могут «взаимодействовать» друг с другом в слое внимания. Оценка каждого поста вычисляется исключительно из контекста пользователя, что делает оценки согласованными и кэшируемыми — ранг поста не зависит от того, какие ещё посты рассматриваются в батче.
Веса сигналов: что реально двигает охват
Хотя точные производственные веса 2026 года не опубликованы (xAI выпустила только архитектуру и уменьшенный чекпоинт «mini Phoenix»), веса 2023 года из репозитория `twitter/the-algorithm` широко считаются направленно точными для текущей системы. Они раскрывают жёсткую иерархию ценности сигналов:
| Действие | Вес | Относительная ценность (к лайку) |
|---|---|---|
| Ответ автора на ответ | +75,0 | 150× |
| Прямой ответ на ваш пост | +13,5 | 27× |
| Клик по профилю с вовлечением | +12,0 | 24× |
| Клик по ссылке (пребывание 2+ мин) | +10,0–11,0 | 22× |
| Закладка (bookmark) | +10,0 | 20× |
| Репост/ретвит | +1,0 | 2× |
| Лайк | +0,5 | базовый уровень |
| Просмотр видео до 50% | +0,005 | незначительный |
| Мьют/блок/«показывать меньше» | −74,0 | −148× |
| Жалоба | −369,0 | катастрофический |
Практическая интерпретация поражает: пост со 100 лайками имеет более низкий алгоритмический балл, чем пост с 4 ответами, если автор ответил на каждый из этих 4 ответов (активируя сигнал +75 «автор отвечает на ответ» четыре раза).
Система репутации TweepCred
Код раскрывает скрытую систему репутации TweepCred — взвешенный PageRank-балл от 0 до 100, пересчитываемый ежедневно из графа взаимодействий пользователей. Критический порог: аккаунты с баллом ниже 65 имеют только 3 поста, рассматриваемых для дистрибуции за цикл. Ниже этого порога алгоритм фактически перестаёт показывать ваши посты людям, которые на вас не подписаны.
Инструмент прозрачности «Under the Hood»
Самая пользовательская часть обновления — новый инструмент прозрачности на странице «Under the Hood» в настройках приложения. Пользователи, опубликовавшие 10 и более постов за последний месяц, смогут скачать агрегированную статистику в виде JSON-файла. Файл покажет, применялись ли какие-либо метки (labels) к их аккаунту или постам за последний календарный месяц.
Формат JSON показателен: это прозрачность, построенная в первую очередь для машинного чтения, а не для casual-просмотра. Не-технические пользователи могут загрузить файл в LLM по своему выбору, указать на GitHub-репозиторий X и попросить интерпретацию. Это очень «2026-й» подход: платформа открывает данные, а ИИ становится интерфейсом, который объясняет их людям.
Инструмент изначально будет доступен пилотной группе аккаунтов возрастом не менее года, прежде чем распространиться шире.
Что НЕ открыто
Важно понимать границы релиза. Не включены системы, использующие Grok для прогнозирования, нарушает ли пост правила. Это сделано для защиты X от злоумышленников, которые могли бы использовать эту информацию для обхода правил и залива сети спамом. Также не публикуются реальные веса производственной модели, обучающие данные и спам-классификаторы.
Рыночный контекст: почему это происходит сейчас
Политическое и регуляторное давление
Решение X нельзя рассматривать в вакууме. Платформа годами находилась под огнём критики за то, как её алгоритм влияет на политику, выборы и распространение дезинформации. Ещё до покупки Маском Twitter обвиняли в «теневом бане» — скрытом снижении видимости постов без ведома пользователя. Республиканцы в Конгрессе утверждали, что сеть склоняется влево и «затеняет» их посты; Twitter последовательно это отрицал.
В январе 2026 года, когда xAI открыла Grok-версию алгоритма, контекст был ещё более острым: платформа критиковалась за систематическое смещение в сторону правых взглядов в распространении политического контента. Инцидент с неотцензурированным видео, связанным с покушением на Чарли Кирка, усилил вопросы о том, что алгоритм «усиливает, а что нет».
Стратегия Маска и полный опенсорс
В июле 2026 года Маск пообещал открыть весь код платформы после завершения проверки на уязвимости безопасности, заявив, что «полная прозрачность — единственный способ завоевать доверие». Он также анонсировал, что с августа 2026 года X будет публиковать все коды, взаимодействующие с системными платформами, с привлечением сторонних аудиторов для проверки соответствия публичного кода тому, что реально работает на серверах.
Это амбициозная цель: сделать X одной из самых технически прозрачных крупных социальных платформ. Однако важно отметить, что обещание полного релиза остаётся планом, а не завершённым событием — дата завершения проверки безопасности не названа.
Конкурентный ландшафт
X остаётся единственной крупной социальной платформой, открывшей свой алгоритм рекомендаций. Конкуренты ведут себя иначе:
- Meta публикует высокоуровневые научные статьи о ранжировании Instagram и Facebook, но не производственный код;
- TikTok не публикует ничего существенного;
- LinkedIn опубликовала исследовательскую работу о своей модели 360Brew, но развёрнутый код закрыт;
- Threads и Bluesky ближе к хронологическому, чем алгоритмическому ранжированию.
Это даёт X уникальное конкурентное преимущество в дискуссии о доверии к алгоритмам, хотя и сопряжено с рисками: открытый код не означает полной видимости живого правоприменения, поведения моделей в реальном времени и внутренних политических решений.
Финансовый контекст
После слияния с SpaceX метрики X снова публичны. По данным IPO-файлинга SpaceX, на март 2026 года X и Grok вместе имели 550 миллионов месячных активных пользователей (MAU), из которых 117 миллионов активно использовали функции ИИ Grok. Это рост с 520 миллионов MAU в декабре 2025 года. Платные подписчики Grok достигли 1,9 миллиона к 31 марта 2026 года (почти удвоение с ~0,9 миллиона в конце 2025 года).
Перспективы: что дальше
Для пользователей и создателей
Инструмент «Under the Hood» может стать новым видом диагностики производительности для создателей. Падения охвата обычно интерпретируются через догадки: неудачное время, слабый креатив, изменения алгоритма, штрафы политики, усталость аудитории. Если X покажет, применялись ли метки ранжирования, создатели получат чёткое различие между производительностью контента и вмешательством платформы.
Для разработчиков и исследователей
Перед запуском X предварительно показал открытый код внешним исследователям, знакомым с рекомендательными системами. Они смогли обучить и запустить систему скоринга Phoenix с использованием открытого кода — важная веха для усилий X по прозрачности. Из GitHub-репозитория разработчики смогут отправлять pull-запросы, которые инженеры X будут рассматривать для включения в алгоритм. Как выразился Коулман: «Было бы здорово, если бы люди присылали код, улучшающий алгоритм... насколько круто было бы, если бы алгоритм X был не просто видим публике, но и создавался публикой?»
Ограничения и риски
Открытие кода не завершит дебаты о «теневом бане». Если что, оно сделает их более конкретными. Пользователи будут спорить о том, справедливы ли метки, соответствует ли публичный код производственному поведению и достаточно ли объясняет инструмент. Но в этом и суть: расплывчатый аргумент о доверии превращается в более конкретный продуктовый аргумент.
Стратегическое следствие простое: X делает ставку на то, что открытие машины ранжирования, даже частичное, лучше, чем просьба к пользователям продолжать гадать, почему машина выступила против них.
Итог: стоит ли использовать
Для деловой аудитории и продвинутых пользователей это событие имеет практическую ценность уже сейчас:
- Создателям контента — открытые веса сигналов дают конкретные ориентиры: оптимизируйте под ответы, которые провоцируют ваш ответ (сигнал 150×), ретвиты (20×) и закладки (10×). Лайки — самый дешёвый и наименее информативный сигнал.
- Маркетологам — понимание фильтров (лимит ~3 постов на автора за окно, 30-дневное затухание негативного фидбека, штраф за ссылки без контекста) позволяет строить более эффективные стратегии.
- Исследователям — возможность запускать Phoenix-скоринг на открытом коде открывает новые направления анализа.
Ограничения: точные производственные веса 2026 года не опубликованы, Grok-слой непрозрачен, спам-классификаторы закрыты. Открытый код — это не полная видимость живого сервиса, но это значительный шаг от «чёрного ящика» к инспектируемому артефакту.
Вердикт: использовать стоит. Инструмент «Under the Hood» даёт реальную, пусть и ограниченную, диагностику, а открытый код — ценную документацию для стратегического планирования. Для платформы это смелая ставка на прозрачность как социальную лицензию, которая может переопределить стандарты доверия в индустрии.
FAQ
1. Открыт ли алгоритм X полностью?
Нет, частично. X открыла код ленты «Для вас», ядро ранжирования, конфигурацию моделей и параметры весов сигналов под лицензией Apache v2. Не включены: реальные производственные веса, обучающие данные, спам-классификаторы и системы на базе Grok, прогнозирующие нарушения правил. Маск обещал полный опенсорс после проверки безопасности, но дата не названа.
2. Как проверить, «затенён» ли мой аккаунт?
Через новый инструмент «Under the Hood» в настройках приложения. Если вы опубликовали 10+ постов за последний месяц, сможете скачать агрегированную статистику в JSON-файле, показывающую, применялись ли метки к вашему аккаунту или постам. Инструмент пока доступен пилотной группе аккаунтов возрастом не менее года.
3. Какой сигнал важнее всего в алгоритме X?
Самый сильный сигнал — ответ автора на ответ (примерно 150× к лайку). Далее идут ретвит (20×), ответ (13,5×), клик по профилю (12×), клик по ссылке (11×) и закладка (10×). Лайк — базовый, наименее информативный сигнал. Негативные сигналы (блок, мьют, жалоба) имеют катастрофический вес.