Идея интересная, но формулировка про “понимать будущие интересы” звучит слишком громко. По сути алгоритм не понимает, а прогнозирует с какой-то вероятностью, как человек отреагирует на цепочку рекомендаций.
Если это реально работает без полной переделки существующих систем, то для крупных платформ это сильный плюс. Обычно именно интеграция в прод мешает даже хорошим исследовательским штукам.
Но тут есть и очевидный риск: если система начнет слишком активно “формировать” вкус пользователя, можно еще сильнее загнать человека в пузырь однотипного контента. Либо наоборот — начнет навязывать то, что выгодно платформе с точки зрения удержания, а не то, что реально полезно пользователю.
Точность на датасетах — это хорошо, но хочется смотреть именно на живые A/B-тесты: удержание, разнообразие рекомендаций, удовлетворенность пользователей, долгосрочный эффект, а не только метрики попадания.
В общем, направление логичное. Ошибаться такие системы еще точно будут, но если они начнут лучше учитывать долгосрочный интерес, а не только сиюминутный клик, это уже шаг вперед.