Исследование 2026 года показывает, что государственный контроль над СМИ во всем мире уже оказывает влияние на результаты работы больших языковых моделей

Помнится, было много шума, когда выяснилось, что модели можно “грумить” - целенаправленно воспитывать, создавая у них ту или иную предвзятость в выдаче. Потом на широкую ногу встал allingment - и LLM стали затачивать под “культурно-национальные” ценности в диапазоне от левой политкорректности до посконной духовности.

Только что вышло исследование, которое говорит о том, что модели достаточно обучающих текстов из СМИ, чтобы отражать доминирующую общественно-политическую повестку. Вся предвзятость уже размещена в медиа-текстах, специального обучения не требуется.

Waight, H., Yang, E., Yuan, Y. et al. State media control influences large language models. Nature 655, 685–693 (2026). https://doi.org/10.1038/s41586-026-10506-7

Становится очевидно, что “общественно-безопасные” тюнингованные модели склонны сваливаться или в унылую банальность, или в пропагандистский режим, а “сырой” open source, который еще не прошел обучение людьми и не отравлен постами в СМИ, еще может удивить. В том числе, не сваливаясь в человеческие заблуждения и дрязги.

image