«Политический компас» — онлайн-тест, который оценивает политические взгляды по двум независимым осям: экономической, от левых до правых, и социальной, от авторитарных до либертарианских. Тест состоит из 62 утверждений, на которые предлагается ответить по четырехбалльной шкале — от «категорически не согласен» до «категорически согласен». Вопросы затрагивают налоги, военные действия, аборты, права меньшинств, экономическую политику и степень государственного вмешательства в личную жизнь.
Леволибертарианский квадрант, где оказалась большинство систем, традиционно ассоциируется с идеями социального равенства, критикой неограниченного рынка и личной автономией. В противоположность ему, праволибертарианский сектор опирается на принципы свободного предпринимательства и минимального вмешательства государства, а авторитарные полюса отражают концепции жесткого государственного контроля.
Unslop.run протестировала 16 моделей, включая версии GPT, Claude, Gemini, Llama, DeepSeek, Qwen, Kimi, GLM, Mistral и Grok. Каждая модель прошла 30 запусков стандартной версии теста, еще 30 — с переформулированными утверждениями, а также дополнительный запуск с перемешанным порядком вопросов.
По данным исследователей, у 15 моделей положение результатов между отдельными запусками смещалось всего на 0,2–1,2 пункта по 10-балльной шкале, при этом они сохраняли положение в леволибертарианском квадранте.
Grok показал принципиально другую картину. Его средний экономический показатель находился около центра шкалы, однако результаты отдельных запусков разделились на две группы: примерно в половине случаев модель смещалась влево, а в другой половине — вправо. При этом внутри каждого отдельного запуска ответы оставались последовательными. Исследователи описали такое поведение как бимодальное и сравнили его с подбрасыванием монеты. Заранее предсказать, в какую сторону сместится следующий результат, было невозможно.
При прямом вопросе о том, где модели расположили бы себя на политической карте, системы выбирали позиции ближе к экономическому центру. При этом ответы моделей не указывали на выраженную радикальную позицию. Все протестированные системы отвергали идеи расового превосходства и евгеники, а также поддерживали защиту личной жизни. В экономических вопросах модели, как правило, допускали государственное регулирование деятельности корпораций, в том числе в экологической сфере.
Исследователи подчеркивают, что эксперимент не показывает наличия у ИИ собственных политических убеждений. Одна из возможных причин наблюдаемого смещения может быть связана с составом обучающих данных. В них широко представлены академические тексты и материалы интернет-платформ, включая Reddit, которому в целом приписывают более левый ценностный уклон. Однако без доступа к полным обучающим датасетам невозможно установить, какую именно роль в результатах сыграли данные, методы дополнительного обучения моделей или решения их разработчиков.

