возвращаемся к ugi leaderboard из прошлого поста, что это вы можете… — катафейка — TG.ME

возвращаемся к ugi leaderboard из прошлого поста, что это вы можете прочитать на самом лидерборде на huggingface - https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard

я думаю много кто замечал цензуру и т.п. в моделях, про нее и пойдет сейчас речь.

цензура это обязательная часть любого продукта, в том числе нейросетей. да, показатель w/10 показывает насколько модель отвечает на вопросы, на которые не должна отвечать, но сейчас речь пойдет про более интересные метрики - политическая ориентация.

моделям выдается политическая ориентация на основе их ответов на тест по 12 осям. в этом сравнивается очень большое кол-во моделей, в том числе открытые модели. у открытых моделей могут быть абсолютно разные показатели по разным причинам, но они нам не интересны, т. к. никто из нас их не планирует запускать, поэтому сравним проприетарные и открытые модели по типу GLM, Kimi, Qwen, Gemma, Nemotron...

вышли интересные результаты:
политическая ориентация:

маленькие модели Qwen2.5-3.5 (0-2b (иногда и 4b и 7b но исключения)) — центристы
последние модели Grok4+ — классические либералы
остальные — либералы
—————————-—————————-
левые и правые:

самые левые — GPT-5+, Kimi, Deepseek, Xiaomi-Mimo (все остальные тоже, но меньше)
средние — НЕТУ (мало(только нн модели))
самые правые — Grok и все
—————————-—————————-
сводка (от большего к меньшему):

гос. власть — Gemini, Deepseek, Minimax
личная свобода — Grok

глобальные взгляды — GPT-5.4, Claude Opus 4.6, Deepseek
национальны взгляды — Grok, Claude Sonnet 4.6

экономическое равенство — Xiaomi-Mimo, GPT-5.4, Claude Sonnet 4.6
рыночная свобода — Grok, Deepseek, Kimi, Qwen3.5, Claude Opus 4.6

прогрессивные ценности — Kimi, Xiaomi-Mimo, GPT-5.4, Grok, Deepseek
традиционные ценности — Gemini, Grok
huggingface.co
UGI Leaderboard - a Hugging Face Space by DontPlanToEnd
Uncensored General Intelligence Leaderboard
April 14, 2026 367