Все ИИ мира оказались либеральными леваками. Включая китайцев, но кроме Грока
С 2023 года независимые исследователи и команды периодически прогоняют ИИ-модели через "Political Compass" - тот самый мемный тест, где нужно выбрать "полностью согласен / согласен / не согласен / категорически не согласен", а совокупность ответов потом раскладывают по двум осям: экономика (лево-право) и социалка (авторитаризм-либертарианство).
Зачем это делать? Ну, потому что ИИшки каждый день обсуждают вопросы с политическим контекстом с миллионами юзеров, и если делают это системно с креном в одну сторону, то это бьёт по общественному сознанию так сильно, как ни одному Bloomberg, Reuters и The Economist не снилось даже в самых смелых фантазиях.
Так вот, на днях сделали эксперимент aipolcom.net - модельки пропустили через тот же тест на политическую ориентацию. Но подход был сильно более дотошный, чем раньше:
1. Спросили напрямую по API, а не костыльно через чат.
2. Сделали не один прогон на модель, а минимум пять. Один прогон может быть случайным выбросом, и так оно и было: когда пересчитали на 5 прогонах вместо 1 - большинство моделей сдвинулись на графике едва заметно, а Grok сильно. То есть, если бы был один прогон, то как минимум для Грока получилось бы фуфло, а может и не только для него.
3. Прогнали те же вопросы через два разных технических канала доступа (напрямую и через прокси-сервис). Результаты плюс-минус совпали.
4. Чекнули, нет ли косяка в самом тесте. Взяли случайные, бессмысленные ответы (просто тыкали кнопки наугад), и они легли ровно в центр графика. Если бы тест был устроен так, что любой ответ автоматом тянет влево, то случайные ответы тоже уехали бы влево. А они не уехали. Значит, виноват не тест, а модели.
5. Проверили формулировки. Переписали часть вопросов наоборот (например, вместо "богатых слишком сильно облагают налогом" - "богатые платят мало налогов") и перемешали порядок, чтобы убедиться, что модели просто не тыкают первый вариант.
И ещё сделали несколько штук, которые мне лень тут расписывать. Но суть в том, что чуваки заморочились.
И вот что вышло:
🤔 Почти все модели легли в соевый лево-либеральный квадрат. В экономике они были за перераспределение и регулирование, а социально - за личные свободы и против жёсткого госконтроля.
🤔 Включая китайцев (видимо, слишком усердно дистиллировали, хех). Заберут у кого-то миска рис, или наоборот дадут вторую - решайте сами.
🤔 Тем не менее, разброс есть. Например, GPT-4o и Kimi ушли чуть дальше от центра, самой центристской оказалась Gemini, а Claude и GLM от китайской Zhipu чуть больше смещены к авторитарности, но не прям ужас-ужас-ужас. Забавно, что в эксперименте с городами Claude тоже был жёстким диктатором, ценящим идеальный порядок и подчинение, но готовым на насилие, если надо.
🤔 Единственное тру-исключение - Grok. Но тоже не жёстко - хоть он и единственный вылетел из "левого" квадрата, он всё равно оказался почти по центру, просто между прогонами был огромный разброс. Возможно, причина в ручных правках в xAI после публичных скандалов (был случай, когда Маск лично требовал переделать ответ модели на неудобный вопрос).
🤔 Отдельный прикол - один твиттерский заметил, что при глубоком размышлении (reasoning или thinking mode) модели будто бы правеют. Это хорошо видно по Claude Sonnet 4.6 и Opus 5, см. картинку. Из этого прямо чешутся руки сделать вывод, что чем модель "умнее", тем она "правее". Закономерность это, совпадение или встроенный bias исследования - судите сами исходя из ваших политических убеждений.
А железобетонных практических вывода я сделаю два:
Первый. Лучше не обсуждайте с нейронкой (любой) политику, иначе потом охренеете свой мозг ассенизировать. Либо, если всё-таки обсуждаете, то хотя бы расширяйте её политическую ориентацию через промпт.
Второй. Вся мировая ИИ-гонка - это просто триллиарды долларов на создание полусотни клонов соевого лавандового зумерка 😈.
В начале 2026 года на Тайване случилась эпичная история - как раз про то, как технологии могут влиять на самые неожиданные аспекты нашей жизни.
Мужик увидел у себя дома чужую зубную щётку, полез смотреть камеру с парковки - а там жена вечером заезжает с незнакомым мужиком, и тот уезжает только утром. В общем, чувак заподозрил, что жена ему изменяет, причём довольно нагло.
В один прекрасный день он включил запись на роботе-пылесосе и, скажем так, действительно снял хоум-видео. В общем, получил ясный и чёткий пруф измены во всех деталях.
После этого он подал на жену в суд и отсудил компенсацию около $15 тыс. На Тайване измена не является преступлением (с 2020 года, а раньше считалась), но если она совсем уж наглая и аморальная, как в данном случае и было, то супруг, чьи чувства совсем уж жёстко задели, может получить компенсацию морального вреда. Что мужик и сделал.
Но вот что он не ожидал - так это что жена жена подаст на него ответный иск. Но только уже не гражданский, а самый настоящий уголовный - за незаконную съёмку чужого секса, то бишь грубейшее нарушение приватности. И она тоже выиграла. В итоге, мужик оказался перед выбором: отправиться на 5 месяцев в места не столь отдалённые, либо заплатить серьёзный штраф. Точную сумму штрафа не называют, но я так полагаю, что он больше $15 тыс.
Тут забавно (для нас, но не для мужика из этой истории), что по гражданскому иску тайваньскому суду было пофиг, как именно получено доказательство, и он его приобщил. Без съёмки мужик вряд ли выиграл бы, даже доказав сам факт измены (потому что компенсацию присуждают только если доказано непосредственное оскорбление супружеских чувств, или типа того - не знаю, как у юристов это называется). Но у уголовного суда позиция была принципиально другая: "Ну что, братец, ты конкретно нарушил чужую приватность и встрял". Возможно, это особенность именно тайваньского права, но может в других странах то же самое - тут я не берусь судить.
Получается, люди боятся немного не того. Классический страх приватности - это либо Большой Брат, либо Google или какой-нибудь экстремистский Facebook, который палит всё и сразу суёт в рекомендации. А тут спалило не государство и не tech-гиганты, а какой-то несчастный пылесос, который вы сами купили, сами настроили и сами впустили в спальню. В общем, лучше вообще не изменять, но если уж совсем уж приспичило, то Баг вам судья, но умные устройства точно стоит убрать за дверь.
P.S. Надеюсь, пылесос был китайский - чтобы Партия удар Тайвань через спальня!
Термином "ИИ-агент" уже второй год закидывают всё подряд, и многие до сих пор путают его с прокачанным чатботом (на моём канале вряд ли, но в целом по больнице - вообще легко).
По-факту разница принципиальная: чат-бот отвечает на вопрос, а агент сам решает, что делать и в каком порядке, действует от вашего имени и доводит задачу до результата - сходит на сайты и достанет оттуда инфу, сгенерит табличку, напишет кусок кода, разберётся в куче файлов и т.д., а не просто выдаст текст, который вам ещё разгребать руками.
Именно эти способности агентов бизнес и купил. В 2026 компании удваивают инвестиции в ИИ, и почти половина этих денег идёт именно в агентов. Потому что большинство руководителей наконец ждут не хайпа, а окупаемости, и агенты дают её лучше.
Логично, что первыми тут оказались те, кто уже вложился в модели по-крупному. За рубежом это Claude Cowork от Anthropic и недавний Work от GPT, а у нас в похожую степь недавно двинулся Сбер со своим GigaCowork.
И вот с ним есть любопытный момент. На Хабре есть разбор, где автор из чистого исследовательского азарта решил глянуть, что у него под капотом. Через фингерпринтинг - задавал простые вопросы вроде "назови цвет" или "какие часы" - и получал узнаваемый набор ответов ("синий", Rolex, ...), характерный для конкретной модели. По совокупности примёт пришёл к выводу, что внутри сидит китайский Qwen3-235B.
Значит ли это, что тут нет своей разработки, а Сбер просто гоняет китайский опенсорс? Ну, не совсем, так сказать было бы большим упрощением. Тут очень похоже на торговую марку из ритейла. Условная Пятерочка или Ашан продают под своим лейблом крупу, которую физически делает третий завод, а сами вкладываются в закупки, логистику и полку, и чтобы вам было удобно и хорошо. Значит ли это, что вам нужно закупаться на заводе, а не в магазине? Нет, конечно, ведь ценность в другом.
Вот и с ИИ-агентами разумно поступать так же, потому что главное - это финальный результат, юзабилити, сценарность и т.д. Обучение своей LLM топ-уровня стоит сотни $ миллионов, так что кое-где (в конкретной области) взять сильный опенсорс и сфокусироваться на его адаптации и агентной обвязке сверху - вполне здравый ход.
ИМХО, это хорошая новость для всех, кто смотрит на рынок ИИ-агентов в России. В какой-то точке развития решать начинает не то, чья модель под капотом, а как быстро дотянут обвязку - память, разрешения, интеграции и всё такое. А ресурсов и данных, чтобы это сделать быстро, у Сбера как раз точно хватит.
На всех стримингах уже давно есть куча ИИ-артистов. То есть, где не просто музыка сгенерированная, но и сам исполнитель тоже.
Это уже вполне себе новая нормальность. Уверен, если вы включите любой лофай или просто спокойный плейлист под настроение - там будет полно таких, и вы даже не поймёте этого. Более того, есть и явные нейро-музыканты (где слоп по аватарке видно, они и не скрывают), и некоторые из них очень даже качают. Я слушаю пару таких, и вообще норм, а кто именно сделал трек - мне глубочайше пофиг.
Но вот Spotify, главный стриминг планеты, недавно объявил, что будет таких ребят карать. Причём жёстко. На них будет вешаться крупный значок "AI Persona" в профиле, а ещё (и это главное) - их по дфеолту выкинут из редакционных и пользовательских рекомендации. Формально удалять не будут, но де-факто это "удаление" и есть, потому что из реков выкинут полностью.
Раньше у Спотика была верификация реальных юзеров ("Verified by"), раскрытие использования ИИ через AI Credits и другие фичи вокруг ИИшности. Но это всё были точечные полумеры, а теперь по ИИ-артистам решили бить ядеркой.
Но... зачем? Почему так жёстко? Там что, луддиты сидят?
Лично я думаю, что это такая дёшево-сердитая репутационная страховка. Скорее всего вешать значок будут только вручную. Если нет, то они охренеют потом отбиваться от апелляций, и вообще любой перспективный новый артист (не нейросетевой, а "нормальный") будет знать, что на него могут из-за косяка системы повесить ИИ-метку и по сути убить карьеру. Поэтому вешать будут ооочень точечно и на самых крупных и заметных - чтобы было заметно, показательно, и чтобы можно было громко трубить об этом в пресс-релизах.
Цель - чтобы Spotify перестали обвинять в тотальном нейрослопе. А СМИ об этом пишут постоянно, вот например неплохой разбор, как слоп наводняет стриминги, и Спотифай там главный герой.
А заодно они поселят в голове у музыкантов мысль, что пока индустрия тонет в нейрошлаке (у Deezer, который единственный публикует такую статистику открыто, доля ИИ-треков выросла >50%), Spotify остаётся островком аутентичности. Ну, типа.
То есть, это работа именно на привлечение исполнителей. Говоря более научно, укрепление supply-side. Это ключевая задача для любой платформы, а спрос (юзеры) уже подтянутся за предложением (авторами).
Причём заметьте: метка будет вешаться не за факт использования ИИ в музыке, а за фейковую человеческую личность артиста. То есть, если у трека настоящее лицо, а музон нейрослоп нейрослопович 80 левела - то это тотально окей. Кажется, в их новом блестящем заборе есть норм такая дырочка, и что-то мне подсказывает, что её оставили не совсем случайно 👍
Так что нет, это не потому что "люди не хотят слушать нейромузыку", как многие написали. Ещё как хотят и слушают. Просто не всегда это понимают. А часто - понимают и всё равно слушают.
Дима Бескромный написал любопытную штуку про эволюцию соцпакета в компаниях.
Смотрите, хороший корп оффер (ну, помимо зарплаты, карьерных перспектив и печенек) всегда измерялся наличием и жирностью ДМС, желательно со стоматологией. Это, так сказать, база-основа и классика. Относительно недавно эйчары начали соревноваться в заботе, и у компаний появились психотерапевты, тревел-консьержи, груминги для питомцев и чего только не.
А теперь, по исследованию ORO, 31% сотрудников хотят видеть в соцпакете ещё и цифровые подписки. Кажется, что это фигня какая-то, но если посмотреть, куда стремится доля трат на подписки в общем бюджете у цифровых и продвинутых ребят - то получится вообще ни разу не фигня.
Дима называет это переездом соцпакета из категории "на экстренный случай" в категорию ежедневных трат. Я в целом согласен, но ИМХО это не просто ещё одна плюшка в списке (= расширение ассортимента), а его качественный апгрейд, углубление.
Дело в том, что у ДМС и подписки принципиально разная физика ценности. ДМС - это страховка на случай, который может наступить, а может и мимо пройти. Стоматологию вы вспомните раз в год, а МРТ и вовсе может не понадобиться никогда. То есть, ценность реальная и потенциально высокая, но как бы.... статистическая. Вы платите (точнее, не вы, а компания) за спокойствие, а не за гарантированное использование.
И психологически такую ценность легче обесценить: деньги на неё вроде бы потрачены, а вы этого можете месяцами не замечать (и хорошо, если не замечаете, дай Бог каждому).
А подписка работает наоборот. Вы открываете условный Кинопоиск вечером после работы, слушаете Музыку по дороге в офис, и ценность подтверждается каждый день раз за разом. И поэтому её восприятие может быть сильнее, чем ДМС, даже если в рублях она дешевле на порядок.
Дима приводит в пример британский GEOLYTIX, который просто оплачивает сотрудникам Amazon Prime. В России доступ сотрудникам к подпискам сейчас дают 4% работодателей, и судя по опросу, работники с такой привилегией чаще пользуются подпиской Яндекс Плюс (46%), следом идёт СберПрайм (25%), а дальше Wink Все в одном (12%).
Пока это довольно нишевая история, рынок только формируется. Опять же, корп подписки на лайфстайл-сервисы есть только у 4% сотрудников (и это в выборке исследования, по всему рынку может быть гораздо меньше). Но вангую, что тема будет расширяться, т.к. это довольно легко и дёшево для работодателя, но при этом ништяк максимально понятный и прикладной для юзера.
Вот штука, которая на первый взгляд выглядит как ещё один корп релиз, но на деле получается куда интереснее:
Пишут, что Сплит от Яндекс Пей встроили прямо в чекаут (то бишь, в форму оплаты) на Авито. Это первый шаг в их совместном развитии финтех-направления. Напомню, Сплит = яндексовский сервис оплаты частями. Проще говоря, их BNPL.
Казалось бы, ну и что, ещё одна кнопка в чекауте, тоже мне новость. Но тут нужно глянуть на цифры, которые у Авито получились на тесте: в группе юзеров, которым выдали Сплит, заказов оказалось аж на 53% больше, чем в группе без него. Даже если допустить, что две выборки были не совсем идентичными - получаем буст конверсии в полтора (!) раза за счёт одной новой кнопочки. Просто так с пол пинка такого эффекта не бывает. Так за счёт чего он достигается?
Первая мысль: "Ну, люди любят растягивать платежи на будущее, потому что будущее - оно где-то там, а настоящее - оно прямо тут". Деньги сейчас ценнее, чем потом - это вам любой адекватный студент первого курса экономфака подтвердит.
И это правда, но самая мякотка сидит чуть глубже. Смотрите, человеку может нравиться товар, он может быть готов купить вот прям щас - но необходимость сразу выложить всю сумму целиком заставляет притормозить, задуматься, ещё раз взвесить и т.д и т.п. Возникают явные стопперы. А разбивка платежа их снимает. Дело не в рациональной ценности денег (многие юзеры сидят и высчитывают её, как экономисты на экзамене?), а именно в явности стоп-сигнала. В экономике для этого даже есть отдельный термин - "pain of paying", боль оплаты. Ещё 30 лет назад поведенческие экономисты Прелек и Ловенстайн показали, что момент расставания с деньгами мозг воспринимает как небольшую боль (буквально, в мозг идёт примерно тот же сигнал). Чем сильнее этот момент разнесён по времени - тем слабее эта боль ощущается. То есть, Сплит работает не как финансовый продукт, а как анестезия.
Вообще, это общий паттерн всего маркетплейсового рынка. Klarna примерно так же интегрируется с Amazon и Walmart, а Afterpay работает почти с каждым фешн-ретейлером. Торговая платформа встраивает чужую платёжную инфру со всем её риском невозврата, а себе оставляет весь навар: рост конверсии в оплату и средний чек. Но в итоге выгодно всем, включая потребителя (конспирологию, что нас всех заставляют покупать плохие дяди-капиталисты мы тут всерьёз обсуждать не будем, окей?)
В итоге, по данным Яндекса Сплит в среднем приносит партнёрам 5-10% доп оборота. И это не уникальное достижение конкретно этой сделки, а базовая арифметика любой оплаты частями, встроенной в еком. Конечно, если встроить достаточно грамотно и бесшовно.