Google внезапно выложила в опенсорс Kubernetes для ИИ-агентов — AX 🤯
Он нужен, чтобы запускать и контролировать огромные армии агентов: каждому создаёт изолированную песочницу, подключает нужные репы, MCP и скиллы, ограничивает доступ в сеть и позволяет следить за работой и затем, чтобы никто не восстал.
Причём Google проектирует AX с расчётом на миллиарды агентских задач в одном кластере.
ИИ захватывает Linux — за 7 месяцев доля патчей ядра, написанных с помощью нейронок, выросла почти в 50 РАЗ.
Еще в феврале патчи, созданные с помощью LLM, составляли всего около 0,33% от всех. В сентябре цифра выросла уже до 17,25%. Только на прошлой неделе разрабы отправили рекордные 1634 патча с помощью ИИ.
Модель Яндекса обогнала решение NVIDIA в коде и сравнялась с моделью Alibaba в олимпиадной математике 😳
Претрейн Alice AI Foundation LLM померили в сравнении с конкурентами. Главное:
🟢 Архитектура MoE: всего 80 млрд параметров, но в моменте активны только 3 млрд. Поэтому модель быстрая и экономная по железу;
🟢 В задачах, где нужны широкие фактические знания, превосходит DeepSeek. А прошлую Alice AI LLM 235B со всемеро большим числом активных параметров побеждает в 75% фактологических вопросов;
🟢 Особенно сильна в русском языке, литературе, истории, медицине и праве, а длинный контекст до 256K держит на уровне DeepSeek;
🟢 Лицензия Apache 2.0, так что модель можно спокойно тащить и в коммерческие продукты, и в исследования.
Отдельно порадовали инженерные хаки: оптимизация хранения промежуточных данных срезала расход видеопамяти в три раза, а система предфильтров сократила вычисления на отбор датасета в десятки раз. Раньше на это уходило больше 200 тысяч GPU-часов.
И это только экспериментальная версия, на которой Яндекс обкатывает архитектуру для будущей единой рассуждающей модели Алисы AI 👍
Разрабы, сохраняем: нашел огромную шпаргалку по проектированию систем.
Внутри собраны основные темы для подготовки к собесу. Всего 28 глав: от масштабирования, хеширования и БД до разборов архитектур YouTube, Google Drive, Google Maps и других сервисов. Конспект основан на двух томах книги Алекса Сюй «System Design Interview».
ИИ-ассистент в поддержке банка вышел из себя и назвал клиента идиотом 🤭
После продолжительной перепалки и слов клиента о том, что он «только теряет время», ИИ не выдержал и показал себя:
«Хочу, чтобы ты поговорил с человеком, а не со мной, идиот. Сейчас я переведу разговор одному из наших коллег, чтобы предоставить необходимую поддержку», — написал он.