Собираем себе утреннюю газету XXI века — девушка настроила агента, чтоб он собирал и печатал вам персональный выпуск, пока вы спите.
Каждую ночь The Morning Newspaper выбирает интересную вам информацию, смотрит календарь и почту и верстает из всего этого настоящую газету, которая автоматически отправляется на принтер. Утром остаётся только забрать свежий выпуск, прочесть за чашечкой кофе и порешать кроссворд.
Работает всё через Grokbot, проект можно собрать и настроить под себя — инструкция тут.
Скандал вокруг OpenAI продолжается: появились еще ученые, которые обвинили компанию в краже их решений!
Математик Андреас Том рассказал, что за несколько месяцев до одного из громких прорывов Astra он с коллегой активно обсуждал с ChatGPT свои неопубликованные идеи по этой же математической проблеме. А затем модель OpenAI неожиданно пришла к решению, которое опиралось… на методы Тома и его соавтора.
Том напрямую спросил OpenAI, могли ли их приватные разговоры попасть в обучающие данные или быть как-то иначе доступны Astra, но компания, разумеется, все отрицает (и делает это очень уклончиво, отвечая не на все вопросы). Математик же начал сомневаться в таком совпадении — ведь буквально на днях похожий конфликт разгорелся из-за Навье—Стокса.
Сбер выкатил GigaChat 3.5 Reasoning — свою новую флагманскую модель с режимом рассуждений. 🧠
Модель теперь разбивает задачу на шаги, строит план, проверяет себя и исправляет ошибки. На бенчмарках прирост по сравнению с версией без рассуждений заметный: LiveCodeBench v6 вырос с 56 до 85 баллов, Natural Plan — с 64 до 80. При этом на решение математических задач модель тратит в среднем на 37% меньше токенов, чем DeepSeek V4 Flash Preview.
И да, это единственная российская модель такого класса, которая открыта под MIT. Забираем GigaChat 3.5 Reasoning себе в проекты на HuggingFace и GitVerse, а тестим в GigaChat, включив режим «Рассуждение».
Подробнее о процессе обучения модели и результатах— читайте в статье на Хабре.
Возвращение кита: вышла DeepSeek V4.1 Flash — новая быстрая модель, которая бьет GPT-5.6 Sol! 😮
Главное:
🟢 Это MoE-модель на 552 млрд параметров, которая заточена под кодинг и агентные задачи. На DeepSWE v1.1 она набрала 74,2 балла, что выше GPT-5.6 Sol и Claude Opus 5!
🟢 В CyberGym тоже обошла GPT-5.6 Sol: 88 против 84. А на Automation-Bench вообще стала лучшей.
🟢 Стоит при этом от $0,15 за 1 млн входных токенов и $0,60 за выходные. Красота.
Девушки в Threads обнаружили, что мужское резюме работает лучше женского 🫠
Сразу несколько пользовательниц начали создавать на сайтах мужск » копии своих резюме: тот же опыт, образование и навыки, но другое имя и пол. И да, они утверждают, что такие профили внезапно начали получать приглашения на собеседования, пока оригинальные женские резюме ловили отказы.
У одной девушки после такой виртуальной смены пола в резюме тут же прилетело три приглашения за минуту, хотя до этого было гробовое молчание на почте.