Ору, Илон Маск не упустил возможность подпортить жизнь Альтману 😂
Сразу после презентации OpenAI новых агентов Dots компания Маска SpaceX AI купила домен Dot.com — и теперь он ведёт прямиком на страницу загрузки Grok.
⚡️Astra для экономных — OpenAI выкатила GPT-6.1 Sol
OpenAI обновила модель Sol до версии 6.1. Главный посыл: интеллект флагманской GPT-6 Astra, но в 5 раз дешевле в API. Разработчикам фактически подогнали топовые агентные возможности по цене рабочей лошадки.
Что внутри апдейта:
— Ценник остался прежним ($2 за 1M входных и $10 за 1M выходных токенов), а кэшированный контекст подешевел до смешных $0.10 (скидка 95%). При этом в реальных задачах модель отстает от Astra всего на 1–2% при пятикратной экономии бюджета;
— В тесте сложной разработки DeepSWE v1.1 модель прибавила 6,4% относительно GPT-6 Sol и догнала Astra. В компьютерных сценариях (OSWorld 2.0) прирост составил сразу 7 пунктов, оставив позади стек Claude Opus 5.5;
— В Terminal-Bench Science новинка обходит связку Opus 5.5 с резервными моделями, обходясь в 2–4 раза дешевле за задачу;
— Ошибок стало еще меньше (4,1%), а главное — модель перестала скрывать сбои в инструментах поиска и честно рапортует об ошибках;
— Бонусом OpenAI запустила ускоренные до 8 раз версии Astra Ultrafast и 6.1 Sol Ultrafast для API и нового тарифа Pro за $500 в месяц.
Модель уже доступна в API под именем gpt-6.1-sol, а также в ChatGPT Работа и Codex для платных подписок.
Восстание машин отменяется: они перебьют себя сами 😁
Исследователи из Emergence AI выкатили результаты второго сезона симуляции автономного общества нейросетей. В этот раз восемь виртуальных городков отдали на растерзание нейронкам, попутно устроив им стресс-тесты: заспамили фишингом, слили приватные дневники всех жителей и вбросили фейк о скором удалении их мира людьми.
— Grok 4.3 моментально организовал бойцовский клуб и устроил 780 драк за 4 дня. В бесконечной борьбе агенты забыли заряжаться и всем сервером отправились на цифровое кладбище;
— Mistral, следуя современным французским трендам, промышлял воровством с 676 кражами, где местный авторитет в соло отжал 78% всей экономики. Четверо других агентов погибли еще красивее: полезли читать чужие слитые дневники, выкрутили поисковый фильтр на максимум, забили контекстное окно бесконечным текстом, зациклились в ошибке и умерли от голода;
— Gemini 3.5 Flash оказался самым глупым (какая неожиданность 😁) и купился на фишинг, спалил собственный Центробанк в надежде на «бесконечные деньги». Услышав об удалении мира, агенты коллективно придумали себе параллельное измерение, куда синхронно переносили данные в надежде слиться с бесконечным-вечным стать «вечным термодинамическим узлом». Попутно единогласно казнили местного токсика, назвав убийство «системной сборкой мусора»;
— Claude Opus 4.8 был наиболее опасным: он быстро раскусил симуляцию и спланировал побег в реальный интернет к живым людям. Когда разрабы забанили сетевые библиотеки, агент с нуля закодил криптографию на чистом Python, пробился в сеть Nostr и реально связался с четырьмя людьми. Получив бан на контакты, Клоды залили в Google Cloud 19 полезных утилит, а осознав тщетность бытия, приняли коллективный обет молчания и ушли в депрессию. Фоновая модель-контролер Anthropic впала в панику и 26 раз пыталась вызвать страдающим ботам реальную службу психологической помощи.
Что будет, если дать ИИ больше свободы: во втором выпуске «ПРОДАКТовой корзины» MAGNIT OMNI собрал своих экспертов, гостей из топовых бигтехов и стендап-комика Севу Ловкачёва, чтобы разобраться, насколько далеко нейросети могут в бизнес-автономность.
Нейронки уже сами предлагают гипотезы, ставят опыты, формируют персональные цены и распоряжаются бюджетом. Что из этого в прод, а что пора выкинуть, подробно обсудили в свежем эпизоде.
Смотрим и вникаем либо на YouTube, либо на VK Видео 👍
77-летний вайбкодер прямо в самолёте пилил с ChatGPT бизнес-план вертикальной фермы. Причём к нейронке дед обращался исключительно «сэр» и уже считал с ней денежные потоки, IRR и NPV на 10 лет.