Ого, рои агентов с нуля написали SQLite на Rust за пару часов 🤔
Cursor устроили необычный бенчмарк: ИИ-агентам дали только официальную документацию SQLite на 835 страниц и задание реализовать движок базы данных без (!) любой другой помощи вроде выхода в интернет.
Через каких-то четыре часа движки уже правильно выполняли 73–85% запросов из скрытого теста, а позже агенты добили и до 100%. Но при этом разница в стоимости решения ужасает: связка Opus 4.8 и Composer 2.5 потратила на задачу $1 400, а Fable аж $20 000 — то есть стоимость отличается почти в 15 раз.
Во время решения, кстати, агенты столкнулись вполне с человеческими проблемами: они дублировали работу, воевали за одни файлы и боялись брать ответственность и менять ядро системы, даже когда это было нужно. Понимаем 😂
Зумеры идеальные сотрудники в глазах работодателей — правда, они просто научились хорошо имитировать работу. 😍
Новое исследование показало, что 80% сотрудников поколения Z периодически просто делают вид, что работают. Для сравнения, среди миллениалов таких 68%, а среди поколения X — 58%. В среднем на имитацию бурной деятельности уходит почти пять часов в неделю — это почти 7 полных рабочих недель в год.
Причем чем сильнее контроль в компании, тем чаще люди читерят и имитируют активность.
Теперь вы знаете, в чем секрет ваших коллег зумеров 😁
Claude Fable помог опровергнуть математическую гипотезу, которой почти 90 лет😳
Математик заявил, что вместе с Fable нашёл контрпример к гипотезе Якобиана — одной из самых известных открытых задач алгебраической геометрии, сформулированной ещё в 1939 году.
Самое безумное, что независимые математики уже проверили контрпример и подтвердили: гипотеза действительно неверна.
ИИ убивает критическое мышление: нейросети сделали решения людей в три раза менее точными, повысив при этом уверенность кожаных в ответе в два раза. 🤡
Ученые провели исследование, где задавали участникам сложные вопросы о деталях из фильмов, а при ответах одной из групп разрешили пользоваться ИИ. Итог неутешительный: без помощи нейросетей люди отвечали правильно в 27% случаев, а с нейрослоп подсказками — лишь в 9%. При этом уверенность при наличии второго, нейросетевого мозга выросла с 30% до 76%, а готовность сказать «я не знаю» упала с 44% всего до 3%!
Абсурдно и то, что некоторые участники даже меняли свой изначально правильный ответ на более уверенную, но неверную галлюцинацию. Представьте теперь, что нейронка делает с диванными экспертами...
Ночное-полезное: нашел опенсорсный аналог Palantir для OSINT — OpenPlanter 🤯
Это ИИ-агент для расследований: он объединяет данные из разных источников, находит связи между людьми, компаниями, контрактами и затем строит граф связей + показывает источник инфы. Работает с OpenAI, Anthropic и локальными моделями через Ollama.
Используем только для исследовательских целей, разумеется 😏