Из ИИ получается УЖАСНЫЙ грибник — даже лучшие модели ошибаются и принимают ядовитые грибы за съедобные ☠️
Разработчик провел небольшой эксперимент и прогнал 1040 фотографий грибов через 18 популярных ИИ-моделей, чтобы понять: можно ли пользоваться ИИ в тихой охоте. Результат удручает.
Лучшей оказалась Gemini 3.8 Flash, но даже она правильно определяла вид с первой попытки лишь в 65% случаев. Самое страшное: в 11% случаев Gemini принимала ядовитые грибы за съедобные. У GPT-5.6 Sol таких смертельных ошибок было 24%, у Claude Opus 5 — 29%, а у Qwen3.8-27B — вообще 36%.
Кажется, грибников ИИ пока не заменит. GitHub, если вдруг захотите повторить эксперимент, тут ☕️
Ночное-полезное для селлеров и стартаперов: Anthropic выложила в опенсорс гайд для создания ИИ-продавцов!
Внутри Claude Commerce Agents набор готовых архитектур, паттернов и промптов для агентов, которые помогают покупателям и продавцам. Они могут искать и сравнивать товары, собирать корзину, планировать путешествия, подбирать тарифы и билеты. Плюс можно создать агентов, которые работают с ассортиментом, ценами, остатками и рекламными кампаниями.
И да — по данным Anthropic, магазины, которые используют таких торговых агентов, отмечают рост размера корзины до 35% + до 60% более высокую вероятность завершения покупки.
А вот официальные бенчмарки: Gemini 3.8 Flash держится на уровне Claude Opus 5, а на некоторых даже обходит, но стоит при этом в 6 РАЗ дешевле!
На DeepSWE 1.1 новая Flash набрала 71% против 74% у Opus 5. Разница небольшая, зато до конца года новая модель стоит всего $0,75 за миллион входных и $3,75 за миллион выходных токенов — против $5 и $25 у Opus 5.
А на Terminal-bench 2.1, работе с графиками, длинными видео и в биологических исследованиях Gemini уже даже обходит гигантов вроде ChatGPT-5.6 Sol и Claude Opus 5!
Модель уже доступна в Gemini, Google AI Studio и API. Легендарное возвращение 😎
Google выпустила Gemini 3.8 Flash — новая быстрая модель уже обходит гигантов в кодинге.
По данным WSJ, во внутренних тестах сотрудники Google предпочитали её ответы Claude Opus. Сама модель обещает быть дешевой и заточенной под кодинг и агентные задачи.
Gemini 3.8 Flash уже начала появляться у пользователей, так что ждем официального релиза.
«Крёстная мать ИИ» Фэй-Фэй Ли представила Atlas — первую мультимодальную модель мира, которая превращает фотографии и видео в полноценные 3D-миры 🤯
Atlas с нуля обучили одновременно работать с текстом, изображениями и видео. Теперь можно будет загрузить всего ОДНУ фотографию, и модель восстановит сцену в 3D, позволит посмотреть на неё с любого ракурса и сама дорисует части мира, которых не было на исходнике. И всё это в нормальном качестве!
А из нескольких изображений можно сгенерировать до минуты видео в 1440p с точным управлением движением камеры. Плюс в вашем видео можно будет замораживать момент и смотреть на него с ракурса, с которого никто не снимал — получается очень киношно.
Ранний доступ откроют уже в ближайшие недели. Красота 😳
Anthropic выложила официальный гайд по промптингу Fable 5.1!
Внутри разобрали особенности новой модели и выдали полезные промпты для агентных задач, кодинга, поиска, субагентов и работы с файлами.
Так, оказывается, Fable 5.1 может переписывать целый файл ради небольшой правки, а в длинных задачах осторожничать и останавливать работу раньше времени. Для таких случаев Anthropic сразу предлагает вам использовать их готовые инструкции.
Fable 5.1 оказался реальным монстром! Только посмотрите, что он умеет:
🟢 Fable 5.1 взяла общедоступные данные NASA, сделала 3D-глобус в браузере и научилась прокладывать маршруты для лунохода: объезжать слишком крутые кратеры и объяснять каждый манёвр.
🟢 Собрала персонального авиадиспетчера для Mac. Вводишь свой адрес, отмечаешь дом и приложение следит за самолётами и говорит, куда смотреть и через сколько секунд появится борт. Причём учитывает рельеф, препятствия и даже время, за которое до вас долетит звук.
🟢 А еще ИИ отлично заменяет аналитиков. В примере Anthropic модель сама берёт сырые данные компании, обновляет прогноз выручки через API без присмотра человека, проверяет расчёты, а утром ещё и проводит бэктест своих прошлых прогнозов.
Более того, Fable 5.1 уже помог составить новую карту Венеры! Модель обучила нейросеть на старых снимках NASA и повысила детализацию рельефа с 10–20 до 2–3 км, а высоты теперь определяются до 25% точнее. Карту уже открыли для использования в будущих миссиях NASA.