🖼 Google запустила AI-фоторедактор прямо у Workspace
Google представила Google Pics — новий інструмент для генерації та редагування зображень на базі Nano Banana. ✨
🎨 За його допомогою можна створювати постери, графіку для соцмереж та ілюстрації за звичайним текстовим запитом.
Pics також уміє:
🎯 редагувати окремі об’єкти на зображенні
🔤 змінювати або перекладати текст без зміни оригінального шрифту
🖼 генерувати одразу кілька варіантів картинки
👥 дозволяти кільком людям працювати над одним проєктом
📄 Google поступово вбудовує Pics безпосередньо у Workspace. Інтеграція вже стартує в Docs і Slides, а пізніше з’явиться і в Drive. ☁️
🚀 Доступ відкривають для підписників Google AI Pro, Google AI Ultra, а також для більшості корпоративних клієнтів Workspace.
Smallest AI представила нову модель для генерації мовлення, орієнтовану на природний голос у реальному часі.
⚡️ Аудіо у якості 44.1 kHz
🌍 Підтримка 31 мови
⏱️ Близько 200 мс затримки при 40 одночасних запитах
🗣 Природніше дихання, паузи, темп і виразність мовлення
За тестами Smallest AI, Lightning v3.1 Pro отримала 4.22/5 MOS — майже на рівні Gemini 2.5 Flash із результатом 4.24.
💰 Ціна стартує приблизно від $0.195 за 10 тисяч символів.
Модель насамперед створена для голосових AI-агентів, телефонних дзвінків та інших сценаріїв, де важливо генерувати мовлення майже без затримки. 📞🤖
🇺🇦 Українська мова, на жаль, поки не входить до офіційного списку підтримуваних мов Lightning v3.1 Pro.
OpenAI серйозно оновила генерацію зображень у ChatGPT — основний акцент зробили на швидкості, точному редагуванні та стабільності результатів.
⚡️ Генерація стала до 50% швидшою
👤 Модель краще зберігає зовнішність людей із референсів
🎯 Можна змінити окремий об’єкт, фон або текст, не перебудовуючи все зображення
🔄 Після кількох послідовних правок попередні зміни зберігаються стабільніше
Окремо з’явився Sketch. Тепер прямо в ChatGPT можна намалювати приблизний ескіз кімнати, одягу чи композиції, додати опис — і перетворити його на готове зображення.
Також додали шаблони для постерів і мерчу, коментарі прямо поверх зображень та можливість ділитися картинкою разом із промптом.
Для розробників доступні дві моделі:
• GPT-Image-2.5 Flare — для швидкої та масової генерації
• GPT-Image-2.5 Sunburst — для більш точної та деталізованої роботи
Схоже, ChatGPT Images поступово перетворюється з генератора картинок на повноцінний інструмент для створення та редагування візуалів. 👀
Tavus представила Sparrow-2 — AI, який розуміє, як насправді працює розмова
🧠 Tavus випустила Sparrow-2 — real-time модель, яка аналізує не лише слова співрозмовника, а й усю динаміку розмови.
🎙 Вона розуміє мовлення та паузи.
🗣 Розпізнає перебивання.
👂 Помічає короткі реакції на кшталт «угу» чи «так».
🔊 Враховує фонові голоси та шум.
⏱️ І сама визначає, коли AI має слухати, чекати або починати говорити.
⚡️ Sparrow-2 обробляє аудіо з інтервалом у 10 мілісекунд, тому AI-агенти можуть реагувати на розмову майже безперервно.
Тепер AI не просто чекає, поки людина закінчить фразу — він намагається зрозуміти сам ритм і контекст діалогу.
🚀 Ще один крок до AI-співрозмовників, які звучать і реагують значно природніше.
🎮 Higgsfield Games 2.0 перетворює один промпт на готову мультиплеєрну гру
Достатньо описати, яку гру ви хочете створити, — система сама згенерує оточення, персонажів, об’єкти та ігрову логіку.
Підтримуються 2D і 3D-проєкти, різні жанри та навіть відкриті світи.
🧠 За код і логіку відповідає GPT-6 Astra, а генеративний стек Higgsfield створює візуальну частину та ігрові асети.
Тобто замість налаштування рушія, написання коду та ручного складання гри можна просто описати ідею звичайним текстом — і отримати проєкт, який уже можна запустити та дати пограти іншим. 🚀
Games 2.0 доступний через Higgsfield Plugin у ChatGPT.
⚡️ Google випустила Gemini 3.8 Flash — і окрему AI-модель для кібербезпеки
Компанія представила одразу дві нові моделі: Gemini 3.8 Flash та Gemini 3.8 Flash Cyber.
🧠 Gemini 3.8 Flash отримала значні покращення в програмуванні, software engineering, роботі AI-агентів та складному багатокроковому reasoning.
При цьому Google зберегла стартову ціну попередньої версії:
• $0,75 за 1 млн вхідних токенів
• $3,75 за 1 млн вихідних токенів
🔐 А Gemini 3.8 Flash Cyber створена спеціально для кібербезпеки.
Модель може автономно знаходити вразливості в коді та генерувати виправлення. Google вже використовує її для захисту власних систем, а в одному з тестів модель допомогла знайти критичну вразливість менш ніж за дві години.
І ще цікава деталь: це вже третій реліз Flash від Google лише за шість тижнів.