Gemini 2.5 от Google теперь поддерживает «разговорную сегментацию изображений»
Компания Google представила новую функцию для ИИ-модели Gemini 2.5. Теперь пользователи могут анализировать и выделять объекты на изображениях с помощью запросов на естественном языке.
ИИ в радиологии: определение контура опухоли легких во время дыхания
Мы неоднократно наблюдали всплески «трендовых» технологий, реакция общества на которые варьировалась от фанатичного желания получить эту технологию до радикального ее отрицания. Дополненная реальность, 3D-печать, голограммы, ИИ — все эти технологии очень громко обсуждались, но не все их них распространились и стали частью нашего быта. ИИ во всех его проявлениях (языковые модели, машинное обучение и т. д.) кажется проник везде, от браузеров и ОС смартфонов, до телевизоров и пылесосов. К ИИ вопросов много, от их этичности до воздействия на экологию. Однако стоит отметить, что не все ИИ одинаково плохи. Многие из них помогают в исследованиях и становятся инструментами улучшения уже имеющихся технологий. Ученые из Северо-Западного университета (Эванстон, штат Иллинойс, США) разработали систему, которая объединяет МРТ и ИИ, что позволяет трехмерно визуализировать контуры опухолей легких, которые меняются при дыхании пациента. Как именно работает данная система, что она позволяет увидеть в легких, и насколько она лучше экспертов-радиологов? Ответы на эти вопросы мы найдем в докладе ученых.
Google представила SynthID Detector — «портал проверки» контента на водяной знак SynthID
На конференции Google I/O компания Google анонсировала
Gemini от Google получает обновленные инструменты создания изображений
Приложение чат-бота Gemini от Google теперь позволяет изменять как изображения, созданные искусственным интеллектом, так и изображения, загруженные с телефона или компьютера, сообщила компания Google в своем блоге в среду. Функция редактирования изображений в Gemini постепенно начнет внедряться сегодня, а в ближайшие недели станет доступна большему количеству пользователей на более чем 45 языках и в большинстве стран.
Adobe перезапускает Firefly
Компания Adobe представила значительное обновление своей платформы искусственного интеллекта Firefly, превратив ее из автономного генератора изображений в комплексную систему для создания различных типов цифрового контента.По данным Adobe
Открытый исходный код Kimi-VL от Moonshot AI обрабатывает текст, изображения и видео всего с 2,8 миллиардами параметров
Новая модель AI с открытым исходным кодом от китайского стартапа Moonshot AI обрабатывает изображения, текст и видео с удивительной эффективностью. Kimi-VL выделяется своей способностью обрабатывать длинные документы, сложные рассуждения и понимание пользовательского интерфейса.
Seedream 3.0: новая модель преобразования текста в изображение от ByteDance
ByteDance представляет Seedream 3.0 — новую модель преобразования текста в изображение. Тесты показывают, что она превосходит GPT-4o и Midjourney по скорости, точности и качеству изображения.
Пользователям ChatGPT стала доступна галерея сгенерированных изображений
OpenAI добавила в ChatGPT галерею сгенерированных изображений. В ней пользователи могут получить доступ ко всем созданным картинкам и не искать их в разных чатах.
OpenAI отключает генерацию видео для некоторых пользователей Sora из-за проблем с емкостью
OpenAI все еще пытается преодолеть проблемы с пропускной способностью, вызванные функцией генерации вирусных изображений, которую компания запустила на прошлой неделе.
Критикующая цитата Миядзаки об AI вновь в центре дискуссии после работ Альтмана в стиле Ghibli
В социальных сетях вновь появилась цитата основателя студии Ghibli Хаяо Миядзаки от 2016 года, в которой он назвал AI «совершенно отвратительным» и «оскорблением жизни», однако это заявление касалось именно демонстрации анимации с использованием AI, а не современной технологии генерации изображений.

