Обработка изображений. - страница 22

Мультимодальные языковые модели: как нейросети учатся видеть и слышать

Мультимодальные языковые модели представляют собой самый прогрессивный класс нейросетевых архитектур, объединяющих способность воспринимать и обрабатывать различные типы данных одновременно - текст, изображения, аудио и видео. Это похоже на то, как наш мозг интегрирует информацию из разных органов чувств, чтобы создать полную картину мира. Как сказал философ Марсель Пруст, “Настоящее открытие не в том, чтобы увидеть новые земли, а в том, чтобы иметь новые глаза”.▍ Фундаментальные принципы мультимодальных моделей

продолжить чтение

5 причин, почему лучше не использовать ИИ-арт для своей статьи

Плох тот хабраюзер, который не мечтает написать пост. По крайней мере, так было до появления режима read&comment. Однако даже сейчас самые уважаемые люди на этом сайте — авторы, создатели контента (в идеале — качественного, но попытка тоже засчитывается). Сегодня поговорим о том, как сделать свои посты лучше. Или, по крайней мере, как не сделать хуже.

продолжить чтение

Google Gemini 2.0 Flash удаляет водяные знаки с изображений Getty Images и других стоковых сервисов

Пользователи обнаружили, что нейросеть Google Gemini 2.0 Flash с возможностью генерации изображений по простому запросу

продолжить чтение

Биометрическая хиромантия: гиперспектральная визуализация сосудов ладони для идентификации личности

Отпечатки пальцев в качестве инструмента идентификации человека начали использоваться еще в середине 19 века. С тех времен многое изменилось, и спектр биометрических параметров, используемых для защиты данных и устройств от несанкционированного доступа, расширился. Однако и отпечатки, и сетчатка глаза, и лицо являются видимыми физическими характеристиками, что делает их менее надежными и более уязвимыми к подделыванию. Ученые из Университета Осаки (Япония) разработали систему биометрической защиты, использующую гиперспектральную съемку. В чем суть такой съемки, какую роль в этом играют вены, и насколько данный метод идентификации надежен? Ответы на эти вороновы мы найдем в докладе ученых.

продолжить чтение

Новая функция от Adobe позволяет редактировать стоковые изображения «на лету»

Adobe обновляет свой сервис Adobe Stock, добавляя функцию на основе ИИ под названием «Настройка». Она позволяет любому пользователю «дорабатывать и адаптировать» стоковые изображения, не покидая платформу Adobe Stock. Другими словами, вы можете быстро и легко вносить изменения в изображения, в том числе создавать вариации изображений с помощью ИИ

продолжить чтение

Поиск одежды и косметики с помощью ИИ: Google представляет новые функции для пользователей

В среду компания Google объявила о запуске новой функции обработки изображений с помощью ИИ на вкладке «Покупки», которая поможет пользователям находить одежду, которую они себе представляют, позволяя искать по ключевым словам. Компания также расширяет свои инструменты для виртуальной примерки и создания образов.

продолжить чтение

Распознавание день в день: как настроить шаблон нового документа без программирования

Привет, Хабр! Вы прекрасно знаете, что мы в Smart Engines непрерывно совершенствуем наши системы распознавания российского паспорта и других документов. Вместе с этим мы постоянно расширяем список документов, которые могут быть распознаны при помощи наших решений, – и будем делать это и дальше. Но что если бизнесу нужно оперативно настроить распознавание нового корпоративного документа с жесткой структурой? Сегодня такая потребность есть практически у любой организации.

продолжить чтение

Нейросеть против ДТП: как мы разработали искусственный интеллект, чтобы обезопасить поездки в автобусе

Уже несколько лет человечество активно внедряет автоматизированные системы с участием нейросетей в свою повседневность. Вопреки расхожему мнению, не только компании извлекают из этого выгоду, но и обычные люди. И речь не только о коммерческой выгоде — такие системы могут спасать жизни. Система, о которой мы сегодня расскажем, преследует цель сделать жизнь людей безопаснее и удобнее. Сколько времени человек проводит в общественном транспорте? Какие нарушения совершают водители? Можно ли повысить безопасность поездок за счет нейросетей? Ответы — в этом материале.5 лет в дороге

продолжить чтение

PhotoDoodle: система ИИ для редактирования изображений с сохранением стиля и композиции

Исследователи из университетов Китая и Сингапура совместно с ByteDance создали PhotoDoodle — впечатляющую новую систему искусственного интеллекта для редактирования изображений. Модель способна анализировать различные художественные стили всего по нескольким образцам изображений, а затем точно выполнять конкретные инструкции по редактированию.

продолжить чтение

Обработать ночные снимки с телефона до уровня профессиональной камеры: челлендж в рамках воркшопа NTIRE 2025

Ночная фотография — одна из самых трудных областей обработки изображений. Сложные условия освещения, повышенные шумы и нестандартные цветовые переходы создают серьезные преграды для алгоритмов, ориентированных на дневной сценарий. Однако совместными усилиями теоретиков и практиков возможно создать методы, позволяющие даже для ночных снимков со смартфона поднять качество до уровня профессиональной камеры.

продолжить чтение