Обработка изображений. - страница 10

Microsoft подтвердила, что для просмотра Android медиа в Windows 11 придётся использовать «Проводник»

Microsoft подтвердила

продолжить чтение

Житель Нидерландов открыл 46 банковских счетов c помощью дипфейков

34-летний житель Нидерландов c помощью дипфейков открыл 46 банковских счетов. Он собирал у желающих снять квартиру сканы паспортов, а затем применял искусственный интеллект, чтобы редактировать своё лицо и проходить банковскую верификацию по селфи.

продолжить чтение

RealTime FaceSwap-10k — датасет для задачи детекции real-time дипфейков

Удалённая идентификация по видеосвязи – привычный для бизнеса сценарий: клиент подключается к оператору, подтверждает личность и получает доступ к операциям. Но современные дипфейки уже достаточно убедительны и «проверка на глаз» перестаёт работать: оператору становится сложнее принять решение. А пользователю – пройти проверку, например, его попросят помахать рукой перед лицом, чтобы ошибки в real-time подмене стали заметны.

продолжить чтение

«Яндекс» научил свою умную IP-камеру понимать происходящее в кадре с помощью ИИ

продолжить чтение

Nano Banana Pro vs SeeDream 4.5 vs GPT-5: битва моделей для генерации изображений. Кто победит в 2025 году?

Доброго времени суток, «Хабр»!Не так давно у меня вышла статья о сравнении топовых моделей для генерации текста (к сожалению, на данный момент её уже нельзя назвать самой актуальной). И вот у меня возникла идея - провести аналогичное сравнение для новых моделей в сфере генерации изображений, ведь и эта ниша развивается бешеными темпами.Сегодня в битве участвуют: Nano Banana Pro, SeeDream 4.5 и GPT-5 Image. Делайте ставки, а я приступаю к сравнению этих впечатляющих моделей.

продолжить чтение

LongCat-Image доказывает, что 6 миллиардов параметров могут превзойти более крупные модели с лучшей обработкой данных

продолжить чтение

Российские физики научились восстанавливать скрытые детали на зашумленных интерферограммах с высокой точностью

продолжить чтение

В ChatGPT появился Photoshop и другие продукты Adobe. Почему это провал — разбираем

Я дико обрадовалась, когда узнала, что Adobe заколабились с ChatGPT, и стало возможным через коннекторы подсоединить Photoshop (редактирование изображений), Adobe Express (создание дизайна и контента) и Acrobat (работа с PDF-файлами) и в интерфейсе ChatGPT творить дела. Но лично моя радость была недолгой - полное разочарование: 1) Adobe Photoshop

продолжить чтение

Реализуем компьютерное зрение на практике

На тему компьютерного зрения есть множество различных публикаций, которые в основном рассказывают о применении этой технологии в разных отраслях. Однако, зачастую публикации содержат лишь общую информацию о том, что реализовано и для каких задач, но при этом отсутствует описание того, как это можно сделать.В нашей статье мы поговорим о том, как можно реализовать на Python навигационную систему на основе машинного зрения для автономных транспортных средств, проанализировать медицинские изображения и выполнить генерацию новых изображений из набора данных уже существующих.

продолжить чтение

Зрительно-языковые модели читают хуже (или лучше), чем вам кажется

Знакомство с бенчмарком ReadBench, позволяющим без труда оценить, насколько хорошо ваши любимые зрительно-языковые модели читают изображения с большими объёмами текста.В этой статье будет рассказано о ReadBench. ReadBench — это очень простой бенчмарк, который мы разработали для оценки важного, но недооценённого аспекта мультимодального ИИ: насколько хорошо моделям удаётся, собственно, читать текст на картинках, рассуждать о нём и извлекать информацию из таких изображений, на которых много текста.

продолжить чтение

1...8910111213...20...25