распознавание изображений.

Как одно неверно прочитанное слово вывело меня на прусское село, которое я искал полгода

История о поиске предков и отчёт о том, где AI помог, а где чуть не увёл в сторонуНекоторое время назад я случайно познакомился с Леонидом, и вскоре выяснилось, что когда‑то мы оба работали в EPAM, хотя были в разных командах и лично тогда не пересекались. Леонид уже много лет увлекается генеалогией и развивает проект Biografissimo. Знакомство с ним вернуло меня к давнему интересу к семейной истории.Работая с открытыми источниками, Леонид обнаружил запись о рождении и крещении Виктора Витшаса, сына моего прадеда Вильгельма Рудольфа Витшаса и Анны Элизабет Штеркель

продолжить чтение

Как мы отдали искусственный интеллект в «рабство» бухгалтерии и что из этого вышло

Всем привет! Меня зовут Александра Царева, я старший специалист машинного обучения в компании «Инфосистемы Джет».

продолжить чтение

Почему слабым местом кредитного конвейера может оказаться не только ставка, но и плохой OCR

Привет, Хабр! Кредиты и все, что с ними связано – тема для многих весьма чувствительная. Мы в Smart Engines выступаем за то, чтобы сделать самые раздражающие процессы удобными и быстрыми. И в этом смысле распознавание документов – это редкий пример технологии, где интересы банка (сократить издержки), сотрудника (меньше рутины) и клиента (не ждать решение неделями) действительно совпадают. Под катом рассказываем, как автоматическое распознавание документов может трансформировать процесс кредитования в банках и как такие технологии становятся ключевым звеном кредитного конвейера.

продолжить чтение

Как выбрать OCR в 2026-м: тестируем девять моделей на трех движках инференса на рукописном русском

продолжить чтение

Используем фотограмметрию для распознавания и геолокации объекта

В статье будет описан способ, как можно использовать фотограмметрию для определения координат подвижных и статичных объектов с летательных аппаратов. Практическое применение данного метода пока что затруднено по причинам, которые будут указаны ниже.Задача: В системе координат, для которой известны GPS координаты (обозначена на рисунке красным цветом) определить расстояние и вектор направления для объекта, обозначенным на рисунке желтым крестиком. Затем, соответственно определить GPS координаты этого объекта.

продолжить чтение

Как ускорить распознавание объектов нейросетями среди множества классов, не жертвуя памятью и точностью

Эксперты российской ИТ-компании «Криптонит» Никита Габдуллин и Илья Андросов разработали принципиально новый метод организации скрытого пространства нейросетей. В ряде сценариев он позволяет снизить требования к памяти GPU и существенно ускорить классификацию объектов нейронными сетями. Вместо того, чтобы мириться с ростом вычислительных затрат и требований к памяти по мере увеличения числа классов, авторы призывают отказаться от классификационного слоя и случайного распределения классов в скрытом пространстве нейросети.Ограничения классификаторов на примере компьютерного зрения

продолжить чтение

На Reddit показали автоматическую водяную турель с ИИ для отпугивания голубей

продолжить чтение

Дипфейки бьют по кошелькам: Smart Engines представила «Шерлока 3о» против мошенничества со сгенерированными документами

Smart Engines представила первое комплексное решение для выявления дипфейков документов — «Шерлок 3о». Система детектирует поддельные изображения, созданные с помощью современных генеративных моделей, включая NanoBanana, ChatGPT, Grok, Qwen, Midjourney, Stable Diffusion, Flux и еще 20 других. Технология ориентирована на компании, которые обязаны проводить идентификацию клиентов и противодействовать мошенничеству в соответствии с регуляторными требованиями. Обновленное решение проверяет документы на подлинность по 600 признакам и используется в банках и МФО — организациях, наиболее подверженных подобным атакам.

продолжить чтение

Распознавание изображений локальными LLM

Читая HABR, наткнулся на статью про мышление больших моделей и их способности распознавания изображений. И у меня возникла идея небольшого теста одной имеющейся у меня модели LLM, которая умеет распозновать фото, а именно llama4:16x17b НО запущенной полностью локально. Весит эта модель 67 гигабайт, если интересно на чем она была запущена отвечу в комментариях.На написание статьи меня подвинул один из комментариев - "а как интересно нейросеть распознает разные типы животных"

продолжить чтение

Razer представила концепт наушников с камерами

Компания Razer презентовала Project Motoko — концепт накладных наушников, оснащённых двумя камерами. По мнению производителя игровой периферии, они могут стать альтернативой умным очкам с ИИ.

продолжить чтение

123