Я научил небольшой Transformer генерировать цифры одной нитью
Наверняка вы видели портреты, собранные из одной нити, натянутой между сотнями гвоздей. Я решил проверить: можно ли научить нейросеть генерировать не готовую картинку, а инструкцию, по которой такая картинка строится?Я превратил цифры MNIST в последовательности переходов между 256 гвоздями и обучил небольшой Transformer продолжать путь нити. В результате модель выдаёт не PNG, а JSON-траекторию, которую можно отрисовать в любом разрешении - или потенциально передать физической string-art установке.
Видеоаналитика на промышленном объекте: почему большинство внедрений разочаровывают и как сделать правильно
Там, где нет людей, нет времени и нет права на ошибкуХочу поделится одной историей из жизни. На удалённом нефтепромысле в -30С° за бортом бригада выполняет огневые работы — сварку, рядом с действующим трубопроводом. По регламенту каждый должен быть в полном комплекте СИЗ, с газоанализатором. Мастер провел инструктаж, расписался в наряде‑допуске, и уехал на следующий объект. Инспектор по ТБ появится через два часа.Что происходит в эти два часа — не знает никто.
Используем фотограмметрию для распознавания и геолокации объекта
В статье будет описан способ, как можно использовать фотограмметрию для определения координат подвижных и статичных объектов с летательных аппаратов. Практическое применение данного метода пока что затруднено по причинам, которые будут указаны ниже.Задача: В системе координат, для которой известны GPS координаты (обозначена на рисунке красным цветом) определить расстояние и вектор направления для объекта, обозначенным на рисунке желтым крестиком. Затем, соответственно определить GPS координаты этого объекта.
Алиса AI научилась лучше генерировать изображения с русскоязычным текстом
Пресс-служба «Яндекса» рассказала Хабру про обновление модели для генерации изображений Alice AI ART. Нейросеть теперь точнее работает с русскоязычными текстами на картинках. Благодаря этому пользователи могут создавать изображения с более длинными и корректными текстами на русском языке.
До свидания, любимые эмэльщики! Мы сделали стенд по компьютерному зрению, которым может воспользоваться каждый
На стенде ваши модели обучаются буквально на десятках картинок вместо тысяч, и дают не меньше 86% точности, при этом обходят YOLO — без GPU-кластеров и эмэль‑псевдомагии.Джекил и Хайд против священной коровы ML
AI делает видео за вас? Я попробовал — и вот где нас обманывают
Привет, я Рустам, у меня несколько продуктовых команд. На Хабре я молчал с 2014 года. Но эта история всё‑таки вытащила меня наружу: слишком уж хотелось зафиксировать момент, где красивая сказка про AI‑видео заканчивается и начинается реальная работа — долгая, нервная и почему‑то всегда ручная.

