ffmpeg.

«Аниме-завод» открыт: выкладываю код конвейера, который сам режет эпизоды на Shorts

За последнее время я написал три статьи про систему, которая превращает длинные видео в вертикальные клипы: общий обзор «аниме-завода», разбор виртуальной камеры с face tracking и рассказ о том, почему связка «транскрипт + LLM» почти всегда даёт мусор.Комментарий, который повторялся под всеми тремя, был один и тот же: «покажи код».Показываю.→ github.com/ialakey/shorts-factory

продолжить чтение

Shorts Maker v2: как я превратил AI-генератор видео в возобновляемый production pipeline на Python

Привет, Хабр!Некоторое время назад я написал первую версию генератора коротких видео для Shorts, Reels и TikTok. На вход подавалась тема — например, «Сюжет “1984” за одну минуту», — а на выходе получался вертикальный ролик со сценарием, изображениями, анимацией, озвучкой и субтитрами.Первая версия доказала, что идея работает. Но она же показала, что сгенерировать ролик один раз и построить надёжный production pipeline — совершенно разные задачи.

продолжить чтение

Радикальный Дельфизм в эпоху AI: подключаем ИИ-ассистентов к OpenCV и FFmpeg через MCP

продолжить чтение

Монтаж видео через Claude Code

Разбираю архитектуру открытого проекта от browser-use: как заставить LLM монтировать без необходимости «смотреть» видеоКогда речь заходит про обработку видео нейросетями, у большинства из нас в голове всплывает одна и та же картина: модель смотрит на кадры, что-то понимает на основе изображения, режет по визуальным признакам. На практике это упирается в простую арифметику. Часовое видео в 30 fps — это 108 000 кадров. Если каждый кадр стоит хотя бы 1500 токенов, получаем 162 миллиона токенов на одно видео. Никакая модель столько не возьмёт за один проход, а если резать на куски — теряется глобальный контекст.

продолжить чтение

Вайбкодим .EXE под Windows с GUI на AutoHotkey v2

Продолжая изучать тему вайбкодинга для пет проектов на личном опыте и все еще находясь под впечатлением от предыдущей быстрой разработки, когда благодаря нейросетям без особых навыков программирования за пару вечеров удалось сделать консольную CMD утилиту для переконвертации семейного фото и видео архива за 15 лет, добившись сокращение его объема на жестком диске более чем в 3 раза!

продолжить чтение

Вайбкодинг на практике: пишем оптимизатор медиа архива для Windows на .BAT с помощью Gemini, ChatGPT и Qwen

Начитавшись за последние пару месяцев статей про вайбкодинг и воодушевившись, что сейчас в микрофон ноута скажу «ОК Гугл, сделай мне скрипт для кодирования фото и видео архива» и далее как в фильме Она (2013), нейросеть мне разберет по полочкам, то что откладывалось 15 лет.. Но дальше я столкнулся с суровой реальность:(

продолжить чтение

Разработчики FFmpeg добились блокировки репозитория Rockchip на GitHub по DMCA

Разработчики FFmpeg добились страйка по DMCA репозитория платформы обработки медиафайлов Rockchip после двухлетнего ожидания исправления лицензии. GitHub заблокировал репозиторий после того, как разработчик FFmpeg подал уведомление о нарушении авторских прав.

продолжить чтение

Команда проекта FFmpeg обратилась к Google: финансируйте нас или прекратите отправлять баги (CVE-slop) с помощью ИИ

Команда FFmpeg

продолжить чтение

FFmpeg добавит функцию расшифровки аудио через OpenAI Whisper

Стало известно, что мультимедийный инструмент FFmpeg получит встроенную возможность автоматической расшифровки речи, используя искусственный интеллект

продолжить чтение

Система поиска уязвимостей с ИИ Google Big Sleep обнаружила 20 багов в опенсорсных проектах

Система поиска уязвимостей с искусственным интеллектом Google Big Sleep обнаружила 20 багов в проектах с открытым исходным кодом, включая аудио- и видеобиблиотеку FFmpeg и пакет для редактирования изображений ImageMagick.

продолжить чтение

12