Звук.

Музыка, которая ждёт игрока: превращаем любой mp3 в адаптивный игровой саундтрек

Я пять лет вожу настольные ролевые игры как мастер и думаю, что музыка это 50% эффекта погружения в процесс игры который работает в обе стороны.

продолжить чтение

Интеграция Muse в Spotify превращает прослушивание музыки в процесс, работающий на автопилоте

Стриминговый сервис Spotify объявил об интеграции с агентом на искусственном интеллекте Muse от Meta*, запущенным ранее в этом месяце. Интеграция позволит управлять музыкой практически без участия пользователя.

продолжить чтение

Google выкатила Gemini 3.8 Live и версию с рассуждениями

15 сентября Google представила

продолжить чтение

Перепеть песню и пересобрать код: почему это законно и что делать авторам в эпоху ИИ

TL;DR: В магазине играла “та самая” песня - но это была не она: та же композиция, переигранная заново и на два с половиной тона ниже. Авторское право защищает выражение, а не идею, - но пересборка не отменяет прав на само произведение. Разбираю, что это значит для авторов в эпоху ИИ.

продолжить чтение

Локальный ассистент для зумов, часть 4: что происходит после кнопки Стоп — и почему вторая модель говорила в пустоту

В первой части ассистент записывал созвон и складывал его в граф, во второй граф учился не врать неделями, в третьей я трижды ошибся с вопросом, кто это говорит. Эта часть про двадцать пять минут после кнопки Стоп: на экране ничего не происходит, на диске происходит всё. Там на этой неделе нашлась дыра, которая жила с июля. Облачная ревизия находила ошибки локальной модели, аккуратно их описывала, и никто её не слушал.Одна встреча, четыре файла, двадцать пять минут

продолжить чтение

Локальный ассистент для зумов, часть 3: кто это говорит — и почему я трижды ошибся, отвечая на этот вопрос

В конце второй части я пообещал честный замер новых локальных моделей распознавания. Обещание пришлось выполнять целый день, и результат оказался самым обидным из возможных: менять нечего. Ни модель, ни эмбеддер, ни алгоритм. А три дефекта, которые я за этот день торжественно нашёл, оказались дефектами не системы, а моего измерительного стенда.Эта часть — про диаризацию: как ассистент отвечает на вопрос «кто это сказал» и почему на рабочем созвоне этот вопрос сложнее, чем разобрать слова. Предыдущие части читать не обязательно: первая

продолжить чтение

«Яндекс Музыка» вводит новые правила работы с ИИ‑контентом

Сервис «Яндекс Музыка» вводит

продолжить чтение

Локальный ассистент для зумов, часть 2: как граф встреч становится памятью и почему ему можно верить

В первой части я собрал ассистента, который слушает созвон, различает голоса, пишет стенограмму и складывает встречу в граф знаний в Obsidian. Всё на своём Маке, ничего не уходит в облако. С тех пор прошло полтора месяца ежедневной работы, и оказалось, что записать встречу — это меньшая половина дела. Большая — сделать так, чтобы через месяц из этих записей можно было достать правду, а не то, что модель придумала по мотивам.

продолжить чтение

Меньше шума, больше смысла: опыт SESAME для Speech Enhancement

продолжить чтение

Производитель умных диктофонов Plaud выпустил наушники с ИИ

Производитель умных диктофонов Plaud вышел на рынок наушников, выпустив модель Plaud One Explorer Edition с функциями искусственного интеллекта. Устройство можно носить как обычные наушники или использовать футляр, который предлагает встроенную поддержку 4G для загрузки и обработки разговоров без необходимости подключения к телефону или Wi‑Fi.

продолжить чтение

123456...10...18