искусственный интеллект. - страница 344

Netflix научил собственную ИИ-модель удалять объекты из видео и перестраивать сцену

Netflix открыл доступ к модели VOID

продолжить чтение

Заставляем голосовых ассистентов Марусю и Салют материться без принуждения и спецсредств

Всем привет! Не такую первую публикацию я планировал сделать на Хабр: есть пара более серьёзных и интересных тем, которыми я планирую поделиться, но перфекционизм пока не даёт их добить.А тут получилась спонтанная и короткая история из разряда «поигрался - проиграл задумался», которая неожиданно упёрлась в этику и безопасность.

продолжить чтение

Ехал Грека через реку. — Кто ехал? — Димон

Это первая часть из задуманной серии статей про ИИ. Здесь мы на немного заступим в техническую часть памяти/контекста LLM моделей. Разберем, почему они частенько забывают или выдумывают факты и врут.Как attention ломается на длинном контекстеНачнём с фундамента. Трансформер работает на self-attention - каждый токен смотрит на все остальные и решает, на что обратить внимание. Квадратичная сложность O(n²) - это причина, по которой модели вынуждены использовать оптимизации: FlashAttention-2/3, RoPE, ALiBi и прочее.Эти оптимизации не бесплатны. Они создают позиционные смещения:Primacy bias

продолжить чтение

PocketCoder-A1: Как я заставил свой Claude работать в три смены

ИИ не заменяет людей, люди просто больше работают. Так давайте хотя бы ночью пусть работает ИИ.Так вышло, что я плачу 100 евро в месяц на Claude Code. Солидная сумма, которая растворяется практически момоментально, когда твой аккаунт превращается в полигон из 10+ проектов, где 7-8 мои, а 2-3 моей жены.Шеринг подписки вообще занятие затратное, но мне не жалко.

продолжить чтение

Anthropic доказала, что «безопасность ИИ» — это маркетинговая афера на триллион долларов

Дарио Амодеи из кожи вон лезет, чтобы сыграть «хорошего парня» на фоне «злодея» Сэма АльтманаНе знаю, как вам, а мне кажется — не очень-то у него выходит.

продолжить чтение

Вышел PrismAudio — генерация звука прямо из видео

Лаборатория Tongyi Lab представила PrismAudio — новый фреймворк для задачи Video-to-Audio, то есть автоматической генерации звуковой дорожки по видеоряду. Проект стал развитием идей предыдущей модели ThinkSound, но с более продуманной архитектурой.

продолжить чтение

AI для умного дома: что уже работает сегодня (часть 1)

В статье — не просто список инструментов, а как они сочетаются, какие подводные камни ждут при развёртывании, какие цифры можно ожидать по производительности и как обойти ограничения Llama 8B без облачных кредитов.1. Ollama — локальные LLMOllama запускает большие языковые модели на вашем сервере. Без облака, без API-ключей.Зачем в умном доме: понимание естественного языка. «Включи свет в гостиной» → модель извлекает намерение и сущность, можно передать в HA.Ресурсы:

продолжить чтение

Microsoft называет Copilot «развлекательным инструментом»

продолжить чтение

Anthropic на пике интереса инвесторов, но SpaceX может «перетянуть внимание»

продолжить чтение

Человек после цифровой эпохи (Часть 2)

Продолжая размышления предыдущей статьи (https://habr.com/ru/articles/1018946/), в которой концепция предполагает, что человек останется важным элементом будущего цифрового мира — неким «нейроном» в супермозге, питающим метасеть. Основа данного предположения то что Homo sapiens сохранится как смыслообразующая единица. Но все же у меня вызывает сомнения поистрепавшаяся мантра «Мы освободим человека от рутины для творчества» - многие ли из рода человеческого способны к мукам творчества? И если их освободить от труда и обеспечить необходимым - способны ли sapiens отказаться от гедонизма?

продолжить чтение