llm.
Selectel запустил бесплатный курс по работе с ML-моделями
Привет, Хабр! Если вы планируете начать работу с ML-моделями, рекомендуем пройти бесплатный мини-курс Академии Selectel
OpenRouter запустил тестирование моделей генерации видео
https://openrouter.ai/models?fmt=cards&output_modalities=videoНа Openrouter впервые появились API трех моделей генерации видео. Пока только в "экспериментальном" режиме.
70% новых статей по программной инженерии на ArXiv связаны с LLM
Данные о статьях, опубликованных с 2022 года на сервисе препринтов ArXiv, показывают, что в области программной инженерии лидирует тема LLM (больших языковых моделей). На них приходится 70% новых материалов.
NSFW фильтр на основе большой языковой модели
В современном мире генерация изображений с помощью нейросетей стала возможна не только большим компаниям с суперкомпьютерами, но и рядовым пользователям с простым геймерским железом.И возможно, кому-то захотелось не только самому пользоваться этими нейросетями, но и дать доступ к ним большому кругу людей, что может быть сопряженно с некоторыми трудностями.Постановка проблемы
Qwen 3.5 с 397 млрд параметров запустили на iPhone 17 Pro: для этого понадобился внешний SSD
Разработчик под никнеймом Anemll запустил языковую модель Qwen 3.5 с 397 млрд параметров на iPhone 17 Pro. Веса модели подгружали с внешнего SSD, а скорость генерации ответов составила всего 0,6 токенов. Авторы проекта признают, что решение не годится для нормального использования, а лишь демонстрирует возможности.
Лучший математик мира использует AI каждый день. Вот что он понял
Двадцать лет. Столько Кеплер перебирал случайные теории о том, как устроена Солнечная система. Платоновы тела, вписанные между орбит��ми планет. Музыкальные гармонии небесных сфер. Астрологические корреляции. Он пробовал всё подряд — и большая часть оказалась мусором.Но в этом мусоре нашлись три закона планетарного движения. На них Ньютон потом построил всю классическую механику.Когда я услышал эту метафору в свежем интервью Теренса Тао, меня пробило. Это же LLM. С temperature=1.0
Почему нам пришлось превратить нормативные документы в граф, а не просто загрузить их в векторную базу
Когда говорят про RAG, обычно имеют в виду довольно прямую схему: взять документы, нарезать их на фрагменты, посчитать эмбеддинги, сложить всё в векторную базу и поверх этого подключить LLM. На демо это часто работает. Иногда работает и на корпоративных данных. Но на нормативных документах такой подход очень быстро начинает сыпаться.
Как мы пришили LLM «спинной мозг»: архитектура рефлексов для ИИ-агентов в 60 FPS
Привет, Хабр!Интеграция современных LLM в геймдев, виртуальных ассистентов и робототехнику сейчас напоминает попытку прикрутить двигатель от космического шаттла к телеге. У вас есть невероятно умная модель, которая понимает тончайший контекст, но её inference latency (задержка вывода) убивает любой пользовательский опыт.Пока ваш ИИ-NPC парсит входящий аудиопоток, отправляет запрос по API, ждет генерации ответа и распаковывает JSON в анимацию, проходит от 1 до 3 секунд. В динамичной среде — это вечность.
AI без Python: как исправить документацию и внедрить RAG в JVM-стеке
Привет, Хабр! Меня зовут Дмитрий Вдовин, я техлид команды Budget Tool. Мы отвечаем за продукт, через который в банке проходят процессы планирования и контроля расходов. Это внутренняя система, в которой формируются бюджеты, согласуются изменения и фиксируются расходы по направлениям. У нас много терминов, правил и нюансов. Например, чем OPEX отличается от CAPEX, зачем нужны кост-центры и группы расходов, что такое аллокация и реаллокация, как заполнять бюджет.
В России запустили сервис для мониторинга упоминаний брендов в YandexGPT и GigaChat
Стартап «Шпиониро» представил инструмент для отслеживания того, как бренды упоминаются в ответах ИИ-ассистентов — YandexGPT, Алисы, GigaChat, ChatGPT и других моделей.

