искусственный интеллект.

Если у вас Android, жизнь стала чуточку легче

Привет, Хабр!Если вы читали прошлые статьи, то знаете Гига Писаря: зажимаешь клавишу, говоришь, отпускаешь, и текст появляется там, где стоит курсор. Распознаёт речь модель GigaAM от Сбера, прямо на устройстве, без интернета.Сначала был мак, потом Windows, а про Android я даже не думал. Диктовка я думал актуальнее на компе, клавиатура, рабочие письма, документы, телефон был где-то за гранью моего виденияСообщение, которого я не ждалИ тут мне пишет Denio1337 «Я тут сделал Писаря для Android. Что скажете?»

продолжить чтение

LLM работает не на одной видеокарте: анатомия AI-инфраструктуры 2026

продолжить чтение

Неделя OCR для LLM — в Telegram-канале Smart Engines

неделя OCR для LLMПривет, Хабр!Объявляем тематическую неделю, посвященную OCR для LLM и интеллектуальной обработки документов без галлюцинаций и «додумывания» данных. Расскажем, как устроено полнотекстовое распознавание Smart Engines

продолжить чтение

Сколько инструментов показывать языковой модели: гипотеза, которую перечеркнул замер

У нашего ИИ-оркестратора более девяноста инструментов: работа с таблицами, документами, почтой, задачами, веб-страницами, презентациями и т.д.При обработке запросов модель на каждом шаге выбирает, какой из них вызвать. Вопрос, который периодически всплывает: сколько из них ей показывать за раз — все или только те, что подходят к запросу?Наш оркестратор умеет работать как с большими облачными моделями, так и с маленькими, которые помещаются на бытовой видеокарте. Минимальный рабочий вариант: RTX 3090 24Gb + Qwen3.6 27B.

продолжить чтение

Развитие языков программирования в эру ИИ

Создатель языка Elixir Жозе Валим (José Valim) размышляет об изменении языков программирования: изменился разработчик — должны измениться и языки.Привет, Хабр! На связи Хекслет

продолжить чтение

Cached input растёт квадратично

TL;DRВ типичных агентских сценариях объем cached input токенов растет квадратично относительно количества ходов. Хорошая модель — модель которая решает задачу за минимальное количество ходов. Цена кэшированного чтения — определяющая характеристика стоимости инференса.Вместо введенияЕдинственная причина, по которой современные авторегрессионные трансформеры вообще пригодны для инференса — это использование KV кэша, без которого каждый следующий токен требовал бы

продолжить чтение

Запускаем множество ИИ на телефоне без интернета в новом формате CMF

Cortiq Mobile — приложение для Android и iOS (пока нет в Appstore, проходит проверку) с открытым кодом, которое запускает модели формата CMF прямо на телефоне. Сейчас производительность телефонов в некоторых случаях превышает производительность ПК поэтому небольшие LLM модели вполне можно использовать для работы. В самолёте без сети оно отвечает на вопрос, переводит письмо и разбирает текстовый файл. Дома, в доверенной сети, тот же телефон отдаёт ноутбуку локальный API или возвращает программе структурированное решение вместо чат-реплики.

продолжить чтение

Мы прошли все стадии принятия ИИ: вышел новый сезон подкаста «Свободный слот»

Помните, как в 2023 году все спорили, заменят ли нейросети инженеров? Тема дискуссионная, но сейчас, когда ИИ уже заложен в каждый процесс, вопрос ставится иначе: что делать? Как с ним жить? Мы в Авито прошли все стадии принятия сами: от скепсиса, FOMO и раздражения к первым болезненным ошибкам, и уже только потом к более-менее спокойной работе с инструментами. Своим опытом будем делиться в 4 сезоне подкаста «Свободный слот», посвященном тому, как руководители и разработчики перестраиваются под ИИ.

продолжить чтение

Семь занятий по локальному RAG на Python от файла до ответа с источниками

Сделал бесплатный курс для тех кто хочет научиться создавать локальные ИИ приложения на Python. За семь занятий разберём помощника, который ищет по вашим документам, отвечает на вопросы и показывает исходные фрагменты для проверки.Чат с документами выглядит просто. Положили файлы в папку, задали вопрос, получили несколько складных предложений. Но стоит ответу разойтись с текстом — и хочется увидеть всю кухню: что нашёл поиск, что отправили модели и откуда она взяла последнюю фразу.В local‑docs‑ai

продолжить чтение