2. Рекурсивный движок llama.cpp на RTX 3050: тесты Qwen 32B и 7B Coder — прирост качества х3 и аппетиты по памяти
Всем привет! Это вторая часть статьи про форк llama.cpp. В ней я покажу реальные цифры и посмотрим, насколько лучше модель решает сложные задачи по сравнению с обычным движком, а также насколько вырастет потребление VRAM и загруженность видеокарты. Обозначения: D=0 — llama.cpp без патча, D=12 — улучшенный форк.ЖелезоВсе модели запускались на RTX 3050 6 ГБ, поэтому результаты на других видеокартах могут отличаться. Все модели запускались в формате Q4.
Селлер платил ЗП отделу из 5 человек и уволил. Нейросеть справляется с этим за 10 долларов
Статья написана на основе интервью с Евгением Беловым, основателем агентства автоматизации NODECS.Я не программист и не инженер. Я предприниматель, который собирает нейросетевые автоматизации для бизнеса. За полтора года такой работы я заменил нейросетью несколько отделов: где-то из семи человек оставался один, где-то двое.В интернетах все чаще слышу мнение, что «ИИ скоро заменит всех», но я убедился, что это не так. С рутиной нейросеть и правда справляется блестяще, а на чём-то очень простом и человеческом ломается.
Как купить подписку Chat GPT в России в 2026 году
9 июля вышло в общий доступ семейство моделей GPT-5.6, которое принесло массу полезных изменений, актуальных как для бизнеса, так и для личного использования. О том, что именно реализовала OpenAI и как приобрести подписку Chat GPT в России — расскажем прямо сейчас.
Попробовали подключить ИИ-агента к бизнесу и посмотреть на процесс через призму UX
Как правило, мы исследуем пользовательские сценарии в рамках сервиса: в мобильных банках, в интернет-банках, но на подключение ИИ-агента as-is тоже можно посмотреть через UX.Мы с коллегами увидели, что в интервью Давида Яна сервис Newo.ai обещает «за минуту» подключить телефонного AI-агента, который вместо фронт-деска принимает брони. Мы решили проверить, насколько это реально для типовых сервисных бизнесов: рестораны, отели, салоны, клиники.
Как заставить LLM выбирать осмысленные фрагменты из часовой расшифровки: почему «найди интересные моменты» не работает
Представьте: у вас есть транскрипт выступления на 40-60 минут – полотно из нескольких тысяч слов с таймкодами. И для продвижения материала через Reels, Shorts или, упаси господь, ВК Клипы, нужно достать из него +-6 самодостаточных фрагментов: законченная мысль, не оборванная на полуслове, которую можно показать вне контекста. Изначальная мысль закинуть в LLM промпт и забыть развалилась. Расскажу, какие грабли я собрал и какая конструкция в итоге заработала стабильно. Привет, Хабр! Меня зовут Андрей, и я потихоньку развиваю своего телеграм-бота для нарезки вертикальных видео по имени Шорти.Постановка задачи

