llm.
Современные LLM оказались плохими грибниками: модели принимают ядовитые грибы за съедобные в каждом девятом случае
Разработчик Пётр Мигдал представил итоги эксперимента, в котором популярные LLM определяли виды грибов по фотографии и решали, можно ли их есть. Выяснилось, что даже лучшие модели примерно в 12% случаев принимали ядовитые грибы за съедобные.
Галлюцинации нейросетей. Как это устроено, откуда берётся и как с этим бороться. Часть 2
В предыдущей статье мы обсудили откуда берутся галлюцинации LLM и что может их спровоцировать. В этой поговорим о последствиях и методах борьбы. Whisper слышит больше, чем нужноШесть дел, которых не было
LLM зацикливается: как найти причину, не трогая параметры?
Всем привет, меня зовут Сергей Прощаев и в этой статье расскажу про аварию, которую сложно поймать тестами.Сервис на базе LLM три недели работает нормально, а потом начинает отдавать отчёты, где с середины примерно двадцать раз подряд идёт один и тот же абзац, а дальше — обрыв на полуслове. Пользователи присылают скриншоты, GPU занят
От десятка подписок к единому шлюзу LiteLLM: что пошло не по плану
Привет! Я Владимир Мокроусов, сисадмин в группе компаний «Синтека». Мы создаем софт для строительной отрасли и активно используем в работе ИИ-модели.
Не замена, а суперсИИла: Что нашей компании дал хакатон
Может ли ИИ не просто избавлять от рутины, а кардинально ускорить рост разработчика? Пару месяцев назад мы провели внутренний хакатон и одновременно эксперимент, который помог получить ответ на этот вопрос. Идея родилась спонтанно, а её реализация и полученный результат заставили многих моих коллег пересмотреть скептическое отношение к ИИ.Рассказываю, как это было, что пошло не так и почему я теперь уверен: искусственный интеллект — не замена разработчику, а его суперсила. Или даже суперсИИла.Как родился ИИ-хакатон
Astra использует рекуррентную глубину — и это осложняет аудит модели
В будущей модели Astra OpenAI использует архитектурный прием recurrent depth, также известный как looped transformer. Вместо того чтобы каждый слой обрабатывать вход один раз, модель многократно прогоняет представление через одни и те же вычислительные блоки перед генерацией следующего токена. Это позволяет увеличить «глубину вычислений» без пропорционального наращивания числа параметров.
«Аниме-завод» открыт: выкладываю код конвейера, который сам режет эпизоды на Shorts
За последнее время я написал три статьи про систему, которая превращает длинные видео в вертикальные клипы: общий обзор «аниме-завода», разбор виртуальной камеры с face tracking и рассказ о том, почему связка «транскрипт + LLM» почти всегда даёт мусор.Комментарий, который повторялся под всеми тремя, был один и тот же: «покажи код».Показываю.→ github.com/ialakey/shorts-factory
Как мы перестали бояться legacy-монолита и перевели его на Python 3 с помощью LLM
Когда-то мы считали, что перевести нашу внутреннюю админку с Python 2 на Python 3 — задача на грани возможностей. В команде даже ходила легенда, что два разработчика уже пробовали это сделать и после этого увольнялись.Задача воспринималась примерно как экспедиция на Эверест. Наверное, можно. Но зачем рисковать жизнью? Рисковать своей жизнью не пришлось! У нас появился LLM, и я смело отдал миграцию ему. Через неделю у меня была рабочая админка на Python 3 и MR на 600 файлов. До прода было ещё далеко.
Галлюцинации нейросетей. Как это устроено, откуда берётся и как с этим бороться. Часть 1
Одна маленькая даже не ошибка, а скорее особенность нейросетей пока мешает им развиваться и внедряться в жизнь куда более бурными темпами, чем сейчас. Хотя, казалось бы, — куда ещё быстрее? Но нет. Эта особенность стоила юристам отстранений от практики, авиакомпании — проигранного суда, а для Google стала поводом к потере примерно ста миллиардов долларов капитализации за один день. Слово «галлюцинация» станет словом года сразу в двух словарях.

