llm. - страница 34

llm.

Современные LLM оказались плохими грибниками: модели принимают ядовитые грибы за съедобные в каждом девятом случае

Разработчик Пётр Мигдал представил итоги эксперимента, в котором популярные LLM определяли виды грибов по фотографии и решали, можно ли их есть. Выяснилось, что даже лучшие модели примерно в 12% случаев принимали ядовитые грибы за съедобные.

продолжить чтение

Галлюцинации нейросетей. Как это устроено, откуда берётся и как с этим бороться. Часть 2

В предыдущей статье мы обсудили откуда берутся галлюцинации LLM и что может их спровоцировать. В этой поговорим о последствиях и методах борьбы. Whisper слышит больше, чем нужноШесть дел, которых не было

продолжить чтение

LLM зацикливается: как найти причину, не трогая параметры?

Всем привет, меня зовут Сергей Прощаев и в этой статье расскажу про аварию, которую сложно поймать тестами.Сервис на базе LLM три недели работает нормально, а потом начинает отдавать отчёты, где с середины примерно двадцать раз подряд идёт один и тот же абзац, а дальше — обрыв на полуслове. Пользователи присылают скриншоты, GPU занят

продолжить чтение

Гонка за самую мощную ИИ-модель подходит к концу. Financial Times объясняет, почему бизнесу это больше не нужно

продолжить чтение

От десятка подписок к единому шлюзу LiteLLM: что пошло не по плану

Привет! Я Владимир Мокроусов, сисадмин в группе компаний «Синтека». Мы создаем софт для строительной отрасли и активно используем в работе ИИ-модели. 

продолжить чтение

Не замена, а суперсИИла: Что нашей компании дал хакатон

Может ли ИИ не просто избавлять от рутины, а кардинально ускорить рост разработчика? Пару месяцев назад мы провели внутренний хакатон и одновременно эксперимент, который помог получить ответ на этот вопрос. Идея родилась спонтанно, а её реализация и полученный результат заставили многих моих коллег пересмотреть скептическое отношение к ИИ.Рассказываю, как это было, что пошло не так и почему я теперь уверен: искусственный интеллект — не замена разработчику, а его суперсила. Или даже суперсИИла.Как родился ИИ-хакатон

продолжить чтение

Astra использует рекуррентную глубину — и это осложняет аудит модели

В будущей модели Astra OpenAI использует архитектурный прием recurrent depth, также известный как looped transformer. Вместо того чтобы каждый слой обрабатывать вход один раз, модель многократно прогоняет представление через одни и те же вычислительные блоки перед генерацией следующего токена. Это позволяет увеличить «глубину вычислений» без пропорционального наращивания числа параметров.

продолжить чтение

«Аниме-завод» открыт: выкладываю код конвейера, который сам режет эпизоды на Shorts

За последнее время я написал три статьи про систему, которая превращает длинные видео в вертикальные клипы: общий обзор «аниме-завода», разбор виртуальной камеры с face tracking и рассказ о том, почему связка «транскрипт + LLM» почти всегда даёт мусор.Комментарий, который повторялся под всеми тремя, был один и тот же: «покажи код».Показываю.→ github.com/ialakey/shorts-factory

продолжить чтение

Как мы перестали бояться legacy-монолита и перевели его на Python 3 с помощью LLM

Когда-то мы считали, что перевести нашу внутреннюю админку с Python 2 на Python 3 — задача на грани возможностей. В команде даже ходила легенда, что два разработчика уже пробовали это сделать и после этого увольнялись.Задача воспринималась примерно как экспедиция на Эверест. Наверное, можно. Но зачем рисковать жизнью? Рисковать своей жизнью не пришлось! У нас появился LLM, и я смело отдал миграцию ему. Через неделю у меня была рабочая админка на Python 3 и MR на 600 файлов. До прода было ещё далеко.

продолжить чтение

Галлюцинации нейросетей. Как это устроено, откуда берётся и как с этим бороться. Часть 1

Одна маленькая даже не ошибка, а скорее особенность нейросетей пока мешает им развиваться и внедряться в жизнь куда более бурными темпами, чем сейчас. Хотя, казалось бы, — куда ещё быстрее? Но нет. Эта особенность стоила юристам отстранений от практики, авиакомпании — проигранного суда, а для Google стала поводом к потере примерно ста миллиардов долларов капитализации за один день. Слово «галлюцинация» станет словом года сразу в двух словарях.

продолжить чтение