Галлюцинации нейросетей.

Почему VLM галлюцинирует объекты, которых нет: zero-shot детекция дыма и решение с помощью промпта

Ранняя детекция дыма и огня — частая и ценная задача уличной видеоаналитики. Камера может заметить возгорание раньше, чем люди на улице или оператор. Обучать отдельную модель детекции — это датасет, разметка и время, а возгорания в кадре выглядят слишком по-разному, чтобы быстро покрыть все случаи. Поэтому, когда сценариев детекции в рабочих проектах стало слишком много, я решила попробовать короткий путь, попросить VLM (языковую модель, умеющую работать с изображениями) найти дым текстовым промптом в zero-shot режиме, то есть вообще без обучения под задачу.Первой моделью взяла Qwen3.5-9B

продолжить чтение

Галлюцинации нейросетей. Как это устроено, откуда берётся и как с этим бороться. Часть 2

В предыдущей статье мы обсудили откуда берутся галлюцинации LLM и что может их спровоцировать. В этой поговорим о последствиях и методах борьбы. Whisper слышит больше, чем нужноШесть дел, которых не было

продолжить чтение

Галлюцинации нейросетей. Как это устроено, откуда берётся и как с этим бороться. Часть 1

Одна маленькая даже не ошибка, а скорее особенность нейросетей пока мешает им развиваться и внедряться в жизнь куда более бурными темпами, чем сейчас. Хотя, казалось бы, — куда ещё быстрее? Но нет. Эта особенность стоила юристам отстранений от практики, авиакомпании — проигранного суда, а для Google стала поводом к потере примерно ста миллиардов долларов капитализации за один день. Слово «галлюцинация» станет словом года сразу в двух словарях.

продолжить чтение

Есть ли у ИИ клиническое мышление — или он просто удачно угадывает

Если вы обратитесь к врачу, например, с болью в груди, он не сможет прямо с порога назвать ваш диагноз. Сначала выслушает, задаст вопросы, составит список возможных вариантов и назначит анализы, чтобы поэтапно их проверить. Нейросетям же на ответ нужно несколько секунд, они звучат убедительно и почти всегда попадают в цель. Появляется соблазн — открыть ChatGPT и быстро выяснить, чем лучше лечиться. В 2026 году вышло несколько исследований, где ученые попытались разобраться, что стоит за этой уверенностью языковых моделей, и насколько можно доверять таким ответам. 

продолжить чтение

За 2 месяца собрали сервис для расшифровки анализов на нейросетях. 4 ошибки в первые недели и как мы их решали

Наш сервис связал в отчёте повышенные лейкоциты с препаратом, который пользователь начал принимать уже после самих анализов. Другому предложил пересдать семь маркеров, сданных два дня назад. Этим вторым был мой папа. Третьему порекомендовал КТ пазух, не зная, что тот неделю назад уже был у ЛОРа с готовым заключением. В отчёте четвёртого всплыл «железодефицит» - там, где про железо не было ни одной цифры.

продолжить чтение

Конец эпохи вероятностного ИИ: почему гонка за GPU от Nvidia — это архитектурный тупик

Индустрия генеративного искусственного интеллекта больна

продолжить чтение

ИИ-агент сказал «сделано». Но сделал ли он на самом деле?

Deterministic Commitment Layer: архитектура верификации агентных систем и первый десктопный инструмент для её практического применения«Ты веришь агенту на слово. Но у агента нет слов — только токены» Проблема, о которой мы знаем, но делаем вид, что не замечаемНа прошлой неделе Хабр опубликовал материал о том, как компании платят до 300 000 рублей в месяц за «скрытый аутсорс» задач в ChatGPT. История получила резонанс — но обсуждение ушло не туда. Говорили о доверии, об этике, о трудовом договоре.

продолжить чтение