llm. - страница 7

llm.

LLM не научились врать. Они научились говорить

LLM галлюцинирует, впрочем, все видели, как это выглядит. Модель уверенно, связно, с правильной интонацией и терминологией сообщает то, чего нет. Инженеры считают это багом, который чинят и  вот-вот починят.Не починят. Это не техническая ошибка, а неотъемлемое свойство языка, которое машина сделала видимым.Язык не нуждается в реальностиЯзык — уникальная система именно в том, что появляется из реальности, но для собственной связности в реальности не нуждается.

продолжить чтение

Auro-3D: как в обычном PCM прячет высотные каналы

Я давно интересуюсь звуком, писал обзоры по железу, писал про Dolby Atmos. Меня не оставлял в покое формат Auro 3D, который нам обещает многоканальный звук, а чтобы послушать нужно покупать дорогой AVR, который из 5.17.1 мог извлечь верха.Формат Auro 3D был представлен бельгийской компанией Galaxy Studios в 2006 году и тогда назывался Octopus. В 2011 стал доступен в потребительских устройствах, а в 2019 был представлен новый формат Auro-Cx, который кроме канального кодирования может использовать и объектное, как, например, в Dolby Atmos и DTS:X

продолжить чтение

Не отдавайте ИИ то, что должны придумать сами

Писать код стало дёшево, думать — дорого. ИИ надо отдавать реализацию, а не продумывание, и только после того, как всё зафиксировано, — иначе он закроет каждую недосказанность своей догадкой.Думаю, многие читатели Хабра уже видели перевод 8 уровней агентной инженерии — тот самый, где путь от автодополнения до автономных команд агентов разложен по восьми ступеням.

продолжить чтение

Anthropic сделает Auto mode режимом по умолчанию в Claude Code: люди пропустили 86,4% опасных команд

Anthropic объявили, что с 14 августа новые сессии Claude Code на тарифах Pro, Max и Team будут запускаться в Auto mode по умолчанию. В этом режиме агент не просит разрешение перед каждым действием: каждый вызов инструмента проверяет отдельный классификатор, который должен блокировать необратимые, разрушительные и выходящие за границы рабочего окружения операции.По данным Anthropic, пользователи одобряют 97% запросов Claude Code на выполнение команд, а автоматическая проверка в контролируемом эксперименте обнаружила значительно больше опасных действий, чем люди.

продолжить чтение

AI и склонение немецких прилагательных

продолжить чтение

Жители Валдории живут 147 лет, а страна граничит с Германией и Японией одновременно. Исследование MiroFish. Часть 2

Вторая статья из трёх об исследовании MiroFish, открытого стека мультиагентной симуляции общества. В первой части изложены методология исследования и находка Silent Failure. В этой части: досье вымышленной страны с восемью классами заложенного абсурда, четыре байт-идентичных прогона с разными результатами и пре-регистрированный эксперимент, который локализовал причину.

продолжить чтение

У нас есть для вас пакет! Как LLM придумывают несуществующие зависимости

продолжить чтение

Qwen3.8-Max: 2 400 000 000 000-параметровый монстр

Пока одни запускали GPT-5.6 Sol Max, другие ломали копья в холиварах «Kimi K3 vs Claude Opus 5», Alibaba тихо (ага, с ростом акций на 7% в моменте – очень тихо) вкатила модель, которую сама называет «новой планкой для кодинга и совместной работы». Знакомьтесь: Qwen3.8-Max

продолжить чтение

Код решает, LLM помогает: как я строил AI-тренера для бегунов

1. Ошибка, после которой всё стало ясноЯ уже несколько месяцев разрабатываю AI-тренера для бегунов в Telegram — придумал ему имя и образ, Клод де Пейс, — и это ещё далеко не финал. В какой-то момент я дал ему возможность менять расписание по свободной фразе в чате. Первый же реальный тест: пользователь пишет «поменяй мне лёгкую в субботу» — имея в виду «перенеси лёгкую тренировку на субботу».План действительно поменялся. Не в субботу — в четверг.Расследование заняло пару минут: в четверг у пользователя стояла лёгкая тренировка, и модель формально нашла в сообщении два признака — easy и Saturday — и уверенно (

продолжить чтение

Грядет агентная экономика: как она работает и что будет делать человек

продолжить чтение

1...5678910...2030...319