llm.
ПДн, 152-ФЗ и LLM
«Сделай мне аналитику по этим пяти резюме, вот они» — с такого сообщения могла начаться история, из-за которой я вообще стал бы разбираться в обезличивании. Думаю некоторые HR-специалисты крупных компаний смело вставляют в ChatGPT пять резюме целиком: с паспортами, адресами, СНИЛС. Для него это была рутина, экономия часа работы. Для компании — передача персональных данных пяти человек неизвестно куда, без основания, без уведомления, в сервис, чьи серверы стоят за пределами России. Формально — сразу несколько нарушений 152-ФЗ. Все чуть сложнее или проще но в целом посыл был примерно такой.
Экранный переводчик для macOS: читаем статьи и смотрим видео без переключения окон
Экранный OCR-переводчик для macOS: читаем статьи и смотрим видео без переключения оконПри чтении технической литературы, англоязычных статей или просмотре видео с субтитрами я постоянно спотыкался об одну и ту же проблему.Встречаешь незнакомый термин или редкое слово и начинается возня: выделить мышкой, скопировать в буфер, переключиться в браузер, вставить в переводчик, прочитать значение, вернуться обратно к чтению.
Как мы измеряем точность детекции ПДн: pii-bench, golden-выборка и честные метрики
Когда вендор защиты данных пишет на сайте «точность детекции 99%», возникает ровно один вопрос: как это измерено? Без методики цифра не значит ничего — «99%» может означать честный span-level F1 на внешнем бенчмарке, а может — «в 99 из 100 сообщений сканер что-то нашёл». Это разные вещи, и разница между ними — это пропущенные паспорта в проде.
Чем заменить Cursor, если он перестал работать
В начале сентября знакомые разработчики стали жаловаться на одно и то же: Cursor перестал работать, показывает not available in your region, у части пользователей отменились платные подписки. Первый совет, который разошёлся по чатам, звучал разумно: «в настройках есть поле для своего ключа OpenAI и переопределение базового адреса — подставьте туда любой доступный эндпоинт, и всё заработает».Не работает. И причина этого интереснее самой новости, потому что она объясняет, какие инструменты вообще устойчивы к таким событиям, а какие нет.
Что КОМПАС-API может рассказать о 3D-модели: от данных к классификации
Когда мы смотрим на 3D-модель, то за доли секунды понимаем, что перед нами: «вал», «плита» или «корпус». Мы не измеряем углы и не считаем грани — мозг сопоставляет форму с уже знакомыми паттернами и классифицирует объект.При этом классификация сама по себе редко является конечной целью. Знать, что это за деталь, интересно для определения конкретных последующих инженерных решений: поиск похожих деталей, выбор технологии изготовления, подбор инструмента, расчёт стоимости или привязка к определённому элементу нормативно-справочной системы.
200 OK от гейтвея ничего не значит
Обычная HTTP-проверка может показывать, что ИИ-сервис работает, хотя его пользователи уже не получают ответы. Эндпоинт доступен, гейтвей на месте, но до самой модели проверка не доходит.Привет, Хабр! Меня зовут Михаил Шпаков, я развиваю Statuser — сервис мониторинга доступности сайтов. Раньше я рассказывал, как он появился и что я узнал за год, мониторя 6 500 сайтов.
Контекст растёт, KV-кэш — нет: Qwen3.8-27B на ограниченной VRAM с CMF формате
Экспериментальный O(1)-режим CMF заменяет растущий KV-кэш в 16 full-attention слоях Qwen3.8-27B фиксированным состоянием 44,1 МиБ. На длине 64K это сопоставляется с 4 ГиБ FP16 KV-кэша, но ценой приближённого восстановления дальнего контекста.Статья про CMF форматВ CMF
LLM — это гениальный языковой процессор с никудышным мыслительным движком
Я, как технический писатель-аналитик, каждый день делегирую искусственному интеллекту создание текстов, структурирование и генерацию документации. Но иногда модель выдаёт такие глупые логические ошибки, что хочется ̶н̶а̶о̶р̶а̶т̶ь̶ ̶н̶а̶ ̶н̶е̶е̶ ̶ закрыть чат и переписать всё руками.Благодаря трёхнедельному отпуску удалось наконец поизучать фундаментальное устройство нейросетей с точки зрения когнитивных наук, чтобы разобраться, как же им удаётся писать крутые тексты за считанные секунды.Кто и как исследует ИИ с точки зрения лингвистики
Обвязка решает
Разбор харнессов ИИ-агентов: как они устроены на обычном проекте, какими бывают — и что показал машинный журнал живого проектаПилю офлайн-заметочник Nitinol и пишу об этом статьи. В первой части рассказывал, как десять лет терял заметки, во второй — про хранение и поиск без RAG, в третьей

