Бесплатного интеллекта не бывает: кто оплачивает данные для LLM
Привет, Хабр! По первому образованию я юрист. Успел поработать в прокуратуре и арбитражном суде, потом ушёл в ИТ и последние 13 лет занимаюсь инфраструктурой, разработкой и DevOps. Сейчас строю MLOps-платформы.Этот опыт мешает мне спокойно читать споры об авторском праве и генеративном ИИ. Юрист видит пробелы учета прав в копировании чужих книг. Инженер — цепочку операций: crawler, raw storage, очистку, дедупликацию, training mix, веса, API. Между «скачали страницу» и «модель ответила пользователю» слишком много разных операций, чтобы обсуждать их одним словом «обучение».Отправной точкой для этого разбора стала
Вышел стандарт Unicode 18
Вышла версия 18.0 стандарта Unicode. Это крупный апдейт, который включает новые символы и таблицы кодов, обновлённые файлы данных, а также пересмотренные спецификации, определяющие многие фундаментальные аспекты обработки текста.
Админка больше не обязательна: как я дал Codex API к сайту и получил новый интерфейс управления контентом
У большинства проектов, где контентом нужно регулярно управлять, есть админка. Иногда она действительно удобная и хорошо продуманная, иногда — собранная на скорую руку, а иногда это вообще стандартный интерфейс фреймворка, который формально позволяет редактировать данные, но пользоваться им каждый день мучительно.
Степени свободы вместо пользы или почему три закона Азимова не работают
Сейчас я вижу в СМИ очень много сообщений о том, что тот или иной человек, близкий к разработкам ИИ, начинает паниковать от того что "мы все умрем" и ИИ нас уничтожит. И грешат этим даже профессионалы. Тем не менее, на мой взгляд, выход здесь есть и достаточно универсальный.
Как я использую генеративные модели как оппонента в нескольких AI-проектах
На бумаге задача выглядела почти обидно просто: камера видит салон автобуса, модель распознаёт людей, на выходе появляется число вошедших и вышедших пассажиров.Но чем ближе мы подходили к реальному рейсу, тем меньше задача была похожа на обычную детекцию. Оказалось, что сначала нужно договориться о времени, остановках, идентификаторах и даже о том, что именно считать событием входа. Модель может правильно увидеть человека — и всё равно выдать неправильный бизнес-результат.
ITIL 5: что реально изменилось и что из этого применимо в России
Российский ИТ-директор, если и слышал об ITIL 5, то мельком: сертификат PeopleCert в стране по-прежнему нельзя купить и сдать напрямую, а хайпа вокруг релиза здесь почти не было. В этой статье рассказываю, что в новой версии фреймворка реально изменилось, почему сертификация в России зависла и какие идеи ITIL 5 можно применять уже сейчас — без диплома и без переплаты за модный ярлык.Автор: Авдей Мартынович, руководитель подразделения по работе с СМБ, ALP ITSMITIL 5 обновляет, а не переизобретает фреймворк
Чем тестер отличается от тестолога
На всякий случай, если вы не знали, 30-го апреля 2025-го года Правительство утвердило нормативные словари, фиксирующие нормы современного русского литературного языка при его использовании в качестве государственного.Распоряжением номер 1102-р словари опубликованы на сайте института Русского языка.Итак, что это за словари?Орфографический словарь русского языка как государственного языка Российской Федерации (как писать)
Загрузил не тот файл в нейросеть — уволен. Как устроена безопасность данных в ИИ
Договор с клиентом, фрагмент кода, медицинская карта — отважные пользователи нейросетей каждый день загружают данные, которые никогда бы не отправили незнакомому человеку. При этом мало кто понимает, куда физически они попадают, кто может их увидеть и использовать, что происходит после нажатия «удалить».
Sandisk и SK Hynix опубликовали первый открытый стандарт высокоскоростной флэш‑памяти
Компании Sandisk и SK hynix объявили о выпуске технической спецификации HBF (High Bandwidth Flash) в рамках проекта Open Compute Project (OCP). Они продвигают работу по стандартизации HBF для эпохи вывода данных в области искусственного интеллекта.

