ai.
Агент пишет код. Что тогда остаётся инженеру данных?
Здравый смыслВ работе инженера данных хватает повторяющихся задач: забрать данные из API, проверить структуру, преобразовать поля, записать результат в хранилище. Вокруг этого — настройки, тесты, сообщения об ошибках и документация.Такую работу удобно поручать Агенту. Например:
Поиск идеального ML ноута — с макбука на x86+Linux
ВведениеВ этом несерьёзном посте попробую разобраться с вполне серьёзным вопросом: каким должен быть идеальный ноутбук для ML-разработчика.Вот несколько основных требований:
Почему юридический AI‑сервис нельзя строить как обычный чат: проектируем case‑first SaaS на Go
Несколько месяцев назад мне понадобилось заключить договор с водоканалом. Казалось бы, обычная бюрократическая задача: отправил документы, дождался ответа, подписал договор. На практике всё оказалось значительно веселее — ответа долго не было, сроки шли, а что делать дальше, было не совсем понятно.Юриста у меня не было, зато был AI. Я загрузил документы, описал ситуацию и начал разбираться, какие вообще есть варианты дальнейших действий. В итоге с помощью AI подготовил несколько обращений и жалоб, после чего ситуация сдвинулась с места и договор со мной всё‑таки заключили.
Сравнение Алисы (Яндекс) и Гигачат (Сбер) по 5 бенчмаркам: τ³, ПРАКТ-120, MultiChallenge, WildBench и Arena‑Hard
Пара вводных слов, чтобы было понятно о чем речьВсем привет!Я обещал написать эту статью и я наконец-то закончил тесты и готов поделиться с вами результатами.Я потратил МНОГО времени на то, чтобы прогнать эти бенчмарки. Много времени на сетапы, много времени на ожидание тестов. Все вместе заняло около двух недель работы - модели обрывались, где-то нужно было костылять заплатки чтобы они отвечали, где-то просто ждать по несколько дней на прохождение теста (даже в многопоточном тестировании).
Снова про сознание ИИ: теория интегрированной информации (IIT) и цифровой Орфей
Эпиграф: и спросил Программист Бога:— А ты сам себя можешь оцифровать?— А я, по-твоему, что делаю? — ответил Он.Доброго времени!Ниже мой диалог с Gemini на тему текущего состояния и перспектив возникновения сознания у ИИ. Мне он показался любопытным, решил поделиться с Вами (немного отредактированным).Сразу скажу, что к нему нужно относиться не как к строго-научному диалогу, а как к мета-ИИ исследовании на тему с несколькими поворотами сюжета..Кому интересно - добро пожаловать! Коментарии горячо приветствуются. Обладает ли ИИ сознанием?
Естественная тупость: 5 шагов, чтобы внедрить ИИ и облажаться
Меня зовут Андрей, я копирайтер, журналист и самозванец. И вот мои вредные неэкспертные советы для специалистов и компаний как идти в ногу со временем — именно туда, куда мы все последнее время движемся.Шаг 1. Не умейте делать рукамиХарды, софты — все это для застрявших в прошлом веке неандертальцев. Современный спец не может и не хочет, иначе для чего еще нужны машины?Отсутствие или слабые навыки — фундамент работника будущего! Если вы можете сами накодить приложение, написать статью или составить профиль будущего сотрудника, есть большой риск, что вы провалите следующие шаги.Шаг 2. Ленитесь
Kodacode лучший харнес для DeepSeek v4 Flash!? Замерили различные харнессы и модели
Когда кодовый агент решает задачу, сама LLM не редактирует файлы и не запускает тесты напрямую. Она работает через агентную оболочку, или, по-другому, харнесс. Она получает системные инструкции, выбирает инструменты, читает результаты их работы и решает, что делать дальше.Поэтому одна и та же модель в разных агентах может показать разные результаты. Где-то ей удобнее искать по проекту, где-то она получает более понятные ошибки, где-то лучше управляется контекст длинной сессии. Даже небольшое различие в инструментах или системном промпте на десятках шагов превращается в заметную разницу на выходе.
OpenAI нажала на газ и почти сразу заговорила о тормозах
Последние несколько дней смотрю, что происходит вокруг OpenAI, и есть во всём этом один моментик, который меня немного напрягает.Не потому, что вышла очередная мощная модель — к этому уже привыкли. А потому, что люди, которые последние годы эту гонку разгоняли, вдруг сами начали говорить, что неплохо было бы притормозить.3 сентября OpenAI выпустила GPT-6 Astra. Модель мощная, бенчмарков много — всё как обычно. Но меня больше зацепила одна строчка из материалов самой OpenAI.Astra стала первой моделью компании, которой присвоили уровень Critical по возможностям в кибербезопасности в рамках Preparedness Framework.
Что будет с инженерами?
Мы занимаемся разработкой электроники для легкого электротранспорта и на днях обсуждали с нашими hardware-инженерами, сможет ли ИИ их заменить. С программистами уже всё понятно, их будущее выглядит печально. Причём последние программисты сейчас как раз дописывают код, который позволит ИИ окончательно обойтись без программистов. Символично.
Определитель повадок: пять способов, которыми разговор с LLM имитирует доказательство
Парный опыт над двумя фронтирными моделями, разбор двух разных механизмов отказа и проверка собственного вывода по литературе, которая его обрушила.

