Кто нашёл больше багов — агент или человек? Мои замеры 11 недель работы с AI-тестировщиком
Одиннадцать недель я вёл дневник каждой рабочей сессии с Claude Code: сколько часов работал агент, сколько я был рядом, кто нашёл каждый дефект и что случилось с каждым кандидатом — подтверждён, снят или ушёл вопросом. Вместо впечатлений — таблица: 277 агентских часов, 213 моих, 94 подтверждённые находки. Первая версия этого счёта оказалась завышенной почти вдвое — куда делась половина, тоже расскажу.Это четвёртая статья про paranoid-qa — опенсорсный пак скиллов, который заставляет Claude Code тестировать с доказательной дисциплиной. В первых трёх я показывал методику: вердикты только с пруфами,
Как AI‑агент видит страницу. Контракт наблюдения между браузером и моделью
Пользователь открывает форму доставки и видит поле города, список пунктов выдачи, карту и кнопку «Продолжить». Браузерный агент получает ту же задачу, но сообщает, что не может найти пункт выдачи. Или находит кнопку, нажимает ее, а форма не отправляется.Обычно после такого начинают менять промпт, модель или локаторы. Но фраза «агент не видит элемент» еще не описывает проблему. Сначала нужно выяснить, что именно инструмент показал модели, как обозначил доступные цели и какое состояние вернул после действия.
62 бесплатных урока сентября: закрываем пробелы в PostgreSQL 18, LLM, Go, ML и не только
В День знаний делимся большой подборкой всех открытых уроков сентября по ключевым IT-направлениям: от разработки и инфраструктуры до аналитики, тестирования, ML и управления. В фокусе — PostgreSQL 18, LLM и AI-агенты, Playwright, GitLab Runners, eBPF, высоконагруженные сервисы и другие темы, с которыми специалисты работают уже сейчас.Уроки бесплатно проведут наши преподаватели-практики. Это хорошая возможность посмотреть, как эксперты разбирают реальные инженерные задачи, задать вопросы и заодно оценить формат обучения.⬇️ Выбрать свое направлениеПрограммирование
Как мы проверяем до 1 000 cайтов в час: рассказываем про ЮScan — сервис оценки рисков в сегменте e-commerce
1000 сайтов в час вместо нескольких часов на каждый — так работает ЮScan, сервис автоматизированного аудита от ЮMoney. Его основная задача — помочь банкам и платёжным организациям не допустить подключения сайтов, которые маскируют запрещённую или рискованную деятельность под легальный бизнес. Сервис автоматически проверяет ресурс и выявляет подобные случаи ещё до начала сотрудничества.С 2020 года через ЮScan проверено более 550 тысяч заявок. За это время ЮKassa не получила штрафов за обслуживание запрещённых видов деятельности.Кому это нужно?
Хуки Claude Code: запрещаем агенту коммитить без прогона тестов
Знакомая сцена: длинная сессия, агент поправил тест и потянулся коммитить, не прогнав тесты. Запрещающее правило никуда не делось — оно всё ещё лежало в CLAUDE.md. Просто перестало весить.
Playwright не спасает от флапающих тестов: разбираемся, как он ждёт на самом деле
Привет, Хабр! Playwright продают примерно так: автоожидание встроено, sleep перед кликом писать не надо, флапающие тесты остались в эпохе Selenium. Обещание не пустое — механика внутри действительно крутая, и первые тесты правда пишутся как по маслу.А потом набор дорастает до полутора сотен тестов, уезжает в CI, и вы видите знакомую картину. Локально всё зелёное. На пайплайне падает через раз. Каждый раз в новом месте. Кто‑то предлагает добавить ретраев, кто‑то — «просто подождать подольше», и через месяц у вас набор, которому никто не верит.
ИИ заменит QA-инженера? Мы дали ему 2000 наших тестов, чтобы проверить
Автотесты писали, чтобы экономить время. Но в какой-то момент поняли, что тратим на их обслуживание больше, чем экономим.
Тестирование изменилось навсегда — Перспективные MCP для QA
Перспективные MCP для QAСодержаниеВведениеЧто такое MCP и зачем оно мне нужно (+ плагины и как подключать)MCP ConfluenceMCP KaitenMCP TestOpsMCP PostgresMCP Chrome DevToolsMCP PlaywrightMCP GitLabMCP Mattermost
Браузер вместо API: как я объединил DeepSeek, Qwen и ChatGPT в одного локального агента
Под капотом AI Free: три разных способа работы с веб-провайдерами, единый агентный рантайм, память, skills и много кода восстановления после сбоев.У веб-версий больших языковых моделей есть странное свойство: для человека они доступны в один клик, а для программы между «отправить вопрос» и «получить ответ» внезапно вырастает целая инфраструктура.
52 открытых урока второй половины июля: LLM, C++, Playwright, Kubernetes, TOGAF и не только
Привет, хабровчане! Собрали открытые уроки второй половины июля по ключевым ИТ‑направлениям: от LLM, RAG и Claude Code до C++, Java, Go, Playwright, Kubernetes, сетей ЦОД, TOGAF и тестирования.Уроки проходят онлайн и бесплатны для участников. Можно выбрать одну тему, посмотреть, как преподаватель разбирает практическую задачу, задать вопросы и заодно понять, подходит ли вам формат обучения в OTUS.⬇️ Выбрать свое направлениеAI и ML Разработка Инфраструктура, DevOps и сети Архитектура и enterprise‑системы

