Тестирование IT-систем.

Нейросеть написала PR, тесты зелёные, а поведение изменилось. Как я научил CI это ловить

Отчёт confidence‑scorer: найден контрпример, score 35/100

продолжить чтение

Ищем замену MinIO в условиях импортозамещения: опыт тестирования трех S3-совместимых хранилищ

Привет, я Иван Засухин, DataOps Лаборатории искусственного интеллекта департамента больших данных Россельхозбанка. Мы одна из команд платформы RAISA (RSHB AI Systems and Applications), отвечаем за инструменты, которые связаны с данными и их обработкой: Оркестрация (Apache Airflow), Compute( Apache Spark и Apache Trino), Хранение (S3 и Qdrant), интерфейсы взаимодействия с источниками данных (python-модули и кастомные операторы). В команде я занимаюсь развитием инструментов и их дальнейшим сопровождением.

продолжить чтение

Как найти причину ошибок AI-фичи и проверить её с помощью тестового оракула

Материал подготовлен в рамках нового курса Otus «ИИ в тестировании: ускорение процессов и проверка ИИ-функций»Предположим, в CRM появилась кнопка «Составить резюме обращения». Она передаёт переписку языковой модели и возвращает короткий текст для следующего оператора. QA нужно проверить функцию перед релизом, но уже на первом сценарии возникает вопрос: что записывать в expected result?Возьмём учебный диалог. Все ответы ниже составлены для разбора, это не результаты эксперимента с конкретной моделью.

продолжить чтение

Как тестировать AI-фичу, если у неё нет одного правильного ответа

Материал подготовлен в рамках нового курса Otus «ИИ в тестировании: ускорение процессов и проверка ИИ-функций»Предположим, в CRM появилась кнопка «Составить резюме обращения». Она передаёт переписку языковой модели и возвращает короткий текст для следующего оператора. QA нужно проверить функцию перед релизом, но уже на первом сценарии возникает вопрос: что записывать в expected result?Возьмём учебный диалог. Все ответы ниже составлены для разбора, это не результаты эксперимента с конкретной моделью.

продолжить чтение

Шестнадцать обещаний и две модели, которые пытались их нарушить: как мы выпускали skillmem 0.12

skillmem — это локальная память для кодовых агентов: MCP-сервер поверх SQLite с девятью инструментами mem_*. Одну базу делят Claude Code, Codex, Cursor и другие клиенты. На Хабре уже были две статьи о нём: как чужой README становился правилом пользователя и сорок раундов ревью. Эта статья — третья и, надеюсь, последняя про ревью.Почему «ревьюить, пока не станет чисто» не работает

продолжить чтение

xk6-sip: SIP-телефония как код

Парадокс 2026 годаНа дворе 2026 год. Веб-сервисы тестируют облачные оркестраторы: тысячи виртуальных пользователей поднимаются из пайплайна, метрики падают в Prometheus, деградации ловит алерт до того, как их заметит клиент. А в телефонии, которая до сих пор держит колл-центры, банки, скорую помощь и диспетчерские, релиз АТС часто проверяют так же, как двадцать лет назад: тестировщик берёт два телефона и звонит сам себе. Нагрузку дают SIPp со сценариями в XML, которые проверяют сигнализацию, но не слышат, прошёл ли голос.xk6-sip — моя попытка закрыть этот разрыв. Это расширение k6/x/sip для Grafana k6

продолжить чтение

Оценка AI‑агентов: 7 ошибок, из‑за которых тесты врут

Всем привет, меня зовут Сергей Прощаев, и в этой статье расскажу про семь ошибок в оценке AI‑агентов — тех самых, из‑за которых прогон тестов светится зелёным, а о деградации команда узнаёт от поддержки.У команды есть

продолжить чтение

ИИ в тестировании: от анализа требований до автоматизации

Привет, Хабр! Я хотела разместить тут перевод статьи моего коллеги, который опубликовали на Medium. Думаю, вы найдете для себя немало интересного о такой горячей теме как ИИ в тестировании приложений. Буду рада комментариям!Меня зовут Денис, я QA-инженер в EXANTE, международной брокерской платформе для торговли на мировых финансовых рынках. В моей зоне ответственности — десктопный и веб-терминалы, а также мобильные приложения.

продолжить чтение

ИИ становится рабочим инструментом 1С: что покажут на TECH EVENT

ИИ в 1С уже не ограничивается генерацией кода и экспериментами с чат-ботами. Его подключают к тестированию, мониторингу, интеграциям, корпоративным данным и внутренним бизнес-процессам. Вокруг него появляются новые подходы к разработке, документации и работе команд.На INFOSTART TECH EVENT 2026 этой теме посвящены

продолжить чтение

Как ИИ-агент проходит весь цикл мобильного тестирования в hh.ru

Привет! Меня зовут Александр Чернышев, я занимаюсь тестированием мобильных приложений hh.ru

продолжить чтение

123456...1020...37