Когда ИИ-агент ошибается молча: 6 отказов, которые не видно по ответу
ИИ-агент — не чат-бот. Чат-бот генерирует текст. Агент совершает действия: читает документ, решает, какие инструменты вызвать, выполняет многошаговый рабочий процесс и выдает результат, на основании которого без дополнительной проверки действуют системы-потребители — а иногда и люди.Когда агент составляет ответ, цена ошибки — неудачный абзац. Когда он одобряет кредит, подает регуляторную отчетность или запускает эскалацию, ошибка может обернуться операционными, финансовыми или репутационными потерями.
Как мы научили AI разбирать упавшие автотесты и заводить баги в Трекере
Всем привет, меня зовут Олег. В прошлой статье я рассказывал, как генерить автотесты из Swagger и тест-кейсов
Генерация автотестов и локаторов с ИИ: рабочий код и подводные камни
Всем привет! Я продолжаю цикл статей про применение ИИ в тестировании. В прошлый раз мы остановились на том, что без README с описанием архитектуры фреймворка генерация автотестов на большом легаси-проекте превращается в бесконечный цикл ревью и правок. Поэтому, начать лучше с создания такого документа, а уже после него переходить к коду.Сегодня я расскажу о том, как именно я генерировала автотесты и локаторы, сколько это заняло по времени и где модель всё равно ошибалась.Что нужно для запуска генерации автотестов?Минимальный список артефактов на входе:README с архитектурой
Агент IDEA: как AI-агент Cline Работает с Intellig IDEA полностью оффлайн
В чем отличие обычного чата от агента?
Процессы vs инструменты: как Авито Sales строит QA с нулевыми сдвигами сроков
Привет, Хабр! На связи Екатерина Серикова и Глеб Дмитриев, мы QA-инженеры в команде Авито Sales. В этой статье мы расскажем, как выстроили процесс обеспечения качества в Распродаже, где сроки нельзя сдвигать, а нагрузка на корчасть почти 2 млн RPM, а цена бага очень высока.Это не история про «идеальный процесс». Она скорее про рабочую систему, которая помогает не сгореть команде и не терять качество, когда QA в проекте один, а разработчиков восемь.
Итоги Standoff 17: исторический блэкаут виртуального государства и атаки на цифровую копию реальной компании
Кибербитва Standoff 17 прошла с 16 по 19 июня в московском Кибердоме. Мероприятие объединило соревнования атакующих и защитников, деловую программу и комьюнити-трек для исследователей ИБ. Лучшие команды атакующих разделили призовой фонд в $50 000. Впервые за десять лет проведения Standoff сразу двум красным командам удалось полностью вывести из строя энергетическую инфраструктуру виртуального Государства F, погрузив киберполигон во тьму.
С чего начать тестирование LLM: 5 проверок из практики
Пять проверок — первое, что я делаю на новом LLM-проекте
Как мы превратили Swagger из документации в двигатель API-автотестов
Всем привет! Меня зовут Олег Малышев. Я один из лидеров стека тестирования в компании «ТехВилл»

