ai.
Claude vs ChatGPT + Codex: Кто лучше решит комплексную задачу? Тестируем 6 моделей
Со времени как вышел Claude 4 прошло пару недель. Весь этот срок я постоянно сравниваю эти модели в разных задачах. И говорят, что Claude 4 отлично справляется с кодом, что мы сейчас и проверим
AI в помощь системному аналитику: от скепсиса к практике
Друзья, привет! Меня зовут Ларионов Александр. Я работаю системным аналитиком. Совместно с Лабораторией инноваций Московской биржи мы изучали вопрос применения AI в системном анализе.
Как мы в Mentorpiece тестируем… стоимость AI-приложений
Третья статья цикла про работу AI-QA-инженера (но написана без использования AI)В предыдущих статьях:Как тестировать AI-приложения:
Как ИИ помог создать систему видеонаблюдения на Android
Превращаем смартфон в умного охранника с помощью Kotlin, CameraX, Gemini AI и TelegramПривет, Хабр!
Benchmark — разрушитель LLM’ок, или Как мы собрали свой мультиязычный SWE-Bench
В статье представлено многоязычное расширение SWE-Bench от команды Doubletapp — бенчмарка для оценки больших языковых моделей (LLM) на реальных задачах программной инженерии, на различных языках программирования и кодовых базах индустрии. О процессе сбора SWE-Bench мы уже рассказывали в отдельной статье
Выгорел, месяц лгал, спасся с помощью AI: инструкция по выживанию в IT (нет)
Недавно на Reddit появилась история, в которой есть всё из жизни современного карикатурного айтишника: выгорание до полной апатии, обман на дейли-митингах, страх увольнения и, конечно же, спасение с помощью искусственного интеллекта в самый последний момент.Акт I: Трагедия выгоревшего человекаПрограммист, относительно новый в компании, попадает на незнакомый стек и ловит жесточайшее выгорание. Настолько сильное, что в течение целого месяца он не пишет ни единой строчки кода. Вообще. Ноль коммитов.
Continuous Thought Machine: как Sakana AI научила модель думать тиками
Continuous Thought Machine: как Sakana AI научила модель думать тикамиАналитический центр red_mad_robot продолжает следить за архитектурными прорывами в мире AI. В этот раз — экспериментальная модель от команды Sakana AI
Когда ИИ тестирует лучше тебя: ищу баги в OWASP Juice Shop с помощью Cypress и Workik
Я — Solution Architect с 19 годами в IT, часто помогаю новичкам в тестировании. Джуны обычно жалуются на вагон теории, отсутствие практики и примеров, где основные алогритмы собраны вместе. Я решил исправить эту проблему: взял OWASP Juice Shop — уязвимое веб-приложение, развернул его через Docker на http://135.181.239.135:4000 и протестировал с помощью ИИ.
19 лет в айти, чтобы прикинуться джуном: как искать баги в приложениях с помощью ИИ
Я — Solution Architect с 19 годами в IT, часто помогаю новичкам в тестировании. Джуны обычно жалуются на вагон теории, отсутствие практики и примеров, где основные алогритмы собраны вместе. Я решил исправить эту проблему: взял OWASP Juice Shop — уязвимое веб-приложение, развернул его через Docker на http://135.181.239.135:4000 и протестировал с помощью ИИ.
Голосовой AI-ассистент в рекрутинге: ожидания vs реальность и новая гипотеза использования
Всем привет! Я — Даша, ИТ-рекрутер в страховой компании, и как и все, мы пробуем инструменты с искусственным интеллектом. Новый тренд — голосовые AI-ассистенты в подборе. Казалось бы, это должно сэкономить кучу времени, но всё оказалось не так просто. Рассказываю, как мы протестировали одну из таких систем и что из этого вышло.

