ai. - страница 315

ai.

Claude vs ChatGPT + Codex: Кто лучше решит комплексную задачу? Тестируем 6 моделей

Со времени как вышел Claude 4 прошло пару недель. Весь этот срок я постоянно сравниваю эти модели в разных задачах. И говорят, что Claude 4 отлично справляется с кодом, что мы сейчас и проверим

продолжить чтение

AI в помощь системному аналитику: от скепсиса к практике

Друзья, привет! Меня зовут Ларионов Александр. Я работаю системным аналитиком. Совместно с Лабораторией инноваций Московской биржи мы изучали вопрос применения AI в системном анализе.

продолжить чтение

Как мы в Mentorpiece тестируем… стоимость AI-приложений

Третья статья цикла про работу AI-QA-инженера (но написана без использования AI)В предыдущих статьях:Как тестировать AI-приложения:

продолжить чтение

Как ИИ помог создать систему видеонаблюдения на Android

Превращаем смартфон в умного охранника с помощью Kotlin, CameraX, Gemini AI и TelegramПривет, Хабр!

продолжить чтение

Benchmark — разрушитель LLM’ок, или Как мы собрали свой мультиязычный SWE-Bench

В статье представлено многоязычное расширение SWE-Bench от команды Doubletapp — бенчмарка для оценки больших языковых моделей (LLM) на реальных задачах программной инженерии, на различных языках программирования и кодовых базах индустрии. О процессе сбора SWE-Bench мы уже рассказывали в отдельной статье

продолжить чтение

Выгорел, месяц лгал, спасся с помощью AI: инструкция по выживанию в IT (нет)

Недавно на Reddit появилась история, в которой есть всё из жизни современного карикатурного айтишника: выгорание до полной апатии, обман на дейли-митингах, страх увольнения и, конечно же, спасение с помощью искусственного интеллекта в самый последний момент.Акт I: Трагедия выгоревшего человекаПрограммист, относительно новый в компании, попадает на незнакомый стек и ловит жесточайшее выгорание. Настолько сильное, что в течение целого месяца он не пишет ни единой строчки кода. Вообще. Ноль коммитов.

продолжить чтение

Continuous Thought Machine: как Sakana AI научила модель думать тиками

Continuous Thought Machine: как Sakana AI научила модель думать тикамиАналитический центр red_mad_robot продолжает следить за архитектурными прорывами в мире AI. В этот раз — экспериментальная модель от команды Sakana AI

продолжить чтение

Когда ИИ тестирует лучше тебя: ищу баги в OWASP Juice Shop с помощью Cypress и Workik

Я — Solution Architect с 19 годами в IT, часто помогаю новичкам в тестировании. Джуны обычно жалуются на вагон теории, отсутствие практики и примеров, где основные алогритмы собраны вместе. Я решил исправить эту проблему: взял OWASP Juice Shop — уязвимое веб-приложение, развернул его через Docker на http://135.181.239.135:4000 и протестировал с помощью ИИ.

продолжить чтение

19 лет в айти, чтобы прикинуться джуном: как искать баги в приложениях с помощью ИИ

Я — Solution Architect с 19 годами в IT, часто помогаю новичкам в тестировании. Джуны обычно жалуются на вагон теории, отсутствие практики и примеров, где основные алогритмы собраны вместе. Я решил исправить эту проблему: взял OWASP Juice Shop — уязвимое веб-приложение, развернул его через Docker на http://135.181.239.135:4000 и протестировал с помощью ИИ.

продолжить чтение

Голосовой AI-ассистент в рекрутинге: ожидания vs реальность и новая гипотеза использования

Всем привет! Я — Даша, ИТ-рекрутер в страховой компании, и как и все, мы пробуем инструменты с искусственным интеллектом. Новый тренд — голосовые AI-ассистенты в подборе. Казалось бы, это должно сэкономить кучу времени, но всё оказалось не так просто. Рассказываю, как мы протестировали одну из таких систем и что из этого вышло.

продолжить чтение