PRACT-120 — бенчмарк для оценки ИИ‑чатов
Когда выбираешь ИИ‑чат для работы, многие первым делом открывают таблицы бенчмарков: MMLU, GPQA, HumanEval, LMSYS Arena. Цифры полезные. Результаты в них отвечают на вопрос, насколько сильна сама модель этого чата, но ни один из этих тестов не показывает, насколько силен чат в целом, ведь чат — это не просто модель. Чат это гораздо больше — совокупность инструментов, обвязка, поиск в интернете, память и контекст чата, и многое другое, собственно, то самое из‑за чего люди и выбирают тот или иной чат для работы или жизни.
Превращаем сгенерированные ассеты в анимации часть 1
В предыдущем эксперименте мы сравнивали между собой три модели, генерировавшие ассеты по одному промту Гроком и Nano Banana Pro. А что будет, если собрать некоторые из них в анимации? Хоть я и не аниматор, я попробовал справиться со столь одиозным таском и посмотреть что получится.БроневичокСпрайт-лист Nano Banana Pro
Claude теперь может автоматически отвечать на письма по электронной почте и управлять Google‑диском
Как сообщили
Глава OpenAI: два года в колледже достаточно для работы в IT‑компании
Глава OpenAI Сэм Альтман заявил, что двух лет обучения в колледже достаточно для трудоустройства, и современному миру, возможно, уже не требуется традиционная 4-летняя программа.
Как я навайбкодил бота в MAX и получил 2000 пользователей в течение 12 часов за 0 рублей
Всем привет, Хабр. Сегодня хочу рассказать свою историю провала и успеха.Топливный кризис как вынужденный толчок к рождению идеиЯ живу в Республике Алтай, поэтому топливный кризис докатился до нас, наверное, позже всех. И 4 июля уже были очереди на заправках. Примерно в то же время появился легендарный gdebenz.ru. Автор уже писал историю своего успеха — вот его статья на vc.ru.
GLM-5.3: Z.ai выпустил новую модель
14 августа 2026 года компания Z.ai (бывшая Zhipu AI, Пекин) официально представила GLM-5.3 - новую версию своей флагманской линейки языковых моделей GLM-5. Анонс сопровождается слоганом "Built to Code. Ready for Cyber Defense" ("Создана для кода. Готова к киберзащите") и техническим блогом на z.ai/blog/glm-5.3.Z.ai впервые за всю серию GLM-5 явно позиционирует модель как инструмент не только агентной разработки, но и информационной безопасности область, которую индустрия ИИ традиционно считает зоной повышенного риска.
Глава Replit: ИИ освободил инженерам время для изобретательских задач
Генеральный директор Replit Амджад Масад утверждает, что ИИ делает разработку программного обеспечения в его компании более интеллектуальной и увлекательной. По его словам, теперь инженеры могут выполнять более творческие задачи.
Как мы научились не тратить деньги на ненужные ИИ-проекты: 4 ошибки и 1 система, которая их исправляет
ИИ-пилоты редко проваливаются из-за «плохой модели». В наших проектах модель честно показывает 80–90% качества, но проект всё равно не взлетает. Либо экономия оказывается меньше стоимости внедрения, либо автоматизируют не тот участок процесса или данные не подтверждают гипотезу. Привет, Хабр! Меня зовут Василий Мухин. Я развиваю направление внедрения искусственного интеллекта в К2Тех: отвечаю за прикладные ИИ-решения, пилотные проекты и оценку эффективности применения нейросетей в реальных задачах крупного бизнеса.
Как работают модели SOFROS AI-ML: от классификации до семантического поиска
ВступлениеМодель классификации. Наивный байесовский классификаторМодель экстракции. Извлечение именованных сущностейМодель семантического поиска: генерация с дополнительной выборкойМодель контекстного поиска: вызов инструментов веб-поиска

