Инженер устал от работы Enter-ом, где Claude Code создаёт спецификации, код, тесты, задачи, решения этих задач и отчёты
Разработчик под ником v0xium устроился
Искусственным интеллектом должен владеть естественный: кто отвечает за ошибки ИИ
ИИ уже забрал на себя маршрутизацию заявок, типовые ответы и добрую половину работы первой линии — там, где раньше сидел человек и вручную разбирал, кому отправить обращение по сломанному принтеру, а кому по доступу в CRM, теперь справляется алгоритм, который не устаёт к вечеру пятницы и не путает приоритеты. Логичный вопрос: если рутину забрал ИИ, зачем вообще нужен ITSM?Зона ответственности Service Desk перераспределяется. Давайте обсудим, кто отвечает за ИИ-сервисы и что будет, если пустить их на самотёк.
Почему одна и та же модель может стоить в пять раз дороже
Исследователи из UC Berkeley и Arena сравнили семь моделей внутри Claude Code, Codex CLI и минималистичного Pi. На двух бенчмарках выбор харнесса почти не менял среднюю успешность, но увеличивал стоимость одной и той же модели до пяти раз. Результат хорошо объясняет, почему сравнивать coding-агентов только по названию моделей уже бессмысленно.А что именно измерили?
AI Gateway как единая точка входа к LLM: как дать сотрудникам ИИ и не потерять контроль
Когда LLM в компании используют несколько энтузиастов, можно обойтись личными ключами и договорённостями в духе «не отправляйте ничего чувствительного». Но когда к моделям подключаются десятки команд, IDE, внутренние агенты и автоматизации, эксперимент превращается в инфраструктуру — с требованиями к безопасности, стоимости и отказоустойчивости.
Новая модель OpenAI решила более 100 открытых математических задач
OpenAI утверждает, что внутренняя модель, которую начали обучать 28 августа, уже решила более 100 давних открытых задач почти по всем основным областям математики. 24 дня обучения — и больше сотни открытых задач. Звучит так, будто OpenAI решили заспидранить математику, но пока это слухи. Разбираемся в очередных сплетнях.
Алисе AI пора стать главным экономическим советником президента России
Нобелевский лауреат Джеффри Хинтон и руководители крупнейших компаний в сфере ИИ считают, что в настоящее время следует ограничить разработку суперинтеллекта, так как это угрожает существованию человечества. Предупреждение запоздало, так как современные нейросети по ряду аспектов уже намного умнее людей, в частности, судя по обсуждению ряда проблем на Восточном экономическом форуме, разбираются в экономике лучше советников президента России Владимира Путина.
Sony подала патент на систему автоматической диагностики и ремонта PlayStation с помощью ИИ
Sony подала патент на сервер с искусственным интеллектом, который будет отслеживать состояние консолей PlayStation, генерировать исправления прошивки и внедрять их. Также система предназначена для отправки диагностических отчётов специалистам японской компании, чтобы сократить количество обращений в службу поддержки.
Как мы обучили детектор джейлбрейков для русскоязычных AI-агентов
Привет, Хабр! На связи команда R&D в Just AI, мы занимаемся исследованиями в области NLP и GenAI, чтобы продукты компании держали статус SOTA на рынке. В частности мы отвечаем за guard-модели и бенчмарки для продукта Jay Guard, о которых и пойдет речь в этой статье.
Snap обновит подписку Lens+ функциями генеративного ИИ
Компания Snap обновила тарифный план подписки Lens+ в Snapchat, добавив ряд инструментов на базе искусственного интеллекта. Подписки стоит $7,99 в месяц.
Почему нельзя просто загрузить историю с фитнес-браслета в LLM и попросить оценить здоровье
Исследователи из Meta и KAIST решили проверить очевидный на первый взгляд вопрос: если дать большой языковой модели реальную историю измерений с фитнес-трекера — пульс, сон, шаги за полгода — сможет ли она разобраться в этих данных так же уверенно, как рассуждает о здоровье вообще? Результат оказался неожиданным. Модели гораздо хуже справлялись с простыми вычислениями по самим цифрам, чем с клинической интерпретацией того же ряда. GPT-4o правильно считал тренды и аномалии лишь в четверти случаев, а вот рассуждал о рисках для здоровья на основе тех же данных вдвое увереннее.

