Илон Маск заинтересовался взломом AI-агента на $50000
AI-агенты, способные самостоятельно обращаться к функциям системы для решения задач, набирают популярность. На прошлой неделе OWASP опубликовал гайд об угрозах для AI-агентов и примеры уязвимостей на базе популярных фреймворков: LangChain, LangGraph, CrewAI, OpenAI Swarm. Участник лаборатории ИТМО AI Security Lab Александр Буянтуев предложил версию криптоагента Freysa
MLGym – новый шаг в автоматизации научных исследований
За последние время ускорение научных открытий с использованием ИИ стало одной из ключевых амбиций исследовательского сообщества. Исторически сложилось, что задачи автоматизации требовали создания гибких инструментов и бенчмарков для объективной оценки результатов.
Стремление OpenAI к росту оказывает давление на стартапы в сфере AI
Поскольку OpenAI трансформируется из простого поставщика API в компанию, предлагающую полный спектр решений в области искусственного интеллекта, многим стартапам, созданным на основе ее технологии, возможно, придется пересмотреть свои стратегии. Адам Гилберт, менеджер GTM компании OpenAI , говорит, что преимущество компании заключается в наличии всего: мощной инфраструктуры, обширных данных, мощных моделей, возможностей тонкой настройки и удобных для пользователя приложений.
Языковые модели могут перегружать себя мыслями и застревать в бесконечных циклах мыслей
Новое исследование выявило неожиданную слабость языковых моделей: они могут зацикливаться на мышлении вместо действия, особенно в интерактивных средах. Эта тенденция к чрезмерному размышлению может значительно повредить их производительности, даже несмотря на то, что эти модели специально разработаны для рассуждений. Исследователи из нескольких университетов США и ETH Zurich разработали методы для измерения и решения этой проблемы в интерактивных сценариях, называемых «агентными задачами».
Лгал ли xAI о тестах Grok 3?
Дискуссии по поводу тестов AI и того, как их результаты представляются лабораториями AI, выплескиваются на общественное обозрение.На этой неделе сотрудник OpenAI обвинил компанию Илона Маска xAI, занимающуюся разработкой искусственного интеллекта, в публикации вводящих в заблуждение результатов тестов для ее последней модели искусственного интеллекта Grok 3. Один из соучредителей xAI, Игорь Бабушкин, настаивал на том, что компания права.
Роботы-гуманоиды с искусственным интеллектом и коллективным разумом. «Я Робот» теперь реальность
Всего через несколько недель после того, как Figure.ai объявила о прекращении сотрудничества с OpenAI, стартап из Кремниевой долины анонсировал Helix — готового к коммерческому использованию робота-гуманоида. Вот только это не просто человекообразная железяка, а обучаемый робот с «коллективным разумом», который обучается на знаниях каждой единицы своего роя. И ориентирован на то, чтобы выполнять ваши приказы.
OpenAI делает ставку на будущее: планы по строительству центров обработки данных и отказ от Microsoft
Microsoft и OpenAI разделяют представление о будущем ИИ, но с разной скоростью реализации. В то время как OpenAI активно работает над обеспечением доступа к огромным вычислительным ресурсам, Microsoft, похоже, придерживается более взвешенного подхода.
Системы ИИ осознают собственные ограничения, когда у них больше времени на «размышления»
В результате исследования, проведённого в Университете Джонса Хопкинса, выяснилось, что если предоставить системам искусственного интеллекта больше времени на анализ информации, то они смогут более точно определять, когда они могут и не могут дать правильный ответ на вопрос.
Мультимодальные модели тотально страдают селективным восприятием
Проводя свои текущие исследования для задач сегментации и распознавания объектов на изображениях, я задал простой вопрос многим мультимодальным моделям с целью оценить их способности к интерпретации деталей изображения.Результат был, мягко говоря, странным.

