Критика и альтернативные взгляды на возможности современных языковых моделей
Команда Apple протестировала ведущие модели в классических логических головоломках, таких как Ханойская башня, и обнаружила, что даже продвинутым системам по-прежнему трудно выполнять простые алгоритмы правильно и в полном объеме. Основываясь на этих результатах, авторы утверждают, что LLM не имеют истинно обобщаемых рассуждений, вместо этого действуя как сопоставители шаблонов, которые упускают из виду более глубокие структуры.
Hailuo 02 от MiniMax превосходит Google Veo 3 по пользовательским тестам при гораздо более низкой стоимости
Компания MiniMax представила Hailuo 02, второе поколение своей модели искусственного интеллекта для видео, с существенными улучшениями как в производительности, так и в цене.
OpenAI обнаружила скрытые функции в моделях ИИ, которые приводят к несогласованным ответам
Исследователи из OpenAI заявили, что обнаружили скрытые функции в моделях ИИ, которые соответствуют несогласованным «персонажам», согласно новому исследованию, опубликованному компанией в среду.
В AI Mode от Google теперь можно вести двусторонний голосовой диалог
Google предоставляет пользователям возможность вести двусторонний голосовой диалог с AI Mode, экспериментальной функцией поиска, которая позволяет пользователям задавать сложные вопросы, состоящие из нескольких частей. Благодаря новой интеграции Search Live пользователи могут вести свободный голосовой диалог с поиском и просматривать ссылки по всему интернету.
Anysphere запускает новый тарифный план Ultra для Cursor
Компания Anysphere запустила новый план подписки на свой популярный инструмент для разработки на основе ИИ Cursor стоимостью 200 долларов в месяц, о чём она сообщила в блоге в понедельник.
Gemini 2.5 Flash-Lite — самая быстрая и экономичная модель в линейке Gemini от Google
Компания Google официально выпустила стабильные версии своих моделей Gemini 2.5 Flash и Pro, отметив их готовность к использованию после успешного этапа предварительного тестирования.
Исследование способности языковых моделей к логическим рассуждениям — тест RELIC
Исследователи из Нью-Йоркского университета представили RELIC (Recognition of Languages In-Context) — новый тест, разработанный для проверки того, насколько хорошо большие языковые модели могут понимать и выполнять сложные многоэтапные инструкции. Команда получила результаты, аналогичные тем, что были представлены в недавней статье Apple, но отметила, что есть ещё над чем поработать.
Rednote выпускает свою первую языковую модель с открытым исходным кодом и архитектурой Mixture-of-Experts
Компания Rednote, занимающаяся социальными сетями, выпустила свою первую большую языковую модель с открытым исходным кодом. Система Mixture-of-Experts (MoE), получившая название dots.llm1, предназначена для того, чтобы соответствовать производительности конкурирующих моделей при значительно меньшей стоимости.
Новый метод адаптирует языковые модели без обучения
Исследователи из Sakana AI представили метод Text-to-LoRA (T2L), который адаптирует большие языковые модели к новым задачам, используя только простое текстовое описание — никаких дополнительных обучающих данных не требуется.

