Исследователи говорят, что, возможно, они нашли способ преодолеть «стену данных»
Исследователи из Массачусетского технологического института представили новую платформу под названием SEAL, которая позволяет большим языковым моделям (LLM) генерировать собственные синтетические обучающие данные и совершенствоваться без посторонней помощи.
Исследование Pfizer о причинах трудностей больших языковых моделей при решении задач
Новый комментарий исследователей из Pfizer ставит под сомнение основные выводы исследования «Иллюзия мышления», соавторами которого являются учёные из Apple. В
YouTube добавляет карусель результатов поиска в стиле AI Overviews
YouTube внедряет новые функции на базе искусственного интеллекта, чтобы помочь пользователям легче находить контент и информацию, объявила компания в четверг. Платформа запускает карусель результатов поиска на базе искусственного интеллекта, аналогичную Google AI Overviews, а также тестирует диалоговый ИИ с большим количеством пользователей.
Китайские учёные: ИИ способен формировать представления об объектах, сходные с человеческими
Китайские исследователи обнаружили первое в истории доказательство того, что модели ИИ, такие как ChatGPT, обрабатывают информацию подобно человеческому мозгу. Они подробно описали это открытие в журнале Nature Machine Intelligence.
FActScore-turbo: инструмент для верификации фактов
Привет, Хабр! Я Наталья Тяжова, бакалавр ПМИ ФКН, NLP-исследователь. В VK занималась проектом про фактологическую точность LLM. А после выступила на DataFest с докладом, который лёг в основу этой статьи.
Исследование способности языковых моделей к логическим рассуждениям — тест RELIC
Исследователи из Нью-Йоркского университета представили RELIC (Recognition of Languages In-Context) — новый тест, разработанный для проверки того, насколько хорошо большие языковые модели могут понимать и выполнять сложные многоэтапные инструкции. Команда получила результаты, аналогичные тем, что были представлены в недавней статье Apple, но отметила, что есть ещё над чем поработать.
Новый метод адаптирует языковые модели без обучения
Исследователи из Sakana AI представили метод Text-to-LoRA (T2L), который адаптирует большие языковые модели к новым задачам, используя только простое текстовое описание — никаких дополнительных обучающих данных не требуется.

