arxiv.

RAG, поиск и LongContext: почему сложные пайплайны не всегда нужны

В 2023 году RAG был единственным способом засунуть знания в LLM — контекстное окно было маленьким, часто были галлюцинации. RAG постепенно стал одной из самых популярных технологий, чтобы получить базу знаний, по которой можно искать данные через натуральный язык.Но с другой стороны — RAG-пайплайн тяжёлый и трудозатратный. Компания хочет чат по своей документации. Разработчик говорит: нужен пайплайн — чанкинг, эмбеддинги, векторная база, реранкер. Два-три месяца работы плюс сервис, который надо вечно поддерживать, ради 400-страничной документации. И всё это занимает месяцы, тратит ресурсы ради не такой уж и большой выгоды.

продолжить чтение

You’re absolutely right: как ИИ делает нас увереннее и поверхностнее

Вы когда-нибудь замечали, что у нейросетей нет своего мнения? Допустим, вы пишете: «Мой тимлид — идиот, он заставил меня писать на PHP». Модель отвечает: «Я понимаю ваше разочарование. Смена технологического стека действительно может быть стрессовой, и PHP часто критикуют за неоднородную архитектуру. Однако…» — и дальше следует мягкая, вежливая, безличная тирада с равным количеством аргументов “за” и “против”, и обобщенным выводом. Она не поддержит вашу агрессию, но и не скажет прямо: «Вы говорите ерунду, ваш тимлид, скорее всего, прав».

продолжить чтение

AI предлагает, мержу я: почему я не даю агенту последний ход

Есть неприятная иллюзия: если модель стала сильнее, ей можно дать больше свободы. В кодинге это быстро выходит боком. Агент пишет много, уверенно, иногда даже красиво. Потом ты открываешь diff и понимаешь, что вместе с полезным кодом туда попало… ну, назовём это решениями, которые ты сам никогда бы не принял.У меня после нескольких таких заходов появилась простая граница.AI может предлагать. Мержу я.

продолжить чтение

ArXiv на год заблокирует исследователей за публикацию статей с участием ИИ

Платформа с препринтами научных работ ArXiv заявляет, что будет блокировать авторов на один год, если они представят статьи, содержащие сгенерированный ИИ контент, такой как вымышленные цитаты, текстовые филлеры или метакомментарии.

продолжить чтение

Когда Кнут признаёт, что Claude решил его задачу за час — пора менять инфраструктуру

«Я с удивлением узнал, что открытая задача, над которой я работал несколько недель, только что была решена Claude Opus 4.6… Похоже, мне придётся пересмотреть своё мнение о генеративном AI» — Дональд Кнут, февраль 2026TL;DR

продолжить чтение

arXiv объявил о независимости от ресурсов Корнеллского университета

Электронный архив для препринтов научных работ arXiv объявил о независимости от ресурсов Корнеллского университета. Проект стартовал в 1991 году, а теперь станет независимой некоммерческой организацией под новым руководством.

продолжить чтение

Неофициальный Python-клиент для alphaxiv: как мы нашли скрытый API и упаковали его в пакет

Если вы работаете с научными статьями, то наверняка знакомы с arXiv — основным репозиторием препринтов в области CS, математики и физики. alphaxiv — это надстройка над ним: платформа добавляет к каждой статье раздел для обсуждений и, что важнее для нас, AI-ассистента, который умеет отвечать на вопросы по содержанию конкретной статьи. Спросить про методологию, попросить объяснить формулу, уточнить, какие результаты получены на каком датасете — всё это прямо на странице статьи.

продолжить чтение

arXiv будет требовать перевода материалов на английский язык

Начиная с 11 февраля, репозиторий препринтов arXiv будет требовать, чтобы все работы были написаны на английском языке или сопровождались полным переводом на этот язык. Ранее авторам было достаточно представить англоязычную аннотацию.

продолжить чтение

ArXiv обновила свою политику публикации из-за засилья низкокачественных материалов, созданных с помощью ИИ

Платформа с препринтами научных работ ArXiv объявила, что больше не будет принимать обзорные статьи и аналитические доклады по информатике, которые не были рецензированы и приняты академическим журналом или конференцией. Изменение правил обусловлено наводнением этой категории низкопробными статьями, созданными при помощи искусственного интеллекта.

продолжить чтение

Яндекс победил шум

Бывало с вами так - лежишь в ванной, хочешь посмотреть видео с конями, кричишь "Алиса!", а колонка тебя не слышит из-за льющейся воды, работающего телевизора, пылесоса, чайника, соседа с перфоратором, блядской стройки за окном?Один из способов - жениться на женщине по имени Алиса, но тогда вам придется растить детей, убирать срач в доме и ездить в глупые отели в эмирате Дубай. Должно существовать более эффективное решение, не требующее обратной дискриминации мужчин.Инженеры (ни в коем случае не рисёчеры) из Яндекса посмотели на эту проблему, и, похоже, нашли элегантное решение. Почитать подробней пейпер можно

продолжить чтение

12