PDF. - страница 2

PDF.

Вайбкодинг – не для гуманитариев? Юрист сделал кривой поиск по PDF и просит помощи…

Я столкнулся с простой (как мне изначально показалось – даже очень) задачкой. Мне в последнее время потребовалось часто проводить поиск в 4-х словарях. Государство мне их дало в виде пяти PDF файлов, выложенных онлайн. Это нормативные словари русского языка, слова из которых можно использовать в публичном пространстве после 1 марта 2026 г. Например, cash - можно использовать на русском как кэш, а не переводить как тайник или склад, поскольку в Словарь иностранных слов это слово уже включено. И это слово нам еще пригодится далее по тексту)

продолжить чтение

Как гуманитарий за 2 месяца с нуля RAG систему построил, или Парсинг PDF по-хардкору

ВведениеДобрый день. Сегодня я расскажу о том, как я за 2 месяца с полного нуля создал доменную RAG систему с корпусом в 20+ книг. В статье затрону проблемы парсинга данных (особенно PDF документов, с которыми приходилось иметь дело), чанкинга, создания и индексации эмбеддингов, а также самого интересного – ретривера. Расскажу о latency, трейд-оффах, и сложностях реализации подобных систем локально на ноутбуке (хоть и «игровом») без использования API LLM.Вся система делалась мной самостоятельно без использования LangChain

продолжить чтение

Питер Штайнбергер. Как работает автор OpenClaw [Clawdbot-Moltbot]

Питер Штайнбергер объясняет, что натворил. Фотография Марио Цехнера, автора другого ИИ-агента

продолжить чтение

Adobe добавила в Acrobat функцию превращения PDF в подкасты и презентации с помощью ИИ

Adobe добавила новые функции в пакет Acrobat, которые позволяют пользователям преобразовывать PDF‑файлы в подкасты и презентации с помощью искусственного интеллекта. Новинками можно воспользоваться в Acrobat Studio. Превратить PDF в подкаст можно с помощью Generate Podcast. Она составляет аудиосводку для любого документа в этом формате, в том числе для заметок, стенограмм встреч, длинных отчётов и учебных пособий. 

продолжить чтение

PDF ожил: Stanford превратил научные статьи в говорящих AI-ассистентов

продолжить чтение

ChameleonLab 1.5: Кросс-платформенный комбайн для стеганографии, рожденный на Хабре

Привет, Хабр! Пару месяцев назад мы представили наше детище — ChameleonLab, десктопное приложение для Windows и Mac, которое позволяет встраивать и извлекать скрытые данные из файлов, а также проводить их глубокий анализ. Проект начинался с самой простой версии, но благодаря активному участию и обратной связи от нашего сообщества, он постоянно развивается. Ваши предложения, в частности по интеграции офисных форматов и формата WebP

продолжить чтение

Claude научили создавать и редактировать файлы

Компания Anthropic объявила, что её ИИ-модель Claude теперь может создавать и редактировать таблицы Excel, документы, слайды PowerPoint и PDF-файлы непосредственно в Claude.ai и настольном приложении. Создание файлов доступно в виде предварительного просмотра для пользователей тарифных планов Max, Team и Enterprise. Пользователи Pro получат доступ к функции в ближайшие недели.

продолжить чтение

Docling in Working with Texts, Languages, and Knowledge

Docling in Working with Texts, Languages, and KnowledgeHi everyone. In the context of our research project, we were solving the problem of automating academic submission workflows, which led us to discover a platform called Docling.Together, we explore the role of Docling in reshaping how research data can be represented, reused, and reasoned over in both human and machine-readable formats.

продолжить чтение

ТОП-5 сервисов и программ для бесплатного редактирования PDF-файлов

Ранее мы уже писали о нейросетях для бесплатного анализа PDF-документов. Рекомендуем ознакомиться — ссылка ниже!Перейти к статье!

продолжить чтение

Топ-5 нейросетей для работы с PDF: модели для бесплатного извлечения данных в 2025 году

Уже не сосчитать, сколько раз мы пытались найти в 50-страничном PDF всего одну цифру

продолжить чтение