documentation.

Как правильно выбрать эмбеддинг для проекта

Эмбеддинги (иначе говоря, векторные представления) — это способ представления абстрактных данных в виде набора чисел (в виде векторов, как вы могли уже понять), близкие значения которых связаны семантически и математически и с которыми может работать модель искусственного интеллекта. Разберемся какие модели лучше других подходят для кодирования слов. Параллельно с этим разберём принципы, на которые нужно опираться при выборе эмбеддинг-модели, пощупаем русские BERT-модели и внесём ясность про системные требования, контекстное окно и размер батча.1. Типы эмбеддингов и области применения

продолжить чтение

Как мы оценивали OCR на русских документах — и почему все, что «распозналось», можно читать без смеха

Привет, Хабр! Меня зовут Искандер, я - AI-инженер в Лаборатории искусственного интеллекта «Честного знака», и недавно мы всерьёз занялись оцифровкой русскоязычных документов: от простых текстовых файлов до сложных документов с таблицами, списками и изображениями, поступающими из различных систем. Цель — чтобы машина читала их быстро, точно и без творческой интерпретации.

продолжить чтение

Как мы с ИИ перезапустили документацию Bitrix Framework и сэкономили 400 часов

Привет! Меня зовут Марина Павлова, я технический писатель в отделе документации 1С-Битрикс. В этой статье я расскажу:как мы полностью переделали документацию по Bitrix Framework,что изменилось в документации для разработчиков,как команде из двух человек удалось выпустить доку за 9 месяцев с помощью ИИ, когда мы параллельно работали над другими проектами.Новая документация уже доступна на сайте

продолжить чтение

Документируйте ИИ или как не провалиться в многомиллионные убытки

ИИ: факторы рискаПривет, слышали про Искусственный интеллекту (ИИ)? А про ИИ из каждого утюга?

продолжить чтение