парсинг.

В «Архиве Интернета» из‑за наплыва ботов могут блокировать и обычных пользователей

Некоммерческая организация «Архив Интернета» развернула средства защиты онлайн‑библиотеки Wayback Machine от автоматизированных и вредоносных ботов, что стало приводить к блокировке и обычных пользователей, пытающихся получить доступ к ресурсу.

продолжить чтение

Собрал мониторинг упоминаний бренда в ChatGPT: три способа сбора данных показали три разные картины

Для одного из клиентов собрал упоминания бренда в ответах ChatGPT. Как обычно — на 20 вопросов, но теперь тремя разными способами. Бренд без подсказки прозвучал на одном вопросе из 19 в первом съёме и ни разу в двух других. А теперь к деталям.Что я измерял и на каких вопросах

продолжить чтение

Шесть мест, где за два месяца в проде ломался LLM-конвейер над лентами закупок, и почти все вне промптов

продолжить чтение

Как мы проверяем до 1 000 cайтов в час: рассказываем про ЮScan — сервис оценки рисков в сегменте e-commerce

1000 сайтов в час вместо нескольких часов на каждый — так работает ЮScan, сервис автоматизированного аудита от ЮMoney. Его основная задача — помочь банкам и платёжным организациям не допустить подключения сайтов, которые маскируют запрещённую или рискованную деятельность под легальный бизнес. Сервис автоматически проверяет ресурс и выявляет подобные случаи ещё до начала сотрудничества.С 2020 года через ЮScan проверено более 550 тысяч заявок. За это время ЮKassa не получила штрафов за обслуживание запрещённых видов деятельности.Кому это нужно?

продолжить чтение

Я не хотел нанимать работника и заменил его нейросетью

Дисклеймер: я люблю людей и свою карму. И не считаю, что всех нужно заменять ИИ. Всем привет! Меня зовут Миша Шумовский, я главред Нейромедиа — нового медиа про нейросети. На запуске у нас была задачка: наладить регулярный выпуск новостей, чтобы получать дополнительный поисковый трафик. Нанимать под это отдельного человека не хотелось: такая работа стоит недорого, но для молодого медиа важна каждая копеечка. Да и как будто в медиа про нейросети часть процессов точно должна быть автоматизирована, иначе зачем все это. 

продолжить чтение

Я собрал конвейер аналитики банков на LLM-агентах. Показываю, где он остановил 7 из 31

У проекта есть работающий сайт: ortant.net. На нём 24 принятых исследования, десять досье банков, карта покрытия данных и раздел с методикой. Исследование можно не только прочитать, но и заказать: конструктор собирает вопрос из готовых блоков (банк, окно, фокус), система бесплатно показывает паспорт данных с ценой, и после подтверждения идёт прогон. Медиана прогона $0,132 и 12,8 минуты; результат открывается своей страницей.

продолжить чтение

Как я хакнул рынок труда: пишем свой ИИ-комбайн для автооткликов на HH.ru

Всем привет! Если вы хоть раз искали работу в IT за последний год, то знаете, что рынок не любит новичков без опыта. Вы откликаетесь на сотни вакансий, получаете отказы от скриптов-автоответчиков, а чтобы пробиться через фильтры HR, нужно под каждую вакансию писать уникальное сопроводительное письмо.На просторах интернета можно найти сервисы-автоотклики, которые просят за свои услуги от 3 000 до 5 000 рублей в месяц. Зачем платить за то, что можно написать самому?

продолжить чтение

Как мы автоматизировали мониторинг цен конкурентов: мультиагентная система на CrewAI + n8n + Firecrawl

Или почему ваши конкуренты уже знают о ваших скидках раньше вас 0. TL;DR для тех, кто спешит Статья о том, как собрать из подручных open-source инструментов систему, которая ежедневно:— Сканирует цены и отзывы у конкурентов— Анализирует их ИИ‑агентами— Присылает готовый отчёт в TelegramСтек: n8n (оркестрация) → Firecrawl (парсинг) → CrewAI (анализ) → Telegram (доставка)1. Проблема: ручной мониторинг — это боль

продолжить чтение

Strava ужесточает доступ к API в попытке противостоять компаниям, занимающимся сбором данных с помощью ИИ

Платформа для отслеживания физической активности и социальная сеть для спортсменов Strava ужесточает доступ к API в попытке противостоять компаниям, занимающимся сбором данных при помощи ботов на искусственном интеллекте. Осенью 2024 года компания уже ввела запрет на использование любых данных, полученных через API Strava, для обучения ИИ-моделей. Однако компании в сфере ИИ обошли этот запрет.

продолжить чтение

Microsoft попросила издателей не блокировать ботов с ИИ

Microsoft попросила издателей и розничных продавцов позволить парсить их сайты. Об этом рассказал вице-президент по продуктам для издателей в Microsoft AI Нихил Колар в рамках мероприятия Programmatic AI, проводимого Ad Exchanger.

продолжить чтение

123