Поисковые технологии. - страница 3

Почему цена Bitcoin «сломалась»: разбор аномалий 2022–2026 с WhyTrend

Увидел провал на графике → открыл Google или Twitter → полдня собираешь версии "почему". Знакомо? Детектор аномалий сам по себе даёт только точки на оси времени, а вопрос "почему" как был ручным, так и остаётся.В этот раз я прогнал WhyTrend не на паре аккуратных точек из Google Trends, а на полном ряде BTC за 4.5 года — и заодно на двух разных LLM. Результат оказался неожиданным: модель меньшего размера дала в три раза больше настоящих объяснений, чем более крупная. Расскажу, что случилось и почему.Что запускалиДанные — дневные close BTC/USDT, 1680 точек без единого пропуска, с 1 января 2022 по 7 августа 2026. Ключевое слово одно — Bitcoin

продолжить чтение

Google начала тестировать новую главную страницу поисковика с ярлыками для работы с ИИ

Google постоянно ищет новые способы привлечь пользователей к функциям искусственного интеллекта, и на этой неделе компания тестирует ещё одно изменение в поиске, ориентированное на ИИ. Некоторые пользователи заметили обновлённый дизайн главной страницы поиска Google, в котором классическая кнопка поисковика заменена множеством ярлыков к функциям ИИ. 

продолжить чтение

Один запрос, семь ИИ-поисковиков, ноль общих источников

Когда человек спрашивает у ассистента «к кому обратиться», он не получает десять синих ссылок. Он получает ответ, внутри которого названы пять-десять доменов. Для бизнеса это новая выдача, и вопрос к ней другой, чем к обычному поиску: не «какая у меня позиция», а «я вообще есть в этом ответе».Я меряю это программно: беру запрос, задаю его нескольким движкам и смотрю не на текст ответа, а на то, какие домены движок реально процитировал. 10 августа 2026 года я прогнал два запроса через семь движков в один заход. Пересечение получилось пустым: ни одного домена, который назвали бы все семеро.

продолжить чтение

«Яндекс» обновил алгоритмы «Поиска по картинкам»

продолжить чтение

Когда подписи недостаточно: как мы расчищали «серую зону» в Поиске по картинкам

продолжить чтение

llms.txt — кто его реально читает и нужен ли он вашему сайту

Ну что, сыграем сегодня в разрушителей мифов? Тем более, именно этот миф набил оскомину и пару маркетинговых физиономий. Итак, давайте разбираться, что же такое этот наш элэлэмс текст, зачем он нужен и нужен ли вообще.

продолжить чтение

Почему никто не объясняет аномалии во временных рядах?

Недавно встретились с коллегой за кружкой кофе, без всякой рабочей повестки. Он занимается Data Science, я — backend‑разработкой. Разговор как‑то незаметно, как это обычно бывает, свернул в сторону обсуждения рабочих нюансов, а самый обычный вопрос про очередной график в дашборде — закончился идеей проекта, который в итоге вырос в open‑source фреймворк.В какой‑то момент он сказал фразу, которая неожиданно зацепила:«Мы легко и быстро умеем находить аномалии. Но потом аналитик всё равно часами выясняет почему они произошли.»

продолжить чтение

BM25 против эмбеддингов, Protocol против наследования: как рождался фреймворк WhyTrend

В прошлой статье я рассказывал про WhyTrend — open‑source инструмент, который не просто находит аномалии во временных рядах, а пытается объяснить, почему они произошли: собирает внешний контекст (новости, Hacker News, Wikipedia) и формирует объяснение со ссылками на источники. Если коротко: идея выросла из наблюдения, что находить аномалии мы научились отлично, а вот объяснять их до сих пор приходится вручную — гуглить, листать Reddit и Slack, собирать гипотезу самому.

продолжить чтение

Штрафуют ли AI-тексты? Прогнал свой корпус через 5 нейросетей и сверил с данными Ahrefs на 331k страниц

Тезис «за AI-текст понижают» (хорошо хоть не унижают) звучит как здравый смысл, и я сам долго в него верил. Но верить, честно говоря, разонравилось, поэтому решил проверить руками на каком-нибудь реальном замере. В итоге я прогнал корпус страниц через пять нейросетей, посмотрел, что предсказывает попадание в их ответы, и сверил вывод с недавним разбором Ahrefs на 331 тысячу страниц (даже Лев Толстой слегка перевернулся). На самом деле, если отбросить шутки, получилось даже интереснее, чем ожидал: наказание следует не за сгенерированный текст как таковой, а за отсутствие реального содержания. Так сказать, за водичку.

продолжить чтение

Как оценить стоимость ручного поиска документов в компании на 200 человек

В корпоративных системах обычно хорошо считают то, что приходит отдельным счётом: лицензии, серверы, внедрение, поддержку, подрядчиков. Эти расходы видно в бюджете, у них есть владелец, договор и понятная строка в финансовой модели.Но есть другой тип расходов — менее заметный. Он не приходит отдельным счётом, но каждый день съедает рабочее время сотрудников. Речь о ручном поиске документов, старых версий файлов, договоров, регламентов, презентаций, отчётов и решений, которые уже когда-то были созданы внутри компании.

продолжить чтение