Kimi K2.5 наступает на пятки GPT-5.4. И работает из России без VPN
Бенчмарков сейчас – как нейросетей: каждую неделю новый. GPQA Diamond тестирует PhD-знания. Lexometrica проверяет фактическую точность. LLM Persuasion Benchmark – способность убеждать в дебатах. Chatbot Arena – предпочтения живых людей. Резонный вопрос: зачем ещё один?
ИИстерия — а есть ли она?
Вводное словоЧуть более двух лет назад я опубликовал здесь статью про восприятие IT-специалистами феномена нейросетей. Тогда моё «исследование» (не стоит убирать кавычки, это именно «исследование») базировалось на опыте психологического консультирования 30 представителей сферы, с которыми поднималась эта тема. Если мы вернемся немного назад во времени, то картина будет следующей.
Исследование Стэнфордского университета выявило опасности обращения к чат-ботам с ИИ за личными советами
Учёные Стэнфордского университета предупредили об опасностях обращения к чат-ботам на базе искусственного интеллекта за личными советами. Они назвали «подхалимство» нейросетей широко распространённым поведение с серьёзными последствиями.
Эксперимент «Резиновая рука»
В 1998 году два исследователя факультета психиатрии Питтсбургского университета и факультета психологии Университета Карнеги-Меллон – Мэтью Ботвинник и Джонатан Коэн провели эксперимент, теперь известный как «Резиновая рука». Участник эксперимента – назовём его для краткости условным именем Ян – садился за стол, исследователи огораживали одну из его рук щитом, за которым Ян её не видел. Исследователи выкладывали перед ним достоверно выполненный муляж руки – параллельно настоящей – загороженной - руке Яна.
Apple представила нейросеть LiTo: она генерирует 3D-объекты с реалистичными бликами и отражениями по одной фотографии
Исследователи ML-подразделения Apple представили модель машинного обучения LiTo, которая восстанавливает 3D-объекты по одной фотографии и сохраняет сложные визуальные эффекты, включая блики, отражения и изменения внешнего вида материала под разными углами.
Anthropic провели крупнейший опрос об ИИ: 80 000 человек из 159 стран
Anthropic опросили 80 508 пользователей Claude из 159 стран на 70 языках о том, чего они ждут от ИИ и чего боятся. Это крупнейшее качественное исследование такого рода — предыдущий рекорд держали архив Фонда Шоа и Всемирного банка, и оба не дотягивали до 60 000 участников.Вместо анкеты с вариантами ответов каждый проходил живое интервью с ИИ-интервьюером, который адаптировал вопросы под ответы собеседника. Claude потом категоризировал разговоры сам.

