Семь нейросетей сравнили вслепую на восьми заданиях: победила Fable 5.1, Kimi K3 взяла больше всего заданий
Опубликованы итоги открытого сравнения семи нейросетей от семи разных команд на восьми практических заданиях. Первое место по сумме баллов заняла Fable 5.1 (145), второе — Kimi K3 (133), третье — GPT-5.6 Sol (118). Все работы, голоса судей с пояснениями и сырые данные выложены на https://ikorg.ru/rating/.Кто участвовал. Fable 5.1, GPT-5.6 Sol , Kimi K3, Qwen 3.8 Max, Gemini 3.8 Flash, Grok 4.6 и DeepSeek V4 Pro.Задания.
Турнир семи нейросетей: участники судили друг друга, а финал решили 3360 битв
После первой статьи я понял, что мои велосипеды кому‑то полезны. Поэтому рассказываю про следующий.Я делаю сайты с помощью нейросетей. И меня давно бесило, что внятного сравнения моделей на наших просторах нет: либо синтетические бенчмарки, где кто‑то решает олимпиадные задачи, либо «топ-10 нейросетей 2026» с картинками из стока. Мне нужно было другое — какая модель с первого промпта выдаст результат, который не стыдно показать заказчику.
Доказательство заняло 30 минут, проверка — 5 дней. Как ИИ закрыл задачу теории связи
Дмитрис Папаилиопулос, исследователь Microsoft Research и в прошлом теоретик информации, рассказал
Qwen3.8-Max: 2 400 000 000 000-параметровый монстр
Пока одни запускали GPT-5.6 Sol Max, другие ломали копья в холиварах «Kimi K3 vs Claude Opus 5», Alibaba тихо (ага, с ростом акций на 7% в моменте – очень тихо) вкатила модель, которую сама называет «новой планкой для кодинга и совместной работы». Знакомьтесь: Qwen3.8-Max
Claude Fable обошел GPT-5.6 в переписывании программ с нуля. Вот как ему это удалось
Исследовательская группа Epoch AI обновила лидерборд бенчмарка MirrorCode
GPT-5.6 помог опровергнуть гипотезу Максвелла — но не ту, про которую все подумали
29 июля на arXiv появилась короткая заметка
У криптографов была «одна пуля в барабане». GPT-5.6 нашел вторую
23 июля Прабханджан Анант (Калифорнийский университет в Санта-Барбаре) и Амит Сахаи (UCLA) выложили на arXiv статью

