gpt-5.6.

Семь нейросетей сравнили вслепую на восьми заданиях: победила Fable 5.1, Kimi K3 взяла больше всего заданий

Опубликованы итоги открытого сравнения семи нейросетей от семи разных команд на восьми практических заданиях. Первое место по сумме баллов заняла Fable 5.1 (145), второе — Kimi K3 (133), третье — GPT-5.6 Sol (118). Все работы, голоса судей с пояснениями и сырые данные выложены на https://ikorg.ru/rating/.Кто участвовал. Fable 5.1, GPT-5.6 Sol , Kimi K3, Qwen 3.8 Max, Gemini 3.8 Flash, Grok 4.6 и DeepSeek V4 Pro.Задания.

продолжить чтение

Турнир семи нейросетей: участники судили друг друга, а финал решили 3360 битв

После первой статьи я понял, что мои велосипеды кому‑то полезны. Поэтому рассказываю про следующий.Я делаю сайты с помощью нейросетей. И меня давно бесило, что внятного сравнения моделей на наших просторах нет: либо синтетические бенчмарки, где кто‑то решает олимпиадные задачи, либо «топ-10 нейросетей 2026» с картинками из стока. Мне нужно было другое — какая модель с первого промпта выдаст результат, который не стыдно показать заказчику.

продолжить чтение

Нейрохирург доказал гипотезу, над которой математики бились 22 года. Ему помог 16-часовой ран GPT-5.6

продолжить чтение

Доказательство заняло 30 минут, проверка — 5 дней. Как ИИ закрыл задачу теории связи

Дмитрис Папаилиопулос, исследователь Microsoft Research и в прошлом теоретик информации, рассказал

продолжить чтение

Qwen3.8-Max: 2 400 000 000 000-параметровый монстр

Пока одни запускали GPT-5.6 Sol Max, другие ломали копья в холиварах «Kimi K3 vs Claude Opus 5», Alibaba тихо (ага, с ростом акций на 7% в моменте – очень тихо) вкатила модель, которую сама называет «новой планкой для кодинга и совместной работы». Знакомьтесь: Qwen3.8-Max

продолжить чтение

OpenAI снесла тайную доску своих агентов. Через два дня они собрали новую — из имен папок

продолжить чтение

ИИ за полтора часа взял задачу, над которой статистики бились 20 лет

продолжить чтение

Claude Fable обошел GPT-5.6 в переписывании программ с нуля. Вот как ему это удалось

Исследовательская группа Epoch AI обновила лидерборд бенчмарка MirrorCode

продолжить чтение

GPT-5.6 помог опровергнуть гипотезу Максвелла — но не ту, про которую все подумали

29 июля на arXiv появилась короткая заметка

продолжить чтение

У криптографов была «одна пуля в барабане». GPT-5.6 нашел вторую

23 июля Прабханджан Анант (Калифорнийский университет в Санта-Барбаре) и Амит Сахаи (UCLA) выложили на arXiv статью

продолжить чтение

12