Kimi K3. - страница 2

Kimi K3 на PAC1 и ECOM1: результаты 204 задач и разбор отказов

Kimi K3 на PAC1 и ECOM1: результаты 204 задач и разбор отказов27 июля Moonshot AI опубликовала открытые веса Kimi K3 и технический отчёт с результатами на coding‑ и агентных бенчмарках. По этим таблицам K3 выглядит конкурентоспособной на задачах с кодом, терминалом и инструментами.Но итоговый балл не показывает, какие операции система действительно завершает, где оставляет неверное состояние и на каком шаге нарушает контракт. Мы решили проверить это на задачах с полностью открытыми трассами.

продолжить чтение

Как устроена Kimi K3: 2,8 трлн параметров, линейное внимание и агенты на миллион токенов

я устал сжимать оригинальное видео с >1mb gifMoonshot AI выпустила веса Kimi K3

продолжить чтение

Как GPT-5.6 и Kimi K3 научились хорошему дизайну — исследование Design Arena

За неделю команда бенчмарка Design Arena выпустила два разбора моделей, возглавивших ее дизайн-лидерборды: разбор GPT-5.6 Sol, флагмана OpenAI, и свежий разбор Kimi K3 от китайской Moonshot AI. Исследователи заглянули внутрь генераций и рассуждений моделей и показали, как именно те научились "вкусу". Выяснилось, что универсального рецепта нет: две модели пришли к хорошему дизайну противоположными путями, а третья — прошлый лидер GLM 5.2 — своим, третьим.

продолжить чтение

Минфин США пригрозил санкциями за китайский ИИ. Через несколько часов глава Nvidia встал на защиту моделей

Во вторник министр финансов США Скотт Бессент заявил

продолжить чтение

Галлюцинации недели: Kimi K3, Inkling и Bonsai 27B, который можно запустить на своем iPhone

продолжить чтение

Анализ отпечатков пальцев: обнаружено высокое сходство в стиле написания у нескольких авторов, использующих ИИ

Недавно широкий резонанс вызвал анализ стиля письма 22 ведущих языковых моделей искусственного интеллекта. Исследователи с помощью статистического инструмента Fable провели сравнение исходных текстовых ответов моделей на одну и ту же серию тестовых заданий с использованием показателя перекрестной энтропии. Результаты показали, что не только модели, разработанные в одной лаборатории, имеют очень схожий стиль письма, но и некоторые модели из разных лабораторий демонстрируют необычайно схожие языковые особенности.

продолжить чтение

Крупнейший open source ИИ в истории. Вышла Kimi K3 — по мощности модель уступает только Fable 5 и GPT-5.6

продолжить чтение

12