llm. - страница 138

llm.

Opus 4.7 vs GPT-5 vs DeepSeek V4-Pro: три агента строят TSS-CLI на Rust

TL;DR24 апреля 2026 DeepSeek в режиме preview выкатил V4-Pro — MoE на 1.6T параметров (49B активных), 1M контекста. Появился повод посадить три флагманские модели за один и тот же не самый тривиальный таск и посмотреть, кто как справится. Задание общее, машина одна, час один, всё запускалось параллельно:МодельHarnessReasoning effortAnthropic Opus 4.7 (1M ctx)Claude Codex-highOpenAI GPT-5CodexhighDeepSeek V4-ProOpenCodehigh (max)

продолжить чтение

Дрессировка и воспитание личного автономного AI‑агента на VPS (Hermes Agent вместо OpenClaw)

Хочешь личного агента, который на связи 24/7? Послушного, исполнительного и даже... в меру умного? Он работает за еду (токены) и кров (VPS), учится новому и готов взять на себя любую рутину (связанную с интернетом) если ты его научишь. Он свободен от корпоративных инфраструктур (opensource) и предан только тебе. Он требует дрессировки и воспитания, а затем становится исполнительным секретарём.Мы живём в удивительное время, когда это стало реальным. Сначала LLMs проникли в веб‑поиск — появился «chatgpt». Проникли в компьютер — «claude code». Когда настала очередь VPS — появился небезопасный OpenClaw, а вскоре за ним — перспективный Hermes.

продолжить чтение

Decoding LLM Clichés: A Fresh Perspective

Like millions of others convinced they possess knowledge the world desperately needs to hear, I decided to write a book on prompting. In the process (which, by the way, turned out to be far more difficult than anticipated), I found myself examining LLM clichés. You know the ones. At least, in the comment sections of tech blogs, hundreds of self-proclaimed experts use them to spot AI-generated text.Anyway, these clichés definitely exist, and many authors now routinely add blocklists of these phrases to their prompts to weed them out. Whether this is actually a good or a bad thing is what I’ll break down below.Editors, writers, and readers unanimously agree that LLM-generated texts are easily recognized by their heavy reliance on certain tropes: "It’s not just , it’s a ...", "Unlocking the potential of...", "In today's fast-paced digital landscape..."

продолжить чтение

Запуск ИИ‑продукта с нуля: от гипотезы до первых результатов

ИИ всегда, ИИ везде… Да, мне тоже уже порядком поднадоели упоминания искусственного интеллекта к месту и не очень. Все, от покрышек до зубных щеток производится с использованием ИИ… по крайней мере, если верить рекламе. Но на самом деле несмотря на ажиотаж вокруг искусственного интеллекта, статистика остаётся неумолимой: около 80% AI‑проектов терпят неудачу, а почти 90% Proof of Concept (PoC) никогда не достигают полноценного развёртывания в продуктив.

продолжить чтение

Кириллица в LLM: почему русский язык в нейросетях стоит дороже и работает медленнее

Когда вы пишете запрос в ChatGPT или другую нейросеть, она не работает с буквами или словами — она режет ваш текст на маленькие кусочки. Эти кусочки называются токенами, и от того, как именно нейросеть режет текст, зависит цена ответа, скорость, и сколько информации в неё помещается за раз. С английским это работает хорошо: одно слово — обычно один‑два кусочка. С русским всё хуже: то же самое слово часто превращается в три‑четыре обрывка. Английское «contract» — один токен. Русское «разработка» — два‑три. «Программирование» — три‑четыре.

продолжить чтение

️ Zyphra выкатила ZAYA1-8B — маленькую MoE-модель, которая выглядит слишком бодро для своего размера

У модели меньше 1 млрд активных параметров, но Zyphra заявляет, что она конкурирует с куда более крупными open-weight и proprietary-моделями на математике, кодинге и reasoning-бенчмарках.ZAYA1-8B - это ставка на весь стек сразу:MoE-архитектура с Compressed Convolutional Attention;новый MLP-router для более стабильного выбора экспертов;learned residual scaling для контроля роста residual-норм;pretraining на AMD Instinct MI300x, без NVIDIA-стека;большой post-training pipeline с SFT, reasoning warmup, RLVE-Gym, math/code RL и RLHF/RLAIF;test-time compute метод Markovian RSA.

продолжить чтение

Veai 5.10: общие скиллы и подсказки в чате

Главное в релизе – скиллы теперь подхватываются из dot-директорий других ассистентов. В чат добавили быструю документацию по ссылкам на код.Скиллы из dot-директорий других вендоровТипичная ситуация – в команде один работает на Claude Code, второй на Cursor, третий на Veai. У каждого своя папка под скиллы, и одни и те же инструкции расходятся по .claude, .cursor, .veai. Чтобы агент в Veai знал то же, что агент в Claude Code, скиллы приходилось копировать руками и потом следить, чтобы версии не разъехались.Теперь Veai ищет скиллы не только в .veai/skills/*/SKILL.md, но и в .*/skills/*/

продолжить чтение

Токенизация: почему ИИ сложно считать буквы «r» в «strawberry»?

Пока мы воспринимаем свои промпты как обычный текст из символов, для LLM они в виде токенов «выглядят» совсем иначе. И если не осознавать этого, порой можно наткнуться на проблемы. Поэтому полезно (и интересно) понимать: что вообще представляют собой токены? По какому алгоритму текст преобразуют в них и обратно? Какие важные нюансы при этом возникают?Возможно, подробнее и понятнее всех объяснил пару лет назад ИИ-рисерчер Андрей Карпатый, записав двухчасовое видео

продолжить чтение

Монтаж видео через Claude Code

Разбираю архитектуру открытого проекта от browser-use: как заставить LLM монтировать без необходимости «смотреть» видеоКогда речь заходит про обработку видео нейросетями, у большинства из нас в голове всплывает одна и та же картина: модель смотрит на кадры, что-то понимает на основе изображения, режет по визуальным признакам. На практике это упирается в простую арифметику. Часовое видео в 30 fps — это 108 000 кадров. Если каждый кадр стоит хотя бы 1500 токенов, получаем 162 миллиона токенов на одно видео. Никакая модель столько не возьмёт за один проход, а если резать на куски — теряется глобальный контекст.

продолжить чтение

Разбираю «Qwen3.5-21B-Claude-4.6-Opus-Heretic-Uncensored»: что на самом деле внутри файнтюна с громким именем

Технический разбор модели, которую в телеграме продают как «Claude без цензуры»В моей ленте недавно завирусился пост: якобы кто-то «дообучил Qwen 3.5 до уровня Claude 4.6 Opus, убрал цензуру через Heretic и получил настоящего монстра». Звучит сенсационно. Я зашёл на HuggingFace, открыл карточку модели и провёл вечер, разбираясь, что там реально под капотом.

продолжить чтение