промпт.

Как писать промпты в 2026 году: генераторы, библиотеки шаблонов и новые правила игры

В 2026 году умение писать промпты — это уже не то же самое, что два года назад. Для многих задач качество формулировки перестало быть узким местом. Модели уровня GPT-5.6 и Claude научились считывать намерение даже из «грязных», небрежных запросов. Если раньше плохой промпт гарантированно давал мусор, то сейчас он выдаёт результат, который вполне подходит для 90% бытовых сценариев.

продолжить чтение

Промпт — не контракт: замерил, как часто модель нарушает жёсткие правила, и вынес их в код

У меня в проде работает ИИ-консультант на сайте. У него есть два правила, которые нарушать нельзя вообще: не называть цены и не называть клиентов, которые под NDA. Оба правила были написаны в системном промпте капслоком, с объяснением почему.Я замерил, как они соблюдаются. Получилось так:правило «не называй цен» модель срывает примерно раз на восемь прогонов;имя клиента под NDA проскакивало раз на пять.

продолжить чтение

Сравниваем LLM, 12 тестов для китайских флагманов: Kimi K3, GLM-5.2, DeepSeek V4 Pro и Qwen 3.8 Max

В первой статье цикла мы гоняли по 11 тестам Opus 4.8, GPT 5.5 и Gemini 3.1 Pro, во второй устроили дуэль тяжеловесов Claude Fable 5 и GPT 5.5 Pro, в третьей спустились в средний класс и столкнули три поколения Sonnet с GigaChat 2 MAX и YandexGPT Pro 5.1. Закончили мы прошлый материал прямым вопросом: хотите ли увидеть в следующей части DeepSeek и Qwen? Запрос в комментариях мы услышали, так что сегодня на ринге Китай.

продолжить чтение

Пользователь в США спрятал в судебных документах подсказку ИИ для решения спора в свою пользу

В соцсетях опубликовали скриншоты, которые демонстрируют, что житель США спрятал в судебных документах незаметную подсказку для ИИ. Он пошёл на такой шаг, чтобы тот согласился с его позицией.

продолжить чтение

Планирование четвёртого поколения: почему списки дел не работают

Лет десять я пытался привести свои дела в порядок и всё это время наступал на одни и те же грабли. Заводил борды с задачами в Notion, они бодро наполнялись первые пару недель, потом помирали, а разгребать мёртвый борд руками настолько больно, что туда перестаёшь заходить. Складывал поток сознания в заметки, в них удобно записывать, но найти нужное потом всегда проблематично. Писал в Saved Messages в Телеге. Лучшее место, чтобы выгрузить голову за десять секунд, и худшее, чтобы через неделю там что-то отыскать.Общее у всех попыток было одно:

продолжить чтение

OWASP LLM10: Unbounded Consumption. Тестируем современные языковые модели на ресурсоёмких промптах

продолжить чтение

Почему хороший результат в разработке с ИИ начинается не с промпта

Хабр, привет! Меня зовут Сергей Бережной, я директор по взаимодействию с разработчиками в Яндексе и эксперт онлайн-магистратуры «Фронтенд-, бэкенд-разработка и ИИ-решения» ИТМО в партнёрстве с Яндекс Практикумом

продолжить чтение

Сравниваем LLM, 12 тестов для Claude Fable 5 и GPT 5.5 Pro

В прошлой статье мы устроили большое сравнение Opus 4.8, GPT 5.5 и Gemini 3.1 Pro и оговорились: GPT 5.5 Pro в том матче не участвовала, потому что ее корректнее сравнивать с недоступной на тот момент Fable. Что ж, обещания надо выполнять. Anthropic внезапно вернула Claude Fable 5 в общий доступ. Напомню, это первая модель нового класса Mythos, которая в иерархии компании стоит выше Opus. Значит, пришло время дуэли тяжеловесов: Claude Fable 5 против GPT 5.5 Pro.

продолжить чтение

Kafka без брокеров: как я из художественного текста сделал современную техническую документацию

продолжить чтение

Сравниваем LLM: 11 тестов для Opus 4.8, GPT 5.5 и Gemini 3.1 Pro

Меньше месяца назад Anthropic выпустила модель Claude Opus 4.8. Как обычно, заявили много новых плюшек, вроде улучшенного кодинга и режима Fast Mode. Нам это показалось отличным поводом, чтобы устроить ее сравнение с двумя другими тяжеловесами рынка от Google и OpenAI.

продолжить чтение