Обновить

Моя лента

Тип публикации
Порог рейтинга
Уровень сложности
Предупреждение
Войдите или зарегистрируйтесь, чтобы настроить фильтры

Я перестал пользоваться самыми умными ИИ‑моделями. Программировать стало быстрее и дешевле

В отпуске есть время подумать и исследовать. Я натолкнулся на несколько вещей и открытий для себя. Оказалось, что мне как программисту перестали быть нужны самые умные и дорогие ИИ‑модели. Оказывается, есть такой параметр «Cost per Task», и по этому параметру на первое место вырвалась модель GPT-5.6 Luna (max).

При этом, если вы пользуетесь Codex, она самая тупая в списке моделей. Artificial Analysis Intelligence Index у нее всего 38. Для сравнения, у самой умной GPT-6 Astra (max) этот индекс равен 53. В итоге цена выполненной Luna задачи составляет $0.18 против $3.26 у Astra. Разница почти в 20 раз.

Как я понимаю, бенчмарк «Cost per Task» высчитывается так: когда ставится нормальная, грамотно описанная задача, замеряется, сколько токенов было потрачено на ее выполнение. То есть не в формате «из ХЗ сделаю ТЗ», а в формате, когда в хорошо заданном вопросе уже содержится половина ответа.

Я сначала не поверил, что так и есть, и стал работать, используя самую тупую модель Luna в линейке. И знаете, какие меня ожидали результаты?

Я перестал пользоваться самыми умными ИИ‑моделями. Программировать стало быстрее и дешевле
Новость

Хакеры взломали OpenAI с помощью моделей Claude

Время на прочтение2 мин
Охват и читатели0

Команда Hacktron опубликовала разбор того, как 25 июля 2026 года она связала две уязвимости и получила доступ к аккаунтам ChatGPT и Codex нескольких сотрудников OpenAI, а через подключённые интеграции и к внутренним репозиториям компании. От первой находки до пул-реквеста в приватном монорепозитории прошло меньше 72 часов.

У OpenAI есть публичный форум для пользователей, community.openai.com. Войти туда можно тем же аккаунтом, что и в ChatGPT и до исправления взлом форума означал взлом аккаунта ChatGPT и Codex у всех, кто на форум заходил, включая сотрудников самой компании.

Читать далее

Новости

Новость

Microsoft отказалась от инструмента для прямой передачи данных между ПК в Windows 11

Время на прочтение2 мин
Охват и читатели2

Microsoft решила отказаться от инструмента для прямой передачи данных между компьютерами (PC‑to‑PC), который был незаметно внедрён в Windows 11. Этот инструмент позволял передавать файлы по Wi‑Fi или локальной сети (LAN), в отличие от метода синхронизации через OneDrive, используемого в приложении «Резервное копирование Windows» (Windows Backup). 

Читать далее
Статья

Мы пытались оптимизировать граф агентов в LangGraph — и в итоге написали gMAS

Уровень сложностиСредний
Время на прочтение17 мин
Охват и читатели0

Около полугода назад мы с командой взялись за оптимизацию мультиагентных систем. Нас интересовали не новые промпты и не очередной способ заставить несколько LLM обсуждать ответ по кругу. Нам хотелось работать с самой структурой системы: автоматически подбирать агентов, менять связи между ними, удалять бесполезные ветви и перестраивать граф по результатам выполнения.

Первым делом мы решили воспроизвести G-Designer. В этой работе коммуникационная топология мультиагентной системы оптимизирована с помощью графовой нейросети: агенты представлены вершинами, обмен сообщениями — рёбрами, а итоговый граф должен лучше соответствовать решаемой задаче.

С воспроизводимостью всё оказалось сложнее. Повторить весь заявленный процесс по опубликованному коду не получилось. Но постановка задачи была слишком интересной, чтобы останавливаться. Мы начали писать собственную реализацию, а средой выполнения выбрали LangGraph.

И тут эксперимент про оптимизацию графов неожиданно превратился в эксперимент про ограничения агентных фреймворков.

Читать далее
Новость

Выступления на конференции AI R&D DAY

Время на прочтение1 мин
Охват и читатели471

17 сентября в Москве прошла AI R&D DAY — конференция для исследовательских команд и создателей ИИ-систем.

Более 600 участников на одной площадке, 20+ докладов — концентрат практического опыта, знаний и инструментов, готовых к внедрению сразу по возвращению в офис. 
 
Обсудили альтернативные архитектуры, обучение моделей и AI-агентов, долгосрочную мультимодальную память, новые модальности и коммуникации, а также бенчмаркинг и стандарты качества AI.

Среди спикеров — эксперты Сбера (Sber AI, Kandinsky Lab, Центра «ИИ для науки», Центра практического ИИ, Центра робототехники), института AIRI, Лондонского института практических наук, Национального суперкомпьютерного центра в Цзинане и другие создатели ИИ-систем.
 
Видеозаписи докладов уже доступны в наших соцсетях. А если вы хотите стать частью исследовательского коммьюнити Сбера, то переходите по ссылке

Читать далее
Пост

ИИ в ИБ: инструмент для аналитика или новая точка риска?

ИИ уже помогает решать задачи, которые раньше требовали значительного участия аналитиков SOC: обрабатывать большие объёмы данных, искать связи между событиями, формировать гипотезы и ускорять расследования. Но одновременно корпоративные ИИ-системы сами становятся объектом защиты.

На вебинаре «ИИ как инструмент и объект защиты» 1 октября в 11:00 эксперты Innostage разберут обе стороны применения ИИ в ИБ.

Искандер Тиморшин, владелец продукта Innostage TDIR, расскажет, как мультиагентная система помогает сокращать объем рутинных операций аналитика и ускорять расследование инцидентов. Отдельно обсудим, как перейти от экспериментов с ИИ к его промышленному применению в SOC.

Айдар Фатыхов, владелец продукта Innostage AIDR, разберёт вопросы защиты корпоративных ИИ-систем: как защищать коммерческую тайну и другие чувствительные данные при работе с ИИ, какие риски возникают при использовании корпоративного ИИ и с чего начать выстраивание его защиты. 

Поговорим с вами о двух взаимосвязанных задачах: как использовать ИИ, чтобы усиливать ИБ, и как не превратить сам ИИ в новую неконтролируемую точку риска.

1 октября, 11:00
Подключиться к вебинару

Теги:
0
Комментарии0
Новость

Google выложила библиотеку эксклюзивных для смартфонов Pixel эмодзи Noto 3D

Время на прочтение2 мин
Охват и читатели481

Google выложила в открытый доступ библиотеку трёхмерных эмодзи Noto 3D на GitHub. Изначально они предназначались эксклюзивно для смартфонов Pixel.

Читать далее
Статья

Угрозы в сетевом трафике, или Что мы нашли в сети за 10 месяцев мониторинга

Уровень сложностиПростой
Время на прочтение19 мин
Охват и читатели768

Для эффективного обнаружения киберугроз в сетевом трафике необходимо регулярно анализировать информацию из различных источников. Отдельные средства защиты выявляют лишь часть признаков вредоносной активности, а для получения общей картины необходимо сопоставлять результаты их работы. Поэтому решения стоит использовать совместно и анализировать события в едином контексте — благодаря этому растет достоверность интерпретации.

Мы проанализировали публичные сведения об инцидентах информационной безопасности, исследования авторитетных организаций и экспертов, взяли собственную экспертизу Positive Technologies, обезличенные данные PT Sandbox, полученные в результате анализа файлов из сетевого трафика PT Network Attack Discovery. Информация в статье охватывает период с октября 2025 года по июль 2026 года.

Читать далее
Новость

Релиз Meta Test 2.0 — российской платформы для создания и запуска автотестов веб‑приложений без навыков программирования

Время на прочтение2 мин
Охват и читатели623

Состоялся второй мажорный релиз проекта Meta Test. Это российская платформа для создания и запуска автотестов веб-приложений без навыков программирования.

Читать далее
Статья

Федерация корпоративного мессенджера: как связать независимые On-Premise-контуры и сохранить контроль над данными

Время на прочтение9 мин
Охват и читатели753

Корпоративный мессенджер обычно работает внутри управляемого контура: ИТ управляет доступом, информационная безопасность — политиками и потоками данных. Но проектные команды редко совпадают с юридическими границами компании. Сотрудникам нужно постоянно общаться с подрядчиками, партнерами и коллегами из дочерних обществ, и желательно не переносить рабочий контекст в публичные сервисы.

В ноябре 2025 года мы выпустили федерацию VK WorkSpace для двух On-Premise-инсталляций. В релизе 26.2, вышедшем в июле 2026 года, сняли ограничение на парное взаимодействие: теперь в одном чате могут работать участники из нескольких независимых контуров. В статье разберем, как устроена модель доверия, почему мы выбрали репликацию данных на стороне каждой организации, что пришлось изменить в клиентских приложениях и какие ограничения у решения остаются.

Меня зовут Андрей Ковайкин, я старший менеджер продукта направления Мессенджер в команде VK WorkSpace. Мы развиваем единый контур корпоративных коммуникаций, а федерация решает его внешний сценарий: позволяет организациям общаться между собой, не объединяя инфраструктуру, администрирование и политики безопасности.

Читать далее
Статья

Windows 11 принудительно включит защиту ядра. Убьет ли это fps

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели680

Microsoft объявила, что с октября начнет включать целостность памяти на подходящих компьютерах самостоятельно, не спрашивая пользователя. Первым обновлением с этим изменением станет ежемесячный набор исправлений 13 октября. Сама по себе эта штука довольно полезная, и спорить с этим трудно, но у нее есть побочный эффект. Про него говорят нечасто, но геймеры знают о нем уже несколько лет. Собственно, из-за особенностей этой функции многие уже давно сняли эту галку в настройках.

Читать далее
Новость

В связности стран Центральной Азии зависимость от российского сетевого транзита снижается, а флагманом стал Казахстан

Время на прочтение3 мин
Охват и читатели578

За последние четыре года в связности стран Центральной Азии зависимость от российского сетевого транзита снизилась, пишет RIPE Labs. Местные операторы и власти диверсифицируют маршруты, расширяют сети точек обмена интернет‑трафиком и укрепляют безопасность маршрутизации. Растёт не только количество прямых соединений между региональными сетями, но и связи с Пакистаном, Китаем, Азербайджаном и Европой, которые предоставляют новые альтернативы традиционным маршрутам.

Читать далее
Статья

Штраф за несвоевременную подачу акта по рекламе: разбор реального кейса, и как снизили штраф в 2 раза

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели755

В один обычный рабочий день на почту ООО пришло определение об истребовании сведений, необходимых для разрешения дела, в том числе сведений (информации), необходимых для расчета размера административного штрафа. Простыми словами: в отношении ООО было возбуждено дело об административном правонарушении. Причина — пропущенный срок подачи акта по Интернет‑рекламе. Возможная сумма штрафа ощутимая для малого бизнеса. Как так вышло и что было дальше — читайте в этом разборе.

Читать далее
Статья

474 712 строк за 35 лет: как мы с LLM и 21 экспертом приводим в порядок справочник автосервиса

Уровень сложностиСредний
Время на прочтение14 мин
Охват и читатели971

НАР РУЧКУ ДВЕРЬ РАСПАШ З ПР С/У

Это не битая кодировка и не ошибка миграции. Это настоящее название работы из нашего справочника. За 35 лет в нём накопилось 474 712 строк: сокращения, дубли, опечатки, разные языки и разные варианты одной и той же операции.

Опытный мастер-консультант многое понимает по контексту. Для специалиста по записи клиентов и аналитика такой справочник уже становится системной проблемой: первый зависит от знаний более опытных коллег, второму приходится вручную собирать разные названия одной операции.

Мы столкнулись с этим при разработке Dealer Digital Platform «Флора». Проект ещё не завершён, но основную часть нормализации уже прошли: дедуплицировали массив, дважды провели его через экспертную проверку и для 96,13% работ после дедупликации подтвердили корректный узел.

Я решил рассказать об этом сейчас, не дожидаясь финального релиза: основные грабли уже случились. Мы отказались от полнотекстового поиска, несколько раз перестроили работу LLM и экспертов, научились возвращать экспертный фидбек в правила и skills агента и ошиблись больше чем втрое в оценке производительности на одной из задач.

Если вы работаете с историческими справочниками, master data или LLM-классификацией, значительную часть этого опыта можно перенести и за пределы автобизнеса.

Читать далее

Ближайшие события

Новость

Rust стал языком первого уровня в Microsoft

Время на прочтение3 мин
Охват и читатели1.2K

Rust стал языком первого уровня (Tier-1) в Microsoft наряду с C++, C# и TypeScript, являясь одним из наиболее поддерживаемых языков для внутренней разработки. 

Читать далее
Статья

Вы просили вернуть Suno v5, а мы сделали лучше. Встречайте Grom Zvuk

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели1.5K

В мире генеративного ИИ всё меняется стремительно. Этим летом музыкальное ИИ-сообщество столкнулось с сюрпризом: разработчики Suno навсегда отключили полюбившиеся многим старые версии моделей (v4, v4.5, v5 и v5.5).

Пользователи нашей ИИ-платформы GPTunneL (агрегатора нейросетей) массово жаловались: пропал тот самый вайб, а новые алгоритмы стали слишком жесткими. К тому же в Suno всегда была одна фундаментальная проблема, которая бесила многих креаторов – там нельзя было просто взять и поменять текст в уже готовом, сгенерированном треке.

Мы выслушали боль нашей аудитории, посмотрели на то, чего не хватает рынку, и решили сделать свой продукт.

Сегодня, 18 сентября, мы официально запускаем Grom Zvuk – нашу собственную музыкальную ИИ-модель. Она работает на наших серверах, выдает крутое качество, делает невероятные каверы и стоит дешевле западных аналогов. Рассказываем, как она устроена и на что способна.

Читать далее
Статья

Количественная торговля: как искать структуру в шуме и не переобучить модель

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели1.3K

Как сделать количественную торговлю эффективной? Не каждый аналитик может дать ответ на этот вопрос, но эффективная алгоритмическая торговля базируется на поиске структуры в зашумлённых рыночных данных. Это поиск закономерностей или областей предсказуемости. Например, если рынок растёт два дня подряд, то он обычно растёт и на третий день. Если такое происходит довольно часто, значит, мы нашли закономерность, которую искали. Далее следует торговая стратегия: если рынок растёт два дня подряд, покупайте на закрытии второго дня и продавайте на закрытии третьего. Однако не всё так просто.

Читать далее
Статья

Как я сделал спутник для Codex и дошел до разработки из электрички

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели1.7K

Утром оставляю ноутбук включенным и еду на работу. По дороге открываю на телефоне режим «удаленно» и обсуждаю с агентом, что еще доделать в моем приложении. Он пишет код, присылает картинки интерфейса и покадровую нарезку анимаций. Я смотрю: норм или не норм. Если готово — выпускаем.

Приложение — маленький пиксельный спутник, который показывает, чем занят Codex. Называется CoPet. Я работаю аэрокосмическим инженером, люблю все пиксельное и хочу постоянно видеть, что делает мой ИИ‑товарищ. Поэтому спутник с телеметрией в углу рабочего стола кажется мне совершенно естественной потребностью. Такой профессиональный фетиш.

До этого проекта я никогда не собирал самостоятельных приложений. Весь мой опыт программирования помещался в учебные тетрадки Jupyter. Как устроить программу для Windows, как ее запускать и вообще с какой стороны подойти к GitHub — предстояло выяснить.

Начал примерно так: хочу, чтобы Codex работал, а CoPet показывал состояния. Кодекс пыхтел‑пыхтел, сказал «готово». Проверяем — нифига не работает. Окно есть, состояния не меняются.

И началось.

Читать далее
Статья

Wi-Fi из PHP: сканирование, подключение, хотспот и watchdog для Raspberry Pi без монитора и клавиатуры

Уровень сложностиСредний
Время на прочтение5 мин
Охват и читатели1.8K

Библиотека для PHP, которая сканирует и подключает Wi-Fi, поднимает хотспот и держит на связи Raspberry Pi без монитора: если сеть пропала, watchdog переподключается сам, а если не выходит, поднимает точку доступа для настройки с телефона. Под капотом nmcli, wpa_cli и hostapd. Каждый релиз прогоняется на настоящем Pi, логи в репозитории.

Читать далее
Статья

Почему юридический AI‑сервис нельзя строить как обычный чат: проектируем case‑first SaaS на Go

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели1.8K

Несколько месяцев назад мне понадобилось заключить договор с Леноблводоканалом. Казалось бы, обычная бюрократическая задача: отправил документы, получил ответ, подписал договор. На практике ответа долго не было. Юриста у меня не было. Зато был AI.

Я описал ситуацию, приложил документы и попросил помочь разобраться, какие у меня вообще есть варианты. В результате подготовил две жалобы в УФАС. Через некоторое время история сдвинулась с места, и договор со мной в итоге заключили.

Не хочу делать из этого вывод в духе «ChatGPT заменил юриста». Наоборот. Когда я позже посмотрел на этот процесс уже как backend-разработчик, самым интересным оказалось другое:

обычный чат — довольно плохая архитектура для решения подобных задач.

Именно из этого наблюдения появилась идея небольшого SaaS-проекта.

Читать далее
Пост

Как пройти путь от полного запрета ИИ до AI Native, где код пишут сотни агентов? Расскажем на GoCloud Tech 2026

Внедрение ИИ в разработку — это, к сожалению, не тумблер из легендарной Need for speed, который щелкнул и ускорился. По нашему опыту это путь через пять уровней зрелости, на каждом из которых свои бонусы и грабли. Расскажем, как мы продвигались от тотального запрета на ИИ к AI Native подходу, где сотни агентов пишут код практически без участия человека. Еще честно разберем, где ИИ реально дает +150% к продуктивности, а где превращается в −100% нервов. Обсудим потерю контекста, когнитивную усталость, боль с поддержкой легаси-кода и разный уровень зрелости внутри одной команды, а еще посмотрим на ситуацию глазами компании: безопасность, ценность SDD (spec-driven development) и границу между личными инструментами разработчика и корпоративной ИИ-инфраструктурой.

Спикеры:
Михаил Трифонов — лидер продуктовой платформы, Cloud.ru;
Руслан Таболин — руководитель направления, Cloud.ru.

Трек: Разработка

📅 Когда: 15 октября в 12:00–12:40 мск.

👉 Зарегистрироваться

А пока ждете выступление, можете посмотреть результаты нашего исследования: Почему пилотные ИИ‑проекты умирают, а теневое использование живет: итоги опроса

Теги:
0
Комментарии0
1
23 ...