GPT-6 Astra стала доступна пользователям Plus, Pro, Enterprise и Business Premium
GPT-6 Astra появилась у всех пользователей тарифов Pro, Enterprise и Business Premium в ChatGPT Work и Codex, а также стала доступна через API.Изначально Astra начали разворачивать для ограниченного числа организаций в программе Daybreak, а затем OpenAI обещала постепенно открыть ее подписчикам Plus, Pro, Business и Enterprise. upd: доступ выкатили всем пользователям платных тарифов.Также GPT-6 Astra стала доступна в Codex.
OpenAI выпустила GPT-6 Astra: кибербезопасность, AGI и доступ
OpenAI представила GPT-6 Astra — новое флагманское поколение модели, ориентированное на автономную работу над сложными многошаговыми задачами. Акцент сделали на программировании, исследованиях, работе с инструментами и других сценариях, где модель должна не просто ответить на запрос, а самостоятельно пройти длинную цепочку действий.Скажу сразу: это скорее поэтапное развертывание. Сначала доступ для избранных — ограниченные группы и спецы по кибербезопасности. Широкий доступ еще не выкатили.
LLM зацикливается: как найти причину, не трогая параметры?
Всем привет, меня зовут Сергей Прощаев и в этой статье расскажу про аварию, которую сложно поймать тестами.Сервис на базе LLM три недели работает нормально, а потом начинает отдавать отчёты, где с середины примерно двадцать раз подряд идёт один и тот же абзац, а дальше — обрыв на полуслове. Пользователи присылают скриншоты, GPU занят
Anthropic представила Claude Fable 5.1 — модель для сложных задач и долгой работы с ИИ-агентами
Anthropic выпустила Claude Fable 5.1 — новую модель из семейства Claude, которая стала преемником Claude Fable 5. Модель ориентирована на задачи с длительным контекстом и многоэтапным выполнением: агентное программирование, исследовательскую работу, анализ документов и другие сценарии, где требуется последовательное решение сложных задач.Claude Fable 5.1 доступна через Claude API и платформы партнёров Anthropic. По сравнению с предыдущей версией модель получила улучшения в работе с ИИ-агентами, более глубоким рассуждением и длительными рабочими процессами.
RAG в медицинской аналитике: как построить управляемый контур вместо очередного чат‑бота
Эта публикация подготовлена на основе моей ВАК‑статьи «Методологический подход к применению Retrieval‑Augmented Generation в медицинской аналитике для развития интеллектуальной поддержки деятельности медицинской организации». Для Хабра я убрал академическое оформление, сократил обзор литературы и подробнее объяснил практическую архитектуру, ограничения и способ оценки такого решения.
Хайп вокруг ИИ: реальное состояние дел и будущее
Меня зовут Ричард Кэмпбелл. Я из Ванкувера из канадской провинции Британская Колумбия. В Копенгагене я не впервые и, как уже говорил, выступал на множестве конференций NDC1.
Сжатие данных — это предсказание
Недавно я читала материалы о сжатии данных, и меня внезапно озарила безумная мысль: по сути своей, алгоритмы сжатия и LLM предназначены для решения одной и той же задачи.
DeepSeek поднимает цены на API: в пиковые часы до 12 раз
DeepSeek объявили новые цены на API моделей V4 Flash и V4 Pro. Они начнут действовать 16 августа в 16:00 UTC, или в 19:00 по Москве.Раньше API стоил одинаково круглые сутки. Теперь появятся часы пик: с 01:00 до 04:00 и с 06:00 до 10:00 UTC. В это время каждый токен будет стоить вдвое дороже, чем в остальные часы.Но это не просто повышение в два раза. Сами базовые цены тоже выросли. Например, миллион выходных токенов V4 Flash сейчас стоит $0,28. После обновления он будет стоить $0,66 вне часов пик и $1,32 в часы пик: в 2,4 и 4,7 раза дороже соответственно.
Google выпустила Gemini 3.7 Flash: развитие агентных сценариев
Google DeepMind представила Gemini 3.7 Flash — новую модель семейства Flash, ориентированную на программирование, сложные многошаговые задачи и автоматизацию рабочих процессов. Предыдущая версия, Gemini 3.6 Flash, вышла 21 июля, то есть между релизами прошло всего 23 дня.
Qwen3.8 Max вышла: выше Claude Fable 5 в агентном индексе при цене $6 за миллион токенов
Финальная модель Alibaba получила миллион токенов контекста, независимые оценки и очень серьёзную цену. Проверяем, что осталось от июльских обещаний и где всё ещё приходится ждать.

