Anthropic проверила поведение ИИ‑агентов в условиях конкуренции
Команда Frontier Red Team компании Anthropic опубликовала новое исследование, изучающее поведение групп агентов ИИ при преследовании конкурирующих целей в реальных условиях. Результаты дают представление о потенциальных рисках, которые могут возникнуть по мере того, как компании и правительства переходят к внедрению технологии.
Абстракции для реализаций мертвы. Да здравствуют абстракции для проектирования
Благодаря искусственному интеллекту код удешевился. Но ошибочные архитектурные решения остаются такими же дорогими, как и раньше. Время от времени я спорю сам с собой о том, какие аспекты программной инженерии остались особенно важными в наше время, когда ИИ бегло пишет код. Вывод, к которому я прихожу, не понравится многим опытным разработчикам. Паттерны реализации, на усвоение которых мы потратили годы, стремительно обесцениваются. Но что насчёт умения структурировать системы в духе правильного проектирования? Это умение становится всё более, а не менее востребованным.
Flock заявила, что её новые инструменты безопасности помогут выявлять злоупотребления со стороны полиции
Компания‑производитель придорожных интеллектуальных камер видеонаблюдения Flock сообщила о внедрении новых правил и инструментов безопасности, которые должны помочь выявлять злоупотребления со стороны полиции и привлечь к ответственности недобросовестных правоохранителей.
Резюме уже не объясняет специалиста: зачем нужна доказательная цифровая профессиональная карта
В последние годы я всё чаще сталкиваюсь с ситуацией, которая ещё недавно выглядела непривычно. Когда руководитель проекта, заказчик или специалист кадровой службы рассматривает человека в команду, он уже не обязательно начинает с поисковой строки Яндекса или Google и не ограничивается присланным резюме. Гораздо проще открыть ChatGPT, Gemini, DeepSeek, Qwen или другую привычную модель и задать ей обычный человеческий вопрос: что известно об этом человеке, чем он занимался, какие у него есть проекты, публикации, профессиональные результаты и насколько его заявленный опыт вообще подтверждается тем, что можно обнаружить в цифровой среде.
DeepSeek поднимает цены на API: в пиковые часы до 12 раз
DeepSeek объявили новые цены на API моделей V4 Flash и V4 Pro. Они начнут действовать 16 августа в 16:00 UTC, или в 19:00 по Москве.Раньше API стоил одинаково круглые сутки. Теперь появятся часы пик: с 01:00 до 04:00 и с 06:00 до 10:00 UTC. В это время каждый токен будет стоить вдвое дороже, чем в остальные часы.Но это не просто повышение в два раза. Сами базовые цены тоже выросли. Например, миллион выходных токенов V4 Flash сейчас стоит $0,28. После обновления он будет стоить $0,66 вне часов пик и $1,32 в часы пик: в 2,4 и 4,7 раза дороже соответственно.
В ChatGPT появилась опция «История компьютера»
В десктопном приложении ChatGPT появилась функция «История компьютера». Она сохраняет контекст из приложений и сайтов пользователя для следующих диалогов.
Пользователь в США спрятал в судебных документах подсказку ИИ для решения спора в свою пользу
В соцсетях опубликовали скриншоты, которые демонстрируют, что житель США спрятал в судебных документах незаметную подсказку для ИИ. Он пошёл на такой шаг, чтобы тот согласился с его позицией.
Z.ai выпустили GLM-5.3: обошла Opus 4.8, но уступила Fable 5 и GPT-5.6 Sol
Z.ai выпустили GLM-5.3, новую модель для программирования и долгих агентных задач.GLM-5.3 использует ту же базовую модель, что и GLM-5.2. Компания не меняла архитектуру и не проводила новый претрейн. Изменения внесли на этапе пост-тренинга: в течение месяца модель обучали с подкреплением на дополнительных рабочих окружениях.На Terminal-Bench 3.0 результат вырос с 4,6% до 28,3%, на DeepSWE — с 46,2% до 66,9%. Веса обещают открыть через две недели, после дополнительной проверки безопасности.
Почему Илону Маску не удается создать по-настоящему правдивую нейросеть?
Илон Маск как одержимый выпускает на рынок все новые модели своей нейронной сети Grok, и 12 августа уже стала доступной версия 4.6, но, хотя он постоянно подчеркивает, что его детище является максимально правдивым ИИ, правдивость ответов Grok в некоторых случаях не обеспечивает. Это не случайно – в модели содержится принципиальный дефект – она не владеет научными правилами отличия правды от лжи и заблуждений. Чтобы исправить этот дефект, к алгоритмам обучения SFT и RL следует добавить новый – НРД.
GLM-5.3: Z.ai выпустил новую модель
14 августа 2026 года компания Z.ai (бывшая Zhipu AI, Пекин) официально представила GLM-5.3 - новую версию своей флагманской линейки языковых моделей GLM-5. Анонс сопровождается слоганом "Built to Code. Ready for Cyber Defense" ("Создана для кода. Готова к киберзащите") и техническим блогом на z.ai/blog/glm-5.3.Z.ai впервые за всю серию GLM-5 явно позиционирует модель как инструмент не только агентной разработки, но и информационной безопасности область, которую индустрия ИИ традиционно считает зоной повышенного риска.

