Cerebras ускорила 1 трлн модель kimi K2.6 до тысяча т-sec
Недавно компания производитель чипов Cerebras добавила топовую открытую трилионную модель Kimi k2.6, на свою платформу.
Сейчас не интересны технологии, обсуждается только ИИ
В своей прошлой статье: https://habr.com/ru/articles/1038584/, я описал примеры из реальной работы, когда ИИ-инструменты повышают продуктивность разработчика и помогают командам быстрее закрывать таски.
От папки с созвонами до 5K+ юзеров: как pet-проект «для себя» встретился с реальными пользователями
Сразу дисклеймер: в этой статье я ничего не продаю. GolosHub — мой бесплатный pet-проект без тарифов, подписок и коммерческого интереса. Это история не про “посмотрите на мой SaaS и дайте денег”, а про то, как моя личная боль с созвонами постепенно превратилась в платформу для работы с голосовой информацией для нескольких тысяч пользователей.1. Розы гибнут на газонах, а менеджеры на созвонахЗдравствуйте, меня зовут Александр, мне 29 лет и я алкоголик работаю продактом в бигтехе.
Opus 4.8 появился в выборе моделей Claude Code в десктопном приложении
Высокая вероятность, что Sonnet 4.8 выйдет сегодня - после нескольких месяцев ожидания с момента, когда модель впервые засветилась в утечке исходников Claude Code.Sonnet 4.6 уже в основном отошёл на второй план: большую часть реальных задач по коду и reasoning сейчас забрали Opus 4.7 и GPT-5.5.Sonnet 4.8, судя по всему, позиционируют как новую рабочую лошадку - особенно для повседневного кодинга и агентных сценариев.Утечки уже указывали на более сильный coding, заметно лучшее следование инструкциям, улучшенные vision-возможности и более чистые completion с первого прохода.
Локализовать нельзя ошибиться. Как работает локализация в автономном транспорте и почему это — самая сложная задача. 1-2
Представьте, что вы находитесь за рулем автомобиля. Даже находясь на пустой дороге, в отсутствии других участников дорожного движения, вам необходимо постоянно "подруливать", чтобы удержаться в полосе, притормаживать или останавливаться перед перекрестками и, наконец, поворачивать, останавливаться и парковаться. А теперь представьте, что все тоже самое вам необходимо делать с закрытыми глазами — примерно также "ощущает" себя автономный автомобиль без системы локализации.Всем привет! На связи вновь команда разработки ЭвоКарго, а именно — команда локализации и картирования. Ранее
Inside AI Meetup — как это было? Делимся записями докладов, фото и атмосферой
Привет! 20 мая прошел Inside AI Meetup от Wildberries & Russ — про практические кейсы внедрения ИИ: векторный поиск и модерация с 200+ моделями, AIOps для ML/GenAI-сервисов, RAG без галлюцинаций, запуск LLM-продуктов, генерация текстов из видео, поиск и рекомендации. В программе были кейсы от опыт Wildberries & Russ, MWS, Avito, VK, M2, МФТИ, Сбера, red_mad_robot и Альфа-Банка, а еще новые знакомства и полезный нетворкинг. В статье вы найдете видеозаписи с ивента и фото.Доклад «О применении AI в Wildberries & Russ» — Павел Раваев, CDO Wildberries & Russ
Gemini-3.5-flash догнал GPT-5.5 на 97-S и в 2.5× дешевле. Но главное — китайцы выигрывают по цене и качеству
Главная новость месяца — китайцы перестали быть «дешёвой альтернативой» и стали реальным конкурентом США по соотношению цена/качество. По чистому качеству американцы пока впереди, но по соотношению цена/качество (которое учитывает оба фактора) лидируют китайские модели. Это сдвиг рынка, а не «ещё один релиз».Gemini-3.5-flash догнал OpenAI — 97/S, тот же балл, что у GPT-5.5, при этом в 2.5 раза дешевле ($0.09 против $0.23 за вызов). Google впервые на нашем тесте берёт ту же вершину, что OpenAI на длинном русском контенте.DeepSeek V4 Flash
В каталоге готовых моделей Selectel появились модели для распознавания речи
Мы расширили наш Foundation Models Catalog
Анатомия Claude Code. Первичный анализ и наполнение контекста
Каждый, кто программирует с агентами (Claude Code, Codex и т.д.), знает: перед тем как приступить к задаче, агент исследует проект. Это кажется логичным, естественным и закономерным, ведь люди делают так же. Обычно говорят: «агент наполняет контекст».Для агента такой контекст должен содержать не только полезные сведения, но и не включать лишних, которые могут оказать влияние на конечный результат. Но добиться этого не так-то просто, поскольку:задача определена в общем виде (кто знает, что имел в виду автор)пути исследования не детерминированы (в общем виде не используется специфика фреймворка)

