Как запустить LLM на 2,8 трлн параметров на ноутбуке
Всем привет, меня зовут Сергей Прощаев, и в этой статье расскажу про то, как летом 2026 года большие языковые модели научились запускаться на железе, которое стоит под столом, а не в дата‑центре, и что из этого может забрать себе обычный backend‑инженер.Я Tech Lead и руководитель направления Java | Kotlin разработки в FinTech & E‑commerce и преподаю на курсах разработки и архитектуры в ОТУС.
Память агента без вектор-БД: 363 markdown-файла вместо эмбеддингов
У меня восемь агентов с постоянной памятью, и на всех вместе больше 360 файлов, около 1,4 МБ текста. Векторной базы нет ни одной: эмбеддинги я не считаю вообще.И это не “руки не дошли”. Схема работает с мая 2026 года: сначала на одном агенте, с июня централизованно на всех восьми. За это время вопрос про вектор-БД я поднимал трижды, каждый раз с конкретным кандидатом на внедрение, и каждый раз закрывал его отказом. Ниже разберу, как это устроено, какими числами живет и в какой момент перестанет работать.Рефлекс, от которого я отказался
Nvidia инвестирует $105 млрд в дата‑центр OpenAI в штате Огайо
Nvidia согласилась предоставить гарантию на сумму до $105 млрд, чтобы помочь OpenAI арендовать обширный центр обработки данных, который построит SB Energy в американском штате Огайо. Также Nvidia вложит $1,5 млрд в SB Energy.
В Малайзии разрабатывают охлаждающую жидкость на основе пальмового масла для иммерсионных систем
Государственное агентство Малайзии MPOB (Malaysian Palm Oil Board) находится на завершающем этапе разработки охлаждающей жидкости на основе пальмового масла под названием Sawit EcoTherm для иммерсионных систем охлаждения. В ведомстве считают, что использование этой жидкости позволит снизить потребление воды и энергии в центрах обработки данных страны.
В ChatGPT появилась опция «История компьютера»
В десктопном приложении ChatGPT появилась функция «История компьютера». Она сохраняет контекст из приложений и сайтов пользователя для следующих диалогов.
AI-хакатон в GlowByte: как мы решали задачи для вымышленной розничной сети «МегаБайт»
Всем привет! На связи команда BI-практики GlowByte.
Загрузил не тот файл в нейросеть — уволен. Как устроена безопасность данных в ИИ
Договор с клиентом, фрагмент кода, медицинская карта — отважные пользователи нейросетей каждый день загружают данные, которые никогда бы не отправили незнакомому человеку. При этом мало кто понимает, куда физически они попадают, кто может их увидеть и использовать, что происходит после нажатия «удалить».
Data‑инфраструктура только 20% компаний КИИ полностью готова к требованиям закона об ИИ
По оценке К2Тех, не более 20% субъектов КИИ обладают достаточной зрелостью data‑инфраструктуры, управления и работы с данными для выполнения требований нового закона в сфере ИИ. Более чем половине (55%) нужна доработка существующих систем и подходов, а 25% потребуется их значительная трансформация. Исследование проводилось К2Тех методом анализа более 80 проведенных предпроектных обследований и аудитов, а также опроса 150 респондентов из компаний‑субъектов КИИ.

