cpu.

cpu.

Векторный поиск: деплой без GPU на Triton Inference Server

Перед каждым ML-разработчиком, после обучения прекрасной модели, которая поднимет бизнесу метрики, а тебе годовую премию, возникает вопрос: а как ее задеплоить в сервисе, чтоб она начала работать?А ты пошел отдыхать.

продолжить чтение

Нода загружена на 40%, а поды стоят: как найти причину через PSI в Kubernetes

Привет, Хабр!Управление ресурсами в Kubernetes десять лет держалось на двух числах в манифесте. Request определял, куда планировщик поставит под и сколько ему достанется при драке за процессор. Limit ограничивал сверху. Оба числа выставлялись один раз, менялись только пересозданием пода, а проверить их правильность было нечем, кроме графиков утилизации.

продолжить чтение

AMD повысит цены на продукцию на 10% в четвёртом квартале

AMD заявила партнёрам, что планирует повысить цены примерно на 10% на некоторые CPU в четвёртом квартале 2026 года. На такой шаг компания идёт из‑за увеличения производственных расходов тайваньской TSMC, которая выпускает для неё CPU и GPU.

продолжить чтение

Новинки серверного железа в июле: новые процессоры AMD EPYC 9006 Venice и тотальное жидкостное охлаждение

продолжить чтение

Голосовой ввод в любое окно Windows за секунду. Офлайн, на CPU, без единого гигабайта torch

Существующие решения для диктовки текста меня не устраивали по одной и той же причине: голос уходит на чужой сервер, а за это ещё и просят подписку. Wispr Flow, Blabby, встроенный Win+H — всё либо в облаке, либо работает так, что проще напечатать.Хотелось простого: нажал хоткей, сказал, нажал ещё раз — текст появился в том поле, где стоял курсор. Хоть в браузере, хоть в IDE, хоть в мессенджере. Локально. Бесплатно. Без прав администратора.Получился WhisperType — MIT, Windows 10/11 x64, ~250 МБ после установки плюс 1.6 ГБ модели. Актуальная версия — 1.3.1

продолжить чтение

AMD разделит серверные процессоры Zen 7 на три семейства и сделает ставку на ИИ‑агентов

продолжить чтение

Что показала AMD на Advancing AI 2026: главное о следующих процессорах EPYC Venice Zen6

На конференции Advancing AI 2026 AMD представила шестое поколение серверных процессоров EPYC 9006 (Venice). Новая линейка построена на архитектуре Zen 6, выпускается по 2-нм техпроцессу TSMC и включает процессоры с числом ядер до 256. Кроме роста производительности, AMD сделала ставку на специализацию: новые CPU разделены на несколько семейств для облачной инфраструктуры, HPC и систем искусственного интеллекта.Разбираемся, что именно представила компания, чем новые EPYC отличаются от предыдущего поколения и какие процессоры войдут в новую линейку.EPYC Venice — новое поколение серверных процессоров AMDНа

продолжить чтение

Анонс AMD EPYC 6-го поколения: чем 2-нанометровый Venice превосходит Intel Xeon 6+

На конференции AMD Advancing AI 2026 представлены новые процессоры AMD EPYC™ 6-го поколения.

продолжить чтение

Как мы вынесли семантический поиск на обычный сервер без видеокарты, облака и выделенной поисковой системы

Когда мы занялись поисковым слоем AI-ассистента в «Первой Форме», договорились на входе: языковую модель, которая отвечает пользователю, не трогаем. Вся эта история — о том, что происходит на шаг раньше: как система решает, что именно показать модели, прежде чем та начнёт отвечать.Планку себе поставили простую на словах и сложную на деле: семантический поиск промышленного уровня, но без специализированной инфраструктуры, целиком внутри изолированной сети, на том же оборудовании, что и само приложение.

продолжить чтение

Тесты бюджетных сборок для ИИ до 100к рублей

GPU для локального ИИ достаточно дорогие, и мне стало интересно: а есть ли жизнеспособный инференс на CPU? А что будет если добавить дешевую видеокарту для майнинга или Tesla V100 16gb? Что можно выжать из максимально бюджетных решений для локального ИИ?Я собрал бюджетную сборку в разных вариациях (2 материнские платы и 2 видеокарты) прогнал тесты некоторых известных моделей LLM и построил графики чтобы можно было сделать выводы.Объем статьи достаточно большой, поэтому для простоты восприятия оформил 15-ти минутное видео на youtube.Навигация по тексту:Стенд

продолжить чтение

123