«Я Сетунь 70». Эмулятор троичного компьютера на Rust
Слышали о семействе советских троичных ЭВМ «Сетунь»? А в политехническом музее бывали, машины видели? Нет? Да? Тогда вот вам эмулятор «Сетуни 70», чтобы посмотреть что к чему, разобраться и написать для нее свою программу.Введение
Google ставит б-у плашки DDR4 в новые AI-серверы
Удорожание и дефицит полупроводниковой памяти внесли серьезные коррективы в архитектурное планирование крупнейших облачных провайдеров. На недавнем саммите Нихил Черян, старший директор по инфраструктуре цепочек поставок Google,
Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток-сек на двух RTX 3090
Плотная 27B-модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по 24 ГБ и 936 ГБ/с каждая не должны выдавать столько, сколько выдаёт одна. Значит, где-то узкое горлышко, и надо разобраться, что и где подкрутить. Оказалось, что горлышек несколько, и все они снимаются флагами запуска: те же веса — 75 токенов в секунду. Ниже каждый флаг описан одинаково: зачем, что писать, что даёт, где ломается. В конце — готовый docker run.Стенд: 2× RTX 3090 (24 ГБ, PCIe 4.0 x16, без NVLink), Threadripper 3960X, 121 ГБ RAM, Ubuntu 26.04, драйвер 595.71.05. llama.cpp — образ ghcr.io/ggml-org/llama.cpp:full-cuda
Cerebras CS-4, CS-5 и CS-6: вычислительные стойки нового поколения
Cerebras Systems на конференции Hot Chips 2026 поделились планами на новые платформы CS-5 и CS-6. Основное внимание уделили
Продление закона Мура — переход на атомные размеры и 3D-архитектуру
Закон Мура — это удвоение числа транзисторов на микросхеме каждые 24 месяца, что означает геометрический рост плотности чипов и пропорциональный рост производительности.На Хабре неоднократно обсуждалось прекращение действия закона Мура (
753B на одной видеокарте: разбор FreeToken
Чувак из Калифорнии вряд ли запускает это все на таком ноутбуке

