- BrainTools - https://www.braintools.ru -
По информации с https://huggingface.co/Qwen/Qwen3.8-27B [1] Qwen3.8-27B, которая считается преемницей популярной Qwen3.6-27B, будет выпущена через сутки и как ожидается должна стать самым мощным открытым решением для локальной генерации
О модели Qwen3.8-27B это модель с примерно 27 миллиардами параметров, созданная для локального запуска на одном GPU. Она рассматривается как прямой преемник очень популярной модели Qwen3.6-27B и ориентирована на использование в частных средах, для высоконагруженных агентных систем и там где важна конфиденциальность данных.
Требования к железу Оценки основаны на проекциях для 27B-моделей, и точные цифры станут известны после релиза. Однако ожидается, что в 4-битной квантизации модель займет примерно 16-24 ГБ видеопамяти, что делает ее идеальной для карт на 24 ГБ (например, RTX 4090). Разные уровни квантизации позволят запускать модель даже на картах с 16 ГБ (Q3) или 12 ГБ (IQ3), но ценой качества. Для полной точности (BF16) потребуется около 54 ГБ, что соответствует уровню карт H100
Автор: iximy
Источник [2]
Сайт-источник BrainTools: https://www.braintools.ru
Путь до страницы источника: https://www.braintools.ru/article/34380
URLs in this post:
[1] https://huggingface.co/Qwen/Qwen3.8-27B: https://huggingface.co/Qwen/Qwen3.8-27B
[2] Источник: https://habr.com/ru/news/1070220/?utm_source=habrahabr&utm_medium=rss&utm_campaign=1070220
Нажмите здесь для печати.