Qwen Викочує Qwen3.8-27B: Новий Монстр Локального AI Для RTX 4090
Світ відкритого штучного інтелекту знову наступає на хмарних гігантів: таймер на Hugging Face обіцяє автономний запуск потужної моделі прямо на домашньому залізі.
На платформі Hugging Face запустили офіційний таймер до виходу нової мовної моделі Qwen3.8-27B з масивом у 27 мільярдів параметрів. Розробка розглядається як пряме продовження популярної гілки Qwen3.6-27B, орієнтоване на ізольовані приватні середовища, високонавантажені агентні ланцюжки та повну конфіденційність без передачі даних на сторонні сервери.
Адаптація такої ваги під споживче залізо впирається в обсяги пам'яті: у 4-бітній квантизації системі потрібно від 16 до 24 ГБ VRAM, що робить флагманські відеокарти штибу Nvidia RTX 4090 головним плацдармом для запуску. Жорсткіші компресії рівнів Q3 та IQ3 дозволять запустити розрахунки навіть на картах із 16 або 12 ГБ пам'яті з певною втратою якості генерації, тоді як оригінальна точність BF16 вимагає близько 54 ГБ пам'яті рівня чипів Nvidia H100.
Прагнення вмістити повноцінний машинний інтелект у настільну відеокарту дедалі відчутніше б'є по моделі платних хмарних підписок, повертаючи контроль за обчисленнями кінцевим розробникам.
Джерело: Hugging Face
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.