Сегодня 31 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Alibaba выпустила открытую ИИ-модель Qwen3.8-27B, которая запускается локально на ПК

В начале августа китайская Alibaba представила обновлённую флагманскую модель искусственного интеллекта Qwen3.8-Max с 2,4 трлн параметров, из которых 95 млрд остаются активными. Эту модель, предназначенную для работы в облачной инфраструктуре, сначала можно было протестировать только в QwenCloud, но затем компания опубликовала её веса в открытом доступе для всех желающих. А вслед за ней выпустила Qwen3.8-27B размером 27 млрд параметров, и она подходит для запуска на мощном ПК.

 Источник изображений: alibabagroup.com

Источник изображений: alibabagroup.com

Alibaba зарекомендовала себя как лидер в области ИИ с открытыми весами, выступая не хуже стартапов DeepSeek и Moonshot. Одним из первых игроков на рынке открытого ИИ была американская Meta, которая на минувшей неделе выпустила модель Glimmer размером 30 млрд параметров, достаточно компактную для запуска на ПК. Alibaba напомнила гиганту соцсетей, что на этом рынке очень высокая конкуренция. Модель Qwen3.8-27B, утверждает разработчик, обладает «отличными возможностями» в работе с кодом, исследованиях и долгосрочных агентских задачах. Её заявленное качество ответов соответствует моделям, которые в десять раз крупнее по размеру. И это подтвердили опубликованные Alibaba тесты — Qwen3.8-27B проявила себя лучше, чем Meta Muse Glimmer 30B, и не хуже, а то и лучше, чем вышедшая в феврале закрытая Anthropic Opus 4.6.

Это утверждение взялись проверить журналисты ресурса Heise. Оригинальная модель с 32-битными числами с плавающей запятой (FP32) требует значительных ресурсов: не менее 108 Гбайт видеопамяти и около 120 Гбайт дискового пространства для KV-кеша. Квантование модели до FP16 позволяет запускать её на оборудовании с 64 Гбайт видеопамяти, а ещё более компактный квантованный вариант Q5_K_M обходится уже 22 Гбайт памяти — его уже можно запускать на флагманских видеокартах AMD Radeon 7900 XTX и Nvidia GeForce RTX 3090 (Ti), 4090 и 5090. Доступен и вариант с весами NVFP4, оптимизированный для вычислительных блоков Nvidia Blackwell и работающий всего с 16 Гбайт памяти.

В рамках тестирования Qwen3.8-27B в вариантах Q8_0 и NVFP4 запустили в среде Llama.cpp на профессиональной видеокарте Nvidia RTX Pro 6000 Blackwell. Модели поставили задачу разработать полный комплект средств REST API для системы управления запасами с контролем пользователей и авторизацией на основе ролей, не задавая уточняющих вопросов. Квантованная версия NVFP4, которая потребляла вдвое меньше памяти, чем Q8_0, не показала заметного снижения точности или качества ответов.

Qwen3.8-27B написала качественный код — он скомпилировался с первой попытки и поддерживал все запрошенные функции. Качество проекта оказалось неотличимо от результатов работы Anthropic Claude. Модель от Alibaba учла особые аспекты, которые не были упомянуты в задании, в ходе работы находила дубликаты в собственном коде и самостоятельно проводила рефакторинг. Отмечалась некоторая склонность к чрезмерному обдумыванию простых проблем, модель несколько зацикливалась на деталях, в результате чего тратила лишние токены и время. Хотя такое поведение корректируется в настройках.

Запускающиеся на локальных ресурсах модели ИИ имеют преимущества перед облачными. Нет необходимости оформлять подписку и передавать персональные данные сторонним поставщикам. Отсутствуют ограничения, свойственные закрытым моделям Anthropic и OpenAI. Некоторые ограничения есть и у Qwen, но вскоре после выпуска оригинального варианта на Hugging Face появились производные версии, в которых эти ограничения были в значительной степени сняты.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
В ранний доступ Steam ворвалась Breathedge 2 — приключенческая комедийная игра о выживании в космосе 29 мин.
OpenClaw обновился до версии 2.0 — запуск ИИ-агентов стал проще, а управлять ими теперь могут сразу несколько человек 2 ч.
Take-Two отчиталась о «бурном развитии» расследования по поиску виновника утечек GTA VI 5 ч.
ЕС поставил ChatGPT в один ряд с крупнейшими онлайн-платформами — ответственность OpenAI возрастёт 5 ч.
ИИ-направление принесло Cloud.ru более половины выручки в I полугодии 2026 года 6 ч.
Instagram объявила войну ИИ-аккаунтам, выдающим себя за реальных людей 6 ч.
Sony подтвердила сентябрьскую презентацию State of Play — покажут Final Fantasy VII Revelation и игры от PlayStation Studios 6 ч.
Windows 11 начала обманывать, что антивирус Defender отключён — на самом деле он работает 7 ч.
В российской серверной ОС SelectOS прописался ИИ-агент Aish 7 ч.
«Нам нужно адаптироваться»: оригинальная The Long Dark получит новые DLC, а Blackfrost: The Long Dark 2 скоро выйдет из тени 10 ч.
Nvidia заплатила $3,5 млрд за союз с MediaTek — вместе они бросают вызов фирменным ИИ-чипам Google и Amazon 2 ч.
Meta внедряет роботов в ЦОД для замены людей, но пока процесс идёт очень медленно 4 ч.
CXMT запустила пробное производство памяти HBM3E 4 ч.
В недрах Марса обнаружилась массивная «тепловая аномалия» — возможно, это результат древнего космического ДТП 5 ч.
Никому ни слова: операторы ЦОД в США всё чаще заключают тайные соглашения в властями, прикрываясь NDA 6 ч.
Российским операторам разрешили строить 5G на частотах LTE — сети скоро появятся в городах-миллионниках 7 ч.
TSMC намерена в 50 раз повысить производительность ИИ-систем — помогут 3D-чипы и кремниевая фотоника 7 ч.
G.Skill представила комплект Flare X5X DDR5-6000 с технологией разгона AMD EXPO ULL для систем на Ryzen 9 ч.
Очередная доставка астронавтов и космонавта на МКС задержится из-за технических проблем у корабля SpaceX Dragon 9 ч.
Поставщики облачных услуг в Бразилии возьмут на вооружение оптические диски Folio Photonics 10 ч.