Современные разработки в области больших языковых моделей продолжают удивлять возможностями локального запуска на персональных компьютерах. Новый проект Strata с GitHub представил модель Qwen3.8-Flash-Next, обладающую 125 миллиардами параметров, которая способна эффективно работать на игровых ПК с относительно скромными ресурсами.
Данная модель не требует мощных серверов или облачных вычислений: по информации из журнала «Код», для её работы достаточно видеопамяти размером 12 ГБ VRAM и оперативной памяти 32 ГБ RAM. Такой минимальный порог системных требований открывает новые возможности для специалистов и энтузиастов, которые хотят использовать продвинутые нейросети на собственных машинах без зависимости от интернет-соединения и удалённых серверов.
Среди ключевых характеристик Qwen3.8-Flash-Next выделяется скорость обработки запросов — до 94 токенов в секунду. При этом все вычисления выполняются локально, что исключает необходимость отправки данных на удалённые серверы, значительно повышая конфиденциальность и снижая задержки.
Как отмечается в публикации, модель совместима с операционными системами Windows и Linux, что обеспечивает широкую доступность и гибкость внедрения в различных ИТ-средах. Это особенно важно для системных администраторов и разработчиков, ищущих способы интеграции продвинутых ИИ-моделей без серьёзных затрат на инфраструктуру.
Подробности о запуске и работе модели доступны по ссылке: https://v.thecode.media/6udbz.
Таким образом, проект Strata демонстрирует тенденцию к демократизации доступа к мощным языковым моделям, позволяя использовать их возможности на привычном игровом оборудовании. Это открывает новые перспективы для локального применения искусственного интеллекта в различных отраслях, снижая зависимость от облачных сервисов и повышая автономность пользователей.
Источник информации: vk.com/wall-179664673_166979
0 комментариев