OossaИИ быстро развивается. Мы объясняем это просто.
Рассылка

Заметка · 1 мин чтения

Swift 1.5 сокращает время выполнения тестовых заданий на RTX 3090

По словам пользователя Reddit, модифицированная модель Swift 1.5 выполнила тестовые задания примерно на 37% быстрее базовой конфигурации HyperQwen на одной RTX 3090. При этом в тестах качества результаты немного различались.

Oossa · О проекте Oossa

Пользователь Reddit утверждает, что адаптированная для HyperQwen модель Swift 1.5 в среднем выполняла задание за 68,2 секунды против 108,1 секунды у быстро квантованной модели Qwen в составе HyperQwen. Тесты проводились на одной RTX 3090 с 24 ГБ памяти и настроенным контекстом на 150 000 токенов.

По словам автора публикации, модифицированная модель в целом работала быстрее, поскольку генерировала меньше токенов, несмотря на немного более низкую скорость декодирования. В нескольких приведённых тестах результаты были близкими, но не идентичными: например, Swift 1.5 с выходными слоями INT4 набрала 91% в тесте на программирование из 100 задач, тогда как HyperQwen — 89%.

Почему это важно

Если результаты автора публикации подтвердятся в других тестах, они покажут, что настройка модели может сократить время выполнения локальных задач ИИ и снизить расход токенов на потребительском оборудовании.

Эта статья была полезной?

Источники и ссылки

#ИсточникИзданиеДатаГлавное
1Swift 1.5 + HyperQwen = 37% less task completion time at 100+ tps w/ 150k context on RTX 3090 ↗Reddit r/LocalLLaMA28 сент. 2026 г.Hi everyone :) The amazing Swift finetunes of Qwen3.8 27B generate much fewer tokens at mostly similar benchmark performance to the original

1 источников

Обновлено:

Oossallms.txt.md

Поделиться

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.

Swift 1.5 сокращает время выполнения тестовых заданий на RTX 3090 – Oossa