# Пять подержанных майнинговых плат запускают Qwen3-Coder-Next со скоростью 40 токенов в секунду

> Пользователь Reddit утверждает, что кластер из пяти плат BC-250 генерирует текст с помощью Qwen3-Coder-Next со скоростью 40 токенов в секунду. По его словам, сборка обошлась менее чем в $800, но расходует электроэнергию неэффективно.

Oossa · 2026-09-29 · https://oossa.com/ru/five-used-mining-boards-run-qwen3-coder-next-at-40-tokens-per-second

Пользователь Reddit из сообщества LocalLLaMA объединил пять подержанных майнинговых плат BC-250, чтобы запускать Qwen3-Coder-Next — модель искусственного интеллекта для написания кода. По его словам, скорость составляет около 40 токенов в секунду при контексте в 30 000 токенов и падает примерно до 30 токенов в секунду при контексте в 100 000 токенов.

У плат в общей сложности около 71 ГБ видеопамяти, а обмениваются они данными через встроенный гигабитный Ethernet. Автор сборки говорит, что она обошлась менее чем в $800, но отмечает, что система «крайне неэффективно» расходует электроэнергию; возможно, он добавит ещё две платы, чтобы протестировать другую модель.

## Факты

- По словам автора, кластер из пяти плат выдаёт 40 токенов в секунду при контексте в 30 000 токенов.
- Автор сборки утверждает, что она обошлась менее чем в $800 и располагает примерно 71 ГБ видеопамяти.

## Почему это важно

Эта сборка показывает, как подержанное майнинговое оборудование можно приспособить для локального запуска ИИ, хотя высокий расход электроэнергии может ограничить её практическую пользу.

## Источники и ссылки

1. [I’m calling this the Monstrosity. 5 ex mining BC-250 boards Qwen3-Coder-Next Q4 at 40 tok/s](https://www.reddit.com/r/LocalLLaMA/comments/1ws49si/im_calling_this_the_monstrosity_5_ex_mining_bc250/) – Reddit r/LocalLLaMA, 2026-09-28

Обновлено: 2026-09-29
