# Cinque schede usate per il mining eseguono Qwen3-Coder-Next a 40 token al secondo

> Un utente di Reddit afferma che un cluster di cinque schede BC-250 genera Qwen3-Coder-Next a 40 token al secondo. La configurazione sarebbe costata meno di 800 dollari, ma consuma energia in modo inefficiente.

Oossa · 2026-09-29 · https://oossa.com/it/five-used-mining-boards-run-qwen3-coder-next-at-40-tokens-per-second

Un utente di Reddit della community LocalLLaMA ha collegato cinque schede BC-250 usate per il mining per eseguire Qwen3-Coder-Next, un modello di intelligenza artificiale per la scrittura di codice. Riferisce una velocità di circa 40 token al secondo con una finestra di contesto di 30.000 token, che scende a circa 30 token al secondo con 100.000 token.

Le schede condividono circa 71 GB di memoria video e comunicano tramite la porta Ethernet integrata da 1 gigabit. L'autore della configurazione afferma di aver speso meno di 800 dollari, ma sottolinea che il sistema è «estremamente inefficiente» dal punto di vista dei consumi; potrebbe aggiungere altre due schede per provare un altro modello.

## I fatti

- Secondo quanto riferito, il cluster di cinque schede raggiunge 40 token al secondo con una finestra di contesto di 30.000 token.
- L'autore afferma che la configurazione è costata meno di 800 dollari e dispone di circa 71 GB di memoria video.

## Perché conta

Questa configurazione mostra come si possa riutilizzare hardware usato per il mining per eseguire localmente modelli di intelligenza artificiale, anche se i consumi potrebbero limitarne la praticità.

## Fonti e riferimenti

1. [I’m calling this the Monstrosity. 5 ex mining BC-250 boards Qwen3-Coder-Next Q4 at 40 tok/s](https://www.reddit.com/r/LocalLLaMA/comments/1ws49si/im_calling_this_the_monstrosity_5_ex_mining_bc250/) – Reddit r/LocalLLaMA, 2026-09-28

Ultimo aggiornamento: 2026-09-29
