Breve · 1 min di lettura
Cinque schede usate per il mining eseguono Qwen3-Coder-Next a 40 token al secondo
Un utente di Reddit afferma che un cluster di cinque schede BC-250 genera Qwen3-Coder-Next a 40 token al secondo. La configurazione sarebbe costata meno di 800 dollari, ma consuma energia in modo inefficiente.
Oossa · Informazioni su Oossa
Un utente di Reddit della community LocalLLaMA ha collegato cinque schede BC-250 usate per il mining per eseguire Qwen3-Coder-Next, un modello di intelligenza artificiale per la scrittura di codice. Riferisce una velocità di circa 40 token al secondo con una finestra di contesto di 30.000 token, che scende a circa 30 token al secondo con 100.000 token.
Le schede condividono circa 71 GB di memoria video e comunicano tramite la porta Ethernet integrata da 1 gigabit. L'autore della configurazione afferma di aver speso meno di 800 dollari, ma sottolinea che il sistema è «estremamente inefficiente» dal punto di vista dei consumi; potrebbe aggiungere altre due schede per provare un altro modello.
Perché conta
Questa configurazione mostra come si possa riutilizzare hardware usato per il mining per eseguire localmente modelli di intelligenza artificiale, anche se i consumi potrebbero limitarne la praticità.
Fonti e riferimenti
| # | Fonte | Testata | Data | Punto chiave |
|---|---|---|---|---|
| 1 | I’m calling this the Monstrosity. 5 ex mining BC-250 boards Qwen3-Coder-Next Q4 at 40 tok/s ↗ | Reddit r/LocalLLaMA | 28 set 2026 | Using an asrock 12 unit case running one board as the main with the rest of them headless. |
1 fonti
Ultimo aggiornamento:
Oossa · Newsletter
La settimana dell'IA, spiegata
Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.