OossaL'IA evolve in fretta. Noi la spieghiamo in modo semplice.
Newsletter

Breve · 1 min di lettura

Cinque schede usate per il mining eseguono Qwen3-Coder-Next a 40 token al secondo

Un utente di Reddit afferma che un cluster di cinque schede BC-250 genera Qwen3-Coder-Next a 40 token al secondo. La configurazione sarebbe costata meno di 800 dollari, ma consuma energia in modo inefficiente.

Oossa · Informazioni su Oossa

Un utente di Reddit della community LocalLLaMA ha collegato cinque schede BC-250 usate per il mining per eseguire Qwen3-Coder-Next, un modello di intelligenza artificiale per la scrittura di codice. Riferisce una velocità di circa 40 token al secondo con una finestra di contesto di 30.000 token, che scende a circa 30 token al secondo con 100.000 token.

Le schede condividono circa 71 GB di memoria video e comunicano tramite la porta Ethernet integrata da 1 gigabit. L'autore della configurazione afferma di aver speso meno di 800 dollari, ma sottolinea che il sistema è «estremamente inefficiente» dal punto di vista dei consumi; potrebbe aggiungere altre due schede per provare un altro modello.

Perché conta

Questa configurazione mostra come si possa riutilizzare hardware usato per il mining per eseguire localmente modelli di intelligenza artificiale, anche se i consumi potrebbero limitarne la praticità.

Questo articolo ti è stato utile?

Fonti e riferimenti

#FonteTestataDataPunto chiave
1I’m calling this the Monstrosity. 5 ex mining BC-250 boards Qwen3-Coder-Next Q4 at 40 tok/s ↗Reddit r/LocalLLaMA28 set 2026Using an asrock 12 unit case running one board as the main with the rest of them headless.

1 fonti

Ultimo aggiornamento:

Oossallms.txt.md

Condividi

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.

Cinque schede usate per il mining eseguono Qwen3-Coder-Next a 40 token al secondo – Oossa