# Vijf gebruikte miningborden draaien Qwen3-Coder-Next met 40 tokens per seconde

> Een Reddit-gebruiker zegt dat een cluster van vijf BC-250-borden Qwen3-Coder-Next genereert met 40 tokens per seconde. De opstelling kostte naar verluidt minder dan $800, maar verbruikt stroom inefficiënt.

Oossa · 2026-09-29 · https://oossa.com/nl/five-used-mining-boards-run-qwen3-coder-next-at-40-tokens-per-second

Een Reddit-gebruiker van LocalLLaMA heeft vijf gebruikte BC-250-miningborden samengevoegd om Qwen3-Coder-Next te draaien, een AI-model voor het schrijven van code. De gebruiker meldt ongeveer 40 tokens per seconde bij een context van 30.000 tokens. Bij 100.000 tokens zakt de snelheid naar ongeveer 30 tokens per seconde.

De borden delen ongeveer 71 GB videogeheugen en communiceren via hun ingebouwde gigabit-Ethernet. Volgens de bouwer kostte de opstelling minder dan $800, al is die “extreem inefficiënt” qua stroomverbruik. Mogelijk voegen ze nog twee borden toe om een ander model te testen.

## De feiten

- Het cluster met vijf borden haalt naar verluidt 40 tokens per seconde bij een context van 30.000 tokens.
- Volgens de bouwer kostte de opstelling minder dan $800 en beschikt die over ongeveer 71 GB videogeheugen.

## Waarom het ertoe doet

Deze opstelling laat zien hoe gebruikte mininghardware opnieuw kan worden ingezet voor lokale AI, al kan het stroomverbruik de praktische bruikbaarheid beperken.

## Bronnen en referenties

1. [I’m calling this the Monstrosity. 5 ex mining BC-250 boards Qwen3-Coder-Next Q4 at 40 tok/s](https://www.reddit.com/r/LocalLLaMA/comments/1ws49si/im_calling_this_the_monstrosity_5_ex_mining_bc250/) – Reddit r/LocalLLaMA, 2026-09-28

Laatst bijgewerkt: 2026-09-29
