Kort bericht · 1 min lezen
Vijf gebruikte miningborden draaien Qwen3-Coder-Next met 40 tokens per seconde
Een Reddit-gebruiker zegt dat een cluster van vijf BC-250-borden Qwen3-Coder-Next genereert met 40 tokens per seconde. De opstelling kostte naar verluidt minder dan $800, maar verbruikt stroom inefficiënt.
Oossa · Over Oossa
Een Reddit-gebruiker van LocalLLaMA heeft vijf gebruikte BC-250-miningborden samengevoegd om Qwen3-Coder-Next te draaien, een AI-model voor het schrijven van code. De gebruiker meldt ongeveer 40 tokens per seconde bij een context van 30.000 tokens. Bij 100.000 tokens zakt de snelheid naar ongeveer 30 tokens per seconde.
De borden delen ongeveer 71 GB videogeheugen en communiceren via hun ingebouwde gigabit-Ethernet. Volgens de bouwer kostte de opstelling minder dan $800, al is die “extreem inefficiënt” qua stroomverbruik. Mogelijk voegen ze nog twee borden toe om een ander model te testen.
Waarom het ertoe doet
Deze opstelling laat zien hoe gebruikte mininghardware opnieuw kan worden ingezet voor lokale AI, al kan het stroomverbruik de praktische bruikbaarheid beperken.
Bronnen en referenties
| # | Bron | Medium | Datum | Kernpunt |
|---|---|---|---|---|
| 1 | I’m calling this the Monstrosity. 5 ex mining BC-250 boards Qwen3-Coder-Next Q4 at 40 tok/s ↗ | Reddit r/LocalLLaMA | 28 sep 2026 | Using an asrock 12 unit case running one board as the main with the rest of them headless. |
1 bronnen
Laatst bijgewerkt:
Oossa · Nieuwsbrief
De AI-week, uitgelegd
Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.