# Fünf gebrauchte Mining-Boards bringen Qwen3-Coder-Next auf 40 Tokens pro Sekunde

> Ein Reddit-Nutzer sagt, ein Verbund aus fünf BC-250-Boards generiere Qwen3-Coder-Next mit 40 Tokens pro Sekunde. Der Aufbau habe Berichten zufolge weniger als 800 US-Dollar gekostet, verbrauche aber ineffizient Strom.

Oossa · 2026-09-29 · https://oossa.com/de/five-used-mining-boards-run-qwen3-coder-next-at-40-tokens-per-second

Ein Reddit-Nutzer aus dem Subreddit LocalLLaMA hat fünf gebrauchte BC-250-Mining-Boards zusammengeschlossen, um Qwen3-Coder-Next auszuführen, ein KI-Modell zum Schreiben von Code. Nach eigenen Angaben erreicht er bei einem Kontext von 30.000 Tokens etwa 40 Tokens pro Sekunde. Bei 100.000 Tokens sinke die Geschwindigkeit auf rund 30 Tokens pro Sekunde.

Die Boards verfügen zusammen über etwa 71 GB Videospeicher und kommunizieren über ihr integriertes Gigabit-Ethernet. Der Erbauer sagt, der Aufbau habe weniger als 800 US-Dollar gekostet, räumt aber ein, dass er „extrem ineffizient“ mit Strom umgehe. Möglicherweise ergänzt er das System um zwei weitere Boards, um ein anderes Modell zu testen.

## Die Fakten

- Der Verbund aus fünf Boards erreicht Berichten zufolge bei einem Kontext von 30.000 Tokens 40 Tokens pro Sekunde.
- Der Erbauer sagt, der Aufbau habe weniger als 800 US-Dollar gekostet und biete etwa 71 GB Videospeicher.

## Warum es wichtig ist

Der Aufbau zeigt, wie sich gebrauchte Mining-Hardware für lokale KI umfunktionieren lässt – der hohe Stromverbrauch könnte ihren praktischen Nutzen jedoch einschränken.

## Quellen und Referenzen

1. [I’m calling this the Monstrosity. 5 ex mining BC-250 boards Qwen3-Coder-Next Q4 at 40 tok/s](https://www.reddit.com/r/LocalLLaMA/comments/1ws49si/im_calling_this_the_monstrosity_5_ex_mining_bc250/) – Reddit r/LocalLLaMA, 2026-09-28

Zuletzt aktualisiert: 2026-09-29
