Nota · 1 min de leitura
Cinco placas de mineração usadas executam o Qwen3-Coder-Next a 40 tokens por segundo
Um usuário do Reddit afirma que um conjunto de cinco placas BC-250 gera respostas com o Qwen3-Coder-Next a 40 tokens por segundo. A configuração teria custado menos de US$ 800, mas consome energia de forma ineficiente.
Oossa · Sobre a Oossa
Um usuário do Reddit, no fórum LocalLLaMA, reuniu cinco placas BC-250 usadas para executar o Qwen3-Coder-Next, um modelo de IA para programação. Segundo ele, o conjunto atinge cerca de 40 tokens por segundo com uma janela de contexto de 30.000 tokens, caindo para aproximadamente 30 tokens por segundo com 100.000 tokens.
As placas compartilham cerca de 71 GB de memória de vídeo e se comunicam pela conexão Ethernet integrada de 1 gigabit. O responsável pela montagem diz que a configuração custou menos de US$ 800, mas ressalta que ela é “muito ineficiente” no consumo de energia; ele talvez acrescente mais duas placas para testar outro modelo.
Por que importa
A montagem mostra como equipamentos de mineração usados podem ser reaproveitados para rodar IA localmente, embora o consumo de energia possa limitar sua viabilidade.
Fontes e referências
| # | Fonte | Veículo | Data | Ponto principal |
|---|---|---|---|---|
| 1 | I’m calling this the Monstrosity. 5 ex mining BC-250 boards Qwen3-Coder-Next Q4 at 40 tok/s ↗ | Reddit r/LocalLLaMA | 28 de set. de 2026 | Using an asrock 12 unit case running one board as the main with the rest of them headless. |
1 fontes
Última atualização:
Oossa · Newsletter
A semana em IA, explicada
Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.