OossaAI ontwikkelt zich snel. Wij leggen het eenvoudig uit.
Nieuwsbrief

Kort bericht · 1 min lezen

Swift 1.5 voert benchmarktaken sneller uit op een RTX 3090

Een Reddit-gebruiker meldt dat een aangepast Swift 1.5-model benchmarktaken op één RTX 3090 ongeveer 37% sneller uitvoerde dan de basisconfiguratie van HyperQwen. De resultaten laten kleine verschillen zien in de kwaliteitstests.

Oossa · Over Oossa

Een Reddit-gebruiker zegt dat een voor HyperQwen aangepast Swift 1.5-model gemiddeld 68,2 seconden per taak nodig had, tegenover 108,1 seconden voor HyperQwens snel gekwantiseerde Qwen-model. De tests werden uitgevoerd op één RTX 3090 met 24 GB geheugen, met een ingestelde context van 150.000 tokens.

Volgens de poster was het aangepaste model over het geheel genomen sneller doordat het minder tokens genereerde, ondanks een iets lagere decodeersnelheid. De scores van verschillende gerapporteerde tests lagen dicht bij elkaar, maar waren niet identiek. Zo scoorde Swift 1.5 met INT4-outputlagen 91% op een programmeertest met 100 opgaven, tegenover 89% voor HyperQwen.

Waarom het ertoe doet

Als de resultaten van de poster ook in andere tests standhouden, wijzen ze erop dat het tunen van modellen de benodigde tijd en het aantal tokens voor lokale AI-taken op consumentenhardware kan verminderen.

Was dit artikel nuttig?

Bronnen en referenties

#BronMediumDatumKernpunt
1Swift 1.5 + HyperQwen = 37% less task completion time at 100+ tps w/ 150k context on RTX 3090 ↗Reddit r/LocalLLaMA28 sep 2026Hi everyone :) The amazing Swift finetunes of Qwen3.8 27B generate much fewer tokens at mostly similar benchmark performance to the original

1 bronnen

Laatst bijgewerkt:

Oossallms.txt.md

Delen

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.

Swift 1.5 voert benchmarktaken sneller uit op een RTX 3090 – Oossa