Kısa haber · 1 dk okuma
Swift 1.5, RTX 3090’da benchmark görevlerini daha kısa sürede tamamlıyor
Bir Reddit kullanıcısı, değiştirilmiş Swift 1.5 modelinin tek bir RTX 3090’da benchmark görevlerini HyperQwen’in temel kurulumuna kıyasla yaklaşık %37 daha hızlı tamamladığını bildiriyor. Sonuçlarda kalite testleri arasında küçük farklılıklar da görülüyor.
Oossa · Oossa Hakkında
Bir Reddit kullanıcısının aktardığına göre HyperQwen için uyarlanan Swift 1.5 modeli, görev başına ortalama 68,2 saniyede sonuç verdi. HyperQwen’in hızlı nicemlenmiş Qwen modeli ise görev başına 108,1 saniye sürdü. Testler, 150.000 tokenlık bağlam yapılandırmasıyla 24 GB belleğe sahip tek bir RTX 3090’da yapıldı.
Gönderiyi paylaşan kullanıcı, çözümleme hızı biraz daha düşük olmasına rağmen değiştirilmiş modelin daha az token ürettiği için genel olarak daha hızlı olduğunu söylüyor. Paylaşılan çeşitli testlerde puanlar birbirine yakındı ancak aynı değildi. Örneğin INT4 çıkış katmanlarına sahip Swift 1.5, 100 soruluk kodlama testinde %91 puan alırken HyperQwen %89’da kaldı.
Neden önemli
Gönderiyi paylaşan kullanıcının sonuçları başka testlerde de doğrulanırsa, model ayarlarının tüketici donanımında yerel yapay zekâ görevleri için gereken süreyi ve token miktarını azaltabileceğine işaret ediyor.
Kaynaklar ve referanslar
| # | Kaynak | Yayın | Tarih | Ana fikir |
|---|---|---|---|---|
| 1 | Swift 1.5 + HyperQwen = 37% less task completion time at 100+ tps w/ 150k context on RTX 3090 ↗ | Reddit r/LocalLLaMA | 28 Eyl 2026 | Hi everyone :) The amazing Swift finetunes of Qwen3.8 27B generate much fewer tokens at mostly similar benchmark performance to the original |
1 kaynak
Son güncelleme:
Oossa · Bülten
Yapay zekâda hafta, anlaşılır dille
Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.