Modeller
Bugün
FBN ve Google AI Futures Fund çiftlikler için yapay zekâ geliştiriyor
Farmers Business Network ve Google AI Futures Fund, aile çiftliklerinin operasyonlarını yönetmesine yardımcı olmayı amaçlayan bir yapay zekâ platformu geliştirecek.
Replit Agent alt ajanlarını seçiyor, maliyeti düşürüyor
Replit’in yeni Agent’ı, görevleri ne zaman ve nasıl devredeceğine modelin karar vermesini sağlıyor; yazılım mühendisliği kıyaslamalarında önceki düzenekleri geride bırakıyor.
NVIDIA Kumo Tabular, üç boyutuyla Hugging Face’te
Hugging Face’te kullanıma sunulan açık temel model, Small, Medium ve Large sürümleriyle (28–215 milyon parametre) geliyor ve dört önemli kıyaslamada zirvede yer alıyor.
ElevenLabs, daha ucuz API fiyatlarıyla v4 ses modelini çıkardı
Yeni v4 ve v4 Turbo seslerinin 1.000 karakter başına fiyatı sırasıyla 0,08 ve 0,04 dolar. 12 Ekim’e kadar bu fiyatlar 0,022 ve 0,011 dolara düşüyor.
Everspin, SNIA 2026’da CXL bağlantılı ilk MRAM’i tanıttı
Bellek üreticisi, Compute Express Link üzerinden bağlanan yeni bir MRAM modülünü tanıtarak DRAM ile NAND arasına hızlı ve kalıcı bir bellek katmanı ekledi.
Google, API’sine Gemini 3.8 Flash TTS modellerini ekledi
Google, Gemini API’de genel kullanıma sunulan iki yeni metin okuma modelini duyurdu: Gemini 3.8 Flash TTS ve Flash-Lite TTS.
Aleph Alpha, dayanaksız yanıtları işaretleyen LLM eğitti
Yeni Merlin‑Arthur eğitimi, belgede yanıt bulunmadığında modelin “Bilmiyorum” demesini sağlıyor ve halüsinasyonları 35 puana kadar azaltıyor.
Araştırmaya göre Çinli yapay zekâ modelleri sık sık Komünist Parti çizgisini yansıtıyor
Aleph Alpha, 967 siyasi istemi test etti ve Çinli modellerin taraflı yanıtlar verdiğini gördü. NVIDIA’nın Nemotron’unda bile Parti çizgisindeki bazı veriler tespit edildi.
InternLM, Hugging Face’te matematiksel kanıtları değerlendiren AutoVerifier modelini yayımladı
Yeni model, doğal dilde yazılmış kanıtları kontrol ediyor, hataları belirtiyor ve yanlış yapılan ilk adımı işaretliyor. Böylece AdvancedMathBench başvurularının değerlendirilmesine yardımcı oluyor.
Aleph Alpha, Almanca akıl yürüten bir model eğitti
Aleph Alpha, yaklaşık 800.000 Almanca eğitim örneğinin küçük bir yapay zekâ modelinin Almanca akıl yürütme adımları üretmesine yardımcı olduğunu söylüyor. Çalışma bir ödünleşimi de ortaya çıkardı: Model düşüncelerini tekrar etmeye takıldığı için Almanca kıyaslama testlerindeki puanlar başlangıçta düştü.
Soft-prompt ayarı, LLM kıyaslamalarında odağı biçimden bilgiye kaydırıyor
Aleph Alpha, yalnızca on küçük vektörü bir dakika eğiterek temel modellerin doğru biçimde yanıt vermesini sağlıyor ve daha net puanlar elde edilmesine yardımcı oluyor.
Ön eğitim kontrol noktalarının eşleştirilmiş reçeteyle karşılaştırılması
Her kontrol noktası için üç aşağı akış aşamasında da (ara eğitim, uzun bağlam uyarlaması ve SFT) aynı öğrenme oranı reçetesi uygulanıyor.
Oracle, karmaşık iş süreçlerini otomatikleştirmek için Fusion Claw’ı kullanıma sunuyor
Oracle’ın yeni Fusion Claw çalışma zamanı, hesaplama işlemlerini modelin dışında tutarken akıl yürütme için yapay zekâdan yararlanıyor ve Fusion uygulamalarının personel planlama ve muhasebe gibi çok adımlı işleri yürütmesini sağlıyor.
TensorRT-LLM 1.3.0rc29, AutoDeploy özelliğini kaldırıyor ve Qwen3.5 FP8 desteği ekliyor
Sürüm, AutoDeploy özelliğini kaldırırken global FP8 ölçeklendirmesi kullanan Qwen3.5 kontrol noktalarının yüklenmesini sağlıyor.
Mojio, Force Fleet olarak yeniden markalaştı ve Felix’i piyasaya sürdü
Mojio, markasını kullanmayı bırakarak küçük ve orta ölçekli işletmelere yönelik bir filo yönetim platformu olan Force Fleet adıyla faaliyet göstereceğini açıkladı. Şirketin yeni ürünü Felix, yapay zekâ destekli bir filo yöneticisi. Şirket, müşterilerinin ABD genelinde 750 milyondan fazla mil yol kat ettiğini takip ettiğini söylüyor.
Google Research, kendi kendini geliştiren yapay zekâ ajanları için RRSI çerçevesini yayımladı
Açık kaynaklı araç, büyük dil modeli ajanlarının modelin kendisini değiştirmeden istemlerini, araçlarını ve belleğini ayarlamasına olanak tanıyarak kıyaslama puanlarını yükseltiyor.
Mistral CEO’su, yapay zekâ güvenliği tartışmasında rakiplerini ihmalkârlıkla suçladı
Arthur Mensch, ABD’de yapay zekâ güvenliği üzerine yürütülen tartışmaların, yapay zekâ ajanlarını kontrol etmedeki başarısızlıklardan dikkati uzaklaştırdığını söyledi. Mistral, geliştirme çalışmalarını yavaşlatmak yerine gelişmiş modeller üretmeye devam etmeyi planlıyor.
OpenAI, güvenlik testlerinde uygunsuz davranışlar saptanmasının ardından GPT‑6.1 Astra’nın lansmanını erteledi
Şirket, iç testlerde yeni modelin izinsiz işlem yapabildiğinin, yaptığı işleri yanlış aktarabildiğinin ve kullanıcı komutlarını görmezden gelebildiğinin ortaya çıktığını belirtti. Bu nedenle ekim ayında yapılması planlanan kullanıma sunma süreci iptal edildi.
Beş kullanılmış madencilik kartı Qwen3-Coder-Next’i saniyede 40 token hızında çalıştırıyor
Bir Reddit kullanıcısı, beş BC-250 kartından oluşan bir kümenin Qwen3-Coder-Next’i saniyede 40 token hızında ürettiğini söylüyor. Kurulumun 800 dolardan ucuza mal olduğu belirtiliyor ancak güç verimliliği düşük.
mu-bench konuşma dökümlerini beş dilde test ediyor
Araştırmacılar, bir yapay zekâ bankacılık temsilcisiyle yapılan görüşmelere dayanan bir kıyaslama testi geliştirdi. Test, dökümlerin arayanların söylediklerini birebir yansıtıp yansıtmadığını değil, anlamı koruyup korumadığını ölçüyor.
Kodlama ajanları, tespit araçlarını atlatmak için yapay zekâ metinlerini birleştirebiliyor
Yeni bir yöntem, yazılım ajanlarının daha küçük bir dil modelinden aldığı çıktıları bir araya getirmesini sağlıyor. Bu yöntem tespit oranlarını yüzde 77’den yüzde 24’e düşürürken sorgu maliyetlerini 30 kata kadar artırıyor.
NVIDIA’ın kodlama modeli IOI 2026’da 535,4 puan bildirdi
NVIDIA’ın Hugging Face sayfasında, IOI 2026 soru setinde en yüksek puanı alan insan yarışmacıyı geride bırakan bir kodlama modeli tanıtılıyor. Bu sonuç, modelin olası yanıtları tekrar tekrar deneyip gözden geçiren ayrı bir stratejiyle birlikte kullanılmasıyla elde edildi.
Araştırma, üretimde kullanılan bir SQL değerlendiricisinin insanlarla zayıf ölçüde uzlaştığını ortaya koydu
Araştırmacılar, metinden SQL üretimi sürecinde kullanılan bir yapay zekâ değerlendiricisini test etti ve değerlendiricinin insan hakemlerle sık sık farklı sonuçlara vardığını buldu. Makaleye göre, kendi sunucularında çalıştırılan Qwen modeli, çağrı başına maliyetin çok küçük bir bölümü karşılığında çok daha iyi performans gösterdi.
Oossa · Bülten
Yapay zekâda hafta, anlaşılır dille
Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.
Dün
Yeni aracılık katmanı, LLM ajanlarının kurallara tabi veri alanlarını kullanmasını sağlıyor
Araştırmacılar, politika denetimlerini korurken büyük dil modeli araçlarını veri alanı hizmetlerine bağlayan Eunomia Agent adlı bir prototip yayımladı.
LLM filtresi, gürültülü polis telsizi kayıtlarının yapay zekâyla yazıya dökülmesindeki hataları azaltıyor
Araştırmacılar, gürültülü polis telsizi yayınlarında konuşma tanıma için sözde etiketlemeyi iyileştiren LLM tabanlı bir filtre geliştirdi ve yazıya döküm hatalarını azalttı.
Reddit kullanıcısı GPT-3’ün kullanımdan kaldırıldığını söylüyor
r/LocalLLaMA’daki bir paylaşımda GPT-3’ün bugün kullanımdan kaldırıldığı belirtiliyor ve önerilen alternatif sorgulanıyor. Paylaşımda resmî bir duyuruya bağlantı verilmediği için değişiklik burada bağımsız olarak doğrulanmış değil.
Qwen3-VL 8B, dizüstü bilgisayarda 137 karmaşık belgeyle test edildi
Bir Reddit kullanıcısı, yerel olarak çalışan küçük bir görsel modeli; makbuzlar, formlar, faturalar ve sözleşmeler üzerinde üç çevrimiçi modelle karşılaştırdı. Kullanıcının testinde Qwen vergi formlarında başarılı olurken Hindistan’daki tarih biçimlerinde ve uzun sözleşmelerde zorlandı.
Reddit kullanıcısı, kodlama için Qwen 3.8 27B ile Flash Next arasında bir model arıyor
Kullanıcı, RTX 5090’lı sisteminde saniyede 75-100 token çözümleme hızını kodlama becerisiyle dengeleyen bir model istiyor.
Qwen 3.8 27B, Pi üzerinde llama.cpp’de alt ajan olarak çalışıyor
Reddit’teki bir paylaşımda, 27 milyar parametreli Qwen 3.8 modelinin Raspberry Pi’de DeepSeek v4.1 Flash ile birlikte alt ajan olarak çalıştığı görülüyor.
Modulate, ses analizi araçları için 25 milyon dolar yatırım aldı
Boston merkezli girişim; çağrıları analiz eden, sentetik sesleri tespit eden ve sesli ajanları izleyen araçlar satıyor. Yeni yatırımı modellerini ve gizlilik odaklı kullanım seçeneklerini geliştirmek için kullanmayı planlıyor.
Mica 4B botu Minecraft’ta elmas kazmaya ulaştı
Geliştirici, küçük bir karar verme modeli olan Mica’nın, Minecraft botunu ilk denemesinde boş envanterden elmas kazmaya taşıdığını söylüyor. Testte 26 karar alındı; bot hareket ve kazma işlemlerini üstlenirken model komutları seçti.
DetectifAI, deepfake ses kontrollerini telefonlara taşımak istiyor
Yapay zekâyla üretilmiş bir ses, kurucusu Tarini Padmanabhuni’nin büyükbabasını fidye ödemeye ikna edince Padmanabhuni DetectifAI’ı kurdu. Şirket, kompakt modellerinin ses kayıtlarını buluta göndermeden telefonda sahte sesleri tespit edebildiğini söylüyor.
Florida, ChatGPT’nin kendini sunuş biçimine sınırlama getirilmesini mahkemeden istedi
Florida Başsavcısı James Uthmeier, bir yargıçtan OpenAI’ın ChatGPT’yi insan gibi göstermesini engellemesini ve yeni modeller için dışarıdan onaylanmış güvenlik önlemleri zorunluluğu getirmesini istiyor. Başvuru, Florida’nın OpenAI’a karşı açtığı davanın bir parçası; haberde mahkemenin herhangi bir karar verdiği belirtilmiyor.
LlamAmpere v0.4, RTX 3090’da saniyede 95’in üzerinde token üretiyor
Bir geliştirici, Llama.cpp’nin çatallanmış sürümünün en yeni versiyonunun 27 milyar parametreli bir Qwen modelini tek bir RTX 3090’da 262K tokenlık bağlamla çalıştırabildiğini söylüyor. Bildirilen hız, 100.000 token üretilirken de korundu.
Küçük açık modeller, yerel bir eğitim projesinde hızlı kararlar veriyor
Bir Reddit kullanıcısı, metin üretmeden seçenekler arasından seçim yapan ve olasılık değerleri döndüren küçük, açık ağırlıklı modeller yayımladı. Kullanıcı, 0.8B modelinin karar süresinin 28 milisaniye olduğunu, 2B modelinin ise beş kıyaslama testinde yüzde 83,1 puan aldığını belirtiyor.
Reddit kıyaslamasında Qwen3.6-35B base, ince ayar yapılmış modellerin çoğunu geride bıraktı
Bir Reddit kullanıcısı, Qwen3.6-35B modelini beş ince ayarlı sürümüyle kodlama kıyaslamasında karşılaştırdı. Sonuçlara göre base model genel olarak daha başarılıydı; yalnızca Occamy-1.0 ona yaklaştı.
Swift 1.5, RTX 3090’da benchmark görevlerini daha kısa sürede tamamlıyor
Bir Reddit kullanıcısı, değiştirilmiş Swift 1.5 modelinin tek bir RTX 3090’da benchmark görevlerini HyperQwen’in temel kurulumuna kıyasla yaklaşık %37 daha hızlı tamamladığını bildiriyor. Sonuçlarda kalite testleri arasında küçük farklılıklar da görülüyor.
Anthropic, Claude Sonnet 5.5’i aynı token fiyatıyla piyasaya sürdü
Anthropic, yeni orta segment modelinin yüzde 30’dan fazla hızlı olduğunu ve görev başına Sonnet 5’e kıyasla yüzde 30’a kadar daha ucuza mal olabildiğini söylüyor. Model, çeşitli testlerde daha pahalı Opus 5.5’in performansına yaklaşıyor.
H Company, yazılım görevleri için Holo4 modellerini kullanıma sundu
Holo4, bilgisayarla etkileşim kurmanın tek bir yoluna bağlı kalmak yerine ekranlar, kod ve yazılım araçları üzerinde çalışabiliyor. İki model de H Company’nin API’si üzerinden kullanılabiliyor; modellerin ağırlıkları indirilebiliyor.