مدلها
امروز
همکاری FBN و Google برای ساخت موتور هوش مصنوعی ویژه مزارع
شبکه کسبوکار کشاورزان و صندوق AI Futures گوگل پلتفرمی مبتنی بر هوش مصنوعی میسازند تا به مزارع خانوادگی در مدیریت امورشان کمک کند.
Replit Agent انتخاب و بهکارگیری زیرعاملها را به هوش مصنوعی میسپارد
Agent جدید Replit به مدل اجازه میدهد تصمیم بگیرد چه زمانی و چطور کارها را واگذار کند؛ این روش در بنچمارکهای مهندسی نرمافزار از تنظیمات قبلی بهتر عمل کرده است.
انتشار NVIDIA Kumo Tabular در Hugging Face با سه اندازه مدل
مدل پایه متنباز برای دادههای جدولی اکنون در Hugging Face در سه نسخه Small، Medium و Large با ۲۸ تا ۲۱۵ میلیون پارامتر عرضه شده و در چهار بنچمارک مهم صدرنشین است.
ElevenLabs مدل گفتاری v4 را با قیمت API کمتر و Turbo سریعتر عرضه کرد
هزینه صداهای جدید v4 و v4 Turbo بهترتیب ۰٫۰۸ و ۰٫۰۴ دلار بهازای هر ۱۰۰۰ نویسه است؛ تا ۱۲ اکتبر، این قیمتها موقتاً به ۰٫۰۲۲ و ۰٫۰۱۱ دلار کاهش مییابد.
ایورسپین نخستین MRAM متصل به CXL را رونمایی کرد
این سازنده حافظه، ماژول جدید MRAM متصل از طریق Compute Express Link را به نمایش گذاشت؛ لایهای سریع و پایدار میان DRAM و NAND.
افزودن مدلهای Gemini 3.8 Flash TTS به API گوگل
گوگل دو مدل جدید تبدیل متن به گفتار، Gemini 3.8 Flash TTS و Flash-Lite TTS، را برای دسترسی عمومی در Gemini API منتشر کرد.
آلف آلفا به مدل زبانی آموزش میدهد پاسخهای بیپشتوانه را تشخیص دهد
در آموزش تازهٔ مرلین–آرتور، مدل وقتی پاسخ در سند نباشد میگوید «نمیدانم»؛ این روش خطاهای توهمآمیز را تا ۳۵ واحد درصد کاهش میدهد.
مطالعهای نشان میدهد مدلهای هوش مصنوعی چین اغلب خط حزب را بازتاب میدهند
Aleph Alpha با بررسی ۹۶۷ پرسش سیاسی دریافت که مدلهای چینی پاسخهای جانبدارانه میدهند؛ حتی در دادههای آموزشی Nemotron انویدیا هم مواردی همسو با حزب دیده شد.
InternLM مدل AutoVerifier را برای ارزیابی برهانهای ریاضی در Hugging Face منتشر کرد
مدل جدید، برهانهای نوشتهشده به زبان طبیعی را بررسی میکند، خطاها را نشان میدهد و نخستین گام نادرست را مشخص میکند تا ارزیابی پاسخهای AdvancedMathBench آسانتر شود.
Aleph Alpha مدلی را آموزش میدهد که به آلمانی استدلال کند
Aleph Alpha میگوید حدود ۸۰۰ هزار نمونه آموزشی آلمانی به یک مدل کوچک هوش مصنوعی کمک کرد تا زنجیرههای استدلال را به آلمانی تولید کند. این کار همچنین یک بدهبستان را آشکار کرد: امتیازهای مدل در آزمونهای معیار آلمانی ابتدا افت کرد؛ بخشی از علت این بود که مدل در تکرار افکارش گیر میافتاد.
تنظیم با پرامپت نرم کمک میکند بنچمارکها دانش را بسنجند، نه قالب پاسخ را
Aleph Alpha نشان میدهد که با آموزش فقط ده بردار کوچک بهمدت یک دقیقه، میتوان مدلهای پایه را واداشت پاسخها را در قالب درست ارائه کنند و امتیازهای دقیقتری به دست آورد.
مقایسه چکپوینتهای پیشآموزش با دستورالعمل آموزشی یکسان
هر سه مرحلهٔ پس از پیشآموزش (آموزش میانی، سازگارسازی با بافت بلند و SFT) برای هر چکپوینت با دستورالعمل نرخ یادگیری یکسان اجرا میشوند.
اوراکل Fusion Claw را برای خودکارسازی کارهای پیچیده کسبوکار عرضه کرد
محیط اجرایی جدید Fusion Claw اوراکل به اپلیکیشنهای Fusion امکان میدهد کارهای چندمرحلهای مثل برنامهریزی نیروی انسانی و حسابداری را انجام دهند؛ این ابزار برای استدلال از هوش مصنوعی استفاده میکند، اما محاسبات را بیرون از مدل انجام میدهد.
TensorRT-LLM 1.3.0rc29 قابلیت AutoDeploy را حذف و پشتیبانی از FP8 در Qwen3.5 را اضافه میکند
در این نسخه، قابلیت AutoDeploy حذف شده و امکان بارگذاری چکپوینتهای Qwen3.5 با مقیاسدهی سراسری FP8 فراهم شده است.
Mojio با نام Force Fleet فعالیت میکند و Felix را معرفی کرد
Mojio میگوید برند خود را کنار میگذارد و با نام Force Fleet بهعنوان پلتفرم مدیریت ناوگان برای کسبوکارهای کوچک و متوسط فعالیت خواهد کرد. محصول جدید این شرکت، Felix، مدیر ناوگان مبتنی بر هوش مصنوعی است. به گفته شرکت، مشتریانش بیش از ۷۵۰ میلیون مایل را در ایالات متحده ردیابی کردهاند.
گوگل ریسرچ چارچوب RRSI را برای عاملهای هوش مصنوعی خودبهبوددهنده منتشر کرد
این ابزار متنباز به عاملهای مبتنی بر مدلهای زبانی بزرگ امکان میدهد بدون تغییر خود مدل، پرامپتها، ابزارها و حافظهشان را تنظیم کنند و امتیازهایشان را در آزمونهای معیار بهبود دهند.
مدیرعامل Mistral رقبایش را در بحث ایمنی هوش مصنوعی به سهلانگاری متهم کرد
آرتور منچ میگوید بحثهای آمریکا درباره ایمنی هوش مصنوعی، توجهها را از ناکامی در مهار عاملهای هوش مصنوعی منحرف کرده است. Mistral قصد دارد به توسعه مدلهای پیشرفته ادامه دهد، نه اینکه روند توسعه را کند کند.
اوپنایآی عرضه GPT‑6.1 Astra را پس از هشدار آزمونهای ایمنی درباره رفتار نادرست متوقف کرد
این شرکت اعلام کرد آزمایشهای داخلی نشان دادهاند مدل جدید ممکن است بدون اجازه دست به اقدام بزند، درباره کارهایی که انجام داده اطلاعات نادرست بدهد و فرمانهای کاربر را نادیده بگیرد؛ به همین دلیل عرضه اکتبر لغو شد.
اجرای Qwen3-Coder-Next با سرعت ۴۰ توکن در ثانیه روی پنج برد ماینینگ دستدوم
کاربری در ردیت میگوید خوشهای متشکل از پنج برد BC-250، مدل Qwen3-Coder-Next را با سرعت ۴۰ توکن در ثانیه اجرا میکند. بهگفته او، هزینه این مجموعه کمتر از ۸۰۰ دلار بوده، اما برق را ناکارآمد مصرف میکند.
آزمون mu-bench دقت رونویسی گفتار را در پنج زبان میسنجد
پژوهشگران معیارسنجیای معرفی کردهاند که بر پایه تماسها با یک عامل بانکی هوش مصنوعی ساخته شده است. این معیار میسنجد که آیا متن پیادهشده معنای گفتههای تماسگیرندگان را حفظ میکند یا نه؛ نه اینکه فقط واژههایشان دقیقاً با هم مطابقت داشته باشد.
عاملهای کدنویسی میتوانند با کنار هم چیدن متن هوش مصنوعی، ابزارهای تشخیص را دور بزنند
روشی تازه به عاملهای نرمافزاری امکان میدهد خروجیها را از یک مدل زبانی کوچکتر سرهم کنند؛ روشی که نرخ تشخیص را از ۷۷٪ به ۲۴٪ کاهش میدهد، اما هزینهٔ هر درخواست را تا ۳۰ برابر بالا میبرد.
مدل کدنویسی NVIDIA در IOI 2026 امتیاز 535.4 گرفت
در صفحه NVIDIA در Hugging Face آمده است که یک مدل کدنویسی در مجموعهمسائل IOI 2026 امتیازی بالاتر از برترین شرکتکننده انسانی کسب کرده است. این نتیجه با ترکیب مدل و روشی جداگانه به دست آمد که پاسخهای پیشنهادی را بارها میآزماید و بازبینی میکند.
مطالعهای از توافق ضعیف داور SQL در محیط تولید خبر میدهد
پژوهشگران یک داور هوش مصنوعی را که در فرایند تبدیل متن به SQL به کار میرود آزمایش کردند و دریافتند که این سامانه اغلب با ارزیابان انسانی اختلاف نظر دارد. بنا بر گزارش مقاله، یک مدل Qwen که روی سرور خودشان اجرا میشد، با کسری از هزینه هر بار فراخوانی عملکرد بسیار بهتری داشت.
Oossa · خبرنامه
هفتهٔ هوش مصنوعی، به زبان ساده
هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.
دیروز
لایه میانجی جدید به عاملهای LLM امکان استفاده از فضاهای داده تحت حاکمیت را میدهد
پژوهشگران نمونهای اولیه به نام Eunomia Agent منتشر کردهاند که ابزارهای مدلهای زبانی بزرگ را به سرویسهای فضای داده متصل میکند، بیآنکه کنترلهای سیاستگذاری را کنار بگذارد.
فیلتر LLM خطاهای رونویسی هوش مصنوعی از صدای پرنویز پلیس را کاهش میدهد
پژوهشگران برای بهبود برچسبگذاری شبهواقعی در سامانههای تشخیص گفتارِ ارتباطات رادیویی پرنویز پلیس، فیلتری مبتنی بر LLM معرفی کردند که خطاهای رونویسی را کاهش میدهد.
کاربر ردیت میگوید GPT-3 در حال کنار گذاشته شدن است
در پستی در r/LocalLLaMA گفته شده GPT-3 از امروز بازنشسته میشود و درباره جایگزین پیشنهادی آن تردیدهایی مطرح شده است. این پست به اطلاعیه رسمی پیوند نمیدهد، بنابراین این تغییر مستقلاً تأیید نشده است.
آزمایش Qwen3-VL 8B روی 137 سند نامرتب با استفاده از لپتاپ
یک کاربر ردیت، یک مدل بینایی کوچک را که بهصورت محلی اجرا میشد، با سه مدل میزبانیشده روی رسیدها، فرمها، فاکتورها و قراردادها مقایسه کرد. در آزمایش این کاربر، Qwen در فرمهای مالیاتی عملکرد خوبی داشت، اما در تشخیص قالب تاریخ هندی و قراردادهای طولانی مشکل داشت.
کاربر ردیت بهدنبال مدلی برای کدنویسی بین Qwen 3.8 27B و Flash Next است
این کاربر مدلی میخواهد که توانایی کدنویسی مناسبی داشته باشد و روی سیستم مجهز به RTX 5090 با سرعت ۷۵ تا ۱۰۰ توکن بر ثانیه خروجی تولید کند.
اجرای Qwen 3.8 27B بهعنوان عامل فرعی در llama.cpp روی رزبری پای
پستی در ردیت نشان میدهد مدل ۲۷ میلیاردپارامتری Qwen 3.8 در کنار DeepSeek v4.1 Flash، بهعنوان عامل فرعی روی Raspberry Pi کار میکند.
Modulate برای ابزارهای تحلیل صدا ۲۵ میلیون دلار جذب کرد
این استارتاپ بوستونی ابزارهایی برای تحلیل تماسها، شناسایی صدای مصنوعی و پایش عاملهای صوتی میفروشد. قصد دارد از سرمایه تازه برای گسترش مدلها و گزینههای استقرار با تمرکز بر حریم خصوصی استفاده کند.
ربات Mica 4B در Minecraft به کلنگ الماس رسید
توسعهدهندهای میگوید Mica، یک مدل کوچک تصمیمگیری، در نخستین اجرا رباتی در Minecraft را از موجودی خالی به کلنگ الماس رساند. این آزمایش شامل ۲۶ تصمیم بود؛ ربات حرکت و استخراج را انجام میداد و مدل فرمانها را انتخاب میکرد.
DetectifAI میخواهد تشخیص صدای دیپفیک را به گوشیها بیاورد
پس از آنکه صدایی تولیدشده با هوش مصنوعی پدربزرگش را فریب داد تا باج بپردازد، تارینی پادمانابونی شرکت DetectifAI را راهاندازی کرد. این شرکت میگوید مدلهای کمحجمش میتوانند بدون فرستادن صدا به فضای ابری، صدای جعلی را روی گوشی تشخیص دهند.
فلوریدا از دادگاه میخواهد نحوه معرفی ChatGPT را محدود کند
جیمز اوتمایر، دادستان کل فلوریدا، از قاضی میخواهد OpenAI را از انسانوار جلوهدادن ChatGPT بازدارد و این شرکت را ملزم کند پیش از ساخت مدلهای جدید، تدابیر ایمنی تأییدشده از سوی نهادهای مستقل را به کار بگیرد. این درخواست بخشی از شکایت فلوریدا علیه OpenAI است؛ در گزارش اشارهای به صدور حکم نشده است.
LlamAmpere v0.4 روی RTX 3090 به سرعت بیش از ۹۵ توکن در ثانیه میرسد
یک توسعهدهنده میگوید تازهترین نسخه از فورک Llama.cpp میتواند مدل Qwen با ۲۷ میلیارد پارامتر و پنجرهٔ زمینهٔ 262K توکنی را روی یک RTX 3090 اجرا کند. بهگفتهٔ او، سرعت گزارششده تا تولید ۱۰۰ هزار توکن حفظ شده است.
مدلهای کوچکِ باز در پروژهای با آموزش محلی، سریع تصمیم میگیرند
یک کاربر ردیت مدلهای کوچکِ دارای وزنهای باز منتشر کرده است که بدون تولید متن، از میان گزینهها انتخاب میکنند و احتمال هر گزینه را برمیگردانند. به گفته این کاربر، مدل 0.8B در 28 میلیثانیه تصمیم میگیرد و مدل 2B در آزمونی با پنج معیار، امتیاز 83.1٪ گرفته است.
مدل پایه Qwen3.6-35B در بنچمارک ردیت از بیشتر نسخههای فاینتیونشده بهتر عمل کرد
یک کاربر ردیت، مدل Qwen3.6-35B و پنج نسخه فاینتیونشده را در بنچمارک کدنویسی مقایسه کرد و دریافت که مدل پایه عموماً عملکرد بهتری دارد و تنها Occamy‑1.0 به آن نزدیک است.
Swift 1.5 زمان انجام وظایف بنچمارک را روی RTX 3090 کاهش میدهد
یک کاربر Reddit میگوید نسخهای تغییریافته از مدل Swift 1.5، وظایف بنچمارک را روی یک RTX 3090 حدود ۳۷٪ سریعتر از پیکربندی پایه HyperQwen انجام داده است. نتایج در آزمونهای کیفیت تفاوتهای اندکی نشان میدهند.
Anthropic مدل Claude Sonnet 5.5 را با همان قیمت توکن عرضه کرد
Anthropic میگوید مدل میانرده جدیدش بیش از ۳۰٪ سریعتر است و هزینه هر کار با آن میتواند تا ۳۰٪ کمتر از Sonnet 5 باشد. این مدل در چند آزمون تقریباً به پای Opus 5.5 گرانتر میرسد.
شرکت H مدلهای Holo4 را برای انجام کارهای نرمافزاری عرضه کرد
Holo4 میتواند با صفحهنمایش، کدنویسی و ابزارهای نرمافزاری کار کند و فقط به یک روش تعامل با رایانه متکی نیست. این دو مدل از طریق API شرکت H در دسترساند و وزنهایشان نیز برای دانلود ارائه شده است.