خبر کوتاه · 1 دقیقه مطالعه
Aleph Alpha مدلی را آموزش میدهد که به آلمانی استدلال کند
Aleph Alpha میگوید حدود ۸۰۰ هزار نمونه آموزشی آلمانی به یک مدل کوچک هوش مصنوعی کمک کرد تا زنجیرههای استدلال را به آلمانی تولید کند. این کار همچنین یک بدهبستان را آشکار کرد: امتیازهای مدل در آزمونهای معیار آلمانی ابتدا افت کرد؛ بخشی از علت این بود که مدل در تکرار افکارش گیر میافتاد.
Oossa · درباره Oossa
پژوهشگران Aleph Alpha، نیکلاس فینکن و سایمون تل، روشی را شرح میدهند که با آن میتوان به یک مدل هوش مصنوعی یاد داد به آلمانی استدلال کند، نه اینکه فقط به آلمانی پاسخ دهد. آنها با ترغیب مدلهای دیگر به آغاز استدلالشان به زبان آلمانی، حدود ۸۰۰ هزار نمونه آموزشی تولید کردند و سپس از این نمونهها برای تنظیم دقیق مدلی با ۳ میلیارد پارامتر فعال استفاده کردند.
این شرکت میگوید عملکرد مدل به زبان انگلیسی بدون تغییر ماند، اما امتیاز آن در ریاضی به زبان آلمانی ابتدا افت کرد: در آزمون German AIME 2026، امتیاز از ۷۰.۲ به ۴۸.۳ رسید و سپس در قویترین اجرای مبتنی بر دادههای ریاضی به ۶۷.۳ بازگشت. پژوهشگران میگویند افزودن دادههای آلمانی از همان حوزهٔ موضوعی مؤثرتر از افزودن دادههای آلمانی بهطور کلی بود و این روش هنوز نمیتواند با اطمینان جلوی دور باطل تکرار را بگیرد.
چرا مهم است
برای کاربران آلمانیزبان، این پژوهش چشماندازی از هوش مصنوعیای ارائه میدهد که بتوانند استدلالهایش را به زبان خود بخوانند؛ اما نشان میدهد بهبود یکدستی زبانی میتواند هزینههایی در دقت و اطمینانپذیری داشته باشد.
منابع و ارجاعها
| # | منبع | رسانه | تاریخ | نکته اصلی |
|---|---|---|---|---|
| 1 | Through the Valley of Tears: Cold Starting German Reasoning in LLMs ↗ | Aleph Alpha | ۷ مهر ۱۴۰۵ |
1 منبع
آخرین بهروزرسانی:
Oossa · خبرنامه
هفتهٔ هوش مصنوعی، به زبان ساده
هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.