# Prime پلتفرم استنتاج مدل‌های متن‌باز را عرضه کرد

> Prime Inference، پلتفرم جدید میزبانی مدل‌های متن‌باز پیشرفته، با GLM‑5.3 در OpenRouter راه‌اندازی شد و تأخیر کم و آپ‌تایم ۱۰۰درصدی ارائه می‌دهد.

Oossa · 2026-10-02 · https://oossa.com/fa/prime-launches-inference-platform-for-open-source-models

Prime از عرضه عمومی Prime Inference خبر داد؛ پلتفرمی برای اجرای مدل‌های متن‌باز روی خوشه‌های GPU. این سرویس از ظرفیت بدون‌سرور و ظرفیت رزروشده پشتیبانی می‌کند و جابه‌جایی خودکار بین مراکز داده را هم دربرمی‌گیرد. نخستین نقطه پایانی عمومی آن، GLM‑5.3، در 22 سپتامبر در OpenRouter در دسترس قرار گرفت و تاکنون هیچ خطایی در فراخوانی ابزارها نداشته و به‌طور پیوسته فعال بوده است.

Prime Inference از GPUهای NVIDIA Blackwell و مجموعه‌ای مبتنی بر Dynamo، vLLM، Mooncake و FlashInfer استفاده می‌کند. همچنین یک API سازگار با OpenAI ارائه می‌دهد که با هر SDK موجود قابل فراخوانی است.

## حقایق

- Prime Inference در 22 سپتامبر 2026 با مدل GLM‑5.3 به‌طور عمومی راه‌اندازی شد.
- این سرویس روی GPUهای NVIDIA Blackwell اجرا می‌شود و از زمان راه‌اندازی آپ‌تایم ۱۰۰٪ داشته است.

## چرا مهم است

توسعه‌دهندگان حالا می‌توانند مدل‌های متن‌باز را در مقیاس تولید و با استنتاجی مطمئن و کم‌تأخیر به کار بگیرند، بی‌آنکه زیرساخت GPU خودشان را بسازند.

## منابع و ارجاع‌ها

1. [AnnouncementsOCT 02ND, 2026Prime Inference: Fast, Reliable Serving for Frontier Open Models](https://www.primeintellect.ai/blog/pi-inference-launch) – Prime Intellect
2. [AnnouncementsOCT 02ND, 2026Prime Inference: Fast, Reliable Serving for Frontier Open Models](https://www.primeintellect.ai/blog/prime-inference) – Prime Intellect

آخرین به‌روزرسانی: 2026-10-02
