# Prime запустила платформу для запуска открытых моделей

> Prime Inference — новая платформа для запуска передовых открытых моделей — начала работу с моделью GLM‑5.3 на OpenRouter. Она обеспечивает низкую задержку и доступность 100%.

Oossa · 2026-10-02 · https://oossa.com/ru/prime-launches-inference-platform-for-open-source-models

Prime объявила о публичном запуске Prime Inference — платформы для запуска моделей с открытым исходным кодом на GPU-кластерах. Сервис поддерживает как бессерверную работу, так и резервирование мощностей, а также автоматически переключается между дата-центрами при сбоях. Первая публичная модель, GLM‑5.3, стала доступна на OpenRouter 22 сентября; с момента запуска не зафиксировано ни одной ошибки при вызове инструментов, а сервис работает без перебоев.

Prime Inference использует GPU NVIDIA Blackwell и технологический стек на базе Dynamo, vLLM, Mooncake и FlashInfer. Платформа также предлагает совместимый с OpenAI API, к которому можно обращаться через любой существующий SDK.

## Факты

- Prime Inference публично запустилась 22 сентября 2026 года с моделью GLM‑5.3.
- Сервис работает на GPU NVIDIA Blackwell и с момента запуска обеспечивает доступность 100%.

## Почему это важно

Теперь разработчики могут запускать модели с открытым исходным кодом в промышленном масштабе и получать стабильные ответы с низкой задержкой — без необходимости создавать собственную GPU-инфраструктуру.

## Источники и ссылки

1. [AnnouncementsOCT 02ND, 2026Prime Inference: Fast, Reliable Serving for Frontier Open Models](https://www.primeintellect.ai/blog/pi-inference-launch) – Prime Intellect
2. [AnnouncementsOCT 02ND, 2026Prime Inference: Fast, Reliable Serving for Frontier Open Models](https://www.primeintellect.ai/blog/prime-inference) – Prime Intellect

Обновлено: 2026-10-02
