Oossa

Cerebras amplía la inferencia rápida en la nube

Cerebras incorpora más modelos, presencia en marketplaces de servicios en la nube e integraciones para desarrolladores, para facilitar el uso de su chip de inferencia ultrarrápida.

BreveOossa1 min de lectura

Cerebras anunció que su chip de IA a escala de oblea, capaz de ejecutar inferencias hasta 15 veces más rápido que las GPU habituales, ya se ofrece en los principales marketplaces de servicios en la nube y a través de un portal de autoservicio. La empresa también incluyó decenas de modelos populares de código abierto e incorporó integraciones con herramientas como LangChain, Docker y VS Code, para que los desarrolladores puedan acceder al servicio rápido mediante API conocidas. La iniciativa busca convertir la velocidad bruta en un componente práctico para las aplicaciones de IA de uso diario.

Por qué importa

Un acceso más sencillo a la inferencia de latencia ultrabaja permite que más productos respondan al instante, mejora la experiencia de usuario y hace posibles nuevas funciones de IA en tiempo real.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.

Fuentes y referencias

2 fuentes

Última actualización: ·Markdown·llms.txt