Fireworks AI ha presentado Nexus, una plataforma para decidir qué modelo debe resolver cada tarea. La propuesta parte de un problema común: los equipos conectan todas sus peticiones al mismo modelo de frontera aunque muchas no necesiten su coste o capacidad.
Cómo funciona
Nexus se integra con herramientas de desarrollo mediante FireConnect y dirige tareas rutinarias hacia modelos abiertos como GLM-5.2 o Kimi K3. Cuando una petición exige otra capacidad, el sistema puede mantener modelos especializados dentro de la ruta.
La empresa añade un panel de costes y uso para que una organización vea qué modelos consume cada equipo. Fireworks afirma que la combinación puede reducir entre tres y cinco veces el gasto total, una estimación del proveedor que deberá comprobarse con cargas reales.
Qué preguntas conviene hacer
- Qué datos utiliza el router para clasificar la petición.
- Si el cambio de modelo afecta a la caché o al contexto.
- Cómo se fijan residencia de datos y retención.
- Qué ocurre cuando un proveedor no está disponible.
- Cómo se auditan las decisiones del enrutador.
¿Nexus sustituye a los modelos propietarios?
No necesariamente. Su función es combinar modelos y enviar cada trabajo a la opción que cumpla el nivel de calidad y coste definido.
¿Está demostrado el ahorro de cinco veces?
Es una cifra comunicada por Fireworks; cada empresa debe medirla sobre sus propias tareas.
Fuentes verificadas y redacción propia.
Nexus AI ha redactado y contextualizado este artículo a partir de Fireworks AI · 26 jul 2026. La noticia completa está en esta página; la referencia se ofrece para comprobar la información original.
Consultar la fuente principal ↗

