Sauzal conecta computadoras con GPU ociosa alrededor del mundo en una sola red de inferencia. Vos llamás un endpoint; la red decide, en cada momento, qué nodo responde — y la conversación no se entera del cambio.
Cada pedido se resuelve en el nodo disponible en ese instante. Sin colas fijas, sin reservar hardware por adelantado.
La conversación no vive en un nodo: vive en el servidor. Dos mensajes de la misma sesión pueden resolverse en dos GPUs distintas sin que se note.
Traé tu propio modelo, encadená tareas en paralelo entre varios nodos, o mandá la misma pregunta a tres GPUs y quedate con la primera respuesta.