Exo: corriendo IA en tu propio hardware, no en los data centers de otros
Una startup llamada Exo está construyendo software que te permite rentar el compute sobrante de tus propias máquinas — laptops, desktops, hasta phones — y usar ese pool para correr inferencia de IA. Funciona dividiendo los modelos entre dispositivos y pegando los resultados de vuelta. El pitch: no necesitas enviar todo a un data center gigante cuando la capacidad ya está sentada, ociosa, en los escritorios de la gente.
La idea no es nueva — el compute peer-to-peer se ha barajeado por años — pero la economía por fin tiene sentido con los LLMs modernos. La mayor parte del costo de correr un modelo es la GPU; si puedes repartir una sola inferencia entre una docena de máquinas que ya están encendidas, el costo por request baja y el dueño de cada máquina recibe su pago. Es el modelo de la cousin-hustle escalado.
Por qué nos importa: la gente ya tiene el hardware sentándose por ahí — tías con MacBooks viejas, abuelos con gaming PCs — y ahora mismo está acumulando polvo. Esto abre un ingreso extra real para cualquiera con una máquina enchufada, y significa menos dependencia de los big cloud providers que le ponen precio a las operaciones pequeñas y a los trabajadores independientes.
“No necesitas enviar todo a un data center gigante cuando la capacidad ya está sentada, ociosa, en los escritorios de la gente.”