¿Qué es Liquid Inference?
Liquid Inference es un router tipo Exchange para la inferencia de LLM. Según Architect, los proveedores publican ofertas para modelos específicos. Cada solicitud se subasta entre todos los proveedores que cotizan el modelo mencionado. La oferta con el precio más bajo que cumpla con las reglas del comprador gana
.El producto proviene de una empresa comercial, no de un laboratorio de inteligencia artificial. Architect dirige la bolsa de futuros perpetua AX. En mayo de 2026, adquirió un mercado de contratos designado en EE. UU. para cotizar en bolsa los futuros de computación con GPU, a la espera de una revisión regulatoria. El equipo utilizó su experiencia en la creación de bolsas financieras para determinar los precios de forma bilateral con fines de inferencia
.¿Cómo funciona la subasta de inferencias?
El flujo consta de 4 pasos:
- Solicitud: un cliente envía una llamada API estándar de OpenAI o Anthropic.
- Reglas: las restricciones del comprador filtran las ofertas aptas.
- Subasta: compiten los proveedores que cotizan ese modelo. La oferta que cumpla los requisitos más bajos gana .
- Recibo: el precio máximo se fija antes de la generación. La facturación cubre únicamente el uso medido .
Los compradores pueden establecer límites de costos por trabajo, límites de tiempo hasta el primer token y un rendimiento mínimo. También pueden exigir regiones aprobadas, no retener datos y tener listas de proveedores o modelos permitidos. El modo automático puede seleccionar el modelo para una unidad de trabajo determinada. La publicación de Harrison en LinkedIn añade ajustes preestablecidos de reglas de enrutamiento y compatibilidad multimodal completa
.Los titulares de cuentas pueden ver los libros de pedidos en tiempo real, las cotizaciones por proveedor y modelo y las transacciones liquidadas. Ese nivel de datos de mercado es inusual para una API de LLM
.¿Qué obtienen los compradores?
- Compatibilidad inmediata con herramientas de codificación de agencias. La publicación incluye Claude Code, Codex, OpenCode, Cursor, Pi y Cline.
- Registro de correo electrónico gratuito. Los primeros 500 usuarios reciben 20 dólares de inferencia gratuita por cada Harrison.
- Un programa de referidos: el 20% de las comisiones por referidos se obtiene como inferencia gratuita, más el 10% sobre los referidos de segundo nivel.
¿Qué obtienen los proveedores de inferencias?
Los proveedores se incorporan a través de la aplicación Liquid Inference. Harrison afirma que los nuevos proveedores se verifican «en minutos, no en semanas». Todas las instrucciones utilizan el estándar de API OpenAI. Una API REST y WebSocket registra modelos
y cotizaciones.Los proveedores pueden actualizar las cotizaciones en función de sus propios costos. Esto les permite vender la capacidad de GPU sobrante solo cuando lo deseen. Los pagos se realizan a través de Stripe, con registros detallados
de cada trabajo.¿Cómo se compara Liquid Inference con OpenRouter y Hugging Face?
| Función | Liquid Inference | OpenRouter | , proveedores de inferencia queabrazan cara a cara, | modelo de enrutamiento | , subasta por solicitud entre proveedores
|---|---|---|---|---|
| que cotizan, equilibrio de carga ponderado por precio, inverso al cuadrado del precio. El proveedor | | |||
| Más de 500 modelos, más de 80 proveedores | 18 socios listados | |||
| Compatibilidad de API | OpenAI y compatible con Anthropic Compatible con | OpenAI compatible con | OpenAI, solo chat | |
| Límite de precio | Precio máximo bloqueado antes del primer token | parámetro max_price | No revelado | Controles de datos | ZDR, regiones, listas | de permisoszdr, data_collection, solo/ignore | Provider
| pedido preferente | ||||
| Tarifa de plataforma | No revelada | Tarifa de crédito con tarjeta de 5,5%, mínimo de 0,80 USD | Sin margen | |
| Créditos gratuitos | de20 dólares para los primeros 500 usuarios | No revelado | 0,10 USD al mes gratis, 2,00 USD PRO | |
| Datos del mercado público | Libros de pedidos en vivo y operaciones liquidadas | No revelado | No revelado |
Conclusiones clave
- Liquid Inference subasta todas las solicitudes de LLM de los proveedores de la competencia.
- El precio máximo se fija antes del primer token, con un recibo por trabajo.
- Funciona con clientes de OpenAI y Anthropic, incluidos Claude Code y Cursor.
- Los primeros 500 usuarios reciben 20 dólares gratis; los referidos ganan el 20% de las comisiones.
- Las tarifas, la lista de proveedores y los datos de latencia aún no son públicos.
Consulta los detalles técnicos. Todo el mérito es para el investigador de este proyecto. Además, siéntete libre de seguirnos en Twitter y no olvides unirte a nuestro subReddit de más de 150 000 ml y suscribirte a nuestro boletín. ¡Espera! ¿Estás en Telegram? ahora también puedes unirte a nosotros en Telegram.
The post Architect lanza Liquid Inference, una subasta en tiempo real para LLM Inference appeared first on MarkTechPost.