Guardar la profundidad de mercado completa en local es posible, pero cuesta mucho más que guardar barras, y casi nunca compensa para decisiones a 1-3 minutos.
Este artículo explica qué exige ingerir el libro de órdenes evento a evento: licencia de datos, proceso de ingesta, almacenamiento y hardware. Después compara el coste de cada nivel de detalle y cómo reducir la inversión sin perder lo útil. Las cifras de volumen son estimaciones de orden de magnitud. No damos precios cerrados, porque cambian con frecuencia: indicamos qué exige cada nivel y dónde consultar las tarifas vigentes.
Qué datos genera la profundidad
La profundidad pasa de megabytes a cientos de gigabytes al año según el detalle que guardes, no según cuánto mercado sigas.
Hay tres niveles. L1 es el mejor precio de compra y de venta; L2 añade la cantidad agregada en cada nivel de precio; L3 o MBO (market by order) registra cada orden individual con sus altas, cancelaciones y modificaciones.
| Qué guardas | Volumen estimado por instrumento y año |
|---|---|
| Eventos completos del libro (MBO) | de cientos de GB a más de 1 TB |
| Snapshots cada segundo, 10 niveles | ~7 GB |
| Snapshots cada segundo, 5 niveles | ~4 GB |
| Métricas de profundidad por barra de 1 minuto | ~50 MB |
| OHLCV de 1 minuto (referencia) | ~18 MB |
Son estimaciones aproximadas y sin compresión, para un futuro que opera 23 horas al día durante 252 días al año, con 8 bytes por valor. El volumen real de eventos varía mucho entre instrumentos y días de volatilidad.
Qué aporta a un motor de decisiones
Hasta aquí, los datos en bruto. Ahora toca la pregunta que de verdad importa en la sala de máquinas: ¿qué hace un motor de decisiones con todo esto?
La profundidad añade contexto de liquidez que las barras OHLCV no contienen, y rinde más como filtro y como medida de coste que como señal única.
El detalle que guardes decide qué capacidades tienes. Con barras solo ves el resultado del minuto; con snapshots ves el estado del libro; con eventos ves cómo cambió dentro del minuto.
| Capacidad | Qué aporta | Detalle mínimo necesario | Utilidad a 1-3 min |
|---|---|---|---|
| Desequilibrio del libro | Presión relativa de compra y venta en los primeros niveles | Snapshots de 1 s | Media: la señal se degrada rápido |
| Spread y coste de ejecución | Coste real de entrar y salir, y slippage esperado para el backtest | Mejor bid/ask o snapshots | Alta |
| Liquidez disponible | Cuánto se puede operar sin mover el precio, para dimensionar la posición | Snapshots | Alta |
| Flujo de órdenes (delta y OFI) | Quién agrede y cómo cambia el libro entre actualizaciones | Operaciones para el delta; eventos para el OFI completo | Alta con delta; el OFI exige eventos |
| Muros y absorción en niveles clave | Liquidez que aguanta o desaparece cerca de soportes y resistencias | Snapshots y operaciones | Media |
| Régimen de liquidez | Mercado fino o grueso, para activar o desactivar sistemas | Métricas por barra | Alta y barata |
La columna de utilidad es una valoración cualitativa propia, que conviene contrastar con datos reales.
Reglas que se pueden construir
Pasemos de la teoría al taller. Con esas capacidades sobre la mesa, estas son las reglas que se pueden construir.
- Filtros duros. No operar si el spread supera un umbral de ticks o si la liquidez en los primeros niveles baja de un mínimo.
- Confirmación. Una señal de precio solo cuenta si el delta o el desequilibrio la acompañan.
- Tamaño de posición. Limitar el tamaño a una fracción de la liquidez disponible en el lado en que se ejecuta.
- Coste de ejecución. Sustituir el slippage fijo del backtest por uno que dependa del spread y de la profundidad de cada momento.
- Gestión de riesgo. Reducir exposición cuando la liquidez se retira del libro.
- Selección de régimen. Activar un sistema u otro según la liquidez de la sesión.
La profundidad visible tiene límites: hay órdenes ocultas y órdenes que se retiran antes de ejecutarse, así que ninguna regla debe depender de ella sin validarla. El procedimiento está en la recomendación final.
Ingesta evento a evento
Con la teoría clara, bajamos al terreno donde la cosa se complica: cómo entra ese flujo en tu sistema sin perder ni un solo mensaje. Aviso: el reto es de software antes que de músculo.
Ingerir el libro evento a evento es un problema de software antes que de hardware: hay que parsear el feed sin perder ni reordenar mensajes.
El proceso receptor debe mantener el orden de los mensajes y absorber las ráfagas de la apertura y de los datos macro, con una cola delante. Con él se reconstruye el libro en memoria, que ocupa poco por instrumento. El cuello de botella es el parseo y la escritura sostenida, no la RAM.
Cómo se pagan los datos
Y ahora, lo que todo el mundo quiere saber: el dinero. Una advertencia de entrada: no hay un precio único, hay un mapa de planes y licencias.
Los datos de profundidad se pagan aparte de las barras, y el coste depende de la bolsa, del tipo de usuario (profesional o no), del nivel de detalle y del histórico que incluya el plan. No damos cifras porque cambian: consulta las tarifas en origen el día que contrates.
| Concepto | Cómo se cobra | Dónde consultar |
|---|---|---|
| CME, profundidad (Depth of Market) | Cuota mensual por bolsa, con tarifa distinta para usuarios no profesionales y profesionales | Lista de tarifas de CME |
| CME, mejor precio (Top of Book) | Cuota mensual por bolsa, bastante inferior a la de profundidad | Lista de tarifas de CME |
| Proveedor con MBO (por ejemplo, Databento) | Planes por niveles: cuanto más histórico de MBO y más uso, más cuesta, y los superiores suelen exigir contrato anual | Databento, precios |
Los planes más baratos incluyen poco histórico de MBO, así que el histórico profundo suele ser la parte más cara y, si no lo compras, tendrás que capturarlo tú.
Las tarifas de visualización de CME son distintas de las de uso no visual. CME define el uso no visual como el que hace un sistema o un cálculo sin mostrar los datos, y lo licencia aparte (política de licencias de CME). En esa guía no se detalla qué se exige para redistribuir datos a terceros.
Almacenamiento y consulta
El flujo ya entra. La siguiente pregunta es incómoda: ¿dónde lo guardas? Aquí es donde las cuentas dejan de ser abstractas.
La profundidad completa exige escrituras sostenidas y lecturas secuenciales grandes: un NVMe de consumo las cubre, pero su capacidad se agota en meses. Por eso el almacenamiento rápido y de gran tamaño es el requisito central del evento a evento.
Con un supuesto de 3 GB al día en bruto por instrumento (estimación propia), un NVMe de 1 TB usado hasta el 80% dura unos 12 meses con un instrumento y unos 2,5 meses con cinco. QuestDB trabaja bien con particiones por día, y las antiguas se pueden separar y archivar. Archivadas en Parquet con compresión zstd, suelen ocupar varias veces menos, aunque la cifra depende de los datos.
Reproducir eventos en un backtest lee muchos GB y es mucho más lento que recorrer barras. Esto choca con calcular en el equipo de cada usuario, porque tendría que descargar esos GB, además de plantear la cuestión de la licencia. Es más práctico servir métricas ya calculadas.
Hardware en local
Llegamos a lo que más pesa en el bolsillo. Hablemos del hierro: qué montar, en qué orden y, sobre todo, en qué no escatimar.
Si quieres profundidad completa evento a evento en local, lo que más pesa es el disco: rápido, para absorber escrituras sostenidas, y de gran capacidad, para retener días y semanas de eventos. La CPU y la RAM importan menos.
Los precios de la memoria flash y de la RAM han subido con fuerza durante 2026, así que conviene comparar varios comercios antes de comprar. Reutilizar la RAM que ya tienes puede ahorrar una parte importante del gasto.
| Nivel | Qué cubre | Configuración orientativa | Qué priorizar |
|---|---|---|---|
| 1. Mínimo | Barras y métricas por barra de un instrumento | CPU de gama media, 16-32 GB de RAM y un NVMe de 1 TB | Basta para barras; se queda corto para guardar eventos |
| 2. Intermedio | Snapshots de 1 s de 1-3 instrumentos y semanas de eventos | La misma CPU, 32 GB de RAM, un NVMe de 2 TB y un disco de archivo | El disco: capacidad y velocidad de escritura sostenida |
| 3. Serio | Eventos completos de varios instrumentos y histórico propio | 8 o más núcleos, 64 GB de RAM ECC, varios NVMe de 2-4 TB y almacenamiento frío ampliable | Varios TB de NVMe rápido: es el mayor gasto del equipo |
No incluimos precios de componentes: varían por tienda y por fecha, y los de memoria y discos han sido especialmente inestables en 2026. Compáralos el día de la compra.
Cómo reducir la inversión
Y si el presupuesto no da para tanto, hay buenas noticias: casi todo el margen está en las decisiones, no en la compra. Estos son los atajos que merecen la pena.
Casi todo el ahorro viene de guardar menos detalle, no de comprar hardware más barato.
- Snapshots en vez de eventos. Guardar 5-10 niveles cada segundo cuesta unos 4-7 GB al año por instrumento.
- Un instrumento al principio. El coste crece casi lineal con cada activo añadido.
- Agregar mientras ingieres. Calcula desequilibrio, spread y tamaño en los primeros niveles, y guarda solo la barra enriquecida. El precio es no poder recalcular métricas nuevas sobre el pasado.
- Bruto de ventana corta. Conserva 2-4 semanas en el NVMe y archiva después en Parquet comprimido en un disco barato.
- Capturar solo lo relevante. La sesión regular y las ventanas de datos macro, en lugar de 23 horas al día.
- Un plan de datos ligero. Los planes baratos incluyen poco histórico de MBO, así que el histórico profundo tendrías que capturarlo tú.
- Alquilar solo cuando haga falta. Un servidor dedicado con NVMe de centro de datos evita comprar hardware; compara su coste con el de tener el equipo propio.
Por dónde empezar
Toca cerrar el reportaje con una hoja de ruta. Si hubiera que empezar mañana, esto es lo que recomendamos.
Para decisiones a 1-3 minutos, empieza con métricas de profundidad agregadas por barra de un solo instrumento y valida su aportación antes de pagar más disco o un feed completo.
- Captura un instrumento (por ejemplo ES): snapshots de 5-10 niveles cada segundo y operaciones. Calcula las métricas por barra de 1 minuto y guarda el bruto 2-4 semanas.
- Durante unas semanas, compara tus decisiones con y sin esas métricas, junto a OHLCV y delta.
- Solo si mejoran el resultado, pasa a un NVMe de 2 TB, más retención y un feed con MBO.
- Antes de ofrecer datos de CME a terceros, por ejemplo en un servicio de pago, aclara la licencia de datos: puede ser redistribución. No se han podido confirmar sus requisitos, así que conviene consultarlo con CME o con el proveedor.
Fuentes
Páginas para consultar tarifas y licencias vigentes. Revisa siempre la versión actual antes de contratar.