Una serie temporal es la misma medición tomada repetidamente con una cadencia fija. Un número de seguidores es un hecho sobre un instante. Cien de ellos, uno por hora, son un hecho sobre una dirección.
Casi todas las preguntas que la gente le hace a una API social son en realidad del segundo tipo.
Ahora frente a en ascenso
| Pregunta | Necesita | ¿Puede responderla una API a demanda? |
|---|---|---|
| ¿Cuántos seguidores tiene esta cuenta? | Una lectura | Sí |
| ¿Qué es tendencia ahora mismo? | Una lectura de una clasificación | Sí |
| ¿Esto está creciendo? | Muchas lecturas a lo largo del tiempo | Solo si alguien las guardó |
| ¿Qué está ya muriendo? | Lo mismo | Lo mismo |
Esta es la parte que no se puede comprar con efecto retroactivo. Una API en vivo, por rápida que sea, no puede decirte cuánto valía un número el martes pasado si nadie lo apuntó el martes. El histórico no es una función que añades después — es una decisión que alguien tomó antes de que tú preguntaras.
Qué hace que una serie sirva
- Una cadencia fija. Horario significa cada hora. Una ventana recolectada a las 14:03 y la siguiente a las 19:40 no son puntos comparables.
- Huecos registrados como huecos. Una hora que falta tiene que verse como ausente, no interpolada y no descartada. Si no, una caída de la recolección se lee como una semana plana.
- Una identidad estable. Si la cosa que sigues puede renombrarse, ánclate en el identificador y no en el nombre, o tu serie se parte en dos en silencio — mira campo ancla.
- Vacío distinguido de fallido. Una fuente que no devolvió nada esta hora no es lo mismo que una fuente que se rompió. Los guardamos en columnas separadas exactamente por esto, fuente por fuente en fuentes.
El coste, que es la ventaja silenciosa
Una serie temporal es barata de leer y cara de tener. Preguntar "qué cambió" cuesta una consulta contra datos guardados; reconstruirla desde una API en vivo cuesta una lectura por punto y por entidad, para siempre, y con precios por recurso esa es la factura que sorprende a la gente.
Nuestro archivo guarda ventanas horarias de fuentes públicas desde que abrió, y la página del archivo es donde eso se publica. Las rutas de tendencia leen de él y no de una lectura en vivo, y por eso responden a una pregunta que un flujo en directo no puede.