El pronóstico de series temporales se ha convertido en una habilidad esencial para los profesionales de la inteligencia artificial y el análisis de datos. Desde la planificación de la demanda en retail hasta la gestión de recursos en energía, pasar una entrevista que incluya este tema suele ser decisivo para conseguir el puesto soñado. En este artículo, compilamos las 20 preguntas más habituales que aparecen en los procesos de selección, explicamos la lógica detrás de cada una y ofrecemos respuestas estructuradas que demuestran dominio tanto teórico como práctico.

1. ¿Qué es una serie temporal y cómo se diferencia de datos estáticos? Una serie temporal es una secuencia de observaciones recogidas a intervalos regulares de tiempo. A diferencia de los datos estáticos, incorpora una dimensión temporal que implica dependencia entre observaciones consecutivas. Este carácter autocorrelacionado obliga a usar técnicas específicas que capturan tendencias, estacionalidades y ciclos.

2. ¿Cuáles son los componentes típicos de una serie temporal? Los componentes principales son: tendencia (dirección a largo plazo), estacionalidad (patrones periódicos), ciclo (fluctuaciones de mayor duración) y ruido (variación aleatoria). Identificarlos permite descomponer la serie y elegir el modelo adecuado.

3. Diferencia entre modelos estadísticos y basados en aprendizaje profundo. Los modelos clásicos –ARIMA, SARIMA, Holt‑Winters– se basan en supuestos lineales y son interpretables, ideales para series con patrones claros y pocos datos. Los modelos de deep learning –LSTM, Temporal Convolutional Networks, Transformers– manejan no linealidades y grandes volúmenes, pero requieren más datos y potencia computacional.

4. ¿Qué es la estacionariedad y por qué es importante? Una serie es estacionaria cuando sus propiedades estadísticas (media, varianza) son constantes en el tiempo. La mayoría de los modelos tradicionales (AR, MA, ARIMA) asumen estacionariedad; de lo contrario, los estimadores pueden ser sesgados. Se logra mediante diferenciación o transformaciones logarítmicas.

5. Explica el proceso de identificación, estimación y diagnóstico en ARIMA. Identificación: análisis de ACF y PACF para determinar los órdenes p y q. Estimación: ajuste de parámetros mediante máxima verosimilitud. Diagnóstico: revisión de residuos (prueba de Ljung‑Box) para confirmar que se comportan como ruido blanco.

6. ¿Cuándo usarías SARIMA en lugar de ARIMA? SARIMA extiende ARIMA incorporando componentes estacionales (P, D, Q, s). Es la elección natural cuando la serie muestra patrones repetitivos cada s periodos (mensual, trimestral, etc.).

7. Ventajas y limitaciones de Holt‑Winters (suavizado exponencial). Ventajas: fácil de implementar, rápido y funciona bien con datos con tendencia y/o estacionalidad. Limitaciones: asume linealidad, no captura relaciones externas y su rendimiento decae con cambios estructurales bruscos.

8. ¿Qué es el "lag" y cómo lo seleccionas? El lag es el retraso entre observaciones que se utilizan como variables predictoras. Se elige mediante análisis de autocorrelación y pruebas de información (AIC, BIC) que penalizan la complejidad del modelo.

9. Describe una arquitectura LSTM para pronóstico. Una capa LSTM recibe una secuencia de valores (por ejemplo, los últimos 30 días) y aprende dependencias a largo plazo gracias a sus puertas de entrada, olvido y salida. Se suele combinar con capas densas para generar la predicción del siguiente punto.

10. ¿Cómo manejas datos faltantes en series temporales? Opciones comunes: interpolación lineal, métodos de arrastre (forward fill), o modelos de imputación basados en Kalman Filter. La elección depende de la frecuencia de los gaps y de la naturaleza del dominio.

11. ¿Qué métricas utilizas para evaluar la precisión? MAE, RMSE y MAPE son estándar. Para negocios, a veces se prefiere el Mean Absolute Scaled Error (MASE) porque permite comparar series con diferentes escalas.

12. Diferencia entre validación cruzada tradicional y "time series split". En series temporales, los datos futuros no pueden usarse para entrenar. El método rolling‑origin o walk‑forward respeta el orden cronológico, entrenando en una ventana y validando en la siguiente.

13. ¿Cómo incorporas variables exógenas? En ARIMAX o SARIMAX se añaden regresores externos (precio del petróleo, indicadores macro). En redes neuronales, se concatenan como entradas adicionales al vector temporal.

14. Explica el concepto de "seasonal decomposition of time series (STL)". STL descompone la serie en tendencia, estacionalidad y residual usando suavizado local. Es robusto a outliers y permite analizar cada componente por separado antes de modelar.

15. ¿Qué es el "forecast horizon" y cómo lo determinas? Es el número de pasos futuros que se quieren predecir. Se decide según la necesidad del negocio (por ejemplo, pronóstico de 12 semanas para planificación de inventario) y la capacidad del modelo para mantener precisión a largo plazo.

16. Estrategias para prevenir el overfitting en modelos de deep learning. Regularización L2, dropout, early stopping y aumento de datos mediante ventanas deslizantes. Además, monitorizar la pérdida en un conjunto de validación temporal es crucial.

17. ¿Cuándo es útil usar un modelo híbrido? Combinar un modelo estadístico para capturar tendencia/estacionalidad y una red neuronal para modelar el residuo puede mejorar la precisión, especialmente cuando la serie tiene patrones lineales y no lineales simultáneos.

18. Impacto de cambios estructurales (regímenes) y cómo detectarlos. Se emplean pruebas de ruptura estructural (Chow test) o métodos de detección de cambio (Bayesian Online Change Point Detection). Detectarlos permite re‑entrenar o adaptar el modelo rápidamente.

19. Herramientas y librerías recomendadas. Python: statsmodels, prophet, pmdarima, scikit‑learn, tensorflow/keras, pytorch. R: forecast, fable. Cada una tiene ventajas según el enfoque estadístico o de deep learning.

20. Buenas prácticas para desplegar un modelo de series temporales en producción. Automatizar la ingesta de datos, versionar modelos, monitorizar drift de datos y de predicciones, y establecer alertas cuando la métrica de error supera umbrales. Un pipeline CI/CD con Docker y Kubernetes facilita la escalabilidad.

Dominar estas preguntas no solo te prepara para responder en una entrevista, sino que también te brinda una hoja de ruta para abordar proyectos reales de pronóstico. En un entorno donde la capacidad de anticipar la demanda, el consumo energético o el comportamiento del usuario se traduce en ventajas competitivas, el expertise en series temporales se ha convertido en un diferenciador clave para los profesionales de IA.

Conclusión El dominio de las series temporales combina conocimientos estadísticos clásicos con las posibilidades que brinda el aprendizaje profundo. Los reclutadores buscan candidatos que demuestren comprensión profunda, capacidad de elegir la herramienta adecuada y habilidades para llevar modelos a producción. Prepararse con estas 20 preguntas y respuestas te colocará un paso adelante en el competitivo mercado tech hispanohablante.