Saltar a contenido

Metodologia

Este sitio publico se genera a partir de artefactos de reportes ya generados y no desde lecturas directas de las fuentes crudas.

Pipeline

  • Los datos fuente se normalizan a salidas curadas en DuckDB y Parquet.
  • Los artefactos semanales y mensuales se generan a partir del almacenamiento curado.
  • La generacion del sitio copia solo descargas CSV seguras para publico y snapshots HTML al sitio publico.

Limite publico

  • Las descargas publicas excluyen empresa, URL, descripciones crudas, IDs de vacante crudos y payloads crudos de OpenAI.
  • El contenido agregado puede mencionar empresas solo en rankings agregados.
  • El detalle privado solo vive localmente en la app de Streamlit.