Metodologia
Este sitio publico se genera a partir de artefactos de reportes ya generados y no desde lecturas directas de las fuentes crudas.
Pipeline
- Los datos fuente se normalizan a salidas curadas en DuckDB y Parquet.
- Los artefactos semanales y mensuales se generan a partir del almacenamiento curado.
- La generacion del sitio copia solo descargas CSV seguras para publico y snapshots HTML al sitio publico.
Limite publico
- Las descargas publicas excluyen empresa, URL, descripciones crudas, IDs de vacante crudos y payloads crudos de OpenAI.
- El contenido agregado puede mencionar empresas solo en rankings agregados.
- El detalle privado solo vive localmente en la app de Streamlit.