Cardinal Datos

Cardinal Datos · Método

De dónde
sale cada cifra

Esta página no resume el método: publica el archivo que genera el propio pipeline, sin intermediarios. Si una pieza cambia de fuente o de límites, aquí se ve en la siguiente compilación.

La regla de oro

Toda cifra publicada tiene que rastrearse hasta un archivo descargado por un script. Si se copió de un PDF, no entra.

1Un script pide los datos al API del organismo y guarda la respuesta sin tocar, en crudo.json. Nadie edita ese archivo a mano.
2El mismo script limpia esa respuesta y producelimpio.json. Las celdas vacías no se rellenan ni se estiman: los huecos se conservan y se declaran.
3Se escribe metodo.md con la fuente, la consulta exacta, la definición del indicador y los límites conocidos. Es lo que se lee más abajo.
4La web, las imágenes de Instagram y cualquier otra superficie leen ese mismo limpio.json. Un solo origen: si dos piezas dieran cifras distintas, sería un fallo, no un matiz.

Aparte, una comprobación semanal pregunta a cada fuente sondeada si sigue respondiendo y si sus datos siguen frescos. Responder no basta: una tabla puede seguir contestando meses después de dejar de actualizarse.

El método de cada pieza

3 de 3 piezas publican aquí el archivo que escribió su propio script, sin redactarlo de nuevo. Las que no tienen método reproducible aparecen igual, declaradas: una pieza sin script se dice, no se esconde.

ACNUR · Datos de 2025

Cuando cambia la etiqueta, cambia el pasado

Fuente: ACNUR — UNHCR Refugee Data Finder, API v1, conjunto de población de fin de año por país de origen y de acogida.
Consulta: https://api.unhcr.org/population/v1/population/?coo=VEN&coa_all=true&yearFrom=2018
Fecha de extracción: 2026-09-17

Definición

Personas venezolanas contabilizadas por ACNUR, repartidas entre los tipos de población que la propia fuente distingue. Los nombres de las categorías son los que ACNUR usa en sus publicaciones en español; no son traducciones propias.

Decía «fuera de Venezuela» y no era exacto: la consulta pide todos los países de acogida, y entre ellos la fuente devuelve el propio país de origen. Ese matiz está declarado en los límites con su peso año por año.

La serie arranca en 2018 porque es el año desde el que ACNUR aplicó retroactivamente la categoría «otras personas que necesitan protección internacional», y también el primer año en que ese tipo existe en su matriz de disponibilidad.

Según la nota al pie de la propia fuente, la columna de personas refugiadas incluye a las personas en situación similar a la de refugiado.

Último año con dato: 2025. No se toma del catálogo de años del API, que llega más lejos que el dato.

Límites declarados

1. Los números son aproximaciones por decisión de la fuente. ACNUR redondea los valores menores que cinco al múltiplo de cinco más cercano antes de publicar, por confidencialidad, y declara que los totales deben considerarse aproximados. La consecuencia práctica: un cero publicado significa entre cero y dos personas. En 2025 hay 65 celdas en ese caso, y limpio.json las marca como cero_redactado.

2. No todos los ceros dicen lo mismo. Las columnas que valen cero para todos los destinos del año no están midiendo nada: son relleno del esquema, porque el concepto no aplica a un desglose por país de acogida. En 2025 son: Comunidad de acogida, Personas desplazadas internas, Personas apátridas. Se marcan como cero_de_esquema y no se dibujan.

3. El denominador incluye solo tipos de población, no soluciones. La misma respuesta trae columnas de personas retornadas, que son flujos anuales y no existencias; sumarlas al total mezclaría dos cosas distintas. Se conservan en limpio.json y quedan fuera del porcentaje.

4. La ausencia de un país no es interpretable. De los 229 países del catálogo de ACNUR, 55 aparecen como destino. Se comprobó pidiendo pares origen-destino ausentes uno por uno: el API no devuelve fila, así que no distingue «no se midió» de «no había nadie». Por eso los que faltan no se publican como países sin dato.

5. La lista de destinos cambia de un año a otro. En el periodo cubierto hubo 30 entradas y 20 salidas de la lista. Un país que aparece o desaparece no es gente que llegó o se fue: es un país que ese año reportó o dejó de reportar.

6. La serie fue reclasificada dos veces y reescrita hacia atrás. Las personas venezolanas contadas hoy como «otras personas que necesitan protección internacional» estaban antes bajo «venezolanos desplazados en el exterior», tipo introducido en junio de 2020, y antes de eso dentro de «otras personas de interés». En octubre de 2022 ACNUR absorbió el tipo intermedio en el actual, retroactivamente desde 2018, y declaró que el término anterior dejaría de usarse. Cualquier cifra publicada por terceros antes de esa fecha se refiere a una clasificación que ya no existe y no es comparable con esta.

7. Omitir el país de acogida en la consulta no da error: el API agrega la dimensión y devuelve el total en una sola fila, con el destino escrito como un guion. Esta consulta pide el desglose explícitamente y descarta las filas agregadas que aun así lleguen; limpio.json registra cuántas fueron.

8. El país de origen aparece también como país de acogida, y entra en el total. La consulta pide todos los países de acogida, y entre las filas que devuelve la fuente hay una cuyo destino es Venezuela: son personas venezolanas contabilizadas dentro del propio país, no en otro. Por eso esta serie no se puede describir como «personas fuera de Venezuela», y la definición lo decía mal hasta esta corrección. No es un matiz de redacción: en 2022 esa sola fila fue el 32,2 % del total contabilizado, y en 2025 el 2,5 %. Buena parte de lo que sube y baja en la serie es esa fila moviéndose, no gente cruzando una frontera. El detalle por año está en el campo origen_como_destino de limpio.json.

Banco Mundial · Datos de 2023

Cuánto se queda en el camino

Fuente: Banco Mundial, World Development Indicators, serie SI.RMT.COST.IB.ZS (costo promedio de enviar remesas hacia un país). Los datos de origen provienen de Remittance Prices Worldwide.
Consulta: https://api.worldbank.org/v2/country/<ISO3>/indicator/SI.RMT.COST.IB.ZS?format=json&mrv=5
Fecha de extracción: 2026-08-07

Definición

Costo total de transacción de enviar 200 USD hacia el país, como porcentaje del monto enviado, promediado entre todos los proveedores de servicios de remesas incluidos en la base Remittance Prices Worldwide para ese destino.

La cifra en dólares de esta pieza devuelve ese porcentaje al monto sobre el que el indicador está definido: no es una extrapolación. Tampoco es la tarifa de ningún proveedor concreto — es el promedio del mercado rastreado.

Límites declarados

1. Los valores latinoamericanos (2–3,5 %) quedan muy por debajo del promedio global del RPW (6,36 %). No es una discrepancia de método: ambos miden lo mismo, y América Latina es la región más barata del mundo para recibir remesas. Pendiente menor: contrastar contra el promedio regional del informe, no contra el global.

2. Frecuencia anual, no trimestral. El metadato del catálogo declara actualizaciones recientes, pero el último año con dato es 2023: refrescan el catálogo sin añadir años. Verificar en cada ejecución.

3. Es un promedio entre los corredores rastreados hacia cada país. En países con pocos corredores el promedio salta fuerte de un año a otro sin que cambie el mercado real. No usar la serie temporal de un país como si fuera una tendencia.

4. Venezuela no tiene indicador en esta serie. Argentina y Chile aparecen con valor nulo. Su ausencia se registra en limpio.json.

5. No hay desglose entre comisión y margen de tipo de cambio, ni por país emisor, ni por tipo de proveedor. Ese detalle solo existe en el Excel trimestral de Remittance Prices Worldwide.

6. Los nombres de país se publican en español. La traducción es nuestra, no de la fuente: el API los devuelve en inglés. El nombre original queda guardado en el campo pais_fuente de limpio.json, y en crudo.json sin tocar. Ninguna cifra depende de esta traducción.

Eurostat · Datos de 2024

El título no cruza

Fuente: Eurostat, Encuesta de Población Activa de la UE (EU-LFS), conjunto lfsa_eoqgan (tasas de sobrecualificación por ciudadanía).
Consulta: https://ec.europa.eu/eurostat/api/dissemination/statistics/1.0/data/lfsa_eoqgan?format=JSON&age=Y20-64&sex=T&unit=PC
Fecha de extracción: 2026-08-10

Definición

Tasa de sobrecualificación: proporción de personas empleadas con estudios superiores (ISCED 5-8) que trabajan en ocupaciones de baja o media cualificación (ISCO, grupos 4-9).

Las personas se clasifican por ciudadanía, no por país de nacimiento: nacionales del país donde residen, ciudadanos de otro Estado miembro de la UE, y ciudadanos de un país no comunitario. Eurostat publica una serie paralela por país de nacimiento (lfsa_eoqgac) cuyos valores no son intercambiables con estos.

Franja de edad: Y20-64 (de 20 a 64 años).

Límites declarados

1. La franja de edad es una elección declarada, no un dato neutro. El conjunto ofrece siete (Y20-64 entre ellas) y cada una da cifras distintas: en 2024, los ciudadanos de fuera de la UE aparecen al 39,8 % en Y20-64 y al 33,0 % en 25-34 años. Comparar cifras de franjas distintas no tiene sentido.

2. Los valores de la serie se revisan. Las cifras de 2024 que esta pieza publicó por primera vez en julio de 2025 (39,6 % y 30,3 %) ya no son las que devuelve el API (39,8 % y 30,2 %). Por eso la pieza se reconstruye desde la fuente en cada ejecución y no conserva cifras transcritas.

3. El ranking por país incluye solo los 27 Estados miembros. El conjunto también devuelve países de la AELC y candidatos —Islandia aparece con una tasa alta—, que quedan fuera porque el ranking se presenta como europeo comunitario.

4. No todos los países tienen dato cada año. Los que faltan se listan en limpio.json como sin_dato; no se estiman ni se rellenan con el año anterior.

5. Es una encuesta por muestreo, no un censo. En países pequeños o con pocas personas migrantes con título universitario, la muestra es reducida y el valor puede saltar de un año a otro sin que cambie la realidad. Eurostat marca esos casos con banderas de fiabilidad que esta consulta no recoge todavía.

6. La tasa mide desajuste entre título y ocupación. No mide reconocimiento de títulos, ni discriminación, ni idioma: son causas posibles que el indicador no separa.

Las fuentes

12 fuentes declaradas, 3 sosteniendo piezas publicadas y 4 con comprobación automática semanal.

Dos preguntas. ¿Habla de personas migrantes o de su diáspora? ¿Está el dato encerrado en un idioma que no es el español, o disperso de forma que nadie puede leerlo? Si las dos son sí, entra. La región no es criterio: Noruega y Colombia entran por lo mismo, por ser países donde vive la diáspora.

Globales

Compara todos los países con la misma vara. Da la cifra mundial y permite decir «de todos los países, este».

Banco Mundial — World Development IndicatorsRemesas, migración y empleo. Cobertura casi mundial, series largas y comparables.En uso · CC BY 4.0
ACNUR / UNHCR — Refugee Data FinderPoblación refugiada, solicitante de asilo y desplazada, por país de origen y de asilo. Serie desde 1951.En uso · CC BY 4.0Descubierta con pipeline/explorar_acnur.py en agosto de 2026. Lo que hay que saber antes de construir encima. UNO: si se omite coa, el API no da error, agrega la dimensión y devuelve una sola fila con el destino escrito como «-». Una consulta sin coa_all publica el total creyendo publicar un desglose. DOS: la ausencia se escribe como cadena vacía, no como null ni como cero, y solo en la columna oip. Las demás columnas traen cero incluso donde el concepto no aplica, así que un cero de este API no significa «se midió y no había nadie». TRES: /years/ es el catálogo de años del API y va dos años por delante del último con dato; consultar su máximo devuelve cero filas sin ningún error. Además cambió de 2026 a 2027 entre dos ejecuciones del mismo día, así que no es fiable como referencia. CUATRO: /population-types/ devuelve 404; los tipos de población se enumeran desde el campo population_type de /footnotes/. RESUELTO: la ausencia de un país no es interpretable, y así se declara. Se comprobó pidiendo pares origen-destino ausentes uno por uno: el API no devuelve fila, así que no distingue «no se midió» de «no había nadie». pipeline/acnur.py no publica los que faltan como países sin dato; cuenta cuántos son frente al catálogo y deja escrito que el hueco no se interpreta. El campo motivo quedó para lo que la fuente sí distingue: columna no recogida, cero de esquema y cero redactado por confidencialidad, que significa entre cero y dos personas y no es un cero exacto. Sostiene la pieza «desplazamiento-venezolano».
OIM — Portal de Datos MigratoriosIndicadores migratorios de todos los países, con las definiciones y los metadatos de cada uno.Candidata, aún sin abrir · Por conjunto de datos; hay que comprobarla en cada unoMás que una fuente, es un agregador con fichas de metodología. Útil sobre todo para saber qué mide realmente cada indicador antes de publicarlo. Pendiente comprobar si expone datos por API o solo por descarga.

Regionales

Compara dentro de un bloque, entre pares. Evita que un país quede medido contra un promedio mundial que no le corresponde.

Eurostat — API Statistics (JSON-stat 2.0)Los 27 de la UE más AELC. Integración, empleo y educación de personas migrantes.En uso · Reuso con atribución
CEPALSTAT — Comisión Económica para América Latina y el Caribe33 países de América Latina y el Caribe. Indicadores demográficos, sociales y económicos comparables entre sí.Candidata, aún sin abrir · Reuso con atribuciónLa contraparte de Eurostat para las Américas. Permite comparar países latinoamericanos entre ellos en vez de contra un promedio mundial que aplana las diferencias. Pendiente descubrir su forma.
R4V — Plataforma de Coordinación Interagencial para Refugiados y Migrantes de Venezuela (ACNUR y OIM)Personas refugiadas y migrantes de Venezuela en 17 países de acogida de América Latina y el Caribe.Candidata, aún sin abrir · Reuso con atribuciónLa cifra canónica de la diáspora venezolana, y la que cita la prensa. Publica en español, así que aquí el trabajo no es traducir sino conectar con el resto. LÍMITE CONOCIDO DE ANTEMANO: sus cifras son las oficiales de cada gobierno de acogida, y cada uno publica con periodicidad distinta — un salto de un mes a otro puede ser un cambio en el sistema de publicación de un país, no un cambio real en las llegadas. Cualquier pieza encima tiene que declararlo. Pendiente comprobar si expone API o solo informes descargables.

Países de destino

Registro administrativo del país que recibe. Dice cosas que ninguna serie internacional recoge, y casi nunca está en español.

Statistisk sentralbyrå — oficina estadística de Noruega (PxWebApi v2)Noruega. Población inmigrante, empleo, precios.Sondeada, sin pieza todavía · CC BY 4.0Estuvo marcada como «en uso» hasta agosto de 2026, pero ninguna pieza publicada se apoya en ella todavía: la sonda comprueba la tabla 14700, que es de precios. Es el caso exacto de «sondeada» — responde, la entendemos, y falta la pieza encima.
IMDi — Direktoratet for integrering og mangfold (Noruega)Noruega. Integración: asentamiento, programa de introducción, resultados por municipio y por país de origen.Candidata, aún sin abrir · Reuso con atribuciónPublica solo en noruego. Es el caso puro del proyecto: datos que existen, son públicos, y nadie que hable español puede leerlos. Pendiente comprobar si expone API o solo tablas descargables.
NAV — Arbeids- og velferdsetaten (Noruega)Noruega. Empleo, desempleo y prestaciones, con desglose por origen.Candidata, aún sin abrir · Reuso con atribuciónSolo en noruego. Complementa a SSB: SSB dice cuántos son, NAV dice cómo les va en el mercado laboral. Pendiente descubrir su forma.
datos.gov.co — portal nacional de datos abiertos (Socrata)Colombia. Registros administrativos, incluida población migrante venezolana.Candidata, aún sin abrir · Por conjunto de datos; hay que comprobarla en cada unoColombia acoge a la mayor parte de la diáspora venezolana, así que sus registros administrativos dicen cosas que ninguna serie internacional recoge. Aviso: el portal no es una sola fuente. Cada conjunto de datos tiene su propia licencia, su propia calidad y su propia periodicidad, y hay que declararlas por separado.
INE — Instituto Nacional de Estadística (España)España. Padrón, población extranjera por nacionalidad, flujos migratorios.Candidata, aún sin abrir · Reuso con atribuciónPrincipal destino europeo de la diáspora venezolana. Publica en español, así que el aporte aquí no es traducir sino comparar: poner la cifra española junto a la colombiana y la estadounidense en una misma vara.

País de origen

Lo que el país emisor publica sobre su propia gente fuera. Aquí el hueco es la noticia.

INE — Instituto Nacional de Estadística (Venezuela)Venezuela. Población y estadísticas oficiales del país de origen.Candidata, aún sin abrir · Sin licencia de reuso declaradaSe registra aquí precisamente porque su publicación es escasa e irregular, y porque Venezuela lleva años sin reportar a varios organismos multilaterales. La ausencia no es un obstáculo para el proyecto: es una serie en sí misma, y documentar qué dejó de publicarse y cuándo es una pieza tan válida como cualquier cifra.

Qué no hacemos

Declarar los límites vale tanto como declarar la fuente.

·No completamos series incompletas con estimaciones propias.
·No le pedimos a un modelo de lenguaje que escriba una cifra ni que rellene un hueco. El proyecto se construye con asistencia de inteligencia artificial, y lo que hace y lo que no está declarado en la página de uso de IA.
·No comparamos países de años distintos sin decirlo en la pieza.
·No convertimos un promedio en una tendencia cuando la serie tiene pocos puntos de origen.
·No borramos un país porque no tenga dato. La ausencia se publica.