Generado con IA por Unholster

Metodología
cómo construimos el Monitor DT

Cómo reunimos, ordenamos y analizamos los documentos de la Dirección del Trabajo que dan forma a este monitor: dictámenes publicados entre 1990 y 2026 y ordinarios disponibles desde 2016. Esta sección explica las fuentes, criterios y procesos utilizados para convertir esos documentos en datos comparables.

Metodología
Cómo se construye el análisis
Enfoque híbrido: reglas sobre los descriptores oficiales de la DT para los ejes temáticos (transparente y reproducible), y extracción con IA para quién plantea, empresa, sector y región, donde el texto libre supera a las reglas.

Ordinario vs. dictamen: la diferencia

La Dirección del Trabajo responde consultas mediante ordinarios (oficios). Es su producción cotidiana: miles al año, resolviendo casos concretos. Una fracción de esos ordinarios —los que fijan criterio o sientan precedente— se eleva a la categoría de dictamen y pasa a ser doctrina vinculante. Un dictamen lleva doble numeración (ORD. N°906/8 = ordinario 906, dictamen 8 del año); un ordinario simple lleva solo la primera. La DT mantiene en su sitio dos catálogos separados, Dictámenes y Ordinarios, y este monitor analiza los dos.

Las pestañas Dictámenes y Análisis cubren el catálogo de dictámenes (la doctrina, unas 5.000 fichas de 1990 y 1995–2026, 96% con doble numeración): qué criterios fija la DT y cómo evolucionan. La pestaña Ordinarios cubre el catálogo de Ordinarios ( oficios 2016–2026): el pulso del día a día consultivo. Por eso "dictámenes por año" mide la cobertura del catálogo de doctrina —no toda la actividad de la DT—; la baja reciente puede reflejar cuántos ordinarios se elevaron a dictamen, no menos trabajo.

Fuente

Unas 5.000 fichas de dictámenes descargadas del catálogo "Normativa" de la DT (dt.gob.cl). Para 1990–2019 el texto completo viene embebido en la ficha; los años recientes separan ficha + PDF.

OCR de escaneados

Los dictámenes recientes en PDF escaneado (alrededor de 150) no tenían texto, lo que inflaba falsamente el "de oficio". Se les aplicó OCR y se re-extrajeron: de 107 falsos "de oficio", solo 13 lo eran realmente; el resto eran consultas de organismos, sindicatos y empresas.

Distribución temática (mapa de calor)

Cada ficha trae una materia con descriptores (Negociación colectiva; Procedencia;…). 12 ejes definidos por patrones de palabras clave, más un residual Otros (13 categorías en total); cada dictamen se asigna a un solo eje por orden de prioridad (mutuamente excluyente), y lo no clasificado cae en "Otros". Las columnas son el % de los dictámenes de cada gobierno en cada eje, sobre el total del gobierno.

Quién solicita

Una herramienta de IA lee el texto de cada dictamen y clasifica al solicitante —empresa, trabajador con/sin sindicato, Estado/organismo o DT de oficio— con un esquema cerrado. El solicitante queda identificado en el 98% de las fichas; el 2% restante (sin solicitante determinable o sin texto extraíble) se agrupa en No identificable.

Ambos gráficos se calculan sobre el mismo universo: todos los dictámenes por gobierno de los documentos procesados. Por eso el n de cada gobierno es el mismo en el mapa de calor y en quién solicita, y las barras —incluido No identificable— suman 100% sobre ese total.

Sector y región

La misma extracción con IA deriva el sector del nombre de la empresa (no del cuerpo legal, que contamina), la región de la Inspección del Trabajo de origen, y el organismo público cuando el solicitante es el Estado.

Corpus de ordinarios (pestaña aparte)

Se aplicó extracción mediante herramientas de IA a los ordinarios 2016–2026: solicitante, empresa, sector y región. El solicitante queda identificado en el de los casos, la región en el y el sector en el ; el 5% residual son oficios muy breves o de 2025 (los más recientes). Las regiones se normalizaron a las 16 canónicas (los textos traen variantes como "Región Metropolitana" vs "Metropolitana de Santiago").

Los números que no cuadran entre sí (y por qué)

Tres cifras del monitor cuentan cosas distintas y a primera vista parecen contradecirse. Ninguna es un error, pero conviene tenerlas claras antes de citar el sitio:

dictámenes, no unos 5.000. El corpus descargado tiene fichas, pero no traen doble numeración (el ORD. N°906/8 que identifica al dictamen dentro del año). Sin ese identificador no se pueden enlazar con las Concordancias de los ordinarios ni citar sin ambigüedad, de modo que quedan fuera del índice, del buscador y de todos los rankings. Las cifras y los análisis usan los que tienen doble numeración.

ordinarios en el pie de página, en el buscador. La diferencia son oficios cuya ficha existe pero no trae materia o fecha que se pueda procesar: entran en los conteos por año y en la serie mensual, y quedan fuera del índice de búsqueda, que necesita ambos campos.

"1990 y 1995–2026" no es una errata. El catálogo de la DT publica 47 dictámenes de 1990 y después nada hasta 1995. Es un salto de la fuente, no del monitor. Por eso el corpus se describe así, y por eso algunas series arrancan en 1995: 1990 es un año parcial de 47 documentos y su porcentaje distorsiona el inicio de cualquier gráfico. Donde el corte importa, la tarjeta lo dice.

El último año siempre parece un desplome. La DT publica con rezago —un ordinario de mayo puede aparecer en agosto—, de modo que el tramo final de toda serie está incompleto y se lee como una caída que no ocurrió. Las tarjetas que dependen de eso recortan la cola inmadura o lo advierten; en las series anuales completas, el último punto es siempre parcial.

Cómo se calcula cada cosa

Revisiones de doctrina (, se puede abrir). Primero se filtran candidatos por reglas: dictámenes cuya materia o cuerpo menciona reconsideración, deja sin efecto, complementa/aclara doctrina, modifica criterio o fija sentido y alcance ( candidatos). Luego una herramienta de IA lee cada uno y lo clasifica en: deja sin efecto (revoca doctrina previa, incluye reconsideración acogida), reconsideración rechazada (se pidió revisar y la doctrina se confirmó), complementa, aclara, o no es revisión — esta última descarta, por ejemplo, reconsideraciones de multas individuales, que no son doctrina ( revisiones reales). La IA extrae además el número y fecha del dictamen revisado, con lo que se calcula el gobierno de origen de la doctrina revisada y se detectan las revisiones cruzadas (un gobierno revisando doctrina de otro). Al hacer clic en las cifras se abre el listado completo caso a caso.

Detalle de cada revocación/modificación. Sobre los casos deja sin efecto, complementa y aclara, un segundo pase de IA lee el dictamen que revisa y, cuando el revisado está en el corpus, también su texto, y resume en una frase cada uno: qué decía la doctrina anterior, qué dice ahora el nuevo criterio y por qué se sustituyó o modificó (el fundamento que el propio dictamen invoca: cambio legal, nueva interpretación, error del criterio previo). Si el texto no permite determinar algo con certeza, el campo queda vacío en vez de inventarse. En la tarjeta de doctrina modificada solo se listan los casos con doctrina previa identificable: los dictámenes que únicamente fijan el sentido de una ley nueva no revisan doctrina y quedan fuera. Para dictámenes recientes cuyo contenido está solo en PDF escaneado, el texto se recupera por OCR antes de ambos pases.

PageRank de la doctrina. De las Concordancias de cada ordinario se toman los dictámenes que lista; dos dictámenes quedan conectados si aparecen juntos en las Concordancias de un mismo ordinario (peso 1/(k−1), donde k es cuántos dictámenes lista ese ordinario — así un oficio con lista gigante no domina la red). Sobre esa red de dictámenes se corre PageRank. La diferencia entre el rank por PageRank y el rank por conteo bruto distingue doctrina transversal (conecta barrios temáticos distintos) de doctrina popular pero encapsulada.

Agenda consultiva vs doctrinaria (, se puede abrir). Los mismos 13 ejes temáticos de la doctrina (taxonomía por orden de prioridad sobre los descriptores) se aplican a los descriptores de cada ordinario (bloque MAT: de la ficha o, si la ficha no trae cuerpo, los descriptores del encabezado). Cada documento cae en UN eje. El de consultas "fuera de taxonomía" se puede inspeccionar haciendo clic en la cifra: son mayormente comités paritarios, licencias médicas, bonos y documentación electrónica.

Serie mensual y reformas. Conteo simple de ordinarios por mes de emisión (todas las fichas traen fecha). Las líneas verticales marcan la entrada en vigencia de cada reforma (no su aprobación).

Artículos del Código del Trabajo. Búsqueda automática sobre el texto completo de ambos conjuntos: se cuenta un artículo una sola vez por documento, y solo si la mención es atribuible al Código del Trabajo (la frase "del Código del Trabajo" aparece hasta 120 caracteres después, o inmediatamente antes). Artículos citados solo por número sin esa atribución quedan fuera (conteo conservador).

Latencia (, se puede abrir). Los antecedentes de muchos oficios mencionan la fecha de la presentación original ("presentación de fecha dd.mm.aaaa"). Se toma la presentación más antigua mencionada (la que abrió el expediente) y se cuentan los días hasta la fecha del ordinario. Detectable en oficios (): para las fichas sin cuerpo se usa el texto OCR del PDF. Se descartan los casos con fechas imposibles o con más de cinco años de diferencia. En la serie anual solo se grafican los años con al menos 20 casos. Sesgo conocido: los oficios que no citan la presentación (posiblemente respuestas rápidas) quedan fuera, de modo que la serie puede sobre-estimar. Al hacer clic en la cifra se ve la distribución y los expedientes más lentos y más rápidos.

Validación de la extracción. Muestra aleatoria de ordinarios re-clasificada por un modelo de IA mayor con el mismo prompt y el mismo texto que vio el modelo inicial. Acuerdo: solicitante , región canónica , sector . Las discrepancias de sector son mayormente casos genuinamente ambiguos (corporaciones municipales: ¿educación o sector público?; empresas TI: ¿telecom o servicios?).

Buscador de dictámenes (pestaña Buscador). Índice embebido de los dictámenes con doble numeración: materia, eje, gobierno, ordinarios vinculados (con su split anterior/posterior), rank por vínculos y por PageRank, extracción con IA (solicitante/sector/región) y las revisiones de doctrina que hace o recibe. Cada ficha incluye además "qué resolvió": el resumen oficial que publica la DT (el párrafo dispositivo de la ficha, extraído del bloque RDIC./RORD. o del abstract de la página; cobertura ) — no es texto generado por IA. La búsqueda por número matchea el x/y; la búsqueda por texto exige que todos los términos aparezcan en la materia (sin acentos).

Buscador de ordinarios. Segundo índice embebido con los ordinarios 2016–2026 (numeración simple, se reinicia cada año — el año del dropdown desambigua): materia (bloque MAT/MATERIA de la ficha), eje temático, "qué resolvió" (bloque RORD/RESUMEN, cobertura — las fichas recientes sin cuerpo no lo traen), la extracción con IA (solicitante, empresa, sector, región) y los dictámenes que cita en sus Concordancias, con salto directo a la ficha del dictamen. La búsqueda por texto cubre materia y nombre de empresa.

Doctrina más citada por los ordinarios (puente entre ambos corpus)

Cada ficha de ordinario incluye una sección de "Concordancias" donde la DT enlaza la doctrina relacionada. Para la pestaña Doctrina viva (top 10 en gráfico y top 100 en tabla) contamos, por cada dictamen, cuántos ordinarios distintos lo listan en sus Concordancias, pero sólo los publicados DESPUÉS del dictamen (citas posteriores). El tema que se muestra es la materia oficial del dictamen.

Por qué sólo las citas posteriores. Las Concordancias son un índice temático retroactivo que la DT mantiene y actualiza: en los dictámenes más vinculados, la mayoría de los ordinarios enlazados son anteriores al dictamen (p.ej. el 96% de los 456 vinculados al N°2927/58, de dic-2021) — no pudieron "citarlo" al redactarse, la DT los enlazó hacia atrás al emitirlo. Y como el corpus de ordinarios sólo llega hasta 2016 hacia atrás, ordenar por el total premia mecánicamente a la doctrina reciente: 0% de vínculos retroactivos en dictámenes de los años noventa, cerca del 70% en los de los años 2020. Contar sólo las citas posteriores mide uso real de la doctrina y elimina ese sesgo; por eso el top vivo se reparte entre 2001 y 2024, no sólo en lo último. (La doble numeración x/y se reinicia cada año; el año se desambigua con la fecha que acompaña a cada referencia.)

⚠ Cómo leer estas cifras

  • Cobertura ≠ producción. El corpus es la doctrina publicada; "dictámenes por año" mide cobertura, no el total real de ordinarios.
  • Comparar distribuciones, no volúmenes. Los % por gobierno (mapa de calor) son más confiables que los conteos absolutos.
  • Cobertura de la extracción con IA (dictámenes): solicitante 98%, sector 79%, empresa/organismo 67%, región 64%. En ordinarios: solicitante 95%, región 81%, sector 75%. Sector, empresa y región son señales limpias pero de un subconjunto.
  • "Doctrina más citada" = relación temática. El ranking de dictámenes cuenta enlaces de Concordancias (índice que la DT mantiene en el tiempo), no citas al redactar. Mide qué doctrina sigue vigente, no causalidad.

Cómo leer revisiones, latencia y PageRank

  • Revisiones: detección por reglas + clasificación con IA sobre candidatos; las reconsideraciones de multas individuales se excluyen (no son doctrina). El volumen alto de los noventa refleja qué publicaba la DT entonces, no necesariamente más conflicto.
  • Latencia: solo casos donde el oficio menciona la fecha de la presentación original (). Oficios sin esa mención (p.ej. respuestas rápidas por correo) quedan fuera; la serie puede sobre-estimar los años con expedientes largos.
  • PageRank: red proyectada de co-aparición en Concordancias (peso 1/(k−1) por ordinario). Misma advertencia que el ranking de vínculos: mide relación temática del índice de la DT, no citas.
  • Validación de la extracción con IA: en una muestra aleatoria de ordinarios, un modelo de IA mayor coincide con el inicial en el del solicitante, de la región (canónica) y del sector.