08 Muestreo y representatividad

1. Lo que dice la tesis

El Capítulo III declara un muestreo probabilístico bietápico: (1) selección aleatoria de tres IPS (instituciones prestadoras de servicios de salud) de alta complejidad a partir de los listados de las secretarías de salud de Bogotá y Cundinamarca; (2) dentro de cada institución, estratificación por estamento ocupacional y muestreo aleatorio simple en cada estrato, con la fórmula para poblaciones finitas, nivel de confianza del 85 % (Z = 1,44) y p = q = 0,5. El mismo apartado describe la segunda etapa como “muestreo estratificado por conveniencia funcional u ocupacional”.

2. Lo que exige la fórmula

Fórmula para poblaciones finitas: n = N·Z²·p·q / [e²·(N - 1) + Z²·p·q]. El valor Z = 1,44 es correcto para 85 % de confianza (valor exacto 1,4395). El texto no declara el error máximo admisible (e), sin el cual la fórmula no puede aplicarse. La tabla muestra la n que exige la fórmula según el tamaño de la plantilla (N) de cada IPS y distintos errores:

N (trabajadores de la IPS)e = 3 %e = 5 %e = 7 %e = 10 %
2001491037042
3001981237945
5002681478848
8003361659449
10003661729650
15004171839951
200044818810151
300048419510351
500051720010452
Población infinita57620810652

Sin la N de cada IPS no se puede verificar si la muestra cumple la fórmula. Lo que sí puede calcularse es el error que se alcanza con la n obtenida (suponiendo N grande) y hasta qué tamaño de plantilla esa n bastaría para un error del 5 %:

Instituciónn originalError con n originaln depuradaError con n depuradaPlantilla máxima para la que la n depurada logra e = 5 %
HCC2015,1 %1725,5 %N ≤ 1004
Mario Gaitán1525,8 %1419,2 %N ≤ 15
Clínica del Occidente1505,9 %3711,8 %N ≤ 45
Total5033,2 %2234,8 %Cualquiera

Con las filas recibidas, las tres instituciones parecían cumplir un error cercano al 5 %. Con los casos únicos, solo HCC se acerca a ese estándar; Mario Gaitán y Clínica del Occidente quedan con errores de 19 % y 12 %, inaceptables para estimar la situación de cada institución.

3. ¿Fue realmente probabilístico?

Requisito de un muestreo probabilísticoEvidencia disponibleValoración
Marco muestral de IPS de alta complejidad y sorteo de 3No se reporta el listado, su tamaño ni el procedimiento de sorteo; la tesis destaca el acceso privilegiado del investigador a gerencias de la regiónProbablemente por conveniencia (selección intencional por acceso)
N por estamento en cada IPSNo se reportaNo verificable
Selección aleatoria dentro de cada estrato (listas de personal, sorteo)No se describe; la tesis dice “por conveniencia funcional”Contradicción interna; probablemente no aleatoria
Asignación por estrato (proporcional u óptima)No se reportaNo verificable
Tasa de respuestaNo se reportaNo verificable
Independencia de las observaciones280 filas duplicadas (nota 01)No se cumple en la base recibida

Valoración. Con la información disponible, el muestreo debe describirse como no probabilístico (por conveniencia), con cuotas aproximadas por estamento, a menos que Héctor documente el sorteo de instituciones y de personas. Declarar un diseño probabilístico que no puede demostrarse es uno de los puntos que un jurado detecta con más facilidad.

4. Efecto de diseño por conglomerado

Las tres instituciones son conglomerados. Si las personas de una misma institución se parecen entre sí, la información efectiva es menor que la n nominal.

Variable (base depurada)Correlación intraclase CCI(1)Efecto de diseñon efectiva
GSTH0,0816,9432
SE Cap. III0,0454,2852
Desarrollo organizacional-0,010 (se toma 0)1,00223
Sostenibilidad (56-60)-0,024 (se toma 0)1,00223

Para la GSTH, el 8 % de la variación se debe a la institución, lo que con conglomerados de tamaño medio 74 reduce la n efectiva para estimar la media poblacional a unas 32 personas. Con solo tres conglomerados, además, no es posible generalizar a “las IPS de alta complejidad de Bogotá y Soacha”: la inferencia válida se limita a las tres instituciones estudiadas. Para las relaciones entre variables (H1 a H4) el problema es menor, pero conviene controlar la institución (se hizo en la nota 06 como análisis de sensibilidad).

5. Representatividad por estamento

Estamento% original% depuradan depurada
Enfermería auxiliar36,235,980
Profesional asistencial26,025,657
Técnico/tecnólogo11,314,833
Médico11,511,225
Administrativo/directivo4,24,911
Apoyo8,54,911
Otro/no clasificable2,22,76

La composición se parece a la de un hospital de alta complejidad (predominio de enfermería), pero no puede compararse con la plantilla real porque no se dispone de ella. Varios estratos que la tesis declara están prácticamente vacíos en la base depurada: directivos (4 casos), vigilancia (2), operarios de mantenimiento (2), servicios generales (2) y técnicos sin especificar (2). No es posible hacer inferencias por estrato para esos grupos, y la propia agrupación en seis estamentos usada en la nota 07 es una decisión necesaria por tamaño.

6. Qué debe reportar Héctor

  1. N total de trabajadores de cada IPS en el periodo de recolección, y N por estamento.
  2. El error máximo admisible (e) que usó en la fórmula y la n calculada para cada IPS y estrato.
  3. Cómo se escogieron las tres IPS (listado, número de instituciones elegibles, sorteo o selección intencional) y cómo se escogieron las personas dentro de cada estrato.
  4. Número de cuestionarios entregados, devueltos y válidos (tasa de respuesta) por institución.
  5. Aclaración y corrección de la duplicación de registros (nota 01).

Si no puede documentar el sorteo, la redacción honesta es “muestreo no probabilístico por conveniencia con cuotas por estamento”, y las conclusiones deben limitarse a las instituciones participantes.

Qué escribir en la tesis

Párrafo modelo para el Capítulo III (ajuste recomendado). La muestra se obtuvo mediante un muestreo no probabilístico por conveniencia en tres instituciones de salud de alta complejidad de Bogotá D.C. y Soacha, seleccionadas por su disposición a participar, con cuotas por estamento ocupacional. A modo de referencia, se estimó el tamaño muestral con la fórmula para poblaciones finitas, con un nivel de confianza del 85 % (Z = 1,44), p = q = 0,5 y un error máximo de [e] %, a partir de una población de [N] trabajadores en la institución A, [N] en la B y [N] en la C.

Párrafo modelo para el Capítulo IV (provisional; base depurada). La muestra analizada quedó conformada por 223 trabajadores con registros únicos: 172 del Hospital HCC, 37 de la Clínica del Occidente y 14 del Hospital Mario Gaitán. Con un nivel de confianza del 85 %, el error máximo de estimación para el total fue de 4,8 %, y para cada institución de 5,5 %, 11,8 % y 19,2 %, respectivamente, por lo que las estimaciones por institución distintas del Hospital HCC deben considerarse descriptivas. La correlación intraclase de la gestión sostenible del talento humano entre instituciones fue de 0,081, lo que indica que la pertenencia institucional explica una fracción pequeña pero no despreciable de la variabilidad.

Ver también: 01 Calidad de la base de datos, 07 Comparaciones por institución y estamento.

Tus sugerencias sobre esta página

Pulsa el micrófono y comenta lo que quieras: qué cambiarías, qué falta, qué no refleja tu postura. La grabación le llega a Juan Camilo, que la transcribe y ajusta la tesis. Los cambios quedan registrados en la Bitácora de cambios.