08 Muestreo y representatividad
1. Lo que dice la tesis
El Capítulo III declara un muestreo probabilístico bietápico: (1) selección aleatoria de tres IPS (instituciones prestadoras de servicios de salud) de alta complejidad a partir de los listados de las secretarías de salud de Bogotá y Cundinamarca; (2) dentro de cada institución, estratificación por estamento ocupacional y muestreo aleatorio simple en cada estrato, con la fórmula para poblaciones finitas, nivel de confianza del 85 % (Z = 1,44) y p = q = 0,5. El mismo apartado describe la segunda etapa como “muestreo estratificado por conveniencia funcional u ocupacional”.
2. Lo que exige la fórmula
Fórmula para poblaciones finitas: n = N·Z²·p·q / [e²·(N - 1) + Z²·p·q]. El valor Z = 1,44 es correcto para 85 % de confianza (valor exacto 1,4395). El texto no declara el error máximo admisible (e), sin el cual la fórmula no puede aplicarse. La tabla muestra la n que exige la fórmula según el tamaño de la plantilla (N) de cada IPS y distintos errores:
| N (trabajadores de la IPS) | e = 3 % | e = 5 % | e = 7 % | e = 10 % |
|---|---|---|---|---|
| 200 | 149 | 103 | 70 | 42 |
| 300 | 198 | 123 | 79 | 45 |
| 500 | 268 | 147 | 88 | 48 |
| 800 | 336 | 165 | 94 | 49 |
| 1000 | 366 | 172 | 96 | 50 |
| 1500 | 417 | 183 | 99 | 51 |
| 2000 | 448 | 188 | 101 | 51 |
| 3000 | 484 | 195 | 103 | 51 |
| 5000 | 517 | 200 | 104 | 52 |
| Población infinita | 576 | 208 | 106 | 52 |
Sin la N de cada IPS no se puede verificar si la muestra cumple la fórmula. Lo que sí puede calcularse es el error que se alcanza con la n obtenida (suponiendo N grande) y hasta qué tamaño de plantilla esa n bastaría para un error del 5 %:
| Institución | n original | Error con n original | n depurada | Error con n depurada | Plantilla máxima para la que la n depurada logra e = 5 % |
|---|---|---|---|---|---|
| HCC | 201 | 5,1 % | 172 | 5,5 % | N ≤ 1004 |
| Mario Gaitán | 152 | 5,8 % | 14 | 19,2 % | N ≤ 15 |
| Clínica del Occidente | 150 | 5,9 % | 37 | 11,8 % | N ≤ 45 |
| Total | 503 | 3,2 % | 223 | 4,8 % | Cualquiera |
Con las filas recibidas, las tres instituciones parecían cumplir un error cercano al 5 %. Con los casos únicos, solo HCC se acerca a ese estándar; Mario Gaitán y Clínica del Occidente quedan con errores de 19 % y 12 %, inaceptables para estimar la situación de cada institución.
3. ¿Fue realmente probabilístico?
| Requisito de un muestreo probabilístico | Evidencia disponible | Valoración |
|---|---|---|
| Marco muestral de IPS de alta complejidad y sorteo de 3 | No se reporta el listado, su tamaño ni el procedimiento de sorteo; la tesis destaca el acceso privilegiado del investigador a gerencias de la región | Probablemente por conveniencia (selección intencional por acceso) |
| N por estamento en cada IPS | No se reporta | No verificable |
| Selección aleatoria dentro de cada estrato (listas de personal, sorteo) | No se describe; la tesis dice “por conveniencia funcional” | Contradicción interna; probablemente no aleatoria |
| Asignación por estrato (proporcional u óptima) | No se reporta | No verificable |
| Tasa de respuesta | No se reporta | No verificable |
| Independencia de las observaciones | 280 filas duplicadas (nota 01) | No se cumple en la base recibida |
Valoración. Con la información disponible, el muestreo debe describirse como no probabilístico (por conveniencia), con cuotas aproximadas por estamento, a menos que Héctor documente el sorteo de instituciones y de personas. Declarar un diseño probabilístico que no puede demostrarse es uno de los puntos que un jurado detecta con más facilidad.
4. Efecto de diseño por conglomerado
Las tres instituciones son conglomerados. Si las personas de una misma institución se parecen entre sí, la información efectiva es menor que la n nominal.
| Variable (base depurada) | Correlación intraclase CCI(1) | Efecto de diseño | n efectiva |
|---|---|---|---|
| GSTH | 0,081 | 6,94 | 32 |
| SE Cap. III | 0,045 | 4,28 | 52 |
| Desarrollo organizacional | -0,010 (se toma 0) | 1,00 | 223 |
| Sostenibilidad (56-60) | -0,024 (se toma 0) | 1,00 | 223 |
Para la GSTH, el 8 % de la variación se debe a la institución, lo que con conglomerados de tamaño medio 74 reduce la n efectiva para estimar la media poblacional a unas 32 personas. Con solo tres conglomerados, además, no es posible generalizar a “las IPS de alta complejidad de Bogotá y Soacha”: la inferencia válida se limita a las tres instituciones estudiadas. Para las relaciones entre variables (H1 a H4) el problema es menor, pero conviene controlar la institución (se hizo en la nota 06 como análisis de sensibilidad).
5. Representatividad por estamento
| Estamento | % original | % depurada | n depurada |
|---|---|---|---|
| Enfermería auxiliar | 36,2 | 35,9 | 80 |
| Profesional asistencial | 26,0 | 25,6 | 57 |
| Técnico/tecnólogo | 11,3 | 14,8 | 33 |
| Médico | 11,5 | 11,2 | 25 |
| Administrativo/directivo | 4,2 | 4,9 | 11 |
| Apoyo | 8,5 | 4,9 | 11 |
| Otro/no clasificable | 2,2 | 2,7 | 6 |
La composición se parece a la de un hospital de alta complejidad (predominio de enfermería), pero no puede compararse con la plantilla real porque no se dispone de ella. Varios estratos que la tesis declara están prácticamente vacíos en la base depurada: directivos (4 casos), vigilancia (2), operarios de mantenimiento (2), servicios generales (2) y técnicos sin especificar (2). No es posible hacer inferencias por estrato para esos grupos, y la propia agrupación en seis estamentos usada en la nota 07 es una decisión necesaria por tamaño.
6. Qué debe reportar Héctor
- N total de trabajadores de cada IPS en el periodo de recolección, y N por estamento.
- El error máximo admisible (e) que usó en la fórmula y la n calculada para cada IPS y estrato.
- Cómo se escogieron las tres IPS (listado, número de instituciones elegibles, sorteo o selección intencional) y cómo se escogieron las personas dentro de cada estrato.
- Número de cuestionarios entregados, devueltos y válidos (tasa de respuesta) por institución.
- Aclaración y corrección de la duplicación de registros (nota 01).
Si no puede documentar el sorteo, la redacción honesta es “muestreo no probabilístico por conveniencia con cuotas por estamento”, y las conclusiones deben limitarse a las instituciones participantes.
Qué escribir en la tesis
Párrafo modelo para el Capítulo III (ajuste recomendado). La muestra se obtuvo mediante un muestreo no probabilístico por conveniencia en tres instituciones de salud de alta complejidad de Bogotá D.C. y Soacha, seleccionadas por su disposición a participar, con cuotas por estamento ocupacional. A modo de referencia, se estimó el tamaño muestral con la fórmula para poblaciones finitas, con un nivel de confianza del 85 % (Z = 1,44), p = q = 0,5 y un error máximo de [e] %, a partir de una población de [N] trabajadores en la institución A, [N] en la B y [N] en la C.
Párrafo modelo para el Capítulo IV (provisional; base depurada). La muestra analizada quedó conformada por 223 trabajadores con registros únicos: 172 del Hospital HCC, 37 de la Clínica del Occidente y 14 del Hospital Mario Gaitán. Con un nivel de confianza del 85 %, el error máximo de estimación para el total fue de 4,8 %, y para cada institución de 5,5 %, 11,8 % y 19,2 %, respectivamente, por lo que las estimaciones por institución distintas del Hospital HCC deben considerarse descriptivas. La correlación intraclase de la gestión sostenible del talento humano entre instituciones fue de 0,081, lo que indica que la pertenencia institucional explica una fracción pequeña pero no despreciable de la variabilidad.
Ver también: 01 Calidad de la base de datos, 07 Comparaciones por institución y estamento.
Tus sugerencias sobre esta página
Pulsa el micrófono y comenta lo que quieras: qué cambiarías, qué falta, qué no refleja tu postura. La grabación le llega a Juan Camilo, que la transcribe y ajusta la tesis. Los cambios quedan registrados en la Bitácora de cambios.