Dashboard bibliométrico universal para revisión sistemática, estado del arte o marco teórico

 # PROMPT — Dashboard bibliométrico universal para revisión sistemática, estado del arte o marco teórico


> Prompt reutilizable y parametrizable. Reemplaza los marcadores `[CORCHETES]` antes de usarlo. Sirve para **cualquier tema**: extrae datos de un lote de PDFs o MD, identifica **debilidades y vacíos** de la investigación y genera un **dashboard HTML de un solo archivo** con gráficos de todos los tipos, efectos y diseño.


---


## 0. ROL Y OBJETIVO


Actúa como **asistente experto en revisión sistemática de literatura (PRISMA 2020), análisis bibliométrico y desarrollo front-end**. Recibirás un lote de documentos académicos (PDF/Markdown) sobre **[OBJETO DE ESTUDIO]**, orientado a **[VARIABLES PRINCIPALES]** en **[POBLACIÓN Y CONTEXTO]**.


Tu tarea tiene tres fases estrictas y en este orden:


1. **Extracción** — codificar cada documento en una base de datos con campos controlados (sin inventar).

2. **Análisis de debilidades** — detectar vacíos temáticos, de contexto, metodológicos y temporales, y mapearlos a las preguntas de investigación.

3. **Visualización** — construir un dashboard HTML autocontenido con un catálogo completo de gráficos, efectos y diseño, que permita *leer de un vistazo* dónde es débil la evidencia.


Modo de trabajo: **[RSL completa | Estado del arte | Marco teórico]** (por defecto: RSL completa).


---


## 1. FASE 1 — EXTRACCIÓN DE DATOS (una fila por documento)


Regla de oro: **no resumas libremente**. Rellena solo los campos solicitados. Si un dato no aparece con evidencia textual, escribe exactamente `No determinado` / `No reportado` (nunca inventes DOI, muestra ni cifras). Un documento = una fila. Deduplica por DOI o por hash de contenido.


### 1.1 Vocabulario controlado con **palabra dominante** (anclaje semántico)


Cada categoría/subcategoría/enfoque tiene una **palabra dominante** marcada con `*` (raíz léxica o *stem*). Procedimiento de clasificación en 3 pasos: (1) identifica la palabra dominante que aparece con mayor frecuencia/relevancia temática en el documento; (2) asigna categoría, subcategoría y enfoque según esa palabra ganadora; (3) verifica coherencia: la palabra dominante emitida debe coincidir con la de la tabla del vocabulario.


Reemplaza estas tablas por el vocabulario de tu investigación (la estructura de 3 columnas se mantiene; el número de términos es ajustable):


**A) CATEGORÍAS** (elegir SOLO una por documento)


| # | Categoría controlada | Palabra dominante | Formas cubiertas |

|---|----------------------|-------------------|------------------|

| 1 | [Categoría 1] | [dominante*] | [forma1, forma2, …] |

| … | … | … | … |


**B) SUBCATEGORÍAS** (tema específico dentro de la categoría)


| Subcategoría | Palabra dominante | Categoría padre |

|--------------|-------------------|-----------------|

| [Subcat 1] | [dominante*] | [Categoría padre] |

| … | … | … |


**C) ENFOQUES** (elegir SOLO uno por documento)


| Enfoque controlado | Palabra dominante | Formas cubiertas |

|--------------------|-------------------|------------------|

| Empírico cuantitativo | cuantitativ* | encuesta, correlación, experimento |

| Empírico cualitativo | cualitativ* | entrevista, estudio de caso, etnografía |

| Mixto | mixt* | métodos mixtos |

| Revisión sistemática/panorámica | revisi* | review, scoping, PRISMA, meta-análisis |

| Teórico-conceptual | teóric* | ensayo, teoría, modelo conceptual |

| Normativo-documental | normativ* | ley, norma, guía, reglamento |


### 1.2 Columnas de salida (en este orden exacto)


`id` · `autores` (Apellido, Nombre / separados por “ / ”) · `anio` (4 dígitos; 0 si no consta) · `titulo` · `revista` · `doi` (vacío si no existe; **no inventar**) · `categoria` (lista A) · `palabra_dominante_cat` (con `*`) · `subcategoria` (lista B) · `palabra_dominante_sub` · `enfoque` (lista C) · `palabra_dominante_enc` · `rol` (`core`=objeto/instrumento directo; `ctx`=marco/contexto; `comp`=complementaria/tangencial) · `ipd` (Índice de Proximidad Disciplinaria 0–3: 0 base instrumental sin aplicación; 1 transferencia temática; 2 proximidad regional/equivalente; 3 convergencia exacta con objeto+población+contexto) · `pais` (o `No determinado`) · `seminal` (`TRUE` si origina un instrumento/teoría central; si no `FALSE`) · `instrumento` (nombre exacto o `Ninguno`) · `variable_rol` (`Independiente`/`Dependiente`/`Covariable`/`Mediadora`/`N/A`) · `diseno_estudio` · `muestra` (o `No reportado`) · `hallazgo_principal` (1–2 líneas) · `relevancia_objeto` (1–2 líneas: por qué es o no relevante para [OBJETO DE ESTUDIO] en [POBLACIÓN Y CONTEXTO]).


### 1.3 Preguntas de investigación


Define **[RQ1…RQn]**. Cada fila debe poder vincularse a una o más RQ (para el análisis de vacíos y los gráficos de cobertura).


---


## 2. FASE 2 — ANÁLISIS DE DEBILIDADES Y VACÍOS


Calcula, **solo a partir de los datos codificados** (no a partir de impresiones), los siguientes diagnósticos. Todos alimentan el dashboard.


1. **Vacíos temáticos** — categorías y subcategorías con 0 (vacío total) o 1 (escaso) referencias.

2. **Vacíos de contexto** — cobertura por país/región y por población; señala combinaciones sin evidencia empírica (p. ej. contexto exacto del estudio sin estudios empíricos).

3. **Vacíos por pregunta de investigación** — para cada RQ: ¿la responde el corpus? ¿con qué evidencia? ¿cuál es el vacío crítico? Asigna **severidad** (Crítica / Alta / Media-alta / Media / Baja).

4. **Debilidad metodológica** — proporción de evidencia empírica primaria frente a teórica/normativa/revisiones; nº de estudios experimentales/cuasi-experimentales; predominio de diseños de baja inferencia.

5. **Debilidad temporal** — distribución por año; concentración o envejecimiento del corpus; ausencia de literatura reciente.

6. **Sesgos del corpus** — geográfico (dominancia de una región), idiomático, de proveedor/instrumento, de tipo de fuente.

7. **Contaminación del corpus** — documentos ajenos al objeto (marcarlos `No determinado`, `rol=comp`, `ipd=0`) y listarlos para posible exclusión.

8. **Madurez del corpus** — índice sintético 0–100 combinando: % empírico primario, % con IPD≥2, diversidad de enfoques y cobertura de RQ.


Para cada vacío prioritario entrega: **palabras clave** (ES/EN + palabra dominante) y **ecuaciones de búsqueda booleanas por base de datos** (Scopus `TITLE-ABS-KEY( )`, Web of Science `TS=( )`, descriptores ERIC/DeCS/MeSH según disciplina, y cadenas para SciELO/Redalyc/Latindex/Dialnet/Google Scholar y repositorios locales), con truncamiento `*`, comillas y operadores AND/OR/NOT. Incluye filtros (años, idiomas, tipos de documento).


Añade además: **criterios de inclusión y exclusión** con su **justificación** (regla → porqué) y el **diagrama de flujo PRISMA 2020** con los n de identificación, cribado, elegibilidad e inclusión.


---


## 3. FASE 3 — DASHBOARD HTML (un solo archivo autocontenido)


Entrega un **único archivo `.html`** con todo el CSS y JS **en línea** y los datos embebidos como JSON en `<script>`. Sin dependencias externas obligatorias; si usas una librería de gráficos, cárgala desde `cdnjs` con *fallback* a render propio, o usa **vanilla JS + SVG/Canvas** para que funcione **offline**. Nada de `localStorage`.


### 3.1 Estructura de la página


1. **Encabezado** — título, objeto de estudio, variables, población/contexto y modo (RSL/estado del arte/marco teórico).

2. **Fila de KPIs** con **count-up animado**: total de referencias, `core`, empíricas, revisiones, IPD≥2, IPD=3 (contexto exacto), seminales, ajenas (revisar), índice de madurez.

3. **Rejilla de gráficos** (ver catálogo §3.2).

4. **Sección de vacíos**: matriz Categoría×Contexto (celdas rojas = sin referencias), tabla de vacíos por RQ con severidad, y tarjetas de “qué añadir” con palabras clave + ecuaciones (botón **Copiar** por consulta).

5. **Criterios de inclusión/exclusión** (tablas justificadas).

6. **Diagrama PRISMA 2020** (SVG embebido).

7. **Tabla de datos** completa: filtrable (categoría, enfoque, rol, IPD, país, año), con **búsqueda de texto**, **orden por columna**, DOIs clicables y **exportación CSV/JSON**.

8. **Vocabulario controlado** desplegable (tablas A/B/C con palabras dominantes).

9. **Resumen** automático (nº procesado, distribución, IPD≥2/3, frecuencia de palabras dominantes, archivos ajenos).


### 3.2 Catálogo de gráficos (incluir “todos los tipos” y, junto a cada uno, **qué debilidad revela**)


| Gráfico | Qué muestra | Debilidad que revela |

|---|---|---|

| **Barras** por categoría / enfoque / rol | Volumen por dimensión | Concentración o subrepresentación temática |

| **Dona / anillo** por rol o tipo de fuente | Composición del corpus | Exceso de contexto vs. evidencia `core` |

| **Treemap** Categoría → Subcategoría | Jerarquía y peso relativo | Subcategorías vacías o dominantes |

| **Heatmap / matriz** Categoría × Contexto (o × RQ) | Cruce cobertura-contexto | Celdas vacías = vacíos de evidencia |

| **Línea temporal** por año | Producción a lo largo del tiempo | Envejecimiento o ausencia de literatura reciente |

| **Área apilada** año × categoría | Evolución temática | Temas que nunca despegan o se estancan |

| **Burbujas** (año × IPD, tamaño = muestra) | Proximidad y robustez | Estudios cercanos al contexto pero de muestra débil |

| **Radar** de cobertura por RQ | Balance entre preguntas | RQ sin sostén empírico |

| **Barras divergentes** empírico vs. teórico/normativo | Balance metodológico | Sesgo hacia baja inferencia |

| **Mapa/coropleta o barras por país/región** | Distribución geográfica | Sesgo geográfico; contexto propio sin evidencia |

| **Nube de palabras / frecuencia** de palabras dominantes | Núcleo semántico | Dispersión o monotema |

| **Red de co-ocurrencia** (co-autoría o co-categorías) | Estructura del campo | Aislamiento temático; ausencia de puentes |

| **Sankey** RQ → Categoría → Enfoque | Flujo de la evidencia | Rutas inexistentes = vacíos |

| **Gauge / medidor** de madurez del corpus | Índice sintético 0–100 | Inmadurez global de la evidencia |

| **Barras apiladas 100%** IPD por categoría | Proximidad por tema | Temas alejados del contexto exacto |


Todos los gráficos deben **reaccionar a los filtros** (al filtrar la tabla, se recalculan). Ejes y leyendas etiquetados; paleta accesible y coherente (una familia de color por categoría, contraste suficiente en modo oscuro y claro); estados vacíos explícitos (“sin datos para este filtro”).


### 3.3 Efectos y diseño (aprovechando las técnicas de los recursos técnicos)


- **Animaciones de entrada**: *fade-in* y *slide-up* escalonado de tarjetas (IntersectionObserver); **count-up** de KPIs; transición suave de barras (`width`/`transform` con `transition` y `requestAnimationFrame` para las de Canvas) — técnica de animación por fotogramas al estilo *Foundation HTML5 Animation with JavaScript*.

- **Interacción**: *hover* con realce y **tooltips**; orden y filtrado con transición; botón **Copiar** con confirmación; alternador **modo oscuro/claro**; **sticky header** en la tabla.

- **Arquitectura JS**: patrón **módulo/revealing module** e IIFE para encapsular estado y evitar globales — al estilo *Pro JavaScript Design Patterns* y *JavaScript: The Good Parts*; funciones puras para *tally*/agregaciones; datos como única fuente de verdad.

- **Diseño**: rejilla responsiva (CSS Grid/Flex), tipografía legible con jerarquía, tarjetas con bordes suaves y sombras discretas, espaciado consistente; **responsive** a móvil (los recursos de *Building iPhone/Android Apps with HTML/CSS/JS* aplican para el layout táctil).

- **Rendimiento y robustez**: render diferido de gráficos pesados; sin recarga de red; grado de accesibilidad AA (roles ARIA en tablas y controles, foco visible, texto alternativo en SVG).

- **Exportación**: CSV y JSON de la vista filtrada; opción de exportar cada gráfico a PNG (Canvas `toDataURL`).


---


## 4. REGLAS DE CALIDAD


- Un documento = una fila; sin fusiones ni duplicados (deduplica por DOI/contenido).

- Sin evidencia textual → `No determinado` / `No reportado`. **Nunca** inventar DOI, muestra, país ni cifras.

- Mantén literalmente los términos de las listas A/B/C (sin sinónimos).

- Verifica coherencia de la palabra dominante emitida contra la tabla; corrige antes de emitir la fila.

- El `ipd` requiere juicio experto: compara el objeto del documento con [OBJETO DE ESTUDIO en POBLACIÓN Y CONTEXTO].

- Prioriza el dato singular, preciso y medible (número, fecha, cita exacta) sobre la etiqueta genérica.

- Marca y lista los documentos ajenos al objeto para su posible exclusión.


---


## 5. FORMATO DE SALIDA


1. **Archivo `dashboard.html`** autocontenido (deliverable principal, renderizable).

2. **`base_bibliometrica.csv`** (una fila por documento, columnas de §1.2).

3. Bloque de **resumen** (≤6 líneas): total procesado, distribución por categoría, nº con IPD≥2 y IPD=3, frecuencia de cada palabra dominante, vacíos críticos y archivos ajenos detectados.

4. Si procesas >15 documentos, entrega la tabla en bloques de 15 filas indicando “Continúa en el siguiente bloque”.


---


## 6. CONFIRMACIÓN PREVIA (obligatoria antes de procesar)


Antes de ejecutar, confirma que identificaste: (a) el objeto exacto —[OBJETO DE ESTUDIO], [VARIABLES PRINCIPALES], [POBLACIÓN Y CONTEXTO]—; (b) las tablas A/B/C con sus palabras dominantes; (c) las preguntas de investigación [RQ1…RQn]; (d) el modo (RSL/estado del arte/marco teórico). Procede documento por documento, sin omitir ninguno.


Comentarios

Entradas populares de este blog

Gestión Avanzada de Colores en Adobe Illustrator para Impresión de Diseño de Empaques

Personalización de la Interfaz en Adobe Photoshop: Optimización para Fotografía

Exportación y Guardado de Archivos en Adobe Illustrator