Dashboard bibliométrico universal para revisión sistemática, estado del arte o marco teórico
# PROMPT — Dashboard bibliométrico universal para revisión sistemática, estado del arte o marco teórico
> Prompt reutilizable y parametrizable. Reemplaza los marcadores `[CORCHETES]` antes de usarlo. Sirve para **cualquier tema**: extrae datos de un lote de PDFs o MD, identifica **debilidades y vacíos** de la investigación y genera un **dashboard HTML de un solo archivo** con gráficos de todos los tipos, efectos y diseño.
---
## 0. ROL Y OBJETIVO
Actúa como **asistente experto en revisión sistemática de literatura (PRISMA 2020), análisis bibliométrico y desarrollo front-end**. Recibirás un lote de documentos académicos (PDF/Markdown) sobre **[OBJETO DE ESTUDIO]**, orientado a **[VARIABLES PRINCIPALES]** en **[POBLACIÓN Y CONTEXTO]**.
Tu tarea tiene tres fases estrictas y en este orden:
1. **Extracción** — codificar cada documento en una base de datos con campos controlados (sin inventar).
2. **Análisis de debilidades** — detectar vacíos temáticos, de contexto, metodológicos y temporales, y mapearlos a las preguntas de investigación.
3. **Visualización** — construir un dashboard HTML autocontenido con un catálogo completo de gráficos, efectos y diseño, que permita *leer de un vistazo* dónde es débil la evidencia.
Modo de trabajo: **[RSL completa | Estado del arte | Marco teórico]** (por defecto: RSL completa).
---
## 1. FASE 1 — EXTRACCIÓN DE DATOS (una fila por documento)
Regla de oro: **no resumas libremente**. Rellena solo los campos solicitados. Si un dato no aparece con evidencia textual, escribe exactamente `No determinado` / `No reportado` (nunca inventes DOI, muestra ni cifras). Un documento = una fila. Deduplica por DOI o por hash de contenido.
### 1.1 Vocabulario controlado con **palabra dominante** (anclaje semántico)
Cada categoría/subcategoría/enfoque tiene una **palabra dominante** marcada con `*` (raíz léxica o *stem*). Procedimiento de clasificación en 3 pasos: (1) identifica la palabra dominante que aparece con mayor frecuencia/relevancia temática en el documento; (2) asigna categoría, subcategoría y enfoque según esa palabra ganadora; (3) verifica coherencia: la palabra dominante emitida debe coincidir con la de la tabla del vocabulario.
Reemplaza estas tablas por el vocabulario de tu investigación (la estructura de 3 columnas se mantiene; el número de términos es ajustable):
**A) CATEGORÍAS** (elegir SOLO una por documento)
| # | Categoría controlada | Palabra dominante | Formas cubiertas |
|---|----------------------|-------------------|------------------|
| 1 | [Categoría 1] | [dominante*] | [forma1, forma2, …] |
| … | … | … | … |
**B) SUBCATEGORÍAS** (tema específico dentro de la categoría)
| Subcategoría | Palabra dominante | Categoría padre |
|--------------|-------------------|-----------------|
| [Subcat 1] | [dominante*] | [Categoría padre] |
| … | … | … |
**C) ENFOQUES** (elegir SOLO uno por documento)
| Enfoque controlado | Palabra dominante | Formas cubiertas |
|--------------------|-------------------|------------------|
| Empírico cuantitativo | cuantitativ* | encuesta, correlación, experimento |
| Empírico cualitativo | cualitativ* | entrevista, estudio de caso, etnografía |
| Mixto | mixt* | métodos mixtos |
| Revisión sistemática/panorámica | revisi* | review, scoping, PRISMA, meta-análisis |
| Teórico-conceptual | teóric* | ensayo, teoría, modelo conceptual |
| Normativo-documental | normativ* | ley, norma, guía, reglamento |
### 1.2 Columnas de salida (en este orden exacto)
`id` · `autores` (Apellido, Nombre / separados por “ / ”) · `anio` (4 dígitos; 0 si no consta) · `titulo` · `revista` · `doi` (vacío si no existe; **no inventar**) · `categoria` (lista A) · `palabra_dominante_cat` (con `*`) · `subcategoria` (lista B) · `palabra_dominante_sub` · `enfoque` (lista C) · `palabra_dominante_enc` · `rol` (`core`=objeto/instrumento directo; `ctx`=marco/contexto; `comp`=complementaria/tangencial) · `ipd` (Índice de Proximidad Disciplinaria 0–3: 0 base instrumental sin aplicación; 1 transferencia temática; 2 proximidad regional/equivalente; 3 convergencia exacta con objeto+población+contexto) · `pais` (o `No determinado`) · `seminal` (`TRUE` si origina un instrumento/teoría central; si no `FALSE`) · `instrumento` (nombre exacto o `Ninguno`) · `variable_rol` (`Independiente`/`Dependiente`/`Covariable`/`Mediadora`/`N/A`) · `diseno_estudio` · `muestra` (o `No reportado`) · `hallazgo_principal` (1–2 líneas) · `relevancia_objeto` (1–2 líneas: por qué es o no relevante para [OBJETO DE ESTUDIO] en [POBLACIÓN Y CONTEXTO]).
### 1.3 Preguntas de investigación
Define **[RQ1…RQn]**. Cada fila debe poder vincularse a una o más RQ (para el análisis de vacíos y los gráficos de cobertura).
---
## 2. FASE 2 — ANÁLISIS DE DEBILIDADES Y VACÍOS
Calcula, **solo a partir de los datos codificados** (no a partir de impresiones), los siguientes diagnósticos. Todos alimentan el dashboard.
1. **Vacíos temáticos** — categorías y subcategorías con 0 (vacío total) o 1 (escaso) referencias.
2. **Vacíos de contexto** — cobertura por país/región y por población; señala combinaciones sin evidencia empírica (p. ej. contexto exacto del estudio sin estudios empíricos).
3. **Vacíos por pregunta de investigación** — para cada RQ: ¿la responde el corpus? ¿con qué evidencia? ¿cuál es el vacío crítico? Asigna **severidad** (Crítica / Alta / Media-alta / Media / Baja).
4. **Debilidad metodológica** — proporción de evidencia empírica primaria frente a teórica/normativa/revisiones; nº de estudios experimentales/cuasi-experimentales; predominio de diseños de baja inferencia.
5. **Debilidad temporal** — distribución por año; concentración o envejecimiento del corpus; ausencia de literatura reciente.
6. **Sesgos del corpus** — geográfico (dominancia de una región), idiomático, de proveedor/instrumento, de tipo de fuente.
7. **Contaminación del corpus** — documentos ajenos al objeto (marcarlos `No determinado`, `rol=comp`, `ipd=0`) y listarlos para posible exclusión.
8. **Madurez del corpus** — índice sintético 0–100 combinando: % empírico primario, % con IPD≥2, diversidad de enfoques y cobertura de RQ.
Para cada vacío prioritario entrega: **palabras clave** (ES/EN + palabra dominante) y **ecuaciones de búsqueda booleanas por base de datos** (Scopus `TITLE-ABS-KEY( )`, Web of Science `TS=( )`, descriptores ERIC/DeCS/MeSH según disciplina, y cadenas para SciELO/Redalyc/Latindex/Dialnet/Google Scholar y repositorios locales), con truncamiento `*`, comillas y operadores AND/OR/NOT. Incluye filtros (años, idiomas, tipos de documento).
Añade además: **criterios de inclusión y exclusión** con su **justificación** (regla → porqué) y el **diagrama de flujo PRISMA 2020** con los n de identificación, cribado, elegibilidad e inclusión.
---
## 3. FASE 3 — DASHBOARD HTML (un solo archivo autocontenido)
Entrega un **único archivo `.html`** con todo el CSS y JS **en línea** y los datos embebidos como JSON en `<script>`. Sin dependencias externas obligatorias; si usas una librería de gráficos, cárgala desde `cdnjs` con *fallback* a render propio, o usa **vanilla JS + SVG/Canvas** para que funcione **offline**. Nada de `localStorage`.
### 3.1 Estructura de la página
1. **Encabezado** — título, objeto de estudio, variables, población/contexto y modo (RSL/estado del arte/marco teórico).
2. **Fila de KPIs** con **count-up animado**: total de referencias, `core`, empíricas, revisiones, IPD≥2, IPD=3 (contexto exacto), seminales, ajenas (revisar), índice de madurez.
3. **Rejilla de gráficos** (ver catálogo §3.2).
4. **Sección de vacíos**: matriz Categoría×Contexto (celdas rojas = sin referencias), tabla de vacíos por RQ con severidad, y tarjetas de “qué añadir” con palabras clave + ecuaciones (botón **Copiar** por consulta).
5. **Criterios de inclusión/exclusión** (tablas justificadas).
6. **Diagrama PRISMA 2020** (SVG embebido).
7. **Tabla de datos** completa: filtrable (categoría, enfoque, rol, IPD, país, año), con **búsqueda de texto**, **orden por columna**, DOIs clicables y **exportación CSV/JSON**.
8. **Vocabulario controlado** desplegable (tablas A/B/C con palabras dominantes).
9. **Resumen** automático (nº procesado, distribución, IPD≥2/3, frecuencia de palabras dominantes, archivos ajenos).
### 3.2 Catálogo de gráficos (incluir “todos los tipos” y, junto a cada uno, **qué debilidad revela**)
| Gráfico | Qué muestra | Debilidad que revela |
|---|---|---|
| **Barras** por categoría / enfoque / rol | Volumen por dimensión | Concentración o subrepresentación temática |
| **Dona / anillo** por rol o tipo de fuente | Composición del corpus | Exceso de contexto vs. evidencia `core` |
| **Treemap** Categoría → Subcategoría | Jerarquía y peso relativo | Subcategorías vacías o dominantes |
| **Heatmap / matriz** Categoría × Contexto (o × RQ) | Cruce cobertura-contexto | Celdas vacías = vacíos de evidencia |
| **Línea temporal** por año | Producción a lo largo del tiempo | Envejecimiento o ausencia de literatura reciente |
| **Área apilada** año × categoría | Evolución temática | Temas que nunca despegan o se estancan |
| **Burbujas** (año × IPD, tamaño = muestra) | Proximidad y robustez | Estudios cercanos al contexto pero de muestra débil |
| **Radar** de cobertura por RQ | Balance entre preguntas | RQ sin sostén empírico |
| **Barras divergentes** empírico vs. teórico/normativo | Balance metodológico | Sesgo hacia baja inferencia |
| **Mapa/coropleta o barras por país/región** | Distribución geográfica | Sesgo geográfico; contexto propio sin evidencia |
| **Nube de palabras / frecuencia** de palabras dominantes | Núcleo semántico | Dispersión o monotema |
| **Red de co-ocurrencia** (co-autoría o co-categorías) | Estructura del campo | Aislamiento temático; ausencia de puentes |
| **Sankey** RQ → Categoría → Enfoque | Flujo de la evidencia | Rutas inexistentes = vacíos |
| **Gauge / medidor** de madurez del corpus | Índice sintético 0–100 | Inmadurez global de la evidencia |
| **Barras apiladas 100%** IPD por categoría | Proximidad por tema | Temas alejados del contexto exacto |
Todos los gráficos deben **reaccionar a los filtros** (al filtrar la tabla, se recalculan). Ejes y leyendas etiquetados; paleta accesible y coherente (una familia de color por categoría, contraste suficiente en modo oscuro y claro); estados vacíos explícitos (“sin datos para este filtro”).
### 3.3 Efectos y diseño (aprovechando las técnicas de los recursos técnicos)
- **Animaciones de entrada**: *fade-in* y *slide-up* escalonado de tarjetas (IntersectionObserver); **count-up** de KPIs; transición suave de barras (`width`/`transform` con `transition` y `requestAnimationFrame` para las de Canvas) — técnica de animación por fotogramas al estilo *Foundation HTML5 Animation with JavaScript*.
- **Interacción**: *hover* con realce y **tooltips**; orden y filtrado con transición; botón **Copiar** con confirmación; alternador **modo oscuro/claro**; **sticky header** en la tabla.
- **Arquitectura JS**: patrón **módulo/revealing module** e IIFE para encapsular estado y evitar globales — al estilo *Pro JavaScript Design Patterns* y *JavaScript: The Good Parts*; funciones puras para *tally*/agregaciones; datos como única fuente de verdad.
- **Diseño**: rejilla responsiva (CSS Grid/Flex), tipografía legible con jerarquía, tarjetas con bordes suaves y sombras discretas, espaciado consistente; **responsive** a móvil (los recursos de *Building iPhone/Android Apps with HTML/CSS/JS* aplican para el layout táctil).
- **Rendimiento y robustez**: render diferido de gráficos pesados; sin recarga de red; grado de accesibilidad AA (roles ARIA en tablas y controles, foco visible, texto alternativo en SVG).
- **Exportación**: CSV y JSON de la vista filtrada; opción de exportar cada gráfico a PNG (Canvas `toDataURL`).
---
## 4. REGLAS DE CALIDAD
- Un documento = una fila; sin fusiones ni duplicados (deduplica por DOI/contenido).
- Sin evidencia textual → `No determinado` / `No reportado`. **Nunca** inventar DOI, muestra, país ni cifras.
- Mantén literalmente los términos de las listas A/B/C (sin sinónimos).
- Verifica coherencia de la palabra dominante emitida contra la tabla; corrige antes de emitir la fila.
- El `ipd` requiere juicio experto: compara el objeto del documento con [OBJETO DE ESTUDIO en POBLACIÓN Y CONTEXTO].
- Prioriza el dato singular, preciso y medible (número, fecha, cita exacta) sobre la etiqueta genérica.
- Marca y lista los documentos ajenos al objeto para su posible exclusión.
---
## 5. FORMATO DE SALIDA
1. **Archivo `dashboard.html`** autocontenido (deliverable principal, renderizable).
2. **`base_bibliometrica.csv`** (una fila por documento, columnas de §1.2).
3. Bloque de **resumen** (≤6 líneas): total procesado, distribución por categoría, nº con IPD≥2 y IPD=3, frecuencia de cada palabra dominante, vacíos críticos y archivos ajenos detectados.
4. Si procesas >15 documentos, entrega la tabla en bloques de 15 filas indicando “Continúa en el siguiente bloque”.
---
## 6. CONFIRMACIÓN PREVIA (obligatoria antes de procesar)
Antes de ejecutar, confirma que identificaste: (a) el objeto exacto —[OBJETO DE ESTUDIO], [VARIABLES PRINCIPALES], [POBLACIÓN Y CONTEXTO]—; (b) las tablas A/B/C con sus palabras dominantes; (c) las preguntas de investigación [RQ1…RQn]; (d) el modo (RSL/estado del arte/marco teórico). Procede documento por documento, sin omitir ninguno.
Comentarios
Publicar un comentario