Campos de datos

Esta página reúne los datos que Digitrack muestra en el Panel, el Explorador de evidencias y las exportaciones. La referencia sirve para entender qué describe cada campo, en qué parte de la aplicación aparece y qué significa cuando no está disponible.

Los nombres entre código corresponden a campos técnicos visibles sobre todo en JSON o en integraciones. En la interfaz aparecen normalmente traducidos, agrupados o convertidos en etiquetas legibles.

Nivel de corpus

El corpus es el conjunto de evidencias que Digitrack tiene disponible para el ámbito de análisis. Sobre ese conjunto se calculan el Panel, las búsquedas y las exportaciones.

El bloque de metadatos describe el alcance general:

  • date_start y date_end: primera y última fecha disponibles en el corpus o en el alcance consultado.
  • entries: número de entradas disponibles para ese alcance.
  • sources: fuentes presentes, como medios, redes sociales, foros, blogs u otros canales configurados.
  • themes: temas disponibles para los derechos digitales.
  • deaggregated: desgloses adicionales cuando existen, por ejemplo agrupaciones internas de noticias o blogs.

Campos de entrada

Una entrada es una evidencia individual. Es la unidad que aparece en el Explorador de evidencias y la base desde la que se construyen los agregados del Panel.

id identifica la entrada dentro del corpus. No describe el contenido por sí mismo; permite distinguir una evidencia de otra y sostener enlaces internos estables.

date es la fecha usada para filtros, ordenación, series temporales y búsquedas desde gráficos. Según la fuente, puede representar la fecha de publicación, captura o disponibilidad en el corpus.

source identifica el canal de procedencia. En la interfaz suele mostrarse como un nombre legible o un icono de fuente.

publisher describe el medio, sitio, cuenta, foro o editor cuando el dato está disponible. En noticias puede ser más informativo que el canal genérico.

title contiene el título cuando la fuente lo proporciona. En publicaciones breves puede no existir.

url enlaza con la fuente de origen cuando existe una dirección navegable y segura para mostrar.

original_content contiene el texto recuperado o normalizado de la entrada. Puede proceder de una noticia, publicación social, foro, blog o página web.

highlighted_content contiene el fragmento con coincidencias resaltadas cuando la entrada procede de una búsqueda de texto. Cuando no hay búsqueda textual o no hay coincidencias marcadas, la tarjeta muestra el contenido original disponible.

themes reúne los temas asignados a la entrada. Una entrada puede tener cero, uno o varios temas.

sentiment resume el tono general detectado. Los valores habituales son positivo, neutral o negativo.

emotion añade una clasificación emocional más específica, como alegría, tristeza, ira, miedo, sorpresa, asco o neutral.

country indica la clasificación geográfica cuando existe. La ausencia de país o los valores desconocidos indican falta de clasificación fiable para esa entrada.

impact agrupa métricas de alcance o interacción cuando la fuente las proporciona. El nombre y significado de cada métrica dependen del canal: respuestas, compartidos, comentarios, visualizaciones u otras señales equivalentes.

Datos del panel

El Panel no muestra entradas sueltas, sino agregados calculados sobre el corpus filtrado. Esos agregados proceden de varias familias de datos.

time_series organiza valores por fecha o por periodo agregado. Incluye entradas por fuente, temas, sentimiento, emociones e impacto cuando esos datos existen.

metadata.sources contiene recuentos por fuente para el alcance activo. metadata.total resume el volumen total de entradas.

keywords contiene palabras o expresiones frecuentes con su recuento. Puede aparecer como total o desglosado por fuente.

topic_momentum compara el recuento actual y anterior de cada tema. Sus campos principales son currentCount, previousCount y growthPct.

country_coverage resume la distribución por país y la parte del corpus sin clasificación geográfica. unknownCount y unknownSharePct describen esa zona sin país fiable.

Las correlaciones cruzan dos dimensiones del corpus. En el Panel aparecen como relaciones entre sentimiento e impacto, emoción e impacto, emoción y sentimiento, tema y sentimiento, tema y emoción, o fuente y sentimiento.

Ausencias, ceros y valores parciales

Un campo ausente no significa necesariamente valor cero. Normalmente indica que la fuente, el procesamiento o el alcance consultado no proporcionan ese dato.

Un valor 0 indica que el dato existe para esa métrica y que el recuento calculado es cero. Una lista vacía, como themes: [], indica que no hay elementos asignados para ese campo en esa entrada o alcance.

Algunas fuentes aportan más contexto que otras. Una noticia puede incluir título, medio y URL; una publicación social puede aportar métricas de interacción; un foro puede tener texto y fecha pero no todas las etiquetas.

Las búsquedas paginadas muestran una parte del conjunto de resultados. results_count describe el total estimado o disponible para la búsqueda, mientras que la página visible contiene solo las entradas devueltas en ese tramo.

Relación con exportaciones

El PDF conserva una lectura visual del Panel. Los CSV exportan las tablas asociadas a gráficos concretos. El JSON conserva la estructura más completa del corpus disponible para descarga.

Por eso un mismo dato puede aparecer con distinta forma según el soporte: etiqueta legible en la interfaz, columna en una tabla, clave técnica en JSON o serie agregada en un gráfico.