Mostrando entradas con la etiqueta Estadística. Mostrar todas las entradas
Mostrando entradas con la etiqueta Estadística. Mostrar todas las entradas

lunes, 17 de febrero de 2025

Podcast - Potentials of ChatGPT (AI) in the analysis of scientific research data

Explorando el Potencial de ChatGPT en el Análisis de Datos Científicos

La inteligencia artificial está revolucionando el mundo de la investigación, y el análisis de datos científicos no es la excepción. En el podcast "Potentials of ChatGPT (AI) in the analysis of scientific research data", se exploran las diversas maneras en que herramientas como ChatGPT pueden facilitar, optimizar y ampliar las capacidades de los investigadores en el tratamiento de datos.

sábado, 19 de agosto de 2023

Descubre SCImago Graphica: Visualización de Datos Simplificada

Introducción:

En la era de la información, la capacidad de comprender y comunicar datos de manera efectiva se ha convertido en una habilidad esencial. SCImago Graphica, creada por Scimago Lab, es una herramienta que hace que el análisis y la visualización de datos sean accesibles para todos, sin importar tu nivel de experiencia en análisis de datos o programación. En esta entrada, exploraremos qué es SCImago Graphica, sus objetivos, características y funcionalidades que hacen que la visualización de datos sea más sencilla y poderosa que nunca.

SCImago Graphica: https://www.graphica.app/

¿Qué es SCImago Graphica?

SCImago Graphica es una aplicación de escritorio disponible tanto para Windows como para Mac que ha sido diseñada para el análisis, exploración y visualización de datos. Su objetivo principal es proporcionarte las herramientas necesarias para:

1. Analizar y Comprender Conjuntos de Datos: SCImago Graphica te permite adentrarte en la riqueza de tus datos, revelando patrones y relaciones ocultas.

2. Comunicar Visualmente Resultados: Con la capacidad de crear visualizaciones atractivas y significativas, puedes comunicar tus hallazgos de manera efectiva.

3. Generar Visualizaciones Interactivas: Tus visualizaciones son adaptables a múltiples pantallas y pueden ser compartidas en línea para una experiencia interactiva.

4. Extraer Conocimiento Subyacente: Mediante técnicas estadísticas, SCImago Graphica te ayuda a desentrañar el conocimiento oculto en tus datos.

Características y Funcionalidades de SCImago Graphica:

Características:

  • Aplicación de escritorio compatible con Windows y Mac.
  • Actualización automática cada vez que se lanza una nueva versión.
  • Capacidad para trabajar con varios formatos de datos tabulados como CSV o Excel.
  • Admite formatos de gráficos estándar como GraphML o GML.
  • Opciones de exportación a PNG, SVG y HTML.

Funcionalidades:

  • Diseño de visualizaciones intuitivo mediante arrastrar y soltar, sin necesidad de programación.
  • Funciones de clustering basadas tanto en estructuras de gráficos como en similitud entre vectores.
  • Herramientas de análisis de regresión.
  • Funcionalidad de visualización geográfica.
  • Herramientas de filtrado de datos para un control preciso.

SCImago Graphica es la herramienta perfecta para quienes desean profundizar en el análisis de datos y la visualización sin una curva de aprendizaje empinada. Ya sea que estés en el mundo académico, la investigación, el marketing o cualquier otro campo, SCImago Graphica te brinda el poder de transformar datos en información clara y comprensible. 

miércoles, 29 de junio de 2022

Tablas de contingencia 📊 - jamovi - Teoría y práctica - 📈 resultados en APA 7

Las tablas de contingencia (también llamadas a veces tablas dinámicas, tablas cruzadas, o crosstabs como se conocen en inglés) son una de las técnicas estadísticas más utilizadas en análisis de datos. En este tutorial comentaré algunos conceptos básicos para su análisis y también como elaborarlas en jamovi de forma muy fácil y sencilla y es que las tablas de contingencia es uno de los análisis más utilizados en investigación social y de la salud.

¡¡Comenzamos!!

Las tablas de contingencia son tablas de doble entrada, en cuyas entradas (o sea, filas y columnas) se sitúan las diferentes categorías de cada variable. A través de un análisis de tabla de contingencia podremos saber cómo se relacionan dos variables entre sí.

Por ejemplo, seguimos analizando la base de datos de estudiantes que hemos usado en videos anteriores, en este caso queremos saber si hay relación entre el rendimiento académico y si tienen acceso a internet en casa los estudiantes.

En las casillas de la tabla se ubican las frecuencias o número de casos. Estas frecuencias son:

Observadas: es el número real de casos en nuestro estudio

Esperadas: Número de casos que debería haber en la casilla si las categorías fueran independientes.

De igual manera, podemos agregarle cuanto representan estos valores con respecto a los totales, en porcentaje.

La tabla, además, comúnmente es presentada con los totales marginales para cada nivel de las variables y un total general

Para analizar las asociaciones entre dos variables se utilizan diferentes pruebas, la mayoría de ellas basan su cálculo en determinar si las frecuencias observadas difieren significativamente de las frecuencias esperadas, bajo la hipótesis nula de que no existe asociación.

Aunque la prueba más usada es la de chi-cuadrada, veremos algunas otras apoyándonos en el cuadro de estadísticas de jamovi para las tablas de contingencia.

- La Primera es precisamente Chi-cuadrada que, como les comentaba, parte de la hipótesis de que las variables son independientes, o sea, no existe relación entre ellas y ninguna ejerce influencia sobre la otra. Esto significa que si p > 0,05 se acepta esta hipótesis nula de independencia. Esta prueba se basa en la diferencia al cuadrado entre las frecuencias observadas y las esperadas. Se debe utilizar siempre que las frecuencias esperadas sean superiores a 5.

El problema surge con el uso indiscriminado de la prueba que, a veces, nos lleva a olvidar que el estadístico que utilizamos para el contraste, la ji-cuadrado, sigue una distribución aproximada que solo es útil cuando el número de observaciones es relativamente grande, pero que pierde efectividad cuando la información de que disponemos es escasa, lo que ocurre con cierta frecuencia.

Por eso, una vez construida la tabla de contingencia, comprobamos que no haya celdas con frecuencias menores de 5. Si esto ocurre, tenemos dos formas de solucionar el problema.

- Una es, la segunda opción, Chi-cuadrada con corrección de continuidad (Yates), la cual se usa cuando al menos una celda en la tabla de contingencia tiene una frecuencia esperada menor que 5. Esta corrección se basa en restar 0,5 a la diferencia entre valores observados y esperados al calcular el valor del estadístico ji-cuadrado.

- La otra opción es el Test exacto de Fisher que también es una corrección de Chi-cuadrada para cuando haya frecuencias esperadas <5, muchos autores consideran que es más segura que la corrección de continuidad. Esta prueba construye todas las tablas de contingencia más extremas que la observada y que cumplen con la dirección de la asociación de la tabla observada. Una vez calculada esta probabilidad exacta, se comparará con el nivel de significación estadística y se procederá a resolver el contraste de hipótesis.

El problema de estos métodos era que son mucho más laboriosos, lo que ha dificultaba su mayor utilización hasta que se dispuso de la potencia de cálculo actual. Esto explica la predilección histórica por el uso de las pruebas aproximadas como la de la chi-cuadrado.

·       Razón de verosimilitud, es una alternativa al estadístico Chi-cuadrado, La diferencia estriba en que en este caso se calcula la razón entre las frecuencias observadas y esperadas y se interpreta igual a Chi-cuadrado.

·       Prueba de z para diferencias de proporciones. A través de esta prueba se determina si existe una diferencia estadísticamente significativa entre los porcentajes obtenidos por cada una de las categorías de las variables. Es utilizada para tablas de 2 x 2.

Medidas de magnitud de la asociación

Ahora bien, como X2 y las demás pruebas no indica la magnitud de la asociación de las variables hay que otros estadísticos que complementen el análisis, según el tipo de variables que presente nuestro estudio, entre los más usados están:

Nominales

·       Tablas mayores a 2 x 2: Coeficiente de contingencia y V de Cramer

·       Para tablas 2x2: Coeficiente Phi, V de Cramer

Ordinales

·       Gamma

·       Tau b de Kendall

·       Mantel-Haenszel

Coeficiente de contingencia, es una extensión de Phi para el caso de tablas mayores a 2 x 2 pero no es una medida normalizada para este tipo de tablas pues oscila entre 0 para el caso de no asociación y Cmax (calculado), valor que nunca alcanza el 1.

-        0 indica independencia absoluta

-        Según el valor máximo que puede tomar, se calcula si la asociación es baja, moderada o alta.

V de Cramer: Obtiene valores entre 0 < V < 1, es también una extensión del coeficiente Phi pero en este caso, y a diferencia del Coeficiente de Contingencia, si se encuentra normalizada. El problema de este estadístico es que tiende a subestimar el grado de asociación entre las variables.

·       0 indica nada de relación

·       0,5 relación moderada

·       0,7 relación moderada-alta

·       1 relación perfecta

El Coeficiente Phi nos permite evaluar el grado de asociación entre dos variables, pero sólo esta normalizada, es decir oscila entre 0 y 1, en tablas de 2 x 2. En tablas con otras características toma valores >1. En estos casos lo recomendable es utilizar el Coeficiente de Contingencia.

Ordinales

Gamma es una medida del grado y tipo de asociación entre dos variables cualitativas ordinales que oscila entre -1 ( a medida que aumentan los valores de una variable, los de la otra disminuyen) y 1 (a medida que aumentan los valores de una variable los de la otra también aumentan) El 0 indica no asociación. La desventaja de esta medida es que alcanza tales valores, aunque la asociación no sea total, es decir, tiende a estar sobrestimada.

Tau-b- de Kendall:

Es una extensión de Gamma pero presenta la ventaja de que alcanza los valores -1 y 1 en situaciones de total asociación, aunque sólo para tablas cuadradas.

Mantel-Haenszel

Es un Test usado para comprobar la posible confusión que puede generar una tercera variable en la relación entre dos variables que se están analizando.

Se trata de estudiar si existe o no asociación entre una variable factor y otra variable respuesta, ambas dicotómicas, cuando se dispone de información referida a varios estratos (distintos grupos de edad o sexo, pacientes con diferente sintomatología, distintos grupos étnicos, distintas dosis de fármaco, etc.).

En estos casos, utilizar el estadístico χ2 sobre el conjunto de datos agrupados puede arrojar resultados inadecuados. Por otra parte, analizar separadamente cada estrato no proporciona una idea global del efecto de la variable factor.

Medidas comparativas (tablas 2 x 2)

También tenemos medidas comparativas que solo están disponibles para tablas de 2x2

Razón de odds (razón de probabilidades) Es una estadística que cuantifica la fuerza de asociación entre 2 variables o eventos, esta medida también indica el tamaño del efecto. Es una forma de expresar las probabilidades, con la que se indica la posibilidad con que suceda un evento, en relación con la probabilidad de otro.

-        Los odd ratio oscilan entre 0 e infinito.

-        Cuando el odd ratio es 1 indica ausencia de asociación entre las variables.

-        Los valores menores de 1 señalan una asociación negativa entre las variables y los valores mayores de 1 indican asociación positiva.

-        Cuanto más se aleje el odd ratio de 1, más fuerte es la relación.

-        Cuando el odd ratio es menor de 1 es conveniente calcular la inversa, es decir, 1/OR. De esta manera podemos expresar mejor la fortaleza de la relación.

Log Razón de odds

Esta segunda opción es el logaritmo natural de la razón de odds. La conversión al logaritmo permite obtener resultados simétricos alrededor de 0, lo cual es más fácil para su análisis.

Riesgo relativo

Es una medida semejante a Odd ratio (OR), pero es la razón de las proporciones, siendo su principal inconveniente que no está normalizada. De este modo, si las variables son independientes, su valor es 1. Es importante aclarar que si las dos proporciones son muy pequeñas su diferencia será muy pequeña, pero podría ser importante.

Diferencia de proporciones

Se utiliza para comprobar si hay diferencias entre estas proporciones, es decir, si se distribuyen homogéneamente entre los niveles de la variable o por el contrario, si existen diferencias.


miércoles, 22 de junio de 2022

¿Cómo está cambiando la temperatura en el mundo? 🌍🔥 - Un gráfico interes...

El cambio climático es uno de los mayores desafíos que enfrenta nuestro planeta en la actualidad. A medida que aumenta la temperatura global, los efectos negativos del cambio climático se vuelven cada vez más evidentes, desde la extinción de especies hasta la pérdida de hábitats naturales y la creciente frecuencia de eventos climáticos extremos.


En este contexto, un video que recientemente publicamos titulado "¿Cómo está cambiando la temperatura en el mundo? 🌍🔥 - Un gráfico interesante" es una herramienta valiosa para comprender mejor la magnitud del problema del cambio climático y cómo está cambiando la temperatura en todo el mundo.

El video presenta un gráfico que muestra las variaciones de temperatura promedio en todo el mundo . A medida que avanza el tiempo, el gráfico muestra cómo la temperatura media global ha aumentado de manera constante, con un aumento particularmente notable en las últimas décadas.

Además, el video proporciona información valiosa sobre lo que podemos hacer para abordar el cambio climático, incluyendo la reducción de las emisiones de gases de efecto invernadero y el fomento de prácticas sostenibles en la agricultura, la industria y el transporte.

En resumen, el video "¿Cómo está cambiando la temperatura en el mundo? 🌍🔥 - Un gráfico interesante" es una herramienta valiosa para aquellos interesados en comprender mejor el cambio climático y sus efectos en todo el mundo. Este video nos recuerda la importancia de tomar medidas para abordar el cambio climático y trabajar juntos hacia un futuro más sostenible.

lunes, 20 de junio de 2022

Pirámide poblacional con Jamovi 📊 – Módulo ClinicoPath Descriptives 📈

Hola amigos, seguimos aprendiendo jamovi, hoy les traigo un gráfico muy usado en ciencias sociales y de la salud, una pirámide poblacional, como las que estamos viendo. La pirámide visualiza de forma fácil el tipo de estructura de la población. Es un doble histograma de frecuencias dispuestos horizontalmente sobre el eje de las abscisas y en el eje de las ordenadas se disponen los grupos de edad (generalmente quinquenios), las edades más bajas se encuentran más cercanas a la base y las edades avanzadas hacia la cúspide.

La pirámide poblacional es una herramienta gráfica que se utiliza para representar la estructura de edad y género de una población en un momento determinado. La pirámide se llama así porque tiene la forma de una pirámide, con las barras que representan las diferentes edades y géneros que se superponen para formar la figura.


Momentos claves
00:00 Presentación 🤓
00:54 Página Módulo ClinicoPath Descriptives
01:39 Ejecución en jamovi
03:00 Despedida

jueves, 16 de junio de 2022

Análisis de correlación lineal con Jamovi 📊 – incluye métodos robustos 📈...

Hola amigos, seguimos aprendiendo análisis de datos con jamovi.

En este video comentaré algunos conceptos relacionados con la correlación lineal, calcularemos el coeficiente r, realizaremos un análisis de gráficos de dispersión, también veremos métodos robustos con el módulo jjStatsPlot. Y por último veremos algunos ejemplos de cómo escribir los resultados en APA 7.

A menudo nos interesa observar y medir la relación entre 2 variables numéricas mediante el análisis de correlación. Se trata de una de las técnicas más habituales en análisis de datos y el primer paso necesario antes de construir cualquier modelo explicativo o predictivo más complejo.



miércoles, 8 de junio de 2022

Análisis de normalidad de los datos 🔔 con Jamovi 📊

Los análisis de normalidad, también llamados contrastes de normalidad, tienen como objetivo analizar si los datos disponibles podrían proceder de una población con una distribución normal. Existen tres estrategias principales abordar este análisis:
• Representaciones gráficas
• Métodos analíticos
• Test de hipótesis.
En este video las comento y las ejecuto en jamovi.

domingo, 24 de abril de 2022

Jamovi 📊: calcular y transformar nuevas variables

Hola amigos, seguimos aprendiendo jamovi, en este tutorial vamos a transformar y calcular nuevas variables a partir de las variables que tenemos en nuestra base. Seguiremos usando la base de datos que utilizamos en el video pasado donde inspeccionamos las variables de un juego de datos de estudiantes.

En la descripción les dejo los enlaces al video y a la base de datos para que la puedan descargar y hacer sus pruebas.

viernes, 8 de abril de 2022

Curso de jamovi en video 📊 – Canal RecuEdu. Prof. Raidell Avello

Curso de estadística con jamovi en video ofrecido por el Canal de YouTube RecuEdu e impartido por Raidell Avello PhD - El curso es gratuito y esta en construcción.

=> Estadística descriptiva con Jamovi 📊 – Introducción - Tutorial 📈


=> Análisis de normalidad de los datos 🔔 con Jamovi 📊



=> Análisis de correlación lineal con Jamovi 📊 – incluye métodos robustos 📈 – APA 7



=> Error estándar de la media 📊 – intervalos de confianza 📈 – APA 7


=> JAMOVI 📊. Variables en filas o columnas?


=> JAMOVI 📊. Un robusto software libre de estadística (🔥 2.3 ya en español)


=> ¿Cómo instalar nuevos módulos a JAMOVI? Algunas sugerencias

=>  JAMOVI 📊: Inspección de variables 


=>  Jamovi. Calcular y tranformar variables.
En este tutorial vamos a transformar y calcular nuevas variables a partir de las variables que tenemos en nuestra base. Seguiremos usando la base de datos que utilizamos en el video pasado donde inspeccionamos las variables de un juego de datos de estudiantes.


=> JAMOVI 📊. Análisisd de normalidad - Kolmogorov



ESPERE MÁS VIDEOS PRÓXIMAMENTE


ANEXOS












Ciencia de datos, stats, jamovi, análisis de datos, Estadística, curso de jamovi, curso jamovi, curso de jamovi en video

Ciencia de datos, stats, jamovi, análisis de datos, Estadística, curso de jamovi, curso jamovi, curso de jamovi en video


miércoles, 28 de julio de 2021

Análisis de las variables del espermograma en pacientes de la consulta de infertilidad del municipio de Cienfuegos

 

Fundamento: El análisis de la calidad del semen es considerado un elemento básico en la evaluación de la fertilidad masculina.
Objetivo: analizar los valores del espermograma de pacientes atendidos en la consulta municipal de Infertilidad de Cienfuegos.
Métodos: estudio descriptivo, que incluyó 128 muestras resultantes de espermogramas realizados a pacientes atendidos en la consulta municipal de Infertilidad de Cienfuegos, entre los años 2019 y 2020. Los espermogramas registran las variables: edad, volumen, concentración, movilidad, morfología y vitalidad. Estas variables fueron comparadas con los valores de referencia propuestos por la OMS.
Resultados: en cuanto a la concentración, resaltó que los valores oscilaron en un rango amplio, desde 0 hasta 350 mmol/L-1, con una media de 89,1; mientras que la movilidad de los espermatozoides mostró valores muy bajos, incluso algunos con 0 %. La movilidad total (movilidad rápida más movilidad lenta) fue de un 57,7 %. El porcentaje de espermatozoides con una morfología adecuada fue de 46,3, mientras que la vitalidad fue de 71,8 %.
Conclusión
: La mayoría de las muestras analizadas mostraron valores normales en todos los parámetros. Resultó significativo el número de pacientes con leucospermia, parámetro que probablemente tenga relación directa con la infertilidad en estos sujetos.