Gráfico de correlaciones entre variables

Los gráficos de correlaciones no me gustan especialmente, pero empiezo a verlos en algunas presentaciones. En R tenemos algunos ejemplos interesantes pero con códigos que, bajo mi prisma, son complejos. Por este motivo me he puesto manos a la obra para realizar este gráfico de correlaciones con un código lo más sencillo posible. Para ello vamos a emplear ggplot2: library(ggplot2) library(reshape2) datos <- cor(mtcars) datos.lista <- melt(datos) names(datos.lista) <- c("Variable_1", "Variable_2", "Correlacion") escala <- seq(-1, 1, 0.1) Vamos a emplear el famoso conjunto de datos mtcars para ilustrar el ejemplo. Con él creamos la matriz de correlaciones, pero esta matriz la hemos de transformar en una lista; para ello empleamos la función melt del paquete reshape2. En este punto hemos pasado de una matriz de correlaciones a una lista con pares de variables y su correspondiente coeficiente de correlación. A esta lista le asignamos los nombres que deseamos con la función names y, por último, generamos un vector que denominamos escala que nos permitirá establecer los colores que deseamos utilizar cuando pintemos nuestra matriz de correlaciones. ...

20 de febrero de 2013 · rvaquerizo

Truco SAS. Ver el contenido de un formato

Para ver los valores que toma un formato con SAS, tenemos que emplear el PROC FORMAT. La sintaxis es muy sencilla: proc format library = work.formats fmtlib; select &formato.; run; Tenéis que poner el nombre del formato sin punto. Sintaxis sencilla, pero difícil de recordar (por lo menos a mí me ha pasado). Saludos.

6 de febrero de 2013 · rvaquerizo

Nueva edición del Curso Básico de R

Tenemos buenas noticias para todos aquellos que se quieran introducir en el mundo de R. El curso que se puso en marcha hace unos 9 meses tiene una nueva edición. Además, se incorpora al equipo de formadores (formado por Juan José Gibaja y Carlos Gil) Juan Pablo Braña. No hace falta desear éxito: está garantizado. Para más información A Q U Í. Retuitead, compartid, pulsar “Me Gusta” para que tenga el mayor alcance posible. Saludos.

5 de febrero de 2013 · rvaquerizo

Macros SAS. Macro split para partir un conjunto de datos

Debido a problemas con un servidor hace años descubrí la macro Split. Básicamente lo que hace es partir un conjunto de datos SAS en múltiples conjuntos de datos SAS con el mismo número de observaciones, además lo hace en un solo paso data. La forma de particionar el conjunto de datos es muy simple, si alguien tiene dudas con el código que lo comente y lo analizamos mejor. La macro (mejorada) es: ...

22 de enero de 2013 · rvaquerizo

Ayudadme. Importar a SAS texto con comillas

Hoy sois vosotros los que tenéis que ayudar al dinosaurio. Ya no estoy para estas cosas. Tengo un problema: un fichero de texto separado por ;, típico CSV de toda la vida. Este fichero de texto contiene diversos campos que, a mis efectos, son de texto. Si abrimos el fichero con una hoja de cálculo tendríamos: Pues bien, a la hora de importar unos datos con esa estructura desde SAS, no soy capaz de que Dato2 siga conservando las comillas. Con IMPORT tampoco me funciona. El código sería algo parecido a esto: ...

17 de enero de 2013 · rvaquerizo

¿Cómo medir la presencia de R en el mercado del análisis de datos?

Mientras comía hoy, he estado leyendo el The Forrester Wave™: Big Data Predictive Analytics Solutions, Q1 2013, un informe sobre las herramientas de análisis predictivo con mayor presencia en el mercado. Las herramientas de SAS e IBM son las mejor paradas en el estudio: Típico gráfico bivariable con «pelotitas». No voy a entrar en la calidad del gráfico ni de la segmentación representada. Pero es difícil saber dónde quedaría R; tenemos a la gente de Revolution Analytics, pero, en mi opinión, no sirve para medir la presencia de R. Es evidente que tampoco es la intención de esta gente medir el uso de software no comercial, pero eso se averigua leyendo el análisis, no viendo los títulos. De momento, me seguiré quedando con TIOBE. Saludos.

14 de enero de 2013 · rvaquerizo

App de SAS para tomar decisiones en base al Big Data

Os presento una app que ha lanzado SAS para emplear el Big Data en la toma de decisiones: https://play.google.com/store/apps/details?id=com.sas.bigdataoverload. Me la ha mandado mi amigo Pepelu. En cuanto pueda me la descargo y comienzo a jugar a ver cómo se me da esto del análisis de grandes volúmenes de información que ahora llaman Big Data e incluso se pueden leer artículos sobre el tema en la prensa más generalista. Con la de años que llevan algunos haciendo esto…

11 de enero de 2013 · rvaquerizo

Intervalos en SAS con PROC FORMAT

El uso de formatos en SAS para la creación de intervalos puede ahorrarnos tanto escritura de código como espacio en nuestros conjuntos de datos SAS. Una vez que nos familiaricemos con ellos, evitaremos la creación de sentencias IF anidadas y generar nuevas variables de texto de gran longitud en nuestro dataset. Sin embargo, siempre me plantean la misma cuestión: ¿por dónde están cerrados los intervalos en un formato? Hoy vamos a generar una serie de ejemplos para analizar este tema. Partimos de un conjunto de datos aleatorio con una variable de Poisson con media 18: ...

21 de diciembre de 2012 · rvaquerizo

SAS te felicita la Navidad

Mirad para qué sirve CALL SOUND: data _null_; call sound(659, 100); call sound(659, 100); call sound(659, 200); call sound(659, 100); call sound(659, 100); call sound(659, 200); call sound(659, 100); call sound(784, 100); call sound(523, 100); call sound(587, 100); call sound(659, 400); call sound(698, 100); call sound(698, 100); call sound(698, 150); call sound(698, 50); call sound(698, 100); call sound(698, 100); call sound(659, 100); call sound(659, 50); call sound(659, 50); call sound(659, 100); call sound(587, 100); call sound(587, 100); call sound(659, 100); call sound(587, 200); call sound(784, 200); run; Felices Fiestas.

20 de diciembre de 2012 · rvaquerizo

Macros SAS. Contar las palabras de una macro variable

Una macro de SAS interesante que nos permite ahorrar código. Dada una macro variable necesitamos contar el número de palabras que tiene esta macro variable. Para ello vamos a crear una función con código macro: %let texto = uno dos tres; %macro cuenta(mv); %eval(%sysfunc(length(%cmpres(&mv.),%str( ))) - %length(&mv.) + 1) %mend; %put La Macrovariable Texto tiene %cuenta(&texto.) palabras; Vemos que la macro variable texto tiene tres palabras y necesitamos contabilizarlas para automatizar un código. La propuesta que se plantea es el cálculo de la longitud de la macro sin espacios frente a la longitud de la macro variable con espacios. La diferencia más uno será el número de palabras de nuestro texto. Como aspectos interesantes tenéis el uso de %str( ) , %cmpres y como se juega con %sysfunc para evitar algún que otro problema. Esta macro tiene sus problemas, no pongáis más de dos espacios que la volvéis loca. Pero puede resultar muy útil para determinadas cosas. Saludos.

11 de diciembre de 2012 · rvaquerizo