0% encontró este documento útil (0 votos)
2 vistas19 páginas

Stata Comandos

La guía de comandos de STATA elaborada por Miguel Angel Chira Ballena proporciona instrucciones sobre cómo utilizar diversos comandos y funciones en STATA, incluyendo la gestión de archivos, la importación y exportación de datos, y la manipulación de variables. Se destacan recomendaciones para el uso de do-files y la ejecución de comandos, así como una lista extensa de comandos con sus aplicaciones y opciones. La guía es un recurso útil para usuarios que buscan aprender o mejorar sus habilidades en STATA.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
2 vistas19 páginas

Stata Comandos

La guía de comandos de STATA elaborada por Miguel Angel Chira Ballena proporciona instrucciones sobre cómo utilizar diversos comandos y funciones en STATA, incluyendo la gestión de archivos, la importación y exportación de datos, y la manipulación de variables. Se destacan recomendaciones para el uso de do-files y la ejecución de comandos, así como una lista extensa de comandos con sus aplicaciones y opciones. La guía es un recurso útil para usuarios que buscan aprender o mejorar sus habilidades en STATA.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones.

Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
STATA: GUÍA DE COMANDOS

Recomendaciones y Cuestiones Previas:

 En un examen se revisa lo realizado en el do-file. ¿Cómo abrir un do-file? Ctrl+9 para abrir
uno nuevo y Ctrl+o para abrir uno existente.
 Antes de ejecutar un comando se debe guardar el do-file. Esto es obligatorio si se va a
ejecutar un bucle infinito, pues Stata puede dejar de funcionar. ¿Cómo guardar un do-file?
Ctrl+s o hacer clic en File y luego en Save as en la ventana del do-file.
 Para ejecutar todo el do existen 2 metodos: 1) Ctrl+d: Los resultados se muestran en la
zona de resultados, 2) Ctrl+r: los resultados no se muestran.
 Para ejecutar un comando o un conjunto de comandos: Seleccionar el/los comando(s) que
se desea ejecutar, y usar Ctrl+d o Ctrl+r.
 Stata es case-sensitive, es decir, diferencia minúsculas de mayúsculas.
 Stata permite usar abreviaturas al hacer referencia a variables y comandos. Estas estarán
especificadas en la presente guía.

Comandos:

cd Cambia el directorio (lugar donde Stata guarda


y desde donde abre documentos)
Aplicación:
Cd “n_directory”
Argumentos:
N_directory: Dirección de la carpeta. ¿Cuál es? Ir a la carpeta donde están ubicados los archivos,
hacer clic izquierdo en la barra superior y copiar y pegar la dirección (ej.
C:\Users\Jorge\Desktop\STATA PROG\Bases)
dir Muestra lo documentos ubicados en el
directorio.
Aplicación:
Dir filespec
Argumentos:
Filespec: Especificación del archivo. Ej.: *.dta (muestra todos los archivos en formato .dta; *2008*
(muestra todos los archivos que contengan 2008 en alguna parte del nombre.
clear Borra base de datos, etiquetas, etc. de la
memoria.
Aplicación:
Clear
display Muestra lo que se indique en la zona de
resultados.
Aplicación:
Display “display_directive”
Argumentos:
“display_directive”: La expresión que se desea mostrar.
Ejemplo:
display “hola” (muestra hola en la zona de resultados)
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
display 45/7 (muestra el resultado en la zona de resultados).
help Muestra cuadro con información sobre
comando o tema.
Aplicación:
Help “command_topic_name”
import Importa bases de datos de diferentes formatos.
La más común es Excel (.xlsx)
Aplicación:
Import Excel using “n_base”.xlsx
Argumentos:
“n_base”.xlsx: El nombre del archivo Excel que se desea importar.
Opciones
sheet(“sheetname”)
Especifica el nombre de la hoja del Excel que se desea importar. Por defecto se importa la
primera hoja.
cellrange
Especifica el rango de celdas que se desea exportar. Por defecto se exporta toda la hoja.
Firstrow Trata la primera columna del Excel como nombre de variables.
Clear Reemplaza a la base de datos existente.
export Exporta la base de datos de Stata a otros
formatos (como Excel).
Aplicación:
Export Excel using “n_base”.xlsx
Argumentos:
“n_base”.xlsx: El nombre del archivo Excel en el que se desea guardar la base de datos.
Opciones
sheet(“sheetname”)
Especifica el nombre de la hoja del Excel a la que se desea exportar. Por defecto se guarda en la
primera hoja.
cell(start)
Especifica la celda (superior izquierda) en la que se empezara a guardar. Por defecto empieza a
guardar en A1.
sheetmodify
Modifica la hoja de trabajo de Excel (no modifica las celdas fuera del rango de exportación).
Sheetreplace Reemplaza la hoja de trabajo de Excel (toda la hoja).
firstrow(variables) Guarda los nombres de las variables en la primera fila.
Replace Sobreescribe el archivo de Excel.
Summarize Calcula estadísticos y los presenta en un cuadro
Aplicación:
Bys varlist: Summarize varlist [if condición] [in rango] [, opciones]
Opciones:
Detail Muestra estadísticos adicionales
Return list Lista resultados guardados por último comando
Aplicación:
Return list
OJO: Para extraer un resultado guardado se realiza el siguiente proceso:
Display r(“name”)
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
set Define el número de observaciones en una
base de datos.
Aplicación:
Set obs #
Donde # es el número de observaciones.
OJO: Se debe usar clear si ya existe una base en memoria.
use Carga a memoria la base de datos ya existente
Aplicación:
Use “filename” [, opciones]
Carga la base de datos “filename”.
Use [varlist] [if condición] [in rango] using “filename” [, opciones]
Carga solo una parte de la base de datos filename (variables y/o observaciones).
Opciones:
clear
sysuse Carga a memoria base de datos instaladas
junto con Stata
Aplicación:
Sysuse dir [, opciones]
Lista las bases de datos que están instaladas junto con Stata.
Sysuse “filename” [,opciones]
Carga la base de datos.
Opciones:
Sysuse dir, all Especifica que todas las bases de datos sean listadas.
Sysuse “filename”, clear
webuse Carga a memoria base de datos disponibles en
el website de Stata
Aplicación:
Webuse “filename” [, opciones]
Para ver las bases de datos guardadas en el website de Stata ingresar a [Link]
[Link]/data/r13/.
Opciones:
clear
save Guarda base de datos en memoria.
Aplicación:
Save “filename” [, opciones]
Guarda la base de datos actual bajo el nombre de “filename”.
Saveold “filename” [, opciones]
Guarda la base de datos en el formato de Stata 12.
Opciones:
Replace Sobreescribe base de datos existente.
edit Muestra la base de datos y permite realizar
modificaciones.
Aplicación:
Edit [varlist] [if condición] [in rango] [,opciones]
Opciones:
Nolabel Variables con etiquetas muestran sus valores numéricos.
browse Muestra la base de datos y no permite realizar
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
modificaciones.
Aplicación:
Browse [varlist] [if condición] [in rango] [,opciones]
Opciones:
Nolabel Variables con etiquetas muestran sus valores numéricos.
sort Ordena la base de datos de manera ascendente
según las variables especificadas.
Aplicación:
Sort [varlist] [in range]
gsort Ordena la base de datos según las variables
especificadas.
Aplicación:
Gsort [+|-] varname [[+|-] varname]
Ordena de manera ascendente (+) o descendente (-).
Ejemplo:
Gsort +sexo –ingxh
Ordena de manera ascendente las observaciones según sexo y de manera descendente según el
ingreso por hora.
list Lista de valores de variables
Aplicación:
[bys varlist:] list [varlist] [if condición] [in rango]
Los valores de las variables seleccionadas se muestran en la zona de resultados.
describe Describe las variables en la base de datos
Aplicación:
Describe [varlist] [using filename]
Describe el tipo de almacenamiento, el formato, etiqueta de valor y la etiqueta de la(s)
variable(s).
lookfor Busca la cadena de texto en nombres y
etiquetas de variables
Aplicación:
Lookfor “txt”
count Calcula el número de observaciones
Aplicación:
[bys varlist:] count [if condición] [in rango]
Drop/keep Borra variables u observaciones (uno a la vez)
Aplicación:
Drop|Keep varlist
Drop|Keep if condición
Drop|Keep in range
Drop borra lo que se indica, mientras que keep borra lo que no se indica.
codebook Describe en resumen el contenido de las
variables
Aplicación:
Codebook [varlist] [if condición] [in rango]
Muestra datos como el número de missing, etiqueta de la variable, rango, etiquetas de los
valores, etc.
inspect Muestra un mini histograma y tipos de valores
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
de la variable. Se utiliza sobre variables
numéricas.
Aplicación:
[bys varlist:] inspect [varlist] [if condición] [in rango] [ponderadores] [,opciones]
compare Compara los valores de dos variables. Se utiliza
sobre variables numéricas
Aplicación:
[bys varlist:] compare varname1 varname2 [if condición] [in rango]
generate Crea o carga contenidos de una variable.
Aplicación:
[bys varlist:] generate [type] newvar=exp [if condición] [in rango]
Argumentos:
[type]: byte, int, long, float, double, str#. Incluir el tipo de variable es opcional. En el caso de
variables numéricas, si no se coloca el tipo, por defecto este será float.
OJO: Para cambiar el tipo numérico por defecto
Set type float/double , permanently
La opción perm cambia el tipo numérico para siempre.
egen Extensión al commando generate
Aplicación:
[bys varlist:] egen [type] newvar=function(arguments) [if condición] [in rango] [,opciones]
Existen algunas funciones que solo funcionan con el comando egen.
replace Reemplaza el contenido de una variable
existente.
Aplicación:
[bys varlist:] replace oldvar=exp [if condición] [in rango]
Reemplaza el contenido de la variable oldvar por exp (puede ser un número o un texto).
rename Cambia el nombre de una variable
Aplicación:
rename old_varname new_varname
OJO: Si se desea cambiar todas las variables a mayúscula, minúscula o tipo oración:
Rename _all , upper/lower/proper
label variable Asocia una etiqueta a la variable.
Aplicación:
Label variable varname [“label”]
Asocia la etiqueta label a la variable varname.
Label define Asocia etiquetas a los valores de una variable.
Aplicación:
Label define lblname #1 “label1” [#2 “label2” …]
Asocia la etiqueta label1 a #1, label2 a #2 y así sucesivamente.
OJO: Para asignar dicha etiqueta usar:
label values varlist lblname
Asigna la etiqueta lblname a las variables listadas en varlist.
decode Transforma variable numérica con etiquetas a
una nueva variable textual.
Aplicación:
Decode varname [if condición] [in rango] , generate(new_var)
Transforma la variable numérica con etiquetas varname a una nueva variable textual llamada
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
new_var.
encode Transforma variable textual en una nueva
variable numérica con etiquetas
Aplicación:
encode varname [if condición] [in rango] , generate(new_var)
Transforma la variable textual varname a una nueva variable numérica con etiquetas llamada
new_var.
recode Transforma variable numérica/categórica en
una nueva variable categórica según las reglas
que se establezcan.
Aplicación:
Recode n_var (rule1) [(rule2) …] [if condición] [in rango] , generate(new_var)
Ejemplo:
Recode dominio (min/3 8=1 “Costa”) (4/6=2 “Sierra”) (7=3 “Selva”) , generate(region1)
Crea la variable región 1 que toma el valor 1 si dominio toma los valores entre el mínimo (1) y 3 u
8. Dicho valor tendrá la etiqueta “Costa”. Si la variable dominio toma los valores entre 4 y 6,
región1 tomará el valor 2 y tendrá la etiqueta “Sierra”. Finalment,e si dominio toma el valor 7,
region1 tomará el valor 3 y tendrá la etiqueta “Selva”.
split Parte una variable textual en varias variables
textuales nuevas
Aplicación:
Split n_vartext [if condición] [in rango] [, opciones]
Opciones:
Generate(new_var) Genera nuevas variables con las partes separadas.
Parse() El carácter que establecerá donde partir. Por defecto es el espacio.
Destring Transforma variables textuales que contiene solo números en variables numéricas.
Ejemplo:
Split id, gen(id) parse(-) destring
Parte la variable id. El carácter – marca donde separar los textos. Se generarán las variables id1,
id2, id3… según el número de partes. Si alguna de estas partes contiene solo números se
transformará en variables numéricas.
tostring Convierte variables numéricas en variables
textuales
Aplicación:
Tostring varlist [, opciones]
Opciones:
generate(new_varlist) Genera nuevas variables textuales.
replace Reemplaza el contenido de la variable existente.
destring Convierte variables textuales en variables
numéricas.
Aplicación:
Destring varlist [, opciones]
Opciones:
generate(new_varlist)
replace
force Si alguna observación no es un número, la convierte en missing.
pctile Crea variable que contiene percentiles de otra
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
variable
Aplicación:
Pctile newvar=exp [if condición] [in rango] [weight] [, opciones]
Opciones:
Nquantiles(#) Número de quantiles. Por defecto es 2.
Ejemplo:
Pctile cortes=ingxh1, nq(5)
Crea la variable cortes que contiene los 4 puntos de corte que definen los 5 cuantiles de la serie
ingxh1.
xtile Crea una variable que muestra el percentil al
que pertenece cada observación de acuerdo a
la distribución de otra variable
Aplicación:
xtile newvar=exp [if condición] [in rango] [weight] [, opciones]
Opciones:
Nquantiles(#) Número de quantiles. Por defecto es 2.
Ejemplo:
xtile quintos=ingxh1, nq(5)
Crea la variable quintos que indica si las observaciones de ingxh1 pertenecen al primer, segundo,
tercer, cuarto o quinto cuantil.
tabulate Tabla de frecuencias de una variable categórica
Aplicación:
[bys varlist:] tabulate varname [if condición] [in rango] [iw aw fw] [,optiones]
Genera table de frecuencias de la variable varname.
Opciones:
Subpop(n_var) Excluye observaciones para las cuales la variable n_var=0.
Missing Incluye missings en la tabla como una categoría adicional.
Nolabel Muestra valores numéricos en lugar de etiquetas.
Generate(n_var) Crea dummies para cada categoría de varname (n_var1 n_var2 …).
Plot Coloca un gráfico de barras sencillo en lugar de los porcentajes.
Sort Muestra la tabla en orden descendente de la frecuencia.
Ejemplo:
Tab neduc [iw=factor]
Muestra tabla de frecuencias de la variable nivel de educación usando el ponderador iw.
Aplicación2:
[bys varlist:] tabulate var1 var2 [if condición] [in rango] [iw aw fw] [, options]
Genera tabla de frecuencias cruzadas de las variables var1 y var2.
Opciones:
Missing
Nolabel
(No)key Key muestra una celda con una leyenda. Nokey oculta esa celda.
Nofreq Oculta las frecuencias en la tabla para mostrar alguno de los siguientes:
Col row cell Porcentajes relativos al total por columna/fila/total. Pueden usarse juntos.
summarize Tabla de resumen de estadísticos para variables
continuas o dicotómicas.
Aplicación:
[bys varlist:] summarize [varlist] [if condición] [in rango] [iw aw fw] [ , opciones]
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
Opciones:
Detail Muestra estadísticos adicionales.
Separator(#) Dibuja una linea de separación después de # variables.
tabstat Tabla de estadísticos de muchas variables para
pocos grupos.
Aplicación:
[bys varlist:] tabstat varlist [if condición] [in rango] [aw] [ , opciones]
El estadístico que muestra por defecto es el promedio.
Opciones:
Save Guarda la tabla en r(). Para revisar valores guardados: ret list.
Statistics():
Indica que estadísticos mostrar en la tabla. Para ver cuales se pueden incluir: help tabstat
Columns (var|stat) Solo si uso s(), para mostrat var o stat en filas. Por defecto se muestra var.
By(var1) Ejecuta la tabla por categorías de var1.
Nototal Solo si uso by(), quita la categoría total.
Missing Solo si uso by(), agrega missing como una categoría más.
Labelwidth(#) Especifica el ancho de la columna de las categorías de by()
Casewise
Los estadísticos son computados para la muestra que no es missing para cualquiera de las
variables de varlist.
Longstub Especifica que la primera columna incluya también los estadísticos de las variables.
OJO: by genera subgrupos en una misma tabla, bys genera tablas por cada subgrupo.
table Tabla de estadísticos de pocas variables para
muchos grupos.
Aplicación:
[bys varlist:] table rowvar [colvar [supercolvar]] [if condición] [in rango] [pw iw fw aw] [ ,
opciones]
Opciones:
Contents(stat varname…) Contenido de celdas, máximo cinco estadísticos. Por defecto usa count.
Cw Excluye las observaciones en las que alguna variable de contents() es missing.
Row col scol Agrega la categoría total para filas/colunas/supercolumnas.
By(superrowvar) Agrega superfilas, máximo 4.
Cellwidth(#) Especifica el ancho de las celdas que contienen el estadístico. # está entre 4 y 20.
Csepwidth(#) Especifica la separación entre columnas(colvar). # está entre 1 y 10.
Stubwidth(#)
Especifica el ancho de la columna que contiene las categorías del by() y la rowvar. # está entre 4 y
40
Scsepwidth(#) Especifica la separación entre supercolumnas(supercolvarI. # está entre 1 y 10.
Center Específica que los resultados estén centrados. Por defecto están alineados a la derecha.
Left
Específica que las etiquetas de rowvar estén alineadas a la izquierda. Por defecto están a la
derecha.
Missing Especifica que las celdas vacías sean mostradas en la tabla con un punto.
histogram Grafica histogramas de variables continuas y
categóricas.
Aplicación:
Histogram varname [if condición] [in rango] [fw] [, opciones]
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
Grafica histograma de la variable varname. En el eje x va la variable y en el eje y, la densidad.
Opciones:
Percent En lugar de densidad, coloca la probabilidad en el eje y.
Kdensity Agrega la densidad estimada tipo kernel.
Normal Agrega la densidad de una distribución normal con la media y varianza de varname.
Discrete Indica que la variable a graficar es discreta y grafica una barra por cada observación.
By(varlist)
Hace el gráfico para cada subgrupo definido por varlist. Si se incluye una variable en varlist, se
harán 2 gráficos; si son 2, 4 gráficos; y así sucesivamente.
kdensity Estima la densidad kernel y grafica.
Aplicación:
Kdensity varname [if condición] [in rango] [iw aw fw] [ , opciones]
Gráfico de la densidad kernel de la variable varname.
Opciones:
gen(newvarx newvard) Guarda los pares estimados en las variables newvarx y newvard).
n(#)
Establece el número de puntos. El número por defecto es 50, por lo que si se usa gen() sin usar
n(#), las nuevas variables tendrán 50 observaciones.
Graph box Gráfico de caja.
Aplicación:
Graph (h)box varlist [if condición] [in rango] [pw aw fw] [, opciones]
Gráfico de caja de las variables listadas en varlist. Si se coloca hbox, el gráfico de cajas será
mostrado de manera horizontal.
Opciones:
Over(varname)
Una caja por cada categoría de varname. Solo se pueden usar hasta 3 over y si este es el caso,
solo puede haber una variable en varlist.
By(varlist) Un gráfico por cada subgrupo definido por varlist.
Ejemplo:
Gr box ingxh horas [pw=factor], over(sexo) over(sector)
8 cajas en un solo gráfico, dónde sexo está “incluido” en sector.
Gr box ingxh [pw=factor], over(sexo) over(sector) over(ocup_sec)
8 cajas en un solo gráfico, donde sector está “incluido” en ocup_sec y sexo es la leyenda.
Gr box ingxh horas [pw=factor], by(sexo)
4 cajas en 2 gráficos, uno para hombres otro para mujeres.
Gr box ingxh horas [pw=factor], by(sexo) over(ocup_sec)
8 cajas en 2 gráficos: 4 cajas en un gráfico para hombres y 4 cajas en un gráfico para mujeres.
Graph bar Gráfico de barras.
Aplicación:
Graph (h)bar (stats) varlist [if condición] [in rango] [pw aw fw] [, opciones]
Crea un gráfico de barras de las variables listadas en varlist. Si se coloca hbar, el gráfico será
mostrado de manera horizontal. Si no se coloca nada en stats, el estadístico que se muestra es
mean.
Opciones:
Over(varname)
By(varlist)
Asyvar Trata la variable del primer over como leyenda.
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
Stack Pone una barra encima de la otra.
Percentages Se usa con stack y fija el tamaño de la barra en 100%.
Ejemplos:
Graph bar ingxh [pw=fac]
Gráfico de barras que muestra el promedio del ingreso por hora.
Graph bar (mean) ing? (median) ing? [pw=fac]
Gráfico de 4 barras que muestra el promedio y la mediana de ing1 e ing2.
Graph hbar ingxh horas [pw=fac], over(neduc)
Gráfico de barras horizontal con 2 barras (una de ingxh y otra de horas) por cada categoría de
neduc.
Graph hbar ingxh horas [pw=fac], over(neduc) over(ged)
Gráfico de barras horizontal, dónde neduc está incluido en ged.
Graph hbar ingxh [pw=fac], over(neduc) over(ged) over(sex)
Gráfico de barras horizontal, donde ged está incluido en sex y neduc es la leyenda.
Graph bar ingxh horas [pw=fac], over(gedad) by(sex)
2 gráficos de barras: una para hombres y otra para mujeres. Cada gráfico cuenta con 8 barras: 2
barras(una de ingxh y otra de horas) por cada categoría de gedad .
graph hbar (sum) horas [pw=fac], over(neduc) over(sexo) asyvar
Gráfico de barras horizontal, donde neduc es leyenda.
graph hbar (sum) horas [pw=fac], over(sexo) over(neduc) asyvar stack
Gráfico de barras horizontal, donde neduc es leyenda y las barras de hombre y mujer están una
encima de otra.
graph hbar (sum) horas [pw=fac], over(neduc) over(sexo) asyvar stack percentages
Gráfico de barras horizontal, donde neduc es leyenda y las barras de hombre y mujer están una
encima de otra y el tamaño de esta es 100%.
Twoway Gráfico de 2 variables
Aplicación:
Twoway “type” n_vary n_varx [if condición] [in rango] [pw] [, opciones]
Argumentos:
“type”: Pueden ser: scatter, line, lfitci, qfitci, etc.
Opciones:
By(varlist)
Title(“”) xtitle(“”) ytitle(“”) Coloca títulos al gráfico, al eje x o al eje y.
Xlabel(#1(#2)#3) ylabel( ) Modifica los ejes. Empieza en #1 y va hasta #3 de #2 en #2.
Legend(order(1 “ “ 2 “ “ …) Modifica la leyenda.
Ejemplos:
twoway scatter ingxh edad [pw=factor]
Dibuja un punto por cada par ordenado de ingxh y edad.
twoway line ingxh edad [pw=factor], sort
Conecta los puntos del scatter (sin mostrar los puntos) según orden edad.
twoway lfit ingxh edad [pw=fac]
Ajusta una regresión lineal entre ingxh y edad y la grafica.
twoway lfitci ingxh edad [pw=fac]
Muestra la regresión con un intervalo de confianza del 95%.
tw qfit ingxh edad [pw=factor]
Grafica regresión cuadrática
tw (sca ming_edad edad) (qfitci ingxh edad [pw=fac])
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
Muestra los 2 gráficos (el scatterplot y el qfitci) en uno solo.
tw (sca ming_edad2 edad) (qfitci ingxh edad [pw=fac]), by(sexo)
Muestra 2 gráficos que contienen los 2 gráficos.
tw (sca ming_edad2 edad) (qfitci ingxh edad [pw=fac]) ///
(sca ming_edad2 edad if neduc>=10 & sector==1), ///
title("Relación entre el salario por hora y la edad") ///
ytitle("Salario por hora (en soles)") ///
legend(order(1 "Todos" 4 "Superior completa sector formal" ///
3 "Valores ajustados" 2 "Intervalos de confianza al 95%"))
Muestra un gráfico que contiene el scatterplot y el qfitci. El gráfico muestra un título y el eje y
también. La leyenda ha sido modificada y expresa lo estipulado entre comillas.
svyset Declara el tipo de diseño muestral de la base de
datos.
Aplicación:
Svyset [psu] [pw iw aw fw], strata()
Declara el tipo de diseño muestral de la base de datos.
Svyset, clear
Borra el diseño muestral declarado.
Argumentos:
[psu]: Unidad primaria de muestro. Variable que identifica lo que se escogió aleatoriamente
primero.
Strata(): Si es estratificado, se coloca la variable que identifica cada estrato.
Ejemplo:
Svyset conglome [pw=fac], strata(estrato)
Donde conglome es el nombre de la variable que contiene el número del conglomerado y estrato
es el nombre de la variable que contiene el estrato.
svydescribe Describe el número de UPM y observaciones
por estrato.
Aplicación:
Svydes
Muestra el número de estratos, el número de unidades(polígonos), observaciones (puntos rojos)
y observaciones por unidad (puntos rojos por polígono).
Svy Permite que los comandos tomen en cuenta el
diseño muestral.
Aplicación:
Svy [, subpop([varname] [if condición])] : command varlist [if condición] [in rango] [,opciones]
Argumentos:
Subpop([varname]/[if condición])]: Ejecuta el comando sobre subpoblación. Si se usa varname, la
variable debe ser dicotómica y, en este caso, subpop es definida como varname==1. Ej.:
Svy, subpop(sexo): mean ingxh El comando se ejecutará sobre las mujeres (sexo==1).
Svy, subpop(if sexo==1): mean ingxh Es igual al anterior.
Svy, subpop(if sexo==0): mean ingxh El comando se ejecutará sobre hombres (sexo==0).
Command: Algunos comandos permiten el uso del prefijo svy. Para ver cuáles son:
help svy estimation
OJO: Si se usa el prefijo svy ya no es necesario declarar los pesos.
OJO: ¿Cuál es la diferencia entre usar un comando con el prefijo svy y usar con comando con
pesos? El error estándar es calculado correctamente con el prefijo svy.
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
OJO: ¿Cuál es la diferencia entre el subpop y el if?
Svy: mean ingxh if sexo==1
Svy, subpop(if sexo==1) : mean ingxh
En el primero, el if no aplica a svy, solo a mean. El promedio de ambos será el mismo, pero el
error estándar del segundo es el correcto.
Comandos que permiten svy:
Mean: Estima el promedio de la(s) variable(s) y el error estándar linealizado.
Total: Suma de la)s variable(s) y el error estándar linealizado.
Proportion: Estima proporciones/tabla de frecuencias relativas y el error estándar linealizado.
Ratio: Estima el ratio promedio entre 2 variables y el error estándar linealizado.
OJO: Si me piden una variable per capita, es preferible usar ratio.
Opciones:
Over(varlist) Ejecuta el comando para subpoblaciones definidas por varlist.
Level(#) Indica el nivel de confianza de los intervalos, por defecto es 95.
ttest Calcula una prueba t.
Aplicación:
ttest varname=# [if condición] [in rango] [, opciones]
Prueba si el promedio de varname es #.
Opciones:
By(varname2)
Prueba si el promedio de varname es igual para los dos grupos definidos por varname2. Si se usa
by() no usar =#.
Level(#)
Aplicación 2:
ttest varname1=varname2 [if condición] [in rango] [, opciones]
Prueba si el promedio de varname1 es igual al de varname2.
Opciones:
Level(#)
prtest Prueba de proporciones
Aplicación:
Prtest varname=#p [if condición] [in rango] [, opciones]
Prueba si varname tiene una proporción de #p.
Opciones:
By(varname2)
Prueba si la proporción de varname es igual para los dos grupos definidos por varname2. Si se usa
by() no usar =#p.
Level(#)
Aplicación 2:
Prtest varname1=varname2 [if condición] [in rango] [, opciones]
Prueba si varname1 y vaname2 tienen la misma proporción.
Opciones:
Level(#)
lincom Prueba de validez de combinaciones lineales.
Comando de post-estimación, requiere una
estimación previa.
Aplicación:
Lincom exp [, level(#)]
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
Computa puntos estimados, errores estándar, estadísticos t o z, p-values e intervalos de confianza
para combinaciones lineales de coeficientes después de un comando de estimación. Prueba si exp
es 0.
Ejemplos:
Svy: mean ingxh1
Lincom ingxh1-5.5
Prueba si el ingxh1 es 5.5.
Svy: mean ingxh1 ingxh2
Lincom ingxh1-ingxh2
Prueba si el ingxh1 es igual a ingxh2.
Svy: mean ingxh, over(sexo)
Lincom [ingxh]mujer-[ingxh]hombre
Prueba si el ingreso por hora es igual para los hombres y para las mujeres.
OJO: Si el pvalue es menor a 0.05 (si trabajo con 95% de confianza), rechazo la hipótesis h0 (ej.
Promedio de ingxh1 igual a 5.5). Si el estadístico t es menor a -1,96 o mayor a 1.96, rechazo la
hipótesis h0. Si en los intervalos de confianza no está incluido el 0, rechazo h0. Si los valores del
intervalo de confianza son negativos, entonces h0<0 (ej. Promedio de ingxh1 es menor a 6).
correlate Calcula correlaciones simples.
Aplicación:
[bys varlist:] correlate [varlist] [if condición] [in rango] [aw] [, opciones]
Muestra la correlación entre las variables de varlist.
Opciones:
Means Agrega una tabla tipo summarize de varlist.
Covariance Muestra las covarianzas.
Aplicación 2:
[bys varlist:] pwcorr [varlist] [if condición] [in rango] [aw] [, opciones]
Muestra la correlación entre las variables de varlist.
Opciones:
star(#) Coloca un asterisco(*) a las correlaciones significativas (!=0) al (100-#)%
Sig
Coloca el p-value de la no significancia de cada correlación. Si es menor a 0.05, se rechaza la no
significancia.
regress Calcula correlaciones parciales (regresiones
mínimos cuadrados ordinarios).
Aplicación:
[Svy:] regress depvar [indepvars] [if condición] [in rango] [pw] [, opciones]
Calcula la regresión de depvar=b0+b1*indepvar1+b2*indepvar3+…
Ejemplos:
Svy: reg ingxh sexo
Si la variable independiente es dicotómica, su coeficiente es la diferencia de medias (ej.:
b1=ingxh(mujer)-ingxh(hombre)).
Svy: reg ingxh sexo#sector
Muestra el coeficiente de mujer formal, mujer informal, hombre formal y hombre informal.
OJO: Si la variable independiente es continua(edad), se puede usar c.indepvar1 para decirle a
Stata que indepvar1 es una variable continua. Stata reconoce usualmente que tipo de variable es,
pero en caso se equivoque, se puede usar c.
OJO: Si la variable independiente es dicotómica o categórica (neduc), se puede usar i.indepvar1
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
para decirle a Stata que indepvar1 es una variable categórica.
collapse Crea una base de datos resumida(con
estadísticos) a partir de otra base de datos.
Aplicación:
Collapse clist [if] [in] [pw iw aw fw] [, by(varlist)]
Crea una base de datos con estadísticos a partir de otra base de datos. Si se usa la opción by(), el
estadístico se calculara sobre cada subgrupo de las variables incluidas en el by.
Argumentos:
Clist: Puede ser definido a partir de combinaciones de los siguientes modos:
Var1 var2
(stat1) var1 var2 (stat2) var2 var3
(stat1) name1=var1 (stat2) name2=var1
Donde stat puede ser: mean (por defecto), median, p1, p2, …, p99, semean (error estándar de la
media), sum, count, max, min, etc.
OJO: Existen 2 comandos que permiten deshacer modificaciones sobre la base de datos original
Preserve
Comandos
Restore
Si uso un collapse entre ambos comandos, la base de datos original se reestablecerá al final.
reshape Transforma filas en columnas (wide) o
columnas a filas (long).
Aplicación:
Reshape wide|long stub, i(varlist) j(varname) [ string]
Argumentos:
Stub: Variable que se está analizando.
Varlist: Identificador de observaciones en nueva base.
Varname: En caso de wide, indica el nombre de variable existente que ahora será columna. En
caso de long, indica el nombre de nueva variable que antes era columna.
String: Cuando varname contiene o contendrá textos.
Ejemplo:
Si tengo la siguiente base de datos:
ao dpto Gr_gas
2015 AMAZONAS 1476
... … …
2014 AMAZONAS 1574
… … …
Reshape wide gr_gas, i(dpto.) j(ao)
dpto Gr_gas2014 Gr_gas2015
AMAZONAS 1574 1476
ANCASH 987 909

Si tengo la siguiente base de datos:


ao dpto Gr_ing Gr_gas Gr_trans
2015 AMAZONAS 9 1476 .
2015 ANCASH 18 909 .
… … … … …
reshape long gr_, i(ao dpto) j(cta) string
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
ao dpto cta Gr_
2014 AMAZONAS gas 1476
2014 AMAZONAS ing 9
2014 AMAZONAS Trans .
append Agrega observaciones de otra base de datos.
Aplicación:
Append using filename.
Se usa cuando la base using y la base master tienen las mismas variables, pero diferentes
observaciones.
OJO: Identifica correspondencia entre variables según su nombre. Edad es diferente de edad.
merge Agrega variables a la base de datos.
Aplicación:
Merge {1:1|1:m|m:1} varlist using filename [, opciones]
Argumentos:
{]
1:1 Misma unidad en ambas bases. (Ej. Hogares es la unidad de la master y de la using).
1:m Diferentes unidades. (Ej. Hogares es la unidad de la master y personas de la using.).
M:1 Diferentes unidades. (Ej. Personas es la unidad de master y hogares de la using).
Varlist: Una o más variables que identifican cada observación. ¿Cuáles son? Para comprobar si
una lista de variables(varlist) es un identificador: isid varlist.
Opciones:
Keepusing(varlist) Especifica que variables del using dataset se desea agregar.
Nogen Si no se especifica, merge crea una variable auxiliar denominada _merge.
Keep(1 2 3)
Quedarse con cierto tipo de resultados. _merge==1 son observaciones que solo existen en
master, _merge==2 son observaciones que solo existen en using y _merge==3 son observaciones
que existen en master y en using.

Funciones:

Concat Función de egen que concatena variables en


una nueva variable textual.
Aplicación:
Egen new_va= concat(varlist) [, opciones]
Opciones:
Punct() Textos unidos serán separados por lo especificado en () en la nueva variable.
Decode Coloca etiquetas y no números al concatenar variables con etiquetas
Ejemplo:
Egen muj_reg=concat(sexo región), decode punct(“-“)
Concatena las variables sexo y región y las separa por un -. Coloca las etiquetas de región al
concatenar y no los números.
substr Función que extrae n2 caracteres de un texto
desde el carácter en la posición n1.
Aplicación:
Substr(string,n1,n2)
OJO: Si n1 es negativo cuenta la posición desde el último carácter
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
Ejemplo:
Substr(“abdef”,-3,2) = “de”
Gen last=Substr(id,-1,1)
Extraerá el último carácter de la variable id.
real Función que transforma un string formado por
caracteres numéricos enúmero
Aplicación:
Real(string)
Inlist( , , ) Función
Aplicación:
Inlist(n_var,a,b,…)
Las observaciones de la variable new_var serán 1 si la variable n_var toma cualquiera de los
valores listados (a o b o c …); de lo contrario, serán 0.
Inrange( , , ) Función
Aplicación:
Gen new_var=Inrange(n_var,#1,#2)
Las observaciones de la variable new_var serán 1 si la variable n_var se encuentra entre #1 y #2;
de lo contrario, serán 0.
Log/ln Función
Aplicación:
Gen new_var=Log(n_var)
La variable new_var tendrá el logaritmo neperiano de las observaciones de la variable n_var.
Runiform Función
Aplicación:
Gen new_var=Runiform()
La variable new_var tendrá números aleatorios de una distribución uniforme entre 0 y 1.
_n Variable del sistema que contiene el número de
observaciones actuales.
Aplicación:
Gen new_var=_n
Si la base de datos tiene 100 observaciones, la variable new_var tendrá observaciones de 1 al
100.
_N Variable del sistema que contiene el número
total de observaciones en la base de datos.
Aplicación:
Gen new_var=_N
Si la base de datos tiene 100 observaciones, la variable new_var tendrá el número 100 en cada
una de sus observaciones.
Rowtotal Función de egen que devuelve la suma por filas
de las variables listadas, tratando los missings
como 0.
Aplicación:
Egen new_var=rowtotal(varlist) [,opciones]
Opciones:
Missing
Si todos los valores de varlist son missing en una observación, new_var también es missing.
group Función de egen que crea una variable que
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
toma los valores 1, 2 , … para los grupos
gormados por varlist.
Aplicación:
Egen new_var=group(varlist) [, opciones]
Opciones:
Missing
Los missing en varlist son tratados como cualquier otro valor cuando se asignan los grupos en
lugar de asignar a los missing al grupo missing.
Ejemplo:
Egen muj_sec=group(sexo sector)
La variable sexo puede ser hombre y mujer, mientras que sector puede ser formal e informal. La
variable muj_sec asignará el valor 1 a los hombres formales, 2 a los hombres informales, 3 a las
mujeres formales y 4 a las mujeres informales.
Total Función de egen que crea una constante que
contiene la suma de las observaciones de la
variable tratando los missings como 0.
Aplicación:
Egen new_var=total(n_var) [, opciones]
Crea la variable new_var que contiene la suma de todas las observaciones de n_var.
Opciones:
Missing Si todos los valores de n_var son missing, new_var será missing.
Sum Devuelve la suma acumulada de la variable,
trantando missing como 0.
Aplicación:
Gen new_var=Sum(n_var)
OJO: Si se desea que la suma acumulada empiece desde el valor más pequeño usar sort.

Objetos de Programación:

Macros Espacio de memoria que puede guardar


números y/o strings de modo permanente
(global) o temporal (local).
Aplicación:
Global gname exp|string
Crea macro global llamada gname que contiene el valor numérico exp o el valor textual string.
$gname
Llama macro global gname
Local lname exp|string
Crea macro local llamada lname que contiene el valor numérico exp o el valor textual string.
`lname’
Llama macro local lname
Comandos relacionados:
macro list
Lista las macros existentes.
Macro drop mname
Borra la macro mname.
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
Scalar Objeto que puede guardar un número (escalar).
Aplicación:
Scalar s_name=exp
Crea escalar llamado s_name que contiene el valor numérico exp.
Comandos relacionados:
Scalar list
Lista todos los escalares
Scalar drop s_name
Borra el escalar s_name
Scalar drop _all
Borra todos los escalares.
matrix Objeto que puede guardar números ordenados
en filas y columnas
Aplicación:
Matrix mname=J(#fil,#col,#)
Crea una matriz mname de #fil filas y #col columnas llena de #.
Matrix mname[#fil,#col]=#núm
Guarda #num en fila #fil y columa #col de mname.
Comandos relacionados:
Matrix dir
Lista los nombres de matrices en memoria
Matrix list mname
Muestra la matriz mname
Matrix drop mname
Borra la matriz mname.
Matrix C=A\B
Une matrices A y B una debajo de otra. OJO: A y B tienen el mismo número de columnas.
Matrix F=D,E
Une matrices D y E una al lado de otra. OJO: D y E tienen el mismo número de filas.
Matrix G=matuniform(#fil,#col)
Crea matriz de #filx#col llena de números aleatorios de una distribución uniforme entre 0 y 1.
Svmat mname
Guarda matriz mname en la base de datos.
Mkmat varlist [if condición] [in rango] [, matrix(mname)]
Guarda variables en matriz mname.

Estructuras de Programación:

Condicional Ejecuta un conjunto de comandos si una


expresión es verdadera.
Aplicación 1:
If exp {
Comandos
}
Ejecuta las líneas dentro de la estructura si exp es verdadera.
Aplicación 2:
Guía elaborada por Miguel Angel Chira Ballena. Sujeta a errores y omisiones. Prohibida su
reproducción y distribución sin autorización ([Link]@[Link])
if exp {
comandos1
}
Else {
Comandos2
}
Ejecuta líneas dentro de la estructura si exp es falsa. Es una extensión no obligatoria.
Bucle abierto Ejecuta los comandos entre llaves una y otra
vez mientras exp sea cierta.
Aplicación:
While exp {
Comandos
}
Bucles cerrados Ejecuta las líneas dentro de la estructura
determinada cantidad de veces.
Aplicaciones:
foreach mu in 1 2 3{ //numlist en cualquier orden
gen vaca`mu'=uniform()*`mu'
}
foreach pio of numlist 4(2)8{ //numlist ordenada o no
gen pollo`pio'=uniform()*`pio'
}
forvalues vee=5(2)9{ //ídem a foreach x of numlist
gen oveja`vee'=uniform()*`vee'
}
foreach cua in price headroom{ //pueden ser nombres de variables o no
gen log_`cua'=log(`cua')
}
foreach oing of varlist mpg trunk-turn{ //deben ser nombres de variables
gen log_`oing'=log(`oing')
}
levelsof rep78, local(niveles) //para repetir según valores de categórica
foreach x of local niveles{
count if rep78==`x'
}

También podría gustarte