Modelo de Predicción de Default en Pymes
Modelo de Predicción de Default en Pymes
de Default
El caso de empresas Pymes en Argentina
1
1. Introducción
Los instrumentos financieros en los mercados globalizados se han vuelto cada vez
más complejos, creando incertidumbre y exposición dinámica entre contrapartes por lo cual
el desarrollo de mecanismos de mejora del análisis de crédito para tomar riesgos de forma
más sofisticada y anticiparse al default de las empresas ha sido una constante en los últimos
años.
Los inconvenientes surgen dado que el proceso de evaluación de riesgo y asignación de
crédito es un ejemplo de decisión hecha en un marco de incertidumbre, que incorpora
información asimétrica entre el proveedor de fondos y el cliente.
La información asimétrica introduce dos cuestiones básicas que afectan a los proveedores
de fondos: selección adversa (efectuar errores en el proceso de decisión) y riesgo moral
(relacionado con el monitoreo de los deudores).
Cuando a una firma se le dificulta el cumplimiento en el pago del servicio de su deuda,
existe lo que se denomina riesgo de default. Antes de que esto suceda, no existe forma de
discriminar sin ambigüedades entre aquellas compañías que entrarán en default y cuales no.
En el mejor de los casos, sólo se pueden efectuar análisis probabilísticos para calcular la
probabilidad de default. Como resultado de ello, los deudores deben pagar a los primeros
un spread que incluye una sobretasa de interés proporcional a la probabilidad de
incumplimiento para compensar a los acreedores por esta incertidumbre.
Según evidencia empírica, el default es un evento poco común. La probabilidad de
incumplimiento en una compañía tipo es de alrededor del 2% en cualquier año. Sin
embargo, existe una variación considerable en la probabilidad, si la medición se efectúa
entre empresas. Por ejemplo, las posibilidades para una sociedad con una calificación
crediticia de AAA, el riesgo de no cumplir con sus obligaciones y entrar en default, no
superan el 2 por 10000 (base anual). 1
1
Ver “Modeling Default Risk”, Investigación de P. Crosbie y J. Bohn donde utilizan la metodología denominada “Expected Default
FrequencyTM”, para definir la probabilidad de que una empresa entre en default en un período dado de tiempo. Para ello recaban
información sobre trabajos anteriores en cuanto a probabilidades de incumplimiento en distintas compañías, utilizando para ello el valor
de mercado de la firma, el nivel de su endeudamiento y la volatilidad del valor de la firma.
2
En cambio, en una empresa categorizada como CCC, las probabilidades se multiplican
exponencialmente, alcanzando un 4 por 100, es decir 200 veces más que las chances de una
firma con un rating altamente satisfactorio.
La pérdida sufrida por la contraparte en caso de incumplimiento es generalmente
significativa y está altamente relacionada con las particularidades de los convenios y/o
arreglos firmados. Las cláusulas de Cross Default en contratos de deuda usualmente
aseguran que las probabilidades de default para cada una de las clases de deuda son las
mismas. No obstante, la pérdida dependerá de la naturaleza de las obligaciones (garantías,
plazo, privilegios, etc.).
Si bien todos los ítems resultan críticos para poder lograr un buen manejo de la
administración de cartera de créditos, ninguno de ellos es tan importante o difícil de
estimar, como el de probabilidad de default.
Los modelos son los medios que permiten transformar los datos en probabilidad de
incumplimiento.
Por otra parte, los modelos de comportamiento más precisos de medición derivarían de
emplear todas las fuentes cuantitativas y cualitativas disponibles en el mercado.
Para estimar las señales de default para compañías, el modelo requiere operar el perfil de
comportamiento normal de las empresas y calcular el desvío de los parámetros diseñados.
Por ejemplo, al examinar el posible impacto de un cambio de directorio, perfil de bancos y
3
deuda, entre otros, se intentará obtener un estimador lo más exacto posible respecto estas
señales y a las nuevas señales de default.
Estos requisitos llevan a un modelo basado en la correlación más que en la causalidad.
El problema para los financiadores, es que buscan la resolución de dos cuestiones
fundamentales:
- Cuál es la probabilidad de incumplimiento.
- Cuál es la pérdida estimada en caso de default.
La “pérdida dado el incumplimiento” depende, básicamente, de cuan rápido se actúe, de las
garantías y de la antigüedad en la industria.
El otorgamiento de facilidades crediticias conlleva una porción importante de pérdidas
potenciales.
La expectativa de pérdida dado el incumplimiento es, consecuentemente, altamente
dependiente de las facilidades otorgadas. El origen de ésta es la incertidumbre mientras que
el riesgo es la probabilidad de default misma.
El desafío principal para los acreedores es caracterizar anticipadamente la distribución en
las probabilidades de incumplimiento de cada deudor, y luego, monitorear la evolución en
la calidad de los parámetros. Uno de ellos, los Estados Contables, no han evolucionado de
manera tal que permita predecir la amenaza de problemas financieros de la compañía
puesto que como se expuso anteriormente, se trata de información ex post.
Los otros inputs del proceso, es decir, los precios de mercado de Deuda y Patrimonio del
deudor y las apreciaciones subjetivas, cuentan con una medida de incertidumbre inserta en
él. No obstante, de éstos se puede generar información sumamente útil para estimaciones,
dado que se trata de datos ex ante.
Es así como en un análisis de portafolio, la incorporación de todos los inputs presenta
muchas ventajas, pues permite cuantificar costos de concentración para toda la cartera y las
transacciones marginales, creando un marco donde considerar todas las agrupaciones por
nombre, industria, país o producto. 2
2
En el trabajo de “Credit Risk Modeling and Credit Derivatives” P. Schönbucher aclara que tanto como el valor del activo de la firma, el
valor de mercado del Patrimonio deben ser analizados en el contexto del riesgo de negocios de la empresa. Por ejemplo, compañías en el
ramo alimenticio, pueden alcanzar niveles más altos de endeudamiento (y consecuentemente, menor valor de mercado del equity) que las
compañías de tecnología pues sus negocios son más estables y menos inciertos.
4
2. Descripción del modelo
2.2. Ecuación
Y = variable endógena o dependiente, está dada por el concurso (que asume dos valores
posibles, 0 cuando no presentó concurso, y 1 cuando sí se convocó).
5
Ordenada al origen: α
Pendientes de la recta:
γ1 = efectos de inhabilitación en la cuenta corriente
D1 = 1 Inhabilitación por rechazo de más de cinco cheques (causal sin fondos) y sin
posibilidad de rescatarlos.
= 0 Sin inhabilitación, o con menos de cinco cheques rechazados por sin fondos o
rescatados.
γ2 = efectos de Ingreso financieras/bancos categoría C y/o salida bancos categoría A
últimos 18 meses.
D2 = 1 Si se verifica movimiento de bancos.
= 0 Mantiene igual categoría de bancos.
γ3 = efectos de Aumento / Disminución en la deuda bancaria, últimos 18 meses.
D3 = 1 Si aumentó/disminuyó en un 20% los compromisos financieros.
= 0 Si aumentó/disminuyó en menos de un 20% los compromisos financieros.
γ4 = efecto de demandas judiciales
D4 = 1 Juicio/s como demandado.
= 0 Sin juicios.
γ5 = efecto de pago de la ART
D5 = 1 Rescisión por falta de pago.
= 0 Afiliación vigente.
γ6 = efecto de inhibición por embargos de AFIP
D6 = 1 Con embargos vigentes.
= 0 Sin embargos vigentes o ya levantados.
Término de error: εi
Como se desprende de la valoración de cada una de las pendientes, se espera que en todos
los casos las mismas sean cercanas a 1, a medida que se observa una señal desfavorable
(inhabilitación/rechazo de cheques, ingreso - egreso de bancos, demandas judiciales, falta
de pago de ART, etc.) y haya mayor probabilidad de default previo al concurso.
6
Tipo de variables utilizadas: dicotómicas, las cuales se pueden utilizar en los modelos de
regresión con la misma facilidad que las variables cuantitativas.
Para el diseño del modelo se eligió una muestra inicial de 100 empresas Pymes, y luego
para su validación una nueva muestra de 75 empresas, de acuerdo a los criterios que se
detallan a continuación:
Cuadro 1
Muestra para el diseño Muestra para la validación
Período muestreo (casos en
09/1999 - 12/2000 09/1999 - 12/2000
default)
Período muestreo (casos no
09/1999 - 09/2002 09/1999 - 02/2003
default)
Tipo de industria Todas las ramas Todas las ramas
Número de casos 100 75
Número de casos en default 30 20
Tasa de default 30.00% 26.67%
9 El universo de empresas concursadas se tomó entre fines 1999 y fines de 2000, para
evitar la información sesgada que se generó a partir de 2001 con el flujo negativo de
capitales y la declaración argentina de default a principios de 2002.
9 Fuente de datos: información proporcionada de las bases de empresas de Credit Bureau
en los períodos comprendidos.
3. Aplicación y resultados
3.1. Regresión
A los efectos de conocer el impacto de cada uno de los factores que participan en la
determinación estadística del modelo, se detalla a continuación un resumen, incluyendo el
Análisis de Varianza:
7
Cuadro 2
Resumen
Estadísticas de la regresión
Coef correlación múltiple 0.671184166
Coef determinación R^2 0.450488184
R^2 ajustado 0.415035809
Error típico 0.352254614
Observaciones 100
ANÁLISIS DE VARIANZA
Grados de libertad Suma de cuadrados Prom de cuadrados F Valor crítico de F
Regresión 6 9.46025187 1.576708645 12.70685481 1.99521E-10
Residuos 93 11.53974813 0.124083313
Total 99 21
La ordenada al origen (α) representa la probabilidad de que una empresa con ART al día,
sin oficios por embargo, con deuda y cantidad de bancos sin cambios, sin juicios como
demandado ni inhabilitación se haya concursado. Si bien el coeficiente no es
comparativamente alto frente al resto de las variables, es estadísticamente significativo al
7%, por lo cual se incluyó en el análisis.
En el caso de las pendientes, por ejemplo, el 0.3819 asociado a D1 significa que, si las
demás variables permanecen constantes, se espera que la probabilidad de que una empresa
haya solicitado su concurso sea más alto en un nivel de alrededor del 38.19% en el caso de
que haya sido inhabilitada que para aquellas compañías que no registraban inhabilitación en
sus cuentas corrientes.
Todos estos factores corresponden al componente sistemático y determinístico de la
variable que tratamos de interpretar (Y). Por ello, εI sustituye a todas las variables ignoradas
u omitidas que pueden afectar a Y.
8
3.2.1. Conclusiones
3.2.2 Prueba F:
9
4. Validación del modelo
Una medida para evaluar la habilidad del modelo para segmentar entre empresas buenas y
malas (con posibilidad de ingresar en default) es el Estadístico Kolmogorov-Smirnoff (K-S)
o de Separación.
Esta herramienta permite verificar la máxima diferencia entre las distribuciones
acumuladas de las cuentas que no entraron en default (ND) comparadas contra las que sí se
concursaron (D). El Estadístico se muestra como porcentajes, siendo 100% el mejor
desempeño, pues da una idea de completa separación, mientras que 0% evidencia la no-
discriminación entre los dos grupos.
De acuerdo a la aplicación en modelos de scoring para el área de banca minorista 3 , la
siguiente tabla exhibe las diferentes puntuaciones para diversas industrias:
Cuadro 3
Categoría Puntuación (expresado en %)
Mínimo 20%
Bueno 30%
Muy bueno 40%
Excelente > 45%
Según lo descripto en el apartado 3.1, se tomó una muestra de validación para verificar la
efectividad sobre una nueva cartera de empresas y determinar si es posible realizar una
segmentación.
Gráficamente, del Estadístico de Separación se observa que el 92.7% de los casos en
default presentan una calificación de 0.27 o menos y sólo el 40.0% de las empresas no
concursadas tiene el mismo puntaje. El estadístico K-S (máxima separación) es de 52.7%
(92.7%-40.0%).
De lo anterior se verifica que el modelo diseñado para la validación está bien por encima de
los niveles de aceptación mínimos.
3
Uno de los modelos de validación utilizados mediante la técnica del Estadístico de Separación, ha sido elaborado por la consultora
Statistical Decisions, quien prepara informes para bancos y entidades financieras, básicamente con el propósito de Due Dilligence.
10
Gráfico 1
120.0%
Casos No Default
100.0%
60.0%
20.0%
0.0%
11
Calc, etc.) se encuentran en un rango de entre 0.50 y 0.75, entonces un ratio como el
obtenido resulta interesante y sólido 4 .
Gráfico 2
% C AP ide a l
d
e
c
a
s B
o
s
A
e
n
d
e
f
CAP a na liz a do
a AR = A/(A+B)
u CAP a le a t orio
l
t
0.0000 0.1000 0.2000 0.3000 0.4000 0.5000 0.6000 0.7000 0.8000 0.9000 1.0000
Percentiles
Asimismo, esta herramienta permite observar claramente las dos formas en que los
resultados de la aplicación de las variables estudiadas en el modelo del punto 2.2, pueden
fallar. En principio, dado que no existe ningún factor perfectamente anticipatorio, cierto
nivel en el resultado puede indicar bajo riesgo, cuando en realidad, el riesgo es alto. Esto
corresponde a las empresas con baja calificación en el modelo diseñado, que sin embargo
4
Ver “Benchmarking Quantitative Default Risk Models: A Validation Methodology”, elaborado por [Link], S. Keenan y R. Stein
para Moody’s Investors Service.
12
se concursan. Se trata de un fenómeno conocido como “Error de tipo I”. Por otro lado,
están los casos de firmas que tienen un alto puntaje en la ponderación de parámetros
(riesgoso) pero que sin embargo, no han entrado en default. Este es el “Error de tipo II”.
Los ejemplos ilustrados a continuación, describen en el ámbito teórico ambos tipos de error
y destacan el hecho de que al intentar minimizar un tipo de error, necesariamente es a
expensas de incrementar el otro tipo de error.
Caso predictivo: Sin errores tipo I y II Caso No Predictivo: Máximo error tipo I y II
60%
Casos No Default
60% 50%
Casos No Casos
default Default
50%
40%
Fre
Fre 40% qu
que en 30%
nci 30% cia
a
20%
20%
Casos Default
10%
10%
0% 0%
- 0,1 0,2 0,3 0,4 0,5 0,6 0,7 0,8 0,9 1,0 - 0,1 0,2 0,3 0,4 0,5 0,6 0,7 0,8 0,9 1,0
Parámetros (agrupados en percentiles) Parámetros (agrupados en percentiles)
Caso Intermedio
60%
50%
Caos No default Casos default
40%
Fre
qu
30%
en
cia
20%
Zona de Zona de
aceptación control previo
10% condicional al rechazo
0%
- 0,1 0,2 0,3 0,4 0,5 0,6 0,7 0,8 0,9 1,0
Parámetros (agrupados en percentiles)
13
Gráfico 3
35
25
20
10
0
0.0000 0.1000 0.2000 0.3000 0.4000 0.5000 0.6000 0.7000 0.8000 0.9000 1.0000
De acuerdo con este gráfico, las reglas de decisión para fijar los criterios de aceptación o
rechazo están dadas por las siguientes categorías:
9 Aceptar: cuando el límite es igual o inferior a 5%.
9 Aceptación condicional: entre 5% y 35%.
9 Revisión previa al rechazo: entre 35% y 40%.
9 Rechazar: superior al 40%.
Cuadro 4
Zona Aceptación 60.0% Empresas no default
15.0% Empresas en default
14
Conclusiones
Tal como se estableció al comienzo de este trabajo, el objetivo fue elaborar un modelo que
permita predecir la probabilidad de default, utilizando información pública y hallar cuáles
son los principales factores que afectan el desempeño de una empresa y que pueden
comprometer seriamente su capacidad para cumplir obligaciones, llegando inclusive a la
convocatoria de acreedores y/o quiebra.
Si bien el modelo no resuelve todos los problemas crediticios, puede ser complementado
con un adecuado análisis del Sistema de Información Gerencial interno, para retroalimentar
y fortalecer las conclusiones del modelo.
15
Bibliografía:
“Modeling Default Risk” (1993), Moody’s KMV. Peter J. Crosbie y Jeffrey R. Bohn.
“Credit Risk Modeling and Credit Derivatives” (1999), Tesis doctoral. Philipp J.
Schönbucher.
“Input Modeling Tools for Complex Problems” (1998), Northwestern University.
Michael Yamnitsky y Barry Nelson.
“Benchmarking Quantitative Default Risk Models: A Validation Methodology”, (2000)
elaborado por [Link], S. Keenan y R. Stein para Moody’s Investors Service.
“Correlated Default Risk” (2002), trabajo a cargo de Sanjiv Das, Laurence Freed, Gary
Geng y Nikunj Kapadia.
“Estadística para las Ciencias Administrativas”, Lincoln Chao (edición 1993).
Información pública, provenientes de la empresa de Credit Bureau Nosis
([Link])
16
Anexo 1
La tabla reporta que, salvo dos excepciones, las correlaciones entre distintas
variables que permiten explicar el default son positivas.
17
Anexo 2
Resumen
Estadísticas de la regresión
Coeficiente de correl 0.621318173
Coeficiente de determ 0.386036271
R^2 ajustado 0.353378626
Error típico 0.370354033
Observaciones 100
ANÁLISIS DE VARIANZA
Grados de libertad Suma de cuadrados medio de los cuadrad F Valor crítico de F
Regresión 5 8.106761701 1.62135234 11.8207014 7.00873E-09
Residuos 94 12.8932383 0.13716211
Total 99 21
18