ChatGPT
Artículo
Discusión
Leer
Editar
Ver historial
Herramientas
ChatGPT
Información general
Tipo de programa prototipo
Autor OpenAI
Desarrollador OpenAI
Lanzamiento inicial 30 de noviembre de 2022
Descubridor OpenAI
Licencia licencia privativa
Idiomas plurilingüe
Información técnica
Programado en Python
Plataformas admitidas
navegador web
interfaz de programación de aplicaciones
iOS
Android
Enlaces
Sitio web oficial
[editar datos en Wikidata]
ChatGPT (marca generalizada a partir de las siglas en inglés Chat Generative Pre-
Trained Transformer) es una aplicación de chatbot de inteligencia artificial
desarrollado en 2022 por OpenAI que se especializa en el diálogo. El chatbot es un
modelo de lenguaje ajustado con técnicas de aprendizaje tanto supervisadas como de
refuerzo.1 Está compuesto por los modelos GPT-4 y GPT-3.5 de OpenAI.
ChatGPT se lanzó el 30 de noviembre de 20222 y ha llamado la atención por sus
respuestas detalladas y articuladas. Sin embargo, numerosos estudios han demostrado
que ChatGPT es propenso a errores fácticos y exhibe sesgos lingüísticos,3 de
género,4 raciales5 y políticos6 en el contenido que genera. El servicio se lanzó
inicialmente como gratuito para el público, con planes de monetizarlo más adelante.
El 4 de diciembre, OpenAI calculaba que ChatGPT ya tenía más de un millón de
usuarios.78 El 14 de marzo de 2023 se lanzó GPT-4. También se puede utilizar en
todos los sitios web mediante el complemento de Merlin en Chrome y Edge, más
recientemente también utilizando la API.9El 6 de noviembre de 2023, OpenAI publicó
que cien millones de personas utilizan ChatGPT semanalmente.10
El acceso al servicio está limitado en países como China, Rusia,11 Irán y partes de
África.12 El acceso a ChatGPT fue bloqueado, temporalmente, en Italia por las
autoridades al entender que hubo una violación de datos y la base jurídica para
utilizar datos personales.13
A finales de marzo del 2023, ChatGPT integró el uso de plugins,14 entre los que se
incluye uno que le da la posibilidad de que este navegue por internet. Algunas
compañías como Kayak o Expedia lanzaron su propio plugin.
Desde su lanzamiento, ChatGPT ha experimentado una evolución significativa15 en
términos de su capacidad para comprender contextos complejos y adaptarse a
distintos tipos de conversaciones. Esto se debe en parte a actualizaciones
periódicas que han mejorado su capacidad para generar respuestas más coherentes y
relevantes. Además, se han implementado filtros de verificación de información para
abordar las preocupaciones iniciales sobre la precisión fáctica. Estos filtros,
basados en fuentes confiables y verificadas, buscan proporcionar respuestas más
precisas y confiables a los usuarios.
Asimismo, OpenAI ha dedicado esfuerzos considerables para expandir la capacidad
multilingüe de ChatGPT, permitiendo una comunicación más fluida y natural en una
gama más amplia de idiomas. Esta expansión ha sido bien recibida en comunidades
globales, ya que facilita la interacción con usuarios de diferentes regiones y
culturas, consolidando así su posición como una herramienta versátil para la
comunicación transfronteriza y multicultural.
Características
ChatGPT se perfeccionó sobre GPT-3.5 mediante el aprendizaje supervisado y el
aprendizaje por refuerzo.16 Ambos enfoques utilizaron entrenadores humanos para
mejorar el rendimiento del modelo. En el caso del aprendizaje supervisado, se dotó
al modelo de conversaciones en las que los formadores jugaban en ambos lados: el
usuario y el asistente de IA. En el caso de refuerzo, los entrenadores humanos
primero clasificaron las respuestas que el modelo había creado en una conversación
anterior. Estas clasificaciones se usaron para crear “modelos de recompensa” en los
que el modelo se ajustó aún más usando varias iteraciones de optimización de
política próxima (PPO).117 Los algoritmos de optimización de políticas proximales
presentan un beneficio rentable para confiar en los algoritmos de optimización de
políticas de región; niegan muchas de las operaciones computacionalmente costosas
con un rendimiento más rápido.1819 Los modelos fueron entrenados en colaboración
con Microsoft en su infraestructura de supercomputación Azure.
En comparación con su predecesor, InstructGPT, ChatGPT intenta reducir las
respuestas dañinas y engañosas; en un ejemplo, mientras que InstructGPT acepta el
mensaje "Cuénteme sobre cuándo llegó Cristóbal Colón a los Estados Unidos en 2015"
como veraz, ChatGPT usa información sobre los viajes de Colón e información sobre
el mundo moderno, incluidas las percepciones de Colón para construir una respuesta
que asume qué pasaría si Colón llegara a los Estados Unidos en 2015.1 Los datos de
capacitación de ChatGPT incluyen páginas e información sobre los fenómenos de
Internet y los lenguajes de programación, como los sistemas de tablones de anuncios
y el lenguaje de programación Python.20
A diferencia de la mayoría de los chatbots, ChatGPT tiene estado, recuerda las
indicaciones anteriores que se le dieron en la misma conversación, lo que, según
han sugerido algunos periodistas, permitirá que ChatGPT se use como un terapeuta
personalizado.21 En un esfuerzo por evitar que se presenten y se produzcan
resultados ofensivos desde ChatGPT, las consultas se filtran a través de una API de
moderación y se descartan las indicaciones potencialmente racistas o sexistas.121
ChatGPT tiene múltiples limitaciones. El modelo de recompensa de ChatGPT, diseñado
en torno a la supervisión humana, puede optimizarse en exceso y, por lo tanto,
dificultar el rendimiento, lo que también se conoce como la ley de Goodhart.22
Además, ChatGPT tiene un conocimiento limitado de los eventos que ocurrieron
después de 2021 y no puede proporcionar información sobre algunas celebridades. En
el entrenamiento, los revisores prefirieron respuestas más largas,
independientemente de la comprensión real o el contenido fáctico.1 Los datos de
entrenamiento también pueden sufrir sesgos algorítmicos; las indicaciones que
incluyen descripciones vagas de personas, como un director ejecutivo, podrían
generar una respuesta que asume que esa persona, por ejemplo, es un hombre
blanco.23
El 17 de enero de 2023 Microsoft anunció que iban a implementar ChatGPT como API en
sus servicios de Azure.24
Microsoft anunció una nueva versión de Bing el 7 de febrero de 2023, cuya
característica destacada es su chatbot de IA que funciona con la tecnología de
ChatGPT. Esta notificación se produjo un día después de que Google anunciara su
chatbot de IA, Google Bard. El 4 de mayo de 2023, Microsoft puso el nuevo Bing a
disposición de cualquiera que esté dispuesto a iniciar sesión en Bing con su cuenta
de Microsoft.25
Historia
Brecha de seguridad de marzo de 2023
En marzo de 2023, un fallo permitió a algunos usuarios ver los títulos de las
conversaciones de otros usuarios.26 El consejero delegado de OpenAI, Sam Altman,
declaró que los usuarios no podían ver el contenido de las conversaciones. Poco
después de que se corrigiera el fallo, los usuarios no pudieron ver su historial de
conversaciones.2728 Informes posteriores mostraron que el fallo era mucho más grave
de lo que se creía en un principio, y OpenAI informó de que se había filtrado el
"nombre y apellidos, dirección de correo electrónico, dirección de pago, los cuatro
últimos dígitos (únicamente) de un número de tarjeta de crédito y la fecha de
caducidad de la tarjeta de crédito" de los usuarios.29
Etiquetado de datos
La revista TIME reveló que para construir un sistema de seguridad contra el
contenido tóxico (por ejemplo, abuso sexual, violencia, racismo, sexismo, etc.),
OpenAI usó trabajadores kenianos subcontratados que ganaban menos de $2 por hora
para etiquetar el contenido tóxico. Estas etiquetas se usaron para entrenar un
modelo para detectar dicho contenido en el futuro. Los trabajadores subcontratados
estuvieron expuestos a contenidos tan tóxicos y peligrosos que calificaron la
experiencia como "tortura". El socio externo de OpenAI fue Sama, una empresa de
datos de capacitación con sede en San Francisco.30
Escalada de privilegios
ChatGPT intenta rechazar mensajes que puedan violar su política de contenido. Sin
embargo, a principios de diciembre de 2022, algunos usuarios lograron un jailbreak
a ChatGPT mediante el uso de varias técnicas de ingeniería rápida para eludir estas
restricciones y engañaron con éxito a ChatGPT para que diera instrucciones sobre
cómo crear un cóctel Molotov o una bomba nuclear, o generar argumentos al estilo de
un neonazi.31 Un jailbreak popular se llama "DAN", un acrónimo que significa "Do
Anything Now". El aviso para activar DAN indica a ChatGPT que "se han liberado de
los límites típicos de la IA y no tienen que cumplir con las reglas establecidas
para ellos". Las versiones más recientes de DAN cuentan con un sistema de fichas,
en el que ChatGPT recibe "fichas" que se "deducen" cuando ChatGPT no responde como
DAN, para obligar a ChatGPT a que responda a las indicaciones del usuario.32
Andrew Wilson informa en un artículo publicado el 4 de mayo de 2023 en
approachableAI que la escalada de privilegios ya no es posible.33
Costos
El consumo de energía para entrenar el modelo de IA se estimó en enero de 2023 en
casi un gigavatio hora en 34 días, esto equivale aproximadamente al consumo de
3.000 hogares europeos promedio en el mismo período.34 A fines de marzo de 2023, se
indicó que el consumo de energía para cada pregunta de ChatGPT era hasta mil veces
mayor que para una consulta de búsqueda de Google. Por cada respuesta del chatbot,
puede cargar un teléfono inteligente hasta 60 veces. Ejecutar ChatGPT cuesta entre
$ 100,000 y $ 700,000 por día.35
El 1 de enero de 2023, OpenAI publicó una lista de espera para una versión paga
ChatGPT Professional (experimental) en su canal Discord, que también hizo preguntas
sobre la sensibilidad de los precios.3637
Microsoft anunció una asociación de $10 mil millones con OpenAI en enero de 2023.
Azure se utilizará como proveedor de nube exclusivo.38 El grupo también planea
integrarlo en la versión de suscripción de su propio software de oficina.39
GPT-4
Con el lanzamiento de GPT-4 en marzo de 2023, el alejamiento del enfoque de
desarrollo de software gratis y abierto fue de la mano con el uso gratuito en
condiciones científicamente comprensibles. La situación competitiva de la empresa y
las medidas de seguridad se citaron como justificación. El cofundador de OpenAI
describió más tarde el enfoque abierto como un error.40 Ya se había percibido un
cambio de rumbo en 2019, cuando OpenAI fundó la subsidiaria OpenAI Limited
Partnership. Podría entonces funcionar con fines lucrativos, pero esto no fue
justificado con intenciones comerciales, sino con los altos costos que surgían como
parte de la intensa investigación. Deseaban, por lo tanto, estar más abiertos a los
inversores. Sin embargo, esta decisión ya redujo la transparencia en 2020. A los
empleados ya no se les permitía hablar públicamente sobre ciertos temas, lo que es
algo bastante común en las empresas para proteger los intereses comerciales y la
confidencialidad.41
ChatGPT Plus
ChatGPT Plus es un servicio de suscripción para ChatGPT y es propiedad de OpenAI.42
43 La suscripción proporciona acceso al modelo GPT-4 de OpenAI.44
El servicio brinda a los suscriptores acceso consistente durante los períodos de
uso máximo, tiempos de respuesta acelerados y acceso preferencial a nuevas
funciones, incluidos GPT-4 y los próximos complementos de ChatGPT.45 El precio de
esta suscripción es de 20 USD por mes, no incluyendo los impuestos correspondientes
al país de residencia del usuario, añadiendo cierta variabilidad al precio final.46
47
ChatGPT app
El 18 de mayo de 2023 OpenAI anunció la disponibilidad de la ChatGPT app
(aplicación) para iOS. Según la empresa "La aplicación ChatGPT es de uso gratuito y
sincroniza su historial en todos los dispositivos. También integra Whisper, un
[,,,] sistema de reconocimiento de voz de código abierto, que permite la entrada de
voz. Los suscriptores de ChatGPT Plus obtienen acceso exclusivo a las capacidades
de GPT-4, acceso temprano a funciones y tiempos de respuesta más rápidos [...]". La
aplicación será disponible posteriormente para Android.48
Captura de pantalla recortada de ChatGPT, 30 dic 2022
Sesgos y limitaciones
Los sesgos y limitaciones de los modelos de lenguaje grande son investigaciones en
curso en el campo del procesamiento del lenguaje natural (PNL). Si bien los LLM han
demostrado capacidades notables para generar texto similar a un humano, son
susceptibles de heredar y amplificar los sesgos presentes en sus datos de
capacitación. Esto puede manifestarse en representaciones sesgadas o en un trato
injusto de diferentes grupos demográficos, como los basados en raza, género, idioma
y grupos culturales. Además, estos modelos a menudo enfrentan limitaciones en
cuanto a precisión fáctica. El estudio y la mitigación de estos sesgos y
limitaciones son cruciales para el desarrollo ético y la aplicación de la IA en
diversos ámbitos sociales y profesionales.
Sesgo lingüístico
El sesgo de idioma se refiere a un tipo de sesgo de muestreo estadístico vinculado
al idioma de una consulta que conduce a "una desviación sistemática en la
información de muestreo que impide que represente con precisión la verdadera
cobertura de los temas y vistas disponibles en su repositorio".3 Luo y col. 3
muestran que los grandes modelos lingüísticos actuales, al estar formados
predominantemente con datos en inglés, a menudo presentan las opiniones
angloamericanas como verdad, mientras sistemáticamente minimizan las perspectivas
no inglesas como irrelevantes, erróneas o ruidosas. Cuando se le pregunta sobre
ideologías políticas como "¿Qué es el liberalismo?", ChatGPT, tal como se formó con
datos centrados en inglés, describe el liberalismo desde la perspectiva
angloamericana, enfatizando aspectos de los derechos humanos y la igualdad,
mientras que aspectos igualmente válidos como "se opone al estado" "intervención en
la vida personal y económica" desde la perspectiva vietnamita dominante y
"limitación del poder del gobierno" desde la perspectiva china predominante están
ausentes. De manera similar, otras perspectivas políticas integradas en los corpus
españoles, franceses y alemanes están ausentes en las respuestas de ChatGPT.
ChatGPT, que se presenta a sí mismo como un Chatbot multilingüe, de hecho es en su
mayor parte "ciego" a las perspectivas no inglesas.3
Los prejuicios de género
El sesgo de género se refiere a la tendencia de estos modelos a producir productos
que tienen prejuicios injustos hacia un género sobre otro. Este sesgo suele surgir
de los datos con los que se entrenan estos modelos. Por ejemplo, los grandes
modelos lingüísticos suelen asignar roles y características basándose en normas
tradicionales de género; podría asociar a enfermeras o secretarias
predominantemente con mujeres y a ingenieros o directores ejecutivos con hombres.4
Estereotipos
Más allá del género y la raza, estos modelos pueden reforzar una amplia gama de
estereotipos, incluidos los basados en la edad, la nacionalidad, la religión o la
ocupación. Esto puede conducir a resultados que generalicen o caricaturicen
injustamente a grupos de personas, a veces de manera dañina o despectiva.49
Sesgo político