{"id":1624,"date":"2023-08-29T14:39:33","date_gmt":"2023-08-29T17:39:33","guid":{"rendered":"https:\/\/datamining.dc.uba.ar\/predictivos\/?p=1624"},"modified":"2023-08-29T20:16:21","modified_gmt":"2023-08-29T23:16:21","slug":"un-asistente-de-inteligencia-artificial-para-el-derecho-argentino","status":"publish","type":"post","link":"https:\/\/datamining.dc.uba.ar\/predictivos\/?p=1624","title":{"rendered":"Un asistente de inteligencia artificial para el derecho argentino"},"content":{"rendered":"<p><b>Investigadores locales est\u00e1n trabajando en el desarrollo de un asistente de inteligencia artificial (IA) experto en temas de abogac\u00eda. Se trata de Edgar Altszyler (Investigador del LIAA-ICC, Profesor de la Maestr\u00eda en Ciencia de Datos y Consultor de IA), David Mielnik (Abogado y Profesor de la Universidad Torcuato Di Tella) y Francisco Valentini (Doctorando en Ciencias de la Computaci\u00f3n en el LIAA-ICC). El prop\u00f3sito de estos cient\u00edficos de datos es lograr que la aplicaci\u00f3n pueda responder preguntas legales complejas y hacerlo rigurosamente a partir de una base de datos real de la jurisprudencia argentina.<\/b><\/p>\n<p><span style=\"font-weight: 400;\">A fines del a\u00f1o 2022 la empresa Open AI lanz\u00f3 la versi\u00f3n de prueba gratuita de una herramienta de inteligencia artificial denominada ChatGPT, un programa inform\u00e1tico que simula y procesa conversaciones humanas y est\u00e1 entrenado para responder casi cualquier pregunta o consigna que se le d\u00e9. La aplicaci\u00f3n est\u00e1 impactando en much\u00edsimas industrias y actividades productivas, y el \u00e1rea de legales no es la excepci\u00f3n.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Aproximadamente seis meses despu\u00e9s de que OpenAI presentara el prototipo de ChatGPT para uso p\u00fablico, muchos abogados en los Estados Unidos, el Reino Unido y Canad\u00e1 ya conocen la herramienta y lo que puede hacer. Recientemente una<\/span><a href=\"https:\/\/www.thomsonreuters.com.ar\/es\/soluciones-legales\/blog-legal\/chatgpt-ia-en-estudios-juridicos.html\" target=\"_blank\" rel=\"noopener\"> <span style=\"font-weight: 400;\">encuesta de Thomson Reuters<\/span><\/a><span style=\"font-weight: 400;\"> evidenci\u00f3 que un 75% de los letrados cree que ChatGPT y su tecnolog\u00eda general, la inteligencia artificial (IA) generativa, se puede aplicar f\u00e1cilmente al trabajo legal, mientras que m\u00e1s del 50% cree que deber\u00eda usarse para el trabajo legal. Un detalle relevante es que GPT-4 (la versi\u00f3n mejorada de ChatGPT) <\/span><a href=\"https:\/\/law.stanford.edu\/2023\/04\/19\/gpt-4-passes-the-bar-exam-what-that-means-for-artificial-intelligence-tools-in-the-legal-industry\/\" target=\"_blank\" rel=\"noopener\"><span style=\"font-weight: 400;\">aprob\u00f3 el examen de finalizaci\u00f3n de la carrera de derecho en Estados Unidos<\/span><\/a><span style=\"font-weight: 400;\">, superando ampliamente a un estudiante de abogac\u00eda promedio y acerc\u00e1ndose al percentil 90.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Actualmente el equipo coordinado por <\/span><b>Edgar Altszyler<\/b><span style=\"font-weight: 400;\"> -Investigador del <a href=\"https:\/\/liaa.dc.uba.ar\/es\/inicio\/\" target=\"_blank\" rel=\"noopener\">Laboratorio de Inteligencia Artificial Aplicada LIAA ICC<\/a> , Profesor de la Maestr\u00eda en Ciencia de Datos y Consultor de IA- se encuentra estudiando el t\u00f3pico de <\/span><b>aplicaciones jur\u00eddicas en la inteligencia artificial generativa<\/b><span style=\"font-weight: 400;\">. Y expone que el uso actual en abogac\u00eda de la \u00faltima versi\u00f3n de ChatGPT, GPT-4, as\u00ed como est\u00e1 configurado, demuestra claros problemas y le falta una \u201cvuelta de tuerca\u201d para que resulte confiable:<\/span><\/p>\n<p><span style=\"font-weight: 400;\">1)<\/span><span style=\"font-weight: 400;\">\u00a0 \u00a0 <\/span><b>Falsedades<\/b><span style=\"font-weight: 400;\">: GPT-4 tiene la habilidad de generar texto coherente pero no tiene por qu\u00e9 ser ver\u00eddico. Entonces en algunas ocasiones inventa datos. GPT-4 escribe textos que es probable que hayan sido dichos por un humano, pero no chequea lo que dice, las fuentes de lo que dice. \u201c<\/span><i><span style=\"font-weight: 400;\">Son alucinaciones porque devuelve datos falsos. Es algo inherente al modelo y GPT-4 no tiene manera de salir de este problema<\/span><\/i><span style=\"font-weight: 400;\">\u201d, puntualiza Altszyler.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">2)<\/span><span style=\"font-weight: 400;\">\u00a0 \u00a0 <\/span><b>Limitaci\u00f3n de datos<\/b><span style=\"font-weight: 400;\">: GPT-4 est\u00e1 limitado a los datos con que fue entrenado. Entonces no tiene acceso a toda la jurisprudencia argentina (o a la de otros pa\u00edses) y no tiene por qu\u00e9 saber de nuestras leyes. Probablemente posea muchos m\u00e1s datos jur\u00eddicos de Estados Unidos que de otros pa\u00edses del mundo.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">3)<\/span><span style=\"font-weight: 400;\">\u00a0 \u00a0 <\/span><b>Ausencia de citas o referencias v\u00e1lidas<\/b><span style=\"font-weight: 400;\">: Considerando que GPT-4 no sabe de d\u00f3nde aprendi\u00f3 lo que aprendi\u00f3, no puede incluir citas en su texto. \u201c<\/span><i><span style=\"font-weight: 400;\">No te da una referencia v\u00e1lida de un art\u00edculo para sustentar lo que dice. Simplemente te responde, le pregunt\u00e1s y sigue respondiendo. Realmente no sab\u00e9s si es verdad lo que dice y no sab\u00e9s de d\u00f3nde sac\u00f3 la informaci\u00f3n. Esto genera una limitaci\u00f3n en los usos reales que pueden hacer los abogados de la aplicaci\u00f3n<\/span><\/i><span style=\"font-weight: 400;\">\u201d, agrega el investigador. De hecho un abogado estadounidense se enfrenta a posibles sanciones despu\u00e9s de haber usado ChatGPT para redactar un escrito y descubrirse que la aplicaci\u00f3n se hab\u00eda inventado toda una serie de supuestos precedentes legales.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Teniendo en cuenta estas limitaciones, <\/span><b>el equipo coordinado por Altszyler implement\u00f3 una nueva t\u00e9cnica denominada <\/b><b><i>Retrieval-Augmented Language Model<\/i><\/b><b> o <\/b><b><i>Retrieval-Augmented Generation<\/i><\/b><b>, para usar GPT-4 como servicio, cuyo valor agregado es sumar informaci\u00f3n real de una base de datos a las respuestas<\/b><span style=\"font-weight: 400;\">. \u201c<\/span><i><span style=\"font-weight: 400;\">Primero hac\u00e9s una pregunta, vas a hacer una b\u00fasqueda a tu base de datos que tiene los datos reales de la jurisprudencia argentina para ver d\u00f3nde est\u00e1n los elementos relevantes para responder esa pregunta, de la cual despu\u00e9s aliment\u00e1s al asistente para que la respuesta se base en la informaci\u00f3n extra que est\u00e1s aportando<\/span><\/i><span style=\"font-weight: 400;\">\u201d, explica Altszyler.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">\u201c<\/span><i><span style=\"font-weight: 400;\">La vuelta de tuerca de esta aplicaci\u00f3n es que adem\u00e1s uno puede sumar links a los elementos de la respuesta de ChatGPT, seg\u00fan de d\u00f3nde surgi\u00f3 la informaci\u00f3n relevante. Entonces en este caso resolvimos los problemas de veracidad, le incorporamos datos reales (toda la jurisprudencia y leyes argentinas), y tambi\u00e9n tiene citas o referencias reales que se pueden usar en las respuestas<\/span><\/i><span style=\"font-weight: 400;\">\u201d, argumenta el investigador y profesor de la Maestr\u00eda. De ese modo, el asistente de IA va a responder la pregunta exclusivamente en el contexto de la base de datos reales aportada por los investigadores, no lo har\u00e1 con datos que no est\u00e9n chequeados. As\u00ed, toda la comunidad jur\u00eddica se beneficiar\u00e1 en el uso profesional de este asistente de IA, el primero que se desarrolla con usos jur\u00eddicos.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">El equipo ya realiz\u00f3 peque\u00f1as pruebas de la aplicaci\u00f3n y funciona muy bien. \u201c<\/span><i><span style=\"font-weight: 400;\">Hoy en d\u00eda esto se est\u00e1 implementando en otras \u00e1reas de la industria (con empresas que pueden acceder f\u00e1cil y r\u00e1pido a los datos internos propios de productos, servicios o clientes). Es realmente una revoluci\u00f3n el uso de ChatGPT con datos propios, no es algo que nosotros inventamos. Pero vamos a ser los primeros en desarrollarlo para el derecho argentino. Lo que est\u00e1 subestudiado es c\u00f3mo hacer estas conexiones entre ChatGPT y una base de datos extra, hay muy poca bibliograf\u00eda cient\u00edfica o cantidad de casos sobre c\u00f3mo optimizar estos usos y d\u00f3nde est\u00e1n las limitaciones u oportunidades de los textos por lo que tambi\u00e9n usaremos esta experiencia para generar publicaciones cient\u00edficas del tema<\/span><\/i><span style=\"font-weight: 400;\">\u201d, aclara Altszyler.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Con respecto a futuros usos para el \u00e1mbito jur\u00eddico local, considerando que un asistente de IA tiene la capacidad de emular el razonamiento humano y responder sobre cuestiones complejas, uno podr\u00eda contarle a la aplicaci\u00f3n todos los hechos de un caso y podr\u00eda pedirle que opine los motivos a favor, los motivos en contra, qu\u00e9 elementos cree que hay que tener en cuenta, cu\u00e1les son los elementos principales y qu\u00e9 tipo de informaci\u00f3n adicional deber\u00eda tener en cuenta un abogado o un juez para complementar la toma de decisiones sobre lo que ya opinaba anteriormente del caso. De este modo, el profesional de las ciencias jur\u00eddicas puede interactuar pregunt\u00e1ndole a ChatGPT ciertas cosas y despu\u00e9s lo chequea. Pero esta b\u00fasqueda de informaci\u00f3n se har\u00eda siempre de manera conversacional, no como una b\u00fasqueda en Google o Wikipedia.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">\u201c<\/span><i><span style=\"font-weight: 400;\">Creo que la abogac\u00eda deber\u00eda ser una de las \u00e1reas con m\u00e1s impacto en IA, con todas las nuevas tecnolog\u00edas que se desarrollan. Claramente la IA es muy rica procesando texto, extrayendo informaci\u00f3n relevante, tomando decisiones, resumiendo y encontrando elementos importantes en cada texto jur\u00eddico<\/span><\/i><span style=\"font-weight: 400;\">\u201d, precisa Altszyler. Teniendo en cuenta que gran parte del derecho sucede en los papeles, al poder reunir muchos textos y datos jur\u00eddicos digitalizados (favorecido por la Ley Nacional 26856 que establece que todos los tribunales en segunda instancia, como c\u00e1maras de apelaci\u00f3n y tribunales orales, tienen que publicar todas las decisiones que emiten) se estima que gran parte del esfuerzo de los abogados puede ser acelerado por la IA.<\/span><\/p>\n<div id=\"attachment_1625\" style=\"width: 348px\" class=\"wp-caption alignleft\"><a href=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2023\/08\/EdgarAltszyler.jpg\"><img aria-describedby=\"caption-attachment-1625\" decoding=\"async\" loading=\"lazy\" class=\" wp-image-1625\" src=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2023\/08\/EdgarAltszyler-300x295.jpg\" alt=\"\" width=\"338\" height=\"332\" srcset=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2023\/08\/EdgarAltszyler-300x295.jpg 300w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2023\/08\/EdgarAltszyler-1024x1006.jpg 1024w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2023\/08\/EdgarAltszyler-768x754.jpg 768w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2023\/08\/EdgarAltszyler-1536x1509.jpg 1536w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2023\/08\/EdgarAltszyler.jpg 2039w\" sizes=\"(max-width: 338px) 100vw, 338px\" \/><\/a><p id=\"caption-attachment-1625\" class=\"wp-caption-text\">Dr. Edgar Altszyler<\/p><\/div>\n<p><span style=\"font-weight: 400;\">Por \u00faltimo, <\/span><b>Altszyler afirma que el prop\u00f3sito de su grupo de investigadores es mantenerse a la vanguardia de estas preguntas cient\u00edficas, que se encuentran en la frontera entre la investigaci\u00f3n y la industria<\/b><span style=\"font-weight: 400;\">. <\/span><i><span style=\"font-weight: 400;\">\u201cUno de los pedidos principales que tenemos de transferencia tecnol\u00f3gica es implementar estos asistentes de IA basados en datos reales. Nosotros abordamos un interrogante abierto de investigaci\u00f3n a partir de una herramienta que est\u00e1 cambiando el mundo e impactando en todas las industrias, no s\u00f3lo en la industria legal<\/span><\/i><span style=\"font-weight: 400;\">\u201d. Al mismo tiempo, complementa que ya han trabajado en otro proyecto que utiliza el <\/span><b>modelado de t\u00f3picos (<\/b><b><i>topic modeling<\/i><\/b><b>) para generar un estudio a gran escala de lo que est\u00e1 sucediendo hoy en d\u00eda en la jurisprudencia argentina<\/b><span style=\"font-weight: 400;\">: analizar el contenido textual de la jurisprudencia Argentina en los \u00faltimos veinte a\u00f1os (un <\/span><i><span style=\"font-weight: 400;\">dataset<\/span><\/i><span style=\"font-weight: 400;\"> de 115.861 sentencias judiciales, pronunciadas por la C\u00e1mara Federal de Casaci\u00f3n Penal desde 1992 hasta 2022) y extraer patrones y reglas latentes en la toma de decisi\u00f3n concreta de los juzgados. Este proyecto se encuentra en proceso de publicaci\u00f3n.<\/span><\/p>\n<p><b>El equipo de investigadores<\/b><\/p>\n<p><strong>Edgar Altszyler<\/strong><\/p>\n<p><span style=\"font-weight: 400;\">El Dr. Edgar Altszyler es consultor de IA, investigador del CONICET en el Laboratorio de Inteligencia Artificial Aplicada, UBA y profesor de Procesamiento de Lenguaje Natural en la Maestr\u00eda en Ciencia de Datos, UBA.\u00a0 El Dr. Altszyler es Licenciado en F\u00edsica del Instituto Balseiro y doctor en F\u00edsica de la UBA.<\/span><\/p>\n<p><strong>David Mielnik<\/strong><\/p>\n<p><span style=\"font-weight: 400;\">David Mielnik es abogado y m\u00e1ster en derecho penal (UTDT). Desde 2013 es profesor titular de Derecho Penal I y II, y desde 2022, de An\u00e1lisis Computacional del Derecho y Legal Analytics en la carrera de abogac\u00eda.<\/span><\/p>\n<p><strong>Francisco Valentini<\/strong><\/p>\n<p><span style=\"font-weight: 400;\">Francisco Valentini es Licenciado en Econom\u00eda (FCE-UBA) y Especialista en Explotaci\u00f3n de Datos (FCEN-UBA). Actualmente es estudiante de Doctorado en Computaci\u00f3n (FCEN-UBA) y docente de grado en el Instituto Tecnol\u00f3gico de Buenos Aires (ITBA). Trabaja en Procesamiento del Lenguaje Natural aplicado.<\/span><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Investigadores locales est\u00e1n trabajando en el desarrollo de un asistente de inteligencia artificial (IA) experto en temas de abogac\u00eda, para lograr que la aplicaci\u00f3n pueda responder preguntas legales complejas y hacerlo rigurosamente a partir de una base de datos real de la jurisprudencia argentina.<\/p>\n","protected":false},"author":4,"featured_media":1627,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"_mi_skip_tracking":false},"categories":[32,24,25],"tags":[],"_links":{"self":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/1624"}],"collection":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/users\/4"}],"replies":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=1624"}],"version-history":[{"count":7,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/1624\/revisions"}],"predecessor-version":[{"id":1633,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/1624\/revisions\/1633"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/media\/1627"}],"wp:attachment":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=1624"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=1624"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=1624"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}