{"id":1811,"date":"2025-10-22T14:16:38","date_gmt":"2025-10-22T17:16:38","guid":{"rendered":"https:\/\/datamining.dc.uba.ar\/predictivos\/?p=1811"},"modified":"2025-10-22T14:21:09","modified_gmt":"2025-10-22T17:21:09","slug":"ciencias-sociales-computacionales-cuando-los-datos-y-el-aprendizaje-automatico-ayudan-a-pensar-la-sociedad","status":"publish","type":"post","link":"https:\/\/datamining.dc.uba.ar\/predictivos\/?p=1811","title":{"rendered":"Ciencias sociales computacionales: cuando los datos y el aprendizaje autom\u00e1tico ayudan a pensar la sociedad"},"content":{"rendered":"<p><b>Germ\u00e1n Rosati es profesor de la Maestr\u00eda en Ciencia de Datos, donde dicta Visualizaci\u00f3n de la Informaci\u00f3n. Es investigador de CONICET en la Escuela Interdisciplinaria de Altos Estudios Sociales de la Universidad Nacional de San Mart\u00edn (EIDAES-UNSAM) y trabaja en la aplicaci\u00f3n de m\u00e9todos de Machine Learning a las Ciencias Sociales y al an\u00e1lisis de texto.<\/b><\/p>\n<p><b>All\u00ed en UNSAM coordina la Diplomatura en Ciencias Sociales Computacionales y Humanidades Digitales y factor~data, un laboratorio en Ciencias Sociales Computacionales. Tambi\u00e9n en IDAES es Profesor Titular de \u00abT\u00e9cnicas de Investigaci\u00f3n Cuantitativa\u00bb en las carreras de Sociolog\u00eda y Antropolog\u00eda.<\/b><\/p>\n<p><b>En cuanto a su formaci\u00f3n es Doctor en Ciencias Sociales y Licenciado en Sociolog\u00eda por la Universidad de Buenos Aires y Mag\u00edster en Generaci\u00f3n y An\u00e1lisis de Informaci\u00f3n Estad\u00edstica por la Universidad Nacional de Tres de Febrero.<\/b><\/p>\n<p><b>Durante esta entrevista con Predictivos, Germ\u00e1n relata de qu\u00e9 modo aplicar la visualizaci\u00f3n de datos para mejorar la toma de decisiones, su mirada sobre el auge de la IA Generativa y c\u00f3mo las ciencias sociales computacionales pueden contribuir a resolver problemas m\u00e1s eficientemente.<\/b><\/p>\n<hr \/>\n<p><b>En primer lugar, quer\u00eda hablar de tu rol como profesor en la Maestr\u00eda.<\/b><\/p>\n<p><span style=\"font-weight: 400;\">Estoy dictando la materia Visualizaci\u00f3n de la Informaci\u00f3n junto con Claudio Delrieux y Paula Feldman.<\/span> <span style=\"font-weight: 400;\">Es una materia optativa dentro de la Maestr\u00eda, aunque a veces termina funcionando como obligatoria de acuerdo a la oferta de ese cuatrimestre.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">En la \u00faltima cursada tuvimos alrededor de 17 inscriptos con much\u00edsimo inter\u00e9s y participaci\u00f3n. Creo que es una materia at\u00edpica respecto al plan de estudios, ya que tiene una componente de dise\u00f1o visual, no s\u00f3lo de ciencia de datos. Est\u00e1 toda la parte de an\u00e1lisis de datos pero hay buena parte de discusi\u00f3n sobre cuestiones de \u201cdise\u00f1o\u201d: qu\u00e9 elementos tiene una visualizaci\u00f3n, c\u00f3mo construirlos de forma efectiva, c\u00f3mo disponerlos en el \u201clienzo\u201d, c\u00f3mo trabajar un <\/span><i><span style=\"font-weight: 400;\">dataset<\/span><\/i><span style=\"font-weight: 400;\"> para hacer una visualizaci\u00f3n que sea efectiva, innovadora e interesante. Eso nos lleva a tocar temas que (en apariencia) est\u00e1n poco relacionados con la ciencia de datos como la teor\u00eda del color, por ejemplo.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Siempre hay m\u00e1s de una decisi\u00f3n posible sobre c\u00f3mo presentar los datos y proponer visualizaciones. Sobre todo en el pr\u00e1ctico, quienes cursan encuentran esta riqueza en ver que en un mismo <\/span><i><span style=\"font-weight: 400;\">dataset<\/span><\/i><span style=\"font-weight: 400;\"> se puede resolver problemas de formas distintas y discutimos visualizaciones que hicieron otros, por lo que siempre hay varias respuestas posibles.<\/span><\/p>\n<p><b>\u00bfPodr\u00edas contar alg\u00fan ejemplo de estas visualizaciones que hayan trabajado en la materia?<\/b><\/p>\n<p><span style=\"font-weight: 400;\">Trabajamos un poco el marco conceptual de la materia con la propuesta de Edward Tufte, profesor em\u00e9rito de Yale, estad\u00edstico y adem\u00e1s escultor. Todo un personaje. \u00c9l tiene una postura minimalista extrema, por as\u00ed decirlo, al respecto de la forma y los elementos que tiene que contener una visualizaci\u00f3n.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Tufte plantea que las visualizaciones tienen que tener lo m\u00ednimo e indispensable y ni un puntito de tinta de m\u00e1s, o en este caso ni un p\u00edxel de m\u00e1s ahora que todo es digital.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Trabajamos una serie de ejemplos que analiza \u00e9l en uno de sus libros. Hay un ejemplo que es de los m\u00e1s conocidos, el del accidente del transbordador espacial Challenger. En 1986 explot\u00f3 pocos segundos despu\u00e9s del despegue, por lo que murieron sus siete tripulantes.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">El an\u00e1lisis forense de las causas de la explosi\u00f3n evidenci\u00f3 que fue provocada por una falla en las juntas que separaban a los propulsores del combustible de hidr\u00f3geno l\u00edquido debido a la baja temperatura del d\u00eda del lanzamiento (mucho m\u00e1s baja que las de los d\u00edas que se hab\u00eda hecho en los ensayos). Pero lo interesante es que hay un informe previo en el que los t\u00e9cnicos ya hab\u00edan identificado esa relaci\u00f3n entre fallas y temperatura y hab\u00edan alertado sobre los riesgos.<\/span><\/p>\n<p><a href=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/dano-temperatura.jpg\"><img decoding=\"async\" loading=\"lazy\" class=\"aligncenter size-full wp-image-1813\" src=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/dano-temperatura.jpg\" alt=\"\" width=\"912\" height=\"494\" srcset=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/dano-temperatura.jpg 912w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/dano-temperatura-300x163.jpg 300w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/dano-temperatura-768x416.jpg 768w\" sizes=\"(max-width: 912px) 100vw, 912px\" \/><\/a><span style=\"font-weight: 400;\">En su libro <\/span><i><span style=\"font-weight: 400;\">Visual Explanations<\/span><\/i><span style=\"font-weight: 400;\">, Tufte analiza el informe y propone un gr\u00e1fico de dispersi\u00f3n<\/span> <span style=\"font-weight: 400;\">(<\/span><i><span style=\"font-weight: 400;\">scatter plot<\/span><\/i><span style=\"font-weight: 400;\">)<\/span> <span style=\"font-weight: 400;\">para mostrar la relaci\u00f3n entre la temperatura y el da\u00f1o de las juntas (cuanto m\u00e1s fr\u00edo mayor era el da\u00f1o), extiende el gr\u00e1fico para mostrar c\u00f3mo la temperatura pronosticada para el d\u00eda del lanzamiento se encontraba en una zona de alto riesgo, muy por fuera de las observaciones anteriores. Y su conclusi\u00f3n es que una visualizaci\u00f3n tan clara habr\u00eda hecho que la decisi\u00f3n de lanzar el transbordador en esas condiciones fuera insostenible.\u00a0<\/span><\/p>\n<p><a href=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/Tufte-al-rescate.jpg\"><img decoding=\"async\" loading=\"lazy\" class=\"aligncenter size-full wp-image-1814\" src=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/Tufte-al-rescate.jpg\" alt=\"\" width=\"831\" height=\"540\" srcset=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/Tufte-al-rescate.jpg 831w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/Tufte-al-rescate-300x195.jpg 300w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/Tufte-al-rescate-768x499.jpg 768w\" sizes=\"(max-width: 831px) 100vw, 831px\" \/><\/a><\/p>\n<p><a href=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/nomenclaturas-diferentes.jpg\"><img decoding=\"async\" loading=\"lazy\" class=\"aligncenter size-full wp-image-1815\" src=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/nomenclaturas-diferentes.jpg\" alt=\"\" width=\"877\" height=\"504\" srcset=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/nomenclaturas-diferentes.jpg 877w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/nomenclaturas-diferentes-300x172.jpg 300w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/nomenclaturas-diferentes-768x441.jpg 768w\" sizes=\"(max-width: 877px) 100vw, 877px\" \/><\/a><\/p>\n<p><span style=\"font-weight: 400;\">Para resumir, Tufte muestra, bastante convincentemente, c\u00f3mo un mal dise\u00f1o de la informaci\u00f3n impidi\u00f3 a los tomadores de decisiones comprender los riesgos y propuso una soluci\u00f3n a esa falta de visualizaci\u00f3n clara.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Con esos extractos del informe, en la materia discutimos c\u00f3mo se dispuso la informaci\u00f3n y vemos qu\u00e9 propuestas de \u201ccorrecci\u00f3n\u201d se podr\u00edan hacer. Est\u00e1 bueno porque es un caso bastante integral, no es un ejemplo suelto.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Tomamos, tambi\u00e9n, el caso famoso del mapa de c\u00f3lera de John Snow, y trabajamos con visualizaciones del INDEC y de trabajos acad\u00e9micos. La idea es detectar puntos d\u00e9biles en la visualizaci\u00f3n y proponer mejoras.<\/span><\/p>\n<p><b>En cuanto al eje de tus proyectos que es el de las ciencias sociales computacionales, te quer\u00eda preguntar c\u00f3mo surgi\u00f3 tu conexi\u00f3n entre lo que son las ciencias sociales y el an\u00e1lisis de datos con herramientas de IA.<\/b><\/p>\n<p><a href=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/interior-ciencias-sociales-computacionales.jpg\"><img decoding=\"async\" loading=\"lazy\" class=\"aligncenter wp-image-1816\" src=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/interior-ciencias-sociales-computacionales.jpg\" alt=\"\" width=\"437\" height=\"374\" srcset=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/interior-ciencias-sociales-computacionales.jpg 1024w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/interior-ciencias-sociales-computacionales-300x257.jpg 300w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/interior-ciencias-sociales-computacionales-768x657.jpg 768w\" sizes=\"(max-width: 437px) 100vw, 437px\" \/><\/a><\/p>\n<p><span style=\"font-weight: 400;\">Mi formaci\u00f3n de grado es en sociolog\u00eda e hice una maestr\u00eda en estad\u00edstica y despu\u00e9s el doctorado en ciencias sociales. Hace unos cuantos a\u00f1os que empec\u00e9 a trabajar con estas t\u00e9cnicas, primero en consultor\u00eda con datos m\u00e1s tradicionales (encuestas, censos, datos de nivel socioecon\u00f3mico, etc.).<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Despu\u00e9s har\u00e1 unos doce a\u00f1os, un poco por inter\u00e9s propio pero tambi\u00e9n por necesidad laboral, me met\u00ed en cuestiones vinculadas al aprendizaje autom\u00e1tico.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Al principio en un proyecto con el ex Ministerio de Trabajo, en la Secretar\u00eda de Informaci\u00f3n Estad\u00edstica, donde se gener\u00f3 un modelo de imputaci\u00f3n de datos de ingreso, usando una serie de t\u00e9cnicas lazo. Ese estudio despu\u00e9s sali\u00f3 publicado en una revista de ciencias sociales.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Y luego mi trabajo se orient\u00f3 m\u00e1s a proyectos de procesamiento del lenguaje natural (NLP) aplicado a problemas sociales.<\/span><\/p>\n<p><b>Si bien la sociolog\u00eda siempre fue acompa\u00f1ando a la ciencia de datos, a\u00fan no habr\u00eda una comunidad tan grande en Machine Learning aplicado a ciencias sociales. \u00bfCoincid\u00eds con esta visi\u00f3n, es una cuesti\u00f3n de madurez de la interdisciplina?<\/b><\/p>\n<p><span style=\"font-weight: 400;\">Creo (o m\u00e1s bien espero) que este campo disciplinar no tan nuevo que se llama \u201cciencias sociales computacionales\u201d apunta a romper esa barrera. Pero el <\/span><i><span style=\"font-weight: 400;\">Machine Learning<\/span><\/i><span style=\"font-weight: 400;\"> deber\u00eda ser una herramienta m\u00e1s para las ciencias sociales. Aunque todav\u00eda no lo sea, por lo menos en Argentina.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Pero lo que s\u00ed veo, entre los estudiantes de grado y particularmente en las carreras de sociolog\u00eda y antropolog\u00eda de la UNSAM, donde doy clase, es cada vez mayor inter\u00e9s por estos temas. Ah\u00ed armamos un trayecto de cuatro materias optativas, y tambi\u00e9n un diploma en Ciencias Sociales Computacionales y Humanidades Digitales. Eso est\u00e1 empezando a vincular m\u00e9todos \u201ccomputacionales\u201d o de aprendizaje autom\u00e1tico con las ciencias sociales, aunque la coyuntura nos muestra que no es el mejor momento para las ciencias y la investigaci\u00f3n.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Empezar a incorporar estas herramientas en la formaci\u00f3n de grado es clave. Coincido con el diagn\u00f3stico de que parte del problema tiene que ver con la madurez relativa en las disciplinas. Habr\u00e1 que ver qu\u00e9 pasa en este contexto de ataque bastante fuerte a la ciencia en general, pero que tiene especial ensa\u00f1amiento con las ciencias sociales en particular.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">De hecho, hoy vi un tweet de Roy Hora, un historiador destacado, que mostraba las inscripciones a las carreras a las facultades de la UBA y la matr\u00edcula en ciencias sociales hab\u00edan ca\u00eddo como un 40% la facultad. Y se iba incrementando en las carreras STEM.<\/span><\/p>\n<p><b>Cambiando un poco de tema, el auge de la IA Generativa y los LLM, lleva a que cada vez haya m\u00e1s herramientas para el an\u00e1lisis textual. \u00bfQu\u00e9 aportes te parece que pueden ser interesantes para aplicaciones sociales y qu\u00e9 problem\u00e1ticas ves, donde la IA a\u00fan no resuelve bien los problemas y se sigue necesitando un fuerte apoyo humano?<\/b><\/p>\n<p><span style=\"font-weight: 400;\">Es bien complicada la cuesti\u00f3n. Por un lado, creo que hay toda una serie de tareas del proceso de investigaci\u00f3n en las que los LLMs tienen una performance alta. Creo que estas herramientas podr\u00edan ayudar a automatizar esas tareas, aunque sea parcialmente. Hablo, espec\u00edficamente de las ciencias sociales, aunque quiz\u00e1s haya puntos en com\u00fan con otras disciplinas.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Tareas vinculadas a la clasificaci\u00f3n de texto, codificaci\u00f3n de preguntas, an\u00e1lisis de entrevistas, en fin, todas aquellas operaciones que tengan que ver con el trabajo sobre texto abierto.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">De hecho, hay varios trabajos cient\u00edficos que tratan de medir la performance de distintos LLM en esas tareas, y la evidencia muestra que hay un campo de aplicaci\u00f3n bastante promisorio.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Despu\u00e9s est\u00e1 el otro uso que se hace, que para m\u00ed est\u00e1 menos sistematizado, que es el uso del modelo de lenguaje como un asistente.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Por ejemplo, para hacer un <\/span><i><span style=\"font-weight: 400;\">brainstorming <\/span><\/i><span style=\"font-weight: 400;\">es muy \u00fatil. No porque el resultado que devuelve el LLM pueda ser usado directamente y sin mediaciones. M\u00e1s bien hay un ida y vuelta entre el planteo de una pregunta, el dise\u00f1o de un primer argumento, la puesta en cuesti\u00f3n de ese argumento, etc. Se abre ah\u00ed un proceso que es interesante pero que tampoco es tan diferente a lo que uno podr\u00eda llegar intercambiando con colegas. Claro que es una utilidad acotada a una serie de tareas espec\u00edficas.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Tambi\u00e9n est\u00e1 la otra la posibilidad de aliviar parte la carga del trabajo m\u00e1s burocr\u00e1tico. La redacci\u00f3n de informes de resultados, de solicitudes de becas, subsidios, etc. en el sistema cient\u00edfico, al menos, es un g\u00e9nero discursivo bastante estandarizado y estructurado. Hay espacio, entonces, para usar RAG sofisticados, como el de la herramienta NotebookLM, ayuda a por lo menos a ordenar la informaci\u00f3n para despu\u00e9s avanzar. Creo que en esas tareas hay m\u00e1s ventajas que riesgos.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Por \u00faltimo, es necesario remarcar que las preguntas todav\u00eda las seguimos planteando los seres humanos y lo que hacen las herramientas es asistirnos en esas respuestas. Si bien hay algunos <\/span><i><span style=\"font-weight: 400;\">papers<\/span><\/i><span style=\"font-weight: 400;\"> dando vueltas donde se intenta armar un pipeline de investigaci\u00f3n totalmente automatizado, a\u00fan no tenemos del todo claro qu\u00e9 puede pasar. Todav\u00eda parecen m\u00e1s bien \u201cjuguetitos\u201d -aunque hace 5 a\u00f1os esos \u201cjuguetitos\u201d eran medio impensables-<\/span><\/p>\n<p><b>Aventur\u00e1ndonos bastante, \u00bfqu\u00e9 pasar\u00eda si el d\u00eda de ma\u00f1ana la IA con toda esa base de prompts, de preguntas humanas, acumule muchas preguntas y respuestas, y empiece a tener autonom\u00eda para que se genere una inteligencia artificial general que se pueda usar para tareas cr\u00edticas o m\u00e1s riesgosas, cu\u00e1l ser\u00eda la \u00e9tica de ese fen\u00f3meno?<\/b><\/p>\n<p><span style=\"font-weight: 400;\">Creo que por ahora estamos lejos de una inteligencia artificial general, aunque ahora estemos m\u00e1s cerca que hace cinco a\u00f1os. Es cierto que hab\u00eda cosas que eran medio impensables hace cinco a\u00f1os y hoy son bastante plausibles. Pero como m\u00ednimo estamos m\u00e1s cerca -o quiz\u00e1s ya llegamos- de un modelo general de lenguaje, que pueda resolver muchas cosas al mismo tiempo.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">En todo caso, entre la eventual aparici\u00f3n de una inteligencia artificial general y este fen\u00f3meno de los LLM y del <\/span><i><span style=\"font-weight: 400;\">Machine Learning<\/span><\/i><span style=\"font-weight: 400;\">, hay toda una serie de usos que s\u00ed son muy problem\u00e1ticos y son urgentes de resolver.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Supongamos que una empresa decidiera hacer una b\u00fasqueda laboral y decidiera filtrar curr\u00edculums con alg\u00fan LLM, que de hecho en alg\u00fan punto es lo que se est\u00e1 haciendo. En este caso, uno quisiera que el LLM, por ejemplo, no filtre esos CVS en funci\u00f3n de sesgos previos que aprendi\u00f3 en su proceso de entrenamiento; es decir, que no excluya personas en funci\u00f3n del lugar en el que viven, de su g\u00e9nero, de la escuela a la que fueron, etc. Todos estos sesgos que vienen por defecto en los LLM pueden ser, efectivamente, un gran problema para ese tipo de tareas.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Tambi\u00e9n es preocupante los usos vinculados al reconocimiento facial, que si bien no son LLMs, hay un claro uso del aprendizaje autom\u00e1tico y la IA muy direccionado hacia eso.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Hay una primera pregunta, que es de car\u00e1cter \u00e9tico o pol\u00edtico y que es previa a la discusi\u00f3n acerca de c\u00f3mo funcionan esos sistemas:\u00a0 \u00bfpor qu\u00e9 el Estado (o una empresa) tienen que reconocer mi cara en la calle que es un \u201cindicador\u201d de mi propia identidad, en la calle?<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Supongamos, s\u00f3lo por avanzar en el argumento porque yo no estoy de acuerdo con esto, que nos pusimos de acuerdo en que est\u00e1 bien que nos anden sacando fotos, tomando videos y reconociendo el rostro; a partir de ese acuerdo se abren toda una una serie de problemas en los en modelos que realizan esa tarea de detecci\u00f3n.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Hay infinidad de casos dando vueltas. El m\u00e1s reciente que recuerdo en Argentina es el del actor c\u00f3mico Osqui Guzm\u00e1n, que fue confundido por uno de esos sistema como \u201cchorro\u201d por el \u201calgoritmo\u201d. En Estados Unidos existe la \u201cLiga por la Justicia Algor\u00edtmica\u201d, un equipo de investigaci\u00f3n que hace unos a\u00f1os mostraron los sesgos que tienen este tipo de herramientas (de clase, raza, etc.)<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Una capa de problemas adicionales tiene que ver con que los gobiernos tienden a comprar paquetes o productos medio enlatados para ese tipo de tareas, que no consideran una soluci\u00f3n a esos sesgos, y eso s\u00ed es muy problem\u00e1tico.<\/span><\/p>\n<p><b>En esta \u00faltima parte quer\u00eda consultarte sobre el proyecto de Factor Data y si podr\u00edas mencionar un caso de uso que hayan encarado en ciencias sociales computacionales para resolver alguna problem\u00e1tica social.<\/b><\/p>\n<p><span style=\"font-weight: 400;\">Bien, te cuento, <\/span><a href=\"https:\/\/factor-data.netlify.app\/\" target=\"_blank\" rel=\"noopener\"><span style=\"font-weight: 400;\">Factor Data<\/span><\/a><span style=\"font-weight: 400;\"> est\u00e1 dentro de la<\/span><a href=\"https:\/\/www.unsam.edu.ar\/escuelas\/eidaes\/\" target=\"_blank\" rel=\"noopener\"> <span style=\"font-weight: 400;\">EIDAES-UNSAM<\/span><\/a><span style=\"font-weight: 400;\">, donde tenemos distintas formas de constituir equipos investigaci\u00f3n, y es lo que se llama un n\u00facleo.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">IDAES forma parte de un centro de investigaci\u00f3n, que se llama <\/span><a href=\"https:\/\/www.unsam.edu.ar\/escuelas\/eidaes\/cesdi\/\" target=\"_blank\" rel=\"noopener\"><span style=\"font-weight: 400;\">CeSDi-Centro de Estudios sobre Sociedad Digital<\/span><\/a><span style=\"font-weight: 400;\">, donde se integraron en un marco com\u00fan todas las investigaciones de la UNSAM relacionadas a la inteligencia artificial, la digitalizaci\u00f3n y las plataformas.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Dentro del CeSDi existen proyectos vinculados con las t\u00e9cnicas metodol\u00f3gicas (ciencias sociales computacionales, etnograf\u00edas digitales), y su impacto en distintas dimensiones de la sociedad (digitalizaci\u00f3n de la cultura, la econom\u00eda, el trabajo, las cuestiones de g\u00e9nero y otras). Pero nosotros abordamos los que tienen que ver con ciencias sociales computacionales.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Y trabajamos en tres l\u00edneas 1) Investigaci\u00f3n b\u00e1sica; 2) Investigaci\u00f3n aplicada a proyectos de ciencias sociales computacionales 3) Formaci\u00f3n (trayecto de materias y diplomatura mencionada anteriormente).<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Y Factor Data articul\u00f3 esa integraci\u00f3n: es un espacio abierto de experimentaci\u00f3n que busca potenciar el desarrollo de las Ciencias Sociales mediante la promoci\u00f3n del uso de fuentes de datos (nuevas y tradicionales) y la aplicaci\u00f3n de t\u00e9cnicas computacionales de an\u00e1lisis de datos.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Quisiera mencionarte un proyecto m\u00e1s aplicado, uno que realizamos durante la pandemia para el Municipio de Vicente L\u00f3pez.<\/span><\/p>\n<p><span style=\"font-weight: 400;\"><a href=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/vicente-lopez.jpg\"><img decoding=\"async\" loading=\"lazy\" class=\"alignleft  wp-image-1817\" src=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/vicente-lopez-300x169.jpg\" alt=\"\" width=\"353\" height=\"199\" srcset=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/vicente-lopez-300x169.jpg 300w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/vicente-lopez-1024x576.jpg 1024w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/vicente-lopez-768x432.jpg 768w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2025\/10\/vicente-lopez.jpg 1500w\" sizes=\"(max-width: 353px) 100vw, 353px\" \/><\/a>Era en el momento m\u00e1s duro del aislamiento y all\u00ed el Municipio ten\u00eda una serie de voluntarios que recorr\u00edan los domicilios de los adultos mayores y les preguntaban qu\u00e9 necesitaban, qu\u00e9 problemas ten\u00edan y en qu\u00e9 les pod\u00edan ayudar.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Los voluntarios relevaban las respuestas en una planilla Excel o en alguna herramienta de ese estilo, es decir, un punteo de las cosas que les comentaban los vecinos de cada hogar. El problema era que la informaci\u00f3n textual no estaba estructurada. Entonces el Municipio se encontr\u00f3 con que necesitaba identificar qu\u00e9 pasaba all\u00ed.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Nosotros tratamos el problema como una tarea de clasificaci\u00f3n de texto, que intentaba analizar cada comentario en los hogares y detectar si eso era un pedido de ayuda, un pedido de acompa\u00f1amiento o si no hab\u00eda ning\u00fan tipo de requerimiento.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">Ese proyecto fue muy interesante porque supuso hacer todo esto en el contexto del 2020 y todav\u00eda no hab\u00eda LLM. Entrenamos un peque\u00f1o modelo basado en <\/span><i><span style=\"font-weight: 400;\">word embeddings <\/span><\/i><span style=\"font-weight: 400;\">(modelo <\/span><i><span style=\"font-weight: 400;\">FastText<\/span><\/i><span style=\"font-weight: 400;\"> de dos capas) y armamos una peque\u00f1a API en Python para que la usaran los analistas del municipio. Fue bastante desafiante en ese momento pero ayud\u00f3 al Municipio a mejorar la toma de decisiones con datos concretos.<\/span><\/p>\n<p><span style=\"font-weight: 400;\">En definitiva, es otro ejemplo de que el uso del Machine Learning tiene que incorporarse cada vez m\u00e1s a las problem\u00e1ticas sociales.<\/span><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Germ\u00e1n Rosati es profesor de la Maestr\u00eda en Ciencia de Datos e investigador de CONICET en EIDAES-UNSAM. Durante esta entrevista relata de qu\u00e9 modo aplicar la visualizaci\u00f3n de datos para mejorar la toma de decisiones, su mirada sobre el auge de la IA Generativa y c\u00f3mo las ciencias sociales computacionales pueden contribuir a resolver problemas m\u00e1s eficientemente.<\/p>\n","protected":false},"author":4,"featured_media":1812,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"_mi_skip_tracking":false},"categories":[24,36,22,25],"tags":[21,37,19,31],"_links":{"self":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/1811"}],"collection":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/users\/4"}],"replies":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=1811"}],"version-history":[{"count":4,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/1811\/revisions"}],"predecessor-version":[{"id":1821,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/1811\/revisions\/1821"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/media\/1812"}],"wp:attachment":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=1811"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=1811"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=1811"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}