{"id":405,"date":"2015-11-09T15:34:21","date_gmt":"2015-11-09T15:34:21","guid":{"rendered":"http:\/\/triton.exp.dc.uba.ar\/predictivos\/?p=405"},"modified":"2015-11-09T19:36:12","modified_gmt":"2015-11-09T19:36:12","slug":"un-predictor-en-el-ambito-electoral","status":"publish","type":"post","link":"https:\/\/datamining.dc.uba.ar\/predictivos\/?p=405","title":{"rendered":"Un predictor en el \u00e1mbito electoral"},"content":{"rendered":"<p><b><a href=\"https:\/\/triton.exp.dc.uba.ar\/predictivos\/wp-content\/uploads\/2015\/11\/Walter-Lamagna.jpg\"><img decoding=\"async\" loading=\"lazy\" class=\"alignleft size-medium wp-image-406\" alt=\"Walter Lamagna\" src=\"https:\/\/triton.exp.dc.uba.ar\/predictivos\/wp-content\/uploads\/2015\/11\/Walter-Lamagna-300x225.jpg\" width=\"300\" height=\"225\" srcset=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2015\/11\/Walter-Lamagna-300x225.jpg 300w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2015\/11\/Walter-Lamagna-1024x767.jpg 1024w\" sizes=\"(max-width: 300px) 100vw, 300px\" \/><\/a>\u00bfEn qu\u00e9 consiste tu trabajo en IBM?<\/b><\/p>\n<p>Actualmente me ocupo de la distribuci\u00f3n automatizada de software para IBM y algunos clientes externos. Este rol, que asum\u00ed desde hace un a\u00f1o, consiste en la programaci\u00f3n de la instalaci\u00f3n autom\u00e1tica de los programas. Es un \u00e1rea bastante evolucionada donde estoy aprendiendo mucho, pero no implica el uso de miner\u00eda de datos.<\/p>\n<p>No obstante, cuando ten\u00eda el puesto de Defect Prevention cuyo objetivo era identificar defectos frecuentes en software o hardware, manejaba\u00a0 un gran volumen de datos; eran alrededor de 5 mil servidores de un cliente del rubro de tarjetas de cr\u00e9dito y en ese caso pude utilizar t\u00e9cnicas visualizaci\u00f3n de la informaci\u00f3n para graficar en series temporales los errores m\u00e1s frecuentes. Pero lo hice m\u00e1s por motus propio que por una tarea asociada a mi puesto.<\/p>\n<p><b>Hablemos un poco sobre tu Tesis de Maestr\u00eda\u2026<\/b><\/p>\n<p>Mi objeto de estudio tiene que ver con redes neuronales aplicadas a im\u00e1genes. Junto a mi directora de tesis, Mar\u00eda Elena Buemi, nos pareci\u00f3 que el tema de las elecciones pod\u00eda ser interesante y adecuado para trabajar desde el procesamiento de im\u00e1genes. Yo hab\u00eda sido fiscal de mesa en las \u00faltimas elecciones legislativas, del a\u00f1o 2013, y me hab\u00eda empezado a interiorizar en el tema. Los manuscritos de los telegramas escaneados eran esencialmente im\u00e1genes, con lo cual pod\u00edan ser parte de la investigaci\u00f3n.<\/p>\n<p><b>\u00bfCon qu\u00e9 tipo de redes neuronales est\u00e1s trabajando?<\/b><\/p>\n<p>Con redes neuronales convolucionales. Para explicarlo de forma sencilla, ser\u00edan redes donde las neuronas corresponden a campos receptivos de una manera muy similar a la corteza visual primaria de un cerebro, que suelen ser muy eficientes para tareas de visi\u00f3n artificial y procesamiento de im\u00e1genes. Estas redes neuronales usan la operaci\u00f3n de convoluci\u00f3n que es la multiplicaci\u00f3n entre dos matrices y de eso resulta un n\u00famero en particular.<\/p>\n<p>Estas redes neuronales convolucionales las impuls\u00f3 el destacado investigador Yann Lecun, que ahora es responsable del \u00e1rea de investigaci\u00f3n y desarrollo en Facebook. Es una aplicaci\u00f3n que ya tuvo mucho \u00e9xito en el reconocimiento de expresiones humanas e im\u00e1genes en forma masiva.<\/p>\n<p><b>\u00bfCu\u00e1l ser\u00eda el objetivo del trabajo?<\/b><\/p>\n<p>El objetivo ser\u00eda ayudar a las personas en la contabilizaci\u00f3n de los votos. Al finalizar las elecciones tenemos un telegrama que los fiscales completan a mano, que contiene el dato de cada mesa con el partido pol\u00edtico y la cantidad de votos obtenidos, por ej. 200. Ese 200 es lo que yo leo pero que tambi\u00e9n puede leer la computadora procesando la imagen de ese telegrama escaneado. Lo que buscamos, a trav\u00e9s de esta red neuronal, es el intento de predecir qu\u00e9 d\u00edgito exacto es.<\/p>\n<p>Cuando finalizan los comicios, cada telegrama llega a un centro de c\u00f3mputos donde un equipo de personas lo recibe y tipean lo que ellos leen de ese manuscrito. Ese telegrama lo lee el Data Entry en una hilera, lo tipea y despu\u00e9s se lo da a otro Data Entry que tambi\u00e9n lo lee y lo tipea. Entonces hay dos controles del mismo resultado. Si eso coincide se lo presenta como resultado final en el escrutinio. Pero si no coincide, el telegrama pasa a un \u00e1rea de incidencias donde\u00a0 revisan por qu\u00e9 no coincidi\u00f3, por ejemplo se puede haber equivocado uno de los Data Entry o el n\u00famero era muy ilegible. A m\u00ed lo que me interesar\u00eda es que haya como un tercer Data Entry, un tercer agente inform\u00e1tico que haga su lectura tambi\u00e9n sobre los d\u00edgitos y que pueda corroborar tambi\u00e9n con lo que escribieron los otros Data Entry, reduciendo a\u00fan m\u00e1s el margen de error.<\/p>\n<p>De hecho, la idea es presentar los resultados que tipearon las personas respecto a los datos y lo que predice mi sistema e intentar encontrar d\u00f3nde no hay coincidencia. Si bien es un m\u00e9todo para contabilizar, lo veo como una herramienta intermedia que asiste a la persona, no que la reemplaza.<\/p>\n<p><b>\u00bfEn qu\u00e9 etapa de la Tesis est\u00e1s?<\/b><\/p>\n<p>El sistema ya est\u00e1 implementado y estoy haciendo los ajustes finales. El tema es que es complejo implementar redes neuronales convolucionales; muchas utilizan librer\u00edas que ya est\u00e1n desarrolladas por otros. Yo encontr\u00e9 una librer\u00eda en Java Script de c\u00f3digo abierto, entonces trabaj\u00e9 sobre ese c\u00f3digo, le hice ingenier\u00eda inversa e implement\u00e9 mi propia red neuronal en Matlab. Mi intenci\u00f3n es que todo el trabajo est\u00e9 acompa\u00f1ado de esta nueva librer\u00eda que le va a permitir a muchos poder conocer c\u00f3mo funciona, lo cual es un paso importante.<\/p>\n<p><b>Est\u00e1 claro que ten\u00e9s m\u00faltiples intereses que van desde la democracia ciudadana y el gobierno abierto hasta el tema de la visualizaci\u00f3n de datos. \u00bfC\u00f3mo converge todo esto en tu carrera?<\/b><\/p>\n<p>Creo que tenemos una enorme oportunidad para que nuestro conocimiento genere aportes concretos a la sociedad. La ciencia tiene que estar al servicio del bienestar de las personas. Ese tambi\u00e9n es un poco el camino del Open Data. Cuando se liberan los datos es muy tentador intentar descubrir qu\u00e9 utilidad o valor se puede encontrar en los datos y compartirlo con los dem\u00e1s.<\/p>\n<p>Por ejemplo, cuando particip\u00e9 en el Hackat\u00f3n Latinoamericano #DAL2012 trabaj\u00e9 con datos del Poder Judicial de la Naci\u00f3n, analizando las sentencias de la Corte Suprema en los \u00faltimos 18 a\u00f1os hasta el a\u00f1o 2012. Lo que me interes\u00f3 fue que el Poder Judicial tiene un buscador donde uno ingresa texto y busca informaci\u00f3n de una manera tradicional. Una cuesti\u00f3n es que ellos plantean en su p\u00e1gina web es la idea de que esta informaci\u00f3n est\u00e9 p\u00fablica para acceso del ciudadano, para que pueda utilizarla para desarrollar aplicaciones o descubrir cosas. Y era una muy buena idea que la informaci\u00f3n sea p\u00fablica pero, justamente, ese buscador representaba un obst\u00e1culo para lograr el objetivo. Todo eso me llev\u00f3 a pensar una aplicaci\u00f3n novedosa e interesante que dinamice la informaci\u00f3n.<\/p>\n<p><b>\u00bfImagin\u00e1s que tu sistema se pueda implementar en las pr\u00f3ximas elecciones?<\/b><\/p>\n<p>No lo s\u00e9. Es dif\u00edcil esta articulaci\u00f3n con el Estado pero creo que de a poco los gobiernos se muestran interesados en incorporar Open Data y nuevas herramientas de gesti\u00f3n. Espec\u00edficamente\u00a0 en el tema elecciones veo cada vez mayor apertura.<\/p>\n<div id=\"address\">\n<address><b>EN FOCO: LA MAESTR\u00cdA<\/b><\/address>\n<address><b><\/b><br \/>\n<b>Cambiando de tema, \u00bfc\u00f3mo fue tu experiencia de realizar la Maestr\u00eda?<\/b><\/address>\n<address>Fue una experiencia muy enriquecedora. Fui a unas Jornadas de Data Mining para saber de qu\u00e9 se trataba y qued\u00e9 completamente deslumbrado por la propuesta. Es una carrera que tiene mucho de descifrar enigmas.<br \/>\nLos profesores est\u00e1n muy bien preparados y traen casos interesantes. Creo que en definitiva este posgrado me brind\u00f3 herramientas anal\u00edticas muy valiosas, de estad\u00edstica, visualizaci\u00f3n y aprendizaje profundo. Pero, por sobre todas las cosas, me despert\u00f3 la curiosidad para seguir investigando.<\/address>\n<address>\u00a0<\/address>\n<address><b>\u00bfQu\u00e9 materias recomend\u00e1s?<\/b><\/address>\n<address>Redes neuronales dictada por Laura Lanzarini fue la materia que m\u00e1s me gust\u00f3. Aprovech\u00e9 la cursada hasta el \u00faltimo d\u00eda. Por alg\u00fan motivo, las Redes Neuronales eran algo lejano para m\u00ed porque estudi\u00e9 ingenier\u00eda en sistemas y las hab\u00eda visto a nivel de divulgaci\u00f3n. En cambio, en esta materia programamos una red neuronal y entendimos realmente el proceso de c\u00f3mo funcionaba. Tambi\u00e9n recomendar\u00eda Visualizaci\u00f3n de la Informaci\u00f3n y Enfoque Estad\u00edstico del Aprendizaje.<\/address>\n<address>\u00a0<\/address>\n<\/div>\n","protected":false},"excerpt":{"rendered":"<p>Walter Lamagna es Especialista en Explotaci\u00f3n de Datos y Descubrimiento del Conocimiento (UBA) e Ingeniero en Sistemas (UAI). Est\u00e1 finalizando su Tesis de Maestr\u00eda sobre la lectura artificial de los d\u00edgitos manuscritos de telegramas durante las elecciones nacionales legislativas de 2013, bajo la direcci\u00f3n de la doctora Mar\u00eda Elena Buemi.<br \/>\nActualmente se desempe\u00f1a como Ingeniero Senior de Sistemas en IBM Argentina, teniendo a cargo la distribuci\u00f3n automatizada de software para dicha compa\u00f1\u00eda. Anteriormente ocup\u00f3 los puestos de Delivery Analyst y Defect Prevention.<br \/>\nObtuvo el premio Outstanding Integrated Overview Display en la competencia de visualizaci\u00f3n de la informaci\u00f3n VAST Challenge 2011.<br \/>\nEn di\u00e1logo con Predictivos, Walter explica c\u00f3mo puede contribuir la miner\u00eda de datos y las redes neuronales al procesamiento de los resultados electorales.<\/p>\n","protected":false},"author":1,"featured_media":406,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"_mi_skip_tracking":false},"categories":[15],"tags":[],"_links":{"self":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/405"}],"collection":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=405"}],"version-history":[{"count":6,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/405\/revisions"}],"predecessor-version":[{"id":432,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/405\/revisions\/432"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/media\/406"}],"wp:attachment":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=405"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=405"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=405"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}