{"id":301,"date":"2014-11-26T22:27:43","date_gmt":"2014-11-26T22:27:43","guid":{"rendered":"http:\/\/triton.exp.dc.uba.ar\/predictivos\/?p=301"},"modified":"2014-11-26T22:27:43","modified_gmt":"2014-11-26T22:27:43","slug":"la-gestion-del-conocimiento-cientifico-debe-democratizarse","status":"publish","type":"post","link":"https:\/\/datamining.dc.uba.ar\/predictivos\/?p=301","title":{"rendered":"\u201cLa gesti\u00f3n del conocimiento cient\u00edfico debe democratizarse\u201d"},"content":{"rendered":"<p><b>Le propon<\/b><a href=\"https:\/\/triton.exp.dc.uba.ar\/predictivos\/wp-content\/uploads\/2014\/11\/Predictivos-6.jpg\"><img decoding=\"async\" loading=\"lazy\" class=\"alignleft size-medium wp-image-302\" alt=\"Predictivos 6\" src=\"https:\/\/triton.exp.dc.uba.ar\/predictivos\/wp-content\/uploads\/2014\/11\/Predictivos-6-225x300.jpg\" width=\"225\" height=\"300\" srcset=\"https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2014\/11\/Predictivos-6-225x300.jpg 225w, https:\/\/datamining.dc.uba.ar\/predictivos\/wp-content\/uploads\/2014\/11\/Predictivos-6-768x1024.jpg 768w\" sizes=\"(max-width: 225px) 100vw, 225px\" \/><\/a><b>go que hablemos sobre la tem\u00e1tica de la desambiguaci\u00f3n de <\/b><b>autores cient\u00ed<\/b><b>ficos, en el contexto de sus trabajos presentados en las \u00faltimas Jornadas de D<\/b><b>ata Mining.<\/b><\/p>\n<p>En principio, estamos construyendo lo que llamo un \u201csistema inteligente\u201d, capaz de encontrar informaci\u00f3n y conocimiento en una gran base de datos, teniendo en cuenta que la informaci\u00f3n textual est\u00e1 cada vez m\u00e1s disponible en la Web.<\/p>\n<p>Pongamos un ejemplo. Supongamos que estamos buscando a una autora, mujer, cuyo nombre es \u201cFrance\u201d.\u00a0 Entonces el sistema buscar\u00e1 ese t\u00e9rmino pero tiene que ser capaz de discernir que no es el pa\u00eds sino la persona, lo que busca, asociando textos al uso de ese nombre. Es un trabajo complejo para el sistema, porque necesita reducir la ambig\u00fcedad entre el pa\u00eds y la persona. El cl\u00e1sico problema de la homonimia, dos palabras que coinciden en su escritura aunque no necesariamente en su pronunciaci\u00f3n. Pero tambi\u00e9n pueden existir problemas de sinonimia, o semejanza de significados entre palabras determinadas.<\/p>\n<p>Para ello se utilizan soluciones de ontolog\u00eda del lenguaje. De esa forma, el sistema puede analizar y comprender el contexto en el que se usa esa palabra. Supongamos que utilizamos s\u00f3lo nombres latinos, podr\u00edamos tener muchos autores que tuvieran el mismo nombre, por ejemplo \u201cMarta Rodr\u00edguez\u201d. Al fusionar dos art\u00edculos cient\u00edficos diferentes, debemos analizar la informaci\u00f3n de contexto para determinar si estas dos publicaciones pertenecen a la misma Marta o no. Este ser\u00eda el problema de la desambiguaci\u00f3n de autores cient\u00edficos.<\/p>\n<p><b>\u00bfC\u00f3mo comenz\u00f3 a interesarse por este tema de la desambiguaci\u00f3n?<\/b><\/p>\n<p>Comenc\u00e9 a trabajar en esta tem\u00e1tica hace cuatro a\u00f1os, con mis estudiantes de la Universidad de Lyon, ya que me interesaba mucho avanzar en el an\u00e1lisis de la red de colaboraci\u00f3n entre autores cient\u00edficos.\u00a0 Comenzamos con una peque\u00f1a encuesta en la materia, ya que lo primero que quer\u00edamos saber era qui\u00e9n estaba trabajando con qui\u00e9n, c\u00f3mo se relacionaban los autores entre s\u00ed, si hab\u00eda alg\u00fan cl\u00faster de tem\u00e1ticas comunes, etc. Entiendo que la desambiguaci\u00f3n es un problema gen\u00e9rico, propuesto en diferentes conferencias y encuentros de Data Mining, por ejemplo, en Microsoft Research.<\/p>\n<p>Pero fue, y sigue siendo, un desaf\u00edo acad\u00e9mico interesante para mis estudiantes. Lo m\u00e1s importante es que quer\u00edamos generar un proyecto pr\u00e1ctico con toda la informaci\u00f3n que est\u00e1bamos reuniendo sobre la comunidad cient\u00edfica.<\/p>\n<p><b>\u00bfEn qu\u00e9 consiste la herramienta de datos abiertos, Babel, que ha desarrollado?<\/b><\/p>\n<p>Babel es el software que estamos desarrollando en la Universidad. Surge de la met\u00e1fora hist\u00f3rica y literaria de una gran biblioteca universal con publicaciones en cientos de idiomas, donde todo el conocimiento est\u00e9 alojado all\u00ed.<\/p>\n<p>Construimos una herramienta de desambiguaci\u00f3n que, a trav\u00e9s de una base de datos relacional con diferentes par\u00e1metros para clasificar art\u00edculos y autores, pueda solucionar el problema de la ambig\u00fcedad sem\u00e1ntica entre miles de publicaciones.<\/p>\n<p>Las fuentes que tomamos para este trabajo son las denominadas \u201cWeb of Science\u201d pero tambi\u00e9n trabajamos con portales cient\u00edficos de libre acceso. All\u00ed relevamos el t\u00edtulo, autores y citas cient\u00edficas. No obstante, cuanta m\u00e1s informaci\u00f3n de contexto tengamos sobre el <i>paper<\/i>, m\u00e1s f\u00e1cil es lograr la desambiguaci\u00f3n.<\/p>\n<p><b>\u00bfQu\u00e9 volumen de publicaciones est\u00e1 analizando?<\/b><\/p>\n<p>Estamos trabajando con m\u00e1s de 300 mil publicaciones, con 436 mil autores, pero la idea es llegar a millones de publicaciones. Actualmente tanto Microsoft como investigadores que se dedicaron a este asunto, pudieron relevar alrededor de 20 millones de publicaciones en total, que es aproximadamente lo que contiene Google Scholar por ejemplo. Pero el total de la comunidad cient\u00edfica mundial re\u00fane unos 2.5 billones de publicaciones.<\/p>\n<p>Expandir los algoritmos que utilizamos para estas publicaciones al conjunto total de las publicaciones relevadas es sumamente complejo. No tenemos la misma informaci\u00f3n para las diferentes librer\u00edas de datos que manejamos, la organizaci\u00f3n de los datos en la comunidad cient\u00edfica es heterog\u00e9nea, la variedad de datos es muy grande y la incompletitud tambi\u00e9n lo es.<\/p>\n<p><b>\u00bfQu\u00e9 piensa del denominado \u201cCrowdsourcing\u201d, entendido como la colaboraci\u00f3n abierta distribuida a un grupo indeterminado de personas, espec\u00edficamente en este \u00e1mbito?<\/b><\/p>\n<p>El Crowdsourcing puede ser una soluci\u00f3n para este tema. Existen ideas con esa filosof\u00eda, en donde personas y comunidades colaboran en la investigaci\u00f3n o soluci\u00f3n de temas conjuntos. Pero a\u00fan no se ha abordado una problem\u00e1tica como la que Babel propone: la red de colaboraci\u00f3n entre autores cient\u00edficos.<\/p>\n<p><b>\u00bfC\u00f3mo ve actualmente los nuevos desaf\u00edos de Open Data?<\/b><\/p>\n<p>Este es, justamente, el tema de la charla que brindar\u00e9 en las Jornadas de Data Mining. Ciudadanos y gobiernos est\u00e1n presionando para alcanzar una soluci\u00f3n pol\u00edtica donde todo el material cient\u00edfico est\u00e9 disponible gratuitamente y resulte accesible para todos. Es el caso de los directorios Open Access Journals, por ejemplo, sin barreras financieras, legales o t\u00e9cnicas para los usuarios.<\/p>\n<p>Creo que el modelo tradicional de editores cient\u00edficos, en lo que hace a evaluaci\u00f3n y publicaci\u00f3n de art\u00edculos, se est\u00e1 agotando. Es muy costoso, no es eficiente y tiene diversos problemas.\u00a0 No s\u00f3lo existen temas legales en cuanto a ceder la propiedad intelectual de las publicaciones. El primer problema que estoy viendo es econ\u00f3mico, qui\u00e9n subsidiar\u00eda todo esto.\u00a0 Tambi\u00e9n otro tema es la garant\u00eda de calidad cient\u00edfica, c\u00f3mo se organizar\u00eda la evaluaci\u00f3n entre pares para este tipo de publicaciones ya que los editores actuales de las revistas concentran la publicaci\u00f3n de la informaci\u00f3n y env\u00edan los art\u00edculos recibidos a un comit\u00e9 evaluador de expertos (referato).<\/p>\n<p><b>De hecho, en Argentina existe la Ley 26.899 de Creaci\u00f3n de Repositorios Digitales Institucionales de Acceso Abierto, que establece que todas las instituciones cient\u00edficas que reciban financiamiento del Estado Nacional deben crear repositorios digitales accesibles.<\/b><\/p>\n<p>Me parece muy adecuado, es la clave de lo que estamos hablando. La gesti\u00f3n del conocimiento cient\u00edfico deber\u00eda alcanzar una democratizaci\u00f3n, porque estamos movi\u00e9ndonos hacia otro tipo de organizaciones, mucho m\u00e1s abiertas. Estoy convencido de que la gesti\u00f3n del conocimiento debe estar bajo el control de los ciudadanos. Y al mismo tiempo, el conocimiento cient\u00edfico debe estar bajo el control de la propia comunidad cient\u00edfica.<\/p>\n<p>Creo que existe una madurez importante en la comunidad cient\u00edfica para que esto sea posible, al menos con las comunidades de investigadores con las que estoy relacionado. Sin embargo, a\u00fan existen barreras de diversa \u00edndole para poder alcanzar este objetivo.<\/p>\n<p><b>\u00bfQu\u00e9 expectativas tiene este a\u00f1o respecto al Tutorial que estar\u00e1 dictando en las Novenas Jornadas de Data Mining?<\/b><\/p>\n<p>Espero que haya muchos m\u00e1s asistentes, a\u00fan m\u00e1s que el a\u00f1o pasado. Cada vez hay m\u00e1s gente interesada en este tipo de conferencias y eso es una se\u00f1al muy positiva. Espero tambi\u00e9n una interacci\u00f3n creciente que ayude a hacer crecer el \u00e1rea de Open Data en la comunidad, ya que encuentro much\u00edsimas oportunidades de colaboraci\u00f3n entre Europa y Argentina. Creo que estos temas pueden ayudar a los participantes a cruzar una nueva frontera del conocimiento.<\/p>\n<p>M\u00e1s informaci\u00f3n: <a href=\"https:\/\/www.zighed.com\">www.zighed.com<\/a><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Djamel Abdelkader Zighed es Profesor Titular de la Universidad de Lyon, Francia, distinguido por esa universidad con el premio a la excelencia cient\u00edfica. Se desempe\u00f1a como Director de L&#8217;Institut des Sciences de l&#8217;Homme de Lyon y Coordinador del Erasmus Mundus Master course in Data Mining and Knowledge Management.<br \/>\nDe visita en Argentina, invitado especialmente a las Novenas Jornadas de Data Mining, el profesor Zighed relata cu\u00e1les son las l\u00edneas de investigaci\u00f3n en Open Data que est\u00e1 desarrollando en su universidad.<\/p>\n","protected":false},"author":1,"featured_media":302,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"_mi_skip_tracking":false},"categories":[12],"tags":[],"_links":{"self":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/301"}],"collection":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=301"}],"version-history":[{"count":1,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/301\/revisions"}],"predecessor-version":[{"id":303,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/posts\/301\/revisions\/303"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=\/wp\/v2\/media\/302"}],"wp:attachment":[{"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=301"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=301"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/datamining.dc.uba.ar\/predictivos\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=301"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}