Un predictor en tecnología agropecuaria
Contanos sobre tu trabajo actual en la Estación Experimental Agropecuaria del INTA de Corrientes.
Estamos insertos en dos líneas principales de investigación. La primera consiste en la taxonomía numéricaen agricultura y la segunda tiene que ver con pronósticos estacionales de caudales de río. Lo que tienen en común ambas líneas es que son altamente multidisciplinarias,ya que trabajan un grupo de biólogos, ingenieros, meteorólogos, matemáticos, informáticos, etc.
En cuanto a la primera línea se enmarca en la genética. El tema que nos interesa es entender cómo ciertas variedades del arroz que se produce en Corrientes son semejantes unas a otras. El principal fin de esta línea es mejorar, entre otras cosas, la documentación sobre la resistencia y el crecimiento de la planta de arroz, custodiando que no haya degradación en la genética de cada variedad.
Para ese fin medimos más de 200 variedades provenientes del banco de germoplasma del INTA, que es una cámara de bajas temperaturas donde se alojan las diferentes semillas de arroz conservadas en condiciones necesarias para su supervivencia. El proceso involucra sembrartodas las semillas de arroz y analizar su crecimiento, delimitando cómo es cada variedad. Para ello se miden entre 40 a 50 variables planta por planta, observando el tamaño de hoja, el tallo, la flor, forma de cada grano de arroz, etc. y se procesan las variables mediante técnicas de minería de datos.
Utilizamos métodos de agrupamiento (clustering)ya que las plantas se van clasificando de acuerdo a gruposcon características auto-similares, que se van detectando en el propio proceso de análisis. Esa metodología también se puede utilizar para producción de maní y algodón. Considero que en esta línea hay muchísimo de búsqueda del propio investigador, sin saber a priori qué variables van a ser decisivas para el agrupamiento. Como si participáramos del descubrimiento de América, un trabajo esencialmente exploratorio.
Respecto a la segunda línea de investigación, consiste en el pronóstico estacional de caudales de ríosen la provincia de Corrientes. Para ilustrarlo, tenemos como gran antecedente el fenómeno climático del “niño”. Este fenómeno implica que el aumento de solamente 1 ó 2 grados en el océanopacífico ecuatorial, a la altura de Perú,durante agosto o septiembre, va a producir muchas lluvias estivales, va a ser un verano muy húmedo en la zona de la Mesopotamia y de Brasil. En cambio la disminución de 1 ó 2 grados, implica que va a haber un verano muy seco.
La pregunta que nos hacemos sería ¿qué zonas de los océanos estarían correlacionadas con los ríos en los meses de enero a marzo, es decir, cómo afectaría este aumento de temperatura con el aumento del caudal y viceversa?
Para encarar el análisis tomamos datos del National Oceanic and Atmosferic Administration (NOAA) que es la agencia estadounidense que se ocupa de medir las condiciones de los océanos y la atmósfera a nivel mundial y tiene relevadas las temperaturas y presiones de los océanos en los últimos 60 años. También utilizamos datos disponibles de la Subsecretaría de Recursos Hídricos de la Nación.
Con esos datos correlacionamos temperatura, presión oceanográfica y otros índices de diferentes zonas de los océanos con los caudales existentes en cuatro ríos de la provincia: Corrientes, Miriñay, Aguapey y Santa Lucía. Para ello, se mide la altura de estas cuencas desde octubre a marzo. En esas cuencas hay mucha producción arrocera, por lo que todas estas variables influyen en la calidad y la superficie de la siembra de arroz.
Los caudales de río son un sistema complejo en sí. Armar las bases y las matrices de datos, involucramuchísimo tratamiento de datos y variables para conformar un modelo consistente. También debemos utilizar diferentes metodologías de minería de datos: componentes principales, regresiones múltiplesy redes neuronales.
¿Qué perspectiva ves en el análisis de datos a futuro, particularmente en un dominio altamente productivo como la tecnología agropecuaria?
Aunque parezca una obviedad, el agro argentino todavía no ha conceptualizado en toda su dimensión la importancia del dato relevado. Porque es muy costoso el relevamiento, lleva mucho tiempo y dinero. Digamos que todavía existe mucho trabajo manual en el agro, se anotan los datos en una planilla o en un cuaderno que no forman parte de una base de datos y muchos datos se dejan de lado, basándose más en la intuición o la experiencia personal que en el análisis científico.
Particularmente en Big Data veo un futuro auspicioso, en pocos años más se va a producir un cambio significativo. Estos datos se van a ir adoptando paulatinamente, los productores van a ir valorizando y sistematizando esa información más precisa en pos de adoptar tecnologías intensivas para agricultura y citricultura. No es sencillo porque implica un cambio cultural, de paradigma, pero soy optimista.
¿Cómo se enmarca esta visión en el trabajo del Grupo TICs que estás liderando?
Hace un año creamos el Grupo TICs del INTA Corrientes, del cual como señalás soy su Jefe de Grupo. Somos doce personas de las cuales cinco trabajamos en el desarrollo de los sistemas y análisis de datos aplicado a la mejora continua en estos temas.
Como ejemplo, puedo mencionar el Proyecto FruTIC, un software para lacitricultura de precisión. Es un sistema de consulta y accesibilidad permanente para los productores que brinda herramientas tecnológicas para optimizar la gestión en la producción de cítricos vinculando el desarrollo del cultivo, las condiciones meteorológicas y la evolución de plagas y enfermedades. Estas herramientas permiten al productor citrícola mejorar la gestión integral de las quintas.
En este proyecto aparecen tres tipos de datos: ambientales, relacionados con el clima, suelo y entorno donde vida la planta; fenológicos, que explican en qué fase de crecimiento está la planta, si está en floración o en fruto en función de las variables estacionales, y qué condiciones de sanidadtiene la planta en su proceso de desarrollo y, por último, los datosfitopatológicos, que indican la presencia de la enfermedad, hongos o plagas en la planta.
Mediante FruTIC buscamos cruzar estos tres tipos de datos para conformar un gran repositorio de información en agricultura y poder utilizarlopara mejorar la toma de decisiones.Creo que estas visiones son muy importantes para visibilizar la temática de TIC en el Agro y que se traduzcan en mayor inversión en ciencia y tecnología.
Saliendo un poco del tema de tu trabajo actual, ¿cómo fue tu experiencia de realizar la Maestría? Mi desarrollo profesional cambió absolutamente cuando cursé la Maestría. Fui el primero en recibirme pero estuve en la segunda cohorte, del año 2005.Hoy puedo decir que la Maestría me permitió re-enfocar mi carrera, me brindó una visión de futuro, además de herramientas conceptuales teórico-prácticas de calidad, que aplico en mi trabajo diario. Me enseñó a pensar las cosas de manera completamente diferente. Hablamos todo el tiempo de Big Data pero esa visión original ya estaba presente cuando nosotros cursábamos y todas las técnicas adquiridas me permitieron enfrentar los problemas más actuales de ciencia de datos. Personalmente veía el enorme esfuerzo de docentes y autoridades por llevar adelante el Posgrado. No íbamos simplemente a cursar, era emocionante escuchar a los profesores cuando hablaban, transmitiendo con pasión su conocimiento. Imagino el sacrificio de venir desde Corrientes hasta Buenos Aires para cursar… Fue una etapa sustancial en mi vida. Durante dos años seguidos viajé todas las semanas, becado por el INTA. Ibalos días miércoles, para cursar jueves, viernes y sábado y volvía el sábado a la noche. Hacía mil kilómetros por cada viaje por lo que dos noches por semana las pasaba en un colectivo. Hoy me resulta anecdótico porque calculo que di tres vueltas y media a la tierra viajando en colectivo. Para mí el tema no era la distancia sino encontrarme con otro mundo totalmente desconocido. La Maestría me dio muchos valores, fundamentalmente por la calidad humana de todos los compañeros que me ayudaron. Por último, ¿qué significa para vos ser el primer Magíster en Data Mining de la Universidad de Buenos Aires? Significa un enorme orgullo y honor. Lo digo sin falta de humildad, no por ser el primero sino por el orgullo personal de haber finalizado esta Maestría.En realidad ser el primero tuvo que ver con que en ese momento se me terminaba la beca de posgrado y tuve que entregar la tesis antes de que concluya el financiamiento, por lo que fue un buen aliciente para cerrar ese ciclo

