Este artículo también está disponible en inglés.
A finales de 2025, Invest in Open Infrastructure lanzó el Fondo de IOI para la Adopción en Redes, un nuevo tipo de inversión diseñado para acelerar la adopción global de infraestructura abierta para la investigación y el intercambio de datos. En lugar de financiar herramientas individuales o instituciones aisladas, el Fondo invierte en redes: consorcios de instituciones e investigadores con relaciones ya establecidas, una gobernanza activa de sus miembros y un compromiso demostrado con la ciencia abierta. La lógica es que fortalecer la infraestructura compartida que una red ya opera puede multiplicar el impacto en todas sus instituciones miembro al mismo tiempo.
El Fondo surgió del diálogo directo con las comunidades de investigación para identificar los proyectos de infraestructura abierta que más necesitan apoyo sostenido, y reúne contribuciones de un grupo de financiadores interesados en fortalecer el ecosistema global de investigación abierta. Cada red seleccionada recibe hasta 1,5 millones de dólares durante un período de dos a tres años, junto con apoyo continuo del equipo de IOI para la implementación en ámbitos como gobernanza, participación comunitaria y modelos de negocio. El objetivo de IOI con el Fondo no es solamente permitir que las organizaciones beneficiarias desarrollen proyectos capaces de generar un gran impacto en sus redes, sino también contribuir a la resiliencia de esas redes mucho después de finalizada la subvención.
LA Referencia fue seleccionada como una de las dos primeras beneficiarias del Fondo, entre más de 100 postulaciones provenientes de 22 países. En conjunto, las dos primeras organizaciones beneficiarias del Fondo están en condiciones de beneficiar a más de 1.300 instituciones de investigación en 36 países de América Latina y África. Este artículo ofrece una visión general de lo que LA Referencia ha realizado durante los primeros seis meses de esta inversión. En los próximos meses publicaremos también una actualización sobre la otra organización beneficiaria inaugural, UbuntuNet Alliance.

Introducción al proyecto de LA Referencia
LA Referencia es una red regional de cooperación que agrega y proporciona infraestructura de acceso abierto a la producción académica y científica de repositorios nacionales de América Latina y España, basada en un modelo de gobernanza federada y en una infraestructura de propiedad pública y no comercial. Con el apoyo del Fondo de IOI, LA Referencia está desarrollando un proyecto para el período 2026–2028 destinado a ampliar el alcance regional y la profundidad técnica de esta infraestructura mediante cuatro grandes objetivos: incorporar más países y repositorios a la red, modernizar la forma en que los investigadores descubren contenidos en múltiples idiomas, construir un sistema soberano y verificable de identificadores persistentes y poner en marcha un repositorio regional compartido junto con un programa de capacitación para datos de investigación. El avance completo del proyecto está documentado en detalle en el sitio de informes del proyecto de LA Referencia, y el relato que sigue se basa directamente en el informe ejecutivo del equipo correspondiente a enero–julio de 2026.
El proyecto está organizado en tres componentes complementarios que conectan contenidos, tecnologías de descubrimiento, infraestructura de identificadores y capacidades humanas:
- Componente A — Expansión de la infraestructura de agregación de LA Referencia: ampliar la cobertura regional, mejorar y normalizar los metadatos e introducir búsqueda semántica multilingüe en la capa de descubrimiento de LA Referencia.
- Componente B — Identificadores ARK descentralizados y preservación de metadatos (dARK): desarrollar dARK 2.0, una infraestructura modular basada en blockchain e ipfs para asignar, publicar y resolver identificadores persistentes.
- Componente C — Repositorio regional de datos datos para instituiones sin infraestructura local y soporte para Dataverse: poner en marcha un repositorio regional para datos de investigación basado en Dataverse, acompañado de un programa federado de capacitación y curaduría.
En el resto de este artículo profundizamos en los avances realizados en cada uno de estos componentes y compartimos productos y resultados del trabajo de LA Referencia que ya pueden ser explorados.
Componente A: Expansión de la infraestructura de agregación de LA Referencia
El descubrimiento depende de contar con buenos metadatos para las colecciones, por lo que el Componente A combina la ampliación de la cobertura regional de LA Referencia con el trabajo sobre calidad de metadatos y una nueva capacidad de búsqueda multilingüe que permite descubrir contenidos independientemente del idioma utilizado en la búsqueda o del idioma del contenido.
Avances hasta la fecha
Durante el período del informe, LA Referencia implementó una metodología regional para identificar instituciones y repositorios candidatos a ser cosechados con el objetivo de ampliar su colección. Este trabajo incluyó la verificación de servicios OAI-PMH, la revisión de metadatos, la actualización de la Interoperability and Registry Database (IRD) de COAR y la verificación cruzada de información institucional con ROR. El trabajo de curaduría se completó para los países miembros Ecuador, Uruguay y Costa Rica, y para los países no miembros Colombia, Paraguay, Venezuela, Bolivia y Cuba; los registros de otros países se encuentran en proceso.
En total, el equipo actualizó los registros de 362 repositorios: 187 fueron editados, 77 incorporados como nuevos y 98 archivados. Venezuela fue el país con mayores avances, con dos repositorios cosechados exitosamente como experiencia piloto para la incorporación de contenidos provenientes de países que todavía no operan como nodos completos de LA Referencia.
En relación con esta expansión geográfica, LA Referencia está desarrollando una solución para un problema común identificado en su comunidad: muchos investigadores realizan búsquedas en un idioma mientras que el trabajo que necesitan está descrito en otro. Un registro de un repositorio en español podría no aparecer nunca para una persona que realiza una búsqueda en inglés, o viceversa, porque la búsqueda tradicional por palabras clave solo puede hacer coincidir las palabras exactas presentes en la página. El Componente A busca cerrar esa brecha mediante búsqueda semántica multilingüe, que encuentra resultados haciendo coincidir significados en lugar de palabras exactas. Para determinar la mejor manera de hacerlo, el equipo realizó una evaluación rigurosa y reproducible, comparando aproximadamente treinta modelos diferentes de IA en dos colecciones de prueba de entre 30.000 y 50.000 documentos, con miles de búsquedas de prueba en hasta 10 idiomas. Este trabajo produjo resultados prometedores: en el piloto, la búsqueda semántica y la búsqueda combinada recuperaron aproximadamente el doble de resultados relevantes entre los primeros 10 resultados —pasando de un promedio de 4,5 a 9,1— en comparación con la búsqueda únicamente por palabras clave. Las mayores mejoras se observaron en idiomas que suelen presentar mayores dificultades para la búsqueda por palabras clave, como chino, japonés y árabe. El equipo evaluó distintos modelos y seleccionó uno que ofrecía un equilibrio entre resultados de alta calidad, eficiencia y velocidad para operar sobre millones de registros.
Esta evaluación ya fue incorporada a un sistema beta funcional dentro de la plataforma de búsqueda de LA Referencia. Cuando una persona realiza una búsqueda, puede elegir entre la coincidencia tradicional por palabras clave, una coincidencia “basada en significado” que funciona entre distintos idiomas o un modo combinado que integra ambas aproximaciones. La reindexación se vuelve considerablemente más rápida cuando se reutilizan embeddings generados previamente. Reconstruir el índice completo para un conjunto de prueba de aproximadamente 28.000 registros requirió alrededor de 5 horas la primera vez, pero solamente unos 10 minutos cuando los datos basados en significado ya estaban almacenados, lo que hace posible realizar actualizaciones regulares a medida que la colección continúa creciendo. Paralelamente, el equipo incorporó un WAF abierto que filtra bots automatizados y scrapers, junto con una forma de aplicar esa misma protección simultáneamente en múltiples sitios de LA Referencia.
También es posible profundizar en los detalles técnicos consultando el informe completo del Componente A de LA Referencia.
Próximos pasos
LA Referencia continúa revisando e incorporando repositorios de otros países miembros y de nuevos países fuera de su red. El equipo planea ampliar la evaluación de la búsqueda semántica multilingüe a toda la colección regional y consolidar la versión beta de búsqueda semántica antes de avanzar hacia un despliegue más amplio.
Componente B: Identificadores ARK descentralizados (dARK) y preservación de metadatos
El Componente B comprende el desarrollo de dARK 2.0, la próxima generación de la infraestructura de LA Referencia para asignar, publicar y resolver identificadores persistentes ARK. Este componente contempla una infraestructura regional, soberana y sostenible, construida específicamente para la región a la que sirve LA Referencia.
Avances hasta la fecha
Los identificadores persistentes son los que permiten que una producción de investigación continúe siendo localizable y citable a largo plazo mediante un enlace permanente que sigue conduciendo al artículo, conjunto de datos o informe correcto años después, incluso si el archivo cambia de ubicación o si cambia el sistema que lo aloja. Actualmente, gran parte de esta infraestructura es gestionada por un pequeño grupo de proveedores externos. dARK 2.0 representa la visión de LA Referencia de una infraestructura que la propia región pueda operar, gobernar y considerar confiable, sin depender de una única organización como centro de control.
Para lograrlo, el equipo dividió dARK 2.0 en componentes separados que pueden ser verificados, actualizados o escalados de manera independiente. Un registro compartido y resistente a manipulaciones —un tipo de blockchain— mantiene el registro autoritativo de qué identificadores existen y hacia dónde apuntan, mientras que los metadatos descriptivos de cada registro se almacenan por separado, permitiendo que cualquiera pueda verificar que no han sido alterados. Esta separación mantiene la capa de “prueba” simple y confiable, mientras que los datos descriptivos pueden continuar creciendo sin necesidad de modificar esa capa de “prueba”. El equipo también construyó todo el flujo de procesamiento que requiere el sistema: reservar nuevos identificadores, preparar y almacenar sus metadatos, publicar la referencia en el registro y permitir que cualquier persona consulte un identificador y lo resuelva hacia el registro correcto.
El equipo sometió este flujo de trabajo a pruebas de estrés con millones de registros y ejecutó cientos de verificaciones automatizadas para confirmar su robustez, además de construir herramientas administrativas para que el personal pueda monitorear identificadores, actividad y consultas. El flujo de dARK ya está listo para ser desplegado y conectado con el sistema regional de cosecha de LA Referencia, por lo que el proceso de cosecha se está integrando con el flujo de dARK para permitir la asignación de identificadores a medida que los registros son procesados, incluso en colecciones grandes y en constante cambio.
Profundizar en los detalles en el informe completo del Componente B.
Próximos pasos
El siguiente paso consiste en distribuir la infraestructura dARK entre distintas instituciones en lugar de ejecutarla desde un único lugar. Se está preparando una instalación equivalente en RNP, en Brasil, y la institución socia IBICT está preparando la migración de sus identificadores desde la versión original 1.0 de dARK. Con múltiples instituciones utilizando el sistema, LA Referencia planea validar su funcionamiento entre distintos sitios y formalizar el modelo de seguridad y gobernanza de esta infraestructura regional federada.
Componente C: Repositorio regional para datos sin infraestructura institucional y soporte para Dataverse
El Componente C combina un nuevo repositorio regional basado en Dataverse con un programa federado de capacitación y curaduría, cuyo objetivo es ofrecer un espacio para aquellos datos de investigación que carecen de infraestructura institucional, al mismo tiempo que se difunden las capacidades necesarias para operar servicios de datos de manera sostenible en toda la región.
Avances hasta la fecha
El equipo comenzó con un diagnóstico regional que identificó aproximadamente 96 repositorios de datos registrados y alrededor de 30 instalaciones de Dataverse en América Latina, concentradas principalmente en Brasil, Argentina, México y Colombia. El diagnóstico se basó en cuestionarios y entrevistas que abordaron gobernanza, infraestructura, curaduría, preservación, soporte e interoperabilidad. Este análisis confirmó que la región ya cuenta con una experiencia y conocimientos significativos, lo que dio forma a una estrategia de colaboración entre pares que concibe al repositorio como un servicio sociotécnico: software e infraestructura combinados con políticas, equipos multidisciplinarios, apoyo a investigadores y capacitación continua.
El principal resultado técnico es una versión de prueba funcional y en línea del repositorio —un “Dataverse Alpha”— que funciona sobre la propia infraestructura de LA Referencia. El repositorio está disponible en inglés, español y portugués, incluye campos para indicar el país de origen de un conjunto de datos y con cuáles de los 17 Objetivos de Desarrollo Sostenible de las Naciones Unidas se relaciona, y utiliza licencias abiertas (CC0 y CC BY) para que los datos puedan ser reutilizados libremente. Ya se han cargado conjuntos de datos de ejemplo para que el equipo pueda probar la carga, descripción, búsqueda y acceso a archivos antes de que comiencen a recibirse depósitos institucionales reales.
Junto con el desarrollo técnico, el equipo está elaborando un MOOC asincrónico de 16 horas, Introducción a la Gestión y Curaduría de Datos en Dataverse, que abarca fundamentos y publicación, metadatos y documentación, verificación técnica y formatos, y ética, licenciamiento y aprobación. Este es uno de los tres productos de capacitación planificados; los otros incluyen capacitación práctica en curaduría y apoyo directo a las instituciones piloto. El curso será construido e instalado en un entorno Moodle de producción, con materiales en español y portugués.
Invitamos a los lectores a explorar todos los detalles técnicos en el informe completo del Componente C.
Próximos pasos
El equipo finalizará los contenidos del curso, validará de extremo a extremo los flujos de trabajo del repositorio, seleccionará las primeras instituciones piloto y transformará las lecciones aprendidas durante la fase Alpha en un modelo estable para el servicio regional.
El proyecto de LA Referencia: apoyando los objetivos del Fondo de IOI para la Adopción en Redes
A seis meses de iniciado el proyecto, LA Referencia ha pasado del diseño y el trabajo de diagnóstico a sistemas funcionales: una experiencia de descubrimiento multilingüe con mejoras medibles, una arquitectura funcional para identificadores persistentes soberanos y verificables, y un repositorio regional de datos en funcionamiento acompañado de un proceso de capacitación diseñado para perdurar más allá de una única subvención. Nada de esto fue construido para una sola institución; cada mejora contribuye a una infraestructura compartida y federada de la que ya dependen los repositorios miembros de LA Referencia en toda América Latina.
Esta es la premisa del Fondo de IOI para la Adopción en Redes: que la forma más rápida y duradera de hacer crecer la adopción de infraestructura abierta es invertir en redes que ya cuentan con la gobernanza, la confianza y el alcance necesarios para poner nuevas capacidades al servicio de muchas instituciones simultáneamente. Los primeros seis meses de LA Referencia muestran esta tesis en acción. La base técnica que están construyendo permitirá avanzar hacia la próxima fase del proyecto: expandirse hacia nuevos países e idiomas, validar dARK entre distintas instituciones e incorporar las primeras instituciones piloto al Dataverse regional.
Leé más sobre el proyecto en el sitio de informes del proyecto de LA Referencia, incluido el informe ejecutivo completoen el que se basa este artículo, o conocé más sobre el trabajo de IOI con LA Referencia y el Fondo de IOI para la Adopción en Redes.





