Catálogo de recursos lingüísticos
El directorio federado y soberano diseñado para la publicación, descubrimiento
y explotación de activos lingüísticos, modelos de IA y servicios avanzados del
ecosistema.
Parte del ecosistema del Espacio de Datos Valle de la Lengua
El catálogo es uno de los componentes del Espacio de Datos Valle de la Lengua y actúa como punto común de referencia para identificar recursos disponibles dentro del ecosistema. Su función no es almacenar datos de forma centralizada, sino publicar metadatos estructurados que permiten descubrir recursos distribuidos en silos institucionales, académicos y empresariales.
A través de esta infraestructura se gestionan automáticamente las políticas de uso y las identidades digitales de los participantes para garantizar confianza en cada transacción.
¿Qué recursos puedes encontrar y compartir?
Datos lingüísticos
Corpus textuales, voz, terminología especializada y recursos documentales.
Modelos y herramientas
Modelos NLP, tecnologías del lenguaje, APIs y servicios asociados.
Metadatos y certificación
Información sobre procedencia, calidad, condiciones de uso y trazabilidad.
Acceso y condiciones de uso
La participación en el catálogo se rige por un Marco de Gobernanza único que asegura la transparencia y el cumplimiento normativo (RGPD, Data Act y AI Act).
El catálogo permite negociar las condiciones de uso de forma dinámica:
Soberanía absoluta
El proveedor define quién, cómo y para qué se usan sus datos mediante políticas digitales (ODRL).
Identidad verificada
Solo entidades con credenciales de confianza pueden iniciar intercambios efectivos.
Modelos flexibles
Los recursos pueden ofrecerse bajo modelos de suscripción, pago por uso o licencias específicas para investigación
Un ecosistema en expansión
El catálogo se encuentra en crecimiento progresivo. Aunque su base es lingüística, la hoja de ruta estratégica contempla la integración de conjuntos de datos de otros sectores para ampliar el valor y las posibilidades de innovación.