Tres capas, tres posiciones. El material patrimonial es gratuito y sigue siéndolo; el software no.
El texto del corpus es gratuito para las personas, de forma permanente.
Sin muro de pago sobre el material patrimonial. Sin necesidad de cuenta para leer. A las instituciones se les pide pagar por el acceso institucional; a las personas, nunca.
Todo aquello por lo que el proyecto cobra queda fuera de esa línea: software, licenciamiento, funciones de conveniencia, docencia y trabajos por encargo. La fecha en que este compromiso quede formalmente publicado, y de la que no se moverá, irá aquí en cuanto exista la entidad que lo asume.
La prosa, los datos estructurados y el software se licencian por separado, porque son tres clases distintas de obra con tres casos de reutilización distintos.
| Capa | Licencia | Efecto |
|---|---|---|
| Prosa del corpus | CC BY-SA 4.0 | Libre de leer, reutilizar y adaptar con atribución; las obras derivadas siguen abiertas. |
| Datos estructurados | CC BY 4.0 | Libre para investigación y para uso en PLN, incluido el trabajo en tecnología de lenguas africanas. |
| Plataforma de software | Propietaria | Se licencia por separado, y es la principal línea comercial del proyecto. |
Prevista, todavía no otorgada. Una licencia se otorga al publicarla junto con la obra, y el corpus todavía no se ha publicado bajo estos términos. Las opciones de arriba son la intención asentada del proyecto y coinciden con la práctica de corpus comparables; se vuelven vinculantes cuando los archivos se distribuyan con ellas.
Estas acompañan a las licencias como declaración de intención y no como términos de licencia.
El contenido de los versos de Ifá no se licencia para entrenamiento de IA generativa
El daño previsible aguas abajo supera cualquier ingreso, y la decisión no es difícil.
La atribución debe sobrevivir
Una reutilización que despoje las citas reproduce exactamente el problema que este proyecto existe para corregir, dado que las citas son la sustancia y no un adorno.
El patrón es constante: compartir igual en la prosa, una licencia más laxa o una renuncia total en los datos estructurados. Este proyecto lo sigue en lugar de inventar una posición.
Wikimedia
Las afirmaciones y declaraciones estructuradas de Wikidata se publican bajo CC0. La prosa de los artículos de Wikipedia es CC BY-SA.
Europeana
Todos los metadatos en Europeana son CC0. La prosa de los blogs y las exposiciones es CC BY-SA, y los objetos de medios patrimoniales llevan sus propias declaraciones de derechos individuales.
Universal Dependencies
Los repositorios nuevos de treebank adoptan por defecto CC BY-SA 4.0 para la anotación sintáctica estructurada, y los proveedores quedan libres de usar CC BY 4.0 en su lugar.
CLARIN
CLARIN identifica CC BY 4.0 y CC BY-SA 4.0 como las principales licencias abiertas para corpus de texto, cubriendo tanto el derecho de autor como los derechos sobre bases de datos, y nombra CC0 como instrumento de renuncia y no como licencia.
El uso académico depende de una cita que resuelva a un pasaje específico en una versión específica, y que siga resolviendo.
Ìpilẹ̀ṣẹ̀, "<título del documento>", https://ipilese.com/read/<sección>/<slug>, consultado el <fecha>.
No está en pie. No hay DOI, no hay una versión publicada del corpus y no hay ninguna instantánea depositada en un repositorio. Una cita a esta obra es actualmente una URL más una fecha de consulta, lo que es más débil de lo que debería ofrecer un recurso académico y se nombra como más débil en lugar de maquillarse.
La práctica a la que esto apunta es la que establecieron Perseus y DraCor: un identificador dereferenciable que resuelve a un pasaje dentro de una versión nombrada, y una instantánea versionada del corpus depositada con un DOI para que un análisis computacional pueda citar exactamente la versión contra la que se ejecutó.
Una sola API REST es la fuente de verdad para todas las superficies, y es la misma que consumiría cualquier otra persona.
Los documentos, las secciones y sus metadatos se sirven por una API JSON versionada. Las respuestas llevan la versión bajo la que se sirvieron, de modo que un cliente puede afirmar la versión que realmente alcanzó y no la que cree haber solicitado. Los endpoints implementados empiezan en ipilese.com/api/v1/documents