Chaque source scientifique doit posséder une identité stable, une base d'accès, une note de licence ou de réutilisation et une trace de provenance. Les sources qui ne permettent pas l'usage de production prévu sont rejetées ou conservées uniquement comme références au lieu d'être scrapées silencieusement.
Identité et provenance de l'enregistrement
Chaque enregistrement scientifique doit être traçable jusqu'à source_id, station_id ou une autre identité stable de source, ainsi qu'à l'heure d'observation et aux informations de traitement. Les valeurs dérivées et indices élaborés conservent en plus la version de l'algorithme, le hachage des paramètres et les identités exactes des enregistrements d'entrée afin que la transformation puisse être auditée.
Droits de réutilisation avant automatisation
Une source ne devient pas une dépendance automatisée simplement parce qu'elle est visible dans un navigateur. L'ingestion de production exige une base d'accès et des conditions de réutilisation compatibles avec la fonction prévue de GeoLira. Lorsque les droits sont incertains, la source peut rester une référence bibliographique ou de validation plutôt que d'être scrapée silencieusement.
Historique canonique et attribution visible par l'utilisateur
Le stockage canonique peut conserver les révisions successives d'un événement pour audit. Les vues utilisateur sélectionnent la révision acceptée la plus récente de l'événement logique afin que, par exemple, des corrections USGS répétées n'apparaissent pas comme des séismes distincts. Les liens de source aident les utilisateurs à vérifier la provenance, mais un nom d'institution ou un DOI ne remplace pas les métadonnées de fraîcheur et de qualité de l'enregistrement concerné. GeoLira ne présente pas du contenu externe comme sa propre mesure.