Ogni fonte scientifica deve avere identità stabile, base di accesso, nota su licenza o riutilizzo e traccia di provenienza. Le fonti che non consentono l'uso di produzione previsto vengono rifiutate o mantenute solo come riferimento invece di essere sottoposte a scraping silenzioso.
Identità e provenienza del record
Ogni record scientifico deve essere riconducibile a source_id, station_id o altra identità stabile della fonte, ora di osservazione e informazioni di elaborazione. I valori derivati e gli indici creati dalla piattaforma conservano inoltre versione dell'algoritmo, hash dei parametri e identità esatte dei record di input affinché la trasformazione possa essere verificata.
Diritti di riutilizzo prima dell'automazione
Una fonte non diventa una dipendenza automatizzata soltanto perché è visibile in un browser. L'ingestione di produzione richiede una base di accesso e termini di riutilizzo compatibili con la funzione GeoLira prevista. Quando i diritti non sono chiari, la fonte può restare un riferimento bibliografico o di validazione invece di essere sottoposta a scraping silenzioso.
Cronologia canonica e attribuzione visibile all'utente
L'archiviazione canonica può conservare revisioni successive dello stesso evento per audit. Le viste utente selezionano la revisione accettata più recente dell'evento logico così, per esempio, correzioni USGS ripetute non appaiono come terremoti separati. I collegamenti alle fonti aiutano gli utenti a verificare la provenienza, ma un nome istituzionale o DOI non sostituisce i metadati di aggiornamento e qualità del record specifico. GeoLira non presenta materiale esterno come propria misurazione.