LÆS: Semi-strukturerede data
- View
Data der er et forsøg på, at strukturere ustrukturerede data kaldes semi-strukturerede data. Det er data der ikke passer ind i eksisterende skemaer og modeller, men alligevel overholder en genkendelig grundstruktur. Typisk vil dataene følge et løst dataformat hvor rækkefølgen er ligegyldig og værdier ikke nødvendigvis følger samme datatype. Der kan komme værdier, som ikke "passer ind" i den eksisterende model. Dataene er organiserede men ustrukturerede.
Der er to primære måder at organisere semi-strukturerede data på. Det ene er ved tagging - f.eks. twitter opslag eller meta tags i HTML. Det andet er ved hjælp af en særlig syntaks, som vi ser i JSON, XML eller CSV. JSON kan opbevarer hvilke som helst værdier organiseret i hvilken som helst struktur. Men det er dog muligt, at validere om det er korrekt JSON, ved at vurdere syntaksen i dataen.