- AutorIn
- Katrin Braunschweig Technische Universität Dresden, Fakultät für Informatik, Institut für Systemarchitektur, Professur für Datenbanken
- Julian EberiusTechnische Universität Dresden, Fakultät für Informatik, Institut für Systemarchitektur, Professur für Datenbanken
- Maik ThieleTechnische Universität Dresden, Fakultät für Informatik, Institut für Systemarchitektur, Professur für Datenbanken
- Wolfgang Lehner
- Titel
- Frontiers in Crowdsourced Data Integration
- Zitierfähige Url:
- https://nbn-resolving.org/urn:nbn:de:bsz:14-qucosa2-728500
- Übersetzter Titel (DE)
- Probleme und Herausforderungen bei der Crowd-basierten Datenintegration
- Quellenangabe
- Information Technology Erscheinungsort: München
Verlag: Oldenbourg
Erscheinungsjahr: 2012
Jahrgang: 54
Heft: 3
Seiten: 130-137
E-ISSN: 2196-7032 - Erstveröffentlichung
- 2012
- Abstract (DE)
- Die stetig wachsende Zahl offen verfügbarer Webdaten findet momentan viel zu wenig oder gar keine Berücksichtigung in Entscheidungsprozessen. Der Grund hierfür ist insbesondere in der mangelnden Unterstützung durch anwenderfreundliche Werkzeuge zu finden, die diese Daten nutzbar machen und Wissen daraus genieren können. Zu diesem Zweck schlagen wir ein schemaoptionales Datenrepositorium vor, welches ermöglicht, heterogene Webdaten zu speichern sowie kontinuierlich zu integrieren und mit Schemainformation anzureichern. Auf Grund der dabei inhärent auftretenden Mehrdeutigkeiten, soll dieser Prozess zusätzlich um eine Crowd-basierende Verifikationskomponente unterstützt werden.
- Abstract (EN)
- There is an ever-increasing amount and variety of open web data available that is insufficiently examined or not considered at all in decision making processes. This is because of the lack of end-user friendly tools that help to reuse this public data and to create knowledge out of it. Therefore, we propose a schema-optional data repository that provides the flexibility necessary to store and gradually integrate heterogeneous web data. Based on this repository, we propose a semi-automatic schema enrichment approach that efficiently augments the data in a “pay-as-you-go” fashion. Due to the inherently appearing ambiguities we further propose a crowd-based verification component that is able to resolve such conflicts in a scalable manner.
- Andere Ausgabe
- Link zum Artikel der zuerst in der Zeitschrift 'Information Technology ' erschienen ist
DOI: 10.1524/itit.2012.0673 - Freie Schlagwörter (DE)
- Datenintegration, Crowdsourcing, Kollaboration, WWW
- Freie Schlagwörter (EN)
- data integration, Crowdsourcing, Collaboration, WWW
- Klassifikation (DDC)
- 004
- 620
- Verlag
- De Gruyter, München
- Version / Begutachtungsstatus
- publizierte Version / Verlagsversion
- URN Qucosa
- urn:nbn:de:bsz:14-qucosa2-728500
- Veröffentlichungsdatum Qucosa
- 26.11.2020
- Dokumenttyp
- Artikel
- Sprache des Dokumentes
- Englisch
- Lizenz / Rechtehinweis
- https://rightsstatements.org/files/buttons/InC.dark-white-interior.svg/