Exploratory Unstructured Data Analysis: A Formative Study and Implications for Human-AI Collaboration
Johannes Eschner, Dominik Eitler, Max Irendorfer, Patrick Kramml, Matthias Zeppelzauer, Manuela Waldner
Abstract
We propose a conceptual framework for exploratory data analysis of (large) unstructured data (EluDA), combining classical elements (querying, visualization) with active knowledge construction in the "search for structure". In a formative study, users conceptualized a structure for an image dataset during exploration. We found that users conceptualize by building faceted classifications bottom-up and rarely create meaningful spatial categorization during this process. We also evaluated CLIP for zero-shot assignment and semantic categorization, finding that it remains unreliable for assigning user-defined concepts to images but does support semantic grouping. Based on these findings, we identify and discuss four key opportunities for human-AI collaboration in EluDA: intelligent sampling and visualization to maximize data visibility; incremental and few-shot learning to minimize effort for reliable assignment; automatic category, concept, and facet suggestions to reduce effort during the search for structure; and the necessity for effective trust calibration methods.
Create a lesson
Related papers
Toward Frontier-Quality Declarative UI Generation at Small-Model Cost
Yingxiang Yang, Weihang Xiao, Ben Bullough et al.
Grounding GUI Design in Computational Psychology
Xianni Wang, Javier Romero Davila, Saku Sourulahti et al.
From Misconceptions to Evidence: What Science Teachers Make Visible When Co-Designing Agentic Learning Apps
Nizam Kadir, Wei Ting Liow, Sumbul Khan et al.
GazeFS: Target-Centered Gaze-Trajectory Forecasting and Stabilization from Gaze-Head History
Yaozheng Xia, Zaiping Zhu, Bo Pang et al.
Auditing Contextual Bias in Human Ball-Strike Calls Using KBO's Automated Umpiring Transition
Kichang Lee, JeongGil Ko
PlanePivoting: Exploration and Optimization of Gaze-Mouse Cursor Alignment for Spatial Object Translation
Jinwook Kim, Sangmin Park, Jihyeon Lee et al.