Pular para o conteúdo principal

Exploratory Search: From Finding to Understanding - Leitura de Artigo

Gary Marchionini. 2006. Exploratory search: from finding to understanding. Commun. ACM  49, 4 (April 2006), 41–46. https://doi.org/10.1145/1121949.1121979
 
This article distinguishes exploratory search that blends querying and browsing strategies from retrieval that is best served by analytical strategies ...
 
Exploratory search. Search is a fundamental life activity.
 
A hierarchy of information needs may also be defined that ranges from basic facts that guide short-term actions (for example, the predicted chance for rain today to decide whether to bring an umbrella) to networks of related concepts that help us understand phenomena or execute complex activities (for example, the relationships between bond prices and stock prices to manage a retirement portfolio) to complex networks of tacit and explicit knowledge that accretes as expertise over a lifetime (for example, the most promising paths of investigation for the seasoned scholar or designer). 
 
For these respective layers of information needs, we can define kinds of information-seeking activities, each with associated strategies and tactics that might be supported with computational tools.  
 
 
These activities are represented as overlapping clouds because people may engage in multiple kinds of search in parallel, and some activities may be embedded in others ...
 
Lookup is the most basic kind of sear ch task and has been the focus of development for database management systems and much of what Web search engines support. Lookup tasks return discrete and well-structured objects such as numbers, names, short statements, or specific files of text or other media. 
 
Database management systems support fast and accurate data lookups in business and industry; in journalism, lookups are related to questions of who, when, and where as opposed to what, how, and why questions. In libraries, lookups have been called “known item” searches to distinguish them from subject or topical searches.
 
Most people think of lookup searches as “fact retrieval” or “question answering.”
 
Clearly, lookup tasks have been among the most successful applications of computers and remain an active area of research and development.
 
[Lookup em Data Retrieval, Information Retrieval e Question Answering] 

Learning searches involve multiple iterations and return sets of objects that require cognitive processing and interpretation. Note that “learning” here is used in its general sense of developing new knowledge and thus includes self-directed life-long learning and professional learning as well as the usual directed learning in schools.
 
Much of the search time in learning search tasks is devoted to examining and comparing results and reformulating queries to discover the boundaries of meaning for key concepts.
 
[Esforço humano em análise e interpretação. Seria possível reaproveitar através do histórico de buscas? FAQ]
[Consultar e navegar, avaliar o resultado, refinar a consulta] 
[Exemplo: Realizar uma Revisão Sistemática sobre um potencial problema de pesquisa]
 
Investigative searching may be done to support planning and forecasting, or to transform existing data into new data or knowledge. In addition to finding new information, investigative searches may seek to discover gaps in knowledge (for example, “negative search” [1]) so that new research can begin or dead-end alleys can be avoided.
 
[Identificar o que não se sabe, o que o KB não contempla ou que ainda não foi reconhecido como conhecimento] 

Serendipitous browsing that is done to stimulate analogical thinking is another kind of investigative search. Investigative searching is more concerned with recall  (maximizing the number of possibly relevant objects that are retrieved) than precision (minimizing the number of possibly irrelevant objects that are retrieved) and thus not well supported by today’s Web search engines.
 
[Cobertura apresenta mais alternativas, mais respostas possíveis MAS pode sobrecarregar o usuário com informações para analisar] 

In the database realm, query-by-example (QBE) interfaces were early alternatives to formal language interfaces and QBE-like systems remain the primary method for supporting non-textual queries in multimedia systems. 
 
[QBE x Modelagem de consultas em linguagem do KB em relação a perguntas em NL] 

There is also substantial evidence in the IR literature that relevance feedback—asking information seekers to make relevance judgments about returned objects and then executing a revised query based on those judgments—is a powerful way to improve retrieval. However, practice shows that people are often unwilling to take the added step to provide feedback when the search paradigm is the classic turntaking model. T o engage people more fully in the search process and put them in continuous control, researchers are devising highly interactive user interfaces.   
   
[Dificuldade de obter o feedback do usuário]

Comentários

  1. White, R.W. & Roth, R.A. 2009. Exploratory search: beyond the query response paradigm, Synthesis Lectures on Information Concepts, Retrieval, and Services, Morgan & Claypool Publishers.

    ResponderExcluir
    Respostas
    1. Lido e tem 3 posts com os trechos mais importantes e comentários de leitura

      Excluir

Postar um comentário

Sinta-se a vontade para comentar. Críticas construtivas são sempre bem vindas.

Postagens mais visitadas deste blog

Aprendizado de Máquina Relacional

 Extraído de -> https://www.lncc.br/~ziviani/papers/Texto-MC1-SBBD2019.pdf   Aprendizado de máquina relacional (AMR) destina-se à criação de modelos estatísticos para dados relacionais (seria o mesmo que dados conectados) , isto é, dados cuja a informação relacional é tão ou mais impor tante que a informação individual (atributos) de cada elemento.    Essa classe de aprendizado tem sido utilizada em diversas aplicações, por exemplo, na extração de informação de dados não estruturados [Zhang et al. 2016] e na modelagem de linguagem natural [Vu et al. 2018].   A adoção de técnicas de aprendizado de máquina relacional em tarefas de comple mentação de grafo de conhecimento se baseia na premissa de existência de regularidades semânticas presentes no mesmo . Modelos grafos probabilísticos  Baseada em regras / heurísticas que não podem garantir 100% de precisão no resultado da inferência mas os resultados podem ser explicados. Modelos de características de ...

Defesa de Doutorado de Grettel Monteagudo Garcia

A última atividade presencial que fiz na PUC-Rio foi assistir a defesa de tese da Grettel Monteagudo Garcia , em 13/03/2020 (uma sexta-feira 13 !!!!). O título da tese é “ A Keyword-based Query Processing Method for Datasets with Schemas ” e me interessou por causa do projeto do NIMA. A proposta parte do cenário onde usuários possam consultar dados, armazenados em bancos de dados relacionais e TripleStores, de maneira semelhante ao Google, ou seja, digitando palavras-chave, e deixando para o sistema recuperar os dados que melhor correspondem ao conjunto de palavras-chave.  Na tese estão descritos um algoritmo e um framework projetados para processar consultas baseadas em palavras-chave para bases de dados com esquema, especificamente bancos relacionais e bases de dados em RDF. A primeira etapa do algoritmo é a conversão do conjunto de palavras chaves em uma consulta abstrata explorando um esquema abstrato . Nesta etapa o principal desafio é achar onde a informação está (os matches...

Metodologia Científica II - continuação

No primeiro post  foram detalhados os 6 primeiros vídeos do canal do Youtube do professor Eduardo Ogasawara do CEFET/RJ   Mais 3 vídeos foram disponibilizados e estão comentados a seguir: Gráficos, Figuras e Tabelas (33 minutos) - como apresentar os resultados das avaliações experimentais. Gráficos: associar análises dos resultados a cada gráfico apresentado, problemas comuns na montagem de gráficos (não usar todo eixo X ou Y, não usar área útil com uma escala adequada a ver o comportamento dos números, não marcar os pontos de observação da série, inconsistência no uso de cores ), escala logarítmica x linear, eixo X para a variável independente e Y para a dependente (resposta), escrever boas legendas para os gráficos, observar se diferenças entre variáveis apresentadas em gráficos separados podem atrapalhar a interpretação dos resultados. Diagramas devem ser pensados de acordo com o propósito, trata-se de uma abstração e cada elemento deve ser explicado no texto, rótulos...