Pular para o conteúdo principal

Contexto Identidade x Determinação - Mudança do esquema do CKG

Na nossa última reunião anotei que "Identidade é importante para montar a melhor resposta mas não é Contexto de Conhecimento, o que seria então? "

A descrição do que seria este tipo de contexto:

Identity: informações que permitam ao usuário identificar as entidade envolvida na afirmação. Por exemplo, o tipo da entidade, o nome da entidade, um identificador único natural (chave primária e chaves alternativas), etc … Na afirmação “Rio de Janeiro” “capital do” “Brasil”, como podemos saber se é o município ou o estado do Rio de Janeiro? Neste exemplo a informação do tipo de entidade permite essa diferenciação entre os nós. Em outros casos as propriedades da entidade que sejam do tipo Inverse Funcional Property, ou seja, propriedades que ligam a entidade (sujeito) a um valor (objeto) que permite identificar unicamente essa entidade podem ser incluídas. Adicionalmente as propriedades que apresentam uma versão legível por humanos do nome principal, nomes alternativos ou descrição de um recurso uma vez que a busca exploratória é realizada por humanos. Com essa dimensão é possível responder a perguntas do tipo O QUÊ ou QUEM que possam surgir durante a busca exploratória.

No livro de KG [1], tem um tópico 3.2 Identity mas só fala do uso de identificadores persistentes.

No paper do GUIZZARDI [2] que o Daniel indicou existem dois conceitos:

Determinação Individual: Um indivíduo x de uma estrutura individual S é considerado determinado se e somente se todas as permutações de S preservam x, ou seja, x não pode ser trocado perfeitamente com um indivíduo distinto de S.

Contexto de Determinação: expressa a determinação como a existência de certas subestruturas de uma estrutura individual S que fundamentam a determinação de um indivíduo específico. Essas subestruturas são caracterizadas pela existência de certos morfismos, chamados de âncoras.

Ou seja, o Contexto de Determinação coloca em evidência os elementos (predicados de Identidade do KG) da estrutura individual S (nós do KG) que podem ser utilizados para definir critérios que permitam identificar qual objeto do mundo real a instância está referenciando. Os predicados seriam atributos e relações naturais (no artigo eles chamam de genuínas) das instâncias e não IDs gerados artificialmente.

Como a nossa definição de Contexto é:

“By context, we herein refer to the scope of truth, and thus talk about the context in which some data are held to be true”

Pensei em mudar o modelo para refletir o conceito de Determinação de Identidade das Entidades e Conceitos envolvidos nas Alegações que vai ser usado para compor a melhor resposta possível.


[1] Hogan, Aidan, et al. "Knowledge graphs." ACM Computing Surveys (CSUR) 54.4 (2021): 1-37.
[2] Nicola, João, and Giancarlo Guizzardi. "Individual determinacy and identity criteria in ontology-driven information systems." Formal Ontology in Information Systems. IOS Press, 2018.

Comentários

Postagens mais visitadas deste blog

Aprendizado de Máquina Relacional

 Extraído de -> https://www.lncc.br/~ziviani/papers/Texto-MC1-SBBD2019.pdf   Aprendizado de máquina relacional (AMR) destina-se à criação de modelos estatísticos para dados relacionais (seria o mesmo que dados conectados) , isto é, dados cuja a informação relacional é tão ou mais impor tante que a informação individual (atributos) de cada elemento.    Essa classe de aprendizado tem sido utilizada em diversas aplicações, por exemplo, na extração de informação de dados não estruturados [Zhang et al. 2016] e na modelagem de linguagem natural [Vu et al. 2018].   A adoção de técnicas de aprendizado de máquina relacional em tarefas de comple mentação de grafo de conhecimento se baseia na premissa de existência de regularidades semânticas presentes no mesmo . Modelos grafos probabilísticos  Baseada em regras / heurísticas que não podem garantir 100% de precisão no resultado da inferência mas os resultados podem ser explicados. Modelos de características de ...

Defesa de Doutorado de Grettel Monteagudo Garcia

A última atividade presencial que fiz na PUC-Rio foi assistir a defesa de tese da Grettel Monteagudo Garcia , em 13/03/2020 (uma sexta-feira 13 !!!!). O título da tese é “ A Keyword-based Query Processing Method for Datasets with Schemas ” e me interessou por causa do projeto do NIMA. A proposta parte do cenário onde usuários possam consultar dados, armazenados em bancos de dados relacionais e TripleStores, de maneira semelhante ao Google, ou seja, digitando palavras-chave, e deixando para o sistema recuperar os dados que melhor correspondem ao conjunto de palavras-chave.  Na tese estão descritos um algoritmo e um framework projetados para processar consultas baseadas em palavras-chave para bases de dados com esquema, especificamente bancos relacionais e bases de dados em RDF. A primeira etapa do algoritmo é a conversão do conjunto de palavras chaves em uma consulta abstrata explorando um esquema abstrato . Nesta etapa o principal desafio é achar onde a informação está (os matches...

Metodologia Científica II - continuação

No primeiro post  foram detalhados os 6 primeiros vídeos do canal do Youtube do professor Eduardo Ogasawara do CEFET/RJ   Mais 3 vídeos foram disponibilizados e estão comentados a seguir: Gráficos, Figuras e Tabelas (33 minutos) - como apresentar os resultados das avaliações experimentais. Gráficos: associar análises dos resultados a cada gráfico apresentado, problemas comuns na montagem de gráficos (não usar todo eixo X ou Y, não usar área útil com uma escala adequada a ver o comportamento dos números, não marcar os pontos de observação da série, inconsistência no uso de cores ), escala logarítmica x linear, eixo X para a variável independente e Y para a dependente (resposta), escrever boas legendas para os gráficos, observar se diferenças entre variáveis apresentadas em gráficos separados podem atrapalhar a interpretação dos resultados. Diagramas devem ser pensados de acordo com o propósito, trata-se de uma abstração e cada elemento deve ser explicado no texto, rótulos...