Pular para o conteúdo principal

Reunião de Orientação 20 de Junho - Exemplos de Contexto Temporal de H4

Sérgio & Daniel

Dentro da definição de Respostas Possíveis cabe esclarecer que existe um entendimento original que é literal e sintático com as variáveis unbounded e também um refinamento de utilizar valores default que são oriundos do Senso Comum

Implementação: queries em Kypher

K1: incompleta, completar com o contexto temporal e proveniência

K2: incompleta, completar com o contexto temporal e proveniência. Adicionar também operações do Contra Domínio para selecionar os "overlaps" dos períodos das alegações envolvidas

Nossa proposta não faz a tradução de linguagem natural para GQL. O ENQUANTO significa "overlap" mas esta tradução não seria nossa porém a infra-estrutura de Contexto permite realizar este tipo de tradução na camada de interface/conversão/tradução. Fazer de fato é trabalho futuro. 

A Algebra de Contradomínio permite encontrar relações que não estão explícitamente representadas / materializadas no grafo através de arestas.  Não é prático materializar todas as relações mas é possível explicitar na resposta. 

Exemplo Ordenar números é uma forma de estabelecer relações como anterior /posterior. 

A Lógica ao trabalhar com nulos é diferente. Assumir a data atual para a data final no lugar do nulo.

Unknown pode ser não se aplica ou não sabemos ... trocar por Undefined? 

A regra poderia ser se for "capital de" e data de fim não existe ... então trocar por Corrente

O argumento em relação a aplicar a regra em um determinado relacionamento é melhor do que ser genérico. 

No mundo aberto é difícil afirmar que algo não aconteceu. 

K3: incompleta, e não existe relação entre os nós da consulta

Exemplo mais claro de relacionamentos que não estão explícitos no grafo. Requer o --force ao rodar no kgtk pois é um produto cartesiano.

Ilustrar algum caso com diferentes proveniências e diferentes datas do período para mostrar como é possível estabelecer um "Segundo X" versus "Segundo Y"

Exemplo do IBGE associa um peso a cada fonte (usando uma função) e faz um ranking para decidir de qual fonte um determinado atributo será utilizado

K4 e K5: Antes e Depois no Tempo

O Exemplo Espacial

1) Encontrar Geometrias

2) Estender o kgtk ou sqlite para utilizar operadores da Álgebra de Contradomínio Espacial

Sobre o prazo de defesa: Não posso ultrapassar novembro, final de setembro é o SBBD então a banca deve ser na primeira quinzena de outubro

O escopo do artigo de 6 páginas seria: o framework e o exemplo H4. 

A tese será em inglês se houver recursos como o ChatGPT e Grammarly já que não tenho fluência na escrita. O inglês é melhor para os artigos depois. Escrever a tese em português quando a língua começar a atrapalhar e depois traduz.


Comentários

Postagens mais visitadas deste blog

Aprendizado de Máquina Relacional

 Extraído de -> https://www.lncc.br/~ziviani/papers/Texto-MC1-SBBD2019.pdf   Aprendizado de máquina relacional (AMR) destina-se à criação de modelos estatísticos para dados relacionais (seria o mesmo que dados conectados) , isto é, dados cuja a informação relacional é tão ou mais impor tante que a informação individual (atributos) de cada elemento.    Essa classe de aprendizado tem sido utilizada em diversas aplicações, por exemplo, na extração de informação de dados não estruturados [Zhang et al. 2016] e na modelagem de linguagem natural [Vu et al. 2018].   A adoção de técnicas de aprendizado de máquina relacional em tarefas de comple mentação de grafo de conhecimento se baseia na premissa de existência de regularidades semânticas presentes no mesmo . Modelos grafos probabilísticos  Baseada em regras / heurísticas que não podem garantir 100% de precisão no resultado da inferência mas os resultados podem ser explicados. Modelos de características de ...

Defesa de Doutorado de Grettel Monteagudo Garcia

A última atividade presencial que fiz na PUC-Rio foi assistir a defesa de tese da Grettel Monteagudo Garcia , em 13/03/2020 (uma sexta-feira 13 !!!!). O título da tese é “ A Keyword-based Query Processing Method for Datasets with Schemas ” e me interessou por causa do projeto do NIMA. A proposta parte do cenário onde usuários possam consultar dados, armazenados em bancos de dados relacionais e TripleStores, de maneira semelhante ao Google, ou seja, digitando palavras-chave, e deixando para o sistema recuperar os dados que melhor correspondem ao conjunto de palavras-chave.  Na tese estão descritos um algoritmo e um framework projetados para processar consultas baseadas em palavras-chave para bases de dados com esquema, especificamente bancos relacionais e bases de dados em RDF. A primeira etapa do algoritmo é a conversão do conjunto de palavras chaves em uma consulta abstrata explorando um esquema abstrato . Nesta etapa o principal desafio é achar onde a informação está (os matches...

Metodologia Científica II - continuação

No primeiro post  foram detalhados os 6 primeiros vídeos do canal do Youtube do professor Eduardo Ogasawara do CEFET/RJ   Mais 3 vídeos foram disponibilizados e estão comentados a seguir: Gráficos, Figuras e Tabelas (33 minutos) - como apresentar os resultados das avaliações experimentais. Gráficos: associar análises dos resultados a cada gráfico apresentado, problemas comuns na montagem de gráficos (não usar todo eixo X ou Y, não usar área útil com uma escala adequada a ver o comportamento dos números, não marcar os pontos de observação da série, inconsistência no uso de cores ), escala logarítmica x linear, eixo X para a variável independente e Y para a dependente (resposta), escrever boas legendas para os gráficos, observar se diferenças entre variáveis apresentadas em gráficos separados podem atrapalhar a interpretação dos resultados. Diagramas devem ser pensados de acordo com o propósito, trata-se de uma abstração e cada elemento deve ser explicado no texto, rótulos...