Pular para o conteúdo principal

Reunião PUC 10 de Outubro 2022

1. Problem Statement: artigos mais recentes não focam em Contexto. Os problemas de Fusão de Dados / Integração de Dados em ambiente Corporativo já trazem essa noção de que a nem tudo que está no banco de dados é verdadeiro independente do contexto.

2. A banca deve ter pelo menos mais 2 de fora, além do Schwabe. Altigram, Palazzo e talvez Ricardo

3. Documento de Defesa de Proposta de até 20 páginas deve deixar claro: Quais são as contribuições científicas, Qual o diferencial da pesquisa (o que será inovador), Justificar pq o problema é relevante, Como a nossa solução é melhor que as demais e qual será o critério de medição. Data provável: entre 21/11 a 30/11

4. A proposta de Sistemas de Informação para Mundo Aberto deve ter Contexto Explícito para as informações recuperadas e considerar a existência de uma Camada de Confiança adicional para tornar a exploração do KG operacional no seu contexto de uso (na tarefa que pretende resolver). Essa Camada de Confiança não será detalhada na minha proposta mas ela representa a Perspectiva Pessoal (Ponto de Vista) que irá resolver eventuais conflitos nas respostas.

5. Uma das contribuições é um Modelo Lógico composto de estrutura (conceitos e seus relacionamentos) e de uma linguagem que recupera a melhor resposta. O modelo possui uma representação em Alto Nível (UML) e deve ser mapeado em estruturas como tabelas de modo a permitir a sua implementação. Além disso a linguagem deve especificar quais operações são permitidas com contexto: AND, OR, NOT

6. Talvez trocar Afirmações por Alegações para reforçar a ideia de Verdade Relativa. 

7. Na experimentação iremos instanciar os casos para uma Classe de Problemas. 

8. Os modelos de grafos usam o meta modelo matemático de conjuntos.

9. As soluções para incorporar contexto costumam ser ad-hoc e implementadas em código em cada aplicação. A implementação pode ser intencional ou não então o contexto além de ser implícito pode ser acidental. Ao tornar explícito e declarativo seria possível estender os conceitos e regras que representem um novo contexto de interesse. 

10. Teste com o Google: mesma query em lugares diferentes , logado/não logado, Verificar as sugestões do auto complete

água ferve

Logada

Anônima

water boils 

Logada


Anônima (Brasil)


Anônima (França) &gl=fr


water boiling

Logada


Anonima

Anônima (gl=cn)

capital Brasil

Logada

Anônima

capital city Brazil

Logada 

Anônima (Brasil)

Anônima (França)


Comentários

Postagens mais visitadas deste blog

Aprendizado de Máquina Relacional

 Extraído de -> https://www.lncc.br/~ziviani/papers/Texto-MC1-SBBD2019.pdf   Aprendizado de máquina relacional (AMR) destina-se à criação de modelos estatísticos para dados relacionais (seria o mesmo que dados conectados) , isto é, dados cuja a informação relacional é tão ou mais impor tante que a informação individual (atributos) de cada elemento.    Essa classe de aprendizado tem sido utilizada em diversas aplicações, por exemplo, na extração de informação de dados não estruturados [Zhang et al. 2016] e na modelagem de linguagem natural [Vu et al. 2018].   A adoção de técnicas de aprendizado de máquina relacional em tarefas de comple mentação de grafo de conhecimento se baseia na premissa de existência de regularidades semânticas presentes no mesmo . Modelos grafos probabilísticos  Baseada em regras / heurísticas que não podem garantir 100% de precisão no resultado da inferência mas os resultados podem ser explicados. Modelos de características de ...

Defesa de Doutorado de Grettel Monteagudo Garcia

A última atividade presencial que fiz na PUC-Rio foi assistir a defesa de tese da Grettel Monteagudo Garcia , em 13/03/2020 (uma sexta-feira 13 !!!!). O título da tese é “ A Keyword-based Query Processing Method for Datasets with Schemas ” e me interessou por causa do projeto do NIMA. A proposta parte do cenário onde usuários possam consultar dados, armazenados em bancos de dados relacionais e TripleStores, de maneira semelhante ao Google, ou seja, digitando palavras-chave, e deixando para o sistema recuperar os dados que melhor correspondem ao conjunto de palavras-chave.  Na tese estão descritos um algoritmo e um framework projetados para processar consultas baseadas em palavras-chave para bases de dados com esquema, especificamente bancos relacionais e bases de dados em RDF. A primeira etapa do algoritmo é a conversão do conjunto de palavras chaves em uma consulta abstrata explorando um esquema abstrato . Nesta etapa o principal desafio é achar onde a informação está (os matches...

Metodologia Científica II - continuação

No primeiro post  foram detalhados os 6 primeiros vídeos do canal do Youtube do professor Eduardo Ogasawara do CEFET/RJ   Mais 3 vídeos foram disponibilizados e estão comentados a seguir: Gráficos, Figuras e Tabelas (33 minutos) - como apresentar os resultados das avaliações experimentais. Gráficos: associar análises dos resultados a cada gráfico apresentado, problemas comuns na montagem de gráficos (não usar todo eixo X ou Y, não usar área útil com uma escala adequada a ver o comportamento dos números, não marcar os pontos de observação da série, inconsistência no uso de cores ), escala logarítmica x linear, eixo X para a variável independente e Y para a dependente (resposta), escrever boas legendas para os gráficos, observar se diferenças entre variáveis apresentadas em gráficos separados podem atrapalhar a interpretação dos resultados. Diagramas devem ser pensados de acordo com o propósito, trata-se de uma abstração e cada elemento deve ser explicado no texto, rótulos...