<!DOCTYPE article PUBLIC "-//NLM//DTD JATS (Z39.96) Journal Archiving and Interchange DTD v1.0 20120330//EN" "JATS-archivearticle1.dtd">
<article xmlns:xlink="http://www.w3.org/1999/xlink">
  <front>
    <journal-meta />
    <article-meta>
      <title-group>
        <article-title>Integrac¸a˜ o Sem aˆntica das Bases de Dados do Sistema U´ nico de Sa u´de: Um Estudo de Caso com o Munic´ıpio de S a˜o Paulo</article-title>
      </title-group>
      <contrib-group>
        <contrib contrib-type="author">
          <string-name>De´bora Lina Ciriaco</string-name>
        </contrib>
        <contrib contrib-type="author">
          <string-name>Alexandre Pessoa</string-name>
        </contrib>
        <contrib contrib-type="author">
          <string-name>La´ıs Salvador</string-name>
        </contrib>
        <contrib contrib-type="author">
          <string-name>Renata Wassermann</string-name>
          <email>renatag@ime.usp.br</email>
        </contrib>
      </contrib-group>
      <abstract>
        <p>Database integration plays a crucial role in understanding the healthcare domain. In this work, a semantic integration methodology was adapted to the birth and mortality database systems of the Brazilian Unified Health System. A case study was carried out to develop a health indicator in the context of maternal and child health in the municipality of S a˜o Paulo. Three layers of ontologies were created for the solution, containing specifications and mappings. The ontologies were populated and evaluated for their ability to answer competence questions elected by domain experts. The solution proved to be useful in the integration process, presenting a global view of the data and their relationships. Resumo. Integrac¸ a˜o de bases de dados tem um papel crucial para compreender o dom´ınio da sa u´de. Neste trabalho, uma metodologia de integrac¸ a˜o sem aˆntica foi adaptada para as bases do sistemas de nascimento e mortalidade do Sistema U´ nico de Sa u´de. Foi realizado um estudo de caso voltado ao desenvolvimento de um indicador de sa u´de no contexto da sa u´de materno-infantil do munic´ıpio de S a˜o Paulo. Foram criadas treˆs camadas de ontologias para a soluc¸ a˜o, contendo especificac¸ o˜es e mapeamentos. As ontologias foram povoadas e avaliadas quanto a` capacidade de responder a`s quest o˜es de competeˆncia eleitas pelos especialistas do dom´ınio. A soluc¸ a˜o mostrou-se u´til no processo de integrac¸ a˜o apresentando uma vis a˜o global dos dados e seus relacionamentos.</p>
      </abstract>
    </article-meta>
  </front>
  <body>
    <sec id="sec-1">
      <title>1. Introduc¸a˜ o</title>
      <p>agravos, como AIDS, s´ıfilis, tuberculose, dengue, entre outros. Ha´ tambe´m sistemas
voltados para a gesta˜o do gasto pu´blico, portanto restritos aos eventos financiados pelo SUS,
tais como os sistemas para notificac¸a˜o de internac¸ o˜es hospitalares - SIH e atendimentos
ambulatoriais - SIA [SIS 2015].</p>
      <p>Por terem surgido a partir de demandas diferentes, os sistemas sa˜o independentes,
na˜o havendo um me´todo fa´cil e automa´tico para busca de registros inter-bases. Apesar
das iniciativas recentes, tambe´m na˜o ha´ o mesmo identificador u´nico em todas as bases.
Outro fator dificultante numa ana´lise global e´ o fato dos registros na˜o estarem centrados
nos pacientes mas em eventos, como procedimentos realizados durante uma internac¸a˜o
ou medicamentos dispensados [SIS 2015]. A esse quadro e´ somado o vasto vocabula´rio
utilizado, exigindo conhecimento do dom´ınio para compreensa˜o dos dados.</p>
      <p>Muitos desses sistemas teˆm seus dados disponibilizados no site do DATASUS1 e
podem ser adquiridos em formato CSV a partir de uma interface online de filtragem, o
TABNET2. Caso seja necessa´ria a aquisic¸a˜o da base completa o acesso se da´ por outra
pa´gina, a de arquivos de dados3. Nela, os arquivos sa˜o disponibilizados em formato DBF
ou DBC. Os dados disseminados publicamente sa˜o devidamente anonimizados a fim de
na˜o comprometer a identidade dos pacientes e profissionais que atuaram no atendimento.
Como consequeˆncia, a tarefa de ligac¸ a˜o dos registros das bases, que depende do acesso
aos dados identificados, deve estar relacionada a um o´rga˜o mantenedor dos registros
originais, geralmente as Secretarias Municipais da Sau´de.</p>
      <p>Dado o contexto de desafios computacionais e do dom´ınio da sau´de, foi
percept´ıvel a necessidade de desenvolver a soluc¸a˜o dentro de uma equipe
multiprofissional. Assim, para a realizac¸ a˜o desta pesquisa, foi formada uma parceria com a Secretaria
Municipal da Sau´de de Sa˜o Paulo - SMS-SP e com a Faculdade de Sau´de Pu´blica da
Universidade de Sa˜o Paulo - FSP-USP. Com o aux´ılio da equipe de especialistas (composta
por aproximadamente 20 profissionais, entre especialistas nas bases de dados e te´cnicos da
SMS-SP, professores e po´s-graduandos da FSP-USP) foi poss´ıvel compreender o dom´ınio
e levantar questo˜es. Os especialistas guiaram a escolha das bases de dados (SINASC e
SIM), do caso de uso (sau´de materno-infantil voltada para o desenvolvimento do
indicador de sau´de DPGP, utilizando os dados do munic´ıpio de Sa˜o Paulo) e auxiliaram no
processo de validac¸a˜o da soluc¸a˜o.</p>
      <p>
        O desenvolvimento do indicador de sau´de se da´ no contexto do projeto: “Dias
Potenciais de Gravidez Perdidos (DPGP): uma medida inovadora da idade gestacional, para
avaliar intervenc¸o˜es e resultados de sau´de materno-infantil”. O projeto busca desenvolver
um indicador de sau´de que medira´ a perda no tempo de gestac¸a˜o, comparando-a com o
tempo de gestac¸a˜o esperado [
        <xref ref-type="bibr" rid="ref4">Diniz et al. 2019</xref>
        ]. No entanto, a elaborac¸a˜o do indicador
depende da integrac¸a˜o de algumas bases de dados do SUS, dentre elas as de natalidade
- SINASC e de mortalidade - SIM, da compreensa˜o das varia´veis e de como se da´ o seu
preenchimento. A necessidade de te´cnicas de integrac¸a˜o que levam em conta o uso de
contexto foi determinante na escolha deste estudo de caso.
      </p>
      <p>1DATASUS: http://www2.datasus.gov.br/DATASUS/index.php?area=02
2TABNET: http://www2.datasus.gov.br/DATASUS/index.php?area=060804
3Arquivos de dados DATASUS: http://www2.datasus.gov.br/DATASUS/index.php?
area=0901</p>
      <p>
        A abordagem te´cnica utilizada para a realizac¸ a˜o da integrac¸a˜o semaˆntica de bases
de dados foi influenciada pelos trabalhos de [
        <xref ref-type="bibr" rid="ref5">Ekaputra et al. 2017</xref>
        ,
        <xref ref-type="bibr" rid="ref6">Ferronato et al. 2016</xref>
        ,
        <xref ref-type="bibr" rid="ref12">Ristoski and Paulheim 2016</xref>
        ,
        <xref ref-type="bibr" rid="ref13 ref14">Stoilos et al. 2018</xref>
        b,
        <xref ref-type="bibr" rid="ref13 ref14">Stoilos et al. 2018</xref>
        a,
        <xref ref-type="bibr" rid="ref17">Zhang et al. 2007</xref>
        ,
        <xref ref-type="bibr" rid="ref2">Bauer et al. 2016</xref>
        ], mas foram os trabalhos de [
        <xref ref-type="bibr" rid="ref15">Vidal et al. 2015</xref>
        ,
        <xref ref-type="bibr" rid="ref9">Lopes et al. 2016</xref>
        ] que
mais trouxeram contribuic¸o˜es. Neles, os autores desenvolveram um framework baseado
em ontologias para a especificac¸a˜o formal de viso˜es de dados integrados, seguindo uma
metodologia de integrac¸a˜o de bases de dados por meio de ontologias - OBDI
(OntologyBased Data Integration).
      </p>
      <p>O presente estudo tem como objetivo realizar a integrac¸a˜o semaˆntica das bases de
dados dos sistemas de natalidade - SINASC e mortalidade - SIM do SUS, ambas
relacionadas a` sau´de materno-infantil e ao desenvolvimento do indicador de sau´de DPGP - Dias
Potenciais de Gravidez Perdidos. A integrac¸a˜o foi testada com os dados do munic´ıpio de
Sa˜o Paulo, advindos tanto do site do DATASUS (dados na˜o integrados do SINASC e do
SIM) quanto da parceria com a SMS-SP e com a FSP-USP (dados do SINASC e do SIM
linkados e anonimizados, nomeados de DNDO), filtrando as varia´veis que sa˜o u´teis para
o problema da pesquisa. Para isso, foi eleita e adaptada uma metodologia de OBDI. O
presente trabalho tem a aprovac¸a˜o do comiteˆ de e´tica da Faculdade de Sau´de Pu´blica da
USP, com o parecer de nu´mero 2.958.248.</p>
      <p>A sec¸a˜o 2 descreve a metodologia de desenvolvimento do sistema de integrac¸a˜o
semaˆntica, incluindo o protocolo utilizado para a escolha da metodologia e arquitetura do
sistema. A sec¸ a˜o 3 conte´m a metodologia e a discussa˜o do desenvolvimento das
ontologias e mapeamentos que sa˜o independentes do dom´ınio central da aplicac¸a˜o. Nesse caso,
sa˜o apresentadas as ontologias das bases do SINASC e do SIM. Ja´ a sec¸a˜o 4 apresenta a
discussa˜o e o desenvolvimento das ontologias dependentes de contexto, onde, as
ontologias do SIM e do SINASC no contexto da sau´de materno-infantil relacionada ao indicador
de sau´de DPGP. Finalmente, a sec¸a˜o 5 traz as considerac¸o˜es finais e os trabalhos futuros.</p>
    </sec>
    <sec id="sec-2">
      <title>2. Metodologia de desenvolvimento da soluc¸ a˜o</title>
      <p>Para o desenvolvimento da soluc¸a˜o de integrac¸ a˜o, as fontes de dados (SINASC e SIM) e
varia´veis foram escolhidas, bem como compreendido o contexto em que o sistema seria
utilizado. Em seguida as metodologias de ODBI foram analisadas a fim de encontrar a
mais adequada para o projeto.</p>
      <p>
        Em [
        <xref ref-type="bibr" rid="ref16">Wache et al. 2001</xref>
        ] e [
        <xref ref-type="bibr" rid="ref5">Ekaputra et al. 2017</xref>
        ] sa˜o apresentadas as principais
metodologias de OBDI. Quanto a` arquitetura, elas sa˜o: i) ontologia u´nica, onde um
vocabula´rio global e´ constru´ıdo e, a partir dele, sa˜o realizados mapeamentos para as fontes de
dados; ii) mu´ltiplas ontologias, onde uma ontologia local e´ desenvolvida para cada fonte
de dado e sa˜o criados mapeamentos semaˆnticos entre as ontologias para a integrac¸a˜o dos
vocabula´rios; iii) ontologia h´ıbrida, onde os mecanismos anteriores sa˜o utilizados,
havendo a construc¸a˜o do vocabula´rio compartilhado numa ontologia global e a partir dele
ocorre a criac¸ a˜o das ontologias locais; e iv) GAV, baseada na abordagem de integrac¸ a˜o de
dados relacionais Global-as View, as ontologias locais e a ontologia global sa˜o
desenvolvidas, mas de maneira independente em termos de vocabula´rio.
      </p>
      <p>
        Segundo os autores, todas as abordagens possuem pontos negativos e positivos,
desse modo, sua adoc¸a˜o dependera´ da complexidade e organizac¸a˜o das fontes de
dados, bem como do tempo dispon´ıvel para o desenvolvimento da soluc¸a˜o e de como
ela sera´ utilizada. Desse modo, seguindo a a´rvore de recomendac¸a˜o apresentada em
[
        <xref ref-type="bibr" rid="ref5">Ekaputra et al. 2017</xref>
        ], Figura 1, foi constatado que a metodologia de OBDI h´ıbrida era
a mais adequada para o problema de pesquisa, uma vez que comporta bem a adic¸ a˜o de
novas fontes de dados, algo desejado a me´dio prazo, como discutido em [
        <xref ref-type="bibr" rid="ref10">Pereira 2019</xref>
        ].
Ao longo do desenvolvimento, foi notado que a preservac¸ a˜o do vocabula´rio das fontes
de dados era importante, principalmente para a reutilizac¸a˜o das ontologias em diferentes
contextos, levando assim a revisa˜o da metodologia mais adequada, sendo adotada a GAV.
      </p>
      <p>
        Figura 1. A´ rvore de Recomendac¸ a˜ o de abordagens de OBDI criada por
[
        <xref ref-type="bibr" rid="ref5">Ekaputra et al. 2017</xref>
        ], adaptada pelos autores
      </p>
      <p>Seguindo a a´rvore, temos os cinco conjuntos de decisa˜o e seus argumentos,
apresentados de acordo com o contexto do projeto e suas fontes de dados:
1. Baixa Heterogeneidade Semaˆntica:
(a) As fontes de dados na˜o possuem viso˜es similares do dom´ınio, embora
possuam conceitos em comum. Cada base de dados possui a sua visa˜o para
o evento, a do SINASC apresenta o evento do nascimento e a do SIM, o
evento do o´bito;
(b) As “viso˜es” locais do dom´ınio sa˜o importantes pois cada profissional tem
sua abordagem sobre o assunto;
(c) As bases compartilham de um padra˜o comum de dados pois possuem
diciona´rios de metadados similares;
O u´ltimo item foi o u´nico ponto que apontou para a escolha da abordagem OBDI
de Ontologia U´nica, enquanto que os dois itens anteriores levavam a necessidade
de continuar as ana´lises.
2. Limitac¸a˜o de Recursos:
(a) O tempo e a quantidade de pessoas, principalmente a equipe de
especialistas do dom´ınio, foram apresentados como adequados a`s soluc¸ o˜es mais
complexas;
(b) A criac¸a˜o e evoluc¸a˜o da integrac¸a˜o dos dados na˜o seria um prot o´tipo
ra´pido, devido a quantidade de bases de dados e varia´veis, bem como a
complexidade terminol o´gica delas;</p>
      <p>As respostas das decis o˜es 1 e 2 levam para a decisa˜o 3.
3. Alta complexidade de Mapeamento:
(a) Apesar da complexidade terminol o´gica, as relac¸ o˜es entre ontologias na˜o
va˜o ale´m das capacidades de representac¸a˜o do framework;</p>
      <p>Esta resposta leva para a decisa˜o 4.
4. Acesso a Dados Locais:
(a) Na˜o existem ontologias legadas, mas as ontologias das fontes de dados
poderiam ser geradas automaticamente se existisse uma estrutura relacional
dos dados. Como na˜o houve acesso a essa estrutura foi necessa´rio recria´-la
e adapta´-la manualmente;
(b) Foi entendido que era importante preservar a estrutura local das
ontologias que representam diretamente o esquema das bases de dados. Afinal,
muitos profissionais utilizam as fontes de dados com a estrutura original,
embora, historicamente essa estrutura seja restrita a eventos, na˜o
modelando bem o dom´ınio;
Com essas respostas houve um impasse, sendo um ponto positivo para a escolha
da soluc¸a˜o ODBI H´ıbrido e outro para seguir na a´rvore de recomendac¸a˜o. Foi
decidido enta˜o por seguir na a´rvore.
5. Dinamicidade das Fontes de Dados:
(a) A quantidade de mapeamentos entre as fontes de dados e´ alta;
(b) A adic¸ a˜o de novas fontes de dados e´ importante para os pr o´ximos passos
do projeto.</p>
      <p>Ao responder este passo a recomendac¸a˜o foi de seguir a abordagem OBDI GAV.</p>
      <p>
        No entanto, apesar das indicac¸ o˜es, foi necessa´rio realizar ajustes na
arquitetura, adicionando mais uma camada de ontologias, a fim de auxiliar no processo
de harmonizac¸a˜o de vocabula´rios e de integrac¸a˜o dos dados, como apresentado em
[
        <xref ref-type="bibr" rid="ref11">Pinheiro 2011</xref>
        ]. Isso tambe´m ocorreu devido ao tamanho e complexidade das fontes
de dados. Desse modo, levando em considerac¸ a˜o o impasse na a´rvore de recomendac¸a˜o,
a metodologia desenvolvida e´ uma combinac¸a˜o entre as metodologias OBDI H´ıbrido e
OBDI GAV, como apresentado na Figura 2. Ela apresenta o diagrama das suas
abordagens originais e os compara com o diagrama da abordagem desenvolvida. As setas
vazadas apontam as camadas similares entre as abordagens. Ao considerar a abordagem
desenvolvida como h´ıbrida, nota-se a similaridade entre o Vocabula´rio Compartilhado (V)
e a Ontologia de Dom´ınio (OD) e em como seus vocabula´rios sa˜o herdados pela camada
inferior de ontologias. No entanto, na abordagem desenvolvida ha´ a adic¸a˜o da camada
de ontologias sobre as fontes de dados, cujo vocabula´rio e´ independente da ontologia de
dom´ınio, caracter´ıstica da abordagem GAV. Por outro lado, ao considera´-la como parte
da GAV, a adic¸a˜o da camada de ontologias de integrac¸a˜o (In) que tem como vocabula´rio
base a ontologia de dom´ınio, a difere da arquitetura usual.
      </p>
      <p>Figura 2. Comparac¸ a˜ o entre a abordagem de OBDI desenvolvida e as abordagens
h´ıdrida e GAV. As setas vazadas indicam as camadas equivalentes nas
abordagens.</p>
      <p>
        Assim, a arquitetura que compo˜ e a soluc¸a˜o proposta possui as seguintes camadas,
apresentadas na Figura 2 como “Abordagem Desenvolvida”e detalhada na Figura 3:
Camada de Fontes de Dados: que recebe diversos formatos de dados
materializados ou virtualizados, integrados ou na˜o. No estudo de caso, as fontes utilizadas
foram os dados pu´ blicos na˜o integrados do SINASC e do SIM e os dados ja´
integrados do SINASC e do SIM num arquivo nomeado DNDO, fornecido pela
SMS-SP;
Camada de ontologias de Fonte (OF)4: constru´ıda a partir da replicac¸a˜o do
vocabula´rio das fontes de dados. Essa camada auxilia na harmonizac¸a˜o dos formatos de
dados de entrada do sistema de integrac¸a˜o, gerando ontologias que podem ser
reutilizadas em outros contextos. Foram criadas as ontologias OFSINASC , OFSIM
e OFDNDO, cada uma originada da fonte de dados correspondente;
Camada de Ontologias de Integrac¸a˜o (OI)5: criada para realizar a integrac¸a˜o do
vocabula´rio contido nas camadas OF e OD, apresentando relac¸ o˜es entre os
vocabula´rios. Ela conte´m o vocabula´rio da camada OD distribu´ıdo em suas ontologias
e mapeia os conceitos correspondentes da camada OF para a OD. Nela tambe´m sa˜o
4Sobre a camada de Ontologias de Fonte: Considerando a similaridade com a abordagem GAV,
no trabalho de [
        <xref ref-type="bibr" rid="ref5">Ekaputra et al. 2017</xref>
        ] essa camada e´ chamada de camada de ontologias locais. Ja´ em
[
        <xref ref-type="bibr" rid="ref15">Vidal et al. 2015</xref>
        ] essa camada e´ chamada de camada de dados
      </p>
      <p>
        5Sobre a camada de Ontologias de Integrac¸a˜o: Em [
        <xref ref-type="bibr" rid="ref15">Vidal et al. 2015</xref>
        ] essa camada e´ chamada de camada
de viso˜es Exportadas e Links Semaˆnticos. Em [
        <xref ref-type="bibr" rid="ref3">da Cruz et al. 2019</xref>
        ] os autores nomeiam de camada de
ontologias locais e em [
        <xref ref-type="bibr" rid="ref1">Barisevicˇius et al. 2018</xref>
        ] de camada de base de conhecimento. Ao considerar essa
abordagem como h´ıbrida, parte do que ocorre na camada OI e´ similar ao que ocorre na camada de ontologias
locais, de [
        <xref ref-type="bibr" rid="ref5">Ekaputra et al. 2017</xref>
        ]
estabelecidas as relac¸o˜es de similaridade entre conceitos (sinoˆnimos como os
conceitos gravidez e gestac¸ a˜o) e entre entidades (estabelecimento da mesma entidade
paciente em fontes de dados distintas). As ontologias criadas foram: OISINASC ,
OISIM , OIDNDO;
Camada de Ontologia de Dom´ınio (OD)6: e´ a camada ontolo´gica que estabelece
o vocabula´rio para uma determinada aplicac¸a˜o, onde as consultas sa˜o realizadas,
sendo composta por uma u´nica ontologia. Foi criada a ontologia ODSMI ,
relacionada ao dom´ınio da sau´de materno-infantil;
Camada de Acesso a`s Aplicac¸ o˜es, porta para o acesso aos resultados das consultas
realizadas nas camadas OD e na OF.
      </p>
      <p>Figura 3. Arquitetura da solu c¸a˜ o OBDI desenvolvida.</p>
      <p>A Figura 3 tambe´m conte´m a arquitetura da soluc¸ a˜o. A imagem de pilha
corresponde a`s fontes de dados; o ´ıcone de nuvem, a`s ontologias, nomeadas de acordo com
suas camadas correspondentes OX1 ate´ OXN ; os arcos, indicam a presenc¸a do mesmo
elemento entre ontologias; e as setas, nomeadas de acordo com a origem e o destino
do mapeamento MOrigem Destino, representando a direc¸a˜o do mapeamento dos conceitos
nas ontologias. A mesma gravura ainda apresenta a ordem de criac¸a˜o de cada camada,
ilustrada pelos passos ordenados, e se a camada e´ dependente ou independente de uma
aplicac¸a˜o espec´ıfica. A parte independente da aplicac¸a˜o pode ser reutilizada em outros
contextos enquanto que a dependente possui vocabula´rio pro´ximo ao dom´ınio (no estudo
de caso ao de sau´de materno-infantil no contexto do indicador DPGP) tornando-se mais
especializada.</p>
    </sec>
    <sec id="sec-3">
      <title>3. Desenvolvimento das ontologias e mapeamentos independentes da</title>
      <p>
        aplicac¸a˜ o
Essa sec¸ a˜o apresenta o desenvolvimento das ontologias da camada de Ontologias de Fonte
(OF) e a caracterizac¸a˜o e mapeamentos das fontes de dados para as ontologias dessa
6Sobre camada de Ontologia de Dom´ınio: Em [
        <xref ref-type="bibr" rid="ref15">Vidal et al. 2015</xref>
        ] essa camada e´ chamada de camada de
Integrac¸a˜o Semaˆntica. Em [
        <xref ref-type="bibr" rid="ref3">da Cruz et al. 2019</xref>
        ], os autores nomeiam de camada de ontologia de dom´ınio e
em [
        <xref ref-type="bibr" rid="ref5">Ekaputra et al. 2017</xref>
        ] de camada ontolo´gica global. Ja´ em [
        <xref ref-type="bibr" rid="ref1">Barisevicˇius et al. 2018</xref>
        ] a camada e´ referida
como camada da ontologia de alto n´ıvel - upper level ontology
camada. As fontes de dados dispon´ıveis para o desenvolvimento da soluc¸a˜o estavam
em formato de planilha eletroˆnica. No entanto, foi constatado que estas ja´ possu´ıram
uma estrutura de dados relacional e que os dados eram capturados a partir de fichas de
preenchimento (Declarac¸a˜o de Nascido Vivo - DN, para o SINASC e Declarac¸a˜o de O´bito
- DO para o SIM) com campos agrupados em blocos tema´ticos.
      </p>
      <p>
        Diante desse histo´rico, a construc¸a˜o das ontologias de fonte, OFSINASC e
OFSIM , seguiu o algoritimo de conversa˜o de bases de dado relacionais em ontologias,
de [
        <xref ref-type="bibr" rid="ref8">Haw et al. 2017</xref>
        ]. Para isso, o diagrama entidade relacionamento - DER das fontes
de dados foi reconstru´ıdo, tendo como base os blocos das fichas de preenchimento. Cada
bloco foi traduzido como uma entidade no DER e posteriormente, uma classe na
ontologia. Cada varia´vel presente nos blocos foi convertida em um atributo no DER e uma
propriedade de dados, na ontologia.
      </p>
      <p>A Figura 4 apresenta o bloco da DN referente a` gestac¸a˜o e parto, a classe
correspondente na ontologia OFSINASC , e as propriedades de dados relacionadas a essa classe.
A partir dos DERs foram criados os primeiros diagramas que representavam os conceitos
e as relac¸o˜es que estariam presentes nas ontologias da camada OF, sendo considerado a
primeira versa˜o das classes e propriedades das ontologias. Esses diagramas tambe´m
serviram para apresentar o fluxo de conceitos presente nos dados. O recorte do diagrama
contendo a classe Gestac¸a˜oEParto e´ apresentado na Figura 5.</p>
      <p>Figura 4. Convers a˜o de um bloco da ficha de preenchimento do SINASC para
uma classe na ontologia OFSINASC.</p>
      <p>O desenvolvimento da ontologia OFDNDO, no entanto, baseou-se na importac¸ a˜o
das ontologias OFSINASC e OFSIM e na adic¸a˜o e modificac¸a˜o de alguns conceitos.
A DNDO foi utilizada para materializar os dados linkados, dado que na˜o foi poss´ıvel
efetuar o linkage com os dados anonimizados. Os dados da DNDO vieram da parceria
Figura 5. Recorte do diagrama com conceitos e relac¸ o˜ es correspondentes a
ontologia OFSINASC, apresenta c¸a˜ o da classe GestacaoEParto.
com a SMS-SP, que os forneceu por meio de uma planilha com a integrac¸ a˜o das bases de
dados do SINASC e do SIM e a adic¸a˜o de algumas varia´veis com a conversa˜o de valores
que eram mais interessantes para o projeto. Haviam duas opc¸ o˜es para a utilizac¸a˜o dos
dados da DNDO, modificar as ontologias do OFSINASC e OFSIM com as converso˜es
realizadas ou enta˜o, o que foi escolhido, criar uma nova ontologia e assim testar o uso de
uma ontologia ja´ com dados integrados.</p>
      <p>A abordagem apresentada supo˜e que o processo de linkage pode ocorrer
previamente (como a DNDO) ou durante o processo de integrac¸a˜o, desde que haja um
identificador u´nico correspondente em ambas as fontes de dados. Isso dependera´ de como
as fontes de dados esta˜o estruturadas. Caso as fontes tenham passado pelo processo de
linkage, como a DNDO, resta executar a integrac¸a˜o semaˆntica. Caso na˜o, mas exista um
identificador comum, e´ poss´ıvel efetuar a integrac¸a˜o combinada, realizada na camada OI.
Para atestar isso, foi decidido por apresentar as duas possibilidades. Enta˜o, na camada OF
foram criadas treˆs ontologias ( OFSINASC , OFSIM , com expressividade ALCHI(D) e
OFDNDO, com ALU I(D)), respectivamente correspondentes a`s bases de dados SINASC,
SIM e DNDO.</p>
      <p>Os mapeamentos das bases de dados para as ontologias foram realizados
utilizando o plugin Ontop7, para Prote´ge´8. Em seguida as ontologias foram povoadas e foram
realizadas consultas para testar sua consisteˆncia. Estas ontologias foram avaliadas com
7Plugin Ontop: https://github.com/ontop
8Aplicativo utilizado para a construc¸a˜o das ontologias: https://protege.stanford.edu/
um raciocinador e pelo algoritmo do OOPS!9 Os arquivos relativos a`s ontologias foram
disponibilizados num reposit o´rio online10. Essas ontologias podem ser reutilizadas, uma
vez que possuem o vocabula´rio original das fontes de dados SINASC e SIM e sa˜o
independentes do contexto de sa u´de materno-infantil.</p>
    </sec>
    <sec id="sec-4">
      <title>4. Desenvolvimento das ontologias e mapeamentos dependentes da aplicac¸a˜ o</title>
      <p>Esse bloco da soluc¸a˜o apresenta as ontologias e os mapeamentos que sa˜o dependentes da
aplicac¸a˜o e que assim foram desenvolvidos a partir das quest o˜es de competeˆncias
elencadas pelos especialistas do dom´ınio pensando na sau´ de materno-infantil e na produc¸a˜o do
indicador de sa u´de DPGP. Fazem parte desta etapa o desenvolvimento das ontologias das
camadas OD e OI, assim como seus devidos mapeamentos.</p>
      <p>O desenvolvimento da ontologia da camada OD seguiu a metodologia apresentada
em [Gr u¨ninger and Fox 1995] e resultou na ontologia ODSMI - ontologia de dom´ınio da
sa u´de materno-infantil, com expressividade SRI(D). Foram realizadas reunio˜ es com os
20 especialistas que definiram 58 questo˜ es de competeˆncias11 que a soluc¸ a˜o de integrac¸ a˜o
deveria responder por meio da ontologia da camada OD. Esta ontologia recebeu todos os
conceitos dessas questo˜ es de competeˆncia, no entanto apenas 20 delas sa˜o respondidas
com os dados do SINASC e do SIM. As quest o˜es foram enta˜o agrupadas por n´ıvel de
dificuldade para respondeˆ-las. Ha´ aquelas que:
1. Podem ser respondidas de um u´ nico modo e que necessitam de:
(a) Uma varia´vel de apenas uma base, como: Qual o peso ao nascer do rece´m
nascido X?
(b) Mais de uma varia´vel da mesma base, geralmente numa apresentac¸a˜o que
remodela os dados, como: Quais foram as causas do o´ bito materno na
usua´ria Y?
(c) Mais de uma varia´vel de mais de uma base, como: Quais foram os
registros de o´bitos de rece´m nascidos no SIM que teˆm registro de anomalia
congeˆnita na base de dados do SINASC?
2. Podem ser respondidas de diversos modos pois a mesma informac¸ a˜o esta´
localizada em mais de uma base de dados, assim, pode conter ate´ as treˆs subdivis o˜es
descritas no modo 1. Como em: Houve aborto ou perdas fetais antes desta gestac¸a˜o?
Onde o resultado pode ser encontrado tanto na base de dados do SINASC quanto
do SIM.</p>
      <p>Essas questo˜ es foram estudadas e tiveram seus conceitos mapeados e
transformados em classes e propriedades na ontologia da camada OD. Para isso foi desenvolvido o
mesmo tipo de diagrama com conceitos e relac¸ o˜es apresentado nas ontologias da camada
OF e exemplificado pela Figura 5. Uma vez desenvolvida a ontologia, esta, assim como as
ontologias da OF, foi avaliada com um raciocinador e pelo algoritmo do OOPS! e depois
foram realizadas as consultas derivadas das quest o˜es de competeˆncia, tais como a questa˜o
apresentada a seguir. As respostas foram revisadas pelos especialistas que concordaram
com o racioc´ınio apresentado.</p>
      <p>9OOPS! OntOlogy Pitfall Scanner! http://oops.linkeddata.es/
10Reposito´rio que conte´m as ontologias e os diagramas citados: https://gitlab.com/
beliefchangetools/diasus
11A lista completa das questo˜es de competeˆncia tambe´m esta´ dispon´ıvel no reposito´rio do projeto.</p>
      <p>A questa˜o de competeˆncia sobre Nascido Vivo, ”Houve o´bito de algum rece´m
nascido que tem registro de anomalia congeˆnita no SINASC? Apresentar o rece´m nascido,
o nu´mero da declarac¸ a˜o de nascido vivo, o nu´mero da declarac¸a˜o de o´bito e o co´digo da
anomalia congeˆnita” tem seu resultado apresentado na Figura 6, tendo sido realizada a
partir da ontologia ODSMI .</p>
      <p>Figura 6. Resposta da quest a˜o de competeˆ ncia sobre o´ bito de rece´ m nascido
com diagn o´stico de anomalia congeˆ nita no SINASC, ontologia ODSMI</p>
      <p>A Figura 7 apresenta o caminho percorrido atrave´s das ontologias para responder
a` questa˜o de competeˆncia Nascido Vivo. Nela, Ob. significa O´bito; RN, rece´m nascido
vivo; e ACon, Anomalia Congeˆnita. A solicitac¸a˜o da consulta e´ recebida pela ODSMI
que passa a consulta para a camada de integrac¸a˜o que a particionara´ de acordo com os
conceitos presentes em cada uma das ontologias. Tambe´m e´ nessa camada que os
conceitos similares sa˜o mapeados e integrados. Enta˜o a solicitac¸a˜o da consulta segue para
a camada de ontologias de fonte que mapeara´ os conceitos nas fontes de dados. Essas
retornara˜o a consulta com o resultado. A resposta da consulta seguira´ o caminho inverso,
sendo apresentado em cada uma das camadas e verificado na transic¸ a˜o da camada de
integrac¸a˜o para a de dom´ınio.</p>
      <p>As ontologias da camada OI integram as fontes de dados (ontologias da camada
OF) e os conceitos presentes nas questo˜es de competeˆncia (ontologia da camada OD).
Assim, a construc¸a˜o dessas ontologias depende da compreensa˜o da presenc¸a e estrutura
dos dados nas ontologias de fonte e de como o conhecimento esta´ representado na
ontologia de dom´ınio. Foram desenvolvidas treˆs ontologias ( OISINASC , OISIM , OIDNDO,
com expressividade SRI(D)), ambas possuem o vocabula´rio da ontologia ODSMI ,
assim essa ontologia foi importada em cada uma delas. Em seguida os conceitos presentes
na ontologia ODSMI foram agrupados de acordo com os conceitos presentes em cada
uma das ontologias da camada OF. Nessas etapas foram identificadas as diferenc¸as e
similaridades de vocabula´rio das fontes de dados e este foi harmonizado com o vocabula´rio
adotado na ontologia da camada OD. Os mapeamentos relacionados a camada OI foram
realizados no n´ıvel conceitual. Assim, a implementac¸a˜o do acesso aos conceitos e dados
entre as camadas de ontologia sera˜o realizados num segundo momento do projeto.</p>
    </sec>
    <sec id="sec-5">
      <title>5. Considerac¸ o˜es finais</title>
      <p>Durante o processo de desenvolvimento da soluc¸a˜o, houve a compreensa˜o do esforc¸o
semaˆntico necessa´rio para a interpretac¸a˜o dos dados e das relac¸o˜es entre os conceitos por
parte dos profissionais da SMS-SP e da FSP-USP. Foi apresentada tambe´m uma visa˜o
geral dos conceitos relacionados a`s duas fontes de dados, mostrando o fluxograma dos
Figura 7. Diagrama representando o caminho percorrido para responder a`
questa˜ o de competeˆ ncia Houve o´bito de algum rece´ m nascido que tem
registro de anomalia congeˆ nita no SINASC?
dados e como eles sa˜o interpretados. Por fim, as bases que ja´ eram pu´blicas, referentes ao
munic´ıpio de Sa˜o Paulo no ano de 2015, foram remodeladas e tambe´m disponibilizadas
em formato de dados abertos, junto com as ontologias do modelo e os mapeamentos entre
as camadas de ontologia da soluc¸a˜o.</p>
      <p>Este trabalho elegeu uma metodologia e arquitetura de integrac¸a˜o semaˆntica
compat´ıvel com os dados do SUS, favorecendo futuras integrac¸o˜es de outras bases de dados
do Sistema. Assim, e´ esperado que as ontologias, do mesmo modo, possam ser
reutilizadas por outras iniciativas e seu uso estendido para ale´m dos dados do munic´ıpio de Sa˜o
Paulo, uma vez que todos os munic´ıpios brasileiros possuem o mesmo formato de dados.
A maior expectativa e´ de que Secretarias Municipais e Estaduais da Sau´de do pa´ıs tenham
acesso a esses mapeamentos, uma vez que possuem os dados identificados, tornando o
processo de integrac¸a˜o poss´ıvel. No entanto, pesquisadores fora dessa esfera tambe´m
podem fazer uso desse conhecimento para compreenderem os conteu´dos das bases de dados
e como eles se relacionam.</p>
      <p>Como trabalho futuro, planeja-se modelar e adicionar, nas ontologias, os
metadados presentes nas bases de dados do SINASC e SIM, tais como Co´digo Brasileiro
de Ocupac¸ o˜es - CBO e o Co´digo Internacional de Doenc¸as - CID. Sera´ tambe´m feita
a implementac¸a˜o das interfaces entre as camadas das ontologias. Pretende-se ainda,
utilizar os dados integrados e o conhecimento inferido para gerar dados para o projeto do
indicador de Dias Potenciais de Gravidez Perdidos. A me´dio prazo, sera´ feita a adic¸a˜o
de novas bases de dados, como a de internac¸o˜es hospitalares - SIH. Tambe´m ocorrera´ a
integrac¸a˜o da soluc¸a˜o desenvolvida com visualizadores de dados.</p>
    </sec>
    <sec id="sec-6">
      <title>Refereˆncias</title>
      <p>(2015). Sistemas de Informac¸a˜o da Atenc¸a˜o a` Sau´de: Contextos Histo´ricos, Avanc¸os
e Perspectivas no SUS. Brasil, Ministe´rio da Sau´de, Secretaria de Atenc¸a˜o a Sau´de,
Departamento de Regulac¸a˜o, Avaliac¸a˜o e Controle.</p>
    </sec>
  </body>
  <back>
    <ref-list>
      <ref id="ref1">
        <mixed-citation>
          <string-name>
            <surname>Barisevicˇius</surname>
            ,
            <given-names>G.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Coste</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Geleta</surname>
            ,
            <given-names>D.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Juric</surname>
            ,
            <given-names>D.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Khodadadi</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Stoilos</surname>
            ,
            <given-names>G.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Zaihrayeu</surname>
            ,
            <given-names>I.</given-names>
          </string-name>
          (
          <year>2018</year>
          ).
          <article-title>Supporting digital healthcare services using semantic web technologies</article-title>
          .
          <source>In International Semantic Web Conference</source>
          , pages
          <fpage>291</fpage>
          -
          <lpage>306</lpage>
          . Springer.
        </mixed-citation>
      </ref>
      <ref id="ref2">
        <mixed-citation>
          <string-name>
            <surname>Bauer</surname>
            ,
            <given-names>C.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Ganslandt</surname>
            ,
            <given-names>T.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Baum</surname>
            ,
            <given-names>B.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Christoph</surname>
            ,
            <given-names>J.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Engel</surname>
            ,
            <given-names>I.</given-names>
          </string-name>
          , Lo¨be, M.,
          <string-name>
            <surname>Mate</surname>
            ,
            <given-names>S.</given-names>
          </string-name>
          , Sta¨ubert,
          <string-name>
            <given-names>S.</given-names>
            ,
            <surname>Drepper</surname>
          </string-name>
          ,
          <string-name>
            <given-names>J.</given-names>
            ,
            <surname>Prokosch</surname>
          </string-name>
          , H.-U.,
          <string-name>
            <surname>Winter</surname>
            ,
            <given-names>A.</given-names>
          </string-name>
          , and U, S. (
          <year>2016</year>
          ).
          <article-title>Integrated data repository toolkit (IDRT). A suite of programs to facilitate health analytics on heterogeneous medical data</article-title>
          .
          <source>Methods of information in medicine</source>
          ,
          <volume>55</volume>
          (
          <issue>02</issue>
          ):
          <fpage>125</fpage>
          -
          <lpage>135</lpage>
          .
        </mixed-citation>
      </ref>
      <ref id="ref3">
        <mixed-citation>
          <string-name>
            <surname>da Cruz</surname>
            ,
            <given-names>M. M. L.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Avila</surname>
            ,
            <given-names>C. V. S.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Vidal</surname>
            ,
            <given-names>V. M. P.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Junior</surname>
            ,
            <given-names>N. M. A.</given-names>
          </string-name>
          (
          <year>2019</year>
          ).
          <article-title>Semanticsus: Um portal semaˆntico baseado em ontologias e dados interligados para acesso, integrac¸a˜o e visualizac¸ a˜o de dados do sus. In Anais Estendidos do XIX Simpo´sio Brasileiro de Computac¸a˜o Aplicada a</article-title>
          ` Sau´de, pages
          <fpage>13</fpage>
          -
          <lpage>18</lpage>
          . SBC.
        </mixed-citation>
      </ref>
      <ref id="ref4">
        <mixed-citation>
          <string-name>
            <surname>Diniz</surname>
            ,
            <given-names>C.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Reis-Queiroz</surname>
            ,
            <given-names>J.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Kawai</surname>
            ,
            <given-names>C.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Queiroz</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Bonilha</surname>
            ,
            <given-names>E.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Niy</surname>
            ,
            <given-names>D.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Sena</surname>
            ,
            <given-names>B.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Lansky</surname>
            ,
            <given-names>S.</given-names>
          </string-name>
          (
          <year>2019</year>
          ).
          <article-title>“Dias potenciais de gravidez perdidos” (DPGP): uma medida inovadora da idade gestacional</article-title>
          . Revista de Sau´de Pu´blica. No prelo.
        </mixed-citation>
      </ref>
      <ref id="ref5">
        <mixed-citation>
          <string-name>
            <surname>Ekaputra</surname>
            ,
            <given-names>F. J.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Sabou</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Serral</surname>
            ,
            <given-names>E.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Kiesling</surname>
            ,
            <given-names>E.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Biffl</surname>
            ,
            <given-names>S.</given-names>
          </string-name>
          (
          <year>2017</year>
          ).
          <article-title>Ontology-based data integration in multi-disciplinary engineering environments: A review</article-title>
          .
          <source>Open Journal of Information Systems (OJIS)</source>
          ,
          <volume>4</volume>
          (
          <issue>1</issue>
          ):
          <fpage>1</fpage>
          -
          <lpage>26</lpage>
          .
        </mixed-citation>
      </ref>
      <ref id="ref6">
        <mixed-citation>
          <string-name>
            <surname>Ferronato</surname>
            ,
            <given-names>A. C. C.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Pires</surname>
            ,
            <given-names>F. R.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Bernardini</surname>
            ,
            <given-names>F. C.</given-names>
          </string-name>
          (
          <year>2016</year>
          ).
          <article-title>Um modelo para integrac¸a˜o e disponibilizac¸a˜o de dados na a´rea de sau´de governamental</article-title>
          . In Anais do XII Simpo´sio Brasileiro de Sistemas de Informac¸a˜o, pages
          <fpage>124</fpage>
          -
          <lpage>127</lpage>
          .
        </mixed-citation>
      </ref>
      <ref id="ref7">
        <mixed-citation>
          <article-title>Gru¨ninger, M. and</article-title>
          <string-name>
            <surname>Fox</surname>
            ,
            <given-names>M. S.</given-names>
          </string-name>
          (
          <year>1995</year>
          ).
          <article-title>Methodology for the design and evaluation of ontologies</article-title>
          .
          <source>Proceedings of IJCAI'95.</source>
        </mixed-citation>
      </ref>
      <ref id="ref8">
        <mixed-citation>
          <string-name>
            <surname>Haw</surname>
          </string-name>
          , S.-C.,
          <string-name>
            <surname>May</surname>
            ,
            <given-names>J. W.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Subramaniam</surname>
            ,
            <given-names>S.</given-names>
          </string-name>
          (
          <year>2017</year>
          ).
          <article-title>Mapping relational databases to ontology representation: A review</article-title>
          .
          <source>In Proceedings of the International Conference on Digital Technology in Education</source>
          , pages
          <fpage>54</fpage>
          -
          <lpage>58</lpage>
          . ACM.
        </mixed-citation>
      </ref>
      <ref id="ref9">
        <mixed-citation>
          <string-name>
            <surname>Lopes</surname>
            ,
            <given-names>G.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Vidal</surname>
            ,
            <given-names>V.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Oliveira</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          (
          <year>2016</year>
          ).
          <article-title>A framework for creation of linked data mashups: A case study on healthcare</article-title>
          .
          <source>In Proceedings of the 22nd Brazilian Symposium on Multimedia and the Web</source>
          , pages
          <fpage>327</fpage>
          -
          <lpage>330</lpage>
          . ACM.
        </mixed-citation>
      </ref>
      <ref id="ref10">
        <mixed-citation>
          <string-name>
            <surname>Pereira</surname>
            ,
            <given-names>D. L. N. C.</given-names>
          </string-name>
          (
          <year>2019</year>
          ).
          <article-title>Integrac¸ a˜o semaˆntica das bases</article-title>
          de dados do Sistema U´nico de Sau´de: um estudo de caso com o munic´ıpio de Sa˜o Paulo.
          <source>Master's thesis</source>
          , Universidade de Sa˜o Paulo.
        </mixed-citation>
      </ref>
      <ref id="ref11">
        <mixed-citation>
          <string-name>
            <surname>Pinheiro</surname>
            ,
            <given-names>J. C.</given-names>
          </string-name>
          (
          <year>2011</year>
          ).
          <article-title>Processamento de consulta em um framework baseado em mediador para integrac¸a˜o de dados no padra˜o de Linked Data</article-title>
          .
          <source>PhD thesis</source>
          , Universidade Federal do Ceara´, Fortaleza - CE.
        </mixed-citation>
      </ref>
      <ref id="ref12">
        <mixed-citation>
          <string-name>
            <surname>Ristoski</surname>
            ,
            <given-names>P.</given-names>
          </string-name>
          and
          <string-name>
            <surname>Paulheim</surname>
            ,
            <given-names>H.</given-names>
          </string-name>
          (
          <year>2016</year>
          ).
          <article-title>Semantic web in data mining and knowledge discovery</article-title>
          .
          <source>Journal of Web Semantics</source>
          , 36(C):
          <fpage>1</fpage>
          -
          <lpage>22</lpage>
          .
        </mixed-citation>
      </ref>
      <ref id="ref13">
        <mixed-citation>
          <string-name>
            <surname>Stoilos</surname>
            ,
            <given-names>G.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Geleta</surname>
            ,
            <given-names>D.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Shamdasani</surname>
            ,
            <given-names>J.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Khodadadi</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          (
          <year>2018a</year>
          ).
          <article-title>A novel approach and practical algorithms for ontology integration</article-title>
          .
          <source>In International Semantic Web Conference</source>
          , pages
          <fpage>458</fpage>
          -
          <lpage>476</lpage>
          . Springer.
        </mixed-citation>
      </ref>
      <ref id="ref14">
        <mixed-citation>
          <string-name>
            <surname>Stoilos</surname>
            ,
            <given-names>G.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Geleta</surname>
            ,
            <given-names>D.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Wartak</surname>
            ,
            <given-names>S.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Hall</surname>
            ,
            <given-names>S.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Khodadadi</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Zhao</surname>
            ,
            <given-names>Y.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Alghamdi</surname>
            ,
            <given-names>G.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Schmidt</surname>
            ,
            <given-names>R. A.</given-names>
          </string-name>
          (
          <year>2018b</year>
          ).
          <article-title>Methods and metrics for knowledge base engineering and integration</article-title>
          .
          <source>In WOP@ ISWC</source>
          , pages
          <fpage>72</fpage>
          -
          <lpage>86</lpage>
          .
        </mixed-citation>
      </ref>
      <ref id="ref15">
        <mixed-citation>
          <string-name>
            <surname>Vidal</surname>
            ,
            <given-names>V. M.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Casanova</surname>
            ,
            <given-names>M. A.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Arruda</surname>
            ,
            <given-names>N.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Roberval</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Leme</surname>
            ,
            <given-names>L. P.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Lopes</surname>
            ,
            <given-names>G. R.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Renso</surname>
            ,
            <given-names>C.</given-names>
          </string-name>
          (
          <year>2015</year>
          ).
          <article-title>Specification and incremental maintenance of linked data mashup views</article-title>
          .
          <source>In International Conference on Advanced Information Systems Engineering</source>
          , pages
          <fpage>214</fpage>
          -
          <lpage>229</lpage>
          . Springer.
        </mixed-citation>
      </ref>
      <ref id="ref16">
        <mixed-citation>
          <string-name>
            <surname>Wache</surname>
            ,
            <given-names>H.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Voegele</surname>
            ,
            <given-names>T.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Visser</surname>
            ,
            <given-names>U.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Stuckenschmidt</surname>
            ,
            <given-names>H.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Schuster</surname>
            ,
            <given-names>G.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Neumann</surname>
            ,
            <given-names>H.</given-names>
          </string-name>
          , and Hu¨bner,
          <string-name>
            <surname>S.</surname>
          </string-name>
          (
          <year>2001</year>
          ).
          <article-title>Ontology-based integration of information - a survey of existing approaches</article-title>
          .
          <source>In IJCAI-01 workshop: ontologies and information sharing</source>
          , volume
          <volume>2001</volume>
          , pages
          <fpage>108</fpage>
          -
          <lpage>117</lpage>
          . Citeseer.
        </mixed-citation>
      </ref>
      <ref id="ref17">
        <mixed-citation>
          <string-name>
            <surname>Zhang</surname>
            ,
            <given-names>X.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Hu</surname>
            ,
            <given-names>C.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Zhao</surname>
            ,
            <given-names>Q.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Zhao</surname>
            ,
            <given-names>C.</given-names>
          </string-name>
          (
          <year>2007</year>
          ).
          <article-title>Semantic data integration in materials science based on semantic model</article-title>
          .
          <source>In Third IEEE International Conference on e-Science and Grid Computing (e-Science</source>
          <year>2007</year>
          ), pages
          <fpage>320</fpage>
          -
          <lpage>327</lpage>
          .
        </mixed-citation>
      </ref>
    </ref-list>
  </back>
</article>