<!DOCTYPE article PUBLIC "-//NLM//DTD JATS (Z39.96) Journal Archiving and Interchange DTD v1.0 20120330//EN" "JATS-archivearticle1.dtd">
<article xmlns:xlink="http://www.w3.org/1999/xlink">
  <front>
    <journal-meta />
    <article-meta>
      <title-group>
        <article-title>Abordagens para Estimar Relev aˆncia de Relac¸ o˜es N a˜o-Taxon oˆmicas Extra´ıdas de Corpus de Dom´ınio</article-title>
      </title-group>
      <contrib-group>
        <contrib contrib-type="author">
          <string-name>Lucelene Lopes</string-name>
        </contrib>
        <contrib contrib-type="author">
          <string-name>Maria Jose´ Finatto</string-name>
        </contrib>
        <contrib contrib-type="author">
          <string-name>Alena Ciulla</string-name>
        </contrib>
        <contrib contrib-type="author">
          <string-name>Renata Vieira</string-name>
        </contrib>
      </contrib-group>
      <abstract>
        <p>This paper performs a comparison between two approaches to weight the relevance of extracted non-taxonomic relations found in domain corpora. The first approach computes the relevance according to the verb absolute frequency. The second approach computes the relevance according to the verb frequency and uniqueness in each corpus using tf-dcf relevance index, an index that takes into account the high frequency of verbs in the target corpus, and the low frequency in contrasting corpora. The preliminary results are evaluated for three domain corpora and the top relevant relations are evaluated by expert terminologists. Resumo. Este artigo apresenta uma comparac¸ a˜o entre duas abordagens de ponderac¸a˜o de relevaˆncia de relac¸ o˜es na˜o-taxonoˆmicas extra´ıdas de corpora de dom´ınio. A primeira abordagem calcula a relevaˆncia de acordo com a frequeˆncia absoluta dos verbos. A segunda abordagem calcula a relevaˆncia de acordo com a frequeˆncia do verbo e sua especificidade em cada corpus utilizando o ´ındice de relevaˆncia tf-dcf, um ´ındice que leva em considerac¸ a˜o a alta frequeˆncia no corpus alvo, e a baixa frequeˆncia em corpora contrastantes. Os resultados preliminares foram avaliados para treˆs corpora de dom´ınio e as relac¸o˜es mais relevantes foram avaliadas por terminologistas.</p>
      </abstract>
    </article-meta>
  </front>
  <body>
    <sec id="sec-1">
      <title>-</title>
      <p>O estudo e a descric¸a˜o dos verbos do portugueˆs do Brasil (PB) sa˜o elementos
importantes no aˆmbito dos Estudos da Linguagem, visto que, entre outros elementos da
linguagem escrita, sa˜o elementos vitais para subsidiar uma se´rie de recursos de representac¸a˜o
e de recuperac¸a˜o de informac¸a˜o com apoio computacional a partir de acervos
documentais. Afinal, os verbos, ale´m do papel fundamental para o funcionamento gramatical de
qualquer l´ıngua, oferecem via predicac¸a˜o, elementos para a representac¸ a˜o de diferentes
relac¸ o˜es na˜o-taxonoˆmicas, que extrapolam relac¸ o˜es hiera´rquicas do tipo parte-todo. Os
elementos relacionados assim pelos verbos podem corresponder a termos ou a conceitos
de um dom´ınio.</p>
      <p>
        Um exemplo dessa importaˆncia do verbo, para a depreensa˜o de relac¸o˜es entre itens
de uma ontologia ou mapa conceitual e´ a expressa˜o da relac¸ a˜o na˜o-taxonoˆmica do tipo
“X causa Y” que se depreende, por exemplo, nas seguintes frases: (1) Tabagismo causa
caˆncer./ (2) Tabagismo pode causar caˆncer de pulma˜o./ (3) Tabagismo favorece o
aparecimento de caˆncer de pulma˜o. Todavia, muitos dos trabalhos de que dispomos em PLN e
mesmo em Lingu´ıstica, tem se centrado na descric¸a˜o de estruturas sinta´ticas de verbos,
como a anotac¸a˜o de pape´is semaˆnticos ou de argumentos, que visa reconhecer padro˜es
de associac¸a˜o entre determinados sujeitos e complementos nominais e um dado tipo de
verbo [
        <xref ref-type="bibr" rid="ref8">Scarton 2013</xref>
        ,
        <xref ref-type="bibr" rid="ref11">Zilio 2015</xref>
        ], sem preocupac¸ a˜o espec´ıfica de caracterizar padro˜es de
verbos em diferentes dom´ınios.
      </p>
      <p>
        Assumindo a existeˆncia de uma forma eficiente e eficaz de recuperar
automaticamente este tipo de relac¸a˜o de um corpus de dom´ınio [
        <xref ref-type="bibr" rid="ref5 ref6">Lopes 2012</xref>
        ], o desafio e´ filtrar
dentre as relac¸o˜es extra´ıdas quais sa˜o particularmente relevantes para o dom´ınio. Na
verdade, esse tipo de detecc¸a˜o das relac¸ o˜es frequentemente mostra um nu´mero grande de
relac¸ o˜es e poucos estudos se dedicam a estabelecer uma ordem de relevaˆncia entre as
relac¸ o˜es detectadas.
      </p>
      <p>Este artigo apresenta um trabalho inicial que propo˜e uma forma alternativa de
estimar a relevaˆncia de relac¸o˜es na˜o-taxonoˆmicas de um dom´ınio baseado no contraste com
outros dom´ınios. Dessa forma, a pro´xima sec¸ a˜o apresenta a abordagem elementar que
considera a relevaˆncia dos verbos extra´ıdos pela sua frequeˆncia absoluta e a abordagem
proposta. Em seguida, a sec¸ a˜o 3 apresenta a comparac¸ a˜o destas duas abordagens sobre
treˆs corpora de dom´ınio.</p>
    </sec>
    <sec id="sec-2">
      <title>2. Abordagens de Ponderac¸ a˜o</title>
      <p>Nesta sec¸ a˜o apresenta-se a abordagem elementar que assume a frequeˆncia absoluta e a
abordagem proposta que utiliza a frequeˆncia contrastada com outros corpora como
indicador de relevaˆncia.</p>
      <sec id="sec-2-1">
        <title>2.1. Abordagem por Frequeˆncia Absoluta</title>
        <p>A primeira abordagem considerada neste trabalho toma os verbos mais frequentes como
sendo as relac¸ o˜es na˜o-taxonoˆmicas mais relevantes. Dessa forma, esse processo
analisa o corpus alvo e identifica os verbos que relacionam dois termos, ou seja, os textos
anotados sa˜o percorridos e todo verbo que conecta dois sintagmas nominais (um sujeito
e um objeto) e´ considerado uma instaˆncia de relac¸a˜o. As instaˆncias sa˜o contabilizadas,
considerando-se os verbos em sua forma canoˆnica (infinitivo), ou seja, a frequeˆncia
absoluta dos verbos e´ contabilizada, ignorando-se tempos verbais e flexo˜es de pessoa e
nu´mero.</p>
        <p>
          A vantagem dessa abordagem e´ que os verbos com maior frequeˆncia absoluta
sera˜o naturalmente mais produtivos na quantidade de relac¸o˜es geradas, pois quanto maior
o n u´mero de instaˆncias, maior o n u´mero de relac¸o˜ es a considerar. Segundo o
levantamento de um grande corpus do PB [
          <xref ref-type="bibr" rid="ref1">Biderman 1998</xref>
          ], que gerou um diciona´rio de
frequeˆncias, temos a situac¸a˜o sobre verbos mais frequentemente empregados,
independentemente de dom´ınio, conforme apresentado na tabela 1. No entanto, essa abordagem
por frequeˆncia absoluta tendera´ a privilegiar os verbos usuais semelhante aos encontrados
por [
          <xref ref-type="bibr" rid="ref1">Biderman 1998</xref>
          ].
        </p>
        <p>
          Tabela 1. Os 20 verbos lematizados no infinitivo mais frequentes no corpus de
Biderman - fonte: [
          <xref ref-type="bibr" rid="ref3">Finatto 2012</xref>
          ].
ranking verbo ranking verbo ranking verbo ranking verbo ranking
1 ser 5 poder 9 dar 13 ficar 17
2 ter 6 dizer 10 ver 14 achar 18
3 ir 7 haver 11 saber 15 dever 19
4 estar 8 fazer 12 querer 16 falar 20
verbo
chegar
precisar
comec¸ar
olhar
        </p>
      </sec>
      <sec id="sec-2-2">
        <title>2.2. Abordagem por Frequeˆncia Contrastada (tf-dcf )</title>
        <p>
          Buscando ter mais especificidade nas relac¸ o˜es a considerar, a abordagem proposta neste
trabalho baseia-se na aplicac¸a˜o do ´ındice tf-dcf (term frequency, disjoint corpora
frequency) [
          <xref ref-type="bibr" rid="ref5 ref6">Lopes et al. 2012</xref>
          ]. Este ´ındice e´ originalmente empregado para calcular a
relevaˆncia de um termo em um corpus alvo, diretamente proporcional a` frequeˆncia
absoluta do termo no corpus alvo e inversamente proporcional a sua frequeˆncia em
corpora contrastantes. Dessa forma, essa abordagem inicia contabilizando as ocorreˆncias
dos verbos no corpus alvo e em todos os corpora contrastantes. Em seguida, os valores
de frequeˆncia absoluta dos verbos sa˜o utilizados como entrada para a fo´ rmula do ´ındice
tf-dcf aplicada a verbos, em vez de termos1 (Eq. 1).
        </p>
        <p>tf-dcf(vc) =
tf(c)</p>
        <p>v
Y 1 + log 1 + tf(g)</p>
        <p>v
g2G
(1)</p>
        <p>Onde tf(vc) representa a frequeˆncia absoluta do verbo v no corpus c; e G representa
o conjunto de corpora contrastantes.</p>
      </sec>
      <sec id="sec-2-3">
        <title>3. Experimentos</title>
        <p>Para ilustrar as diferenc¸as das duas abordagens apresentadas escolhemos treˆs corpora de
dom´ınio, um sobre Geologia (Geo), um sobre Pneumopatias (Pneumo), e o Curso de
Lingu´ıstica Geral (CLG), de Ferdinand de Saussure, um texto fundamental para a a´rea de
L´ınguistica. Adicionalmente, como a abordagem baseada no ´ındice tf-dcf requer o uso de
corpora contrastantes, foram utilizados treˆs outros corpora sobre Modelagem estoca´stica
(SM), Minerac¸a˜o de dados (DM) e Processamento paralelo (PP) como contrastantes.
Assim, para calcular os ´ındices tf-dcf de cada corpus sa˜o usados como contrastantes os dois
outros corpora, ale´m dos treˆs corpora adicionais (SM, DM, PP). A tabela 2 apresenta as
caracter´ısticas desses corpora e indica, para os treˆs corpora alvos o n u´mero de relac¸ o˜es
extra´ıdas. A tabela 3 apresenta as dez relac¸o˜ es consideradas mais relevantes para cada um
dos corpora segundo a frequeˆncia absoluta (tf ) e o ´ındice tf-dcf.</p>
        <p>corpus</p>
        <p>Tabela 2. Caracter´ısticas dos corpora utilizados.</p>
        <p>Nu´ mero de Nu´ mero de Nu´ mero de Relac¸o˜ es</p>
        <p>Textos Sentenc¸as Tokens Extra´ıdas</p>
        <p>Geo
Pneumo</p>
        <p>CLG
SM
DM
PP</p>
        <p>
          Conforme [
          <xref ref-type="bibr" rid="ref1">Biderman 1998</xref>
          ], na sua lista dos verbos mais frequentes do PB,
encabec¸ando-a temos os auxiliares “ser”, “estar”, “ter”. Ate´ o verbo “ir” registrou um
elevado n u´mero de valores modais e aspectuais, raza˜o para estar tambe´m nos primeiros
lugares da hierarquia dos verbos usuais. Constam dessa lista ainda verbos modalizadores
como “poder”, ou vica´rios, e/ou suportes como “fazer”, “dar”; entre os de significac¸ a˜o
plena, apenas “dizer”, “falar”, “olhar” e “ver” [
          <xref ref-type="bibr" rid="ref1">Biderman 1998</xref>
          ] (p. 174). Se excluirmos
os verbos que integram uma locuc¸a˜o ou que sa˜o auxiliares do levantamento por dom´ınio
com tf-dcf , temos que (“recobrir”, “cortar” e “aflorar”); (“acometer”, “inalar” e
“contaminar”); e (“obscurecer”, “acentuar” e “consagrar”) seriam, respectivamente, os
verbos de maior especificidades nos dom´ınios de Geologia, Pneumologia e Lingu´ıstica,
considerando-se os corpora sob exame e os tipos de textos envolvidos.
        </p>
        <p>#
1
2
3</p>
        <p>Tabela 4. Exemplos de rela c¸ o˜es mais relevantes para o corpus Geo.</p>
        <p>Frequeˆncia Absoluta ´Indice tf-dcf
superf´ıcie ! ser ! molha´vel cascalho ! recobrir ! formac¸a˜o ferruginosa
E´ mostrado que a auseˆncia de a´cidos na˜o garante que a su- Horizonte cascalhento ferruginoso fria´vel de superf´ıcie
corperf´ıcie sera´ molha´vel por a fase aquosa. responde ao solo ou os cascalhos que eventualmente
recobrem as formac¸o˜es ferruginosas.</p>
        <p>footwall ! apresentar ! soerguimento corpo de granito ! cortar ! foliac¸a˜o gna´issica
Desta forma, o footwall apresenta sempre um soergui- Os corpos de granito e pegmatito sa˜o usualmente
subconcormento, enquanto o hangingwall e´ o dom´ınio subsidente. dantes, mas com frequ¨eˆncia cortam a foliac¸ a˜o gna´issica.</p>
        <p>empregado ! ter ! gerente tonalito ! aflorar ! belt de Crixa´s
Utilizando-se este paradigma, pode-se induzir que cada em- No extremo sudoeste da a´rea o tonalito aflora como um
pregado tem um gerente, o que e´ uma generalizac¸a˜o a partir corpo triangular, limitado a nordeste pelos Gnaisses Crixa´s
dos dados existentes naquelas relac¸o˜es. Ac¸u e a oeste pelo greenstone belt de Crixa´s.
1A u´nica adaptac¸a˜o da formulac¸a˜o do ´ındice tf-dcf para termos ao considerar verbos consiste em
considerar frequeˆncia absoluta de verbos (tfv) ao inve´s de frequeˆncia de termos (tft).</p>
        <p>Tabela 5. Exemplos de rela c¸o˜ es mais relevantes para o corpus Pneumo.
# Frequeˆncia Absoluta ´Indice tf-dcf</p>
        <p>efeito ! ser ! fator importante espondilite tuberculosa ! acometer ! disco intervertebral
1 O efeito idade e´ um fator importante na chance de abandono A espondilite tuberculosa acomete o disco intervertebral
do ha´bito de fumar. mais tardiamente no curso da doenc¸a.</p>
        <p>moxifloxacina ! apresentar ! metabolizac¸a˜o hepa´tica nadador ! inalar ! grande quantidade de ar
2 A moxifloxacina, entretanto, apresenta metabolizac¸a˜o Durante a pra´tica do esporte, os nadadores inalam grandes
hepa´tica, e a principal via de excrec¸a˜o e´ a biliar. quantidades de ar logo acima de a superf´ıcie da a´gua.</p>
        <p>stress ! ter ! papel relevante balangero´ıta ! contaminar ! corpos minerais
3 Como exemplos, podemos citar as doenc¸as coronarianas, em A balangero´ıta contamina os corpos minerais da Ita´lia, e
as quais o stress tem um papel relevante. assim por diante.</p>
        <p>Tabela 6. Exemplos de rela c¸o˜ es mais relevantes para o corpus CLG.
# Frequeˆncia Absoluta ´Indice tf-dcf</p>
        <p>l´ıngua ! ser ! sistema escrita ! obscurecer ! visa˜o da l´ıngua
1 Visto ser a l´ıngua um sistema em que todos os termos sa˜o O resultado evidente de tudo isso e´ que a escrita obscurece
solida´rios e o valor de um resulta ta˜o somente da presenc¸a a visa˜o da l´ıngua.
simultaˆnea de outros, segundo o esquema:</p>
        <p>l´ıngua ! ter ! cara´ter de fixidez evoluc¸a˜o de som ! acentuar ! diferenc¸a existente
2 Se a l´ıngua tem um cara´ter de fixidez, na˜o e´ somente porque A evoluc¸a˜o dos sons na˜o faz mais que acentuar as
esta´ ligada ao peso da coletividade, mas tambe´m porque esta´ diferenc¸as existentes antes de ela.
situada no tempo.</p>
        <p>l´ıngua ! constituir ! sistema
3 Uma l´ıngua constitui um sistema.</p>
        <p>uso ! consagrar ! dupla grafia
Vimos na que, contrariamente ao que se verifica para outros
sons, o uso consagrou para aqueles uma dupla grafia.</p>
        <p>As tabelas 4, 5 e 6 apresentam exemplos (sentenc¸as do corpus) das treˆs relac¸o˜es
mais relevantes para cada um dos corpora, respectivamente, segundo cada uma das
abordagens. Observando estes exemplos, percebe-se que as relac¸o˜es mais relevantes segundo
abordagem baseada no ´ındice tf-dcf apresentam caracter´ısticas claras de relac¸ o˜es
na˜otaxonoˆmicas. Por exemplo, observa-se as triplas geradas por tf-dcf “cascalho recobre
formac¸a˜o ferruginosa”, “espondite tuberculosa acomete disco intervertebral”, e “escrita
obscurece visa˜o da l´ıngua”.</p>
        <p>Ja´ os exemplos das relac¸o˜es mais relevantes segundo a frequeˆncia absoluta tem
um caracter que se assemelha mais a definic¸a˜o de propriedades/atributos, como e´ o caso
de “superf´ıcie e´ molha´vel”, ou ainda de “stress tem papel relevante”. Ainda encontra-se
casos que podem ser vistos como uma relac¸a˜o taxonoˆmica, como por exemplo: “l´ıngua e´
sistema”, ou seja, uma l´ıngua e´ um tipo de sistema.</p>
      </sec>
    </sec>
    <sec id="sec-3">
      <title>4. Considerac¸o˜ es Finais e Trabalhos Futuros</title>
      <p>Neste estudo, mostramos dois tipos de abordagens no que diz respeito ao tratamento
automa´tico dos verbos em corpora de dom´ınio com o propo´sito de identificar relac¸ o˜es
na˜o-taxonoˆmicas mais relevantes. Enquanto que a primeira abordagem, que considera a
frequeˆncia em termos absolutos, aponta para aqueles verbos que sa˜o mais gerais da l´ıngua,
a segunda abordagem, que se vale do ´ındice tf-dcf, fornece uma lista de verbos que sa˜o
mais espec´ıficos do dom´ınio a que pertencem os textos.</p>
      <p>Acreditamos, portanto, que atingimos nosso objetivo de identificar as relac¸o˜es
mais relevantes para o dom´ınio, contribuic¸a˜o do estudo atrave´s do ´ındice tf-dcf que
consiste no aux´ılio a` construc¸a˜o de ontologias e na recuperac¸ a˜o automa´tica de informac¸o˜es,
visto que acrescenta dados importantes sobre o verbo, um elemento vital - e pouco
explorado, do ponto de vista do processamento automa´tico - para o funcionamento da l´ıngua.
Ale´m disso, temos tambe´m uma importante contribuic¸a˜o para os Estudos da Linguagem,
ressaltando o papel dos verbos em diferentes dom´ınios.</p>
      <p>Cabe observar, contudo, que, quanto aos corpora em exame neste estudo, o
CLG destaca-se dos outros corpora analisados, por va´rios motivos. Em primeiro lugar,
ainda que se trate de um texto importante dentro do dom´ınio da Lingu´ıstica, na˜o e´ uma
compilac¸a˜o de textos cient´ıficos, como os corpora de Geologia e de Pneumopatias e, ale´m
disso, e´ uma traduc¸a˜o de um texto escrito originalmente em franceˆs, em 1916. Outro
aspecto e´ o de que e´ o u´nico representante de um dom´ınio de a´reas humanas, enquanto que
todos os outros sa˜o das a´reas Exatas, da Sau´de ou das Cieˆncias Naturais, incluindo-se os
corpora contrastantes. Por isso, fica como sugesta˜o para trabalhos futuros, a contraposic¸ a˜o
dos verbos do CLG com os verbos de um corpus de textos de jornais, por exemplo, em
que a linguagem ordina´ria desse geˆnero pode, em contraste, oferecer um panorama mais
espec´ıfico do dom´ınio da Lingu´ıstica.</p>
    </sec>
  </body>
  <back>
    <ref-list>
      <ref id="ref1">
        <mixed-citation>
          <string-name>
            <surname>Biderman</surname>
            ,
            <given-names>M. T. C.</given-names>
          </string-name>
          (
          <year>1998</year>
          ).
          <article-title>A face quantitativa da linguagem: um diciona´rio de frequ¨eˆncias do portugueˆs</article-title>
          .
          <source>Alfa, Sa˜o Paulo</source>
          , Brasil.
        </mixed-citation>
      </ref>
      <ref id="ref2">
        <mixed-citation>
          <string-name>
            <surname>Ferreira</surname>
            ,
            <given-names>V. H.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Lopes</surname>
            ,
            <given-names>L.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Vieira</surname>
            ,
            <given-names>R.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Finatto</surname>
            ,
            <given-names>M. J. B.</given-names>
          </string-name>
          (
          <year>2013</year>
          ).
          <article-title>Automatic extraction of domain specific non-taxonomic relations from portuguese corpora</article-title>
          .
          <source>In Knowledge Discovery in Ontologies - KDO</source>
          <year>2013</year>
          ,
          <article-title>Proc</article-title>
          .
          <source>of WI-IAT</source>
          <year>2013</year>
          , pages
          <fpage>161</fpage>
          -
          <lpage>165</lpage>
          .
        </mixed-citation>
      </ref>
      <ref id="ref3">
        <mixed-citation>
          <string-name>
            <surname>Finatto</surname>
            ,
            <given-names>M. J. B.</given-names>
          </string-name>
          (
          <year>2012</year>
          ).
          <article-title>Projeto porpopular, frequeˆncia de verbos em portugueˆs e no jornal popular popular brasileiro. In As Cieˆncias do Le´xico: lexicologia, lexicografia, terminologia</article-title>
          , volume VI, pages
          <fpage>277</fpage>
          -
          <lpage>244</lpage>
          . Edit. da UFMS/Lab. de Edic¸
          <article-title>a˜o FALE-UFMG.</article-title>
        </mixed-citation>
      </ref>
      <ref id="ref4">
        <mixed-citation>
          <string-name>
            <surname>Kavalec</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          and
          <string-name>
            <surname>A</surname>
          </string-name>
          ´ tek,
          <string-name>
            <surname>V. S.</surname>
          </string-name>
          (
          <year>2005</year>
          ).
          <article-title>A study on automated relation labelling in ontology learning</article-title>
          .
          <source>In Ontology Learning from Text: Methods, Evaluation and Applications</source>
          , pages
          <fpage>44</fpage>
          -
          <lpage>58</lpage>
          . IOS Press.
        </mixed-citation>
      </ref>
      <ref id="ref5">
        <mixed-citation>
          <string-name>
            <surname>Lopes</surname>
            ,
            <given-names>L.</given-names>
          </string-name>
          (
          <year>2012</year>
          ).
          <article-title>Extrac¸a˜o automa´tica de conceitos a partir de textos em l´ıngua portuguesa</article-title>
          .
          <source>PhD thesis</source>
          , PUCRS University - Computer Science Department, Porto Alegre, Brazil.
        </mixed-citation>
      </ref>
      <ref id="ref6">
        <mixed-citation>
          <string-name>
            <surname>Lopes</surname>
            ,
            <given-names>L.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Fernandes</surname>
            ,
            <given-names>P.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Vieira</surname>
            ,
            <given-names>R.</given-names>
          </string-name>
          (
          <year>2012</year>
          ).
          <article-title>Domain term relevance through tf-dcf</article-title>
          .
          <source>In Proceedings of the 2012 International Conference on Artificial Intelligence (ICAI</source>
          <year>2012</year>
          ), pages
          <fpage>1001</fpage>
          -
          <lpage>1007</lpage>
          ,
          <string-name>
            <surname>Las</surname>
            <given-names>Vegas</given-names>
          </string-name>
          , USA. CSREA Press.
        </mixed-citation>
      </ref>
      <ref id="ref7">
        <mixed-citation>
          <article-title>Sa´nchez, D. and</article-title>
          <string-name>
            <surname>Moreno</surname>
            ,
            <given-names>A.</given-names>
          </string-name>
          (
          <year>2008</year>
          ).
          <article-title>Learning non-taxonomic relationships from web documents for domain ontology construction</article-title>
          .
          <source>Data Knowl. Eng.</source>
          ,
          <volume>64</volume>
          (
          <issue>3</issue>
          ):
          <fpage>600</fpage>
          -
          <lpage>623</lpage>
          .
        </mixed-citation>
      </ref>
      <ref id="ref8">
        <mixed-citation>
          <string-name>
            <surname>Scarton</surname>
            ,
            <given-names>C. E.</given-names>
          </string-name>
          (
          <year>2013</year>
          ).
          <article-title>Verbnet.br: construc¸ a˜o semiautoma´tica de um le´xico verbal online e independente de dom´ınio para o portugueˆs do brasil</article-title>
          .
          <source>Master's thesis</source>
          , ICMC - USP.
        </mixed-citation>
      </ref>
      <ref id="ref9">
        <mixed-citation>
          <string-name>
            <surname>Serra</surname>
            ,
            <given-names>I.</given-names>
          </string-name>
          and
          <string-name>
            <surname>Girardi</surname>
            ,
            <given-names>R.</given-names>
          </string-name>
          (
          <year>2011</year>
          ).
          <article-title>A process for extracting non-taxonomic relationships of ontologies from text</article-title>
          .
          <source>Intelligent Information Management</source>
          ,
          <volume>3</volume>
          :
          <fpage>119</fpage>
          -
          <lpage>124</lpage>
          .
        </mixed-citation>
      </ref>
      <ref id="ref10">
        <mixed-citation>
          <string-name>
            <surname>Weichselbraun</surname>
            ,
            <given-names>A.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Wohlgenannt</surname>
            ,
            <given-names>G.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Scharl</surname>
            ,
            <given-names>A.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Granitzer</surname>
            ,
            <given-names>M.</given-names>
          </string-name>
          ,
          <string-name>
            <surname>Neidhart</surname>
            ,
            <given-names>T.</given-names>
          </string-name>
          , and
          <string-name>
            <surname>Juffinger</surname>
            ,
            <given-names>A.</given-names>
          </string-name>
          (
          <year>2009</year>
          ).
          <article-title>Discovery and evaluation of non-taxonomic relations in domain ontologies</article-title>
          .
          <source>International Journal of Metadata, Semantics and Ontologies</source>
          ,
          <volume>4</volume>
          (
          <issue>3</issue>
          ):
          <fpage>212</fpage>
          -
          <lpage>222</lpage>
          .
        </mixed-citation>
      </ref>
      <ref id="ref11">
        <mixed-citation>
          <string-name>
            <surname>Zilio</surname>
            ,
            <given-names>L.</given-names>
          </string-name>
          (
          <year>2015</year>
          ).
          <article-title>Um Recurso Le´xico com Anotac¸a˜o de Pape´is Semaˆnticos para o Portugueˆs</article-title>
          .
          <source>PhD thesis</source>
          , PPG Letras - UFRGS.
        </mixed-citation>
      </ref>
    </ref-list>
  </back>
</article>