首页    期刊浏览 2025年03月03日 星期一
登录注册

文章基本信息

  • 标题:Avaliando entidades mencionadas na coleção ELTeC-por
  • 本地全文:下载
  • 作者:Diana Santos ; Eckhard Bick ; Marcin Wlodek
  • 期刊名称:Linguamática
  • 电子版ISSN:1647-0818
  • 出版年度:2020
  • 卷号:12
  • 期号:2
  • 页码:29-49
  • DOI:10.21814/lm.12.2.336
  • 出版社:Universidade do Minho & Universidade de Vigo
  • 摘要:Este artigo relata a preparação da anotação da coleção ELTeC-por com entidades mencionadas apropriadas ao género textual "romances e novelas publicadas entre 1840 e 1920", para possibilitar a leitura distante em português. Em primeiro lugar apresentamos a coleção ELTeC-por, compilada no âmbito da ação COST "Distant Reading for European Literary History" para estudar a literatura europeia, e explicamos as diversas restrições e escolhas necessárias, fornecendo uma caracterização inicial segundo vários eixos: a origem e tamanho das obras, o seu (sub)género literário, o género do autor, o local de publicação e a existência ou não de mais edições. Em seguida apresentamos o sistema PALAVRAS-NER, com o qual anotaremos a coleção, explicando detalhadamente o seu funcionamento. Passamos então à descrição da criação de uma subcoleção de oito obras revistas, que servem, por um lado, para avaliar o desempenho do sistema de REM automático, e, por outro, para caracterizar o tipo de população esperada. As obras podem classificar-se segundo dois eixos diferentes: romances históricos vs. romances contemporâneos; e obras com grafia original ou grafia modernizada. Além disso, algumas obras são obviamente canónicas, outras não. Além da descrição quantitativa do resultado de anotação e revisão, apresentamos algumas considerações qualitativas sobre o processo. Também fornecemos uma análise detalhada de algumas categorias, tentando mostrar como os lugares, profissões e gentílicos mais mencionados podem ser indicadores numa leitura distante. Concluímos comparando com o trabalho internacional feito na análise de entidades mencionadas de obras literárias, explicando as diferenças e sugerindo trabalho futuro.
  • 关键词:leitura distante;reconhecimento de entidades mencionadas;português;literatura portuguesa;humanidades digitais;compilação de corpos
国家哲学社会科学文献中心版权所有