Hoppa till huvudinnehåll

sbx-bul-lemmatization-treetagger

Standardreferens Information

Helmut Schmid (1995): Improvements in Part-of-Speech Tagging with an Application to German. Proceedings of the ACL SIGDAT-Workshop. Dublin, Ireland.

Analyscitering Information

Språkbanken (2021). sbx-bul-lemmatization-treetagger (uppdaterad: 2021-03-24). [Analysis]. Bearbetad och distribuerad av Språkbanken. https://doi.org/10.23695/80hg-ch82
BibTeX Ytterligare sätt att citera datamängden.
Annotering av grundformer (lemman) med TreeTagger för bulgariska

Exempel

This analysis is used with Sparv. Check out Sparv's quick start guide to get started!

To use this analysis, add the following line under export.annotations in the Sparv corpus configuration file:

- <token>:treetagger.baseform  # Baseforms from TreeTagger

In order to use this annotation you need to add the following setting to your Sparv corpus configuration file:

metadata:
  language: bul

For more info on how to use Sparv, check out the Sparv documentation.

Example output:

<token baseform="Езѝкът">Езѝкът</token>
<token baseform="е">е</token>
<token baseform="система">система</token>
<token baseform="от">от</token>
<token baseform="знак">знаци</token>
<token baseform="за">за</token>
<token baseform="кодиране">кодиране</token>
<token baseform="и">и</token>
<token baseform="декодиране">декодиране</token>
<token baseform="на">на</token>
<token baseform="информация">информация</token>
<token baseform=".">.</token>

Övriga referenser

Typ

  • Analys

Uppgift

  • lemmatisering

Enhet

  • token

Licens

MIT

Beroenden

Externa verktyg

TreeTagger
TreeTagger License https://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/Tagger-Licence

Modeller

Tränad på

Nyckelord

  • treetagger

Skapad

2014-09-16

Uppdaterad

2021-03-24

Kontakt

sb-info@svenska.gu.se