AplikaceAplikace
Nastavení

Rozdíly

Zde můžete vidět rozdíly mezi vybranou verzí a aktuální verzí dané stránky.

Odkaz na výstup diff

Následující verze
Předchozí verze
cnk:intercorp:verze16 [2023/09/22 14:42] – vytvořeno alexandrrosencnk:intercorp:verze16 [2024/04/18 12:23] (aktuální) – [Morfosyntaktická anotace] tomasmachalek
Řádek 2: Řádek 2:
  
 ^ Název ^^ čeština jádro ^ čeština kolekce ^ cizí jazyky jádro ^ cizí jazyky kolekce ^ ^ Název ^^ čeština jádro ^ čeština kolekce ^ cizí jazyky jádro ^ cizí jazyky kolekce ^
-^ [[pojmy:atributy_pozicni|Pozice]] ^ Počet [[pojmy:token|tokenů]] |  148 487 713 |  117 094 767 |  434 905 960 |  1 551 791 814 +^ [[pojmy:atributy_pozicni|Pozice]] ^ Počet [[pojmy:token|tokenů]] |  154 512 254 |  363 685 460 |  464 653 933 |  5 840 602 221 
-^ ::: ^ Počet [[pojmy:word|slovních tvarů]] |  119 933 378 |  90 181 070 |  361 991 365 |  1 226 159 823 +^ ::: ^ Počet [[pojmy:word|slovních tvarů]] |  124 679 582 |  272 862 335 |  386 728 679 |  4 505 550 764 
-^ [[pojmy:atributy_strukturni|Struktury]] ^ Počet [[seznamy:strukturni_atributy_intercorp|dokumentů]] |  1 743 |  33 |  4 372 |   313 +^ [[pojmy:atributy_strukturni|Struktury]] ^ Počet [[seznamy:strukturni_atributy_intercorp|dokumentů]] |  1 812 |  33 |  4 643 |   338 
-^ ::: ^ Počet textů |  1 743 |  112 393 |  4 372 |  1 846 588 +^ ::: ^ Počet textů |  1 812 |  162 612 |  4 643 |  2 662 665 
-^ ::: ^ Počet vět |  10 288 141 |  13 626 168 |  26 843 652 |  143 334 058 |+^ ::: ^ Počet vět |  10 691 339 |  50 729 559 |  28 684 678 |  790 046 584 |
 ^ Další informace ^ [[pojmy:referencni|referenční]] |  ANO   ^^^^ ^ Další informace ^ [[pojmy:referencni|referenční]] |  ANO   ^^^^
 ^ ::: ^ [[pojmy:reprezentativnost|reprezentativní]] |  NE ([[seznamy:txtype|různé textové typy]])  ^^^^ ^ ::: ^ [[pojmy:reprezentativnost|reprezentativní]] |  NE ([[seznamy:txtype|různé textové typy]])  ^^^^
-^ ::: ^ rok zveřejnění |  2022  ^^^^ +^ ::: ^ rok zveřejnění |  2023  ^^^^ 
-^ ::: ^ cizích jazyků |  41  ^^^^+^ ::: ^ cizích jazyků |  61  ^^^^
 ^ ::: ^ [[pojmy:tag|tagovaných]] jazyků |  27  ^^^^ ^ ::: ^ [[pojmy:tag|tagovaných]] jazyků |  27  ^^^^
 ^ ::: ^ jazyky s [[pojmy:lemma|lemmaty]] |  25  ^^^^ ^ ::: ^ jazyky s [[pojmy:lemma|lemmaty]] |  25  ^^^^
Řádek 26: Řádek 26:
 ==== Obsah korpusu ==== ==== Obsah korpusu ====
  
-**Jádrem** korpusu InterCorp jsou ručně zarovnané, převážně beletristické texty. Kromě toho korpus obsahuje také nabídku automaticky zpracovaných textů, tzv. **kolekce**. Ve verzi 15 jsou k dispozici tyto kolekce:+**Jádrem** korpusu InterCorp jsou ručně zarovnané, převážně beletristické texty. Kromě toho korpus obsahuje také nabídku automaticky zpracovaných textů, tzv. **kolekce**. Ve verzi 16 jsou k dispozici tyto kolekce:
  
   * publistické články a zpravodajství z webových stránek [[http://www.project-syndicate.org|Project Syndicate]] a [[http://www.voxeurop.eu|VoxEurop]] (dříve PressEurop)   * publistické články a zpravodajství z webových stránek [[http://www.project-syndicate.org|Project Syndicate]] a [[http://www.voxeurop.eu|VoxEurop]] (dříve PressEurop)
Řádek 37: Řádek 37:
 Došlo rovněž k rozdělení //Syndicate// a //PressEurop// na jednotlivé ročníky, čímž se zvýšil počet dokumentů v kolekcích.  Došlo rovněž k rozdělení //Syndicate// a //PressEurop// na jednotlivé ročníky, čímž se zvýšil počet dokumentů v kolekcích. 
  
-Každý cizojazyčný text má v korpusu svou českou verzi. Čeština je tedy tzv. pivot, česká verze textu (originál nebo překlad) je zarovnána s jednou nebo více verzemi cizojazyčnými. Celkový rozsah zpřístupněné části korpusu ve verzi 15 listopadu 2022 činí v zarovnaných cizojazyčných textech 362 milionů slov v jádru a 1 226 milionů slov v kolekcích. V českých textech je v jádru 120 a v kolekcích 90 milionů slov (viz [[cnk:intercorp:historie|historie verzí]]). Rozložení textů v rámci jádra a v jednotlivých kolekcích je znázorněno na následujících grafech. Čísla v grafech ukazují velikost v milionech slov.+Každý cizojazyčný text má v korpusu svou českou verzi. Čeština je tedy tzv. pivot, česká verze textu (originál nebo překlad) je zarovnána s jednou nebo více verzemi cizojazyčnými. Celkový rozsah zpřístupněné části korpusu ve verzi 16 roku 2023 činí v zarovnaných cizojazyčných textech 387 milionů slov v jádru a 4 506 milionů slov v kolekcích. V českých textech je v jádru 125 a v kolekcích 273 milionů slov (viz [[cnk:intercorp:historie|historie verzí]]). Rozložení textů v rámci jádra a v jednotlivých kolekcích je znázorněno na následujících grafech. Čísla v grafech ukazují velikost v milionech slov.
  
-[{{:cnk:intercorp:intercorp_wordcounts_v15.png|Skladba korpusu podle jednotlivých jazyků – jádro i kolekce}}] \\+[{{:cnk:intercorp:intercorp_wordcounts_v16.png?1000|Skladba korpusu podle jednotlivých jazyků – jádro i kolekce}}] \\
  
  
-[{{:cnk:intercorp:intercorp_wordcounts2_v15.png|Skladba korpusu podle jednotlivých jazyků – jádro}}] \\+[{{:cnk:intercorp:intercorp_wordcounts2_v16.png?1000|Skladba korpusu podle jednotlivých jazyků – jádro}}] \\
  
  
-[{{:cnk:intercorp:intercorp_wordcounts3_v15.png|Skladba korpusu podle jednotlivých jazyků – kolekce}}] \\+[{{:cnk:intercorp:intercorp_wordcounts3_v16.png?1000|Skladba korpusu podle jednotlivých jazyků – kolekce}}] \\
  
 ====Velikost korpusu v tisících slov==== ====Velikost korpusu v tisících slov====
  
 ^ Zkratka ^ Jazyk ^ Jádro ^ Syndicate ^ Presseurop ^ Acquis ^ Europarl ^ Subtitles ^ Bible ^ Celkem ^ ^ Zkratka ^ Jazyk ^ Jádro ^ Syndicate ^ Presseurop ^ Acquis ^ Europarl ^ Subtitles ^ Bible ^ Celkem ^
-^  ar  ^ arabština |  34 |  384 |  0 |  0 |  0 |  |  0 |  418 +^  af  ^ afrikánština |  0 |  0 |  0 |  0 |  0 |  136 |  0 |  136 | 
-^  be  ^ běloruština |  6 524 |  0 |  0 |  0 |  0 |  0 |  0 |  6 524 +^  ar  ^ arabština |  34 |  384 |  0 |  0 |  0 |  126 157 |  0 |  126 576 
-^  bg  ^ bulharština |  7 068 |  0 |  0 |  13 577 |  9 083 |  0 |  0 |  29 728 +^  be  ^ běloruština |  7 131 |  0 |  0 |  0 |  0 |  0 |  0 |  7 131 
-^  ca  ^ katalánština |  8 920 |  0 |  0 |  0 |  0 |  |  736 |  9 656 +^  bg  ^ bulharština |  7 068 |  0 |  0 |  13 577 |  9 083 |  165 092 |  0 |  194 820 | 
-^  da  ^ dánština |  8 456 |  0 |  0 |  20 313 |  13 916 |  14 429 |  657 |  57 770 +^  bn  ^ bengálština |  0 |  0 |  0 |  0 |  0 |  1 554 |  0 |  1 554 | 
-^  de  ^ němčina |  39 412 |  5 067 |  2 483 |  20 610 |  13 088 |  8 392 |  724 |  89 776 +^  br  ^ bretonština |  0 |  0 |  0 |  0 |  0 |  98 |  0 |  98 | 
-^  el  ^ řečtina |  0 |  0 |  0 |  23 853 |  15 404 |  23 709 |  0 |  62 966 +^  bs  ^ bosenština |  0 |  0 |  0 |  0 |  0 |  58 758 |  0 |  58 758 
-^  en  ^ angličtina |  38 706 |  5 273 |  2 670 |  22 902 |  15 576 |  52 106 |  730 |  137 964 +^  ca  ^ katalánština |  10 112 |  0 |  0 |  0 |  0 |  2 735 |  736 |  13 582 | 
-^  es  ^ španělština |  29 145 |  6 074 |  2 859 |  26 262 |  16 249 |  36 650 |  0 |  117 239 +^  cs  ^ čeština |  124 680 |  4 717 |  2 312 |  19 214 |  12 917 |  233 139 |  563 |  397 542 
-^  et  ^ estonština |  |  0 |  0 |  14 896 |  10 899 |  10 298 |  0 |  36 093 +^  da  ^ dánština |  9 548 |  0 |  0 |  20 313 |  13 916 |  71 825 |  657 |  116 259 
-^  fi  ^ finština |  6 674 |  0 |  0 |  15 269 |  10 108 |  15 047 |  543 |  47 641 +^  de  ^ němčina |  40 679 |  5 067 |  2 483 |  20 610 |  13 089 |  98 566 |  724 |  181 219 
-^  fr  ^ francouzština |  21 996 |  5 896 |  3 046 |  26 200 |  17 179 |  25 986 |  764 |  101 067 +^  el  ^ řečtina |  0 |  0 |  0 |  23 853 |  15 404 |  162 561 |  0 |  201 818 
-^  he  ^ hebrejština |  0 |  0 |  0 |  0 |  0 |  16 221 |  0 |  16 221 +^  en  ^ angličtina |  42 395 |  5 273 |  2 670 |  22 902 |  15 576 |  280 335 |  730 |  369 882 | 
-^  hi  ^ hindština |  409 |  0 |  0 |  0 |  0 |  |  0 |  409 +^  eo  ^ esperanto |  0 |  0 |  0 |  0 |  0 |  226 |  0 |  226 
-^  hr  ^ chorvatština |  23 351 |  0 |  0 |  0 |  0 |  19 048 |  571 |  42 971 +^  es  ^ španělština |  30 661 |  6 074 |  2 859 |  26 262 |  16 249 |  223 134 |  0 |  305 240 
-^  hs  ^ hornolužtina |  128 |  0 |  0 |  0 |  0 |  0 |  0 |  128 +^  et  ^ estonština |  79 |  0 |  0 |  14 896 |  10 899 |  54 514 |  0 |  80 388 | 
-^  hu  ^ maďarština |  6 922 |  8 |  0 |  17 852 |  12 198 |  21 115 |  0 |  58 095 +^  eu  ^ baskičtina |  0 |  0 |  0 |  0 |  0 |  3 022 |  0 |  3 022 | 
-^  is  ^ islandština |  0 |  0 |  0 |  0 |  0 |  1 581 |  0 |  1 581 +^  fa  ^ perština |  0 |  0 |  0 |  0 |  0 |  33 167 |  0 |  33 167 
-^  it  ^ italština |  16 384 |  1 389 |  2 747 |  23 771 |  15 494 |  14 700 |  684 |  75 169 +^  fi  ^ finština |  6 959 |  0 |  0 |  15 269 |  10 108 |  90 471 |  543 |  123 349 
-^  ja  ^ japonština |  3 491 |  2 |  0 |  0 |  0 |  477 |  0 |  3 970 +^  fr  ^ francouzština |  24 361 |  5 896 |  3 046 |  26 200 |  17 179 |  181 433 |  764 |  258 879 | 
-^  lt  ^ litevština |  502 |  0 |  0 |  17 316 |  11 213 |  558 |  471 |  30 059 +^  gl  ^ galicijština |  0 |  0 |  0 |  0 |  0 |  623 |  0 |  623 
-^  lv  ^ lotyština |  3 437 |  0 |  0 |  17 522 |  11 682 |  280 |  537 |  33 458 +^  he  ^ hebrejština |  0 |  0 |  0 |  0 |  0 |  130 143 |  0 |  130 143 
-^  mk  ^ makedonština |  8 881 |  0 |  0 |  0 |  0 |  1 877 |  0 |  10 758 +^  hi  ^ hindština |  409 |  0 |  0 |  0 |  0 |  432 |  0 |  841 
-^  ms  ^ malajština |  0 |  0 |  0 |  0 |  0 |  3 521 |  0 |  3 521 |+^  hr  ^ chorvatština |  24 529 |  0 |  0 |  0 |  0 |  137 966 |  571 |  163 066 
 +^  hs  ^ hornolužická srbština |  466 |  0 |  0 |  0 |  0 |  0 |  0 |  466 
 +^  hu  ^ maďarština |  6 921 |  8 |  0 |  17 852 |  12 198 |  141 691 |  0 |  178 670 | 
 +^  hy  ^ arménština |  0 |  0 |  0 |  0 |  0 |  24 |  0 |  24 | 
 +^  id  ^ indonéština |  0 |  0 |  0 |  0 |  0 |  38 343 |  0 |  38 343 
 +^  is  ^ islandština |  0 |  0 |  0 |  0 |  0 |  7 375 |  0 |  7 375 
 +^  it  ^ italština |  18 086 |  1 389 |  2 747 |  23 771 |  15 494 |  163 622 |  684 |  225 793 
 +^  ja  ^ japonština |  3 818 |  2 |  0 |  0 |  0 |  12 485 |  0 |  16 305 | 
 +^  ka  ^ gruzínština |  0 |  0 |  0 |  0 |  0 |  889 |  0 |  889 | 
 +^  kk  ^ kazaština |  0 |  0 |  0 |  0 |  0 |  14 |  0 |  14 | 
 +^  ko  ^ korejština |  0 |  0 |  0 |  0 |  0 |  5 980 |  0 |  5 980 
 +^  lt  ^ litevština |  696 |  0 |  0 |  17 316 |  11 213 |  5 269 |  471 |  34 964 
 +^  lv  ^ lotyština |  3 636 |  0 |  0 |  17 533 |  11 682 |  2 053 |  537 |  35 441 
 +^  mk  ^ makedonština |  8 881 |  0 |  0 |  0 |  0 |  15 595 |  0 |  24 476 | 
 +^  ml  ^ malajámština |  0 |  0 |  0 |  0 |  0 |  1 281 |  0 |  1 281 
 +^  ms  ^ malajština |  0 |  0 |  0 |  0 |  0 |  7 939 |  0 |  7 939 |
 ^  mt  ^ maltština |  0 |  0 |  0 |  13 935 |  0 |  0 |  0 |  13 935 | ^  mt  ^ maltština |  0 |  0 |  0 |  13 935 |  0 |  0 |  0 |  13 935 |
-^  nl  ^ nizozemština |  17 769 |  812 |  2 953 |  23 416 |  15 558 |  29 373 |  717 |  90 598 +^  nl  ^ nizozemština |  18 782 |  812 |  2 953 |  23 416 |  15 558 |  170 979 |  717 |  233 217 
-^  no  ^ norština |  7 851 |  0 |  0 |  0 |  0 |  |  724 |  8 575 +^  no  ^ norština |  8 221 |  0 |  0 |  0 |  0 |  39 807 |  724 |  48 752 
-^  pl  ^ polština |  28 112 |  0 |  2 380 |  19 604 |  12 817 |  26 576 |  583 |  90 072 +^  pl  ^ polština |  28 597 |  0 |  2 380 |  19 604 |  12 817 |  169 498 |  583 |  233 480 
-^  pt  ^ portugalština |  6 943 |  739 |  2 782 |  24 598 |  15 193 |  41 468 |  706 |  92 429 |+^  pt  ^ portugalština |  7 285 |  739 |  2 782 |  24 598 |  15 193 |  229 515 |  706 |  280 818 |
 ^  rn  ^ romština |  14 |  0 |  0 |  0 |  0 |  0 |  0 |  14 | ^  rn  ^ romština |  14 |  0 |  0 |  0 |  0 |  0 |  0 |  14 |
-^  ro  ^ rumunština |  4 219 |  0 |  2 738 |  8 092 |  9 446 |  34 128 |  0 |  58 622 +^  ro  ^ rumunština |  4 219 |  0 |  2 738 |  8 092 |  9 446 |  212 396 |  0 |  236 890 
-^  ru  ^ ruština |  10 549 |  4 302 |  0 |  0 |  0 |  6 887 |  565 |  22 303 +^  ru  ^ ruština |  12 387 |  4 302 |  0 |  0 |  0 |  104 609 |  565 |  121 864 | 
-^  sk  ^ slovenština |  8 596 |  0 |  0 |  18 399 |  12 727 |  5 133 |  561 |  45 416 +^  si  ^ sinhálština |  0 |  0 |  0 |  0 |  0 |  2 346 |  0 |  2 346 
-^  sl  ^ slovinština |  4 354 |  0 |  0 |  18 515 |  12 241 |  17 035 |  0 |  52 144 +^  sk  ^ slovenština |  8 586 |  0 |  0 |  18 399 |  12 727 |  34 581 |  561 |  74 854 
-^  sq  ^ albánština |  0 |  0 |  0 |  0 |  0 |  2 003 |  0 |  2 003 +^  sl  ^ slovinština |  4 636 |  0 |  0 |  18 515 |  12 241 |  83 000 |  0 |  118 392 
-^  sr  ^ srbština |  12 356 |  0 |  0 |  0 |  0 |  20 727 |  0 |  33 082 +^  sq  ^ albánština |  0 |  0 |  0 |  0 |  0 |  9 351 |  0 |  9 351 
-^  sv  ^ švédština |  17 877 |  0 |  0 |  19 542 |  13 784 |  14 666 |  638 |  66 507 +^  sr  ^ srbština |  12 706 |  0 |  0 |  0 |  0 |  152 636 |  0 |  165 342 
-^  tr  turečtina |  0 |  0 |  0 |  0 |  0 |  21 190 |  0 |  21 190 +^  sv  ^ švédština |  19 740 |  0 |  0 |  19 542 |  13 784 |  81 548 |  638 |  135 252 
-^  uk  ukrajinština |  12 712 |  0 |  0 |  0 |  0 |  244 |  596 |  13 551 +^  ta  tamilština |  0 |  0 |  0 |  0 |  0 |  104 |  0 |  104 
-^  vi  vietnamština |  0 |  0 |  0 |  0 |  0 |  1 474 |  0 |  1 474 +^  te  telugština |  |  0 |  0 |  0 |  0 |  96 |  |  96 
-^  zh  ^ čínština |  202 |  604 |  0 |  0 |  0 |  2 247 |  |  3 054 +^  th  thajština |  0 |  0 |  0 |  0 |  0 |  5 660 |  0 |  5 660 
-^  **celkem**   |  361 991 |  30 552 |  24 658 |  406 445 |  263 854 |  489 143 |  11 507 |  1 588 151 +^  tl  tagalština |  0 |  0 |  0 |  0 |  0 |  38 |  0 |  38 | 
-^  cs  ^ čeština |  119 933 |  4 712 |  2 310 |  19 085 |  12 908 |  50 604 |  562 |  210 114 +^  tr  ^ turečtina |  0 |  0 |  0 |  0 |  0 |  149 892 |  0 |  149 892 | 
-^  **CELKEM**  |  481 925 |  35 264 |  26 968 |  425 530 |  276 763 |  539 747 |  12 069 |  1 798 266 |+^  uk  ^ ukrajinština |  14 849 |  |  0 |  0 |  0 |  2 938 |  596 |  18 382 
 +^  ur  urdština |  |  |  |  |  |  158 |  |  158 | 
 + vi  ^ vietnamština |  0 |  0 |  0 |  0 |  0 |  22 298 |  0 |  22 298 
 +^  zh  ^ čínština |  238 |  838 |  |  |  |  71 331 |  |  72 407 
 +^  **CELKEM**   |  511 408 |  35 503 |  26 971 |  425 670 |  276 772 |  4 001 428 |  12 069 |  5 289 821 |
  
 Pozn.: U českých textů se počítají slova jen jednou za každý text, i když má více cizojazyčných protějšků. Pozn.: U českých textů se počítají slova jen jednou za každý text, i když má více cizojazyčných protějšků.
 +
 +====Počet textů v jádru korpusu====
 +
 +^ Zkratka ^ Jazyk ^ Počet textů ^ z toho originály ^
 +^  ar  ^ arabština |  3 |  1 |
 +^  be  ^ běloruština |  108 |  14 |
 +^  bg  ^ bulharština |  87 |  19 |
 +^  ca  ^ katalánština |  92 |  1 |
 +^  cs  ^ čeština |  1 812 |  368 |
 +^  da  ^ dánština |  93 |  9 |
 +^  de  ^ němčina |  471 |  163 |
 +^  en  ^ angličtina |  422 |  271 |
 +^  es  ^ španělština |  355 |  142 |
 +^  et  ^ estonština |  1 |  0 |
 +^  fi  ^ finština |  112 |  36 |
 +^  fr  ^ francouzština |  277 |  126 |
 +^  hi  ^ hindština |  7 |  2 |
 +^  hr  ^ chorvatština |  324 |  37 |
 +^  hs  ^ hornolužická srbština |  13 |  5 |
 +^  hu  ^ maďarština |  89 |  1 |
 +^  it  ^ italština |  171 |  26 |
 +^  ja  ^ japonština |  35 |  15 |
 +^  lt  ^ litevština |  23 |  4 |
 +^  lv  ^ lotyština |  73 |  15 |
 +^  mk  ^ makedonština |  108 |  4 |
 +^  nl  ^ nizozemština |  215 |  52 |
 +^  no  ^ norština |  102 |  23 |
 +^  pl  ^ polština |  348 |  54 |
 +^  pt  ^ portugalština |  87 |  24 |
 +^  rn  ^ romština |  2 |  2 |
 +^  ro  ^ rumunština |  45 |  5 |
 +^  ru  ^ ruština |  160 |  37 |
 +^  sk  ^ slovenština |  165 |  62 |
 +^  sl  ^ slovinština |  73 |  25 |
 +^  sr  ^ srbština |  148 |  13 |
 +^  sv  ^ švédština |  232 |  101 |
 +^  uk  ^ ukrajinština |  199 |  8 |
 +^  zh  ^ čínština |  3 |  3 |
 +^  **CELKEM**  ^    6 455 |  1 668 |
  
 ==== Morfosyntaktická anotace ==== ==== Morfosyntaktická anotace ====
Řádek 102: Řádek 160:
  
 ^  Jazyk  ^  Značky  ^  Lemmata  ^  Stručný popis  ^  Podrobný popis  ^  Značky v korpusu  ^ Nástroj  ^ ^  Jazyk  ^  Značky  ^  Lemmata  ^  Stručný popis  ^  Podrobný popis  ^  Značky v korpusu  ^ Nástroj  ^
-^ angličtina |  ✔    ✔  |  [[http://utkl.ff.cuni.cz/~rosen/INTERCORP/TAGSETS/PennTreebankTags.pdf|anglicky]]  | [[http://utkl.ff.cuni.cz/%7Erosen/public/Penn-Treebank-Tagset.pdf|anglicky]] + [[http://utkl.ff.cuni.cz/%7Erosen/public/PennTagAdd.html|dodatky]]  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_en&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ angličtina |  ✔    ✔  |  [[http://utkl.ff.cuni.cz/~rosen/INTERCORP/TAGSETS/PennTreebankTags.pdf|anglicky]]  | [[http://utkl.ff.cuni.cz/%7Erosen/public/Penn-Treebank-Tagset.pdf|anglicky]] + [[http://utkl.ff.cuni.cz/%7Erosen/public/PennTagAdd.html|dodatky]]  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~AoIeKE4AOIoO|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ běloruština |  ✔  |   ✔    [[http://universaldependencies.org/docs/u/pos/index.html|anglicky]]%%****%%)  |  [[https://universaldependencies.org/be/index.html#morphology|anglicky]]%%****%%)  |   [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_be&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  |[[https://web.archive.org/web/20170122231904/http://lindat.mff.cuni.cz/services/udpipe/api-reference.php|UDPipe]] +^ běloruština |  ✔  |   ✔    [[http://universaldependencies.org/docs/u/pos/index.html|anglicky]]%%****%%)  |  [[https://universaldependencies.org/be/index.html#morphology|anglicky]]%%****%%)  |   [[https://www.korpus.cz/kontext/wordlist/result?q=~WUgyKq0a2I2I|ukázat]]  |[[https://web.archive.org/web/20170122231904/http://lindat.mff.cuni.cz/services/udpipe/api-reference.php|UDPipe]] 
-^ bulharština |  ✔  |   ✔    [[https://www.sketchengine.eu/bulgarian-treebank-part-of-speech-tagset/|anglicky]]    [[http://utkl.ff.cuni.cz/~rosen/INTERCORP/TAGSETS/BTB-TR03_BulTreeBank_morphosyntactic_tag.pdf|anglicky]]  |   [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_bg&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ bulharština |  ✔  |   ✔    [[https://www.sketchengine.eu/bulgarian-treebank-part-of-speech-tagset/|anglicky]]    [[http://utkl.ff.cuni.cz/~rosen/INTERCORP/TAGSETS/BTB-TR03_BulTreeBank_morphosyntactic_tag.pdf|anglicky]]  |   [[https://www.korpus.cz/kontext/wordlist/result?q=~deauEUMQSay2|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ čeština |  ✔  |  ✔  |  [[http://wiki.korpus.cz/doku.php/seznamy:tagy|česky]] a [[http://ufal.mff.cuni.cz/pdt/Morphology_and_Tagging/Doc/hmptagqr.html|anglicky]] |  [[http://ufal.mff.cuni.cz/pdt/Morphology_and_Tagging/Doc/docc0pos.pdf|anglicky]]  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_cs&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://ufal.mff.cuni.cz/morce/index.php|Morče]] +^ čeština |  ✔  |  ✔  |  [[http://wiki.korpus.cz/doku.php/seznamy:tagy|česky]] a [[http://ufal.mff.cuni.cz/pdt/Morphology_and_Tagging/Doc/hmptagqr.html|anglicky]] |  [[http://ufal.mff.cuni.cz/pdt/Morphology_and_Tagging/Doc/docc0pos.pdf|anglicky]]  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~dWMc6cC2mEYI|ukázat]]  | [[http://ufal.mff.cuni.cz/morce/index.php|Morče]] 
-^ čínština |  ✔  |    |  [[https://www.sketchengine.eu/chinese-penn-treebank-part-of-speech-tagset/|anglicky]]  |  [[https://repository.upenn.edu/cgi/viewcontent.cgi?article=1039&context=ircs_reports|anglicky]]  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_zh&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[https://www.sutd.edu.sg/cmsresource/faculty/yuezhang/zpar.html|ZPar v0.7.5]] +^ čínština |  ✔  |    |  [[https://www.sketchengine.eu/chinese-penn-treebank-part-of-speech-tagset/|anglicky]]  |  [[https://repository.upenn.edu/cgi/viewcontent.cgi?article=1039&context=ircs_reports|anglicky]]  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~Qy0WEKcyKCAG|ukázat]]  | [[https://www.sutd.edu.sg/cmsresource/faculty/yuezhang/zpar.html|ZPar v0.7.5]] 
-^ estonština |  ✔  |  ✔  |  [[http://www.cl.ut.ee/korpused/morfliides/seletus|estonsky a anglicky]]  |       [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_et&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ estonština |  ✔  |  ✔  |  [[http://www.cl.ut.ee/korpused/morfliides/seletus|estonsky a anglicky]]  |       [[https://www.korpus.cz/kontext/wordlist/result?q=~OYogQQcMUc86|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ finština |  ✔  |  ✔  |  [[https://www.sketchengine.co.uk/finntreebank|anglicky]]%%*%%)  |  [[http://www.ling.helsinki.fi/kieliteknologia/tutkimus/treebank/sources/FinnTreeBankManual.pdf|anglicky]]%%*%%)  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_fi&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  |[[http://www.ling.helsinki.fi/kieliteknologia/tutkimus/omor/omorfi/README.shtml|OMorFi]] +[[https://code.google.com/archive/p/hunpos/|HunPOS]] +^ finština |  ✔  |  ✔  |  [[https://www.sketchengine.co.uk/finntreebank|anglicky]]%%*%%)  |  [[http://www.ling.helsinki.fi/kieliteknologia/tutkimus/treebank/sources/FinnTreeBankManual.pdf|anglicky]]%%*%%)  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~BwiUqc2SoaKY|ukázat]]  |[[http://www.ling.helsinki.fi/kieliteknologia/tutkimus/omor/omorfi/README.shtml|OMorFi]] +[[https://code.google.com/archive/p/hunpos/|HunPOS]] 
-^ francouzština |  ✔  |  ✔  |  [[https://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/french-tagset.html|anglicky]]  |      [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_fr&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  |[[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ francouzština |  ✔  |  ✔  |  [[https://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/french-tagset.html|anglicky]]  |      [[https://www.korpus.cz/kontext/wordlist/result?q=~MEY8qsoECM42|ukázat]]  |[[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ chorvatština |  ✔  |  ✔  |   [[https://github.com/ffnlp/sethr/blob/master/mte4r-upos.mapping|anglicky]]  |  [[http://nlp.ffzg.hr/data/tagging/msd-hr.html|anglicky]]    [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_hr&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[https://github.com/clarinsi/reldi-tagger|ReLDI Tagger]]   | +^ chorvatština |  ✔  |  ✔  |   [[https://github.com/ffnlp/sethr/blob/master/mte4r-upos.mapping|anglicky]]  |  [[http://nlp.ffzg.hr/data/tagging/msd-hr.html|anglicky]]    [[https://www.korpus.cz/kontext/wordlist/result?q=~ve6ySioUWoQo|ukázat]]  | [[https://github.com/clarinsi/reldi-tagger|ReLDI Tagger]]   | 
-^ islandština |  ✔  |  ✔  |  [[http://www.malfong.is/files/ot_tagset_files_en.pdf|anglicky]]    [[http://nlp.cs.ru.is/pdf/Tagset.pdf|anglicky]]  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_is&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.ling.su.se/english/nlp/tools/stagger/stagger-the-stockholm-tagger-1.98986|IceStagger]] +^ islandština |  ✔  |  ✔  |  [[http://www.malfong.is/files/ot_tagset_files_en.pdf|anglicky]]    [[http://nlp.cs.ru.is/pdf/Tagset.pdf|anglicky]]  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~OSQqSoscsiiG|ukázat]]  | [[http://www.ling.su.se/english/nlp/tools/stagger/stagger-the-stockholm-tagger-1.98986|IceStagger]] 
-^ italština |  ✔  |  ✔  |  [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/italian-tagset.txt|anglicky]]        [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_it&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  |[[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ italština |  ✔  |  ✔  |  [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/italian-tagset.txt|anglicky]]        [[https://www.korpus.cz/kontext/wordlist/result?q=~AG82UCM6swiK|ukázat]]  |[[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ japonština |  ✔  |  ✔  |  [[https://www.sketchengine.eu/tagset-jp-mecab/|anglicky]]        [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_ja&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[https://taku910.github.io/mecab/|MeCab]] + [[https://unidic.ninjal.ac.jp|Unidic]] +^ japonština |  ✔  |  ✔  |  [[https://www.sketchengine.eu/tagset-jp-mecab/|anglicky]]        [[https://www.korpus.cz/kontext/wordlist/result?q=~v8EQwWqiygis|ukázat]]  | [[https://taku910.github.io/mecab/|MeCab]] + [[https://unidic.ninjal.ac.jp|Unidic]] 
-^ katalánština |  ✔  |  ✔  |  [[http://clic.ub.edu/corpus/webfm_send/18|anglicky]]  |      [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_ca&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ katalánština |  ✔  |  ✔  |  [[http://clic.ub.edu/corpus/webfm_send/18|anglicky]]  |      [[https://www.korpus.cz/kontext/wordlist/result?q=~xIQI46GMkQMc|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ lotyština |  ✔  |  ✔  |   [[http://www.semti-kamols.lv/doc_upl/TagSet.html|lotyšsky]]  |      [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_lv&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[https://peteris.rocks/blog/latvian-part-of-speech-tagging|LVTagger]] +^ lotyština |  ✔  |  ✔  |   [[http://www.semti-kamols.lv/doc_upl/TagSet.html|lotyšsky]]  |      [[https://www.korpus.cz/kontext/wordlist/result?q=~NiGIW6iec6eq|ukázat]]  | [[https://peteris.rocks/blog/latvian-part-of-speech-tagging|LVTagger]] 
-^ maďarština |  ✔  |        |  [[http://www.inf.u-szeged.hu/projectdirs/hlt/en/Szeged%20Treebank%202.0_en.html|anglicky]]  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_hu&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/RFTagger/|RFTagger]] +^ maďarština |  ✔  |        |  [[http://www.inf.u-szeged.hu/projectdirs/hlt/en/Szeged%20Treebank%202.0_en.html|anglicky]]  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~CCeWgGmqmcqi|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/RFTagger/|RFTagger]] 
-^ němčina |  ✔  |  ✔  |  [[https://www.sketchengine.co.uk/German-rftagger-part-of-speech-tagset/|anglicky]] %%**%%)  |  [[http://utkl.ff.cuni.cz/%7Erosen/public/stts_guide.pdf|německy]]  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_de&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/RFTagger/|RFTagger]] +^ němčina |  ✔  |  ✔  |  [[https://www.sketchengine.co.uk/German-rftagger-part-of-speech-tagset/|anglicky]] %%**%%)  |  [[http://utkl.ff.cuni.cz/%7Erosen/public/stts_guide.pdf|německy]]  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~gs4MCm8iuEea|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/RFTagger/|RFTagger]] 
-^ nizozemština |  ✔  |  ✔    |   [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/dutch-tagset.txt|anglicky]]  |    [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_nl&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ nizozemština |  ✔  |  ✔    |   [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/dutch-tagset.txt|anglicky]]  |    [[https://www.korpus.cz/kontext/wordlist/result?q=~58AMOGUAOg6I|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ norština |  ✔  |  ✔  |  [[http://universaldependencies.org/docs/u/pos/index.html|anglicky]]%%****%%)  |  [[https://universaldependencies.org/no/index.html#morphology|anglicky]]%%****%%)  |    [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_no&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[https://web.archive.org/web/20170122231904/http://lindat.mff.cuni.cz/services/udpipe/api-reference.php|UDPipe]] +^ norština |  ✔  |  ✔  |  [[http://universaldependencies.org/docs/u/pos/index.html|anglicky]]%%****%%)  |  [[https://universaldependencies.org/no/index.html#morphology|anglicky]]%%****%%)  |    [[https://www.korpus.cz/kontext/wordlist/result?q=~I6aemQOK8yiU|ukázat]]  | [[https://web.archive.org/web/20170122231904/http://lindat.mff.cuni.cz/services/udpipe/api-reference.php|UDPipe]] 
-^ polština |  ✔  |  ✔  |  [[http://nkjp.pl/poliqarp/help/ense2.html#x3-20002|anglicky]] a [[http://nkjp.pl/poliqarp/help/plse2.html#x3-20002|polsky]]  |  [[http://nlp.ipipan.waw.pl/%7Eadamp/Papers/2003-eacl-ws12/|anglicky]]  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_pl&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  |[[http://sgjp.pl/morfeusz/|Morfeusz]], [[https://github.com/kwrobel-nlp/krnnt|KRNNT]] +^ polština |  ✔  |  ✔  |  [[http://nkjp.pl/poliqarp/help/ense2.html#x3-20002|anglicky]] a [[http://nkjp.pl/poliqarp/help/plse2.html#x3-20002|polsky]]  |  [[http://nlp.ipipan.waw.pl/%7Eadamp/Papers/2003-eacl-ws12/|anglicky]]  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~ReKM6qg4Ic8W|ukázat]]  |[[http://sgjp.pl/morfeusz/|Morfeusz]], [[https://github.com/kwrobel-nlp/krnnt|KRNNT]] 
-^ portugalština |  ✔  |  ✔  |  [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/Portuguese-Tagset.html|španělsky]]  |      [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_pt&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ portugalština |  ✔  |  ✔  |  [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/Portuguese-Tagset.html|španělsky]]  |      [[https://www.korpus.cz/kontext/wordlist/result?q=~saGaiAI0uEMo|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ ruština |  ✔  |  ✔  |  [[http://corpus.leeds.ac.uk/mocky/ru-table.tab|anglicky]]  |  [[http://nl.ijs.si/ME/V4/msd/html/msd-ru.html|anglicky]] %%***%%)  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_ru&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  |[[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ ruština |  ✔  |  ✔  |  [[http://corpus.leeds.ac.uk/mocky/ru-table.tab|anglicky]]  |  [[http://nl.ijs.si/ME/V4/msd/html/msd-ru.html|anglicky]] %%***%%)  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~T2sc4y6Uw2WO|ukázat]]  |[[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ slovenština |  ✔  |  ✔  |  [[http://korpus.sk/morpho.html/|slovensky]] [[https://korpus.sk/morpho_en.html/|anglicky]]  |  [[https://korpus.sk/attachments/morpho_en/tagset-www.pdf|slovensky]]  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_sk&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://conference.ui.sav.sk/wikt2010/papers/01_garabik_f.pdf|Radovan Garabík, Morče]] +^ slovenština |  ✔  |  ✔  |  [[http://korpus.sk/morpho.html/|slovensky]] [[https://korpus.sk/morpho_en.html/|anglicky]]  |  [[https://korpus.sk/attachments/morpho_en/tagset-www.pdf|slovensky]]  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~qkQQs4cq2IyG|ukázat]]  | [[http://conference.ui.sav.sk/wikt2010/papers/01_garabik_f.pdf|Radovan Garabík, Morče]] 
-^ slovinština |  ✔  |  ✔  |    [[http://nl.ijs.si/jos/msd/html-en/josMSD-en.html|anglicky]]  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_sl&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[https://github.com/clarinsi/reldi-tagger|ReLDI Tagger]] +^ slovinština |  ✔  |  ✔  |    [[http://nl.ijs.si/jos/msd/html-en/josMSD-en.html|anglicky]]  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~jQMEsa8MuCQm|ukázat]]  | [[https://github.com/clarinsi/reldi-tagger|ReLDI Tagger]] 
-^ srbština |  ✔  |  ✔  |  [[https://www.sketchengine.eu/multext-east-serbian-part-of-speech-tagset/|anglicky]]  |   [[http://nl.ijs.si/ME/V4/msd/html/msd-sr.html|anglicky]]    [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_sr&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[https://github.com/clarinsi/reldi-tagger|ReLDI Tagger]]   | +^ srbština |  ✔  |  ✔  |  [[https://www.sketchengine.eu/multext-east-serbian-part-of-speech-tagset/|anglicky]]  |   [[http://nl.ijs.si/ME/V4/msd/html/msd-sr.html|anglicky]]    [[https://www.korpus.cz/kontext/wordlist/result?q=~3C8YOAWM0IIC|ukázat]]  | [[https://github.com/clarinsi/reldi-tagger|ReLDI Tagger]]   | 
-^ španělština |  ✔  |  ✔  |  [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/spanish-tagset.txt|anglicky]]  |      [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_es&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] +^ španělština |  ✔  |  ✔  |  [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/data/spanish-tagset.txt|anglicky]]  |      [[https://www.korpus.cz/kontext/wordlist/result?q=~twEuIaMu4sSQ|ukázat]]  | [[http://www.cis.uni-muenchen.de/~schmid/tools/TreeTagger/|TreeTagger]] 
-^ švédština |  ✔  |  ✔  |  [[http://spraakbanken.gu.se/korp/markup/msdtags.html|švédsky a anglicky]]        [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_sv&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[http://www.ling.su.se/english/nlp/tools/stagger/stagger-the-stockholm-tagger-1.98986|Stagger]] +^ švédština |  ✔  |  ✔  |  [[http://spraakbanken.gu.se/korp/markup/msdtags.html|švédsky a anglicky]]        [[https://www.korpus.cz/kontext/wordlist/result?q=~hOAuiSoQMGQe|ukázat]]  | [[http://www.ling.su.se/english/nlp/tools/stagger/stagger-the-stockholm-tagger-1.98986|Stagger]] 
-^ ukrajinština |  ✔  |  ✔  |  [[http://universaldependencies.org/docs/u/pos/index.html|anglicky]]%%****%%)  |  [[https://universaldependencies.org/uk/index.html#morphology|anglicky]]%%****%%)  |  [[https://kontext.korpus.cz/wordlist/result?wlnums=frq&wlpat=.*&blhash=&include_nonwords=0&wlsort=f&corpname=intercorp_v14_uk&wlattr=tag&usesubcorp=&wlminfreq=1&wlhash=&wlpage=1|ukázat]]  | [[https://web.archive.org/web/20170122231904/http://lindat.mff.cuni.cz/services/udpipe/api-reference.php|UDPipe]]  |+^ ukrajinština |  ✔  |  ✔  |  [[http://universaldependencies.org/docs/u/pos/index.html|anglicky]]%%****%%)  |  [[https://universaldependencies.org/uk/index.html#morphology|anglicky]]%%****%%)  |  [[https://www.korpus.cz/kontext/wordlist/result?q=~iQ0owcu4o2eQ|ukázat]]  | [[https://web.archive.org/web/20170122231904/http://lindat.mff.cuni.cz/services/udpipe/api-reference.php|UDPipe]]  |
  
 <wrap lo>%%*%%) Morfologické značky jsou v korpusu uvedeny v kondenzované podobě, např. V:Sg:Nom:Act:PrfPrc:Pos odpovídá zápisu s atributy [POS=V] [NUM=SG] [CASE=NOM] [VOICE=ACT] [PCP=PRFPRC] [CMP=POS]. Podobně Pron:Pers:Sg:Ade:Up odpovídá zápisu [POS=PRON] [SUBCAT:PERS] [NUM:SG] [CASE=ADE] [CASECHANGE=UP].</wrap> <wrap lo>%%*%%) Morfologické značky jsou v korpusu uvedeny v kondenzované podobě, např. V:Sg:Nom:Act:PrfPrc:Pos odpovídá zápisu s atributy [POS=V] [NUM=SG] [CASE=NOM] [VOICE=ACT] [PCP=PRFPRC] [CMP=POS]. Podobně Pron:Pers:Sg:Ade:Up odpovídá zápisu [POS=PRON] [SUBCAT:PERS] [NUM:SG] [CASE=ADE] [CASECHANGE=UP].</wrap>