Obě strany předchozí revizePředchozí verzeNásledující verze | Předchozí verze |
cnk:syn2020:tag [2021/03/05 10:38] – [2. pozice Detailní určení slovního druhu] jankrivan | cnk:syn2020:tag [2021/06/18 12:44] (aktuální) – [Segment (S)] jankrivan |
---|
Jako **prefixoidy** se značkují první části složených slov, které se obvykle nevyskytují samostatně, ale v daném textu jsou odděleny (nejčastěji spojovníkem a mezerou) od následujícího slova, např. __//troj//__ //- až pětipodlažní//, původně psáno jako //troj- až pětipodlažní//). Značku **S** dostávají také vymezené slovní části, které byly od kompozita odtrženy procesem tokenizace (např. __//makro//__ //- úroveň//, původně psáno jako //makro-úroveň//; viz popis procesu [[cnk:syn2020:tokenizace]]). U prefixoidů se značkují pouze první dvě pozice. Na 2. pozici se vždy uvádí hodnota **2**. | Jako **prefixoidy** se značkují první části složených slov, které se obvykle nevyskytují samostatně, ale v daném textu jsou odděleny (nejčastěji spojovníkem a mezerou) od následujícího slova, např. __//troj//__ //- až pětipodlažní//, původně psáno jako //troj- až pětipodlažní//). Značku **S** dostávají také vymezené slovní části, které byly od kompozita odtrženy procesem tokenizace (např. __//makro//__ //- úroveň//, původně psáno jako //makro-úroveň//; viz popis procesu [[cnk:syn2020:tokenizace]]). U prefixoidů se značkují pouze první dvě pozice. Na 2. pozici se vždy uvádí hodnota **2**. |
| |
Jako **sufixoidy** se značkují pouze striktně vymezené koncové části ohebných slov po lomítku (a případně po spojovníku), jimiž pisatel značí morfologickou alternativu: např. //učitel / // __//ka//__, //podepsal / -// __//a//__. V tagu sufixoidy přebírají na dalších pozicích všechny značky od morfologické třídy, kterou zastupují, např. //ka// z výše uvedeného příkladu bude mít tag %%SNFS1-----A----%%. | Jako **sufixoidy** se značkují pouze striktně vymezené koncové části substantiv a adjektiv po lomítku (a případně po spojovníku), jimiž pisatel značí morfologickou alternativu: např. //učitel / // __//ka//__, //pověřený / -// __//á//__. U slovesných příčestí (např. //viděl / a//, //unaven / -a//) budou kvůli chybě ve zpracování sufixoidy anotovány až od korpusu SYNv10. V tagu sufixoidy přebírají na dalších pozicích všechny značky od morfologické třídy, kterou zastupují, např. //ka// z výše uvedeného příkladu bude mít tag %%SNFS1-----A----%%. |
| |
==== Slovnědruhové přehodnocení některých skupin ==== | ==== Slovnědruhové přehodnocení některých skupin ==== |
===== 13. pozice Vid ===== | ===== 13. pozice Vid ===== |
| |
Dříve nevyužívaná 13. pozice se nyní používá pro slovesný vid, a proto již tag nemá 16. pozici. Možné hodnoty jsou **I**, **P** a **B**. | Dříve nevyužívaná 13. pozice se nyní používá pro slovesný vid, a proto již tag nemá 16. pozici. Možné hodnoty jsou **I**, **P** a **B**. Na rozdíl od předchozích korpusů je značka **B** vyhrazena pro skutečná obouvidá slovesa (např. //soustředit se//, //analyzovat//, apod.), zatímco slovesa vidově homonymní (např. //zahýbat//, //nalétat// apod.) jsou desambiguována. |
| |
===== 15. pozice Varianta ===== | ===== 15. pozice Varianta ===== |