############## file all.corpus.words.csv ############## 
uid 				- сквозной уникальный номер
word.id 			- слово
item.id 			- уникальный идентификатор предложения
word.serial.no 		- номер слова в предложении
item.text 			- текст предложения
Lemma 				- лемма
POS 				- часть речи
Form 				- морфологический разбор при помощи mystem2 (с неснятой неоднозначностью)
Form.disamb			- морфологический разбор со снятой неоднозначностью
fl 					- 1, если слово первое или последнее в предложении (нужно, потому что мы исключаем первое и последнее слов в айтрекинг-данных)
X0 					- количество раз, когда слово (точная словоформа) не было угадано
X1 					- количество раз, когда слово (точная словоформа) было угадано
average.accuracy 	- вероятноcть угадать это слово (количество успехов на количество попыток)
rsc_f_v_ipm			- частотность словоформы по подкорпусу со снятой неоднозначностью, которые прислала Ляшевская, всего 458219 словоформ, общая частотность - 999842.589999353) 
initial.bigram 		- первая биграмма (бралась по написанию с ё, см. ниже)
initial.trigram		- первая триграмма (бралась по написанию с ё, см. ниже)
rsc_inf_bi_l 		- количество лемм, начинающихся в первой биграммы (на основе словаря Ляшевской и Шарова)	
rsc_inf_bi_f 		- количество уникальных словоформ, начинающих с первой биграммы (по всем возможным словоформам, составляющих парадигму лемм из пункта выше, построение словоформ по леммам производилось при помощи видоизменненого грамматического словаря)
rsc_inf_tri_l 		- то же самое, но про триграммы как rsc_inf_bi_l
rsc_inf_tri_f		- то же самое, но про триграммы как rsc_inf_bi_f
rsc_inf_bi_f_rucrp	- количество словоформ, начинающих с первой биграммы (словоформы взяты из подкорпуса со снятой неоднозначностью, которые прислала Ляшевская, всего 458219 словоформ, общая частотность - 999842.589999353)
rsc_inf_tri_f_rucrp	- то же самое, но про триграммы как rsc_inf_bi_f_rucrp
rsc_fam_bi_l		- частотность всех лемм, начинающихся на данную биграмму (на основе словаря Ляшевской и Шарова)
rsc_fam_tri_l		- то же самое, но про триграммы как rsc_fam_bi_l
rsc_fam_bi_f_rucrp	- частотность всех форм, начинающихся на данную биграмму (словоформы взяты из подкорпуса со снятой неоднозначностью, которые прислала Ляшевская, всего 458219 словоформ, общая частотность - 999842.589999353)
rsc_fam_tri_f_rucrp	- то же самое, но про триграммы как rsc_fam_bi_f_rucrp
rsc_form_with_yo	- запись с ё (почти у всех слов ё изначально было, кроме слова гнезда)
rsc_form_no_yo		- запись без ё
rsc_inf_same_bi_l	- количество лемм, начинающихся в первой биграммы (на основе словаря Ляшевской и Шарова) и имеющих ту же длину, что и слово из корпуса
inf_bi				- informativeness of the bigram (посчитанная, на основе форм)
rsc_inf_same_tri_l	- количество лемм, начинающихся в первой триграммы (на основе словаря Ляшевской и Шарова) и имеющих ту же длину, что и слово из корпуса
inf_tri				- informativeness of the trigram (посчитанная, на основе форм)
rsc_inf_same_bi_f_rucrp	- количество словоформ, начинающих с первой биграммы (словоформы взяты из подкорпуса со снятой неоднозначностью, которые прислала Ляшевская, всего 458219 словоформ, общая частотность - 999842.589999353) и имеющих ту же длину, что и слово из корпуса
rsc_inf_same_tri_f_rucrp - количество словоформ, начинающих с первой триграммы (словоформы взяты из подкорпуса со снятой неоднозначностью, которые прислала Ляшевская, всего 458219 словоформ, общая частотность - 999842.589999353) и имеющих ту же длину, что и слово из корпуса
base.form			- стоит ли слово в базовой (словарной) форме
ambig				- является ли словоформа неоднозначной (морфологически)
sense_number        - количество значений в соответствие с Новым толково-словообразовательным словарем русского языка (Ефремова, 2000)
word.as.txt         - слово, как было показано испытуемому
morph.structure     - поверхностные морфемы, из которых состоит слово
morph.structure     - количество морфем, из которых состоит слово
morph.structure.j   - морфемы, из которых состоит слово (некоторые суффиксы не отображаются на письме/входят в состав других морфем). Здесь попытка отобразить такие случаи
stress.pos          - позиция ударения в символах от начала слова
stress.pos.syl      - позиция ударения в слогах от начала слова
has.stress.variant  - есть у слова омограф
form.suff           - формообразующие суффиксы в составе слова



