На этой таблице:
N - номер горизонтальной строки - это номер позиции ударной гласной (т.е. номер ударного слога)
K - номер вертикального столбца - это количество гласных букв в слове (т.е. число слогов в слове)
число в ячейке таблицы - количество слов
Частное от деления N /K является критерием относительной позиции ударения,т.е.
ударным является слог: первый, второй,...последний.
Число, указанное в ячейке таблицы, (количество слов), отражает статистику, т.е. распространенность
такой позиции ударения.
Например, значения в ячейках с совпадающими номерами строки и столбца (N/K = 1) показывают
распространенность слов, имеющих ударение на последнем слоге.
В статистической матрице использован принцип "цветовой дифференциации штанов":
желтый - максимальное значение
красный - выше 50% от максимального
зеленый - от 30% до 50%
синий - ниже 30%
Таким образом, желто-красно-зеленая область показывает статистическое ядро распределения ударений
ВНИМАНИЕ ! В таблицах клик по числу в ячейке открывает список слов,
удовлетворяющих данному соотношению (действует ограничение в слов).
Ранги отношения N/K
| Ранг | N/K | Слов |
|---|
| 1
| 1
| 19380
|
|
| 2
| 0.67
| 14518
|
|
| 3
| 0.5
| 11263
|
|
| 4
| 0.75
| 10990
|
|
| 5
| 0.6
| 4609
|
|
| 6
| 0.33
| 4151
|
|
| 7
| 0.8
| 3703
|
|
| 8
| 0.4
| 1262
|
|
| 9
| 0.83
| 951
|
|
| 10
| 0.25
| 835
|
|
| 11
| 0.71
| 725
|
|
| 12
| 0.86
| 232
|
|
| 13
| 0.57
| 207
|
|
| 14
| 0.43
| 196
|
|
| 15
| 0.2
| 128
|
|
| 16
| 0.63
| 63
|
|
| 17
| 0.88
| 43
|
|
| 18
| 0.78
| 26
|
|
| 19
| 0.56
| 13
|
|
| 20
| 0.29
| 8
|
|
| 21
| 0.14
| 8
|
|
| 22
| 0.7
| 5
|
|
| 23
| 0.38
| 3
|
|
| 24
| 0.64
| 1
|
|
| 25
| 0.89
| 1
|
|
Приведенные гистограммы показывают, что распределение значений N/K соответствует .
Частотность n-го слова в списке слов, упорядоченном по убыванию частотности их использования,
обратно пропорциональна рангу этого слова (его порядковому номеру n).
Например, второе по используемости слово встречается примерно в два раза реже, чем первое,
третье — в три раза реже, чем первое, и так далее.
Хотя на самом деле это просто статистический феномен (известный в теории вероятностей как распределение Парето ).
Вероятность случайного появления какого-либо слова длиной N в цепочке случайных символов уменьшается с ростом N
в той же пропорции, в какой растёт при этом ранг этого слова в частотном списке (порядковой шкале).
Потому произведение ранга слова на его частотность есть константа.