У человеческого языка есть два статистических свойства, которые долго считали чуть ли не его визитной карточкой. Первое: речь состоит из связных кусочков — слов, внутри которых звуки угадываются гораздо предсказуемее, чем между ними. Второе: в достаточно длинном тексте слова распределяются по закону Ципфа — самое частое встречается вдвое чаще второго по частоте, втрое чаще третьего и так далее. Оказалось, ни то ни другое людям не принадлежит.

Учёные из Великобритании и Японии проанализировали песни самцов японских амадин — певчих птиц, которые учатся петь у старших сородичей. В записях нашлись статистически связные последовательности слогов, распределённые ровно по закону Ципфа, с наклоном около 1,05. Для сравнения: в человеческой речи этот наклон близок к единице. Такими же свойствами, как выяснилось раньше, обладают песни горбатых китов и даже жестовая коммуникация шимпанзе.

Интереснее всего то, как эти закономерности появляются. В экспериментах людям давали запомнить и передать дальше случайный набор символов, не подчиняющийся закону Ципфа. Через несколько передач в хаотичных наборах сами собой возникали связные блоки с нужным распределением. То же самое делала компьютерная модель. Похоже, сам процесс передачи сложных сигналов от одного носителя к другому и порождает эти статистические черты.

У амадин закономерность прослеживалась уже на ранних стадиях обучения, но с возрастом наклон становился круче, а связность блоков из нескольких слогов росла. Когда учёные перемешивали слоги внутри песен или оставляли только частоты пар, ломая более длинные последовательности, все наблюдаемые свойства терялись.

Авторы работы, опубликованной в Science Advances, считают это примером конвергентной эволюции: необходимость запоминать и воспроизводить сложные цепочки звуков у разных видов привела к похожему устройству коммуникации. Значит, статистические законы языка — не уникальная человеческая особенность, а скорее побочный продукт того, как мы учимся друг у друга.