Скачать книгу

парсимонии широко используется для поиска эволюционных деревьев. Но в том случае, когда конвергенций и реверсий слишком много – а это случается и с последовательностями ДНК, и с текстами Чосера, – метод парсимонии может оказаться недостоверным. Эта проблема известна как “эффект притяжения длинных ветвей”.

      Кладограммы – как укорененные, так и неукорененные – отражают лишь порядок ветвления. Филограммы, или филогенетические деревья, похожи на кладограммы, но в них длина ветвей несет дополнительную информацию. Обычно длина ветвей отражает эволюционное расстояние: длинные ветви обозначают крупные изменения, а короткие – мелкие. На основе первой строки “Кентерберийских рассказов” можно построить следующую филограмму.

      Здесь длина ветвей не слишком различается. Но представьте, что будет, если два манускрипта сильно отличаются от двух других. Тогда ветви первых манускриптов будут очень длинными. Однако изменения могут оказаться не уникальными. Изменения могут случайно оказаться идентичными изменениям в другом месте древа. Но с наибольшей вероятностью (именно в этом заключается проблема) они совпадут с изменениями на другой длинной ветви. Ведь длинные ветви – это те, в которых произошло наибольшее число изменений. И если изменений окажется слишком много, две длинные ветви на филограмме будут отображаться как родственные, даже если это не так. Таким образом, метод парсимонии, основываясь на простом подсчете изменений, может ошибочно сгруппировать две самые длинные ветви, “притянуть” их друг к другу.

      Эффект притяжения длинных ветвей – серьезная помеха для систематики. Он проявляется везде, где много конвергенций и реверсий. К сожалению, эту проблему нельзя решить простым увеличением объема рассматриваемого текста. Наоборот, чем больше текст, тем выше вероятность обнаружения случайных совпадений. Про такие деревья говорят, что они лежат в “зоне Фельзенстайна” (звучит устрашающе!), названной в честь американского биолога Джо Фельзенстайна. Увы, ДНК особенно подвержена эффекту притяжения длинных ветвей. Основная причина в том, что в ДНК всего четыре “буквы”. Поскольку большинство изменений затрагивают всего одну “букву”, случайные мутации с высокой вероятностью могут привести к совпадениям. Так возникает притяжение длинных ветвей. Очевидно, что для таких случаев нужна альтернатива методу парсимонии. Она существует – это метод правдоподобия. В последнее время он используется все чаще.

      Оценка правдоподобия требует больше вычислительных мощностей, чем метод парсимонии, поскольку здесь мы учитываем длину ветвей. Таким образом, приходится иметь дело с еще большим количеством деревьев: вдобавок к рассмотрению возможных схем ветвления мы должны учитывать возможные длины ветвей. Геркулесов труд! Поэтому, несмотря на упрощенные методы вычисления, компьютеры пока могут подвергнуть анализу небольшое количество видов.

      Термин “правдоподобие” здесь имеет вполне точное значение. Возьмем древо определенной