Новый метод стандартизации наборов данных ископаемой пыльцы для экологических исследований

Исследование, опубликованное в Global Ecology and Biogeography, представляет пошаговое руководство по объединению многочисленных наборов данных ископаемой пыльцы в стандартизированную и очищенную компиляцию, готовую для анализа.

За последние десять лет произошел значительный рост количества данных об ископаемой пыльце со всего мира в базах данных открытого доступа. Однако существуют сложности в объединении этой информации для изучения изменений биоразнообразия.

Исследователь Сюзетт Флантюа и ее коллеги создали руководство с советами по компиляции данных об ископаемой пыльце, чтобы обеспечить их стандартизированное использование и минимизировать риск ошибочных интерпретаций.

«Эти наборы данных поступают из разных сред по всему миру, они отобраны и проанализированы разными исследователями и представляют собой разнообразные растительные сообщества. Перед любым анализом такую компиляцию необходимо тщательно отобрать, чтобы гарантировать хорошее качество данных», — говорит Флантюа.

Универсальное руководство по обработке данных

Руководство, разработанное для упрощения подготовки данных, состоит из рабочего процесса FOSSILPOL, пакета для R (RFossilpol) и веб-сайта.

Рабочий процесс FOSSILPOL обрабатывает большинство этапов обработки (связанных со средой осадконакопления, хронологией, фильтрацией и таксономической гармонизацией), требуя ввода от пользователя на определенных этапах. Все критерии и конфигурации определяются в одном основном файле конфигурации.

Конечными результатами рабочего процесса являются:

  • Стандартизированная компиляция таксономически гармонизированных данных об ископаемой пыльце.
  • Графики смоделированных возрастно-глубинных кривых и диаграммы пыльцы для каждой записи.
  • Несколько обзорных графиков и карт.

Соавторы подчеркивают, что руководство повышает воспроизводимость и прозрачность исследований, поскольку все решения на этапах обработки данных становятся прозрачными и хорошо документированными. Компиляция данных является динамической и будет обновляться по мере появления новых данных в открытом доступе.