CD-HIT: ускоренный для кластеризации данных новейших секвенирующих технологий

CD-HIT: accelerated for clustering the next-generation sequencing data
Weizhong Li, Beifang Niu, LiMin Fu, Zhengwei Zhu, Sitao Wu
2012-10-11

CD-HITснижение избыточности последовательностей для высокопроизводительных данныхсеквенирование следующего поколенияпараллелизациякластеризация последовательностей
CD-HIT — широко используемая программа для кластеризации биологических последовательностей с целью снижения избыточности последовательностей и улучшения производительности других анализов последовательностей. В ответ на быстрый рост объёмов данных секвенирования, генерируемых технологиями следующего поколения, мы разработали новую версию CD-HIT, ускоренную за счёт новой стратегии параллелизации и дополнительных методов, что позволяет эффективно кластеризовать такие наборы данных. Наши тесты продемонстрировали существенное ускорение благодаря параллелизации при использовании до ~24 ядер и квази-линейное ускорение при использовании до ~8 ядер. Усовершенствованный CD-HIT способен обрабатывать очень большие наборы данных за значительно более короткое время по сравнению с предыдущими версиями. Доступность: http://cd-hit.org. Контакт: liwz@sdsc.edu. Дополнительная информация: дополнительные данные доступны в Bioinformatics online.
1
Разработана новая версия CD-HIT с новой стратегией параллелизации и дополнительными приёмами для эффективного кластеризации данных следующего поколения секвенирования.
2
CD-HIT доступен по адресу http://cd-hit.org, дополнительные данные доступны онлайн.
3
Усовершенствованный CD-HIT способен обрабатывать очень большие наборы секвенционных данных значительно быстрее предыдущих версий.
4
Параллелизация обеспечивает очень хорошее ускорение до примерно 24 ядер и почти линейное ускорение до примерно 8 ядер.

Кластеризация наборов биологических последовательностей следующего поколения (NGS) с помощью программы CD-HIT

Производительность и масштабируемость ускоренной параллельной реализации CD-HIT для эффективной кластеризации очень больших NGS-наборов последовательностей (ускорение при использовании нескольких ядер CPU и сокращение времени выполнения)

Publication Details
Publication Date
2012-10-11
Journal
Publisher
ISSN
Access Type
Author Information
Authors
Weizhong Li
Beifang Niu
LiMin Fu
Zhengwei Zhu
Sitao Wu
Explore further
Open the scid.ai AI chat with a ready-made request: it will find papers on a similar topic and help build a literature review.
Find similar papers in the chat
Make a presentation
100%