它通过级联聚类架构、多节点并行和创新的线性模式,首次实现了在合理时间内对 190 亿条蛋白质序列进行敏感聚类,将数据压缩至原来的156,并在此过程中发现了超过 1 亿个未被现有数据库覆盖的新蛋白质家族。 …...