如果您愿意贡献闲置的计算能力来抗击新冠疫情,请访问Folding@home 网站了解更多。
自去年二月起,Folding@home——一个旨在研究包括癌症、埃博拉和阿尔茨海默病在内的疾病起源的大规模分布式计算项目——将注意力转向新冠疫情。全球已有超过20万人捐赠其闲置计算能力以支持这一紧迫事业。
通过下载 Folding@home 软件并在计算机后台运行,任何人都可以在任何地方帮助研究人员模拟与新冠疫情相关的蛋白质行为。
这种全球协作的成果是世界上最首个“艾克斯算力”(exascale)分布式计算资源。它是一台每秒可进行千万亿次计算的超级计算机,正在生成前所未有的大规模数据集,并通过Amazon Web Services 开放数据注册表向全球研究人员提供这些数据。
“我们的模拟本质上就是蛋白质的许多图像,”Folding@home 主任 Greg Bowman 表示,“如果只有10张图像,我们可以手动查看、比较并做出推断。然而,我们有数亿张图像。数据的庞大体量以及人类有限的带宽意味着我们所做的任何事情都需要自动化。”
“这就是为什么我们需要如此巨大的计算能力,也是为什么我们将数据提供在 AWS 云上的原因。我们需要尽可能多地让大脑并行工作,以便获得成果。”
“我们正在积极利用这些数据进行药物发现,”Bowman 继续说道,“我们已有化合物进入测试阶段,并希望在未来六个月内进入一期临床试验。我们启动这个项目是为了回答一些非常基础的研究问题,而目前的反响完全超出了我们的预期。”
Folding@home 只是通过AWS 开放数据赞助计划在云端提供的众多数据集之一。该计划为对科学界具有高价值的存储成本提供资助,旨在:
- 通过在 AWS 上提供数据分析访问来促进数据获取的民主化;
- 开发新的云原生技术、格式和工具以降低数据处理成本;
- 鼓励受益于共享数据集访问的社区发展。
了解更多关于如何AWS 正在支持 Folding@home 项目。
什么是大规模分布式计算项目?
在大规模分布式计算项目中,个人可以将闲置的计算能力贡献给特定项目。这通常是为了帮助生成解决复杂问题所需的海量计算或模拟。例如,Folding@home 利用计算机模拟来理解与多种疾病(包括新冠肺炎)相关的蛋白质运动。
什么是百亿亿次超级计算机?
当今最快的计算机每秒能够进行一万亿(即百万亿)次计算。为了帮助理解这一数量级,地球上昆虫的数量也达到万亿级别,据估计数量超过人类(我们全人类大约70亿人)以2亿比1的比例。但即使这种计算能力,与“艾克斯级”超级计算机相比也显得微不足道,后者每秒可进行一千万亿次,即 1,000,000,000,000,000,000 次计算。
Folding@home 正在生成多少数据?
截至目前,Folding@home 产生的数据量已超过 100,000 倍于通常为其他模拟研究创建的 COVID-19 相关数据。在 Folding@home 将这些数据发布到 AWS Open Data Registry 之前,由于文件体积庞大,共享这些数据极其耗时且繁琐,有时甚至需要邮寄物理硬盘来传输数据集。通过将其置于云端,任何感兴趣的用户都可以按需快速下载这些信息。

