描述
ProGen3 代表了蛋白质设计的前沿,利用在超过 34 亿个蛋白质序列上训练的亿参数 AI 模型。这些模型旨在生成新型全长蛋白质,并重新设计现有蛋白质的特定区域以增强其功能。该平台采用稀疏架构,实现了四倍的速度提升而不影响性能。ProGen3 在 Profluent Protein Atlas v1 上进行训练,这是一个针对语言模型训练优化的综合数据集,使其能够扩展到 460 亿参数模型。这种扩展使 ProGen3 能够生成以前对较小模型未知的蛋白质家族,显著增加了多样性。
ProGen3 的能力扩展到抗体设计和紧凑基因编辑器。OpenAntibodies 计划展示了其生成与已批准治疗药物亲和力匹配的抗体的能力,且氨基酸组成存在显著差异。这种方法允许这些抗体的免版税或预付费许可。在基因编辑方面,ProGen3 开发了在实验室环境中有效工作的超紧凑蛋白质,解决了 CRISPR-Cas 系统的尺寸限制等挑战。
Profluent 为合作伙伴提供许可其蛋白质资产或合作开发新蛋白质设计的机会。ProGen3 API 的早期访问程序也可用,允许合作伙伴根据特定数据或用例定制模型。该平台有望通过提供创新的蛋白质设计解决方案来改变治疗、农业和生物制造等行业。
ProGen3 蛋白质生成模型亮点
亿参数语言模型
34 亿蛋白质序列
单次抗体设计
超紧凑基因编辑器
稀疏架构以加速
Profluent Protein Atlas v1
460 亿参数模型
API 早期访问程序
ProGen3 蛋白质生成模型入门
配置:设置模型参数
使用:生成或重新设计蛋白质
优化:将模型与实验室数据对齐
合作:与合作伙伴共同开发定制解决方案
ProGen3 蛋白质生成模型的使用案例
- 抗体设计
- 基因编辑
- 蛋白质重新设计
- 生物制造
- 治疗开发






