与实验数据对齐可提升蛋白质生成建模 笔记

与实验数据对齐可提升蛋白质生成建模

直接偏好优化(DPO)将预训练的蛋白质语言模型与实验稳定性数据进行对齐,生成了 ProteinDPO 模型,该模型能够对蛋白质序列进行评分并生成热稳定性蛋白质序列。将其应用于 H5N1 流感血凝素时,显著提升了血凝素的热稳定性,同时保留了抗体识别能力。