Alignment with experimental da... Note

Alignment with experimental data improves protein generative modeling

Direct preference optimization (DPO) aligns a pretrained protein language model with experimental stability data, yielding ProteinDPO, a model that scores and generates thermostable protein sequences. Applied to H5N1 influenza hemagglutinin, it achieved large improvements in thermal stability of hemagglutinin while preserving antibody recognition.