실험 데이터와의 정렬은 단백질 생성 모델링을 향상시킨다 노트

실험 데이터와의 정렬은 단백질 생성 모델링을 향상시킨다

Direct preference optimization (DPO)는 사전 훈련된 단백질 언어 모델을 실험적 안정성 데이터에 맞춰 조정하여, 열 안정적인 단백질 서열의 점수를 매기고 생성하는 모델인 ProteinDPO를 생성합니다. H5N1 인플루엔자 헤마글루티닌에 적용했을 때, 항체 인식을 유지하면서 헤마글루티닌의 열 안정성을 크게 향상시켰습니다.