İlaç şirketlerinin oluşturduğu konsorsiyum, şirket arşivlerindeki 20.000’den fazla protein yapısıyla OpenFold3’ü eğitti. Yeni model, yalnızca kamuya açık verilerle veya tek bir şirketin verileriyle eğitilen modellere göre daha iyi performans gösterdi. Hakem değerlendirmesinden geçmeyen çalışma blog yazısıyla duyuruldu; model kamuya açılmadı.
Neden önemli
Sonuçlar, protein yapısı modellemesinde veri havuzunun genişliği kadar, şirketler arasında paylaşılabilen özel verilerin de performans karşılaştırmalarını etkileyebileceğine işaret ediyor. Bu durum, kamuya açık verilerle çalışan araştırmacılar açısından erişilemeyen kurumsal arşivlerin rekabet koşullarını nasıl değiştirdiği sorusunu gündeme getiriyor. İlaç şirketleri içinse ortaklaşa kullanılan verilerin, tek bir kuruluşun kaynaklarına dayanan çalışmalardan farklı sonuçlar sağlayıp sağlamadığı önem kazanıyor. Ancak çalışma henüz hakemler tarafından incelenmediği ve model kullanıma açılmadığı için bulguların bağımsız biçimde doğrulanması, yöntemin ayrıntılı olarak değerlendirilmesi ve başka ekiplerce sınanması şimdilik mümkün değil. Her iki durum da performans farkının veri birleşiminden mi, yoksa modelin diğer özelliklerinden mi kaynaklandığını açık bırakıyor.