本文へスキップ
日本語
FikirPilot の記事

製薬会社の機密データがAIタンパク質モデルを強化

更新日: 2026年9月15日 · 2 分で読めます

公開: · 記事の受信: · 処理時間: 10 時間 46 分

製薬会社の機密データがAIタンパク質モデルを強化
研究室内の3Dタンパク質モデル

製薬会社が形成したコンソーシアムは、各社のアーカイブにある20,000を超えるタンパク質構造を用いてOpenFold3を訓練した。新しいモデルは、公開データのみ、または1社のデータのみで訓練されたモデルよりも優れた性能を示した。査読を受けていないこの研究はブログ記事で発表されたが、モデルは一般公開されていない。

なぜ重要か

この結果は、タンパク質構造モデリングにおいて、データプールの広さだけでなく、企業間で共有可能な非公開データも性能比較に影響を及ぼし得ることを示唆している。この状況は、公開データを用いて研究する研究者にとって、アクセスできない企業のアーカイブが競争条件をどのように変えるのかという問題を提起している。一方、製薬会社にとっては、共同利用されるデータが、単一の組織のリソースに基づく研究とは異なる結果をもたらすかどうかが重要になっている。しかし、この研究はまだ査読者による検証を受けておらず、モデルも利用可能になっていないため、現時点では、知見を独立して検証し、手法を詳細に評価し、他のチームが検証することはできない。いずれの状況も、性能差がデータの統合に起因するのか、それともモデルの他の特性に起因するのかを未解決のままにしている。

出典: Nature Machine Learning