Уряд США, Google та Meta долучилися до масштабної ініціативи Biohub зі створення відкритих біологічних даних для навчання моделей штучного інтелекту. Загальний обсяг інвестицій у проєкт сягне $1,8 млрд.
Про це повідомляє Reuters.
Йдеться про Virtual Biology Initiative - проєкт некомерційної організації Biohub, заснованої керівником Meta Марком Цукербергом та його дружиною Прісциллою Чан.
Meta, Google DeepMind та стартап Isomorphic Labs спільно інвестують у проєкт $300 млн. Міністерство енергетики США протягом п'яти років вкладе понад $500 млн у лабораторні дослідження, моделювання та обчислення. Ще понад $500 млн федерального фінансування вже спрямували на створення наборів даних та спеціальних сховищ під координацією Національних інститутів здоров'я США. Раніше сам Biohub оголосив про інвестиції у розмірі $500 млн.
Мета ініціативи — зібрати значно більше даних про те, як клітини реагують на різні зміни та умови, а потім використати їх для навчання моделей ШІ. Розробники сподіваються, що такі моделі зможуть прогнозувати поведінку клітин і в перспективі прискорити створення нових ліків, яке нині може тривати роками.
Для формування бази даних науковці, зокрема, використовуватимуть просторову транскриптоміку, яка дає змогу відстежувати молекулярну активність у тканинах, а також досліджуватимуть реакцію клітин на зміни середовища.
У Biohub зазначають, що сучасні набори даних охоплюють сотні мільйонів клітин, тоді як для створення точних прогнозних моделей можуть знадобитися дані про мільярди, а згодом і трильйони клітин. Перший набір даних у межах ініціативи планують підготувати приблизно за рік, а точні прогнозні моделі — протягом п'яти років.
Зібрані дані згодом планують зробити загальнодоступними. Водночас приватні компанії, які фінансують їх створення, матимуть певний період пріоритетного доступу. Дані, створені за державне фінансування, таких обмежень не матимуть.

