Читаю статью о ДНК-моделе OmniNA.
Идея очень интересная - буквы ДНК пишутся следом за их текстовым обписанием с NCBI (например: this is genome assembly of rhesus monkey иди this is CDS of human EF1a). И на такой смеси ДНК и букв тренируется GPT-модель.
Потом модель может делать как на картинке - выдвать по ДНК описание того, что это за последовтаельность.
Также можно файнтюнить модель прямо текстом: вводится инструкция, потом последовательность ДНК, потом задается вопрос. Получается такой вариант GPT, который адаптирован к работе с ДНК.
Вообще мне кажется, что пока прогресс ДНК-моделей именно в получении биологических сигналов не очень большой это может стать основным направлением их использования - интеграция с текстами, чтобы людям было удобно решить биологические задачи. Чтобы с этим могли комфорртно взаимодействовать "мокрые" биологи, описывая свои вопросы текстом, без написания кода.
https://www.biorxiv.org/content/10.1101/2024.01.14.575543v1.full.pdf
Post #818
1.37K

- 🔥 6
- 👍 4
- ❤ 2