https://www.biorxiv.org/content/10.1101/2024.12.18.628606v1.full
Поскольку мне (видимо как адепту DNA LMs) сегодня сразу из трех независимых источников прислали ссылку на эту статью, решил, что нужно ее коротко разобрать.
Основной тезис авторов в заголовке:
"Genomic Foundationless Models: Pretraining Does Not Promise Performance"
Напомню очень коротко как работают языковые модели ДНК - их сначала предобучают на какой-то общей задаче (часто не имеющей понятного биологического смысла), вроде предсказать замаскированную букву по соседям. А потом файн-тюнят уже для решения задач с понятным смыслом.
Результат авторов - если вообще не претренировать модели, а случайным образом инициализировать, получается немногим хуже (а иногда - удивительно - но даже лучше) решать нужную задачу.
Разбор в комментариях. Мой вывод - если не умеешь пользоваться, никакая претрена не поможет
Post #628
1.54K
image.png316 KB
- 🔥 11
- 🥰 2
- 💩 1
- 🗿 1