TGViewer
Channel Public Channel
я обучала одну модель

я обучала одну модель

@def_model_train

Shitposting on various subjects

PS рекламы в канале нет
Subscribers
4.48K
Photos
458
Videos
29
Links
385

Showing posts older than #537 · Back to latest

Older Posts 17 shown
Post #535 248
такие у меня сегодня вопросы
Post #534 242
буду твоим песиком (это том 10)
Post #533 245
Одна история охуительней другой если честно
Post #532 248
О сколько открытий чудных можно совершить, открыв полное собрание сочинений Пушкина (это том 3)
Post #530 269
Вообще с к*рсовой происходит ставший уже классическим для меня вид жопной боли – ты кучу времени въебывашь на то, чтоб какая-то тупая nlp моделька начала давать какие-то результаты, чтобы потом узнать, что это все умеет делать BERT, при чем с довольно неплохим качеством. Я так где-то месяц обучала Latent dirichlet allocation во всех возможных конфигурациях, он почти при любом раскладе выдавал хуйню (ну, кроме топиков типа abort_cells и pray_jesus), а BERTopic сделал что-то осмысленное почти с первого запуска.
Еще больше времени я убила на работу с лексиконами. И да, наверное, в моем случае юзать лексиконы, чтобы определить сентимент скор твита это методологически оправдано (потому что лексиконы можно редактировать руками, как на картинке выше, и это можно туда добавить всякие слова специфичные для этой кампании типа sleepy или laptop), но half the time с этими сентиментами выходит тоже хуйня. И вот вчера я чуть ли не на стартовой странице huggingface со списком моделек вижу, что bert умеет считать сенимент скоры и так. И то есть всей этой дрочильни ручками могло и не быть. Мда.
Летом конечно обязательно обучу это все на берте и попробую пропихнуть как публикацию, но вот такой крик души
Post #529 243
работа над к*рсовой идет хорошо (нет)
Post #528 380
Иногда в 2 часа ночи приходится задаться вопросом, как работают генераторы в питоне....

Небольшая подборка для тех, кто в последний раз слово yield видел на парах по эконому (как и я собсна): базовое объяснение, более сложный пример с прохождением по графу и немножко с разбором логики всего процесса, примерчики где это хорошо использовать
Хабр Как работает yield На StackOverflow часто задают вопросы, подробно освещённые в документации. Ценность их в том, что на некоторые из них кто-нибудь даёт ответ, обладающий гораздо б...
Post #527 263
я обучала одну модель Мы тут с товарищами кстати запилили нейронку, которая генерит твиты в стиле Пушкина. Пока это все в тестовом режиме, но скоро будут нормальные почищенные данные + видимо нам дадут ru gpt3 xl сберовскую 👀 Уже сейчас моделька может выдавать кеки типа этого:…
все так
Post #525 242
Мы тут с товарищами кстати запилили нейронку, которая генерит твиты в стиле Пушкина. Пока это все в тестовом режиме, но скоро будут нормальные почищенные данные + видимо нам дадут ru gpt3 xl сберовскую 👀
Уже сейчас моделька может выдавать кеки типа этого:
https://twitter.com/NeuralPushkin/status/1386751533447012357
Twitter Neural Pushkin Сегодня в метро услышал, как один из проводников по громкоговорителю сообщил: «Сейчас за мной придет женщина и принесет мне стакан воды». Я опешил. Оказывается на этот счет есть статья Уголовного кодекса — до двух лет лишения свободы условно с испытательным…
Post #523 236
И немного демонстрации того, что можно вытащить через этот пакет
Post #522 260
Как известно, Твиттер почти никогда не дает свой стриминг апи русским, по причине русских хакеров, которые в 2016 украли выборы. Недавно вы могли видеть громкие слова о том, что Твиттер opening up its full tweet archive to academic researchers for free, но это тоже только для девелоперов.
Что делать, если вы русский и все еще хотите ресерчить, что там пишут пендосы? На самом деле решений дохуя и больше.
1. При наличии айди твитов (их периодически выкладывают в открытых датасетах на гитхабе, так как это не противорчит политике конфиденциальности), можно подрубить Hydrator и восстановить сами твиты с некоторой метаинформацией типа описания профиля юзера. Парсится долго и нудно, но чет мне подсказывает, что стриминг апи не очень быстрее. Еще периодически вас могут банить, так как софт симулирует открытие самих твитов с вашего аккаунта, ну и когда вы за час смотрите несколько тысяч твитов без перерыва, твиттеру становится странно.
2. Совершенно волшебный пакет для R, который без наличия апи твиттера (но при наличии совершенно рандомного пустого акка, который вам не жалко) может дать вам считать инфу о пользователях. Если быть точнее, эта штука вытаскивает одновременно 90 (девяносто) параметров по юзерам, вплоть до графов пользователей (!!! вообще это фича только для девов). Очень интересно, почему в твиттере всем так похуй, что это все можно выкачать просто вот так. Конечно, есть лимит запросов, но вроде он исчисляется десятками тысяч.
The Verge Twitter is opening up its full tweet archive to academic researchers for free A full searchable archive of public tweets will now be available for free.
Post #520 222
я обучала одну модель Остановите русскую gpt3 пока не поздно
уже лучше
Post #519 217
что волнует американский народ [2]
Post #518 233
Тайны эйчара сбера (хайрят по фотке)
Post #517 283
я обучала одну модель Прикладываю все ссылки, использованные мной, чтобы заботать a/b тесты за полтора дня: 1. Вообще что это такое 2. Очень подробно про t-test, критерий Манна-Уитни и бутстрап (включая ограничения и преимущества каждого из подходов) 3. Отдельно про бутстрап…
It's official: эти ссылки + 40 задачек на sql-ex + знание nlp и берта в частности дадут вам хороший оффер
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →