TGViewer
Channel Public Channel
🍳 Датазавтраки ☕️ НСК (Академ)

🍳 Датазавтраки ☕️ НСК (Академ)

@databreakfast

Каждый вторник с 8:30 до 10:00 в "Shurubor coffeeshop" у фонтана ТЦ https://go.2gis.com/wlkqi

По всем вопросам к @promsoft . Рекламу не размещаем
Subscribers
682
Photos
251
Videos
15
Links
1.8K

Showing posts older than #2251 · Back to latest

Older Posts 20 shown
Post #2245 227
⬆️ Кстати говорили про внутреннюю размерность
Post #2244 215

Forwarded from Техножрица 👩‍💻👩‍🏫👩‍🔧

Часто грущу от того, что нашей с коллегами последней статьей Unveiling Intrinsic Dimension of Texts: from Academic Abstract to Creative Story никто не интересуется и не цитирует... 💢

Напомню, что статья посвящена анализу внутренней размерности активаций LLM и её связи с различными свойствами текста, который подали на вход модели. Более подробное разъяснение статьи можно найти здесь, посмотреть видос про то, что такое в принципе внутренняя размерность (от 3blue1brown) - тут; ещё более подробное разъяснение популярных способов оценить внутреннюю размерность облака точек можно прочитать здесь.

Так вот, вместо этой новой статьи, которая связывает внутреннюю размерность активаций на тестах с лексическим разнообразием и сжимаемостью этих текстов алгоритмом gzip и энтропией (что, на мой взгляд, очень интересно, так как связывает внутреннюю размерность со сжатием представлений в LLM, а, как говорит 3blue1brown, compression is intelligence), челики почему-то цитируют нашу старую статью про детекцию сгенерированных текстов с помощью внутренней размерности, хотя мы же и показали в более поздней статье, что для новых моделей GPT этот метод уже не работает.

Скорее всего, это происходит от того, что старая статья была опубликована на NeurIPS, а новая, на мой взгляд, более актуальная, интересная и вносящая больший вклад в область interpretability of LLM - на EACL - то есть, на конференции поменбше и статусом пониже, где эта область вообще почти не представлена, так что мало кто будет ожидать найти в материалах конференции такие работы...

Я писала про эту работу в дискорде Neel Nanda, но там никто ею не заинтересовался, так как все только рекламируют свои работы, но не читают чужие... В общем, уже и не знаю, что сделать, чтобы на данную работу обратили внимание 🤔🤔🤔

Помогите советом кто сможет 🥺
ACL Anthology Unveiling Intrinsic Dimension of Texts: from Academic Abstract to Creative Story Pedashenko Vladislav, Laida Kushnareva, Yana Khassan Nibal, Eduard Tulchinskii, Kristian Kuznetsov, Vladislav Zharchinskii, Yury Maximov, Irina Piontkovskaya. Proceedings of the 19th Conference of the European Chapter of the Association for Computational…
Post #2243 261
18.08.2026 🍳 датазавтрак по вторникам ☕️ в Новосибирском Академгородке с 08:30 до 10:00 в "Shurubor coffeeshop" у фонтана ТЦ https://go.2gis.com/wlkqi
Датазавтраки найти просто - на столе стоит кот с аватарки датазавтраков.
  • 👍 2
  • 🔥 1
Post #2242 394
Тут подсказывают, что во вторник все будет закрыто из соображений безопасности. Придется пропустить
  • 😢 5
Post #2241 374
11.08.2026 🍳 датазавтрак по вторникам ☕️ в Новосибирском Академгородке с 08:30 до 10:00 в "Shurubor coffeeshop" у фонтана ТЦ https://go.2gis.com/wlkqi
Датазавтраки найти просто - на столе стоит кот. Я буду в командировке, хранителем кота и старшим по датазавтраку будет
@BenMarg

Кот в этот вторник грустит
  • 🔥 4
Post #2239 318
Post #2238 296
582.pdf20.9 MB
Страница 340 и дальше описывает задачу с камерами
Post #2234 258

Forwarded from 🍳 Датазавтраки ☕️ НСК (Академ)

Бразильский шаман Ido Bright, о котором я рассказывал, использовал Karhunen-Loéve Decomposition для выявления истинной размерности системы. Картинка из его лекций. Еще гуглить Proper Orthogonal Decomposition
Post #2229 281
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →