TGViewer
epsilon correct epsilon correct @epsiloncorrect · 8.08K subscribers
Post #346 7.7K
Пока я откисаю в Корее от очередного сезона исхода дорогих коллег [1, 2, 3, и др.] перед ICML, наша с читателями любимая Лилиан Вэн – авторка топ-1 блога по диплёрнингу – написала первый за почти два года пост про историю и развитие науки об оценке правил масштабирования (scaling laws) языковых моделей. Почему "правил", а не "законов" – чтобы не создавать ощущения универсальности самих законов: всех необходимых факторов для по-настоящему точных предсказательных правил для конкретных архитектур, моделей, данных, оптимизаторов и других факторов, на них влияющих.

Особого почтения заслуживает упоминание статьи Lovelace et al., где в первый раз в академическом мире разбираются, как влияют повторения данных на scaling laws. Так что у кого знания остановились на шиншилле – бежим освежать знания, чтобы фронтир толкался предсказуемо и безопасно.
  • ❤ 38
  • 🔥 8
  • 😭 3
  • 👍 1
  • 👏 1
  • 🤝 1
More from @epsiloncorrect
  1. Sep 2, 2026Gemini 3.8 Flash Наконец-то достали до опуса по агентским бенчмаркам, вот только скорость…
  2. Aug 24, 2026Что-то я сюда не писал уже почти месяц, будем исправляться. Произошло много чего, анонсы ч…
  3. Jul 18, 2026Куртку продали за $960.000 Если купили дорогие подпищеки, дайте поносить?
  4. Jul 16, 2026у нашей с вами любиой геммы пофиксили темплейт чата, стало лучше на бенчах 👀 бежим качать…
  5. Jul 7, 2026Техрепорт Gemma 4 наконец-то докатился до архива ☺️, особо ничего нового, немного больше э…
  6. Jul 3, 2026Мечта всех, кто хотел кожаночку как у Дженсена Хуанга – на следующем Sotheby's можно будет…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →