TGViewer
Pixel Science Pixel Science @pixels_science · 478 subscribers
Post #207 763
Можно ли применить Inference-Time Scaling не только для улучшения LLM - как было с o1 - но и для генерации изображений?

Именно такой вопрос проресёрчили ребята из Гугл, NYU и MIT, и оказалось что ответ: да, можно, и приводит к успеху

Напомню на чём строится идея за этим направлением в общих чертах:
1️⃣ У нас есть проблемы с обучением ИИ, которые решают задачи с 100% точностью end-to-end
2️⃣ Но мы неплохо продвинулись в вопросе верификации ответов

Разница: легко научиться понимать вкусный ли торт, но в разы сложнее научиться его печь с нуля

Поэтому, мы можем, используя всякие метрики: CLIP/DINO/FID/IS, проверять насколько сгенерированное изображение соответствует запросу и выбирать лучшее из всех попыток - Random Search

Или пойти дальше и по пути генерации пикчи - решения ODE/интегрирования - заглядывать немного в будущее и смотреть какие шумы приведут к каким результатам и выбирать лучший путь - Search over Paths

Имхо, очень любопытно. Но можно ли эту мысль перепроецировать на рендеринг? 🤔🤔
#ии #статья
  • 🔥 3
  • 👍 2
More from @pixels_science
  1. Aug 25, 2025The Bitter Lesson for RL: Verification as the key to Reasoning LLMs - отличная презентация…
  2. Aug 21, 2025Подытожу этот сумбурный тред фразой одного умного парня из мира Computer Vision: "Не беспо…
  3. Aug 21, 2025Продолжение про SIGGRAPH ч.2 И я сам очень многому удивился и обнаружил свой предсказатель…
  4. Aug 21, 2025Продолжение про SIGGRAPH ч.1 Кто-то просто делает ставки. На 10ки $млн. Надеясь открыть но…
  5. Aug 21, 2025Про SIGGRAPH, рынок, разговоры о будущем графики Съездил. Встретился с 10ками прекраснейши…
  6. Aug 4, 2025Пригласили на SIGGRAPH 2025 ещё раз презентовать нашу статью по нейронному рендеру! Если в…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →