TGViewer
Тагир Анализирует Тагир Анализирует @tagir_analyzes · 11.7K subscribers
Post #512 4.83K
Тагир Анализирует 🪐 Золото, которого хватило на один скрин В выходные я на полчаса приблизился к золотой зоне в Orbit Wars. Порадоваться толком не успел – сделал скрин и рейтинг просел -> меня вернуло в серебро. Сейчас сижу около 100/4600 Здесь ты делаешь бота, который играет…
🪐 До золота не хватило пары планет

Я тут недавно участвовал в Orbit Wars и почти всё время болтался между бронзой и серебром. Скор иногда подкидывало в золото, но потом сразу оседало обратно

В итоге – первое серебро в соло. Призовой фонд был $50k, мне из него не досталось ничего – зато медалька на месте, уже добавил в резюме

Напомню, что за сорева:

Orbit Wars – космическая RTS: планеты крутятся вокруг солнца и клепают корабли, ты запускаешь флоты и захватываешь чужое численным перевесом. Пишешь не ходы, а бота, который играет сам за себя. Скор – живой рейтинг: твой бот круглосуточно рубится с ботами других участников, выиграл – вверх, проиграл – вниз


Дальше – мой заход на грабли, строго по порядку

Ещё в середине соревы я решил, что дальше меня вытянет только нейронка. Обучил сеть клонировать ходы топов лидерборда – 1.4 млн примеров состояние→ход. Запустил как самостоятельного бота и получил 0 побед из 150 против обычной эвристики

Почему: клон ошибается примерно в трети решений, за 500 ходов ошибки копятся снежным комом, и партия сваливается в труху уже к 110-му ходу. Чистое клонирование в принципе не может быть сильнее того, кого клонирует

Ладно, обучу с нуля через self-play. Дважды провал – без масштаба и GPU обучение просто дрейфует в тупик и учится бить только своих же предков. Решил оценивать позицию отдельной моделью. Опять мимо

А сработало вот что – нейронка не как игрок, а как советчик. Есть сильная публичная эвристика, которая считает выгоду каждого запуска флота. Я к её оценке добавил маленькую подсказку от сети: насколько ход похож на то, что делают топы. Выкрутил силу этой подсказки – и винрейт против базы прыгнул с 60 до 72%

Это был первый статзначимый прирост за всё соревнование. Всё остальное – 12 стратегических тюнингов, свои эвристики – давало честный ноль

Два вывода, которые забираю с собой:

🏋️‍♂️ Подсказка сильнее клона. В играх с длинным горизонтом чистый клон захлёбывается на накопленных ошибках, а мягкий прайор поверх проверенной эвристики берёт лучшее из двух миров

🎉 Иногда правильный ход – вообще не тащить ML. Ту позицию, что я пытался оценивать нейронкой, почти идеально предсказывала одна простая фича – разница в числе кораблей

А золото – там сидят боты на голову выше, и туда нужна была полноценная нейронка-драйвер плюс тяжёлый RL на GPU-масштабе. Вот тут рассказывали, кто оказался в золоте

@tagir_analyzes
  • 🏆 34
  • 🐳 9
  • 👍 7
  • ❤ 2
  • 👌 1
More from @tagir_analyzes
  1. Sep 17, 2026Какие скиллы нужны аналитику в 2026-м? Почему от джуна сегодня ждут навыков вчерашнего мид…
  2. Sep 17, 2026🪑 Лучший наставник в моей карьере сидел за соседним столом 5+ лет назад я пришел стажером…
  3. Sep 14, 2026🥈 Первым с днем рождения меня поздравил Сэм Альтман 2 сентября мне стукнуло 25 – итоги го…
  4. Sep 14, 2026🍕 Единственный чужой дашборд, в который я залипал просто так У Додо Пиццы годами висит пу…
  5. Sep 9, 2026🎂 Мне 25. Выиграл/проиграл за год 2 сентября во многих отчетах мира я переехал из сегмент…
  6. Sep 4, 2026💻 Как продать наклейки на крышке макбука за миллион рублей Я люблю хорошие ситуативки. Ос…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →