TGViewer
Градиентное погружение Градиентное погружение @gradientdip · 4.2K subscribers
Post #329 7.39K

Forwarded from Love. Death. Transformers.

Инженер LLM (Оптимизация и RL Alignment)
Стартап в области безопасности ИИ

Чем предстоит заниматься:

Дообучение и Оценка Sota llm, аттаки на blackbox модели

Улучшение RL для аттак на модели, настройки моделей (PPO, RLHF, стабильность обучения).

Бенчмаркинг и оценка качества моделей (ELO-метрики, alignment).

Оптимизация инференса (vLLM, SGLang, TRT).

Требования:

Опыт работы с LLM (архитектуры, RL, alignment).

Знание PyTorch/JAX.

Реальная практика с RL методами (DPO, RLHF — плюс).

Опыт с системами инференса (vLLM, kuber, docker).

Публикации в NeurIPS/ICML/ICLR и др. — сильный плюс.

Преимущество:

Экспертиза в байесовской оптимизации, эволюционных алгоритмах, гиперпараметрическом поиске, автоматической оптимизации промптов.

Условия:

Зарплата: 80K–130K usd + опционы.

Релокация в Париж🥐, полная занятость.

Работа с передовым стеком (AI research, model alignment).

Отклик:
https://forms.gle/z45WwdBTRHrd8inM9
  • 🔥 16
  • ❤ 6
  • 👍 2
More from @gradientdip
  1. Oct 24, 2023🔥TensorRT-LLM 👉Ваш любимый нейронный ускоритель получил расширение! TensorRT - движок, к…
  2. Oct 15, 2023🧹Scrapper Инструмент для парсинга страниц с JS. Работает в докере, можно обращаться по ап…
  3. Oct 6, 2023🏅А кто сегодня молодец и взял Trending paper на Hugging Face, обогнав Google DeepMind и C…
  4. Oct 6, 2023Всем привет, мы строили строили и наконец построили! Первая супер-библиотека по spelling c…
  5. Oct 3, 2023⚡️Началось открытое голосование за номинантов премии HighLoad++. Среди прочих достойных но…
  6. Sep 24, 2023Всем привет 👋 Продолжаем серию постов под авторством @TimeEscaper, посвященную применению…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →