Halo это open-source фреймворк для обучения языковых и мультимодальных моделей.
Он поддерживает pre-training, SFT, preference optimization и асинхронный RL. Модели остаются в стандартном формате Hugging Face, поэтому чекпоинты можно загружать через
from_pretrained.В тестах на 8× B300 Halo показал до 2,8 раза больше throughput, чем стандартный TRL, при меньшем пиковом потреблении памяти.
https://github.com/whitecircle/halo
