Фреймворк глубокого обучения на Rust убрал параметр бэкенда из пользовательских моделей:
// Было
struct Model<B: Backend> {
linear: Linear<B>,
}
// Стало
struct Model {
linear: Linear,
}
Теперь место и способ выполнения выбираются через
Device. Изменение модели затрагивает меньше кода при перекомпиляции.Пересборка после правки модели в замерах команды:
• CNN: 28,42 → 4,57 с, ускорение в 6,2 раза.
• Transformer: 14,73 → 1 с, ускорение в 14,7 раза.
В тесте обучения CNN на RTX 4050 Laptop, FP32 пропускная способность выросла на 80%, а пиковая VRAM после прогрева снизилась с 956 до 486 МиБ. Для Transformer экономия памяти составила около 18%. Это результаты конкретных тестовых моделей.
Также добавили LoRA и QLoRA, раннюю поддержку экспорта в ONNX, удалённые вычисления и повторное исполнение GPU-графов.
Обновление ломает совместимость API: Candle удалён, NdArray и LibTorch объявлены устаревшими.
https://tracel.ai/blog/release-0.22.0/
@machinelearning_ru
