🔘
nn.LinearCrossEntropyLoss объединяет последний линейный слой и функцию потерь, сокращая пиковый расход GPU-памяти до четырёх раз на моделях с большим словарём;🔘 FlexAttention заработал на Apple Silicon;
🔘
torch.load() открывает safetensors без отдельной библиотеки;🔘 появились Linux wheels для предварительных Python 3.15 и свободнопоточного 3.15t.
Заявленное ускорение FlexAttention примерно в 12 раз получено на конкретном разреженном шаблоне. Для плотного внимания SDPA остаётся быстрее. Сборки для Python 3.15 пока лежат в отдельном индексе PyTorch, а
torch.compile с этой версией языка ещё не работает.@zen_of_python