С этим постом для меня началась новая эпоха. Обратите внимание на второй пункт - стартап Миры Муратти (один из бывших боссов OpenAI) Thinking machines запустила полноценную эксплуатацию Tinker - продукта, который позволяет обучать нейронки ламерам.
Идея такая - есть классические способы обучения типа Lora. Классические опенсорс модели - Qwen, Llama, gpt-oss и пр. Рябята уже реализовали все нужные алгоритмы для обучения, от вас нужны просто данные и выбрать модель. Цены на обучение привлекательные.
Например, если я хочу научить небольшую модель оформлять протоколы в моем стиле, нужно несколько десятков протоколов, до сотни, это 1-2 миллиона токенов обучения - и у Тинкера это обойдется в 0,5-1 доллара для небольших моделей. Вообще халява.
Бонус еще с том, что обученный слой можно будет перенести и на квантованные модели.
Да, еще один бонус - обученные модели можно запускать не у себя, а у облачных провайдеров вычислений, например, Replicate. Это, кстати, позволяет погонять дообученную модель на разном квантовании и посмотреть, что лучше подходит.
В общем, не зря Мире отвалили несколько миллиардов на разработку, когда продукт был только на бумаге.
Post #703
55