Недавно опубликованная большая языковая модель Qwen2.5 Coder показывает SOTA по генерации программного кода. На самом деле это коллекция моделей, которая обладает рядом характеристик, делающих ее привлекательной для разработчиков.
Во-первых, в коллекцию вошли веса модели под любую конфигурацию: 0.5B / 3B / 14B / 32B. Последняя версия, наилучшая по бенчмаркам, близка к GPT-4o по качеству генерации кода. Эту модель можно развернуть в облаке immers.cloud и получить собственный мощный сервер — анализатор кода, или аналог GitHub Copilot.
А если нужен компактный помощник программиста на локальном девайсе, то веса меньшего размера сделаны как раз на этот случай - и все они поддерживаются Ollama.
Далее, благодаря длине контекстного окна 128К токенов и поддержке 92 языков программирования Qwen2.5 Coder должен быть полезен в решении широкого набора задач по программированию. Так ли это, сообществу разработчиков скоро предстоит оценить.
@ruslandevlive - мысли о современных AI/ML технологиях
