Топ-ИИ из Китая и другие новости недели
Уходящая неделя вышла интересной на новости и слухи, давайте вспомним главные.
Kimi K2-Thinking
Китайцы из Moonshot AI выпустили Kimi K2-Thinking – “думающую” версию Kimi K2. Модель бесплатна в чат-приложении, недорого стоит по API, также доступны открытые веса. Причем, судя по первым оценкам, требования к железу очень демократичные.
Будете пробовать – зайдите в меню Tools и включите Thinking, иначе будет работать обычная “быстрая” K2.
В бенчмарках K2-Thinking – один из лидеров. Модель, например, обходит GPT-5 Pro и Grok 4 в Humanity’s Last Exam – наборе из 3000 тысяч вопросов по разным дисциплинам, которые написаны таким образом, что на них нельзя “подсмотреть” ответы в интернете. Новинка хорошо держится в бенчмарках по математике, а в кодинге лишь немного уступает GPT-5 и Claude Sonnet 4.5.
Qwen3-Max Thinking
И еще одна “думающая” модель из Китая, очень похожая на K2-Thinking. Тоже бесплатная в чат-приложении, в бенчмарках немного хуже – но это еще не показатель.
Мы сейчас используем ИИ для такого количества задач, что охватить их все какими-то метриками просто нереально. Я пробовал разные способы тестировать новые ИИ, но лучший – просто взять тот, с которым работаете постоянно (у меня сейчас это GPT-5), открыть новинку в соседнем окне, а затем кидать одинаковые промпты обеим моделям. Иногда быстро понимаю, что “не мое”, но если ИИ достойный – то тестировать его таким образом нужно минимум несколько дней. Повторюсь, Qwen3 Max и K2-Thinking бесплатные, так что на тест нужно просто потратить немного времени.
Слухи о Gemini 3.0 Pro и GPT-5.1
В коде сервисов Google уже заметили упоминание Gemini 3.0 Pro с пометкой 11 – обычно так обозначают месяц выхода, в данном случае ноябрь. Не буду загадывать – сливали уже несколько дат Gemini 3.0 Pro, все оказались ошибочными. Если интересно, то подробнее про эту модель я писал здесь, с тех пор мало что поменялось.
Другая любопытная находка – на сервисах вроде Design Arena появились сразу четыре “секретных” модели от OpenAI. А внутри Codex нашли упоминание GPT-5.1 Thinking. GPT-4 в свое время получала обновления каждые 2-4 месяца, так что пора обновлять “пятерку”.
Разборки США и Китая
Недавно рассказывал про то, что ИИ-соревнование между США и Китаем постепенно превращается во вторую космическую гонку. Выход K2-Thinking – важный этап в этой гонке. На Китай наложены серьезные санкции: официально можно ввозить только “замедленные” ИИ-ускорители Nvidia, а по серым схемам везут меньше и дороже. И, несмотря на дефицит ускорителей, у китайцев раз за разом получается выпускать модели, все ближе к лидирующим позициям.
Есть немало статей, отмечающих, что санкции часто имеют обратный результат – тот, кто попал под них, выжимает из оставшихся ресурсов максимальный результат. Такое, похоже, происходит с китайскими разработчиками. Не имея доступа к топовым ускорителям, они выжимают максимум из оптимизации алгоритмов.
Впервые так получилось в январе с DeepSeek R1 – его авторы применили ряд интересных приемов, которые позволили натренировать крутую модель на небольшом парке ускорителей. Теперь видно, что это не разовый случай, более того – Китай способен разрабатывать сразу несколько топовых моделей параллельно.
Плюс Китай ведет разработку своих ускорителей – это не только Huawei, но и, например, Cambricon. Еще летом была информация, что разработка буксует, но сейчас появились новости, что власти Китая запретили использование иностранных ИИ-ускорителей в новых дата-центрах с государственным финансированием. Учитывая то, какие ставки сделаны на ИИ, вряд ли бы они приняли такое решение без уверенности в своих разработках.
Для нас с вами это в любом случае хорошие новости. Чем больше конкуренция на рынке – тем больше разных моделей на рынке. Китайские ИИ где-то уступают моделям из США, но они обычно бесплатны и часто с открытыми весами – а возможность запустить мощную модель на собственном железе также важна.
Post #268
893