На презентации глава AMD Лиза Су достала небольшую коробку и запустила на ней модель на 235 миллиардов параметров.
Внутри процессор Ryzen AI Max+ 395, его фишка в том, что CPU и GPU делят общую память на 128 ГБ. Из них видеояру отдают больше 110 ГБ. Модель Qwen3 на 235 млрд параметров идёт со скоростью около 11 токенов в секунду (не спринтер, но для ответов в чате супер).
В чем глобально суть и почему это интересная новость:
Сейчас типичный пользователь платит за ChatGPT Pro, Claude Code Max, Cursor, Gemini. В год набегают тысячи долларов аренды. Коробка от AMD предлагает другую модель: заплатил один раз - пользуешься. Всё считается локально. Никаких подписок, никакой отправки данных наружу, просто ставите программу, скачиваете модель и работаете.
Как это выглядит на практике: открываете привычный интерфейс, тот же Claude, но вместо облака он стучится на localhost, в вашу собственную коробку на столе. Снаружи всё как раньше, внутри железо, которое принадлежит уже именно вам.
Понятно, что рано говорить о том, что именно такое будущее нас ждет, но тренд мы уже точно видим.
Вайб Working — канал, где простым языком рассказываем как оптимизировать свои рабочие процессы с помощью ai.