Рубрика «Навайбкодили»🚀
Всем вайб привет!
Я решил начать больше писать про искусственный интеллект и про то, что я делаю. Я каждый день занимаюсь разработкой проектов: пробую, тестирую, глубоко погружаюсь. Знаете, не потому что мне нечего делать, это так не работает. У меня просто куча идей, и меня привлекает, что я могу что-то придумать и сразу же воплотить.😍
Поэтому я решил объединить новости про AI с более понятными пояснениями для тех, кто не глубоко в этой теме.
Сейчас я веду разработку порядка 10–15 проектов. Мне супер интересно выпустить две полноценные игры. Одна — тактическая RPG. Другую кто-то сравнивает с Worms, кто-то с Angry Birds: хочу сделать мультиплеерную игру для мобильных платформ и для десктопа, может быть, чтобы она была опубликована в Steam. Обожаю игры. Всегда мечтал побывать в этом бизнесе, и вот с помощью AI у меня появилась возможность эту мечту воплотить.👻
Чтобы со всем этим работать эффективнее, нужен AI: модели, которые помогают писать код и совершенствовать продукты. Напомню, что есть несколько топовых разработчиков таких моделей:
OpenAI, Claude и Grok Илона Маска. А ещё есть очень сильные китайские модели: DeepSeek, Kimi, GLM.
За сентябрь вышли просто топовые модели: те, что лучше выполняют задачи и лучше понимают контекст. Вот главное, с пояснениями: Claude Opus 5.5 и Sonnet 5.5 от Anthropic: Opus вышел 22 сентября, Sonnet — 28-го. Opus — флагман, Sonnet гораздо дешевле и делает примерно то же самое. По данным Anthropic, Sonnet 5.5 отвечает больше, чем на 30% быстрее прежнего Sonnet 5 и до 30% дешевле за задачу: 2 доллара за миллион входных токенов и 10 за миллион выходных. Токен — это кусочек текста, по ним модели и считают цену. В тестах агентного кодирования Sonnet обходит Opus только в одном из трёх. Зато киберзащитные меры, которые раньше стояли только на флагмане, Anthropic впервые распространила и на Sonnet: по словам компании, его киберспособности сопоставимы с Opus 5.
OpenAI выпустила GPT-6.1 Sol. По ряду тестов она приближается к самой топовой модели, GPT-6 Astra, а стоит в разы дешевле: по данным OpenAI, 2 доллара за миллион входных токенов против 10 у Astra и 10 против 50 за выходные.
В тот же день, 29 сентября, OpenAI показала Dots. Это постоянно работающие агенты на базе Astra. Агент — это AI, который сам ведёт задачу по шагам, а не отвечает на один вопрос. У каждого Dot свой облачный компьютер, он подключается больше, чем к 4 000 приложений и сервисов, и может работать круглосуточно. Пользователь заранее задаёт правила: что агент делает сам, что только после «да» от человека, а что нельзя никогда.
Про китайские модели интересно смотреть отчёт Mozilla от 15 сентября: он про открытые модели, и китайские там заметная часть. Открытые, вроде Kimi (это те, что можно скачать и запустить у себя), по оценке Mozilla отстают от закрытых примерно на четыре месяца. На рейтинге Artificial Analysis от 1 сентября Kimi K3 набрал 60 баллов, Claude Fable 5 — 62, а по цене за токены Kimi стоит около 30% от Fable.
Для тех, кто пишет код с AI, 11 сентября в Claude Code (версия 2.1.269) появилась команда claude plugin eval. Плагин — это надстройка над Claude, которую ставят, чтобы он лучше справлялся с задачами. Команда проверяет, есть ли от неё толк: прогоняет каждую задачу в чистой сессии три раза с плагином и три раза без и показывает два балла и разницу. Anthropic сама разбирает случай, когда оба балла 1,0: задача решена, но плагин тут ни при чём.
И про то, что бывает, когда код пишут агенты. 21 сентября Linear рассказала, что переделала свой CI — систему, которая автоматически проверяет каждый кусок нового кода. Причина: агенты стали писать код быстрее, чем команда успевала его проверять. По цифрам самой компании, набор тестов с начала года почти учетверился, сейчас добавляют около 2 000 тестов в неделю, и большинство пишут агенты. Агентов тормозить не стали, занялись самой проверкой, и ожидание даже чуть сократилось: с шести с лишним минут до чуть больше пяти.
Но там вообще много всего, углубляться я сейчас не буду. Смысл в том, что эти решения действительно позволяют выпускать продукты на совершенно ином уровне, чем даже два или три месяца назад, не говоря о том, что было год назад. Поэтому, если интересно, буду постепенно делиться этапами своей разработки и выкладывать проекты.
Не забываю постоянно совершенствовать и проекты внутри компании. В частности, допилили нашу CRM для отдела продаж. Пытаюсь построить управляемый контур операционной системы компании. Это оказалось самой сложной задачей, даже не с точки зрения разработки, а с точки зрения того, как сделать так, чтобы контекст и информация друг другу не противоречили и всем этим было удобно пользоваться.
И из интересного — то, что я делаю сейчас на нашем
сайте. Постоянно его обновляю, поэтому заходите, пишите мне, если будут предложения или что-то ещё. Будет супер интересно получить от вас обратную связь.
Так что начинаем с понедельника. Точнее, начинаем понедельник вместе с AI, естественно.