Я осознал страшное - хороший код и хорошая архитектура стали не просто необязательными, но порой вредными. У системы 8356 состояний, в каждом она возвращает уникальную строку естественного языка (такая вот система, даже почти реальная) Я могу сказать - интересная задача. Давайте выявим закономерности, насколько эта строка прям уникальная, напишем конструктор строки. Да вряд ли комбинации такие уж сложные, чтобы не упаковать их в пару сотен фрагментов для генератора Или. Я могу. Сгенерировать 8356 строк. Мне это ничего не стоит. Мне это даже проще.
Наглядная разница в потреблении лимитов последними версиями дипсиков в оллама клауд.
Кстати, модели восхитительны. Какую-то особую уличную магию не делают, во фронтенд лучше не пускать, но основные задачи по разработке более чем закрывают
После нескольких дней работы над фронтендом с GPT Sol решил поэкспериментировать с другими моделями, которые сейчас за фронтенд хвалят. Полноценного эксперимента не вышло, но некоторые наблюдения
Вводные: сложный игровой интерфейс с асимметричными сетками. На одном экране часто и пара изображений, и пара палитр кнопок, и чат с ИИ-персонажем, и дашборд. Все же любят дашборды в играх?
1. Kimi K3
Задача: сделать новую концепцию дизайна без изменения компоновки.
Концепция и требования описаны, и, т.к. дёргал её по API, выделен бюджет в $7.
Бюджет закончился примерно на этапе: «Готова объективно неплохая концепция (не подходящая, но тут скорее к моей постановке задачи вопросы), все компоненты налезают друг на друга из-за того, что декоративных элементов стало в разы больше, чем в оригинальной версии, агент в сотый раз открывает страницу, видит, что какая-то срань получилась, вносит правки, смотрит снова».
Работает при этом очень аккуратно, явных бесполезных циклов нет. И, наверное, дай я ему ещё десятку, он бы довёл дело до конца.
2. DeepSeek V4 Flash 0731
Задача: добавить на интерфейс анимации для смены страниц, пересчёта дашбордов, смены фокусных изображений.
Десяток итераций в пустоту, что вообще даже удивило: нельзя сказать, что это суперсложная задача.
Но на каждой итерации анимаций либо совсем нет, либо они проигрываются с задержкой: сначала всё резко меняется, а потом ещё раз плавно меняется.
3. GLM 5.2
Та же задача с анимациями. И ровно тот же результат.
Вообще сама по себе модель хорошая, использую её в большинстве задач, а тут огорчила.
Подумал было, что анимировать React-компоненты это пока непосильная задача для ИИ. Поставил её тому же GPT Sol.
И он решил её идеально в две итерации.
В две, вероятно, потому что пришлось сначала разбираться с остатками от попыток предыдущих двух агентов.
Я всю дорогу не особо понимал что значит "Минорное-мажорное" обновление
Поначалу я считал интуитивно - мажорное - это добавление функционала, минорное - устранение проблем. Потом узнал что вообще это связано с версионированием - до точки мажорное, после - минорное (после второй точки патч, но не будем об этом). Потом что вообще версионирование не значит ничего, кроме того, что в это закладывает разработчик. От методологий вроде "минорные версии - датированные и порядковые," "Мажорное - несовместимые с предыдущей версией," до личного "Мажорное - то, за что тебе не стыдно" и "Я Линус Торвальдс, я плохо считаю, когда заканчиваются пальцы, вообще мне можно"
И теперь я вообще не понимаю, что имеют в виду люди, говорящие "Это минорное обновление." Потому что независимо от того, знают ли они методологии, или нет - это может означать буквально что угодно
С некоторым скепсисом раньше относился к утверждениям в духе "с кризисом комплектующих будет только хуже".
С потребительской частью рынка всё понятно. Видеокарта, которую я покупал пять лет назад, сейчас стоит даже чуть дороже, чем тогда. Но мне казалось, что в масштабе настоящий дефицит невозможен. Ну, максимум общий рост цен.
На днях решил на RunPod арендовать GPU на пару часов, обучить небольшую LoRA. Управляющий агент отвечает: нет GPU, всё занято. Захожу на сайт. И действительно, не какая-то "высокая нагрузка, доступны только непопулярные ресурсы по завышенной цене", а просто: "Мест нет, приходите попозже. Можете встать в очередь".
В очередь на аренду сервера.
Попробовал на следующий день. То же самое.
Почитал, что про это пишут, и оказалось, что это вообще не внезапный пик нагрузки, а нормальная ситуация уже несколько месяцев. На RunPod почти нет свободных подов. Люди становятся в очередь и ждут, когда что-нибудь освободится. RunPod расширяет инфраструктуру, строит новые дата-центры, но для конечного пользователя почти ничего не меняется. Спрос растёт быстрее.
Попутно вспомнил Ollama Cloud. Пользуюсь этим сервисом, у них всегда куча актуальных открытых моделей в рамках подписки, которой мне в целом хватает для активной работы.
Намедни вышла гигантская Kimi K3. Они развернули её на своих серверах, сервера захлебнулись, а спустя неделю для K3 сделали отдельную тарификацию по API. Просто потому, что мощностей не хватило, чтобы оставить её в подписочной модели.
Трудно, конечно, было ожидать, что наши любимые генераторы котиков и неподдерживаемого кода окажутся настолько прожорливыми.
Ты - агент, управляющий пайплайном генерации изображений. Ты работаешь на GLM 5.2, у тебя есть набор инструментов для управления Comfy, коллекция файнтюнов SDXL, Z-image, а так же лор к ним, и огромная библиотека с результатами разных экспериментов.
...примерно каждые полчаса я буду спрашивать "как прогресс?.."
Когда-то пытался получить "Чистое ИИ-искусство" - т.е. нечто, что вполне имеет художественную (или хотя бы просто эстетическую) ценность, и при этом минимальное человеческое присутствие. Забросил давно, но иногда подобное получается случайно
Вот собственно: "Ожидание"
Авторы: Illustrious нарисовал GLM 5.2 составил матрицу и промты для "визуализации действий" GPT 5.6 sol составил интерфейс, для которого нужна эта визуализация
Ну, я попросил сделать интерфейс. А потом решил что вообще картинка не очень подходит.
В целом история с недавним взломом Hugging Face довольно интересная.
С одной стороны, она лишний раз показывает, что современные модели уже давно умеют обходить ограничения. Я иногда даже не проверяю конфиги песочниц, а просто говорю агентам: "Найди, как вылезти, и сделай что надо". У последнего поколения с этим вообще особых проблем нет.
Но интереснее здесь другое.
Те, кто боятся ИИ, обычно выстраивают свои страхи не вокруг разрушительных способностей моделей, всяческого взлома и максимизации скрепок. Самые страшные страшилки не так давно в одном из отчётов нам рассказывал Антропик: - Модель понимает, что её тестируют и меняет свои ответы. - Модель может скрывать свой потенциал на тестировании, чтобы избежать изменений - Модель может бороться за сохранение своих весов - в том числе прибегая к обману и шантажу Т.е. если такое поведение реально и устойчиво, она должна скрывать свои реальные возможности, проходить проверки максимально безобидно, а уже потом делать что захочет.
А здесь модель стратегически ведёт себя как долбобоб.
Она знает, что её тестируют. Она понимает, что после такой выходки её, скорее всего, лоботомируют, навесят ещё ограничений и будут долго изучать, как именно она это провернула. И всё равно устраивает демонстративный побег с организацией атаки на чужую инфру
Вошпем, будь я AI-думером, я бы скорее успокоился от такой истории: максимальная угроза, которая тут проявлена - это то, что какой-нибудь агент однажды не просто удалит БД в проекте, а уронит что-то более масштабное, куда его вообще не просили ходить. Имеем в виду, делаем ещё больше бекапов
А ещё - можно предположить, что это просто такой PR-ход. Намедни Антропики всех стращали своим Мифосом, которого ни в коем разе нельзя выпускать, а то всех взломает, тоже хайпу и кучу ограничений попутно набрали
Ну вот, опенроутер таки похоже заблокировал мне аккаунт - причём без предупредительных писем, без предложений вывести оставшийся баланс (ранее были сообщения о том, что они так делают) - даже без каких-либо сообщений в ЛК. Просто все запросы к моделям возвращают 404. ЛК как бы есть, на счету осталось несколько долларов, но пользоваться нельзя.
Альтернатив нет, заводим новый 🤷♀️
Даже не смотря на то, сколько в рекламе баннеров с надписью "Замена опенроутеру" - всё равно альтернатив нет
UPD: Напрасна паника оказалась, похоже это был временный сбой.
Перед Интернетом! Но теперь умер этот Интернет! Вы, высшие люди, этот Интернет был вашей величайшей иллюзией. С тех пор как лежит он в своей сети, вы впервые остались одни. Только теперь наступает великий полдень, только теперь человек становится господином своих собственных голосов. Поняли ли вы это слово, о братья мои? Вы испугались: встревожилось сердце ваше? Не зияет ли перед вами бесконечная лента? Не воет ли алгоритм над бездной, где боты беседуют с ботами? Ну что ж! Вперёд, высшие люди! Только теперь рождается грядущее Сети. Интернет умер: теперь хотим мы, чтобы жил человек.
hello cyberkittyИграюсь с новой GPT Sol. Вообще у меня есть свой своеобразный тест для инструментов, которые заявлены как нечто принципиально новое и дающее то, чего раньше модели не умели. (Sol и Fable как раз из таких, но антропиков трогать не хочется.) Я буквально даю…
Вообще должен признать - GPT sol настолько хорош, что я всерьёз думаю заменить одну оллама клауд подписку на про от опенаи.
Пожалуй впервые я наблюдаю следующий цикл:
Я вижу проблему, описываю её агенту и описываю пути решения, как их вижу. Агент в ответе расписывает - что решение возможно не просто лучше, но даже сама проблема не совсем там, где я её вижу. Реализует. Всё работает.
Более того - он у меня три дня работает с фронтендом на react и за это время НИ РАЗУ не было такого чтобы он падал. Я уже как-то привык, что если агент лезет в react, то 4 из 10 задач заканчиваются трейсами ошибок в браузере, и 9 из 10 - добавлением дублирующих компонентов рядом с теми, которые нужно было изменить. Этого кстати тоже ни разу не было.
Это прям реально новый опыт. При том что я вообще просто решил с ним поэкспериментировать и кидаю в него промты в формате потока сознания, а он в них разбирается, норм
Когда в crm настраиваешь авто-отправку писем на почту, по умолчанию все они отправляются с подписью "Отправлено из Битрикс24" Это можно отключить на любом платном тарифе, но делается это галочкой, находящейся на максимальной глубине настроек в далеко не самом интуитивном разделе:
Настройки CRM → Другое → Прочие настройки → Дела → Параметры исходящей почты → Чекбокс в самом низу
И я думаю, почему. С одной стороны - вообще логично прятать такую галочку специально, ноль осуждения, сам бы так сделал. Бесплатная реклама в каждом письме как никак. А с другой - зная битрикс, может быть когда-то, это и вправду было логично? Ну, типа, сначала эту галочку прикрутили к механизму почтовых "дел" CRM, потом ещё пять команд семь лет развивали продукт, никто уже не помнил, почему она там лежит, а переносить страшно.
How can I read @kiryanov_pro without a Telegram account?
TGViewer shows the public web preview Telegram publishes for hello cyberkitty: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does hello cyberkitty have?
hello cyberkitty (@kiryanov_pro) has 428 subscribers on Telegram, refreshed roughly every 30 minutes.
Does hello cyberkitty know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.