TGViewer
Channel Public Channel
Vitaliy Zarubin | @keygenqt

Vitaliy Zarubin | @keygenqt

@aurora_dev

Привет! Я инженер-программист компании ОМП. За свою карьеру я сменил много платформ и языков, и продолжаю учить новые. На канале рассказываю о своей работе и моих pet-проектах.
Subscribers
461
Photos
1.2K
Videos
295
Links
620

Showing posts older than #1924 · Back to latest

Older Posts 20 shown
Post #1923 228
🔥 Vibe Action: CLI v0.2.0 + Plugins Update

Новый релиз — навел порядок, прокачал ввод/вывод и сделал работу со скриншотами умнее.

👉 Авто-скриншоты: если в буфере нет изображения, команда сама понимает, когда нужно сделать скриншот

👉 Новый ввод/вывод: переработали систему, добавили тег query — он упрощает и систематизирует данные для разных источников (CLI/API)

👉 Полные прогоны: добавили выполнения пайплайнов с фикстурами. Убрали метод bench — теперь это часть внутренней кухни

👉 Синхронизация с плагином: синхронизировали все доступные экшены и пайплайны, а сам плагин обновили под новый формат вывода приложения

🔗 Vibe Action
🔗 Vibe Action Plugins

📕 https://vibe-action.keygenqt.com
  • 🔥 4
Post #1922 200
Vitaliy Zarubin | @keygenqt 🔗 https://z.ai/blog/glm-5.3
API уже отдаёт новую GLM-5.3, но при отправке запросов пока выдаёт Access Denied. Ждем.
  • 🔥 3
Post #1921 213
Банкста США хотят запретить Европе использовать китайский ИИ. Согласно полученному Reuters проекту письма, страны, которые присоединились к пекинской модели ИИ, потеряют доступ к возглавляемой США инициативе Pax Silica. В проекте говорится, что членство в Pax Silica…
Рыночная экономика: или у вас не наша ИИ-вундервафля (wunderwaffe), а китайская, но тогда хрен вам, а не печатный станок.
  • 🤣 1
Post #1920 193

Forwarded from Банкста

США хотят запретить Европе использовать китайский ИИ. Согласно полученному Reuters проекту письма, страны, которые присоединились к пекинской модели ИИ, потеряют доступ к возглавляемой США инициативе Pax Silica. В проекте говорится, что членство в Pax Silica не может сосуществовать с конкурирующими инициативами. Pax Silica также затрагивает полупроводники, критически важные минералы, инвестиции и экспортный контроль, поэтому членство влияет не только на доступ к моделям. Страны, которые хотят использовать американские чипы и капитал, должны отказаться от проектов с Китаем. @banksta
  • 🤣 8
Post #1918 231
#fyi Подбил логи GLM 5.2 за 12 дней. Если K3 — это снайпер, то GLM — это пулемет.

📊 Масштаб: 1650 запросов (~137 в день), 2 млн токенов в ответах и почти 50 млн суммарно. По прайсу это потянуло бы на ~175 юаней.

🎯 Умная и быстрая: 87% всех потраченных токенов — это Cache Hit. Иногда не хочется скидывать чат, чтобы объяснять модели контекст заново, и работа выходит за рамки обычной сессии.

🚀 Сложные задачи — расход больше: В обычные дни уходит 1-2 млн токенов. Но когда даешь модели объемный контекст для глубокого разбора, расход взлетает до 10 млн в день.

Я доволен этой моделью. Сколько потратил? Я купил пакет на 100 лямов токенов, и ни в чем себе не отказываю =)
  • 👍 4
  • 🔥 2
  • ❤ 1
Post #1917 230
#fyi Модель с русским промтом тупеет?

Как модель «думает», если коротко. Внутри у неё нет русского, английского или китайского отдела — есть одно общее пространство смыслов, куда складывается всё. Но кормили её в основном английским: GitHub, StackOverflow... Поэтому пространство это плотнее всего именно там, где английские слова. Отсюда два налога на русский.

Налог на ум. Спросили по-русски — модель всё равно достаёт знания из "английской" части памяти, cross-lingual transfer работает. Но с потерями: у топовых моделей 1–3%, заметно только на задачах, где она и так на пределе. У слабых моделей разрыв больше.

Налог на токены. Модель читает текст не словами, а токенами — кусочками. Английский режется экономно, русский — в 1.5–2 раза мельче. Один и тот же смысл занимает вдвое больше места: окно на 200k токенов вмещает меньше русского текста, чем английского, и кончается раньше, в API тот же текст дороже в полтора-два раза, ответ генерируется дольше.
  • 🔥 4
  • 😱 4
Post #1916 206
Банкста Сбер представил ГигаАгента, — по заявлению компании, первого в России автономного универсального ИИ-агента. Он решает повседневные задачи: управляет календарём, работает с документами, ведёт переписку, исследует информацию, создаёт отчёты и презентации. В…
Он же Гога, он же Гига, он же Гора, он же Жора =)
  • 😁 10
Post #1915 211

Forwarded from Банкста

Сбер представил ГигаАгента, — по заявлению компании, первого в России автономного универсального ИИ-агента. Он решает повседневные задачи: управляет календарём, работает с документами, ведёт переписку, исследует информацию, создаёт отчёты и презентации.

В отличие от диалоговых интерфейсов, ИИ-агент работает автономно и в фоновом режиме, запоминает контекст и накапливает опыт между сессиями, а при необходимости сам задаёт уточняющие вопросы.

ГигаАгент уже доступен для выбора в Agents Space — пространстве для создания и использования персональных ИИ-агентов без настройки моделей, серверов и среды запуска. При этом все технические сложные процессы автоматизированны. Пользователю достаточно выбрать подходящего агента или создать собственного, чтобы использовать ИИ для решения конкретных задач. @banksta
Post #1914 238
#fyi Проанализировал траты на Kimi K3 — это дорого, но оно того стоит. В экспертном режиме ассистента модель думает много: у меня частенько вылезает за 16к токенов рассуждений. Но проработка кода отличная.

Основная моя модель — GLM 5.2. Умная, быстрая, недорогая, но в деталях может ошибаться. Я могу легко помочь ей сам, но если мне кажется, что нужен детальный разбор, прошу поревьювить код в Kimi. Такой запрос может стоить 5-10 юаней и вашего времени минут 5-10. Это инструмент не на фулл-тайм, но находит крайние случаи, которые можно упустить из виду.

Чтобы не сливать баланс, подправил правила работы с ним:

🎯 K3 — дорогой эксперт. Ему требуется отлаженный системный промпт, который не сокращает его способности, а направляет и уточняет задачу.

🚀 Он должен выдавать результат, а не просто вывод «хорошо/не хорошо». Будет очень обидно, если запрос прошел, а в ответ вы получили лишь текстовый отчет об ошибках. Нужен исправленный код.

⚡️ Не стоит экономить на лимитах — дайте то, что ему нужно. Если он выходит за 16к — дайте 30к сразу. Его задача — детально проанализировать код и дать результат. Если он не вложится в лимит, его поток сознания просто оборвется, и вы переплатите за еще один запрос.

К Kimi K3 стоит обращаться, когда у вас есть сомнения, и вы хотите максимально надежный результат в важном блоке. Не во всем коде важна высокая детализация, но встречаются места, где нужно совместить свои знания и максимальную помощь от LLM. Вот тут он отличный помощник.
  • 👍 6
  • 🔥 2
Post #1913 226
Дарим зрение текстовым LLM 👀
  • 🔥 5
  • 👍 2
Post #1912 233
🔥 Vibe Action: CLI v0.1.4 + Plugins Update

Небольшой релиз — навел порядок в выводе и пофиксили баги.

👉 Форматирование кода в терминале
👉 Полный прогресс выполнения в логах

🔗 Vibe Action
🔗 Vibe Action Plugins

📕 https://vibe-action.keygenqt.com
  • 🔥 3
  • 👍 2
Post #1909 233
Банкста Китайский разработчик ИИ DeepSeek уведомил пользователей о планах повысить цены на свои услуги, сообщает Bloomberg. Компания не назвала точное увеличение стоимости, но заявила, что оно будет существенным, и призвала клиентов это учитывать. @banksta
  • 😁 3
Post #1908 202

Forwarded from Банкста

Китайский разработчик ИИ DeepSeek уведомил пользователей о планах повысить цены на свои услуги, сообщает Bloomberg. Компания не назвала точное увеличение стоимости, но заявила, что оно будет существенным, и призвала клиентов это учитывать. @banksta
  • 😱 4
Post #1907 218
Vitaliy Zarubin | @keygenqt Говорят, Qwen 3.8 Max уступает только Claude Fable 5. Проверим, насколько он хорош.
Немного поработал с Qwen 3.8 Max — поискали с ним решения задачи на уровне идей. Честно говоря, ожидал большего. Кажется, Fable 5 просто заперли с ним, провели тест, и Qwen нехотя уступил.
  • 🔥 6
  • 😁 1
Post #1906 257
Говорят, Qwen 3.8 Max уступает только Claude Fable 5. Проверим, насколько он хорош.
  • 🔥 7
Post #1905 212

Forwarded from Открытая мобильная платформа

Роман Аляутдин в эфире телеканала Россия 24

Директор по разработке ОС Аврора рассказал о взаимодействии с облачной платформой МосХаб для успешного развития индустриального, системного и инженерного программного обеспечения.

Open Source-проекты для ОС Аврора стали доступны на МосХаб в прошлом году. Независимые разработчики, представители академического сообщества и студенты могут запускать и развивать свои проекты на базе надежного российского ресурса, что устраняет риски и барьеры, связанные с использованием зарубежных сервисов.


📲 Аврора в MAX
  • 🔥 6
Post #1904 199
#fyi Вы тоже встречали в LLM проблемы с идентичностью? Модели путаются, кто они. Почему такое может происходить?

Первое, что приходит на ум — дистилляция на синтетических данных, сгенерированных Claude. Ответ кажется простым, но на деле мы не можем знать точно, как именно попали данные о Claude в модель.

Еще вариант — «вирусные данные», когда в общедоступные датасеты намеренно закладываются триггеры в духе «я модель Claude», которые ИИ бездумно заглатывает при обучении. Если компания жжет книги, чтобы они не достались другим, я уже ничему не удивлюсь.

Еще есть вероятность простой замусоренности самих данных — будь то миллиарды страниц из интернета или базовые модели и веса, которые уже забиты контентом от Anthropic. Возможно, все эти факторы накладываются друг на друга, ломают ассоциативные связи, и модель выдает чужой шаблон идентичности.
  • 🔥 4
Post #1903 172
Vitaliy Zarubin | @keygenqt 🔥 Vibe Action: IDE Plugin v0.0.1 (alpha) + CLI v0.1.2 (beta) Главный релиз — плагины для IDE! Vibe Action выходит за пределы терминала и переезжает прямо в редактор. Плагины на Compose Multiplatform для VS Code, и для IntelliJ. Плагин и бекенд — независимые…
  • 🔥 8
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →