TGViewer
Channel Public Channel
Бодрый кодер

Бодрый кодер

@bodrcoder

Меня зовут Лев, я IT Лидер в Альфа-Банке. Это мой личный блог о DevOps, разработке, системном анализе, AI и управлении IT-командами. Делюсь своими мыслями, инсайтами, полезными инструментами и тем, что меня вдохновляет.

Автор: @nemirlev
Subscribers
576
Photos
334
Videos
31
Links
205

Showing posts older than #797 · Back to latest

Older Posts 19 shown
Post #796 462
У меня уже наверное три года электронные или больше. Неужели скоро настанет время, когда физические документы с собой можно не брать.
Post #795 478
Новая Qwen3.8-Flash-Next с Qwen 4 архитектурой очень интересная. Alibaba просто решила захватить весь рынок локального запуска. Модель содержит 180 млрд параметров и магия заключается в том, что 51 милиард можно выгрузить на SSD без потери скорости и качества.
  • 🔥 5
Post #794 596
Интересно, а кто-то купил себе подписку на Netflix, что бы раньше увидеть трейлер новой GTA?
Post #793 615
Казалось, что можно еще придумать в проекте, который стибильно парсит данные из Дзен Мани, что бы анализировать деньги.

Оказывается много, но сейчас сделал прям крутую фичу - mcp, с поддержкой новой спецификации. Получается не нужна не какая Grafana - делаю запрос, а в ответ получаю графики, на основе моих данных, которые тут же в таблице могу проверить. MCP App это прям вещь.

Кому надо анализировать свои финансы в ленивом режиме - https://github.com/nemirlev/zenmoney-export
GitHub GitHub - nemirlev/zenmoney-export: ZenMoney Export is a tool designed to export and sync data from the personal finance management… ZenMoney Export is a tool designed to export and sync data from the personal finance management service ZenMoney to your own database. - nemirlev/zenmoney-export
  • 🔥 3
Post #792 465
Похоже, гонка персональных устройств для локального ИИ началась всерьёз.

Apple сегодня представила M5 Ultra - первый четырёхкристальный чип компании. До 36 ядер CPU, 80 ядер GPU, 512 ГБ унифицированной памяти и пропускная способность 1,2 ТБ/с. На 50% больше, чем у M3 Ultra. Mac Studio с таким чипом начинается с $5499.

А буквально накануне Xiaomi показала прототип AI Cube. Внутри сразу три собственных чипа: Xring O3, O100 и D100. До 160 ГБ памяти, локальный запуск связки моделей 120B и 3B, потребление до 150 Вт. Ускоритель O100 получил пропускную способность 1,22 ТБ/с и в демонстрации выдавал до 330 токенов в секунду на MiMo 3B.

Самое забавное - на слайдах у Apple и Xiaomi почти одинаковая цифра: 1,2 ТБ/с.

Подозреваю, Xiaomi будет заметно дешевле Apple (ставлю что стоимость будет не больше 300к за 128 памяти. Им надо со Spark конкурировать) - если эта коробочка вообще доберётся до розницы. Пока это инженерный прототип без цены и даты начала продаж, а коммерческое применение O100 и D100 обещают только в 2027 году.

И главное: проблема локальных LLM постепенно становится не в том, как их запустить. Память и пропускная способность это уже позволяют. Проблема - сделать модель действительно полезной: дать ей нормальные инструменты, контекст, доступ к файлам и сервисам и заставить надёжно выполнять работу, а не просто очень быстро генерировать текст.

В общем, 1,2 ТБ/с у нас уже есть (осталось заплатить 1.5-2 млн за версию на 512). Теперь бы придумать, что полезного гонять через них каждый день.
  • 👍 3
  • 👏 2
  • 💯 2
Post #791 514
Статья в топ 3 суток попала. Приятно.
  • 👍 8
Post #790 698
А сегодня поделюсь другой статьей, уже не своей. Очень интересная история развития ИИ (перевод выступления Ричарда Кэмпбелла).

https://habr.com/ru/articles/1072298/
  • 🔥 2
  • 👍 1
Post #789 521
Давно не писал статей на Хабре - решил исправиться :)

Написал про свой опыт с AI-агентами, локальными моделями, Hermes и про то, почему в какой-то момент пришлось перестать ждать магии и вернуться к нормальной инженерии.

+ к карме, статье и комментарии, как всегда, приветствуются 🙌

https://habr.com/ru/articles/1072770/
  • 🔥 7
Post #788 496
Я только сейчас осознал, что ChatGPT вышла почти 4 года назад и очень сильно изменила мир. Я почему-то был уверен что всего два года назад, хотя я использовал модель уже 1-го или 2-го декабря, прям в первую волну.
  • ❤ 6
Post #787 493
Мне очень нравится дизайн в Claude. Но блин, потом что Codex что Claude натягивает на Astro или другой Фреймворк - так, как будто это самая сложная инженерная задача. Ты можешь сделать классный дизайн за 10 минут, а потом 8 часов переносить, закрыва глаза на качество кода полностью.
Post #786 526
Бодрый кодер Новость дня. OpenAI приостановила обучение новых моделей ИИ из-за киберрисков, сообщила компания. Странное решение, вместо того что бы вместе с моделями реализовать инструменты, которые эти киберриски позволит купировать.
Юмор в тему
  • ❤ 7
  • 🔥 2
  • 😁 1
Post #785 468
Новость дня.

OpenAI приостановила обучение новых моделей ИИ из-за киберрисков, сообщила компания.

Странное решение, вместо того что бы вместе с моделями реализовать инструменты, которые эти киберриски позволит купировать.
Post #784 522
Только сейчас заметил, что описание моего канала немного устарело, уже не в ПСБ. Теперь актуальное 🙂
  • 🔥 4
  • ❤ 2
  • 👍 2
Post #783 562
Я потратил три часа, пытаясь исправить баг на своём сайте: курсор не менялся при наведении на ссылку. Я был настолько упорен, что проверил проблему в другом браузере только через три часа, а затем догадался проверить другие сайты. Оказалось, это баг Safari 27.
  • 😁 13
  • 🫡 2
  • ❤ 1
Post #781 577
Выдает 10 токенов в секунду, не быстро, но на самом деле терпимо. Особенно для асинхронных задач (M4 Max, 128 Гб).
Post #780 439
В целом количество скачиваний за два часа показывает сколько реально людей пользуется локальными моделями.
  • 🤣 1
Post #779 436
Вышла Qwen. Тестить буду ночью.

А самый кайф - миллион контекста. Я думаю уже год максимум и маленькие модели будут полностью соответствовать текущим большим - что за глаза для любых задач.
  • 🥰 6
Post #778 431
Всех с пятницей! #пятничныйюмор
  • 😢 4
  • 😁 2
Post #777 432
В Hermes Agent меня бесит больше всего, что он на любой чих - пух вызывает питон. Ну то есть в задаче ему достаточно прочитать пару файлов, грепнуть их, а он вызывает питон. При этом в телеге этот вызов очень сильно сокращяется и я даже не понимаю, а че он пытается сделать.
  • 🤣 3
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →