TGViewer
Channel Public Channel
very vibe coding

very vibe coding

@veryvibecoding

Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Subscribers
120
Photos
460
Videos
126
Links
983

Showing posts older than #1258 · Back to latest

Older Posts 20 shown
Post #1257 45
Тут у меня заканчивались недельные лимиты на Клода, решил настроить Claude Design - плагин в веб-версии клода, который позволяет делать презентации. На обучение Клода корпоративному стилю в лимит прошлой недели не уложился. Потратил еще и лимит этой недели.

Зато сделали шаблон для подготовки презентаций в стилистике моей конторы. Пример презентации прилагается. Не все идеально, но решил, что докручу в следующий раз.

Презентации всегда были слабым местом нейронок, но похоже, что мы близки к решению. Сама мысль о том, что можно сделать презу за 5 минут, и она будет иметь дизайн промышленного качества, вдохновляет. И заставляет задуматься о возвращении к дорогой подписке с большими лимитами.

Из интересного - преза верстается в html, потом, при необходимости, переводится в power point. Есть ощущение и надежда, что скоро паверпойнт отомрет и станет лишним - все проблемы с кривыми презентациями от него.

Вообще интерактивную страничку сейчас проще и дешевле сделать, чем презентацию - может, так и надо поступать.

Но если подвести итог, от Claude Design я под большим впечатлением. Офигенно
Post #1256 52
Post #1255 43
HuggingFace публикует не только открытые модели. Но, например, и макеты роботов - можно собрать из доступных запчастей и деталей, напечатанных на 3D принтере. Стоит примерно 2,5 тыс. баксов.

https://huggingface.co/blog/VirgileBatto/lerobot-humanoid
huggingface.co LeRobot Humanoid: An Open, Low-Cost, 3D-Printed Humanoid for Robot Learning A Blog post by Virgile BATTO on Hugging Face
Post #1253 41
Post #1252 43
Google выпустил новые классные обновления - модели, агенты для работы с ними и пр. Как результат, подписку на гугл я отменил.

Просто в новых подписках меня жестко банят по стране эккаунта, и поменять страну мне тоже не дали.

Ну ок, буду платить OpenAI и Антропику. В крайнем случае, DeepSeek - у них нет подписок, но есть дешевый апи, и хотял слухи, что китайцы пишут для него свой Claude code. Вот жду и с удовольствием попробую.
Post #1250 46

Forwarded from Tips AI | IT & AI

Мне вчера понравилась обнова в Codex, а именно:

• Appshots для macos — жмёшь хоткей и Codex получает скриншот и расшифровку активного окна, удобно чтобы передать ошибку или фрагмент документа без копирования
• Locked Computer Use — будет работать даже на залоченном Mac, как раз для тех самых с приоткрытыми ноутами
• Browser annotations — режим когда во встроенном браузере отмечаешь что поменять: шрифт, цвет, отступы и тд

По мелочи еще улучшили расширение для Chrome, добавили /goal в десктопное приложение, и дали возможность делиться плагинами с командой внутри workspace

Очень крутой и удобный Codex именно в десктопе. В отличии от клодовского приложения.

Настолько, что даже Antigravity превратился в Codex 😏

@tips_ai #news
  • 🔥 1
Post #1249 38
Love. Death. Transformers. У меня давно был скептицизм касательно гугловых моделей, в целом - ничего не поменялось
Таких прям проблем у меня с Google не было, но с точки зрения поиска ошибок в коде она сильно уступает Claude и GPT. C кодом у GPT получше, но по человечески - модель сильно бесит по сравнению с Клодом. Он как-то понятнее пишет...
Post #1248 40

Forwarded from Love. Death. Transformers.

У меня давно был скептицизм касательно гугловых моделей, в целом - ничего не поменялось
  • 🕊 1
Post #1247 42

Forwarded from Dealer.AI

Google Search an agent🔋

Вот оно закономерное и долгожданное обновление всего поиска. Google недавно объявил о самом масштабном редизайне поиска за 25 лет, и это не просто новая поисковая строка. Это переход от поисковика к агентной платформе. 😜

Вот что важно понимать прямо сейчас:

1. AI Mode уже 1 млрд пользователей в месяц, статистика за год. Запросы удваиваются каждый квартал. Люди перестают искать ключевыми словами - они начинают разговаривать  с поиском. И я уже говорил, что будет нативный диалог в поиске и рекомендациях , как удобный канал связи с юзером.
2. Новая поисковая строка - не строка, а диалоговое окно. Логичное следствие из п1. Оно динамически расширяется, понимает изображения, видео, файлы, вкладки Chrome. AI подсказывает, как сформулировать вопрос - не автодополнение, а мышление вместе с пользователем. 🤙
3. Поисковые агенты работают 24/7. Задали критерии поиска квартиры? Агент сам сканирует объявления и пишет, когда появился подходящий вариант. Следите за дропами кроссовок? Агент мониторит соцсети и новости. Работает в фоне, пока вы живёте жизнь. Вот для чего мы делаем свой GEO и MCP 😜
4. Google теперь ваш дворецкий/консьерж: звонит за вас в "бронирование караоке" , делает запись к мастеру по маникюру, вызов сантехника. Крч, Search может позвонить в бизнес от вашего имени, правда только в США и уже этим летом. 🤔
5. Antigravity и поиск генерирует приложения. Нужен трекер фитнеса? Search кодирует  его прямо в окне браузера, подтягивая реальные данные: погоду, карты, отзывы. Интерактивные симуляции, графики, дашборды все это на лету, бесплатно, ну это пока 👍
6. Personal Intelligence стал бесплатным 200 стран, 98 языков, без подписки. Подключаете Gmail, Photos, Calendar, и Search знает ваш контекст. Но контроль остаётся у вас. 🪨
Модель по умолчанию - Gemini 3.5 Flash. Сделана именно для агентов и кодинга.

Что это значит для рынка?
Google не догоняет ChatGPT. Google превращает поиск, экономику, UX/CJM в операционную систему поверх интернета (не только уже поиск). Конкуренция теперь не за запросы - а за задачи, в текущем случае, ещё и подкрепленные мощным поиском, а значит более доверенные. Кто выполнит всю работу от идеи до результата, и вырастит доверие к выдаче, пусть через поиск, тот и заберет пользователя.
И да, самые мощные агенты информационные + кастомные мини-приложения, пока за подпиской Pro/Ultra. 🚬

Что думаете - убьёт ли это классические сайты-агрегаторы? Или превратит их в API для Google? Пишите в комментариях.
👇👇👇👇👇
Post #1246 34

Forwarded from Анализ данных (Data analysis)

Qwen выкатила Qwen3.7-Max: модель под агентов.

Alibaba показала Qwen3.7-Max - новый флагман семейства, который явно целят не в «ответь на вопрос», а в полноценную агентную работу.

Главный акцент - кодинг и long-horizon задачи. Модель обещают как основу для агентов, которые умеют не только писать куски кода, но и вести задачу end-to-end: собирать фронтенд-прототипы, делать многофайловые рефакторы, дебажить реальные проблемы и работать через инструменты.

Самая громкая заявка - 35 часов автономной работы над задачей по оптимизации kernel. Больше 1000 tool calls и без постоянного ручного контроля. Если это стабильно повторяется не только в демо, это уже другой класс агентных сценариев.

Что ещё заявляют:

- coding agent для реальной разработки, а не игрушечных сниппетов
- офисный ассистент через MCP-интеграции
- multi-agent orchestration для сложных рабочих процессов
- совместимость с разными агентными оболочками
- работа через Claude Code, OpenClaw, Qwen Code или свой стек
- доступ через Alibaba Model Studio и Qwen Studio

📖 Blog: https://qwen.ai/blog?id=qwen3.7
✅ Qwen Studio: https://chat.qwen.ai/?models=qwen3.7-max
⚡️ API:https://modelstudio.console.alibabacloud.com/ap-southeast-1?tab=doc#/doc/?type=model&url=2840914_2&modelId=qwen3.7-max&serviceSite=international

@data_analysis_ml
  • 🔥 2
Post #1245 37
Post #1244 37

Forwarded from Data Secrets

Создатель механизма внимания Йошуа Бенджио предложил новую архитектуру для нейросетей

Вместе с исследователями из лабы KAIST и Нью-Йоркского университета он анонсировал GRAM – Generative Recursive reAsoning Models.

Ученые уже давно экспериментируют с так называемыми Recursive Reasoning Models. Идея в том, что в отличие от привычных ризонинг моделей они рассуждают не с помощью генерации дополнительных токенов, а как бы про себя, в пространстве внутренних состояний, которые итеративно уточняются, улучшая ответ.

Преимущество в теории очевидно: можно делать сотни шагов рассуждения без раздувания контекста. Но до этой работы такие модели были детерминированы, то есть при одинаковом входе всегда шли по одному и тому же пути и приходили к единственному ответу.

Почему это проблема? Потому что случайность – это источник креативного рассуждения самого по себе. В обычных ризонерах она есть, и это открывает путь к исследованию альтернатив и масштабированию через параллельный перебор. Нет случайности – нет возможности попробовать иначе, и это тупиковое развитие.

Заслуга GRAM как раз в том, что это первая в своем классе стохастичная модель. На каждом шаге рекурсии модель вычисляет детерминированный шаг – куда двигаться дальше – и добавляет к нему стохастический сдвиг. Среднее этого сдвига задает направление, а дисперсия – степень исследования. Чем сложнее задача, тем шире модель разбрасывает траектории. Затем из множества таких траекторий с помощью реворд модели выбирается лучшая.

На ARC-AGI GRAM набирает 52%, это примерно уровень GPT-5.2. А еще модель просто отлично играет в судоку.

https://ahn-ml.github.io/gram-website/
Post #1243 37
Google меняет Gemini CLI на Antigravity CLI - и пока кто-то в твиттерах радуется, я скажу, что это жесть. Во-первых у меня не работает, так как Google продолжает блокировать меня исходя из того, что я живу в стране-изгое (модель, кстати, дает. Настройки аккаунта и канадский телефон не помогают). Ну так еще и протокол acp по подключению агентов не будет работать в Антигравити. Ну и зачем такие обновления?

Можно, конечно, поплясать с бубном и попробовать прикрутить Gemini к оппнсорсному Claude code или OpenCode, но вот даже не знаю, оно мне надо?
Post #1242 43

Forwarded from КПД

Пока все обсуждают новую Гемини Флэш, NVIDIA тихонько выкатили серию гибридных авторегрессионно-диффузионных моделей Nemotron-Labs-Diffusion.

В коллекции 6 чисто языковых моделей - 3B, 8B, 14B LM-ки с алайнментом и их базовые модели, и еще 8B диффузионная VLM.

Модели имеют 3 режима работы:
🤓 Авторегрессионную генерацию
🚀 Диффузионную генерацию
🧙‍♂️ Спекулятивную генерацию с набрасыванием чернового варианта диффузией и AR самопроверкой

По качеству оно типа немного лучше Qwen-3-8B, но по скорости в самоспекулятивном режиме обходит Qwen3-8B-Eagle3 в 3 раза. Правда, вышел уже Qwen 3.5 ...

[Техрепорт]
Post #1241 36
Потратил с командой /goal 70% недельных токенов за 2 дня - и вот OpenAI обнуляет лимиты. Не рассчитывал, но надеюсь. Пожалуй, поставлю на ночь что-нибудь тяжелое погонять...
Post #1240 40
Большая модель Google пока не вышла, посмотрим, на что способна малая. Здесь, правда, скажу, что и Антропик и ОпенЭйАй далеко ушли в обвязке моделей своими продуктами - посмотрим, как с этим справится Гугл. Терминальный агент у них, честно говоря, так себе. Одной хорошей модели уже мало, нужна еще и ее обвязка

https://t.me/ai_machinelearning_big_data/10171
Telegram Machinelearning Google выкатили сразу два больших релиза: Gemini Omni и Gemini 3.5 Flash Похоже, Google снова пытается перехватить повестку в ИИ. Первый релиз - Gemini Omni. Это семейство мультимодальных моделей, которые работают почти со всем сразу: текстом, кодом, изображениями…
Post #1239 42
С одной стороны, очень рад за Карпаты, с другой - жаль. Хочется чтобы побольше крутых людей оставалось в опенсорсе. А то все эти корпорации добра потом из тебя все соки выжимают. С другой стороны, моего главного агента-программиста у Клода зовут Андрей (понятно, в честь кого) - как знал. А Карпаты удачи!

https://t.me/ai_newz/4582
Telegram эйай ньюз В одном из своих интервью осенью (кстати, очень рекомендую к просмотру) Адрей Карпатый говорил, что у него сформировалось FOMO, пока он был на вольных хлебах. Поэтому он, возможно, хотел бы вернуться назад в какую-нибудь frontier лабу в ближайшее время. …
Post #1238 39
Пошли новые модели от Google. Я как раз почти высадил подписки на неделю от GPT и Claude, посмотрим, на что способен Gemini 3.5
  • 🙏 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →