TGViewer
Channel Public Channel
very vibe coding

very vibe coding

@veryvibecoding

Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Subscribers
119
Photos
460
Videos
126
Links
980

Showing posts older than #1378 · Back to latest

Older Posts 19 shown
Post #1377 60
Новый стандарт для голосовых ассистентов - надеюсь, недолго ждать когда появятся подобные локальные модели. Тот же Sber может постараться - его Salut для распознавания голоса я использую активно.

Думаю, через какое-то время и у мошенников уйдет украинский акцент..

https://t.me/vibecoding_tg/3445
Telegram Вайб-кодинг Вчера OpenAI представила GPT-Live — новое поколение голосовых моделей, которые теперь лежат в основе режима ChatGPT Voice. Главное изменение - поддержка full-duplex. Модель одновременно слушает и говорит, поэтому может естественно вставить короткое «угу»…
Post #1376 68
Когда я вайбкодю, очень часто использую разные модели. Одна программирует - другие проверяют. Это позволяет находить много ошибок, и бонус в том, что разные модели на код смотрят по разному, здесь разнообразие принципиально важно.

Запустил проверку с 4 моделями - Fabel, GPT, GLM, DeppSeek. Из интересного - DeepSeek хотя и самая слабая модель из этих, нашел несколько критичных проблем, которые не увидели другие. GPT- нашел больше всего. А Fable - даже не стал искать. Он посчитал, что оркестратору это не нужно. Очень в духе Антропиковских моделей - никогда не видел таких ленивых ИИ у других компаний ))
Post #1375 79
У Клода есть фишка, которой я пользуюсь чаще и чаще - Claude Design. Начинаю отвыкать от самостоятельного изготовления презентаций. Думаю, что это уже навсегда.
Post #1374 89
Cursor наконец дообучил свою модельку на мощностях xAI. Раньше они работали с Kimi-2.6 - интересно, насколько новая модель ее развитие, или писали прямо все свое с нуля.

Предложение интересное, особенно для тех, кто сидит на Курсоре, но у меня и так уже три модели по подписке - GPT, Claude, GLM, плюс по апи DeepSeek - пятую уже не осилю

https://t.me/data_secrets/9508
Telegram Data Secrets ⚡️ Вышел Grok 4.5 Релиз пришел откуда не ждали. Это первая модель от xAI (теперь уже SpaceX), ориентированная на кодинг и агентов. Итак: – По бенчмаркам в целом уровень GPT-5.5 и Opus 4.8, но на SWE Pro пока не дотягивает. – При этом модель быстрее…
Post #1372 96
Post #1371 86

Forwarded from Вайб-кодинг

Несколько ресурсов по harness engineering, которые я с большим удовольствием изучаю в последнее время:

» https://walkinglabs.github.io/learn-harness-engineering/en/ — отличный курс о том, как продуктивно ограничивать поведение агента, какие проблемы возникают при использовании LLM (особенно с удержанием контекста) и как сделать harness более агентным и доводящим задачи до корректного завершения.
» https://twotimespi.dev — создай упрощённого агента на Python (Tau). Начни с uv tool install tau-ai.
» https://humanlayer.dev/blog/skill-issue-harness-engineering-for-coding-agents — уроки и выводы из неудач и успехов в построении harness-ов для кодинг-агентов за 12+ месяцев.
» https://langchain.com/blog/the-anatomy-of-an-agent-harness — обзор высокого уровня множества компонентов, которые должны правильно сойтись в harness-е, чтобы агент работал.

🐸🐸🐸
walkinglabs.github.io Welcome to Learn Harness Engineering | Learn Harness Engineering A project-based course on designing the environments, state, verification, and control systems that make Codex and Claude Code reliable.
Post #1370 81
Fable вернулся, но чуда не случилось. Склонен согласиться с критиками, что теперь это просто Опус, магия пропала. Интересно, что будет с GPT-5.6, насколько зарежут Sol.
Post #1369 84
Прежде чем вам пересылать такие посты, я обычно спрашиваю своего кло - интересно, стоит заняться?

С память я и без кло знаю - что важно. Но вот когда дойдут до этого руки... У меня сейчас, кстати, стоят параллельно claude-mem и agentmemory. Иногда использую, но не сказать, чтобы это прям в систему вошло

https://t.me/machinelearning_interview/2855
Telegram Machine learning Interview ⚡️ 30 техник памяти для AI-агентов в Jupyter notebooks Вышел репозиторий Agent Memory Techniques с 30 runnable notebooks по памяти в современных AI-агентах. Внутри собраны основные подходы: conversation buffers, vector stores, knowledge graphs, episodic…
Post #1368 63

Forwarded from Вайб-кодинг

Anthropic выпустили официальную библиотеку промптов для Claude.

И она полностью бесплатна. Там есть:
- Планирование, отладка, ревью кода, безопасность, автоматизация

Каждый промпт сопровождается пояснениями, как и почему он работает. Библиотека создана самой Anthropic.

🎉🎉🎉
  • ❤ 2
Post #1367 68
Post #1366 68
Ну, в общем, да. Похоже, что Sonnet действительно очень прожорлив на токены. По крайней мере, при подготовке презентации с Опус они уходят не сильно быстрее Соннета.

Чувствую себя так, как будто купил в магазине бутылку кефира, которая по цене хороша, а по размерам оказалась раза в полтора меньше прежней модели...

Fable, конечно, круто, но по АПИ его будут использовать только крейзи сотрудники айти компаний. Единственное, что нас спасет пока - это GPT-5.6. Может, глядя на него и Fable будет доступнее, но для этого надо сначала модель выпустить в паблик..
Post #1365 68
Fable вернулся... А я пока тестирую Sonnet на изготовлении презентаций...
Post #1364 69

Forwarded from эйай ньюз

Anthropic опубликовали блогпост с деталями перевыпуска Fable 5

Официально подтвердили что причиной блокировки стал репорт амазона, где Fable 5 нашла уязвимость и написала код который её может использовать. Те же самые уязвимости могли найти и использовать Opus 4.8, GPT 5.5 и Kimi K2.7. Тем не менее Anthropic натренировали более жёсткий классификатор, который будет перекидывать запросы на Opus 4.8.

Доступ должны включить всем у кого он был в течение ~суток. До 7 июля до половины лимитов подписок Pro, Team, Max и Premium Enterprise могут быть использованы на Fable 5, дальше по кредитам.

@ai_newz
Post #1363 66
Ну, кстати. Если кто-то раздумывает над платной подпиской, но не хочет тратить много - берите Антропик за 20 баксов (даже дешевле, если за год платить), ставьте Sonnet - и наслаждайтесь. Это отличное вхождение в мир LLM. Окупите потраченные деньги на паре больших презентаций, сделанных с Claude Design.
Post #1362 76
Post #1361 61

Forwarded from Вайб-кодинг

NVIDIA открыла исходный код модели визуальной локализации LocateAnything-3B.

Модель умеет находить объекты даже в очень плотных сценах. Например, на изображении с десятками миньонов, стоящих вплотную друг к другу, она корректно выделяет каждого отдельной рамкой.

Главное отличие от большинства существующих моделей - это способ генерации ограничивающих рамок. Обычно координаты (x1, y1, x2, y2) предсказываются последовательно, цифра за цифрой. Это замедляет работу, а ошибки на ранних этапах могут влиять на последующие координаты, особенно если объектов много.

В LocateAnything-3B используется параллельное декодирование, тоесть модель сразу предсказывает готовые рамки целиком, а не строит их поэтапно. За счёт этого детекция становится стабильнее, особенно в сценах с большим количеством объектов.
Для обучения использовались не только классические датасеты для распознавания объектов, но и данные для распознавания интерфейсов, OCR и анализа структуры документов. Поэтому модель умеет находить как реальные объекты, так и элементы пользовательского интерфейса и текстовые области.

Модель содержит 3 млрд параметров и распространяется с открытым исходным кодом. 💜
Post #1360 67

Forwarded from Вайб-кодинг

Нашёл бесплатный опенсорс инструмент, который за секунды превращает любые PDF, Word, Excel или отсканированные изображения в чистый Markdown:

• текст в правильном порядке
• таблицы в HTML
• формулы в LaTeX
• OCR
• 109 языков

Работает через CLI, Python или веб (mineru.net). Запускается локально на твоём компьютере. 100% приватно.
Больше 70000 звёзд на GitHub. 😋
  • 🔥 1
Post #1358 61

Forwarded from How2AI (дядя_д)

GPT-5.6 вышла - и сразу три модели

☀️ Sol - флагман, следующий frontier-модель. Самая мощная, самый глубокий reasoning
🤣 Terra - сбалансированная для повседневной работы. Конкурент GPT-5.5 по качеству, но в 2 раза дешевле
🌚 Luna - быстрая и дешёвая для высоконагруженных задач. Самый низкий ценник у OpenAI

Новая логика нейминга: цифра = поколение, имя = уровень способностей. Каждая линейка развивается самостоятельно.

Что нового в Sol:
- Новый режим max для максимально глубокого reasoning
- Новый режим ultra — работает через сабагентов, выходит за рамки одного агента
- SOTA на Terminal-Bench 2.1 (кодинг), сильный буст на GeneBench (биология) и ExploitBench (кибербез)
🔥🔥🔥На чипах Cerebras будет давать до 750 токенов/сек. запуск в июле

Цены (за 1M токенов):
- Sol: $5 / $30
- Terra: $2.50 / $15
- Luna: $1 / $6

OpenAI вложила 700K GPU-часов A100 в автоматический red-teaming для поиска универсальных джейлбрейков. Но релиз это не спасло.

Прямо сейчас - limited preview для доверенных партнёров. Широкий доступ «в ближайшие недели». В OpenAI сами отмечают, что не считают такой правительственный процесс правильным на долгосрочку, но выбрали его как самый быстрый путь к релизу.

Блог-пост: https://openai.com/index/previewing-gpt-5-6-sol/

@how2ai | Забустить канал 💗
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →