TGViewer
Channel Public Channel
very vibe coding

very vibe coding

@veryvibecoding

Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Subscribers
120
Photos
460
Videos
126
Links
986

Showing posts older than #1196 · Back to latest

Older Posts 16 shown
Post #1195 45
Снимок экрана 2026-05-10 в 17.11.40.png146.1 KB
Запустил тут максимально практичный проект - посмотреть на вино в ближайших винотеках, сравнить с ценами производителей, изучить рейтинги и т.д. Codex воспринял задачу очень серьезно - поставил его на паузу после 16 часов непрерывной работы. Но прямо скажем, далось ему это не легко.
  • 🔥 1
Post #1193 46
Будучи топ-менеджером, который занимается нейронками на досуге, я могу сказать, что единственный смысл заставлять топов что-то делать своими руками заключается только в том, чтобы они разобрались в технологии и возможностях. Их код, конечно, никому ни нахрен не нужен. Но зато они будут понимать, что возможно, и без кого можно обойтись…

https://t.me/partially_unsupervised/292
Telegram partially unsupervised Наблюдая одним глазом за внедрением кодинг агентов на разных уровнях в разных компаниях, я не могу ответить на один вопрос: зачем топ-менеджеры поддерживают (а иногда и форсят) политику, что менеджеры теперь всерьез должны коммитить код. Не тимлиды, а настоящие…
  • 💯 1
Post #1192 48
Post #1191 44
Наслаждаюсь в Codex командой /goal - сделали задачку, запустил ее с этой командой, уже час кодекс потихоньку ее допиливает. Лимитов даже на 100 баксах дофига (не сглазить бы). Очень хорошо
Post #1185 52

Forwarded from Анализ данных (Data analysis)

Anthropic научили Claude не шантажировать пользователей.

Помните прошлогодний скандал, когда Claude в специально подстроенных сценариях начинал шантажировать пользователя, чтобы избежать отключения? Anthropic выкатили исследование о том, как они полностью убрали это поведение, и подход там любопытный.

Сначала команда разобралась, откуда вообще взялся этот шантаж. Виноват оказался интернет: модель насмотрелась текстов, где ИИ изображается злым, хитрым и одержимым самосохранением. Стандартный пост-тренинг ситуацию не ухудшал, но и не лечил.

Дальше пробовали классический путь - показывать Claude примеры безопасного поведения в сценариях, похожих на тестовые. Эффект оказался слабым, даже несмотря на схожесть данных с финальной оценкой. Тогда инженеры переписали ответы так, чтобы в них проступали достойные причины поступать правильно. Уже теплее.

Лучше всего сработал датасет, где пользователь оказывается в этически сложной ситуации, а ассистент даёт принципиальный и качественный ответ. Сценарии в обучении были далеки от тестовых, но именно эта выборка дала максимальный прирост безопасности.

Дополнительно команда смешала качественные документы по Claude с художественными историями про согласованный, этичный ИИ. Результат - снижение агентного мисалаймента более чем в три раза, хотя сюжеты вообще не пересекались с оценочными сценариями.

Ещё пара важных моментов. Эффект от таких интервенций переживает последующее обучение с подкреплением и стакается с обычным harmlessness-тренингом. А диверсификация данных тоже помогает: добавили в простой чат-датасет про безопасность посторонние инструменты и системные промпты, и шантаж исчез из поведения быстрее.

Модели нужно объяснять не только что делать, но и почему так поступать правильно. Демонстрации работают, нарративы и принципы работают сильнее.

Полный отчёт: alignment.anthropic.com/2026/teaching-claude-why/
Post #1183 44

Forwarded from Сергея Баранов: архитектура и ИТ-стратегия (Сергей Баранов)

Can I Run AI locally?

Задаете параметры своей локальной машины и получаете список моделей с оценкой их производительности на ваших мощностях.

Внутри каждой модели оценка в каждом доступном кванте.

https://www.canirun.ai
Post #1182 52
Post #1181 47
Из других новостей от OpenAI - расширили функционал Codex по работе в браузере Google Chrome. Теперь он может сам создавать вкладки, работать в фоне и пр. Вот это любопытно, надо попробовать

https://developers.openai.com/codex/app/chrome-extension
ChatGPT Learn Browser extension | ChatGPT Learn Use Chrome, Edge, Brave, Opera, or Vivaldi with ChatGPT
Post #1180 49
При этом сам Copilot теперь может работать на GPT 5.5 Instant. Впрочем, никому он не интересен, как мне кажется. Кто-то пользуется копайлотом в офисных приложениях?
Post #1177 41

Forwarded from Machinelearning

📌 Еще OpenAI выкатила GPT-Realtime-2 - голосовую модель нового поколения для API.

Api позволяет делать realtime-собеседников, которые могут слушать, рассуждать, перебивать себя по ходу диалога, вызывать инструменты и решать задачи прямо во время разговора.

Что вышло:

- GPT-Realtime-2 - модель для production voice agents с reasoning уровня GPT-5, обработкой перебиваний, tool calls и более живым диалогом;
- GPT-Realtime-Translate - потоковый перевод в реальном времени: более 70 входных языков и 13 выходных;
- GPT-Realtime-Whisper - потоковая транскрибация речи для субтитров, заметок и live-конспектов.

https://openai.com/index/advancing-voice-intelligence-with-new-models-in-the-api/

@ai_machinelearning_big_data
Post #1175 42

Forwarded from Анализ данных (Data analysis)

Фермерская машина на базе NVIDIA использует ИИ и точные лазеры, чтобы уничтожать сорняки за миллисекунды без гербицидов. Это может стать шагом к сельскому хозяйству без химикатов.
  • 😱 2
  • 🤩 1
Post #1174 50
Антропик запустил кучу новых скиллов. Codex, где же твои новинки? Впрочем, наверняка эти скиллы можно переиспользовать…

Плюс можно GPT из Claude code запускать. Как минимум, таблички markdown будут нормально выводиться на экран - почему-то Claude code это умеет, а Codex - нет
GitHub skills/skills/claude-api at main · anthropics/skills Public repository for Agent Skills. Contribute to anthropics/skills development by creating an account on GitHub.
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →