TGViewer
Channel Public Channel
КайфКодинг

КайфКодинг

@vibecodingartem

ВайбКодинг с Артемом Кругловым,
выпускник МФТИ, AI-гуру и основатель AnyQuery.

Быстрые лайфхаки: короткие видео с приёмами и трюками
Subscribers
1.02K
Photos
348
Videos
108
Links
479

Showing posts older than #358 · Back to latest

Older Posts 13 shown
Post #356 291

Forwarded from Artem Kruglov

Архитектура рантайма поиска озона
Post #355 310
Post #354 285

Forwarded from Валера Ковальский

UPDATE OpenAI deactivating (пост тут)

Нашел причину бана своих акков!

Оказалось проблема была не в IP и не в RU тексте

LiteLLM сливал все внутренние метаданные прокси напрямую в OpenAI

Что утекало

Если клиент передавал хоть какую то metadata (например sessionId в теле реквеста то LiteLLM добавлял к ней ВСЮ внутреннюю инфу прокси хотя должен был писать во внутренний лог

{
"metadata": {
"sessionId": "abc-123", // от клиента
"headers": { // ВСЁ ЭТО УТЕКАЛО
"x-real-ip": "1.2.3.4",
"x-forwarded-for": "5.6.7.8, ...",
"user-agent": "RestSharp/112.1.0"
},
"user_api_key_spend": 287.83,
"endpoint": "https://my-proxy.com/..."
}
}


OpenAI видел (лайт ллм душка прям все собирал)
Все IP адреса через x-forwarded-for
Что вы используете прокси
Информацию о расходах и ключах
User-Agent = автоматизация
Внутреннюю структуру сервиса

→ Бан 3 аккаунтов (одному было 2 года обидно)

Как это произошло

У меня появилось приложение клиент которого использует RestSharp для подключения к прокси (популярная C# библиотека 9.8k звезд) просто передавал sessionId для трекинга (честно не знаю то ли это клиент делает то ли разработчик)

metadata = new { sessionId = "abc-123" }

Прям внутрь реквеста к ллм
        "role": "user",
"content": "Привет! Как дела?"
}
],
"temperature": 1,
"metadata": {
"sessionId": "a5b3e26b-18c7-4017-9bcd-c2db6e450f78"
},
"stream_options": {
"include_usage": true
}
}'


И всё LiteLLM начинал сливать всю инфу в OpenAI

Код проблемы, пока нашел с курсором но передал так же людям проверить!

https://github.com/BerriAI/litellm/blob/main/litellm/proxy/litellm_pre_call_utils.py#L892

https://github.com/BerriAI/litellm/blob/main/litellm/proxy/proxy_server.py#L7855

https://github.com/BerriAI/litellm/blob/main/litellm/proxy/route_llm_request.py#L122

https://github.com/BerriAI/litellm/blob/main/litellm/llms/openai/chat/gpt_transformation.py#L436


Вы в зоне риска если
Используете LiteLLM Proxy
Клиенты передают metadata
Используете nginx перед LiteLLM
В РФ + VPS за рубежом

Большинство клиентов не передают metadata вообще и юзают обычные клиенты на питоне типа AsyncOpenAI
Но если хоть один клиент начинает использовать metadata утечка уже началась....


Кто на LiteLLM и ходит к openai напрямую проверьте это по списку

1 Проверьте логи что реально уходит к провайдеру (сделайте тест с передачей метадаты)
2 Временно запретите клиентам передавать metadata


Далее буду осторожнее
Со мной такое в первый раз (за один акк прям обидно 2 года ему было)
  • 😢 1
Post #353 275

Forwarded from Всеволод Устинов (канал: ai, стартапы, пост-ирония)

Имхо маркетинговым аналитикам сложнее и грустнее всех с ai. У разработчиков ai генерит код и автотесты, у менеджеров - проектную документацию и фолоуапы, а к аналитикам чаще все попадают только сложные и непонятные задачи, с которыми никакой ai без уймы инструкций и контекста не поможет. Но мы работаем над этим 🙂

Поговорили об этом на эфире с Александром Игнатенко, автором канала Модель Атрибуции @marketing_analysis.

Показал вживую:
— Cursor как агент для работы с документами и аналитическими задачами, а не только для кода.
— Реальные кейсы автоматизации аналитических задач
— Наш AI агент для анализа и мониторинга качества данных
— Наш AI агент для автоматического управления эд сетами и креативами - масштабирование, остановка выгорающих, перезапуск
— Roadmap до автоматизации полного цикла управления рекламой, вытаскиванием инсайтов из всех тестов и изменений, анализом конкурентов, автоматическим пополнением базы знаний и запуском экспериментов в автономном режиме

Итого: Мы движемся от ChatGPT (вопрос-ответ) → к Cursor (агент, который выполняет куски работы) → к автономным агентам (full-cycle automation).

Запись: https://www.youtube.com/watch?v=nFzxrpqxdnE

--

@vsevolodustinovchannel - самые трушные кейсы использования ai
YouTube AI против МАРКЕТОЛОГА. Кто кого? «Как запустить проект сквозной аналитики за 1 месяц - гайд в Miro + видеоурок» - https://go.add-2-cart.online/guide Телеграм-канал «Модель атрибуции» - https://go.add-2-cart.online/tg_channel Пост про Курсор в телеграм-канале Всеволода Устинова - htt…
  • 🔥 3
  • ❤ 1
  • 👍 1
Post #352 290

Forwarded from Валера Ковальский

Вайб Цех

Первый раз в жизни собираю митап!

Когда мы прогоняли сегодня с ребятами материал для конфы я понял, мы собрали реально очень полезную инфу для вас!

И от 0 и до 100 по сложности есть!

Значит будет интересно!

Ссылка на онлайн стрим https://red-mad-robot.timepad.ru/event/3605115/

25.10.2025


Дядя вещает вещи: https://t.me/dealerAI
  • 👍 1
Post #351 326

Forwarded from Да придет ИИ: ChatGPT, Claude, Gemini, Grok

Антропик представили Code with Claude anywhere

1. Работает в браузере
2. Можно кодить с телефона
3. Можно добавлять переменные окружения и настраивать доступ к сети
4. Можно создавать несколько сессий паралельно
5. После завершения сессии можно сделать PR

Но, для работы нужен git, что может оттолкнуть начинающих.

После завершения задачи, Claude создаст новую ветку claude/ с внесенными изменениями.

По-моему перед нами просто аналог Codex и Jules, но на движке Claude Code. За исключением того, что есть кнопка открыть сессию в Claude Code (cli) для открытия сессии уже локально.
Post #350 320

Forwarded from Глеб Кудрявцев — мастер AI

Ну что, обещал в пятницу, так что вот оно 🙂

Зарегистрироваться и попробовать Шотган про тут

Выбирайте в онбординге тариф Free, промо-код на месяц бесплатного pro применится автоматически.

Это облачный агент, то есть работает с репозиториями. Читает код оттуда, кодит, и делает пулл-реквесты. Локальную разработку когда-нибудь подвезу, но точно не сейчас.

Что делать после регистрации:

— Добавьте ключ одного из трех провайдеров (гугл, openai, openrouter)
— Запустите скан/умную индексацию репозитория. Если скан сорвался по любой причине, то можно нажать retry и он продолжит.
— В настройках можно задать оверрайд системных моделей (сейчас это либо gpt-5 либо gemini-2.5-pro). На оверрайде сейчас работает херово, я вас предупредил 😁
— после скана можно кодить

PS Основное назначение инструмента — эффективно кодить на кодовых базах свыше миллиона контекста, когда альтернативы начинают все сильнее деградировать.

Буду рад увидеть ваш фидбэк тут: @shotgun_feedback

Версия бета. То есть оно работает, кодит, и на мой взгляд довольно стабильно. Но всратые баги вы конечно заметите. Буду признателен за репорт.
Post #343 337

Forwarded from Сиолошная

Грустно видеть, что несмотря на то, что про бенчмарк я пиал два раза за последние 10 дней (7 и 11 октября), всё равно половина отметила «нет, не знаем». Я думал, что подводку хоть не надо будет писать, так как на слуху же, но нет... в общем, если не знаете — отправляю читать сюда.

Сейчас на первых трёх уровнях сложности из четырёх лучшая модель, GPT-5-High, решает 29% задач. Но это если делать 1 прогон и сравнивать один ответ. Но если бы вы запустили GPT-5 бесконечное количество раз, решила бы она в конечном итоге все проблемы?

Epoch.AI развели OpenAI на кредиты и решили это проверить, сделав по 32 прогона. Кроме этого, модели дали в 10 раз больше токенов на подумать, чем в прошлые замеры. Суммарно решили 134 задачи, или 46%. Авторы оценили динамику (см. первую и вторую картинки) и пришли к выводу, что скорее всего потолок примерно 50%.

Из оставшихся задач выбрали 10 и прогнали ещё 100 раз — и ни в одной из попыток ни для одной из задач GPT-5 не смогла дать правильный ответ. Это согласуется с ожиданиями.

Если же сделать суп из всех моделей и систем, которые тестировались на бенчмарке, включая ChatGPT Agent и Gemini Deep Think, то суммарно решается 57% задач, что почти наверянка не превышает 70%, если делать сильно больше прогонов.

Зачем вообще заниматься такой оценкой? Она может подсказать нам, чего ждать от ближайших обновлений моделей. Из-за того, как устроен процесс обучения размышлениям, можно ожидать, что если задача решается хотя бы один раз в 32-64 генерации, то можно забутстрепить до плюс-минус надёжного решения этой и других схожих задач.

И вот сейчас оказывается, что для 30% задач даже одной такой попытки нет. Правда у меня тут есть скепсис: часть задач в бенчмарке подразумевает поиск узкосепциализированной литературы по математическим разделам. Помню, что для некоторых задач давали описание, что их понимает буквально 10-20 человек на планете, и что по смежным темам есть по 2-3 статьи.

Из всех замеренных систем только ChatGPT Agent имеет доступ в интернет, и он показывает самый лучший результат при 16 прогонах, решая 49% задач, 14 из которых не решены ни одной другой моделью (у GPT-5 тут 46% при 32 решениях и всего 1 уникальная задача). Epoch.AI пишут, что в будущем добавят возможность делать поиск в интернете — ждём обновлений результатов в будущем.

По оценке авторов, в 2026-м модели будут решать +- 80% задач (с первой попытки, не группой).
  • 👍 1
Post #342 289
ЛЛМ решают 70% бенчмарк сложнейших математических задач, которые поймет 10-20 человек на планете
Post #337 307

Forwarded from EDU (Bayram Annakov)

Учим Claude уму разуму или Claude Skills

Помните, как в матрице Нео скачивает скиллы и фигачит в кунгфу и не только?

Anthropic выпустил нечто похожее, но пока только для AI агентов: вы можете научить Claude выполнять повторяющиеся задачи - например, выставить счет - и он сделает это за вас. Не надо копировать промпты. Классно не только то, что вам во второй раз не придется писать весь этот длинный промпт, но и то, что вы легко потом этот скилл можете передать Morpheus-у вашему коллеге, чтобы он своего Claude тому же научил. По всем стандартам и правилам вашей компании.

В аттаче скриншоты, как я научил Claude выставлять счета —> задачка, которую я регулярно делаю и, хоть и приятная в результате, но нудноватая. А тут научил ассистента и норм. Вот здесь подробная инструкция как это сделать для вашей задачи. Не забудьте включить в настройках Клода эту фичу (Settings > Capabilities > Skills)

Anthropic-у осталось только прикрутить создание скиллов к Claude for Chrome и будет RPA на максималках!

Научите себя, своих бухгалтеров, HRов, и операционистов!

P.S. Если хотите научиться автоматизировать скучные штуки в своей работе и жизни - то приходите в воскресенье
  • 🔥 3
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →