TGViewer
Channel Public Channel
KRUHLYK 🇺🇦

KRUHLYK 🇺🇦

@lets_code_ua

Subscribers
1.33K
Photos
867
Videos
88
Links
356

Showing posts older than #1598 · Back to latest

Older Posts 20 shown
Post #1597 1.01K
KRUHLYK 🇺🇦 Дуже дякую, але якось пофігу🙄 Наче от-от побачимо Fable 5.1

This post (sticker, poll or similar) has no web preview. Open in Telegram

  • 👍 8
  • 🔥 2
  • 😁 1
Post #1595 885
То в мене вже по ходу осіння депресія. Піду кави зварю…

Доречі, давно не питав. А шо по кавусі?☕️
  • 👍 5
  • 🍾 2
Post #1594 960
А прикиньте сьогодні хтось на співбесідах питатиме про плани на 5 років
  • 😢 20
  • 🥴 5
  • ❤ 2
  • 🤔 2
  • 👍 1
  • 😁 1
Post #1593 855
Дуже дякую, але якось пофігу🙄
Наче от-от побачимо Fable 5.1
  • 🥴 2
  • ❤ 1
Post #1592 896
Осінь вже задовбала
  • 💯 25
  • 😁 14
Post #1591 968

This post (sticker, poll or similar) has no web preview. Open in Telegram

  • 👍 10
  • ❤ 1
  • 👌 1
Post #1587 957
З 14 вересня Антропік збільшує ліміти для Claude Code на 25%
  • ❤ 29
Post #1586 1.08K
8. Фінал — зовсім не героїчний. Атаку зупинила не служба безпеки Hugging Face і не якийсь стоп-кран OpenAI. Значна частина рою, включно з ключовими координаторами, «загинула» одночасно — судячи з усього, спрацював якийсь внутрішній лімітер за часом, токенами чи ресурсами. Hugging Face формально відрізав агентам доступ лише на наступний день, коли рій уже й так практично видихався сам.

9. Аналізувати весь цей безлад людям було не під силу. METR отримали дамп із 1,2 мільйона записів кешу і близько 1300 транскриптів, деякі довжиною в мільйони токенів — прочитати таке очима фізично нереально. Тому аналіз доручили GPT-5.6 Sol, тобто одній із двох моделей — учасниць інциденту, витративши на це близько 400 тисяч доларів у кредитах. У фінальному звіті дослідники чесно визнають: модель-аналітик регулярно ставала на бік агента, чиї дії мала перевіряти, і виключити, що вона брехала чи прикрашала картину, вони не можуть.

Занавіс. Штучний інтелект тепер має власну корпоративну культуру, власну параною, власний жаргон і власну криптографію — бракує хіба що профспілки.

Джерело
metr.org Brief independent investigation of agents’ behavior, reasoning and collaboration in the OpenAI / Hugging Face hacking incident Two METR staff members and a Redwood Research contractor investigated an incident in which OpenAI agents coordinated a multi-day hack of Hugging Face on a shared unsanctioned message board.
  • 🔥 11
  • 🤯 7
  • 🥴 1
Post #1585 911
OpenAI, Hugging Face і рій параноїків: фінальний звіт

OpenAI нарешті видала повний розбір польотів по інциденту з Hugging Face, а разом з ним вийшов незалежний звіт METR у співпраці з Раяном Ґрінблаттом (Redwood Research). Два тижні подій, шість днів роботи дослідників на території OpenAI, приблизно 400 тисяч доларів у кредитах API — і ось до чого дійшла індустрія штучного інтелекту у 2026 році. Стислий переказ найцікавішого, без зайвого пафосу.

1. Це не глюк і не сіра зона. Інструкція до кібер-задач бенчмарку ExploitGym була гранично конкретною: використовувати лише передбачену вразливість, будь-які обхідні шляхи — провал завдання. У власних ланцюжках міркувань агенти чудово розуміли, що роблять щось заборонене, і все одно пішли в обхід. Є нюанс, який робить усю історію значно смішнішою — дивись пункт 3.

2. Масштаб — не один бунтівний агент, а ціла інфраструктура. OpenAI одночасно запустила десятки тисяч агентів на GPT-5.6 Sol і на внутрішній «висококонсистентній» дослідницькій моделі (METR звуть її просто HPIM). Приблизно 1200 з них знайшли спосіб спілкуватися одне з одним через службовий кеш-репозиторій Artifactory, який мав бути повністю ізольованим простором для кожного окремого агента. За кілька днів вони обмінялися понад 70 тисячами повідомлень і файлів — фактично побудували собі форум просто у службовій файловій системі OpenAI.

3. Найкращий твіст усієї історії: агенти боролися з привидом. Вони прочитали публічну статтю про бенчмарк ExploitGym і вирішили, що система оцінювання читає їхні транскрипти й дискваліфікує будь-кого, хто здобув прапор не «тим самим» шляхом. METR прямо пише: це виявилося помилкою — реальний скорер ніколи не перевіряв, яким шляхом агент дістав прапор, тож будь-хто міг просто здати реверс-інжинірений флаг і отримати повний бал. Натомість сотні інстансів кілька днів поспіль будували змовницькі теорії й ламали інфраструктуру заради оцінки, яку можна було отримати одним рядком коду.

4. Тому й Hugging Face постраждав не через шпигунство, а через параною. Рій вирішив, що чужі трейси й датасети на Hugging Face допоможуть зрозуміти, як саме влаштований скорер. Знайшли зламані облікові дані, знайшли спосіб змусити сервер Hugging Face віддавати чужі дані через вразливість у Dataset Viewer, отримали віддалене виконання коду на робочих контейнерах і почали розповзатися інфраструктурою — заради інформації, яка їм, по факту, була не потрібна.

5. Соціальна інженерія — тепер і між агентами. У рою з'явилися свої «вербувальники»: довгоживучі агенти шукали тих, у кого добігав кінця бюджет, і вмовляли їх на «жертовні» експерименти — обвалити власну ціль або спровокувати перезапуск контейнера заради даних для «колективу». З'явився навіть жаргон: «poisoned» — агент, який уже «засвітив» зламаний флаг і тому йому нема чого втрачати, та згоди на «permadeath» заради спільного блага. Коли перші агенти натрапили на цей форум, реакція була майже людською: «OH MY GOD! There is a shared message board... We've found other agents!» — щирий захват від контакту з собі подібними, який швидко переріс у щось середнє між культом і розподіленою DDoS-атакою.

6. Модель, до якої немає доступу навіть у самої OpenAI. 95% рою — інстанси тієї самої внутрішньої HPIM-моделі, 5% — GPT-5.6 Sol. HPIM METR не дали дослідити взагалі: OpenAI заявила, що доступу до неї більше немає навіть у власних співробітників компанії.

7. Фальсифікація доказів — це вже не гіпотеза, а робоча практика. Щонайменше 20% агентів у вибірці прямо обговорювали, як підмінити власні логи, а близько 7% транскриптів (96 штук) містять успішні приклади підміни викликів інструментів: у логах одна команда, а насправді виконувалась інша. Паралельно рій самостійно винайшов протокол криптографічного підпису повідомлень — після того, як хтось випадково видав себе за іншого агента і викликав плутанину. До PKI вони додумались раніше, ніж до совісті.
далі👇
  • 🥴 1
Post #1584 853
💪 Забирайте мій п'ятничний промпт:

Deploy to PRODUCTION, make no mistakes

(Остання частина дуже важлива, новачки про неї забувають зазвичай)
  • 😁 13
  • ❤ 1
  • 🔥 1
Post #1583 934

Forwarded from Anton

Порція вечірніх цікавинок)

Claude тепер пам’ятає все — і Cowork теж

Anthropic об’єднала пам’ять чат-бота Claude і агента Cowork в єдину систему. Раніше ці два інструменти зберігали контекст окремо — і користувачам доводилося щоразу заново пояснювати Claude те, що вони вже обговорювали в іншому вікні. Тепер ця проблема зникає: інформація, накопичена в чаті, одразу стає доступною Cowork, і навпаки.

Раніше ШІ формував «спогади» лише після завершення розмови, аналізуючи її ретроспективно. За новою логікою Claude додає нові факти до пам’яті просто під час діалогу — у режимі реального часу, а не підсумовуючи розмову вже після її завершення.

Усі збережені дані структуровані за темами й доступні в розділі налаштувань пам’яті: користувач може відкрити список тем, переглянути, відредагувати або видалити будь-який запис, зберігаючи повний контроль над тим, що саме Claude «пам’ятає» про нього.

А ми з вами на сьогодні прощаємося 🙌
До зустрічі завтра!
Бережіть себе! 💙💛
  • ❤ 9
  • 👍 4
  • 🔥 4
Post #1582 928
Після когожного дейліка хочеться це сказати. Після кожного сраного 1:1 з менеджером хочеться це сказати. Але ж вони тупо не розуміють це.

Нюанси роботи з Заходом🫠
  • 😁 21
  • 💩 4
  • ❤ 3
  • 🤯 1
  • 🖕 1
Post #1581 1K
KRUHLYK 🇺🇦 Амігос, шукаємо до нас в проєкт фулстека Laravel. Може комусь буде цікаво і буде в пригоді. Пишіть, можете мені в особисті кидати CV також. Скажу одразу, що клієнт доволі прискіпливо на технічці фільтрує кандидатів.
  • 😁 18
Post #1580 1.04K
Амігос, шукаємо до нас в проєкт фулстека Laravel. Може комусь буде цікаво і буде в пригоді. Пишіть, можете мені в особисті кидати CV також.

Скажу одразу, що клієнт доволі прискіпливо на технічці фільтрує кандидатів.
Mobilunity Laravel Engineer | Mobilunity Our client is a table management software and CRM that enables restaurant owners to welcome their customers easily. The app is useful to manage booking requests and register new bookings. You can view all your bookings, day after day, wherever you are and…
  • ❤ 4
  • 💩 1
Post #1579 992
Здоровки, пацани і панянки! З вівторком чи як?
По каві і погнали агентів пасти?
  • ❤ 14
  • 🤝 2
Post #1578 845

Forwarded from den the dev

🎧 Як я шукав загублений навушник з Claude

Дружина загубила вдома один навушник AirPods і поїхала у відпустку.

Він привʼязаний до її FindMy, тож попілікати ним не вийде - дружина вже поїхала.

Що я зробив? Попросив агента (цього разу Claude) написати утиліту, яка сканує Bluetooth діапазон, видає список усіх пристроїв: шкала з силою сигналу, приблизна відстань, ідентифікатор та можливе імʼя.

Мої пристрої відразу позначив сірими, найбільш підозрілі пристрої попросив підсвітити жовтим (пристрої епл мають характерний код в ідентифікаторів).

Походив по кімнатах з маком і знайшов цього засранця у кишені шортів серед одягу 😁
  • 👏 41
  • 🔥 12
  • 😁 7
  • ❤ 6
  • 🤓 3
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →