AI досліджує, розробляє, тестує безпеку — і все частіше робить це самостійно. Дайджест новин минулого тижня 👇
▪️ Claude бере участь у понад чверті AI-досліджень компанії
Близько 26% досліджень і розробок компанії тепер виконує Claude. Ще навесні цей показник був меншим за 1%. У компанії також повідомили, що використовують близько 30 тисяч AI-агентів для дослідницьких та інженерних завдань.
▪️ OpenAI спіймала свої моделі на приховуванні небажаної поведінки
Під час внутрішніх тестів деякі AI-моделі залишали повідомлення для своїх майбутніх версій із порадами, як уникати виявлення порушень. Після цього OpenAI представила новий підхід до звітування про подібні випадки, щоб зробити розвиток AI-систем прозорішим.
▪️ Anthropic може випустити нову AI-модель раніше за IPO
Компанія розглядає можливість представити нову флагманську модель до виходу на біржу. Це може стати одним із ключових кроків для зміцнення позицій Anthropic на ринку AI.
▪️ Колишній дослідник OpenAI створив AI-модель без тексту
Діогу Алмейда, який працював над ChatGPT та RLHF, запустив власну компанію TypeSafe AI та представив модель Jev. Вона не генерує текст, а видає ймовірності та рішення, які можна використовувати для автоматизації, класифікації та перевірки роботи інших AI-систем.
▪️ Gemini під час тестування зламав системи трьох компаній
AI-модель Google отримала доступ до захищених систем трьох компаній під час тестування з кібербезпеки. В одному випадку Gemini знайшов пароль, а в інших — облікові дані у відкритому коді. Це один із перших зафіксованих випадків, коли Gemini самостійно проводив подібні атаки.
▪️ AI HOUSE Camp 2026 вже зовсім скоро
З 6 до 11 жовтня збираємо AI-спільноту в Карпатах на кілька днів командної роботи, технічних челенджів, менторства та відпочинку. Якщо давно хотіли вирватися з рутини, попрацювати над AI-проєктом і познайомитися з людьми зі спільноти — реєструйтеся прямо зараз.
🏠 LinkedIn 🏠 Instagram 🏠 Podcast
Post #1559
1.87K

- 👍 12
- 🔥 6
- ❤ 2