TGViewer
PPC |AI | Маркетинг| для себе та інших PPC |AI | Маркетинг| для себе та інших @ppc_chuhui · 333 subscribers
Post #509 82
Anthropic та OpenAI хочуть пустити незалежних AI-аудиторів всередину компаній
Anthropic планує розмістити в компанії незалежних сторонніх оцінювачів безпеки, які зможуть перевіряти роботу з передовими AI-моделями безпосередньо зсередини.
Йдеться не просто про зовнішнє тестування готової моделі.
Оцінювачам хочуть видати бейджі, робочі місця та ноутбуки, а також надати доступ до внутрішніх процесів, систем і даних приблизно на тому ж рівні, який мають власні команди Anthropic з оцінки ризиків.
Їхнє завдання — перевіряти, чи дотримується компанія власних правил безпеки, контролювати ключові показники розвитку AI та стежити, щоб небезпечні інциденти не залишалися всередині компанії без розголосу.
Однією з організацій, які можуть виконувати таку роль, Anthropic називає METR, що спеціалізується на незалежному тестуванні передових AI-систем.
CEO OpenAI Сем Альтман назвав пропозицію «хорошою ідеєю» і заявив, що OpenAI планує зробити те саме. Деталі компанія поки не розкрила.
Окреме питання — наскільки незалежними залишатимуться аудитори, які фізично працюватимуть усередині AI-компаній. Сама Anthropic раніше пропонувала вимоги щодо розкриття фінансування, конфліктів інтересів та зв'язків оцінювачів з AI-розробниками.
TechCrunch — Anthropic and OpenAI want to embed safety evaluators
#anthropic #openai #ai #aisafety #aiagents #технології
TechCrunch Anthropic and OpenAI want to embed safety evaluators. Will they really be independent? | TechCrunch Anthropic and OpenAI want to embed independent safety evaluators inside their AI labs. Researchers welcome the unprecedented access, but warn meaningful oversight requires transparency, independence, and eventually regulation.
  • ❤ 2
  • 👍 2
  • ❤‍🔥 1
  • 🔥 1
More from @ppc_chuhui
  1. Oct 2, 2026OpenAI випустила найдорожчий персональний тариф ChatGPT — $500 на місяць Новий Pro 500 дає…
  2. Oct 2, 2026Google випустила Gemini 4 Argon — нову frontier-модель для довгих складних задач Google пр…
  3. Oct 2, 2026YouTube тестує монтаж Shorts через текстові команди YouTube додає Conversational Editing —…
  4. Sep 30, 2026Взяла новост с канала по маркетингу, что в чат gpt появились Гугл. карты.
  5. Sep 30, 2026Anthropic випустила Claude Sonnet 5.5 Нова модель працює на 30%+ швидше за Sonnet 5 і, за…
  6. Sep 29, 2026Глава Nvidia не бачить проблеми в тому, що через AI люди забуватимуть базову математику В…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →