TGViewer
Пакет Безопасности Пакет Безопасности @package_security · 33K subscribers
Post #1392 7.11K
Ребята из Anthropic (это стартап выходцев из OpenAI, который уже произвел на свет нашумевшую Claude) тут выпустили свой опенсорсный инструмент для оценки безопасности LLM – Petri.

Если коротко, то нужен он для того, чтобы выявлять риски и нежелательные сценарии в работе ИИ, включая дезинформацию, манипуляции и скрытые формы взаимодействия.

Интересно то, что происходит это в формате обычного взаимодействия пользователя (как мы с вами) с любой ИИ, например, с теми же чат-ботами. Вам нужно только заранее задать несколько сценариев/инструкций, на базе которых и будет строиться эмуляция реальных пользователей.

В общем, я бы поиграл с этой штукой. Что вообще думаете, стоит делать какой-то упор на ИИ, LLM и прочий нейрохайп в канале? А то я хоть и ковыряю такое иногда сам, но в канал об этом не пишу.

⚡ ПБ | 😎 Чат | 🛍 Проекты
  • 🔥 32
  • ❤ 15
  • 👾 5
  • 👍 3
More from @package_security
  1. Oct 3, 2026Ну что, дорогие мои, натерпелись вы за сентябрь рекламы, поэтому настало время отблагодари…
  2. Oct 2, 2026Про то, как убить короткоживущий мошеннический номер Есть у телефонного мошенничества одна…
  3. Oct 1, 2026Я как-то писал пост про то, что игра Pokemon Go в итоге была связана с ЦРУ и их проектом п…
  4. Oct 1, 2026Автоботы, харденимся Ребята из BI.ZОNE тут собрали в одном месте концентрированную годноту…
  5. Sep 30, 2026Post #2069
  6. Sep 29, 2026Так что же делать при тотальном взломе (инструкция) Недавно нашитпостил в канале на тему,…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →