TGViewer
azalio_tech_summary azalio_tech_summary @azalio_tech_summary · 70 subscribers
Post #9663 10
⚡️ WORLD INTEL BRIEF

• 🔬 Jev выявляет сбои поведения AI-агентов одним вопросом «да/нет»: медианный AUROC — 0,886, стоимость проверки 19 бенчмарков — $0,30 против $18,96 у LLM-судей. Порог оценки нельзя переносить между задачами, но настройка на 10 размеченных примерах повысила медианный F1 с 0,706 до 0,793. X:@omarsar0
↳ Контроль поведения агента обходится примерно в 63 раза дешевле LLM-судьи.

—
📡 @azalio_tech_summary
X (formerly Twitter) elvis (@omarsar0) on X Cool paper on catching alignment failures with Jev. The ideas is to ask Jev one generic yes/no question about a model's response, and use its probability as a score. With no extra training, that…
More from @azalio_tech_summary
  1. Sep 28, 2026⚡️ WORLD INTEL BRIEF • 🆕 Cloudflare выпустила агентский CLI cf, который охватывает весь A…
  2. Sep 28, 2026⚡️ WORLD INTEL BRIEF • 🆕 Cloudflare обновила браузер Kitesurf для AI-агентов: добавила We…
  3. Sep 28, 2026⚡️ WORLD INTEL BRIEF • 🆕 В Kubernetes 1.37 потоковое чтение etcd RangeStream перешло в бе…
  4. Sep 28, 2026⚡️ WORLD INTEL BRIEF • 🆕 MWS Cloud выдаёт новым клиентам грант без верхнего лимита — вдво…
  5. Sep 28, 2026⚡️ WORLD INTEL BRIEF • 🆕 Uber представила ServiceScale — Kubernetes-контроллер, который о…
  6. Sep 28, 2026⚡️ WORLD INTEL BRIEF • 🆕 Zhipu раздаёт с 28 сентября по 7 октября первые 100 000 пакетов…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →