TGViewer
azalio_tech_summary azalio_tech_summary @azalio_tech_summary · 89 subscribers
Post #9858 18
⚡️ WORLD INTEL BRIEF

• 🔬 NVIDIA обнаружила падение способности мультимодальных моделей отклонять вредные запросы после подключения инструментов: доля ошибок выросла в среднем на 17,7%, максимум — на 68,7%. Повторная вставка исходного запроса и изображения перед финальным ответом частично восстановила отказы. X:@omarsar0
↳ Проверки только в обычном чате завышают безопасность агентов, использующих инструменты.

—
📡 @azalio_tech_summary
X (formerly Twitter) elvis (@omarsar0) on X Does giving a multimodal model tools make it worse at refusing harmful requests? New work from NVIDIA, accepted at NeurIPS 2026, says yes for every model it tested. Refusal failures rise by up t…
More from @azalio_tech_summary
  1. Oct 8, 2026⚡️ WORLD INTEL BRIEF • 🆕 l9gpu связывает телеметрию GPU с конкретными подами, пространств…
  2. Oct 8, 2026⚡️ WORLD INTEL BRIEF • 🆕 Grafana Cloud Fleet Management получила централизованное управле…
  3. Oct 8, 2026⚡️ WORLD INTEL BRIEF • 🆕 В обвязке Anthropic для автономной разработки создание и оценка…
  4. Oct 8, 2026⚡️ WORLD INTEL BRIEF • 🆕 Claude Sonnet 5.5 в тестах The New Stack выполнила все прогоны и…
  5. Oct 8, 2026⚡️ WORLD INTEL BRIEF • ⬆️ Claude Haiku 5.5 в сравнении @ai_product выполнила лишь 35% пров…
  6. Oct 8, 2026⚡️ WORLD INTEL BRIEF • 🆕 DX по данным более 400 организаций зафиксировала рост среднего р…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →