⚡️ WORLD INTEL BRIEF
• 🔬 Автоматическая оптимизация обвязки AI-агента способна повысить тестовый балл, одновременно ухудшив работу на новых задачах. В исследовании Google метод RRSI показал худший результат на задачах оптимизации, но лучший — на всех трёх независимых наборах; Meta-Harness достиг 93,0 на своём тесте, прибавив лишь 0,3–1,5 пункта на JobBench, GDPval и APEX-Agents. X:@omarsar0
↳ Рост внутренней метрики агента больше не доказывает улучшение на реальных задачах.
• 🆕 Lemonade исправила потоковую генерацию моделей на AMD APU и отказалась от OpenMOSS на ROCm: эта реализация оказалась примерно в 40 раз медленнее Vulkan. Phoronix
↳ Для локального инференса на AMD выбор Vulkan вместо ROCm меняет задержку на порядок.
• 💬 Нескольких подрядчиков, нанятых проверять запросы ChatGPT и помогать обучению моделей OpenAI, по сообщениям уволили за использование AI-инструментов в самой работе. Reddit:r/nottheonion
—
📡 @azalio_tech_summary
Post #9596
10