⚡️ WORLD INTEL BRIEF
• 🆕 GPT-6 Luna набрала 66,6% в DeepSWE при стоимости $0,22 за задачу — на два пункта меньше GPT-6 Sol, но в 12 раз дешевле. API-тарифы составляют $0,10/$0,50 за миллион входных/выходных токенов у Luna и $2/$10 у Sol. Telegram:@ai_product
↳ Небольшая потеря качества кодинга теперь снижает стоимость агентской задачи на порядок.
• 🆕 Mac Studio M5 Ultra с 256 ГБ памяти запускает локальную Qwen3.8-Flash-Next со скоростью 108 токенов/с, а три параллельных субагента — суммарно 81 токен/с. RTX 5090 быстрее, пока модель помещается в её 32 ГБ VRAM; после выгрузки в системную память скорость падает до 1,5–4,6 токена/с. Telegram:@ai_product
↳ Большие локальные модели работают интерактивно без многопроцессорного GPU-сервера.
• 🆕 Стоимость работы моделей при сопоставимом качестве с 2023 года снижается примерно на 47% за квартал, или в 12,7 раза за год. Достижение порога 25% в FrontierMath подешевело с $0,55 на OpenAI o3 до $0,0015 на GPT-5.6 Luna за 18 месяцев. Telegram:@aioftheday
↳ Бюджеты инференса, рассчитанные по прошлогодним моделям, устаревают за несколько кварталов.
• 🆕 Открытая GLiNER-2.5-Decide 340M принимает текст и набор допустимых решений, работает локально на CPU без генерации токенов и распространяется по Apache 2.0. В авторском тесте на 17 типах задач модель получила 60,2% точных совпадений против 57,6% у Jev. Telegram:@ai_product
↳ Маршрутизация обращений и контроль завершения агентских задач обходятся без облачной LLM.
• 🆕 API модели Qwen-Image-2.1 бесплатно открыт на видеокартах RTX 4090 с 48 ГБ памяти из-за некоммерческой лицензии; при нагрузке возможна очередь. Telegram:@neuraldeep
—
📡 @azalio_tech_summary
Post #9658
8