✔️ Anthropic даёт стартапам год Claude Team и 1000 долларов на API
Программу Claude for Startups расширили - участникам полагается год тарифа Claude Team на пять премиальных мест и 1000 долларов кредитов на разработку с Claude.
Этим шагом компания стремится переманить разработчиков и фаундеров на ранних стадиях, напрямую конкурируя с программами поддержки от OpenAI и облачных гигантов Microsoft Azure и AWS.
К участию допускаются проекты, основанные в течение последних пяти лет. Подать заявку можно на странице программы Claude for Startups.
techcrunch.com
✔️ Google открыла веб-платформу генерации браузерных игр
Платформа Playground, запущенная в рамках партнерства Google и Unity, предоставляет возможность генерации браузерной игры по текстовому запросу с настраиваемой физикой, правилами механики, окружением и внешним видом персонажей. Созданную игру можно запустить в мобильном или десктопном браузере.
В сервис встроены публичная галерея проектов, лидерборды и мультиплеер для некоторых жанров. В будущем заявлена интеграция с Unity Spark. через который можно будет экспортировать текстовые наработки в движок Unity для добавления 3D-графики и игровой логики.
На старте Playground доступен пользователям из США. Лимиты на генерацию зависят от уровня подписки Google One.
blog.google
✔️ Nous Research представила бенчмарк оценки эффективности и стоимости агентов
Исследовательская группа собрала Hermes Index, публичный лидерборд для сравнения языковых моделей внутри фреймворка Hermes Agent при максимальной глубине рассуждения.
Итоговый балл формируется на основе четырёх тестов: Terminal-Bench 4, Terminal-Bench Science, SkillsBench и нового набора Hermes Bench. В последнем агент выполняет 150 разноплановых задач в реальном рабочем пространстве, оперируя файлами и внешними инструментами.
Первое место заняла Claude Opus 5.5 с расходом около $5 на задачу, опередив GPT 6 Astra, которая показала второй результат, но оказалась самой дорогой в рейтинге - $11,6. Тройку замкнула Sonnet 5.5 ($2,8).
В бюджетном сегменте на границу Парето вышли DeepSeek V4.1 Flash (36,91 балла при 26 центах за задачу) и GPT6 Luna (14 центов). Они стали наиболее выгодными с точки зрения баланса цены и продуктивности.
nousresearch.com
✔️ ElevenLabs запустила инструмент сборки и отладки голосовых агентов через диалог
Открылось альфа-тестирование специализированного ассистента Architect, помогающего создавать, конфигурировать и оптимизировать голосовых агентов с помощью текстовых или голосовых команд.
Инструмент понимает логику, структуру баз знаний, настройки синтеза речи и системных промптов. Ему достаточно передать системе лог сбоя, статистику эскалаций на операторов или общий запрос на улучшение, после чего Architect самостоятельно выполнит анализ транскриптов, выявит узкие места и предложит готовые решения.
Все предложенные обновления фиксируются в виде версионируемых черновиков и применяются в продакшене только после ручного подтверждения.
Architect доступен внутри ElevenLabs и в Cursor, Claude Code, ChatGPT и Grok Bot.
elevenlabs.io
✔️ Boston Dynamics показала новые манипуляторы для Atlas под ручной инструмент
Новинка получила 13 степеней свободы - четыре оси на противопоставленном большом пальце и по три на остальных. Инженеры отказались от мизинца для упрощения кинематики и снижения себестоимости. Конструкция позволяет удерживать дрели, горелки и пневмопистолеты с возможностью нажатия на курок.
Механика построена на закрытых электроприводах прямого действия без тросовых тяг и выдерживает нагрузку свыше 45 кг. Подушечки пальцев и ладонь оснащены матрицами тактильных датчиков давления.
Аппаратная часть оптимизирована под sim2real. Точная проприоцепция минимизирует динамическую погрешность при моделировании - манипулятивные политики обучаются через RL в симуляции и напрямую переносятся на физического робота.
bostondynamics.com
@ai_machinelearning_big_data
#news #ai #ml
Post #11095
9.39K