Wally от RunAnywhere
Облачный стек для быстрого инференса открытых моделей. Подключается напрямую к OpenCode, Claude Code, Claude Desktop, Hermes и OpenClaw
• прямой коннект к кодинг-агентам и ассистентам
• $5 бесплатного баланса на старте без привязки карты
• быстрые токены на открытых моделях
• GLM-5.3 Flash - 380 ток/с
• Qwen3.8-27B - 485 ток/с
• DeepSeek V4.1 Flash - 615 ток/с
• GLM-5.3 Max - 790 ток/с
• в OpenCode GLM-5.3 Flash дала 213 ток/с на реальной агентной задаче
Для сравнения в том же тесте Nebius - 149, Fireworks - 68, Z.ai - 47. Сервис в предварительном режиме, опубликованные цифры сняла сама RunAnywhere, независимого теста Artificial Analysis пока нет
Спасибо @Endorpheen
#platform #cloud #inference
MAX
Post #14684
1.19K

