TGViewer
IT с перцем IT с перцем @hotcodeit · 158K subscribers
Post #2463 4.59K
Alibaba нашла способ сократить потребность в ускорителях Nvidia на 82% благодаря системе Aegaeon. В условиях нехватки вычислительных мощностей и ограничений на импорт, компания оптимизировала использование ускорителей для работы своих языковых моделей.

Теперь для обслуживания десятков языковых моделей требуется всего 213 ускорителей вместо 1192. Система позволяет одному GPU обрабатывать до семи моделей, значительно снижая задержки при переключении. Это стало возможным благодаря сотрудничеству с учеными Пекинского университета и внедрению автомасштабирования на уровне токенов.

Как сообщает South China Morning Post, тестирование Aegaeon уже идет более трех месяцев на платформе Bailian.

Источник изображения: Nvidia

@Unlim_AI
  • 👍 7
  • 🤔 2
More from @hotcodeit
  1. Sep 29, 2026ИИ летит в космос! Уже в 2027 году Project Suncatcher отправит свои TPU чипы на орбиту зем…
  2. Sep 28, 2026OpenAI использовали «агрессивные методы» для доступа к данным ООН С апреля по июнь агенты…
  3. Sep 26, 2026ИИ диктует фэшн тренды Бренды начинают выпускать одежду, которая по их словам должна защит…
  4. Sep 25, 2026Jev пожертвовала человеком ради роботов Новая модель, которая наточена на быстрое принятие…
  5. Sep 24, 2026Opus 5.5 создал рабочую 3D-лабораторию за 1.5 часа Разработчик Райан Саел заставил нейросе…
  6. Sep 23, 2026А вот подъехал и Claude Opus 5.5 Обновленная модель стала мощнее, а главное дешевле: цена…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →