TBPN

September 1, 2026

21 stories / новостей

Diversified accelerator fleet targets different AI workloads in rack-scale systems

An accelerated-computing company says different AI models and stages—including prefill, inference and decode—require different capabilities. Its strategy is to offer high-performance architectures across those workloads, alongside multiple rack-scale server configurations; a Groq deal is also coming online, although its precise future role was not specified.

The company describes rack-scale infrastructure built around seven processors, aiming to achieve best-in-class performance across them and maximize token efficiency per watt for large AI factories. It also sees a partner ecosystem as a way to extend that efficiency into new domains and use cases.

The future mix of specialized accelerators and configurations remains unsettled, but the described approach suggests that the fleet may expand as new models and use cases emerge.

Разнообразный парк ускорителей рассчитан на разные AI-нагрузки в rack-scale системах

Компания, работающая в сфере ускоренных вычислений, заявляет, что разным AI-моделям и этапам вычислений — включая prefill, inference и decode — требуются разные возможности. Ее стратегия предполагает предоставление производительных архитектур для таких нагрузок и нескольких конфигураций rack-scale серверов; также вводится в работу сделка с Groq, хотя ее точная будущая роль не уточняется.

Компания описывает rack-scale инфраструктуру на базе семи процессоров, стремясь обеспечить передовые характеристики каждого из них и максимальную эффективность токенов на ватт для крупных AI-фабрик. Партнерскую экосистему она рассматривает как способ распространить эту эффективность на новые области и сценарии применения.

Будущий состав специализированных ускорителей и конфигураций остается неопределенным, однако описанный подход предполагает, что парк может расширяться по мере появления новых моделей и вариантов использования.

Read the full issue / Читать весь выпуск
Privacy ·