Positron развивает аппаратную платформу для ресурсоёмкого inference по быстрому пути от FPGA к кремнию
Компания Positron, основанная в 2023 году Томасом Саммерсом и Эдвардом Кметом, разрабатывает оборудование для AI-inference с акцентом на объём и пропускную способность памяти. Митеш Агарвал заявил, что присоединился к компании после наблюдений за нагрузкой, которую создают модели рассуждений и генерации видео в Lambda: по его словам, одной видеомодели требовались четыре H100 для создания 10-секундного ролика, причём ограничением были память и её пропускная способность.
Positron выпустила первый клиентский продукт за 15 месяцев, имея менее 20 сотрудников, и использовала FPGA. Недавно штат компании превысил 100 человек, причём более 50 сотрудников были наняты за предыдущие три месяца. Установленные в Oracle 50 стоек Atlas также работают на FPGA. Positron активно применяет AI-инструменты для верификации, взаимодействия при проектировании и сопутствующих задач, но пока не поручает им создание нового чипа; Агарвал ожидает, что такая возможность появится в ближайшее время.
