Открытые и закрытые ИИ-лаборатории в основном масштабируют один и тот же рецепт обучения
Согласно оценке текущего развития моделей, между стеком reinforcement learning OpenAI, китайскими open-source-разработками и американскими open-source-проектами существует мало различий. Сначала масштабировались предварительное обучение и размер моделей, а теперь масштабируется reinforcement learning (RL).
Ожидается, что лаборатории продолжат масштабировать RL, рассчитывая на достижение более высоких уровней интеллекта и выполнение большего числа экономически полезных задач. Отдельно важным приоритетом называется непрерывное обучение.
