TBPN

← Все новости выпуска

3 сентября 2026

Открытые и закрытые ИИ-лаборатории в основном масштабируют один и тот же рецепт обучения

Согласно оценке текущего развития моделей, между стеком reinforcement learning OpenAI, китайскими open-source-разработками и американскими open-source-проектами существует мало различий. Сначала масштабировались предварительное обучение и размер моделей, а теперь масштабируется reinforcement learning (RL).

Ожидается, что лаборатории продолжат масштабировать RL, рассчитывая на достижение более высоких уровней интеллекта и выполнение большего числа экономически полезных задач. Отдельно важным приоритетом называется непрерывное обучение.

Конфиденциальность ·