Основатель DeepReinforce — лаборатории, которая выпустила Ornith

Джиуэй Ли

Jiwei Li · 李纪为

Исследователь NLP и предприниматель: PhD Стэнфорда, лауреат MIT Technology Review Innovators Under 35, профессор Чжэцзянского университета. Основал две компании — Shannon.AI, а затем DeepReinforce, чья команда выпустила семейство открытых моделей Ornith.

Где и кем

Основатель

DeepReinforce

AI-лаборатория, выпускающая CUDA-L1/L2, GrandCode и семейство моделей Ornith.

Faculty position

Чжэцзянский университет (Zhejiang University)

Плюс позиция Adjunct Professor в Shanghai Institute for Advanced Study (SIAS).

Основатель

Shannon.AI

Предыдущая NLP-компания, основана до DeepReinforce.

Образование

  • PhD, Computer Science, Stanford UniversityНаучный руководитель — Dan Jurafsky.
  • B.S., Biology, Peking University, 2012

Признание

  • MIT Technology Review Innovators Under 35На сайте премии он числится в списке TR35 China за 2019 год — за работы по диалоговым системам с обучением с подкреплением. В собственной биографии и на странице ZJU SIAS формулировка иная: «recipient of the 2020 Global MIT TR35 innovator award». Приводим оба варианта: расхождение в первоисточниках мы не разрешаем за них.

Что известно точно

Каждый пункт подтверждается источником из списка внизу страницы.

Ключевые работы

CUDA-L1 / CUDA-L2

Обучение с подкреплением для автоматической оптимизации CUDA-ядер. CUDA-L1 заявляет средний ×3,12 и медианный ×1,42 прирост на 250 ядрах KernelBench.

GrandCode

Агентный RL для спортивного программирования: система заняла первое место в трёх подряд живых раундах Codeforces (1087, 1088, 1089), обойдя людей-грандмастеров.

Ornith 1.0 → 1.5

Семейство открытых моделей под MIT: 397B MoE, 35B-A3B MoE и 9B dense. Основная идея — замкнуть цикл самоулучшения: модель сама придумывает задачи, сама строит под них строительные леса и сама учится на своих же прогонах.

Профили

Источники · сверено 2026-08-23

Лаборатория, которую он основал, — DeepReinforce. Её модели разбираем в каталоге моделей.