# Команда Alibaba Qwen опровергла утверждения исследователя о его ведущей роли в разработке RL

> Команда модели Qwen от Alibaba опубликовала официальное опровержение заявлений исследователя Тяньхана Чжу (Tianhang Zhu) о его ключевой роли в развитии алгоритмов обучения с подкреплением (RL) для их языковой модели.

- Canonical HTML: https://youragents.me/ru/media/news/komanda-alibaba-qwen-oprovergla-utverzhdenija-issledovatelja-o-ego-vedushhej-roli-v-razrabotke-rl
- Markdown: https://youragents.me/ru/media/news/komanda-alibaba-qwen-oprovergla-utverzhdenija-issledovatelja-o-ego-vedushhej-roli-v-razrabotke-rl.md
- Section: Новости
- Published: 2026-07-02T01:37:36+03:00
- Modified: 2026-07-02T01:37:36+03:00

Команда модели Qwen от Alibaba опубликовала официальное опровержение заявлений исследователя Тяньхана Чжу (Tianhang Zhu) о его ключевой роли в развитии алгоритмов обучения с подкреплением (RL) для их языковой модели. 

В понедельник, 30 июня, исследователь Тяньхан Чжу (Tianhang Zhu), ранее работавший в Alibaba, опубликовал пост в X, в котором утверждал, что возглавлял разработку алгоритмов обучения с подкреплением для модели Qwen. По его словам, именно его работа легла в основу значительных улучшений производительности модели, включая прорыв в области RLHF (обучение с подкреплением на основе обратной связи от человека).

Однако команда Qwen оперативно отреагировала на эти заявления. В официальном посте на платформе X представители проекта опровергли ведущую роль Чжу в разработке RL-алгоритмов. «Тяньхан Чжу действительно участвовал в некоторых экспериментах, связанных с RL, но его вклад не был определяющим для ключевых улучшений модели Qwen», — говорится в сообщении команды. При этом разработчики отметили, что работа над RL ведётся коллективно и включает множество направлений, не ограничиваясь одним исследователем.

Конфликт между Чжу и командой Qwen поднимает вопрос о прозрачности вклада отдельных специалистов в крупные корпоративные проекты по разработке ИИ. Ранее подобные споры возникали и в других компаниях, например, в Google DeepMind и OpenAI, где исследователи публично оспаривали авторство тех или иных технологических решений. В случае с Qwen команда подчеркнула, что все значимые достижения — результат совместной работы, а не индивидуальных усилий.

Сам Чжу в последующих комментариях не стал оспаривать заявление команды Qwen, но подчеркнул, что его работа над RL-алгоритмами была важной частью процесса. Он также сослался на внутренние документы Alibaba, которые, по его словам, подтверждают его вклад.

Источники: X-пост Тяньхана Чжу (Tianhang Zhu), 30 июня; X-пост команды Qwen, 30 июня.
