動察 Beatingのモニタリングによると、騰訊混元のシニア研究員である徐灿氏は最近、微信WeLMチームに異動し、大規模モデルの研究開発に従事している。姚順雨氏が混元大規模言語モデルの研究開発を引き継ぐ前、徐灿氏は混元LLMの後続トレーニングの一方向を担当していた。
徐灿氏はマイクロソフトのWizardLMプロジェクトの創設者であり、論文の筆頭著者でもある。彼はEvol-Instructを提案し、大規模モデルがより複雑な指示データを自動生成してトレーニングに活用できるようにした。彼は2025年に騰訊混元に加入し、長期間にわたり合成データ、指示トレーニング、大規模モデルの後続トレーニングを研究してきた。
今回の異動は、微信がWeLMとAgentに注力を強めるタイミングと重なる。公開された採用情報によると、WeLMチームは推論最適化およびAgent研究員を募集しており、「汎用Long-Horizon LLM Agentのトレーニング戦略」の研究も含まれている。微信は以前、微信製品を支えるモデルのトレーニング用にRLHFトレーニングフレームワークWeChat-YATTも公開している。
微信自身のモデルも急速に拡張している。7月に公開されたHidden Decoding研究では、すでにWeLM-HD4-80BとWeLM-HD4-617Bを実現している。同時に、微信ネイティブAIアシスタント「小微」は小規模なグレースケールテスト中で、微信のネイティブ機能を操作し、ミニアプリを呼び出すことができる。徐灿氏の後続トレーニング経験は、微信が現在強化しているAgentの複雑なタスク能力の方向性と高度に一致している。