TencentがHy4 previewを公開した理由
Tencentが自社の大規模言語モデル「Tencent Hy4 preview」を公開し、同時にオープンソース化した。単に新しいAIモデルを出したという話ではなく、770Bという巨大な総パラメータ数、49Bのアクティブパラメータ、100万トークン超の長い文脈処理を前面に押し出しているのが特徴だ。しかも用途は研究室のデモではなく、coding、office work、scientific researchのような実務寄りの場面に置かれている。Tencentがこのモデルをどう位置づけ、どこで使わせようとしているのかを見ると、いまの生成AI競争の焦点がかなりはっきりしてくる。 Tencentの発表によると、Hy4 previewは次世代のlarge language modelで、総パラメータ数は770B、実際に推論時に動くactive parametersは49B、context windowは100万トークンを超える。要するに、モデル全体としてはかなり大きいが、常時全部を動かすわけではなく、必要な部分だけを使って計算効率を確保する設計だと読める。Tencentはこのモデルを、実際の生産性
papoo.work