2026年、4月のプレビューを経て、TencentはHy3を公開した。295BパラメータのモデルをApache 2.0で提供する。商用ユーザーはTencentのAPIに戻ることなく改変・セルフホストできるため、同社が下流での利用から確実に利用料を得る仕組みはない。

要点

  • Tencentは4月のプレビュー後、2026年7月7日に295BパラメータのHy3をApache 2.0で公開した。
  • xAIは2024年3月、Grok-1の314BパラメータのウェイトとアーキテクチャをApache 2.0で公開した。
  • Z.aiはMITライセンスのウェイトと100万トークンのコンテキストウィンドウを備えるGLM-5.2を公開した。
  • DeepSeekはV4 Flashを入力100万トークン当たり$0.14、出力100万トークン当たり$0.28に設定した。
  • TencentとMeituanはEven Realitiesの$150 millionのpre-Series Bラウンドを主導した。

ApacheによりHy3はTencentのAPIの外へ広がる

Apacheは開発者と企業に、Hy3を商用でカスタマイズし再配布する広範な権利を与える。開発者はTencentの直接的な管理を受けずに、プライベートアプリケーションの背後に置き、独自データに適応させ、別のサービスに組み込める。

Quarterly coverage volume: TencentCoverage of Tencent by quarter, 2024 Q4 to 2026 Q3: from 10 to 32 articles per quarter, peaking at 32.322024 Q42026 Q3
Quarterly coverage · Tencent · 2024 Q4–2026 Q3 · current quarter projected

TencentはHy3がGLM-5.1およびGLM-5.2と競合すると述べた。この比較は同社によるものであり、入手可能な証拠は独立したベンチマークでの優位性も、意味のある下流での採用も裏付けていない。Tencentの戦略的な賭けは、ベンチマーク首位でなくてもHy3を広げられる公開方式にある。

ほかのモデル提供者もすでに同じ道を選んでいた。xAIは2024年3月、Grok-1の314BパラメータのウェイトとアーキテクチャをApache 2.0で公開した。2025年3月には、AlibabaがQwen2.5-VL-32Bを公開した。Tencentがオープンウェイトモデルのエコシステムに加わる頃には、モデル開発企業は寛容なライセンスを繰り返し使い、下流の開発を呼び込んでいた。

2024年から2026年にかけて、Tencentを扱う報道における開発者中心のフレーミングは6.0%から16.1%へ上昇し、消費者中心のフレーミングは42.0%から26.8%へ低下した。注目はすでに、モデルを自らのシステムに持ち込める開発者へ移っていた。

提供者はライセンス条件で競争する

中国のモデル提供者は現在、幅広いライセンスの選択肢で競争している。Z.aiは、MITライセンスのウェイト、100万トークンのコンテキストウィンドウ、エージェント型コーディングと長期タスクへの注力を備えるGLM-5.2を公開した。Moonshot AIはKimi K3を公開したが、ApacheやMITではなく独自のKimi K3 Licenseを採用した。Alibabaは2.4TパラメータのQwen3.8-Maxを発表し、そのモデルとQwen3.8-27Bのウェイトを公開する計画だとした。

各社は下流エコシステムとの異なる契約を選んだ。ApacheとMITは法務交渉を最小限に抑え、商用開発者に改変と再配布の余地を与える。カスタムライセンスなら、ウェイトが提供者のサーバーを離れた後も制約や交渉力を維持できる。Alibabaは次期Qwenモデルの大規模商用ユーザーに収益分配を求めることを検討していたと報じられた。これは採用を広げつつ、無条件にはしない取り決めである。

提供者のライセンスは普及の境界を定める。十分な能力を持つ2つのモデルを評価する企業は、ベンチマーク、トークン価格、再配布権、カスタマイズ権、変動する商用条件へのさらされ方を比較しなければならない。モデル提供者は、アーキテクチャと並べて契約を技術購入の判断材料に置いた。

オープンウェイトで競争は提供コストへ移る

Hy3をダウンロードするチームは、ユーザーがモデルを呼び出すたびに、メモリ、アクセラレータ、ネットワーク、スケジューリング、遊休容量の提供コストを負担する。その訓練費用は推論時の負担を軽くしない。

モデル規模と並んで、そのコストを左右するのはアーキテクチャと運用である。Mixture-of-expertsシステムは、総容量とトークンごとに起動する計算量を分けられる。運用者は量子化、バッチ処理、キャッシュ、ルーティング、稼働率によっても実効コストを変える。フリート規模では、ハードウェアとモデルアーキテクチャを協調させなければならない。安価でも遊休状態のアクセラレータは、ただの高価な彫刻である。

OpenAIとAnthropicの投資家向け予測は、推論をコスト基盤の中心に置いている。OpenAIのエンジニアは後に、推論コストを半分以上削減できる手法を見つけたと報じられた。両社は提供の最適化を中核的な事業機能として扱わなければならない。

一部のOpenAIおよびAnthropicの予測における、売上高に占める推論コストの割合

DeepSeekはV4 Flashを入力100万トークン当たり$0.14、出力100万トークン当たり$0.28に設定した。同社がAIサービス全体の大幅な値上げを発表する一方での価格である。こうした価格では、稼働率、メモリトラフィック、生成トークン量の小さな変化がマージンを左右する。運用者が最終的に競うのは、有用なタスク当たりのコストである。

ウェイトが広がるほど、推論市場の重要性は増す。開発者はモデルを交換し、ホストを変え、より簡単なタスクを安価なシステムへ振り分けられる。提供事業者は、アクセスの希少性だけからレントを得るのではなく、トークンごとに価値を稼ぎ続けなければならない。

導入には依然として厳しい制約がある。中国のAI企業は海外の計算資源へのアクセスを求めていたと報じられた。Nvidia Rubinチップを求め、東南アジアと中東に目を向けた。一方、ZhipuとAlibabaは米国との差が広がっていると警告した。十分なアクセラレータがなければ、企業はモデルを経済的にセルフホストできないままである。

政府もその経路を狭め得る。OpenAIとGoogleはTencent、Alibaba、Baiduのシンガポール拠点の子会社にAIサービスを販売していたと報じられ、米国の政策担当者はより厳しい規制を求める声を新たにした。Apacheが導入を許可しても、ハードウェアが利用できず、アクセス規則が変われば、実用的ではなくなり得る。

長時間稼働するエージェントはボトルネックを運用へ移す

企業が価値を得られるのは、エージェントが認可された作業を完了し、障害を乗り越え、監査証跡を残し、曖昧なケースを適切な人へ引き渡す場合に限られる。長期タスクでは、モデルの誤り、ツールの障害、安全でない行動が仕事を脱線させる機会が増える。

GoogleはGemini Enterprise Agent Platformを導入した。Vertex AI上でエージェントフリートのライフサイクル全体を管理するためだ。OpenAIはAgents SDKにネイティブのサンドボックス機能とインディストリビューションのテストハーネスを追加した。GoogleとOpenAIがこうした制御機能を構築したのは、本番エージェントにはモデルの知能だけでなく、評価、隔離、権限、監視、復旧が必要だからである。

企業はこれまで、主に効率の向上とコスト削減のためにエージェントを使ってきた。こうした買い手は完了した作業と削減できた人件費で導入を評価するため、運用上の失敗には即座に経済的な代償が生じる。

デプロイメント層の制御を握る企業は、どのモデルがタスクを処理するか、どのツールを呼び出せるか、失敗をどう再試行するか、結果としてのアクションをどこに表示するかを決められる。オープンウェイトは、そのシステム内で使えるエンジンの数を増やす。周辺の運用者はなお、システムそのものを提供しなければならない。

TencentはHy3の採用を収益化するアプリケーションを必要とする

Alibabaはすでに、モデルを既存の流通接点と結び付ける方法を示した。同社はQwenをTaobao、Alipay、Fliggy、Amapに接続した。1億ユーザー向けのワンストップAIアプリケーションを追求する中での動きである。AlibabaはQwenを、チャットボットへのアクセス数だけでなく、購入、決済、旅行、完了したアクションで測定できる。

最近の投資は、あり得るインターフェースを示している。TencentとMeituanは、カメラを搭載しないスマートグラスメーカーEven Realitiesの$150 millionのpre-Series Bラウンドを主導した。Tencentはまた、Manusの筆頭投資家になることを協議していたと報じられた。一方、ManusのオーナーはMetaによる$2 billionの買収を取り消すことを検討していた。どちらの報道もHy3の導入を裏付けてはいない。

Tencent自身のゲームポートフォリオは警告材料になる。同社のLightspeedスタジオは、難航したLast Sentinelの開発に6年間で数億ドルを投じたと報じられた。Tencentはカテゴリーに資金を出せる。それでも、構成要素を組み合わせて価値あるものにするエンドユーザー体験を生み出せないことがある。

よくある質問

Hy3をセルフホストする実際のコストはいくらか

この記事は、Hy3固有のハードウェア、スループット、トークン当たりの提供コストの推定を示していない。メモリ、アクセラレータ、ネットワーク、スケジューリング、遊休容量という関連するコスト要因は挙げているが、導入予算は運用者の構成と稼働率に左右される。

Hy3が競合モデルを上回ることを示す独立ベンチマークはあるか

ない。TencentはHy3がGLM-5.1およびGLM-5.2と競合すると述べたが、入手可能な証拠は独立したベンチマークでの優位性を裏付けていない。

TencentはHy3がManusまたはEven Realitiesの製品を通じて導入されると確認したか

していない。TencentによるManusへの投資の可能性と、Meituanと共同で行ったEven Realitiesへの投資は潜在的なインターフェースを示すが、どちらの報道もHy3の導入を裏付けていない。

AlibabaはいつQwen3.8-MaxとQwen3.8-27Bのウェイトを公開し、どのような収益分配条件が適用されるのか

この記事は、Alibabaがウェイトの公開を計画し、次期Qwenモデルの大規模商用ユーザーとの収益分配を検討していたと報じられたことを述べている。公開日、大規模利用の基準、確定した商用条件は示していない。

記事で取り上げた寛容なオープンウェイト公開

  • March 2024 — xAIはGrok-1の314BパラメータのウェイトとアーキテクチャをApache 2.0で公開した。
  • March 2025 — AlibabaはQwen2.5-VL-32BをApache 2.0で公開した。
  • April 2026 — TencentはHy3をプレビューした。
  • July 7, 2026 — Tencentは295BパラメータのHy3をApache 2.0で公開した。

Apache 2.0はTencentにHy3の利用料を保証しない。同社にあるのは、独立した導入が自社の提供スタック、エージェント制御、アプリケーション接点への需要を引き寄せるようにする機会である。開発者はウェイトを移せるため、Tencentが戦略的なリターンを得られるのは、この周辺システムから離れるコストがHy3を置き換えるコストを上回る場合に限られる。