FlashLabsは、AI推論ゲートウェイ「OrcaRouter」でTencentの「Hy4 preview」の提供を始めました。
Hy4 previewは、総パラメータ770Bで約100万トークンの文脈長に対応するテキスト専用モデルです。
無料枠でも利用でき、コーディングエージェントや複雑なツール操作などを想定しています。
記事の概要
FlashLabsは2026年9月29日、OrcaRouterでTencentの最新フラッグシップモデル「Hy4 preview」を提供中と発表しました。
Hy4 previewは、総パラメータ770Bのうち1トークンあたり49Bを活性化するMoE構成です。
コンテキスト長は約100万トークンで、出力上限は6万4000トークンです。
推論の深さはhigh・low・noneの3段階から選べ、既定値はhighです。
ネイティブのツール呼び出しと構造化出力に対応し、コーディングエージェントやデータ分析などを想定しています。
「Hy4 preview (Free)」として無料枠でも利用でき、有料枠は入力100万トークンあたり0.834米ドルです。
Tencentの社内評価では、163名の専門家と203のエンジニアリング課題を対象に平均2.99点でした。
プレビュー版のため、推論に時間をかけすぎることなどが既知の課題として示されています。
記事のポイント
- 大規模MoEモデルを提供: 総パラメータ770Bのうち49Bを活性化するMoE構成で、約100万トークンの文脈長に対応します。
- 無料枠とAPIに対応: 無料枠に加え、チャット補完とResponses APIに対応し、OpenAI互換の形式で利用できます。
- 料金と評価を明示: 有料枠は入力0.834米ドル、出力2.501米ドルで、Tencentの社内評価は平均2.99点です。
このニュースがもたらす影響
- 導入を検討する企業: 無料枠とOpenAI互換APIにより、長文処理やツール操作を含むエージェントの試作を始めやすくなります。一方、プレビュー版の遅延や品質を本番投入前に検証する必要があります。
- AI基盤の競合: 複数モデルを同じAPI形式で比較でき、無料枠も用意されることで、モデルの取りそろえだけでは差別化しにくくなる可能性があります。選定支援や安定運用が問われそうです。
- エージェント開発者: 処理ごとに推論の深さを切り替え、コーディングや分析などでモデルの使い分けを設計しやすくなります。応答が長引く課題を踏まえ、速度重視の経路も必要になりそうです。
このニュースの背景
エージェント型AIアプリケーションでは、コード生成や調査、分析、要約など性格の異なる処理が連続するため、複数のモデルを組み合わせてコストと品質を調整する考え方があります。
一方、モデルごとに契約やAPI仕様が異なると、比較検討のたびに個別対応が必要になります。OrcaRouterは、複数モデルをOpenAI互換APIから利用できる形にすることで、この導入上の負担を抑える位置づけです。
Hy4 previewは大規模なMoE構成と約100万トークンの文脈長を備え、ツール呼び出しや構造化出力にも対応しています。ただし、プレビュー版として推論に時間をかけすぎる場合などの課題も示されています。
関連するニュース
- FlashLabsはOrcaRouterでDeepSeek-V4.1-Flashを提供し、長文・画像処理と低価格APIに対応しました。
- FlashLabsはOrcaRouterに最新AIモデル4種を追加し、定価で単一APIから提供します。
- FlashLabsはOrcaRouterの全ユーザー向けログ本文に耐量子暗号を標準搭載しました。
詳しい記事の内容はこちらから(引用元)
FlashLabs株式会社のプレスリリース(2026年9月30日 15時00分)OrcaRouter、Tencentの最…
https://prtimes.jp/main/html/rd/p/000000102.000138449.html