OrcaRouterのAIモデルリーダーボードで「GPT-5.6 Luna」が総合1位を維持

FlashLabs株式会社が日本市場向けに提供するAI推論ゲートウェイ「OrcaRouter」は、そのモデルリーダーボードを更新し、OpenAIの「GPT-5.6 Luna」が独自指標「Composite Index」で総合1位を維持していることを発表しました(2026年9月1日時点)。

OrcaRouter モデルリーダーボードの概要

新しいAIモデルが登場する中でも首位を維持

2026年8月後半には、Anthropicの「Claude Opus 5」やMoonshot AIの「Kimi K3」など、多くの主要AIモデルが発表されました。最先端のAIモデルが次々と登場する中で、どのモデルが実際に優れた性能を発揮するのかを見極めることは難しくなっています。

しかし、OrcaRouterのモデルリーダーボードでは、「GPT-5.6 Luna」が75.2点という高い「Composite Index」スコアで総合1位を維持しています。総合2位には「Claude Opus 5」(72.4点)、総合3位には「GPT-5.6 Sol」(71.8点)が続いています。

独自指標「Composite Index」とは

OrcaRouterが開発した「Composite Index」は、AIモデルの性能を評価するための独自の指標です。この指標は、単に実験室でのテスト結果だけでなく、実際の利用状況や人々の意見を重視しています。具体的には、以下の4つの要素を組み合わせて評価されます。

  • 人間の選好(40%): コミュニティによる投票や評価

  • 独立ベンチマーク(30%): 第三者機関による客観的な評価

  • 本番利用実績(20%): OrcaRouter上での実際の利用データ

  • エコシステム浸透度(10%): 実際の利用の広がり

この指標は、新しいモデルが発表されてから48時間以内にリストに追加され、常に最新の情報が反映されるように更新されています。

現在のトップ10モデル(2026年9月1日時点)

順位 モデル Composite Index
1 GPT-5.6 Luna(OpenAI) 75.2
2 Claude Opus 5(Anthropic) 72.4
3 GPT-5.6 Sol(OpenAI) 71.8
4 GPT-5.4 Pro(OpenAI) 71.4
5 Kimi K3(Moonshot AI) 70.8
6 GLM-5.3(Z.ai) 70.3
7 GLM-5.3 Flash(Z.ai) 69.8
8 GLM-5.2(Z.ai) 69.3
9 Qwen3.7 Max(Alibaba) 69.3
10 Grok 4.6(xAI) 67.3

OrcaRouterについて

OrcaRouterは、米国のAI研究機関Continuum AIが開発し、FlashLabs株式会社が日本市場向けに提供するAI推論ゲートウェイです。OpenAI互換のAPIを通じて、Anthropic、OpenAI、Google Geminiなど200種類以上のAIモデルを一つの場所から利用できます。最新のモデルも公開後すぐに利用可能になります。

OrcaRouterのAIモデル一覧はこちらで確認できます。

OrcaRouter Model Leaderboardの詳細はこちらをご覧ください。

FlashLabs株式会社についてはこちら、Continuum AIについてはこちらをご覧ください。

×