QuantumCore、7,500億パラメータのLLM「GRZ」をNVIDIA DGX Spark 1台で提供開始

QuantumCore、7,500億パラメータのLLM「GRZ」をNVIDIA DGX Spark 1台で提供開始

株式会社QuantumCoreは、総パラメータ数7,530億(753B)のフロンティア級大規模言語モデル(LLM)「GRZ(ジー・アール・ズィー)」を搭載したオンプレミス生成AI「GRZ スターターパック」の受注を2026年7月27日より開始しました。この製品は、NVIDIA DGX Spark(128GB)1台に導入された状態で出荷され、設置はコンセントに挿すだけで完了します。

プロンプトや文書、現場のデータを社外に一切送信することなく、機密性の高い情報にも生成AIを活用できます。また、エッジAI異常検知システム「VADQore Sense」と連携することで、設備の監視からレポート作成、チューニングまでを社内のネットワーク内で完結させることが可能です。

7,530億パラメータを、コンセント1本で。GRZ by QuantumCore

本リリースの主なポイント

  • 機密データに使える生成AIが、届いたその日からすぐに利用できます。導入済みで出荷されるため、特別な工事やサーバルーム、専任のエンジニアは不要です。

  • AIの頭脳はフロンティア級です。NVIDIAが公表しているDGX Spark単体での動作目安(約2,000億パラメータ)の約3.7倍にあたる7,530億パラメータを、QuantumCore独自の技術で128GBの1台に搭載しています。

  • 運用コストは定額で、ランニングコストは月額15万円と、電気代はフル稼働でも月5千円台とされています。これはクラウド型生成AIを100名で利用する場合(年間約1,200万円)と比較して、初年度で478万円に抑えられる計算です。

  • 「VADQore Sense」との連携により、設備の異常が「読める報告書」として提供されます。今後、IT、製造、医療、大学向けの専門特化モデルも順次提供される予定です。

現場での活用シーン

設計図、議事録、顧客情報、研究データなど、社内規程や契約、ガイドラインにより外部クラウドの生成AIに利用できないデータは少なくありません。また、使うほど費用が膨らむ従量課金制では、全社的な導入が難しいという課題もあります。「GRZ スターターパック」は、このような企業の課題を解決するために開発されました。生成AIのすべての処理が社内で完結するため、これまで外部利用が難しかった機微なデータにも安心して活用できます。

自動化された製造ラインにおけるエッジAIの活用

届いたその日からできる3つの使い方

  1. 社内ナレッジQA:規程、仕様書、トラブル報告、マニュアルなどを取り込み、根拠となる文書と共に回答するナレッジAIとして利用できます。部門ごとの権限管理や監査ログも備えており、退職や異動で失われがちな知識の共有に役立ちます。
  2. 文書ドラフトと対話:報告書、提案書、翻訳、要約、コード作成など、フロンティア級の対話AIとして日常業務に活用できます。入力内容が学習や外部送信に使われることはなく、機密性の高い案件にも利用可能です。65,536トークンの長文コンテキストに対応し、分厚い資料も一度に扱えます。
  3. 現場コパイロット(VADQore Sense連携):「昨夜、3号機で何が起きた?」といった質問に対し、GRZが監視記録を解析して日本語で回答します。詳細は次章で説明します。

導入と運用

本体はNVIDIA DGX Spark 1台(約1.2kg)で、手のひらサイズです。GRZと業務アプリケーションは導入済みの状態で出荷されるため、箱から出してコンセント(AC100V)に挿し、社内ネットワークに接続すれば、その日から利用を開始できます。サーバルームや電源工事は不要で、執務室や現場事務所にも設置可能です。

電気代は、フル稼働でも月5千円台と試算されています。最大消費電力240Wは家庭用ドライヤーの約4分の1程度で、24時間365日の連続稼働を前提に設計されています。モデル全体をメモリに常駐させる方式のため、負荷が増えても急に処理が遅くなったり停止したりすることはなく、通信障害の影響も受けません。

運用については月額サービスに含まれており、モデルやアプリケーションのアップデート(インターネット非接続環境向けの閉域配信にも対応)、保守サポート、毎月のAI設備診断レポートが提供されます。

「VADQore Sense」連携による工場まるごとローカルAI

「GRZ スターターパック」には、設備に後付けできる電池駆動のエッジAIセンサー「VADQore Sense」3台と、監視ダッシュボード「VADQore Studio」が同梱されます。Senseは振動や音を常に監視し、約10秒の正常データからその場で学習して異常を検知します。GRZはStudioを通じて監視・解析からしきい値チューニング、再学習の指示までを直接実行できます。

工場向けローカルAI「GRZ」と「VADQore Sense」のシステム構成図

現場では、毎朝、夜間の設備状況をまとめたブリーフィングが自動で届くようになります。異常スコアは「読める診断レポートと推奨対応」に変わり、しきい値の変更や再学習の指示も担当者との対話で完了します。異常検知の「意味と対応の言語化」という最後の課題を、フロンティア級の知能が現場で解決します。検知したデータも、生成されたレポートも、社外に出ることはありません。

工場内でタブレットを操作し、産業機械の稼働状況や診断結果を確認する作業員

技術について:なぜ1台に収まったのか

複雑なサーバー室と、モダンな空間に置かれた小型PCが青い光で繋がっている対比的な画像

GRZは、公開されている大規模言語モデル(GLM系・Qwen系)を基盤に、QuantumCoreが独自開発した圧縮技術で最適化したモデルです。通常、この規模のモデルを動かすには数百GBのGPUメモリを備えたデータセンター級のサーバーが必要とされます。

QuantumCoreが創業以来エッジAIで用いてきた「リザバーコンピューティング」は、少ない計算資源で時系列の特徴を捉える方式です。これを推論を支える補助機構として組み込むことで、限られたメモリの中でも大きなモデルをそのまま動かせるようにしました。これは、2018年の創業以来、256KB SRAM級のマイコンでAIを動かしてきた「制約の中で知能を動かす」という8年間の技術蓄積によるものです。

GRZは生成AIの全処理が社内で完結するため、データが社外(国外を含む)へ送信される経路が構造上存在しません。また、QuantumCoreの圧縮技術と支援機構はモデルに依存しないため、国産LLMを含む任意の公開モデルへ適用できます。技術の詳細は、近日公開予定の技術レポートで紹介される予定です。

価格・提供形態

GRZ スターターパック(製造現場向け)の標準価格は、初期費用298万円(税別)から、月額15万円(税別)からとなっています(従量課金なし)。

同梱内容には、NVIDIA DGX Spark(128GB)本体(GRZ導入済み)、対話AI・社内ナレッジQA(RAG)、VADQore Sense 3台、VADQore Studio、導入セットアップ・現地教育が含まれます。月額費用には、モデル・アプリのアップデート(閉域配信対応)、保守サポート、月次AI設備診断レポートが含まれています。

受注は本日より開始され、出荷は2026年11月より順次行われます(初回導入枠は2台)。販売はQuantumCore直販および販売パートナー経由で行われます。

導入形態の比較(QuantumCore試算)では、クラウド型生成AI(100名)の年間費用が約1,200万円であるのに対し、本パックは初年度478万円とされています。データの所在も社内であり、設置も執務室でコンセント1本と手軽です。

このほか、GRZ単体の導入(手持ちのDGX Spark・GPUサーバー向け)、VADQore Senseの増設、任意のオープンウェイトモデル×指定ハードウェアへの圧縮変換サービスも個別見積もりで提供されます。

今後の展開

コンパクトなデバイスが、ソフトウェア開発、製造業、医療、教育といった多様な分野と光る線で繋がり、幅広い産業への応用やデータ連携、統合ソリューションを提供している様子

  • 専門特化GRZ:IT、製造、医療、大学/研究機関向けに、専門用語や文書体系へ追加最適化した業種特化モデルが2026年秋以降、順次提供される予定です(月額プラン内でのアップデート)。

  • 会議AI:議事録や決定事項の自動ドラフト機能が2026年内にアップデートで追加される予定です。

  • 拡張構成:NVIDIA DGX Spark 2台連結による処理能力の向上、NVIDIA Jetson Thorなどへの対応が予定されています。

  • パートナー募集:販売、技術、事業共創パートナーを募集しており、初期パートナー枠は2026年8月末まで優先受付が行われています。

GRZの主な仕様

製品名 GRZ(ジー・アール・ズィー)
ベースモデル 公開されている大規模言語モデル(GLM系・Qwen系)をQuantumCoreが最適化
規模 総パラメータ 7,530億(753B)/ MoE構造(トークンあたり約400億が活性)
搭載方式 QuantumCore独自の圧縮技術と、リザバーコンピューティングによるTransformer支援機構により、全パラメータを128GBメモリに常駐(プレインストール出荷)
コンテキスト長 65,536トークン
ハードウェア NVIDIA DGX Spark(GB10 Grace Blackwell、128GB統合メモリ、約1.2kg)
消費電力 最大240W(システム電源仕様)・AC100V
ネットワーク 完全オフライン動作(閉域アップデート対応)

株式会社QuantumCoreについて

株式会社QuantumCoreは、リザバーコンピューティングを用いたエッジAIの開発、提供、導入支援を行っています。同社は「制約の中で、知能を動かす」を掲げ、マイコン上のエッジAIからフロンティア級LLMのローカル実装までを一貫して手がける日本発のAIプロダクト企業です。PoC導入企業80社超、製品ユーザー約2,500名の実績があります。

  • 会社名:株式会社QuantumCore

  • 所在地:東京都品川区西五反田2-14-13

  • 設立:2018年4月24日

  • 代表者:代表取締役CEO 秋吉 信吾

  • 事業内容:リザバーコンピューティングを用いたエッジAIの開発・提供・導入支援

  • URLhttps://www.qcore.co.jp/

本件に関するお問い合わせは、株式会社QuantumCoreの広報・事業開発担当まで。実機デモ(NDAベース)、先行導入枠への応募、販売パートナーの相談を受け付けています。

×