日本政府 デジタル庁 実績

国家スーパーAI
CC Gov-LLM

デジタル庁に提出された、国内開発・高セキュリティ・
日本語特化の大規模言語モデル

政府提出資料・個別相談はこちらから
Trust

デジタル庁への
正式提出実績

「ガバメントAI」公募において、国産LLMとして正式に提出された実績を持つモデルです。

公式提出資料

デジタル庁 戦略・組織グループ AI実装戦略総括班宛に、ガバメントAIで試用する国内大規模言語モデル(LLM)の公募に係る資料として正式に提出されました。

提出先 デジタル庁 AI実装戦略総括班
提出日 令和8年1月30日
提出者 カスタマークラウド株式会社
デジタル庁提出資料
※ 実際に提出した原文資料です
Why Local LLM

なぜ今、ローカルLLMなのか

データ主権、情報統制、将来の地政学リスク。
今、求められるのは国家レベルで運用可能なAI基盤です。

データ主権の確保

機密情報・国家情報を海外APIに送信することなく、完全に国内で処理。データ主権を守りながらAIを活用できます。

極めて高い機密性

完全オンプレミス・クラウド閉域網対応。外部通信が一切発生しない設計で、最高レベルのセキュリティを実現。

完全なカスタマイズ

法令・行政・業務ドメインに特化した学習が可能。組織固有の知識をRAGで統合し、最適化されたAIを構築。

国家利用を前提とした設計

将来的なAI規制・地政学リスクに対応。国家・自治体での運用を前提に設計された、真の主権AIモデル。

海外API型LLM
CC Gov-LLM
データ所在地
海外
国内
カスタマイズ
限定的
完全自由
機密性
制約あり
極めて高い
国家利用
困難
前提設計
Performance

行政実務で証明された性能

独自ベンチマーク「GovQA」で測定された、
行政特化LLMとしての圧倒的な実用性。

92.0%
行政QA正答率
法令・手続き・給付金・社会保険・税務の
5分野で高精度を達成
50+
トークン/秒
高速な推論速度で
実務利用に耐える応答性能
<3
レイテンシ(P95)
窓口業務でもストレスなく
利用可能な応答速度
Benchmark

GPT-5.2を超える
日本語読解力

業界標準フレームワーク「llm-jp-eval」による第三者評価で、
日本語読解タスクにおいてGPT-5.2を上回る性能を実証。

JSQuAD 読解スコア
+10.3pt
GPT-5.2比で日本語読解力が上回る
パラメータ効率
100x
より少ないパラメータで同等以上の性能
評価フレームワーク:国立情報学研究所(NII)公開の「llm-jp-eval v2.0.0」を使用。JGLUE+JMMLU等、全10データセットで評価を実施。評価コード・設定ファイルは提供可能です。
GovQA Benchmark

行政ドメイン特化
驚異の評価結果

独自構築した行政特化ベンチマーク「GovQA」で、
法令・手続き・給付金・社会保険・税務の5分野を徹底評価。

GovQA ベンチマーク評価結果
独自ベンチマーク評価
92.0%
総合正答率
(100問中92問正解)
分野別スコア
法令
100%
社会保険
100%
給付金
90%
手続き
85%
税務
85%
評価結果の分析

CC Gov-LLM(約130億パラメータ)は、GPT-5.2(推定数兆パラメータ規模)に対しパラメータ規模が100倍以上小さいにもかかわらず、日本語読解(JSQuAD)でGPT-5.2を上回り(+10.3pt)、行政利用で重要な常識推論で90%超、文類似度でも高水準を示しました。

評価の透明性と再現性
フレームワーク
国立情報学研究所(NII)公開の業界標準ツール
JGLUEデータセット
早稲田大学河原研究室構築の標準ベンチマーク
JMMULデータセット
日本語版MMLU(7,097問、57分野)
再現性
評価コード・設定ファイルを提供可能
Use Cases

活用ユースケース

行政から企業まで、幅広い業務でAIの力を活用できます。

💬
社内問い合わせAI
📖
業務マニュアルQA
⚖️
法務・規程検索
📝
文書作成支援
🌐
やさしい日本語
Vision

国家スーパーAI構想

各国独自のLLMを構築し、言語・法制度・文化に最適化された
主権AIモデルを世界に展開する。それが私たちのビジョンです。

各国独自LLMの構築
文化・法制度への最適化
国家単位でのRAG設計

国家レベルのAIを、
貴社の競争力に。

デジタル庁に正式提出されたローカルLLMの導入をご検討ください。