Cloud PF Type A

生成AIサービス・機能

国産生成AIを活用したAIサービス

Cloud PF Type A上で提供する生成AIサービスです。国産生成AI「Sarashina」を活用し、RAGやAIエージェントなどの生成AIアプリケーションを構築できます。

特長

日本国内完結型のAI環境

Cloud PF Type Aで国産生成AI「Sarashina」を提供。AIモデルから推論基盤、データ管理までを国内環境で統合し、データ主権やコンプライアンス要件に配慮した生成AI活用を実現します。

AIアプリケーションの開発を迅速化

Playgroundによるプロンプト検証からAPI・SDKによるシステム連携まで対応。PoCから本番運用までをスムーズに推進できます。

データベースとAIのシームレスな連携

Oracle DatabaseやObject Storageなどのデータ基盤と連携し、既存の企業データを活用した生成AIアプリケーションを構築可能。データ管理からAI活用までを統合的に実現します。

高性能GPUによる高速推論

検証用途から本番利用まで、AIワークロードに適したGPU環境を提供。高性能な推論基盤により、生成AIアプリケーションの安定運用を支援します。

RAGやAIエージェント構築に対応

チャット、埋め込み、リランキング、ガードレールなどの機能を提供。RAGやAIエージェントを活用した高度な生成AIアプリケーションの構築を支援します。

セキュリティとガバナンス

入力データや応答結果はAIの再学習には利用されません。利用ログまでデータ主権を確保 やPrivate Endpoint、IAMによるアクセス制御に対応し、高いセキュリティとガバナンスを実現します。

活用シーン

設計・研究開発

設計図面や研究開発データなどの重要な技術資産を守りながら、生成AIを活用

具体例
設計レビュー/技術文書検索/開発支援

重要インフラ運用支援

電力・通信・交通など重要インフラの運用情報を国内環境で保護しながら生成AIを活用

具体例
障害対応支援/手順書検索/運用ナレッジ活用

自治体窓口業務の効率化と

住民サービス向上

住民情報や行政文書を国内で安全に管理しながら、生成AIによる窓口業務の効率化を実現

具体例
窓口手続きに関する条件確認/制度要件確認/法令・通知の根拠確認/住民向け説明文作成

生成AIアプリケーション構成例

「Cloud PF Type A」では、国産生成AI「Sarashina」の利用に加え、生成AIアプリケーションの開発・運用を支援するジェネレーティブAI も提供しています。

提供モデル

モデル名
用途
Sarashina3 mini(チャットモデル) 高速なレスポンスと高い日本語能力を兼ね備えた標準モデルです。
一般的な対話やタスク処理に適しています。
Sarashina3 nano(チャットモデル) 高速なレスポンスと高い日本語能力を兼ね備えた軽量モデルです。
情報抽出や要約など比較的シンプルなタスクを大量に処理したい場合に適しています。
Sarashina3 guard(ガードレールモデル) 入力テキストの安全性を判定するための専用モデルです。
テキスト生成は行わず、有害カテゴリの判定結果を返します。
Sarashina3 embedding(埋め込みモデル) 日本語の文脈理解に特化したベクトル化モデルです。
検索や情報抽出タスクに対応しています。
Sarashina3 rerank(リランキングモデル) 日本語の文脈理解に特化したリランキングモデルです。
情報検索タスクにおいて、クエリと検索対象文書の関連度スコアを推定することができます。

提供形態

お客さまの利用用途やシステム要件に応じて、 Dedicated(専有型)と On-Demand(共有型)の2つの提供形態を提供しています。

提供形態
Dedicated(専有型) On-Demand(共有型)
料金体系
月額固定料金 従量課金
特長
専有GPUによる安定した性能と高い処理能力 必要な時に利用できる柔軟で低コストな環境
おすすめ用途
本番システム、大規模利用、ミッションクリティカルなAIワークロード PoC、検証環境、小規模導入、短期間利用
提供モデル
Sarashina3 mini / Sarashina3 nano Sarashina3 mini / Sarashina3 nano / Sarashina3 guard / Sarashina3 embedding / Sarashina3 rerank

よくあるご質問

今後提供モデルは追加されますか?
お客さまニーズに応じてモデルラインアップの拡充を予定しています。
モデル選定について相談できますか?
はい。利用目的に応じて、最適なモデルや構成をご提案します。お問い合わせフォームよりご相談ください。
導入支援はありますか?
はい。ソフトバンクの技術チームが、PoCから本番導入まで支援します。
最低利用期間はありますか?
契約条件や提供プランによって異なります。詳細はお問い合わせフォームよりご相談ください。
On-DemandとDedicatedの違いは何ですか?
On-Demand(共有型)は共有GPU環境を利用する従量課金型で、PoCや小規模利用に適しています。Dedicated(専有型)は専用GPUリソースを利用する固定料金型で、本番システムや高負荷な業務利用に適しています。利用規模や要件に応じて選択いただけます。
生成AIサービスの料金体系を教えてください。

生成AIサービスの料金は、ご利用規模やシステム構成に応じて変動します。

柔軟にご利用いただける従量課金モデルを基本とし、長期契約や大規模利用に対応するお得な料金プランもご用意しています。


より詳しい価格やお見積もりについては、お問い合わせフォームよりご相談ください。

入力したデータはAIの学習に利用されますか?
いいえ。入力データ(プロンプト)や生成結果は、AIモデルの再学習には利用されません。
データが海外へ送信されることはありますか?

Cloud PF Type Aは、データ主権を重視した国内完結型のクラウド環境として提供しています。お客さまデータおよび利用ログは、日本国内のデータセンターで保管・管理され、海外へ転送されることはありません。

また、本サービスは、お客さまデータに対してソフトバンクおよびOracleがアクセスできない設計を採用しています。データの保存・処理・管理を国内で完結させることで、データ所在地やアクセス権限に関する懸念を低減し、高いレベルのデータ主権を実現しています。

NVIDIA HGX B200のサービス仕様について教えてください。

サーバー1台から専有できるベアメタル型として提供します。

■GPU

NVIDIA B200 Tensor コア GPU(180GB)

■OCPU

Intel Emerald Rapids 8592+ 64コア

■ストレージ

30T(8 x 3.84TB)

■メモリー

GPU:1.44TB

CPU:4TB

■料金
お問い合わせフォームよりご相談ください。

まずはお気軽にお問い合わせください

資料ダウンロード
お問い合わせ