さくらインターネットは2026年10月8日、GPUサーバ上に基盤モデル(LLM)を展開しマネージドサービスとして提供する「さくらのAI Engine」の新プランとして、GPUを専有して利用できる「さくらのAI Engine プライベートエディション」の提供開始を発表しました。
従来の「さくらのAI Engine」はAPI利用に応じた従量課金型でしたが、プライベートエディションではGPU単位の月額定額制となるのが最大の特徴です。これにより大規模なAPI利用でもコストが予測しやすく、トークン消費量を気にせず生成AIを活用できます。
| 項目 | さくらのAI Engine(従来) | プライベートエディション(新) |
|---|---|---|
| 課金形態 | 従量課金型(API利用量に応じ課金) | GPU単位の月額定額制 |
| リソース | 共有環境 | GPU専有環境 |
| コスト予測 | トークン消費量に依存 | 大規模API利用もコストが予測しやすい |
| 活用場面 | 小〜中規模のAPI利用 | 機密情報を扱う社内業務・自社サービスなど |
「さくらのAI Engine」は、GPUサーバの設定・LLMのインストール・運用をさくらインターネットが担い、ユーザーはAPIにアクセスするだけでAIアプリケーションを構築できるサービスです。プライベートエディションはその“おまかせ運用”を保ちつつ、専有GPU+定額という企業向けの要件に応えたラインナップと言えます。
自前でGPUを所有して維持管理する手間を省きたい企業、特に機密性の高いデータを扱う場合や、トークン消費量が読みにくくコスト管理が難しい大規模API利用において、有力な選択肢になりそうです。