HiTechCloud AI Platform

Model as a Service (vMaaS)

HiTechCloud インフラ上で AIモデルを API として提供するプラットフォームにより、企業は AI を迅速に統合し、コスト最適化を実現し、安全に運用できます。

vMaaSとは?

APIを通じて利用可能なAIモデルは、あらゆるビジネスアプリケーション向けです。

HiTechCloud vMaaS により、開発チームは複雑な inference インフラを自分たちで運用する代わりに API 経由でモデルを呼び出すことができ、AI を製品に搭載するまでの時間を短縮できます。

このプラットフォームはChatbot、内部アシスタント、ドキュメント処理、コンテンツ生成、セマンティック検索、RAG、画像生成、データ分析、および多数の企業AI自動化シナリオをサポートします。

料金表

token 使用量に応じた柔軟な vMaaS サービスプラン。

料金表にはVAT(該当する場合)は含まれていません。最低利用期間: 01か月。支払い方法: 前払い。

既製の token パッケージを選択するか、HiTechCloud にお問い合わせいただきカスタム構成のご相談が可能です。

vMaaS_5M

30.000đ

/ 月

Starter Dev

5M Token / 月
8KContent length
8KMax output
無制限Request/分
1 ヶ月最小契約期間
  • 低い初期投資で、GPU/NPU インフラストラクチャへの投資なく AI 実験を開始するのに適した料金体系。
  • 既存のアプリケーション、Chatbot、ワークフローに迅速かつ容易に統合できるOpenAI互換API。
  • LLM、Embedding、Reranker、Vision、Image Generation を含むプラットフォーム全体の AI モデルカタログにアクセスできます。
vMaaS_10M

54.000đ

/ 月

Freelance Dev

10M Token / 月
8KContent length
8KMax output
無制限Request/分
1 ヶ月最小契約期間
  • AI アプリケーション開発、テスト、定期的な最適化に適した容量。
  • 単一の API プラットフォーム上で多くの異なるタスクをサポート
  • HiTechCloud インフラストラクチャはベトナムで運用されており、本番環境デプロイメントにおけるデータセキュリティおよび信頼性をサポートしています。
vMaaS_100M

480.000đ

/ 月

ISV

100M Token / 月
8KContent length
8KMax output
無制限Request/分
1 ヶ月最小契約期間
  • 複数のエンドユーザー向けに AI ソリューションを構築・提供するための適切なプラットフォームです。
  • Add-on tokenによるオンデマンド拡張と、システムへの新しいモデル追加更新ロードマップをサポートします。
  • ISV、AI Agency、AI ソリューション開発企業に適しています。

すべてのプランに適用

  • Input/Output token に区別なし
  • token/分および API request/分の制限なし
  • コンテンツ長最大 8K
  • 最大出力 8K まで
  • プラットフォーム上の利用可能なモデルカタログにアクセス
任意のオプション

容量を拡張またはカスタム構成を設計します。

個別相談

Customize (ニーズに応じて)

大量の token 利用、専用構成、独自のセキュリティ要件、または BYOM のデプロイを必要とする大企業/企業グループ向けです。

Block 1.000.000 token

Add-on Token

6,000đ/1M Token

顧客がメインプランのクォータ制限を超えて容量を拡張する必要がある場合の追加パッケージです。拡張単位は1,000,000 tokenブロック単位です。

オープンプラットフォーム

1つのAPI、各ユースケース向けの複数のAIモデルファミリー。

LLM Embedding Reranker Image Generation Vision-Language Model BYOM
主要機能

HiTechCloud vMaaS 上の一般的な AI タスクカテゴリー。

01

言語処理

Chatbot、社内アシスタント、要約、ドキュメント分析、翻訳、分類、および多段階推論。

02

画像・マルチモーダル

テキスト説明から画像を生成し、画像を認識・説明し、スキャン文書、請求書、フォームを処理。

03

Embedding & Reranker

データのベクトル化、セマンティック検索、RAG、ナレッジベースの Q&A、結果の関連性チューニング。

04

API & BYOM

OpenAI互換のREST API/SDKを通じて統合でき、カスタムモデルルーティングおよびBring Your Own Modelに対応しています。

利点

企業がHiTechCloud vMaaSを選ぶ理由。

ベトナムにおけるAI課題に最適化

ベトナム語の文脈に適し、ベトナムでの実際のデプロイメント要件に対応した AIモデルをサポートし、BFSI、小売、ロジスティクス、医療、および公共部門などの業種ごとに拡張可能です。

コスト最適化とシンプルなデプロイ

OpenAI互換APIを通じた統合で、GPU/NPUインフラストラクチャまたは独自のMLOpsチームへの投資は不要です。プラットフォームはinferenceおよびエンタープライズ規模での運用に最適化されています。

データセキュリティとベトナムでの運用

HiTechCloud のベトナム国内インフラ上にデプロイされており、データ主権、国内データ保管、情報セキュリティの要件への適合を支援します。顧客データが第三者のモデル学習に使用されることはありません。

拡張 AI エコシステム

vMaaS は MLOps、Vector Database、Knowledge Base-as-a-Service、Agent Builder などのサービスを含むより広範な AI エコシステムへと発展する予定です。

1つのプラットフォーム、複数のモデル

単一の API 標準を通じて複数の AIモデルファミリーに接続でき、LLM、画像生成、embedding、reranker、ビジョン言語モデルに対応しています。

実験から大規模デプロイメントまでの運用に適しています。

Starter Dev、Freelance Dev、SME、ISV から Customize までの柔軟な token パッケージを提供し、PoC、アプリケーション開発、および企業デプロイに対応しています。

機能

AI を開発、管理および運用するための完全なツールセット

AI アプリケーション

LLM、text-to-image、embedding などの一般的なモデルから結果と相互作用し、視覚的に検査するためのインターフェース。

開発ツール

OpenAI 互換のREST API およびSDK により、既存アプリケーションへの統合が迅速化され、技術ドキュメント、コードサンプル、開発者向けテスト環境がサポートされます。

モデル管理

AIモデルカタログを管理し、使用制限を設定し、組織独自のカスタムモデル(BYOM - Bring Your Own Model)をサポートする方向性を定める。

アカウント & 使用状況管理

API key 管理、リソース使用状況の追跡、token 消費レポート、サービス支払い/クレジット管理に対応しています。

サポート & 運用

HiTechCloud チームによるドキュメント、FAQ およびテクニカルサポートにより、AI デプロイと運用の安定性を確保します。

AIモデルカテゴリ

LLM、Embedding、Reranker、Image Generation、Vision-Language Modelのコレクション。

対話、RAG、画像生成、マルチモーダルドキュメント処理など、多様な企業のAI用途をカバーするAIモデルの幅広いコレクション。

LLM (Large Language Models) グループ

対話、推論、要約、プログラミング、RAG、および業務自動化のための大規模言語モデル。

Qwen/Qwen3-32B

32B Parameters Reasoning & Agentic

複数ステップの推論、詳細なドキュメント分析、プログラミングサポート、RAG高度化、ツール呼び出しプロセス自動化に適しています。

Qwen/Qwen3-14B

14B Parameters Balanced Chat

パフォーマンスとコストのバランスに優れ、Chatbot、テキスト分析、要約、推論、高い精度が求められる企業向けタスクに適しています。

Meta-llama/Llama-3.1-8B

8B Parameters Multilingual Instruct

長いコンテキストを持つ多言語モデルで、要約、質問応答、ツール利用、推論、プログラミング支援に適しています。

Aisingapore/Llama-SEA-LION-v3.5-8B-R

8B Parameters Regional Optimization

東南アジアの言語と文化に最適化され、ベトナム語とマルチリンガル対話をサポートしています。

Qwen/Qwen3-4B-Instruct-2507

4B Parameters Edge & Fast Inference

指示フォロー、論理的推論、読解、数学、プログラミング およびツール呼び出しに適したコンパクトで効率的なモデルです。

Embedding、Reranker & マルチモーダルモデル

画像生成、データのベクトル化、検索の最適化、視覚言語タスクの処理に対応するモデルセットです。

Stabilityai/sdxl-turbo

Image Gen Fast Text-to-Image

テキストから高速な応答時間で画像を生成します。

BAAI/bge-m3

Embedding Semantic Vectorization

セマンティック検索、RAG、ナレッジベースQ&A、および重複コンテンツ検出のためのEmbedding。

BAAI/bge-reranker-v2-m3

Reranker Search Optimization

RAG pipelineで関連度による再ランキングを実行します。

Qwen/Qwen 2.5-VL-7B

Vision LLM Multimodal AI

画像認識、画像キャプション、ビジュアル推論、スキャンドキュメント、請求書、フォームの処理のための vision-language モデル。

企業ユースケース

vMaaS を製品と運用プロセスに適用します。

AI Chatbot CSKH

バーチャルアシスタント が 24/7 をとおし、サイト、アプリ、Zalo OA、またはその他のサポートチャネルで 顧客 の質問に自動返信 します。

推奨モデル: Qwen3-32B / Qwen3-14B

社内ナレッジベースの Q&A

プロセス、ポリシー、製品ドキュメント、運用ガイドに基づくQ&Aシステムを構築します。正確な検索とソース引用付きの回答をサポートします。

推奨モデル: Qwen3-4B-Instruct / Qwen3-32B / BGE-M3 / BGE-Reranker-V2-M3

ドキュメント要約と分析

契約、財務報告書、会議議事録、長文ドキュメントを要約し、主要ポイント抽出、ドキュメント比較、インサイト統合に対応しています。

推奨モデル: Qwen3-14B / Llama3.1-8B

プログラミングアシスタント

コード生成、コード補完、コードレビュー、エラー検出、および OpenAI 互換 API を介した IDE への統合。

推奨モデル: Qwen3-32B / Qwen3-14B

マーケティング コンテンツ生成

ブログ、ソーシャル投稿、Email marketing、製品説明、および複数のスタイルでのコンテンツ展開支援。

推奨モデル: Qwen3-32B / Qwen3-14B / Llama3.1-8B

プロセス自動化 (RPA + AI)

Emailの分類、フォーム/ドキュメントからの情報抽出、ツールやfunctionの呼び出しを行い、社内プロセスを完了します。

推奨モデル: Qwen3-14B / Qwen3-4B-Instruct
curl https://api.hitechcloud.vn/v1/chat/completions \
  -H "Authorization: Bearer <API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3-14b","messages":[{"role":"user","content":"Xin chào vMaaS"}]}'
AI Platform Playground

アプリケーションに統合する前にモデルをテストします。

  • レイテンシ、精度、コスト、サポート能力に基づいて異なるモデルを比較。
  • インタラクティブテストのリクエストを送信し、productionへの導入前に出力結果を評価します。
  • temperature、max tokens、top_pなどのパラメータを微調整し、ユースケースごとに最適な構成を見つけます。
API で構築

OpenAI互換API、SDKまたはcURLで迅速に統合できます。

Playground でのテスト後、企業はHiTechCloud vMaaS を通じてモデルにアクセスし、追加の統合作業なしにモデル推論を実行できます。

Step 01

トライアル

AI Platform Playground でモデルを検証し、実績に基づいて最適なモデルを選択します。

Step 02

API key作成

アクセスキーの作成、アプリケーションの権限設定、および環境ごとの利用制限。

Step 03

SDK 統合

REST API、Python、JavaScript SDKで接続するか、cURLを使用してターミナルから直接呼び出します。

Step 04

使用状況追跡

token消費、レイテンシ、APIエラー、コストをリアルタイムで監視します。

使用状況追跡

API Key、token、AI コストをリアルタイムで管理します。

使用状況管理ページにより、エンジニアリングおよび財務チームが、使用トークン、リソースレポート、およびサービス支払い・クレジットを含む消費量を詳細に追跡できます。

API Key/アプリケーション
プラン別トークン消費
時間に応じた usage レポート
サービスの支払い/クレジット管理
FAQ

HiTechCloud vMaaS についてのよくあるご質問。

vMaaSとは?

vMaaS は AIモデルを API として提供し、言語、画像、音声およびエンベディング処理に対応し、OpenAI API 互換のエンドポイントを備えています。

企業は GPU/NPU ハードウェアまたは MLOps チームへの投資が必要ですか。

いいえ。企業は、AI インフラへの投資や専門の MLOps チームを構築することなく、API を通じてアプリケーション、製品、または業務プロセスに AI を統合できます。

サービスは OpenAI API と互換性がありますか?

はい。vMaaSはOpenAI互換のAPI標準をサポートしており、技術チームが既存のアプリケーション、SDK、またはシステムと迅速に統合できるようにします。

vMaaSはどのようなユースケースに適していますか?

このサービスは、カスタマーサポート Chatbot、ナレッジベース Q&A、ドキュメント要約、プログラミングアシスタント、マーケティングコンテンツ生成、RAG および AI 支援プロセス自動化に適しています。

token/分または API request/分の制限がありますか?

vMaaS プランは、分単位の token、API request 制限はなく、Input/Output token を区別しません。コンテンツ長と最大出力は 8K に制限されます。

顧客データは第三者モデルの学習に使用されますか。

いいえ。顧客データは第三者のモデル学習に使用されず、システムは HiTechCloud のベトナム国内インフラストラクチャで運用されるように設計されています。

BYOM に対応していますか?

はい。Customizeプランは、独自設定のコンサルティングとBYOM(Bring Your Own Model)デプロイの指導を含み、特殊な要件を持つ企業に対応します。

どのような支払い方法がありますか?

最小利用期間は 1 カ月です。支払い方法は前払いです。料金には VAT が含まれていません(該当する場合)。

vMaaS のデプロイの準備はできていますか?

HiTechCloud と共に AIモデルをアプリケーションに統合する。

HiTechCloud はモデル選択、API 設計、コスト管理および production 規模での AI デプロイを支援します。