HiTechCloud AI Platform

Model as a Service (vMaaS)

Nền tảng cung cấp mô hình AI dưới dạng API, giúp doanh nghiệp tích hợp AI nhanh chóng, tối ưu chi phí và vận hành an toàn trên hạ tầng HiTechCloud tại Việt Nam.

vMaaS là gì?

Mô hình AI sẵn sàng dùng qua API cho mọi ứng dụng doanh nghiệp.

HiTechCloud vMaaS cho phép đội ngũ phát triển gọi model qua API thay vì tự vận hành hạ tầng inference phức tạp, giúp rút ngắn thời gian đưa AI vào sản phẩm.

Nền tảng hỗ trợ chatbot, trợ lý nội bộ, xử lý tài liệu, tạo nội dung, tìm kiếm ngữ nghĩa, RAG, tạo ảnh, phân tích dữ liệu và nhiều kịch bản tự động hóa AI trong doanh nghiệp.

Bảng giá dịch vụ

Gói vMaaS linh hoạt theo nhu cầu sử dụng token.

Bảng giá chưa bao gồm thuế VAT (nếu có). Thời hạn sử dụng tối thiểu: 01 tháng. Hình thức thanh toán: Trả trước.

Quý khách hàng có thể chọn gói token có sẵn hoặc liên hệ HiTechCloud để tư vấn cấu hình riêng.

vMaaS_5M

30.000đ

/ Tháng

Starter Dev

5M Token / tháng
8KContent length
8KMax output
Không giới hạnRequest/phút
01 thángThời hạn tối thiểu
  • Chi phí khởi điểm thấp, phù hợp để bắt đầu thử nghiệm AI mà không cần đầu tư hạ tầng GPU/NPU.
  • API tương thích OpenAI, dễ tích hợp nhanh vào ứng dụng, chatbot hoặc workflow hiện có.
  • Sử dụng được toàn bộ danh mục mô hình AI trên nền tảng, bao gồm LLM, Embedding, Reranker, Vision và Image Generation.
vMaaS_10M

54.000đ

/ Tháng

Freelance Dev

10M Token / tháng
8KContent length
8KMax output
Không giới hạnRequest/phút
01 thángThời hạn tối thiểu
  • Dung lượng phù hợp cho phát triển, kiểm thử và tối ưu ứng dụng AI thường xuyên.
  • Hỗ trợ triển khai nhiều tác vụ trên cùng một nền tảng API.
  • Hạ tầng HiTechCloud vận hành tại Việt Nam, hỗ trợ bảo mật dữ liệu và độ ổn định khi triển khai thực tế.
vMaaS_100M

480.000đ

/ Tháng

ISV

100M Token / tháng
8KContent length
8KMax output
Không giới hạnRequest/phút
01 thángThời hạn tối thiểu
  • Nền tảng phù hợp để phát triển và cung cấp giải pháp AI cho nhiều khách hàng cuối.
  • Hỗ trợ mở rộng theo nhu cầu với Add-on token và lộ trình cập nhật thêm mô hình mới trên hệ thống.
  • Phù hợp cho ISV, AI Agency và đơn vị phát triển giải pháp AI.

Áp dụng cho tất cả các gói

  • Không phân biệt Input/Output token
  • Không giới hạn token/phút và API request/phút
  • Content length tối đa 8K
  • Max output tối đa 8K
  • Truy cập danh mục mô hình hiện có trên nền tảng
Tùy chọn bổ sung

Mở rộng dung lượng hoặc thiết kế cấu hình riêng.

Tư vấn riêng

Customize (Theo nhu cầu)

Dành cho doanh nghiệp lớn/tập đoàn có nhu cầu token lớn, cấu hình riêng, yêu cầu bảo mật đặc thù hoặc triển khai BYOM.

Block 1.000.000 token

Add-on Token

6.000đ/1M Token

Gói bổ sung khi khách hàng cần mở rộng dung lượng ngoài giới hạn mức gói chính. Đơn vị mở rộng theo block 1.000.000 token.

Nền tảng mở

Một API, nhiều nhóm mô hình AI cho từng bài toán.

LLM Embedding Reranker Image Generation Vision-Language Model BYOM
Khả năng chính

Các nhóm tác vụ AI phổ biến trên HiTechCloud vMaaS.

01

Xử lý ngôn ngữ

Chatbot, trợ lý nội bộ, tóm tắt, phân tích tài liệu, dịch thuật, phân loại và suy luận nhiều bước.

02

Hình ảnh & đa phương thức

Tạo ảnh từ mô tả văn bản, nhận diện hình ảnh, mô tả ảnh, xử lý tài liệu scan, hóa đơn và biểu mẫu.

03

Embedding & Reranker

Vector hóa dữ liệu, tìm kiếm ngữ nghĩa, RAG, hỏi đáp kho tri thức và tối ưu mức độ liên quan của kết quả.

04

API & BYOM

Tích hợp qua REST API/SDK tương thích OpenAI, hỗ trợ định hướng mô hình tùy chỉnh và Bring Your Own Model.

Ưu điểm

Lý do doanh nghiệp chọn HiTechCloud vMaaS.

Tối ưu cho bài toán AI tại Việt Nam

Hỗ trợ các mô hình AI phù hợp với ngữ cảnh tiếng Việt và nhu cầu triển khai thực tế tại Việt Nam; có khả năng mở rộng theo từng ngành như BFSI, bán lẻ, logistics, y tế và khu vực công.

Chi phí tối ưu & triển khai đơn giản

Tích hợp qua API tương thích OpenAI, không cần đầu tư hạ tầng GPU/NPU hoặc đội ngũ MLOps riêng. Nền tảng được tối ưu cho inference và vận hành ở quy mô doanh nghiệp.

Bảo mật dữ liệu & vận hành tại Việt Nam

Triển khai trên hạ tầng tại Việt Nam của HiTechCloud, hỗ trợ đáp ứng yêu cầu chủ quyền dữ liệu, lưu trữ nội địa và bảo mật thông tin. Dữ liệu khách hàng không được sử dụng để huấn luyện mô hình bên thứ ba.

Hệ sinh thái AI mở rộng

vMaaS được định hướng phát triển thành hệ sinh thái AI toàn diện với các dịch vụ như MLOps, Vector Database, Knowledge Base-as-a-Service và Agent Builder.

Một nền tảng, nhiều mô hình

Cho phép kết nối nhiều nhóm mô hình AI qua một chuẩn API, hỗ trợ từ LLM, tạo ảnh, embedding, reranker đến mô hình thị giác-ngôn ngữ.

Phù hợp từ thử nghiệm đến triển khai quy mô lớn

Cung cấp các gói token linh hoạt từ Starter Dev, Freelance Dev, SME, ISV đến Customize, phù hợp cho PoC, phát triển ứng dụng và triển khai doanh nghiệp.

Tính năng

Đầy đủ công cụ để phát triển, quản lý và vận hành AI.

Ứng dụng AI

Giao diện giúp người dùng tương tác và quan sát kết quả trực quan từ các mô hình phổ biến như LLM, Text-to-Image và Embedding.

Công cụ phát triển

REST API và SDK tương thích OpenAI giúp tích hợp nhanh vào ứng dụng hiện có; hỗ trợ tài liệu kỹ thuật, code samples và môi trường thử nghiệm cho developer.

Quản lý mô hình

Quản lý danh mục mô hình AI, cấu hình giới hạn sử dụng và định hướng hỗ trợ mô hình tùy chỉnh của doanh nghiệp (BYOM - Bring Your Own Model).

Quản lý tài khoản & sử dụng

Hỗ trợ quản lý API Key, theo dõi mức sử dụng tài nguyên, báo cáo token tiêu thụ và quản lý thanh toán/tín dụng dịch vụ.

Hỗ trợ & vận hành

Cung cấp tài liệu, FAQ và hỗ trợ kỹ thuật từ đội ngũ HiTechCloud nhằm đảm bảo quá trình triển khai và vận hành AI ổn định.

Danh mục mô hình AI

Bộ sưu tập LLM, Embedding, Reranker, Image Generation và Vision-Language Model.

Bộ sưu tập đa dạng các mô hình AI hỗ trợ nhiều bài toán AI doanh nghiệp, từ hội thoại, RAG đến tạo ảnh và xử lý tài liệu đa phương thức.

Nhóm LLM (Large Language Models)

Các mô hình ngôn ngữ lớn cho hội thoại, suy luận, tóm tắt, lập trình, RAG và tự động hóa nghiệp vụ.

Qwen/Qwen3-32B

32B Parameters Reasoning & Agentic

Phù hợp suy luận nhiều bước, phân tích tài liệu chuyên sâu, hỗ trợ lập trình, RAG nâng cao và tự động hóa quy trình có gọi công cụ.

Qwen/Qwen3-14B

14B Parameters Balanced Chat

Cân bằng hiệu năng và chi phí, phù hợp chatbot, phân tích văn bản, tóm tắt, suy luận và tác vụ doanh nghiệp yêu cầu độ chính xác cao.

Meta-llama/Llama-3.1-8B

8B Parameters Multilingual Instruct

Mô hình đa ngôn ngữ với ngữ cảnh dài, phù hợp tóm tắt, hỏi đáp, sử dụng công cụ, suy luận và hỗ trợ lập trình.

Aisingapore/Llama-SEA-LION-v3.5-8B-R

8B Parameters Regional Optimization

Tối ưu cho ngôn ngữ và văn hóa Đông Nam Á, hỗ trợ tiếng Việt và hội thoại đa ngôn ngữ.

Qwen/Qwen3-4B-Instruct-2507

4B Parameters Edge & Fast Inference

Mô hình nhỏ gọn, hiệu quả cho tuân thủ hướng dẫn, suy luận logic, đọc hiểu, toán học, lập trình và gọi công cụ.

Nhóm Embedding, Reranker & Đa Phương Thức

Bộ mô hình phục vụ tạo ảnh, vector hóa dữ liệu, tối ưu tìm kiếm và xử lý bài toán thị giác-ngôn ngữ.

Stabilityai/sdxl-turbo

Image Gen Fast Text-to-Image

Tạo ảnh từ văn bản với tốc độ phản hồi nhanh.

BAAI/bge-m3

Embedding Semantic Vectorization

Embedding cho tìm kiếm ngữ nghĩa, RAG, hỏi đáp kho tri thức và phát hiện nội dung trùng lặp.

BAAI/bge-reranker-v2-m3

Reranker Search Optimization

Sắp xếp lại mức độ liên quan trong pipeline RAG.

Qwen/Qwen 2.5-VL-7B

Vision LLM Multimodal AI

Mô hình thị giác-ngôn ngữ cho nhận diện hình ảnh, mô tả ảnh, suy luận trực quan, xử lý tài liệu scan, hóa đơn và biểu mẫu.

Use-case doanh nghiệp

Ứng dụng vMaaS vào sản phẩm và quy trình vận hành.

AI Chatbot CSKH

Trợ lý ảo trả lời tự động câu hỏi khách hàng 24/7 trên website, ứng dụng, Zalo OA hoặc kênh CSKH khác.

Mô hình đề xuất: Qwen3-32B / Qwen3-14B

Hỏi đáp trên kho tri thức nội bộ

Xây dựng hệ thống Q&A dựa trên quy trình, chính sách, tài liệu sản phẩm, hướng dẫn nghiệp vụ; hỗ trợ tìm kiếm chính xác và trả lời có trích dẫn nguồn.

Mô hình đề xuất: Qwen3-4B-Instruct / Qwen3-32B / BGE-M3 / BGE-Reranker-V2-M3

Tóm tắt & phân tích tài liệu

Tóm tắt hợp đồng, báo cáo tài chính, biên bản họp và tài liệu dài; hỗ trợ trích xuất ý chính, so sánh tài liệu và tổng hợp insight.

Mô hình đề xuất: Qwen3-14B / Llama3.1-8B

Trợ lý lập trình

Sinh code, gợi ý code, review code, phát hiện lỗi và tích hợp vào IDE qua API tương thích OpenAI.

Mô hình đề xuất: Qwen3-32B / Qwen3-14B

Sinh nội dung Marketing

Hỗ trợ viết blog, social post, email marketing, mô tả sản phẩm và biến thể nội dung theo nhiều phong cách.

Mô hình đề xuất: Qwen3-32B / Qwen3-14B / Llama3.1-8B

Tự động hóa quy trình (RPA + AI)

Phân loại email, trích xuất thông tin từ form/tài liệu, gọi tool hoặc function để hoàn thành quy trình nội bộ.

Mô hình đề xuất: Qwen3-14B / Qwen3-4B-Instruct
curl https://api.hitechcloud.vn/v1/chat/completions \
  -H "Authorization: Bearer <API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3-14b","messages":[{"role":"user","content":"Xin chào vMaaS"}]}'
AI Platform Playground

Thử nghiệm mô hình trước khi tích hợp vào ứng dụng.

  • So sánh các mô hình khác nhau dựa trên độ trễ, độ chính xác, chi phí và khả năng hỗ trợ.
  • Gửi yêu cầu thử nghiệm tương tác, đánh giá kết quả đầu ra trước khi đưa vào production.
  • Tinh chỉnh tham số như temperature, max tokens, top_p để tìm cấu hình phù hợp nhất cho từng use-case.
Xây dựng với API

API tương thích OpenAI, tích hợp nhanh bằng SDK hoặc cURL.

Sau khi thử nghiệm trong Playground, doanh nghiệp có thể truy cập các mô hình thông qua HiTechCloud vMaaS để thực hiện suy luận model một cách liền mạch.

Step 01

Thử nghiệm

Khám phá model trong AI Platform Playground và lựa chọn model phù hợp theo kết quả thực tế.

Step 02

Tạo API key

Tạo khóa truy cập, phân quyền ứng dụng và giới hạn sử dụng theo từng môi trường.

Step 03

Tích hợp SDK

Kết nối bằng REST API, Python, JavaScript SDK hoặc gọi trực tiếp qua terminal với cURL.

Step 04

Theo dõi usage

Giám sát token tiêu thụ, độ trễ, lỗi API và chi phí theo thời gian thực.

Theo dõi usage

Kiểm soát API Key, token và chi phí AI theo thời gian thực.

Trang quản lý usage giúp đội ngũ kỹ thuật và tài chính theo dõi chi tiết mức sử dụng, token tiêu thụ, báo cáo tài nguyên và thanh toán/tín dụng dịch vụ.

API Key theo ứng dụng
Token tiêu thụ theo gói
Báo cáo usage theo thời gian
Quản lý thanh toán/tín dụng dịch vụ
FAQ

Câu hỏi thường gặp về HiTechCloud vMaaS.

vMaaS là gì?

vMaaS là dịch vụ cung cấp các mô hình AI dưới dạng API, hỗ trợ xử lý ngôn ngữ, hình ảnh, âm thanh và embedding, với chuẩn tương thích OpenAI API.

Doanh nghiệp có cần đầu tư GPU/NPU hoặc đội ngũ MLOps không?

Không. Doanh nghiệp có thể tích hợp AI vào ứng dụng, sản phẩm hoặc quy trình thông qua API mà không cần đầu tư hạ tầng AI hay xây dựng đội ngũ MLOps chuyên biệt.

Dịch vụ có tương thích OpenAI API không?

Có. vMaaS hỗ trợ chuẩn API tương thích OpenAI, giúp đội ngũ kỹ thuật tích hợp nhanh với ứng dụng, SDK hoặc hệ thống hiện có.

vMaaS phù hợp với những bài toán nào?

Dịch vụ phù hợp cho chatbot CSKH, hỏi đáp kho tri thức, tóm tắt tài liệu, trợ lý lập trình, sinh nội dung marketing, RAG và tự động hóa quy trình kết hợp AI.

Có giới hạn token/phút hoặc API request/phút không?

Các gói vMaaS được thiết kế không giới hạn token/phút và API request/phút, đồng thời không phân biệt Input/Output token. Content length và max output tối đa 8K.

Dữ liệu khách hàng có được dùng để huấn luyện mô hình bên thứ ba không?

Không. Dữ liệu khách hàng không được sử dụng để huấn luyện mô hình bên thứ ba; hệ thống được định hướng vận hành trên hạ tầng tại Việt Nam của HiTechCloud.

Có hỗ trợ BYOM không?

Có. Gói Customize hỗ trợ tư vấn cấu hình riêng và định hướng triển khai BYOM (Bring Your Own Model) cho doanh nghiệp có yêu cầu đặc thù.

Hình thức thanh toán như thế nào?

Thời hạn sử dụng tối thiểu là 01 tháng. Hình thức thanh toán là trả trước. Bảng giá chưa bao gồm thuế VAT nếu có.

Sẵn sàng triển khai vMaaS?

Tích hợp các mô hình AI vào ứng dụng của bạn cùng HiTechCloud.

HiTechCloud hỗ trợ lựa chọn model, thiết kế API, kiểm soát chi phí và triển khai AI ở quy mô production cho doanh nghiệp.