HiTechCloud AI Platform

Model as a Service (vMaaS)

该平台以 API 形式提供 AI 模型,帮助企业快速集成 AI、实现成本优化,并在越南的 HiTechCloud 基础设施上安全运行。

什么是 vMaaS?

可通过 API 直接调用的 AI 模型,适用于各类企业应用。

HiTechCloud vMaaS 允许开发团队通过 API 调用 model,而无需自行进行复杂的 inference 基础设施运维,从而缩短将 AI 引入产品的时间。

该平台支持 Chatbot、内部助手、文档处理、内容生成、语义搜索、RAG、图像生成、数据分析以及企业内的多种 AI 自动化场景。

服务价格表

vMaaS 套餐根据 token 使用需求灵活调整。

价格表未包含 VAT 税(如有)。最短使用期限:01 个月。支付方式:预付费。

您可以选择现有的 token 套餐,或联系 HiTechCloud 咨询专属配置。

vMaaS_5M

30.000đ

/ 月

Starter Dev

5M Token / 月
8KContent length
8KMax output
无限制请求/分钟
1 个月最短期限
  • 初始成本低,适合在无需投资 GPU/NPU 基础设施的情况下开展 AI 测试。
  • 兼容 OpenAI 的 API,可快速轻松集成到现有应用程序、Chatbot 或 workflow 中。
  • 使用平台完整的 AI 模型目录,包括 LLM、embedding、reranker、vision 和 image generation。
vMaaS_10M

54.000đ

/ 月

Freelance Dev

10M Token / 月
8KContent length
8KMax output
无限制请求/分钟
1 个月最短期限
  • 容量适合用于AI应用的开发、测试和定期优化。
  • 支持在同一 API 平台上部署多项任务。
  • HiTechCloud 基础设施运行在越南,支持生产部署中的数据安全和可靠性。
vMaaS_100M

480.000đ

/ 月

ISV

100M Token / 月
8KContent length
8KMax output
无限制请求/分钟
1 个月最短期限
  • 适合构建和向多个最终客户交付 AI 解决方案的平台。
  • 支持通过 Add-on token 按需扩展,并提供在系统上更新添加新模型的路线图。
  • 适用于 ISV、AI Agency 和 AI 解决方案开发商。

适用于全部套餐

  • 不区分 Input/Output token
  • 无 token/分钟或 API request/分钟限制
  • Content length 最大 8K
  • Max output 最高 8K
  • 访问平台上可用的模型分类
选填附加项

扩展容量或设计自定义配置。

专属咨询

Customize (按需)

适用于有大 token 需求、专属配置、特殊安全要求或部署 BYOM 的大型企业/集团。

Block 1.000.000 token

Add-on Token

6,000đ/1M Token

客户需要扩展超出主套餐配额限制的容量时的附加包。扩展单位按 1,000,000 token 的 block 计。

开放平台

一个 API,针对各类场景提供多种 AI 模型组。

LLM Embedding Reranker Image Generation Vision-Language Model BYOM
核心能力

HiTechCloud vMaaS上常见的AI任务类别。

01

语言处理

Chatbot、内部助手、摘要、文档分析、翻译、分类和多步推理。

02

图像 & 多模态

基于文本描述生成图像、图像识别、图像描述,处理扫描文档、发票和表单。

03

Embedding & Reranker

数据向量化、语义搜索、RAG、知识库问答和结果相关性调优。

04

API & BYOM

通过 OpenAI 兼容的 REST API/SDK 集成,支持自定义模型路由和 Bring Your Own Model。

优势

企业选择 HiTechCloud vMaaS 的原因

专为越南的 AI 场景优化

支持适配越南语语境及越南本地实际部署需求的 AI 模型;具备面向 BFSI、零售、物流、医疗和公共部门等行业的可扩展性。

成本优化 & 部署简便

通过兼容 OpenAI 的 API 进行集成,无需投资专用的 GPU/NPU 基础设施或自建 MLOps 团队。该平台针对 inference 和企业级规模运行进行了优化。

数据安全与越南本地运维

部署在 HiTechCloud 的越南本地基础设施上,支持满足数据主权、本地存储和信息安全要求。客户数据不会被用于训练第三方模型。

扩展 AI 生态系统

vMaaS 正在发展成为包括 MLOps、Vector Database、Knowledge Base-as-a-Service 和 Agent Builder 等服务的全面 AI 生态系统。

一个平台、多种模式

通过单一 API 标准连接多个 AI 模型族、支持从 LLM、图像生成、embedding、reranker 到视觉-语言模型。

适用于从测试到大规模部署

灵活的 token 服务套餐,从 Starter Dev、Freelance Dev、SME 和 ISV 到 Customize,适用于 PoC、应用软件开发和企业部署。

功能

用于开发、管理和运营 AI 的完整工具集。

AI 应用

该界面帮助用户与常见模型(如 LLM、Text-to-Image 和 Embedding)进行交互并直观查看结果。

开发工具

兼容 OpenAI 的 REST API 和 SDK 支持快速集成到现有应用程序中;为 developer 提供技术文档、code samples 和测试环境。

模型管理

管理 AI 模型分类,配置使用限制,并明确企业自定义模型(BYOM - Bring Your Own Model)支持方向。

账户与使用管理

支持 API Key 管理、资源使用监控、token 消耗报告以及服务支付/信用额度管理。

支持 & 运维

由 HiTechCloud 团队提供文档、常见问题和技术支持,确保 AI 部署和运维稳定运行。

AI 模型分类

LLM、embedding、reranker、Image Generation 和 Vision-Language Model 的集合

涵盖多样化的AI模型,支持从对话、RAG到图像生成和多模态文档处理等多种企业AI场景。

LLM (Large Language Models) 组

用于对话、推理、摘要、编程、RAG 和业务自动化的各类大语言模型。

Qwen/Qwen3-32B

32B Parameters Reasoning & Agentic

适用于多步推理、深度文档分析、编程辅助、高级 RAG 以及包含工具调用的流程自动化。

Qwen/Qwen3-14B

14B Parameters Balanced Chat

平衡性能与成本,适用于 Chatbot、文本分析、文本摘要、逻辑推理以及高精度要求的企业任务。

Meta-llama/Llama-3.1-8B

8B Parameters Multilingual Instruct

长上下文多语言模型,适用于摘要、问答、工具使用、推理和编程辅助。

Aisingapore/Llama-SEA-LION-v3.5-8B-R

8B Parameters Regional Optimization

针对东南亚语言和文化优化,支持越南语和多语言对话。

Qwen/Qwen3-4B-Instruct-2507

4B Parameters Edge & Fast Inference

紧凑高效的模型,适应指令遵循、逻辑推理、阅读理解、数学、编程和工具调用。

Embedding、Reranker 及多模态模型

该模型集用于图像生成、数据向量化、搜索优化以及处理视觉-语言任务。

Stabilityai/sdxl-turbo

Image Gen Fast Text-to-Image

从文本生成图像,响应速度快

BAAI/bge-m3

Embedding Semantic Vectorization

用于语义搜索、RAG、知识库问答和重复内容检测的 embedding。

BAAI/bge-reranker-v2-m3

Reranker Search Optimization

在 RAG pipeline 中按相关性重新排序结果。

Qwen/Qwen 2.5-VL-7B

Vision LLM Multimodal AI

视觉-语言模型用于图像识别、图像描述、视觉推理、处理扫描文档、发票和表单。

企业用例

将 vMaaS 应用于产品和运营流程。

AI Chatbot CSKH

虚拟助手 24/7 自动回复网站、应用、Zalo OA 或其他客户服务渠道上的客户问题。

推荐模型:Qwen3-32B / Qwen3-14B

内部知识库问答

构建基于流程、政策、产品文档和业务指南的问答系统;支持精准搜索和带源引用的答案。

推荐模型:Qwen3-4B-Instruct / Qwen3-32B / BGE-M3 / BGE-Reranker-V2-M3

文档摘要 & 分析

总结合同、财务报告、会议纪要和长篇文档;支持提取要点、比对文档和综合洞察。

推荐模型:Qwen3-14B / Llama3.1-8B

编程助手

代码生成、代码建议、代码审查、发现错误,并通过兼容 OpenAI 的 API 集成至 IDE。

推荐模型:Qwen3-32B / Qwen3-14B

生成营销内容

支持撰写博客、社交媒体帖子、Email marketing、产品描述以及多种风格的内容衍生版本。

推荐模型:Qwen3-32B / Qwen3-14B / Llama3.1-8B

流程自动化 (RPA + AI)

分类企业邮箱、从表单/文档中提取信息、调用工具或函数以完成内部流程。

推荐模型:Qwen3-14B / Qwen3-4B-Instruct
curl https://api.hitechcloud.vn/v1/chat/completions \
  -H "Authorization: Bearer <API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3-14b","messages":[{"role":"user","content":"Xin chào vMaaS"}]}'
AI Platform Playground

在将模型集成到应用程序之前进行测试。

  • 基于时延、精度、成本和支持能力对比不同模型。
  • 发送请求进行交互测试,并在投入 production 前评估输出结果。
  • 调整 temperature、max tokens、top_p 等参数,为每个用例找到最佳配置。
基于 API 构建

与OpenAI兼容的API、可通过SDK或cURL快速集成。

在 Playground 中完成测试后,企业可通过 HiTechCloud vMaaS 访问各模型,无缝执行 model 推理。

Step 01

试用

在 AI Platform Playground 中探索模型,并根据实际结果选择合适模型。

Step 02

创建 API key

创建访问密钥、配置应用权限并按环境限制使用。

Step 03

SDK 集成

通过 REST API、Python、JavaScript SDK 连接,或在终端中直接使用 cURL 调用。

Step 04

使用情况跟踪

实时监控 token 消耗、时延、API 错误和成本。

使用情况跟踪

实时控制 API Key、token 和 AI 成本。

使用情况管理页面帮助开发团队和财务团队详细跟踪资源使用情况、token 消耗、资源报告和服务支付/信用额度。

按应用分配 API Key
Token 按套餐消耗
按时间统计的 usage 报告
管理服务支付/信用额度
FAQ

关于 HiTechCloud vMaaS 的常见问题。

什么是 vMaaS?

vMaaS 是以 API 形式提供 AI 模型的服务,支持处理语言、图像、音频和 embedding,兼容 OpenAI API 标准。

企业是否需要投资 GPU/NPU 或 MLOps 团队?

否。您可以通过 API 将 AI 集成到应用、产品或流程中,而无需投资 AI 基础设施或建立专门的 MLOps 团队。

该服务是否与OpenAI API兼容?

支持。vMaaS 支持与 OpenAI 兼容的 API 标准,帮助技术团队快速与现有应用、SDK 或系统集成。

vMaaS 适合哪些使用场景?

该服务适用于客服 Chatbot、知识库问答、文档摘要、编程助手、营销内容生成、RAG 以及结合 AI 的混合办公流程自动化。

是否有 token/分钟或 API request/分钟限制?

vMaaS 各套餐均不设每分钟 token 和每分钟 API request 限制,且不区分 Input/Output token。Content length 和 max output 最高支持 8K。

客户数据是否会被用于训练第三方模型?

否。客户数据不用于第三方模型训练,系统设计为在 HiTechCloud 越南基础设施上运行。

是否支持 BYOM?

是的。定制版本包括针对特定需求企业的自定义配置咨询和 BYOM(自带模型)部署指导。

支付方式是怎样的?

最短使用期限为1个月。支付方式为预付费。价格表不包含VAT(如适用)。

准备好部署 vMaaS 了吗?

携手 HiTechCloud 将 AI 模型集成至应用程序。

HiTechCloud 支持模型选择、API 设计、成本控制和 AI 生产规模部署。