HiTechCloud AI Platform

Model as a Service (vMaaS)

API 형태로 AI 모델을 제공하는 플랫폼으로, 기업이 신속하게 AI를 통합하고 비용 최적화를 달성하며 베트남 내 HiTechCloud 인프라에서 안전하게 운영할 수 있도록 지원합니다.

vMaaS란 무엇입니까?

AI 모델은 모든 기업 애플리케이션을 위해 API를 통해 즉시 사용 가능합니다.

HiTechCloud vMaaS를 통해 개발팀은 복잡한 inference 인프라 운영을 직접 수행하는 대신 API를 통해 model을 호출할 수 있어, 제품에 AI를 도입하는 시간을 단축할 수 있습니다.

챗봇, 내부 어시스턴트, 문서 처리, 콘텐츠 생성, 시맨틱 검색, RAG, 이미지 생성, 데이터 분석 및 다양한 기업 AI 자동화 시나리오를 지원하는 플랫폼입니다.

서비스 가격표

토큰 사용량에 따라 유연한 vMaaS 요금제.

가격표에는 VAT(해당하는 경우)가 포함되지 않았습니다. 최소 이용 기간: 01개월. 결제 방식: 선불.

고객은 기본 제공되는 token 패키지를 선택하거나 맞춤형 구성 상담을 위해 HiTechCloud에 문의하기를 진행할 수 있습니다.

vMaaS_5M

30.000đ

/ 월

Starter Dev

5M Token / 월
8KContent length
8KMax output
무제한Request/분
1개월최소 약정 기간
  • 초기 비용이 저렴하여 GPU/NPU 인프라에 투자하지 않고도 AI 테스트를 시작하기에 적합합니다.
  • OpenAI 호환 API로, 기존 애플리케이션, Chatbot 또는 워크플로우에 빠르고 쉽게 연동할 수 있습니다.
  • LLM, Embedding, Reranker, Vision 및 Image Generation을 포함한 플랫폼의 모든 AI 모델 카테고리를 활용할 수 있습니다.
vMaaS_10M

54.000đ

/ 월

Freelance Dev

10M Token / 월
8KContent length
8KMax output
무제한Request/분
1개월최소 약정 기간
  • 정기적인 AI 애플리케이션 개발, 테스트 및 최적화에 적합한 용량.
  • 단일 API 플랫폼에서 여러 작업 배포를 지원합니다.
  • HiTechCloud 인프라는 베트남에서 운영되며, 실제 배포 시 데이터 보안 및 안정성을 지원합니다.
vMaaS_100M

480.000đ

/ 월

ISV

100M Token / 월
8KContent length
8KMax output
무제한Request/분
1개월최소 약정 기간
  • 다양한 최종 고객을 대상으로 AI 솔루션을 개발하고 제공하기에 적합한 플랫폼입니다.
  • Add-on token을 통한 온디맨드 확장 및 시스템 내 신규 모델 추가 업데이트 로드맵 지원.
  • ISV, AI Agency 및 AI 솔루션 개발사에 적합합니다.

전체 플랜에 적용

  • Input/Output token 구분 없음
  • 분당 token 및 분당 API request 무제한
  • 최대 콘텐츠 길이 8K
  • Max output 최대 8K
  • 플랫폼에서 사용 가능한 모델 카테고리에 액세스
추가 선택 사항

용량을 확장하거나 맞춤형 구성을 설계하십시오.

맞춤 상담

Customize (맞춤형)

대규모 token 수요, 전용 구성, 특화된 보안 요구사항 또는 BYOM 배포가 필요한 대기업/그룹을 위한 상품입니다.

Block 1.000.000 token

Add-on Token

6,000đ/1M Token

기본 패키지 한도를 초과하는 용량이 필요한 고객을 위한 추가 패키지. 1,000,000 token 단위로 판매됩니다.

오픈 플랫폼

단일 API, 각 과제별 다양한 AI 모델 그룹.

LLM Embedding Reranker Image Generation Vision-Language Model BYOM
주요 기능

HiTechCloud vMaaS의 일반적인 AI 작업 범주

01

언어 처리

Chatbot, 내부 지원 도구, 요약, 문서 분석, 번역, 분류 및 다단계 추론.

02

이미지 & 멀티모달

텍스트 설명으로부터 이미지 생성, 이미지 인식 및 캡션, 스캔된 문서, 청구서 및 양식 처리.

03

Embedding & Reranker

데이터 벡터화, 시맨틱 검색, RAG, 지식 기반 Q&A 및 결과의 관련성 최적화.

04

API & BYOM

OpenAI와 호환되는 REST API/SDK를 통해 연동되며, 커스텀 모델 라우팅 및 Bring Your Own Model을 지원합니다.

이점

기업이 HiTechCloud vMaaS를 선택하는 이유

베트남의 AI Workload에 최적화

베트남 언어 맥락 및 베트남 실제 배포 필요에 맞는 AI 모델을 지원하며, BFSI, 소매, 물류, 의료 및 공공 부문 등 각 산업별로 확장성을 갖춥니다.

비용 최적화 & 간단한 배포

OpenAI 호환 API를 통해 통합, GPU/NPU 인프라 또는 별도의 MLOps팀에 투자할 필요 없음. 플랫폼은 inference 및 기업 규모의 운영에 최적화되었습니다.

베트남의 데이터 보안 및 운영

HiTechCloud의 베트남 현지 인프라에 배포되어 데이터 주권, 국내 데이터 보관 및 정보 보안 요구 사항 충족을 지원합니다. 고객 데이터는 제3자 모델 학습에 사용되지 않습니다.

확장형 AI 생태계

vMaaS는 MLOps, Vector Database, Knowledge Base-as-a-Service 및 Agent Builder와 같은 서비스를 포함한 포괄적인 AI 생태계로 발전하고 있습니다.

하나의 플랫폼, 다양한 모델

단일 API 표준을 통해 여러 AI 모델 계열에 연결하며, LLM, 이미지 생성, embedding, reranker 및 vision-language 모델을 지원합니다.

테스트 단계부터 대규모 배포까지 적합

Starter Dev, Freelance Dev, SME, ISV부터 Customize까지 유연한 token 요금제를 제공하여 PoC, 애플리케이션 개발 및 기업 배포에 적합합니다.

기능

AI를 개발, 관리 및 운영하기 위한 완전한 도구 모음

AI 애플리케이션

사용자가 LLM, Text-to-Image, Embedding과 같은 주요 모델과 상호작용하고 직관적인 결과를 확인할 수 있도록 지원하는 인터페이스입니다.

개발 도구

REST API 및 OpenAI 호환 SDK는 빠른 기존 애플리케이션 통합을 지원하며, 기술 문서, 코드 샘플 및 개발자용 테스트 환경을 제공합니다.

모델 관리

AI 모델 카테고리 관리, 사용 한도 구성 및 기업 맞춤형 모델(BYOM - Bring Your Own Model) 지원 방향을 설정합니다.

계정 및 이용 현황 관리

API key 관리, 리소스 사용량 추적, token 소비 보고 및 서비스 결제/신용 관리를 지원합니다.

지원 & 운영

AI의 안정적인 배포 및 운영을 보장하기 위해 문서, FAQ 및 HiTechCloud 팀의 기술 지원을 제공합니다.

AI 모델 카테고리

LLM, Embedding, Reranker, Image Generation 및 Vision-Language Model의 모음입니다.

대화, RAG, 이미지 생성 및 다중 양식 문서 처리에 이르기까지 다양한 기업 AI 문제를 지원하는 다양한 AI 모델 모음입니다.

LLM (Large Language Models) 그룹

대화, 추론, 요약, 프로그래밍, RAG 및 비즈니스 프로세스 자동화를 위한 대규모 언어 모델.

Qwen/Qwen3-32B

32B Parameters Reasoning & Agentic

다단계 추론, 심층 문서 분석, 프로그래밍 지원, 고급 RAG 및 도구 호출 프로세스 자동화에 적합합니다.

Qwen/Qwen3-14B

14B Parameters Balanced Chat

성능과 비용의 균형을 맞추며, Chatbot, 텍스트 분석, 요약, 추론 및 높은 정확도가 필요한 업무에 적합합니다.

Meta-llama/Llama-3.1-8B

8B Parameters Multilingual Instruct

긴 컨텍스트를 지원하는 다국어 모델로 요약, 질의응답, 도구 활용, 추론 및 프로그래밍 지원에 적합합니다.

Aisingapore/Llama-SEA-LION-v3.5-8B-R

8B Parameters Regional Optimization

동남아시아의 언어와 문화에 최적화되어 베트남어 및 다국어 대화를 지원합니다.

Qwen/Qwen3-4B-Instruct-2507

4B Parameters Edge & Fast Inference

지시 사항 규정 준수, 논리적 추론, 독해, 수학, 프로그래밍 및 도구 호출에 효율적인 컴팩트 모델입니다.

Embedding, Reranker & 다중 모달 모델

이미지 생성, 데이터 벡터화, 검색 최적화, vision-language 작업을 위한 모델 세트

Stabilityai/sdxl-turbo

Image Gen Fast Text-to-Image

빠른 응답 속도로 텍스트에서 이미지를 생성합니다.

BAAI/bge-m3

Embedding Semantic Vectorization

시맨틱 검색, RAG, 지식 기반 Q&A 및 중복 콘텐츠 감지를 위한 Embedding입니다.

BAAI/bge-reranker-v2-m3

Reranker Search Optimization

RAG pipeline에서 관련성을 재정렬합니다.

Qwen/Qwen 2.5-VL-7B

Vision LLM Multimodal AI

이미지 인식, 이미지 설명, 시각 추론 및 스캔한 문서, 청구서 및 양식 처리를 위한 시각-언어 모델입니다.

기업 유스케이스

vMaaS를 제품 및 운영 프로세스에 적용합니다.

AI Chatbot CSKH

웹사이트, 앱, Zalo OA 또는 기타 지원 채널에서 24/7 고객 질문에 자동으로 응답하는 가상 비서입니다.

권장 모델: Qwen3-32B / Qwen3-14B

내부 지식 기반에서 Q&A

프로세스, 정책, 제품 문서, 업무 가이드를 바탕으로 Q&A 시스템을 구축하며, 정확한 검색 및 출처 인용이 포함된 답변을 지원합니다.

권장 모델: Qwen3-4B-Instruct / Qwen3-32B / BGE-M3 / BGE-Reranker-V2-M3

문서 요약 및 분석

계약 요약, 재무 보고서, 회의록 및 장문 문서 지원; 핵심 요점 추출, 문서 비교 및 인사이트 종합을 지원합니다.

권장 모델: Qwen3-14B / Llama3.1-8B

프로그래밍 어시스턴트

OpenAI 호환 API를 통한 코드 생성, 코드 제안, 코드 리뷰, 오류 감지 및 IDE 연동.

권장 모델: Qwen3-32B / Qwen3-14B

마케팅 콘텐츠 생성

블로그 작성, 소셜 포스트, Email marketing, 제품 설명 및 다양한 스타일의 콘텐츠 변형을 지원합니다.

권장 모델: Qwen3-32B / Qwen3-14B / Llama3.1-8B

프로세스 자동화 (RPA + AI)

이메일 분류, 양식/문서에서 정보 추출, 내부 프로세스 완료를 위한 도구 또는 함수 호출.

권장 모델: Qwen3-14B / Qwen3-4B-Instruct
curl https://api.hitechcloud.vn/v1/chat/completions \
  -H "Authorization: Bearer <API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3-14b","messages":[{"role":"user","content":"Xin chào vMaaS"}]}'
AI Platform Playground

애플리케이션에 통합하기 전에 모델을 테스트합니다.

  • 지연 시간, 정확도, 비용 및 지원 능력을 기준으로 다양한 모델을 비교합니다.
  • 대화형 테스트 요청을 보내고, production에 배포하기 전에 출력 결과를 평가합니다.
  • temperature, max tokens, top_p 같은 매개변수를 조정하여 각 use case에 맞는 최적의 구성을 찾습니다.
API로 구축

OpenAI 호환 API, SDK 또는 cURL로 빠르게 통합합니다.

Playground에서 테스트한 후, 기업은 HiTechCloud vMaaS를 통해 모델에 액세스하여 추가 통합 없이 모델 추론을 실행할 수 있습니다.

Step 01

테스트

AI Platform Playground에서 모델을 살펴보고 실제 결과에 따라 적절한 모델을 선택합니다.

Step 02

API key 생성

액세스 키 생성, 애플리케이션 권한 설정 및 환경별 사용량 제한.

Step 03

SDK 연동

REST API, Python, JavaScript SDK로 연결하거나 터미널에서 cURL로 직접 호출할 수 있습니다.

Step 04

Usage 추적

token 소비, 지연 시간, API 오류 및 비용을 실시간으로 모니터링합니다.

Usage 추적

API Key, token 및 AI 비용을 실시간으로 제어합니다.

usage 관리 페이지는 기술 및 재무 팀이 상세 사용량, 소비된 token, 리소스 보고서 및 서비스 결제/크레딧을 면밀히 추적할 수 있도록 지원합니다.

애플리케이션별 API Key
요금제별 Token 사용량
기간별 usage 보고서
서비스 결제/신용 관리
FAQ

HiTechCloud vMaaS에 대한 자주 묻는 질문

vMaaS란 무엇입니까?

vMaaS는 OpenAI API 호환 표준을 바탕으로 언어, 이미지, 오디오 및 embedding 처리를 지원하는 AI 모델을 API 형태로 제공하는 서비스입니다.

기업이 GPU/NPU 또는 MLOps 팀에 투자해야 합니까?

아니요. 기업은 AI 인프라에 투자하거나 전담 MLOps 팀을 구축할 필요 없이 API를 통해 AI를 애플리케이션, 제품 또는 프로세스에 통합할 수 있습니다.

서비스가 OpenAI API와 호환됩니까?

예. vMaaS는 OpenAI 호환 API 표준을 지원하여 엔지니어링 팀이 기존 애플리케이션, SDK 또는 시스템과 빠르게 통합할 수 있습니다.

vMaaS는 어떤 사용 사례에 적합한가요?

본 서비스는 고객지원 Chatbot, 지식 기반 Q&A, 문서 요약, 프로그래밍 어시스턴트, 마케팅 콘텐츠 생성, RAG 및 AI 기반 프로세스 자동화에 적합합니다.

분당 토큰 또는 분당 API 요청 제한이 있습니까?

vMaaS 계약은 분당 token 또는 API 요청 제한이 없으며, Input/Output token을 구분하여 청구하지 않습니다. Content length 및 최대 출력은 8K입니다.

고객 데이터가 제3자 모델 학습에 사용됩니까?

아니요. 고객 데이터는 제3자 모델 학습에 사용되지 않으며, 시스템은 HiTechCloud의 베트남 인프라에서 운영되도록 설계됩니다.

BYOM을 지원합니까?

예. Customize 플랜은 맞춤형 구성 자문 및 특정 요구사항이 있는 조직을 위한 BYOM (Bring Your Own Model) 배포 지원을 포함합니다.

결제 방식은 어떻게 됩니까?

최소 이용 기간은 1개월입니다. 결제 방식은 선불입니다. 가격표에는 VAT가 포함되지 않습니다.

vMaaS 배포 준비 완료?

AI 모델을 HiTechCloud와 함께 애플리케이션에 통합합니다.

HiTechCloud는 기업을 위한 모델 선택, API 설계, 비용 통제 및 production 규모의 AI 배포를 지원합니다.