Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāđāļāļĒ āđāļĨāļ·āļāļāļŠāđāļāļāļāļĒāđāļēāļāđāļĢāđāļŦāđāļāļļāđāļĄāļāđāļē
āļāļģāđāļĄāļāļāļāđāļāļĢāđāļāļĒāļĒāļļāļāļāļīāļāļīāļāļąāļĨāļāđāļāļāđāļĢāļīāđāļĄāļāļīāļāđāļĢāļ·āđāļāļ Server AI
āđāļāļĒāļļāļāļāļĩāđ AI, Machine Learning āđāļĨāļ° Data Analytics āļāļĨāļēāļĒāđāļāđāļāļŦāļąāļ§āđāļāļāļāļāļāļēāļĢāđāļāđāļāļāļąāļāļāļēāļāļāļļāļĢāļāļīāļ āļāļāļāđāļāļĢāđāļāļĒāļāļģāļāļ§āļāļĄāļēāļāđāļĢāļīāđāļĄāļĄāļāļāļŦāļē Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢ āđāļāļ·āđāļāļĢāļāļāļĢāļąāļāļāļēāļāļāđāļēāļ AI, āļ§āļīāđāļāļĢāļēāļ°āļŦāđāļāđāļāļĄāļđāļĨ, āļĢāļ°āļāļāđāļāļ°āļāļģ (Recommendation), Chatbot āđāļĨāļ°āļāļēāļāļāđāļēāļ Automation āļāđāļēāļāđ āļ āļēāļĒāđāļāļāļāļāđāļāļĢ
āđāļāđāļāļģāļāļēāļĄāļŠāļģāļāļąāļāļāļ·āļ:
âāļāļ°āđāļĨāļ·āļāļāļŠāđāļāļ Server AI āļāļĒāđāļēāļāđāļĢāđāļŦāđāļāļļāđāļĄāļāđāļē āļāļāļāđāļāļāļĒāđāļāļēāļ āđāļĨāļ°āđāļĄāđāđāļāļĨāļ·āļāļāļāļāļāļĢāļ°āļĄāļēāļāđāļāļīāļāļāļģāđāļāđāļ?â
āļāļāļāļ§āļēāļĄāļāļĩāđāļāļ°āļāđāļ§āļĒāđāļŦāđāļāļđāđāļāļĢāļīāļŦāļēāļĢāļāđāļēāļĒāđāļāļāļĩ, System Engineer, Data Team āđāļĨāļ°āļāļđāđāļāļđāđāļĨāļĢāļ°āļāļ āļŠāļēāļĄāļēāļĢāļāļ§āļēāļāđāļāļāđāļĨāļ·āļāļāļŠāđāļāļ Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāđāļāļĒ āđāļāđāļāļĒāđāļēāļāļĄāļąāđāļāđāļāđāļĨāļ°āļāļļāđāļĄāļāđāļē āļāļĢāđāļāļĄāđāļāļ§āļāļēāļāđāļāļ·āđāļāļāļāđāļāđāļāļāļēāļĢāđāļāļĢāļĩāļĒāļĄāļĢāļ°āļāļāđāļŦāđāļāļĢāđāļāļĄāđāļāđāļāļēāļāļāļĢāļīāļ
1. Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāđāļāļĒāļāļ·āļāļāļ°āđāļĢ āđāļĨāļ°āđāļŦāļĄāļēāļ°āļāļąāļāļāļēāļāđāļāļāđāļŦāļ
Server AI āļāļ·āļāđāļāļīāļĢāđāļāđāļ§āļāļĢāđāļāļĩāđāļāļđāļāļāļāļāđāļāļāļŦāļĢāļ·āļāđāļĨāļ·āļāļāļŠāđāļāļāļĄāļēāđāļāļāļēāļ°āđāļāļ·āđāļāļĢāļāļāļĢāļąāļāļāļēāļāļāđāļēāļ Artificial Intelligence (AI), Machine Learning (ML) āđāļĨāļ° Deep Learning āļĢāļ§āļĄāļāļķāļāļāļēāļāļāļĩāđāđāļāđāļāļēāļĢāļāļĢāļ°āļĄāļ§āļĨāļāļĨāđāļāļāļāļāļēāļāļŦāļĢāļ·āļāļāļģāļāļēāļāļāļąāļāļāđāļāļĄāļđāļĨāļāļģāļāļ§āļāļĄāļēāļ
āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāđāļāļĒ Server AI āļĄāļąāļāļāļđāļāđāļāđāđāļāļāļēāļāļāđāļēāļāđ āđāļāđāļ
- āļĢāļ°āļāļ Chatbot āļāļāļāđāļāļĢ āļāļĩāđāļāļāļāļāļģāļāļēāļĄāļĨāļđāļāļāđāļēāļāļąāļāđāļāļĄāļąāļāļī
- āļĢāļ°āļāļ āļ§āļīāđāļāļĢāļēāļ°āļŦāđāļāđāļāļĄāļđāļĨāļĨāļđāļāļāđāļē (Customer Analytics) āđāļāļ·āđāļāļāļģāļāļēāļĢāļāļĨāļēāļāđāļāļ Personalization
- āļĢāļ°āļāļ Recommendation āđāļāđāļ āđāļāļ°āļāļģāļŠāļīāļāļāđāļē āļāļĢāļīāļāļēāļĢ āļŦāļĢāļ·āļāđāļāļĢāđāļĄāļāļąāđāļāļāļĩāđāđāļŦāļĄāļēāļ°āļāļąāļāļĨāļđāļāļāđāļēāđāļāđāļĨāļ°āļĢāļēāļĒ
- āļāļēāļ Image/Video Processing āđāļāđāļ āļāļĢāļ§āļāļāļąāļāđāļāļŦāļāđāļē, āļāđāļēāļĒāļāļ°āđāļāļĩāļĒāļ, āļ§āļīāđāļāļĢāļēāļ°āļŦāđāļ āļēāļāļāļēāļāļāļĨāđāļāļāļ§āļāļāļĢāļāļīāļ
- āļĢāļ°āļāļ RPA / Automation āļāļĩāđāļĄāļĩ AI āļāđāļ§āļĒāļāļąāļāļŠāļīāļāđāļāđāļāļāļĢāļ°āļāļ§āļāļāļēāļĢāļāļļāļĢāļāļīāļ
āļāļēāļĢāđāļĨāļ·āļāļ Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāđāļāļĒ āļāļķāļāļāđāļāļāļāļīāļāļāļąāļāļāļĢāļ°āđāļ āļāļāļēāļ āđāļĨāļ°āļāļĢāļīāļĄāļēāļāļāļēāļĢāđāļāđāļāļēāļāļāļĢāļīāļ āđāļāļ·āđāļāļāļĩāđāļāļ°āđāļĄāđāļāļ·āđāļāļŠāđāļāļāđāļāļīāļāļāļģāđāļāđāļ āļŦāļĢāļ·āļāđāļĨāļ·āļāļāļŠāđāļāļāļāđāļģāđāļāļāļāļĢāļ°āļāļāļāļģāļāļēāļāļāđāļē
2. āļ§āļīāđāļāļĢāļēāļ°āļŦāđāļāļ§āļēāļĄāļāđāļāļāļāļēāļĢāļāļāļāļāļāļāđāļāļĢāļāđāļāļāđāļĨāļ·āļāļāļŠāđāļāļ
āļāđāļāļāļāļ°āđāļāļāļķāļāļāļēāļĢāđāļĨāļ·āļāļ CPU āļŦāļĢāļ·āļ GPU āļŠāļīāđāļāļŠāļģāļāļąāļāļāļĩāđāļŠāļļāļāļāļ·āļ āļāļēāļĢāļ§āļīāđāļāļĢāļēāļ°āļŦāđāļāļ§āļēāļĄāļāđāļāļāļāļēāļĢāđāļāđāļāļēāļ (Requirement) āļāļāļāļāļāļāđāļāļĢāđāļŦāđāļāļąāļāđāļāļ
āļāļģāļāļēāļĄāļŦāļĨāļąāļāļāļĩāđāļāļ§āļĢāļāļēāļĄāļāļąāļ§āđāļāļāļāđāļāļ
āļāļāļāđāļāļĢāļĄāļĩ āļāļēāļ AI āļāļĢāļ°āđāļ āļāđāļŦāļ āđāļāđāļāļŦāļĨāļąāļ?
- NLP / Chatbot / Text Processing
- Computer Vision / Image / Video
- Predictive Analytics / Data Science
āļāļĢāļīāļĄāļēāļāļāļēāļĢāđāļāđāļāļēāļāđāļāđāļāļāļĒāđāļēāļāđāļĢ?
- āđāļāđāļāļēāļāļāđāļāđāļāļ·āđāļāļ 24/7 āļŦāļĢāļ·āļāđāļāļāļēāļ°āļāđāļ§āļāđāļ§āļĨāļē
- āļĄāļĩāļāļđāđāđāļāđāļāļĢāđāļāļĄāļāļąāļāļāļĩāđāļāļ (Concurrent Users)
- āļāļķāļāļāđāļāļĄāļđāļĨāļāļēāļāļĢāļ°āļāļāļ āļēāļĒāđāļāļāļĩāđāļĢāļ°āļāļ
āđāļāđāļāļāļēāļ Training Model āļŦāļĢāļ·āļ Inference/Deployment
- āļāļēāļ Training āļāđāļāļāļāļēāļĢ GPU āđāļĢāļ āđāļĨāļ°āđāļ§āļĨāļēāļāļĢāļ°āļĄāļ§āļĨāļāļĨāđāļĢāđāļ§
- āļāļēāļ Inference āļāđāļāļāļāļēāļĢāđāļŠāļāļĩāļĒāļĢāļ āļēāļ āđāļĨāļ°āļĢāļāļāļĢāļąāļāļāļģāļāļ§āļ Request āļŠāļđāļ
āļāđāļāļāļāļēāļĢ āļāļīāļāļāļąāđāļāđāļāļĻāļđāļāļĒāđāļāđāļāļĄāļđāļĨāļāļāļāļāļāļāđāļāļĢ (On-Premise) āļŦāļĢāļ·āļāđāļāļ·āđāļāļĄāļāļąāļ Cloud
āđāļĄāļ·āđāļāļĄāļĩāļāļģāļāļāļāđāļŦāļĨāđāļēāļāļĩāđ āļāļēāļĢāđāļĨāļ·āļāļāļŠāđāļāļ Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢ āļāļ°āđāļĄāđāļāļĒāļģāļāļķāđāļāđāļĨāļ°āļĨāļāļāļ§āļēāļĄāđāļŠāļĩāđāļĒāļāđāļāļāļēāļĢāļĨāļāļāļļāļāļāļīāļāļāļĢāļ°āđāļ āļ
3. āđāļĨāļ·āļāļ CPU, GPU, RAM āļāļĒāđāļēāļāđāļĢāđāļŦāđāđāļŦāļĄāļēāļ°āļāļąāļāļāļēāļ AI
āļŦāļąāļ§āđāļāļŠāļģāļāļąāļāļāļāļāļāļēāļĢāđāļĨāļ·āļāļāļŠāđāļāļ Server AI āļāļ·āļāļāļēāļĢāļāļąāļāļŠāļĄāļāļļāļĨāļĢāļ°āļŦāļ§āđāļēāļ CPU, GPU āđāļĨāļ° RAM āđāļŦāđāđāļŦāļĄāļēāļ°āļāļąāļāļāļĢāļ°āđāļ āļāļāļēāļāđāļĨāļ°āļāļāļāļĢāļ°āļĄāļēāļ
3.1 CPU â āļŠāļĄāļāļāļŦāļĨāļąāļāļāļāļāļĢāļ°āļāļ
āļŠāļģāļŦāļĢāļąāļ Server AI āđāļāļāļāļāđāļāļĢāđāļāļĒ āļŠāđāļ§āļāđāļŦāļāđāļāļ°āļāļīāļĒāļĄāđāļāđ
- CPU āļāļĢāļ°āļāļđāļĨ Intel Xeon āļŦāļĢāļ·āļ AMD EPYC
- āļāļ§āļĢāđāļāđāļāļāļģāļāļ§āļ Core āļĄāļēāļāļāļ§āđāļēāļāļ§āļēāļĄāđāļĢāđāļ§ Clock āđāļāļĩāļĒāļāļāļĒāđāļēāļāđāļāļĩāļĒāļ§
- āļŦāļēāļāļĢāļ°āļāļāļĄāļĩāļŦāļĨāļēāļĒ Service āđāļĨāļ°āļĢāļāļāļĢāļąāļāļāļđāđāđāļāđāļāļģāļāļ§āļāļĄāļēāļ āļāļ§āļĢāđāļĨāļ·āļāļ CPU āļāļĩāđāļĄāļĩ āļŦāļĨāļēāļĒ Core / Thread āđāļāļ·āđāļāļĢāļāļāļĢāļąāļāļāļēāļāđāļāļ Multi-thread āđāļĨāļ° Containers
āļāļģāđāļāļ°āļāļģāđāļāļ·āđāļāļāļāđāļ:
- āļāļēāļ AI āļāļĩāđāđāļāđāļ Inference āđāļĨāļ° API Response āļāļģāļāļ§āļāļĄāļēāļ
- āđāļĨāļ·āļāļ CPU 12â32 Core āļāļķāđāļāđāļ āļāļķāđāļāļāļąāļāļāļāļēāļāļāļēāļ
- āļāļēāļ Analytics āđāļĨāļ° BI āļĢāđāļ§āļĄāļāļąāļ AI
- CPU 16â64 Core āļāļ°āļāđāļ§āļĒāļĢāļāļāļĢāļąāļāļāļēāļĢāļ§āļīāđāļāļĢāļēāļ°āļŦāđāļŦāļĨāļēāļĒāļāļļāļāļāļĢāđāļāļĄāļāļąāļ
3.2 GPU â āļŦāļąāļ§āđāļāļāļāļāļāļēāļ AI/Deep Learning
āļŦāļēāļāļāļāļāđāļāļĢāļĄāļĩāļāļēāļĢāļāļķāļāļāļāđāļĄāđāļāļĨ (Model Training) āļŦāļĢāļ·āļāļāļģāļāļēāļāļāđāļēāļ Deep Learning āļāļĢāļīāļāļāļąāļ āļāļēāļĢāļĄāļĩ GPU āļŠāļģāļŦāļĢāļąāļ AI āđāļāđāļāđāļĢāļ·āđāļāļāļāļģāđāļāđāļ
āļāļąāļāļāļąāļĒāđāļāļāļēāļĢāđāļĨāļ·āļāļ:
- āđāļĨāļ·āļāļ GPU āļāļĩāđāđāļāđāļāļĢāļļāđāļ Data Center / Server Grade āđāļāđāļ NVIDIA Tesla / A-series / H-series āļĄāļēāļāļāļ§āđāļēāļĢāļļāđāļ Gaming
- āļāļīāļāļēāļĢāļāļē āļāļģāļāļ§āļ CUDA Cores, VRAM (āļŦāļāđāļ§āļĒāļāļ§āļēāļĄāļāļģāļāļāļ GPU) āđāļĨāļ°āļĢāļāļāļĢāļąāļ Framework āļāļĩāđāđāļāđ āđāļāđāļ PyTorch, TensorFlow
- āļŦāļēāļāđāļāđāļāļāļēāļ Inference āļāļģāļāļ§āļāļĄāļēāļ āļāļēāļāđāļāđ GPU āļĢāļ°āļāļąāļāļāļĨāļēāļāļŦāļĨāļēāļāļŦāļĨāļēāļĒāļāļąāļ§ āļĄāļēāļāļāļ§āđāļēāļāļ·āđāļ GPU āļāļąāļ§āđāļāļĩāļĒāļ§āļāļĩāđāļĢāļēāļāļēāđāļāļāļĄāļēāļ
āļāļģāđāļāļ°āļāļģāđāļāļ·āđāļāļāļāđāļ:
- āļāļēāļāļāļāļĨāļāļ AI / PoC āđāļāļāļāļāđāļāļĢ
- GPU āļĢāļ°āļāļąāļāļāļĨāļēāļ 1â2 āđāļ āļāļĢāđāļāļĄ VRAM 16â24GB
- āļāļēāļ Training Model āļāļāļēāļāđāļŦāļāđ āļŦāļĢāļ·āļāļŦāļĨāļēāļĒāļāļĩāļĄāđāļāđāļāļēāļāļĢāđāļ§āļĄāļāļąāļ
- GPU Data Center 2â4 āđāļ āļāļķāđāļāđāļ āļāļĢāđāļāļĄ VRAM 24â80GB
3.3 RAM â āļŦāļāđāļ§āļĒāļāļ§āļēāļĄāļāļģāļāļĩāđāđāļĄāđāļāļ§āļĢāļāļĢāļ°āļŦāļĒāļąāļāđāļāļīāļāđāļ
RAM āđāļāđāļāļāļąāļ§āļāđāļ§āļĒāđāļŦāđ Server AI āļāļģāļāļēāļāđāļāđāļĨāļ·āđāļ āđāļĄāđāļāļīāļāļāļąāļāđāļ§āļĨāļēāđāļŦāļĨāļāļāđāļāļĄāļđāļĨāļŦāļĢāļ·āļāļĢāļąāļāļŦāļĨāļēāļĒ Service āļāļĢāđāļāļĄāļāļąāļ
āļāļģāđāļāļ°āļāļģāđāļāļ·āđāļāļāļāđāļ:
- āļāļēāļ AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāļāļāļēāļāđāļĨāđāļâāļāļĨāļēāļ
- RAM āđāļĢāļīāđāļĄāļāđāļ 64â128GB
- āļāļāļāđāļāļĢāļāļĩāđāļĄāļĩ Data Lake, Analytics āđāļĨāļ°āļŦāļĨāļēāļĒ Container/VM
- āļāļīāļāļēāļĢāļāļē RAM 256GB āļāļķāđāļāđāļ
4. Storage, Network āđāļĨāļ°āļāļ§āļēāļĄāļāļĨāļāļāļ āļąāļĒ â āļŠāđāļ§āļāļŠāļģāļāļąāļāļāļĩāđāļĄāļąāļāļĄāļāļāļāđāļēāļĄ
āļŦāļĨāļēāļĒāļāļāļāđāļāļĢāđāļāļĒāļāļēāļāđāļāļāļąāļŠāđāļāļāļĩāđ CPU/GPU āđāļāđāļāļĢāļīāļāđ āđāļĨāđāļ§ Storage, Network āđāļĨāļ° Security āļĄāļĩāļāļĨāļāđāļāļāļĢāļ°āļŠāļīāļāļāļīāļ āļēāļāļāļāļ Server AI āļāļĒāđāļēāļāļĄāļēāļ
4.1 Storage â āđāļĄāđāđāļāđāđāļāđāļāļ§āļēāļĄāļāļļ āđāļāđāļāļ·āļāļāļ§āļēāļĄāđāļĢāđāļ§
āđāļāļ°āļāļģāđāļŦāđāđāļāđ:
- SSD āļŦāļĢāļ·āļ NVMe āđāļāđāļ āļĢāļ°āļāļāļŦāļĨāļąāļ (OS + Application)
- āđāļĒāļ Storage āļŠāļģāļŦāļĢāļąāļ āļāļēāļāļāđāļāļĄāļđāļĨāđāļĨāļ°āļāļļāļāļāđāļāļĄāļđāļĨ AI (Dataset) āđāļāļ·āđāļāđāļāļīāđāļĄāļāļ§āļēāļĄāđāļĢāđāļ§āđāļāļāļēāļĢāļāđāļēāļ/āđāļāļĩāļĒāļ
- āļŦāļēāļāļĄāļĩāļāđāļāļĄāļđāļĨāļāļģāļāļ§āļāļĄāļēāļ āđāļŦāđāļāļīāļāļēāļĢāļāļēāļĢāļ°āļāļ Storage āđāļāļ SAN, NAS āļŦāļĢāļ·āļ Object Storage āļāļ§āļāļāļđāđāļāļąāļ
4.2 Network â āļĒāļīāđāļ AI āđāļāļ·āđāļāļĄāļŦāļĨāļēāļĒāļĢāļ°āļāļ āļĒāļīāđāļāļāđāļāļāđāļĢāļāđāļĨāļ°āđāļŠāļāļĩāļĒāļĢ
- āđāļāđāļāļēāļĢāđāļāļ·āđāļāļĄāļāđāļ Network āļ āļēāļĒāđāļ Data Center āļāļĩāđāļĄāļĩāļāļ§āļēāļĄāđāļĢāđāļ§āļāļĒāđāļēāļāļāđāļāļĒ 10GbE āļāļķāđāļāđāļ
- āļ§āļēāļāđāļāļāļāļēāļĢāđāļāļ·āđāļāļĄāļāđāļāļĢāļ°āļŦāļ§āđāļēāļ Server AI, Database Server, Application Server āđāļĨāļ°āļĢāļ°āļāļāļ āļēāļĒāđāļāļāļ·āđāļāđ āđāļŦāđāļĄāļĩ Latency āļāđāļģ
4.3 Security â āļāļāļāđāļāļāļāđāļāļĄāļđāļĨāđāļĨāļ°āđāļĄāđāļāļĨāļāļāļāļāļāļāđāļāļĢ
āļāļēāļĢāđāļāđāļāļēāļ Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāđāļāļĒ āļĄāļąāļāđāļāļĩāđāļĒāļ§āļāđāļāļāļāļąāļāļāđāļāļĄāļđāļĨāļĨāļđāļāļāđāļē āļāđāļāļĄāļđāļĨāļāļļāļĢāļāļīāļ āđāļĨāļ°āđāļĄāđāļāļĨāļāļĩāđāđāļāđāļāļāļĢāļąāļāļĒāđāļŠāļīāļāļāļēāļāļāļąāļāļāļē
āļāļ§āļĢāđāļŦāđāļāļ§āļēāļĄāļŠāļģāļāļąāļāļāļąāļ:
- āļĢāļ°āļāļ Firewall, Access Control āđāļĨāļ°āļāļēāļĢāđāļĒāļ Network Segment
- āļāļēāļĢāđāļāđāļēāļĢāļŦāļąāļŠāļāđāļāļĄāļđāļĨāļŠāļģāļāļąāļāļāļąāđāļāļāļāļ°āļāļąāļ (At-rest) āđāļĨāļ°āļĢāļ°āļŦāļ§āđāļēāļāļŠāđāļāļāđāļāļĄāļđāļĨ (In-transit)
- āļāļēāļĢāļāļģāļŦāļāļāļŠāļīāļāļāļīāđāļāļēāļĢāđāļāđāļēāļāļķāļ Server AI āļāļēāļĄāļāļāļāļēāļ (Role-based Access)
5. āđāļĨāļ·āļāļāđāļāđ Server AI āđāļāļ On-Premise vs Cloud āđāļāļāđāļŦāļāļāļļāđāļĄāļāļ§āđāļē
āļāļāļāđāļāļĢāđāļāļĒāļāļģāļāļ§āļāļĄāļēāļāļĄāļĩāļāļģāļāļēāļĄāļ§āđāļē āļāļ§āļĢāđāļĨāļ·āļāļ Server AI āđāļāļāļāļ·āđāļāđāļāļĢāļ·āđāļāļāđāļāļ (On-Premise) āļŦāļĢāļ·āļāđāļāđ Cloud AI / GPU Cloud āđāļāļāļāđāļēāļĒāļāļēāļĄāļāļēāļĢāđāļāđāļāļēāļ (Pay-per-use)
āļāđāļāļāļĩāļāļāļ On-Premise Server AI
- āļāļ§āļāļāļļāļĄāļāđāļāļĄāļđāļĨāđāļāđāđāļāđāļĄāļāļĩāđ āđāļŦāļĄāļēāļ°āļāļąāļāļāđāļāļĄāļđāļĨāļāļĩāđāļāđāļāļāļāļēāļĢāļāļ§āļēāļĄāđāļāđāļāļŠāđāļ§āļāļāļąāļ§āļŠāļđāļ
- āļĨāļāļāļļāļāļāļĢāļąāđāļāđāļāļĩāļĒāļ§ āđāļĨāļ°āļāļĢāļīāļŦāļēāļĢāļāđāļēāđāļāđāļāđāļēāļĒāļĢāļ°āļĒāļ°āļĒāļēāļ§āđāļāđ
- āļāļĢāļąāļāđāļāđāļāļŠāđāļāļāđāļŦāđāļāļĢāļāļāļąāļāļĢāļ°āļāļāļ āļēāļĒāđāļāļāļāļāđāļāļĢāđāļāđāļāļĩ
āļāđāļāļāļĩāļāļāļ Cloud AI / GPU Cloud
- āđāļĢāļīāđāļĄāļāđāļāđāļāđāļāļēāļāđāļāđāđāļĢāđāļ§ āđāļĄāđāļāđāļāļāļĨāļāļāļļāļ Hardware āđāļĢāļīāđāļĄāļāđāļāļŠāļđāļ
- āļāļĢāļąāļāđāļāļīāđāļĄ/āļĨāļāļāļĢāļąāļāļĒāļēāļāļĢāđāļāđāļāļēāļĄāļāļēāļĢāđāļāđāļāļēāļāļāļĢāļīāļ
- āđāļŦāļĄāļēāļ°āļāļąāļāļāļēāļāļāļāļĨāļāļ, PoC āļŦāļĢāļ·āļāđāļāļĢāļāļāļēāļĢāļāļĩāđāļĄāļĩāļĢāļ°āļĒāļ°āđāļ§āļĨāļēāļāļģāļāļąāļ
āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāđāļāļĒāļāļĩāđāđāļĢāļīāđāļĄāļāđāļāļāļāļĨāļāļāđāļāđ AI āļāļēāļāđāļĢāļīāđāļĄāļāļēāļ Cloud āđāļĨāđāļ§āļāđāļāļĒāļ§āļēāļāđāļāļ āļĨāļāļāļļāļ Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢ āđāļāļ On-Premise āđāļĄāļ·āđāļāļĄāļāļāđāļŦāđāļāļĢāļđāļāđāļāļāļāļēāļĢāđāļāđāļāļēāļāļāļąāļāđāļāļāđāļĨāļ°āļāļļāđāļĄāļāđāļēāđāļāļĢāļ°āļĒāļ°āļĒāļēāļ§
6. āđāļāļ§āļāļēāļāļāļēāļĢāđāļĨāļ·āļāļāļŠāđāļāļ Server AI āļāļĩāđāđāļŦāļĄāļēāļ°āļāļąāļāļāļāļāđāļāļĢāđāļāļĒ
āđāļāļ·āđāļāđāļŦāđāļāļēāļĢāđāļĨāļ·āļāļāļŠāđāļāļāļāļļāđāļĄāļāđāļēāļĄāļēāļāļāļķāđāļ āļŠāļēāļĄāļēāļĢāļāđāļāđāđāļāļ§āļāļīāļāļāļąāļāļāļĩāđ
āđāļāļ§āļāļīāļ âāđāļĢāļīāđāļĄāļāļēāļ Use Case āđāļĨāđāļ§āļāđāļāļĒāļāļģāļŦāļāļāļŠāđāļāļâ
- āļĢāļ°āļāļļ Use Case AI āļāļĩāđāļāļ°āđāļāđāļāļĢāļīāļ āđāļ 1â2 āļāļĩāđāļĢāļ
- āļāļĢāļ°āđāļĄāļīāļāļ§āđāļēāđāļāđāļĨāļ° Use Case āļāđāļāļāļāļēāļĢ
- āļāļĢāļīāļĄāļēāļ Request āļāđāļāļ§āļąāļ
- āļāļāļēāļāļāđāļāļĄāļđāļĨ
- āļāđāļāļ Training āļāđāļāļĒāđāļāđāđāļŦāļ
- āđāļĨāļ·āļāļāļŠāđāļāļāđāļŦāđāļĢāļāļāļĢāļąāļ Use Case āđāļŦāļĨāđāļēāļāļąāđāļāļāđāļāļ āđāļĨāđāļ§āđāļāļ·āđāļ Headroom āļŠāļģāļŦāļĢāļąāļāļāļēāļĢāļāļĒāļēāļĒāļāļąāļ§āļāļĩāļāđāļĨāđāļāļāđāļāļĒ
āđāļāļ§āļāļīāļ âBalanced Spec â CPU, GPU, RAM āđāļĨāļ° Storageâ
- āļāļĒāđāļēāļāļļāđāļĄāļāļāđāļāļāļĩāđ GPU āđāļāļĩāļĒāļāļāļĒāđāļēāļāđāļāļĩāļĒāļ§ āđāļāđāđāļŦāđ CPU, RAM āđāļĨāļ° Storage āļĄāļĩāļĢāļ°āļāļąāļāļŠāļĄāļāļļāļĨ
- āđāļĨāļ·āļāļāļŠāđāļāļāļāļĩāđāļŠāļēāļĄāļēāļĢāļ āļāļąāļāđāļāļĢāļāđāļāļīāđāļĄāđāļāļāļāļēāļāļ āđāļāđ āđāļāđāļ āđāļāļīāđāļĄ RAM, āđāļāļīāđāļĄ GPU, āđāļāļīāđāļĄ Storage
7. āļāļąāļ§āļāļĒāđāļēāļāļŠāđāļāļ Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāļāļāļēāļāđāļĨāđāļ-āļāļĨāļēāļ-āđāļŦāļāđ
āļāđāļāđāļāļāļĩāđāđāļāđāļāđāļāļ§āļāļēāļāļĢāļ°āļāļąāļāļŠāļđāļāđāļāļ·āđāļāđāļŦāđāđāļŦāđāļāļ āļēāļ (āļāļ§āļĢāļāļĢāļąāļāļāļēāļĄāļāļĢāļīāļāļāļāļĢāļīāļāļāļāļāļāļāļāđāļāļĢ)
āļāļāļāđāļāļĢāļāļāļēāļāđāļĨāđāļ â āđāļĢāļīāđāļĄāļāđāļāđāļāđ AI āļ āļēāļĒāđāļ
- CPU: 12â16 Core
- RAM: 64â128GB
- GPU: 1 āđāļ āļĢāļ°āļāļąāļāļāļĨāļēāļ VRAM 16â24GB
- Storage: SSD/NVMe 1â2TB + Storage āđāļŠāļĢāļīāļĄāļŠāļģāļŦāļĢāļąāļ Data
āđāļŦāļĄāļēāļ°āļŠāļģāļŦāļĢāļąāļ: Chatbot āļ āļēāļĒāđāļ, āļĢāļ°āļāļ Recommendation āđāļāļ·āđāļāļāļāđāļ, āļāļēāļ Analytics āļāļāļēāļāđāļĄāđāđāļŦāļāđ
āļāļāļāđāļāļĢāļāļāļēāļāļāļĨāļēāļ â āļĄāļĩāļŦāļĨāļēāļĒāļāļĩāļĄāđāļāđ AI āļĢāđāļ§āļĄāļāļąāļ
- CPU: 24â32 Core
- RAM: 128â256GB
- GPU: 2â3 āđāļ Data Center Grade
- Storage: NVMe āļŠāļģāļŦāļĢāļąāļāļĢāļ°āļāļāļŦāļĨāļąāļ + Storage āļŠāļģāļŦāļĢāļąāļ Data āļŦāļĨāļēāļĒ TB
āđāļŦāļĄāļēāļ°āļŠāļģāļŦāļĢāļąāļ: Training Model āđāļāļāļēāļ°āļāļēāļ, āļĢāļ°āļāļ AI āļāļĩāđāļĢāļāļāļĢāļąāļāļĨāļđāļāļāđāļēāļāļģāļāļ§āļāļĄāļēāļ, BI + Analytics
āļāļāļāđāļāļĢāļāļāļēāļāđāļŦāļāđ â āđāļāđ AI āđāļāđāļāļŠāđāļ§āļāļŠāļģāļāļąāļāļāļāļāļāļļāļĢāļāļīāļ
- CPU: 48â64 Core āļāļķāđāļāđāļ
- RAM: 256â512GB āļŦāļĢāļ·āļāļĄāļēāļāļāļ§āđāļē
- GPU: 4 āđāļāļāļķāđāļāđāļ Data Center / AI GPU
- Storage: āļĢāļ°āļāļ Storage āđāļĒāļāđāļāļ SAN/NAS/Object Storage āļāļĢāđāļāļĄāļāļ§āļēāļĄāđāļĢāđāļ§āļŠāļđāļ
āđāļŦāļĄāļēāļ°āļŠāļģāļŦāļĢāļąāļ: AI Platform āļŠāļģāļŦāļĢāļąāļāļāļąāđāļāļāļāļāđāļāļĢ, āļāļēāļ Deep Learning āļāļāļēāļāđāļŦāļāđ, āļĢāļ°āļāļ Recommendation āđāļĨāļ° Analytics āđāļāļ Real-time
8. āļāļąāļāļāļąāļĒāļāđāļēāļāļāļāļāļĢāļ°āļĄāļēāļ āļāļēāļĢāļāļđāđāļĨ āđāļĨāļ°āļāļēāļĢāļāļĒāļēāļĒāļĢāļ°āļāļāđāļāļāļāļēāļāļ
āļāļēāļĢāđāļĨāļ·āļāļ Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāđāļāļĒ āđāļŦāđāļāļļāđāļĄāļāđāļē āđāļĄāđāđāļāđāđāļāđāļāļđāļĢāļēāļāļēāļāļ·āđāļāļāļĢāļąāđāļāđāļĢāļ āđāļāđāļāđāļāļāļāļģāļāļķāļāļāļķāļ Total Cost of Ownership (TCO) āļāđāļ§āļĒ
āļŠāļīāđāļāļāļĩāđāļāļ§āļĢāļāļģāļāļķāļāļāļķāļ
- āļāđāļēāđāļāļāđāļēāđāļĨāļ°āļĢāļ°āļāļāļĢāļ°āļāļēāļĒāļāļ§āļēāļĄāļĢāđāļāļ (Cooling)
- āļāđāļēāļāļđāđāļĨāļĢāļąāļāļĐāļēāđāļĨāļ°āļāļĢāļīāļāļēāļĢāļŦāļĨāļąāļāļāļēāļĢāļāļēāļĒ (Warranty / Support)
- āļāđāļēāđāļāđāļāđāļēāļĒāđāļāļāļēāļĢāļāļąāļāđāļāļĢāļāđāļāļāļāļēāļāļ āđāļāđāļ āđāļāļīāđāļĄ GPU āļŦāļĢāļ·āļ RAM
- āļāđāļē License āļĢāļ°āļāļāļāļāļīāļāļąāļāļīāļāļēāļĢ, Virtualization, Container Platform āđāļĨāļ° AI Framework āļāļĩāđāđāļāđ
āļŦāļēāļāļāļāļāđāļāļĢāđāļĄāđāļĄāļĩāļāļĩāļĄāđāļāļāļĩāļāļĩāđāđāļāļĩāđāļĒāļ§āļāļēāļāļāđāļēāļ Server āđāļĨāļ° AI āļĄāļēāļāļāļąāļ āļāļēāļĢāđāļĨāļ·āļāļāļāļđāđāđāļŦāđāļāļĢāļīāļāļēāļĢāļāļĩāđāļŠāļēāļĄāļēāļĢāļāļāđāļ§āļĒāļāļāļāđāļāļāļŠāđāļāļ āļāļīāļāļāļąāđāļ āđāļĨāļ°āđāļŦāđāļāļģāļāļĢāļķāļāļĐāļēāļāļĒāđāļēāļāļāđāļāđāļāļ·āđāļāļ āļāļ°āļāđāļ§āļĒāļĨāļāļāļ§āļēāļĄāđāļŠāļĩāđāļĒāļāđāļĨāļ°āļāļģāđāļŦāđāļāļēāļĢāļĨāļāļāļļāļāļāļļāđāļĄāļāđāļēāļĄāļēāļāļāļķāđāļ
9. āļŠāļĢāļļāļāđāļĨāļ° Call-to-Action: āđāļĢāļīāđāļĄāļāđāļāļ§āļēāļāđāļāļ Server AI āļāļĩāđāļāļļāđāļĄāļāđāļē
āļāļēāļĢāđāļĨāļ·āļāļ Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢāđāļāļĒ āđāļŦāđāļāļļāđāļĄāļāđāļē āđāļĄāđāļāļģāđāļāđāļāļāđāļāļāđāļĢāļīāđāļĄāļāļēāļāļŠāđāļāļāļāļĩāđāļŠāļđāļāļāļĩāđāļŠāļļāļ āđāļāđāļāđāļāļāđāļĢāļīāđāļĄāļāļēāļ āļāļ§āļēāļĄāđāļāđāļēāđāļāļāļēāļ AI āļāļāļāļāļāļāđāļāļĢ āđāļĨāđāļ§āļāđāļāļĒāļāļāļāđāļāļāļŠāđāļāļāļāļĩāđāđāļŦāļĄāļēāļ°āļŠāļĄāļāļąāđāļāđāļāđāļāđāļāļĢāļ°āļŠāļīāļāļāļīāļ āļēāļ āļāļāļāļĢāļ°āļĄāļēāļ āđāļĨāļ°āļāļēāļĢāļāļĒāļēāļĒāļāļąāļ§āđāļāļāļāļēāļāļ
āļŦāļēāļāļāļļāļāđāļāđāļāļāđāļēāļĒāđāļāļāļĩāļŦāļĢāļ·āļāļāļđāđāļāļĢāļīāļŦāļēāļĢāļāļĩāđāļāļģāļĨāļąāļāļĄāļāļāļŦāļēāđāļāļ§āļāļēāļāđāļĨāļ·āļāļāļŠāđāļāļ Server AI āļŠāļģāļŦāļĢāļąāļāļāļāļāđāļāļĢ āđāļāļ·āđāļāļĢāļāļāļĢāļąāļāļāļēāļ AI, Data Analytics āļŦāļĢāļ·āļāļĢāļ°āļāļ Chatbot āļāļāļāļāļāļāđāļāļĢ āļāļēāļĢāđāļĢāļīāđāļĄāļāđāļāļāļĢāļķāļāļĐāļēāļāļđāđāđāļāļĩāđāļĒāļ§āļāļēāļāļāđāļēāļ Server āđāļĨāļ°āđāļāļĢāļāļŠāļĢāđāļēāļāļāļ·āđāļāļāļēāļ āļāļ°āļāđāļ§āļĒāđāļŦāđāļāļēāļĢāļĨāļāļāļļāļāđāļāđāļĨāļ°āļāļĢāļąāđāļ āļāļļāđāļĄāļāđāļē āđāļĨāļ°āļāļāļāđāļāļāļĒāđāļāļļāļĢāļāļīāļāđāļāđāļāļĢāļīāļ
āļŦāļēāļāļāļļāļāļāđāļāļāļāļēāļĢāļāļģāđāļāļ°āļāļģāđāļāļāļēāļĢāđāļĨāļ·āļāļāļŠāđāļāļ Server AI āļāļĩāđāđāļŦāļĄāļēāļ°āļāļąāļāļāļēāļāđāļĨāļ°āļāļāļāļĢāļ°āļĄāļēāļāļāļāļāļāļāļāđāļāļĢ āļŠāļēāļĄāļēāļĢāļāļāļīāļāļāđāļāļāļđāđāđāļāļĩāđāļĒāļ§āļāļēāļāļāļĩāđāļāļĢāđāļāļĄāļāđāļ§āļĒāļāļāļāđāļāļāđāļāļĨāļđāļāļąāļ āļāļąāđāļāđāļāđāļāļēāļĢāļ§āļīāđāļāļĢāļēāļ°āļŦāđ Requirement āđāļāļāļāļāļķāļāļāļēāļĢāļ§āļēāļāļĢāļ°āļāļāđāļĨāļ°āļāļđāđāļĨāļŦāļĨāļąāļāļāļēāļĢāļāļīāļāļāļąāđāļ āđāļāļ·āđāļāđāļŦāđāļāļāļāđāļāļĢāļāļāļāļāļļāļāļāļĢāđāļāļĄāļāđāļēāļ§āļŠāļđāđāļĒāļļāļ AI āļāļĒāđāļēāļāļĄāļąāđāļāđāļ
āļāļīāļāļāđāļāđāļĢāļēāļāđāļēāļāđāļ§āđāļāđāļāļāđāđāļĨāļ°āļŠāļāļāļāļēāļĄāļŠāļīāļāļāđāļēāđāļāđāđāļĨāļĒ
- āļŠāļāđāļāļŠāļāļāļāļēāļĄāļāđāļāļĄāļđāļĨāđāļāļīāđāļĄāđāļāļīāļĄāļŦāļĢāļ·āļāļāļ·āđāļāļāļļāļāļāļāđ IT āļāļĨāļīāļāđāļĨāļĒ
- āļāļ·āđāļāļŠāļīāļāļāđāļēāļāđāļēāļ Application āļĢāļąāļāļŠāđāļ§āļāļĨāļāđāļāļīāđāļĄÂ āļāļĨāļīāļāđāļĨāļĒ
- LINE: @2beshop
- āđāļāļĢ 02-1186767