āļāļēāļĢāļˆāļ°āđ€āļĨāļ·āļ­āļ AI Server āļŠāļģāļŦāļĢāļąāļšāļ‡āļēāļ™ Generative AI āđƒāļŦāđ‰āļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆāđ„āļ”āđ‰āļ”āļĩ āļ•āđ‰āļ­āļ‡āđ‚āļŸāļāļąāļŠāļ—āļĩāđˆāļŠāđ€āļ›āļ GPU, VRAM, RAM, Storage āđāļĨāļ° Network āđƒāļŦāđ‰āļŠāļ­āļ”āļ„āļĨāđ‰āļ­āļ‡āļāļąāļšāļ‚āļ™āļēāļ”āđ‚āļĄāđ€āļ”āļĨāđāļĨāļ°āļĢāļđāļ›āđāļšāļšāļ‡āļēāļ™ (Training / Inference) āļžāļĢāđ‰āļ­āļĄāļĢāļ­āļ‡āļĢāļąāļšāļāļēāļĢāļ‚āļĒāļēāļĒāđƒāļ™āļ­āļ™āļēāļ„āļ•


1. AI Server āļŠāļģāļŦāļĢāļąāļš Generative AI āļ„āļ·āļ­āļ­āļ°āđ„āļĢ āđāļĨāļ°āļŠāļģāļ„āļąāļāļ­āļĒāđˆāļēāļ‡āđ„āļĢ

AI Server āļ„āļ·āļ­āđ€āļ‹āļīāļĢāđŒāļŸāđ€āļ§āļ­āļĢāđŒāļ—āļĩāđˆāļ­āļ­āļāđāļšāļšāļĄāļēāđ€āļžāļ·āđˆāļ­āļĢāļ­āļ‡āļĢāļąāļšāļ‡āļēāļ™āļ›āļąāļāļāļēāļ›āļĢāļ°āļ”āļīāļĐāļāđŒāđ‚āļ”āļĒāđ€āļ‰āļžāļēāļ° āđ€āļ™āđ‰āļ™āđƒāļŠāđ‰ GPU āļ›āļĢāļ°āļŠāļīāļ—āļ˜āļīāļ āļēāļžāļŠāļđāļ‡āļŦāļĨāļēāļĒāļ•āļąāļ§ āđāļ—āļ™āļāļēāļĢāļžāļķāđˆāļ‡ CPU āđ€āļžāļĩāļĒāļ‡āļ­āļĒāđˆāļēāļ‡āđ€āļ”āļĩāļĒāļ§ āđ€āļžāļ·āđˆāļ­āđ€āļĢāđˆāļ‡āļāļēāļĢāļ›āļĢāļ°āļĄāļ§āļĨāļœāļĨāļ‚āļ­āļ‡āļ‡āļēāļ™ AI āļ—āļĩāđˆāđƒāļŠāđ‰āļāļēāļĢāļ„āļģāļ™āļ§āļ“āļˆāļģāļ™āļ§āļ™āļĄāļēāļ āđ€āļŠāđˆāļ™ Deep Learning, Large Language Model (LLM) āđāļĨāļ°āļ‡āļēāļ™ Generative AI āļ­āļ·āđˆāļ™ āđ†

āđƒāļ™āļĄāļļāļĄāļ‚āļ­āļ‡āļ­āļ‡āļ„āđŒāļāļĢāļ—āļĩāđˆāļ•āđ‰āļ­āļ‡āļāļēāļĢāļĢāļąāļ™ āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆ (Large Model) āđ€āļŠāđˆāļ™ LLM āļ‚āļ™āļēāļ”āļŦāļĨāļēāļĒāļŠāļīāļšāļžāļąāļ™āļĨāđ‰āļēāļ™āļžāļēāļĢāļēāļĄāļīāđ€āļ•āļ­āļĢāđŒ āļŦāļĢāļ·āļ­āđ‚āļĄāđ€āļ”āļĨāļ āļēāļž/āļ§āļīāļ”āļĩāđ‚āļ­āļĢāļ°āļ”āļąāļšāļŠāļđāļ‡ āļāļēāļĢāļĄāļĩ AI Server āļ—āļĩāđˆāļŠāđ€āļ›āļāđ€āļŦāļĄāļēāļ°āļŠāļĄāļŦāļĄāļēāļĒāļ–āļķāļ‡:

  • āļ›āļĢāļ°āļĄāļ§āļĨāļœāļĨ āđ€āļĢāđ‡āļ§āļ‚āļķāđ‰āļ™ āđāļĨāļ°āļ•āļ­āļšāļŠāļ™āļ­āļ‡āļœāļđāđ‰āđƒāļŠāđ‰āđ„āļ”āđ‰āđāļšāļšāđ€āļĢāļĩāļĒāļĨāđ„āļ—āļĄāđŒ
  • āļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨāđ„āļ”āđ‰ āđ€āļŠāļ–āļĩāļĒāļĢ āđ„āļĄāđˆāļŦāļĨāļļāļ” āđ„āļĄāđˆāļ„āđ‰āļēāļ‡
  • āļĢāļ­āļ‡āļĢāļąāļšāļāļēāļĢ āđ€āļ—āļĢāļ™/āđ„āļŸāļ™āđŒāļˆāļđāļ™ āđ‚āļĄāđ€āļ”āļĨāļ‚āļ­āļ‡āļ­āļ‡āļ„āđŒāļāļĢāđ€āļ­āļ‡
  • āļ„āļ§āļšāļ„āļļāļĄ āļ‚āđ‰āļ­āļĄāļđāļĨāļ āļēāļĒāđƒāļ™ (Data Governance) āđ„āļ”āđ‰āļ”āļĩāļāļ§āđˆāļēāđƒāļŠāđ‰ Cloud āđ€āļžāļĩāļĒāļ‡āļ­āļĒāđˆāļēāļ‡āđ€āļ”āļĩāļĒāļ§


2. āđāļĒāļāđƒāļŦāđ‰āļ­āļ­āļ: āļ‡āļēāļ™ Training vs Inference āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆ

āđ€āļĄāļ·āđˆāļ­āļžāļđāļ”āļ–āļķāļ‡ â€œāļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆâ€ āđƒāļ™āļ‡āļēāļ™ Generative AI āđ€āļĢāļēāļĄāļąāļāļžāļđāļ”āļ–āļķāļ‡āļŠāļ­āļ‡āļāļĢāļ“āļĩāļŦāļĨāļąāļ:

  • Training / Fine-tuning

    • āđ€āļ—āļĢāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļĄāđˆ āļŦāļĢāļ·āļ­āļ›āļĢāļąāļšāļˆāļđāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆāļ”āđ‰āļ§āļĒāļ‚āđ‰āļ­āļĄāļđāļĨāļ‚āļ­āļ‡āļ­āļ‡āļ„āđŒāļāļĢ
    • āđƒāļŠāđ‰āļ—āļĢāļąāļžāļĒāļēāļāļĢāļŠāļđāļ‡āļŠāļļāļ” āļ—āļąāđ‰āļ‡ GPU, VRAM, RAM, Storage āđāļĨāļ° Network
    • āļ•āđ‰āļ­āļ‡āļāļēāļĢ GPU āļ—āļĩāđˆāļĢāļ­āļ‡āļĢāļąāļš Tensor Cores, VRAM āļŠāļđāļ‡, NVLink/NVSwitch āđ€āļžāļ·āđˆāļ­āđƒāļŦāđ‰āļ—āļģāļ‡āļēāļ™āļĢāđˆāļ§āļĄāļāļąāļ™āđ„āļ”āđ‰āđ€āļŦāļĄāļ·āļ­āļ™ â€œGPU āļĒāļąāļāļĐāđŒāđƒāļšāđ€āļ”āļĩāļĒāļ§â€
  • Inference (āļāļēāļĢāļĢāļąāļ™āđƒāļŠāđ‰āļ‡āļēāļ™āļˆāļĢāļīāļ‡)

    • āđƒāļŠāđ‰āđ‚āļĄāđ€āļ”āļĨāļ—āļĩāđˆāđ€āļ—āļĢāļ™āđāļĨāđ‰āļ§ āļĄāļēāļ•āļ­āļšāļ„āļģāļ–āļēāļĄ āļŠāļĢāđ‰āļēāļ‡āļ‚āđ‰āļ­āļ„āļ§āļēāļĄ āļŠāļĢāđ‰āļēāļ‡āļ āļēāļž āļŊāļĨāļŊ
    • āļĒāļąāļ‡āļ•āđ‰āļ­āļ‡āļāļēāļĢ GPU āđāļĢāļ‡ āđāļ•āđˆāđ‚āļ”āļĒāļ—āļąāđˆāļ§āđ„āļ›āđƒāļŠāđ‰āļ—āļĢāļąāļžāļĒāļēāļāļĢāļ™āđ‰āļ­āļĒāļāļ§āđˆāļē Training
    • āļŠāļēāļĄāļēāļĢāļ–āļ­āļ­āļāđāļšāļšāđƒāļŦāđ‰āđ€āļ›āđ‡āļ™ Cluster āļŦāļĢāļ·āļ­āđƒāļŠāđ‰ GPU āļŦāļĨāļēāļĒāđƒāļšāđ€āļžāļ·āđˆāļ­āļĢāļ­āļ‡āļĢāļąāļšāļœāļđāđ‰āđƒāļŠāđ‰āļˆāļģāļ™āļ§āļ™āļĄāļēāļ

āļāļēāļĢāđ€āļĨāļ·āļ­āļ AI Server āļŠāļģāļŦāļĢāļąāļšāļ‡āļēāļ™ Generative AI āļˆāļķāļ‡āļ„āļ§āļĢāļ•āļ­āļšāļ„āļģāļ–āļēāļĄāđƒāļŦāđ‰āļŠāļąāļ”:

  • āđ€āļ™āđ‰āļ™ āđ€āļ—āļĢāļ™āđ‚āļĄāđ€āļ”āļĨ āļŦāļĢāļ·āļ­āđ€āļ™āđ‰āļ™ āļĢāļąāļ™āđƒāļŠāđ‰āļ‡āļēāļ™ (Inference)
  • āļ‚āļ™āļēāļ”āđ‚āļĄāđ€āļ”āļĨāļ­āļĒāļđāđˆāļ—āļĩāđˆ āļāļĩāđˆ Billion Parameters (āđ€āļŠāđˆāļ™ 7B, 13B, 34B, 70B)
  • āļ•āđ‰āļ­āļ‡āļāļēāļĢāļĢāļ­āļ‡āļĢāļąāļšāļœāļđāđ‰āđƒāļŠāđ‰āļžāļĢāđ‰āļ­āļĄāļāļąāļ™āļĄāļēāļāļ™āđ‰āļ­āļĒāđāļ„āđˆāđ„āļŦāļ™
  • āļ‡āļšāļ›āļĢāļ°āļĄāļēāļ“ āđāļĨāļ°āļĢāļ°āļĒāļ°āđ€āļ§āļĨāļēāļāļēāļĢāđƒāļŠāđ‰āļ‡āļēāļ™āļ•āđˆāļ­āđ€āļ™āļ·āđˆāļ­āļ‡ (24/7 āļŦāļĢāļ·āļ­āđ€āļ›āđ‡āļ™āļŠāđˆāļ§āļ‡ āđ†)

3. āļŠāđ€āļ›āļāļŦāļĨāļąāļāļ—āļĩāđˆāļ•āđ‰āļ­āļ‡āđ‚āļŸāļāļąāļŠāđ€āļĄāļ·āđˆāļ­āđ€āļĨāļ·āļ­āļ AI Server āļŠāļģāļŦāļĢāļąāļšāđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆ

3.1 CPU āļŠāļģāļŦāļĢāļąāļš AI Server

āđāļĄāđ‰ GPU āļˆāļ°āđ€āļ›āđ‡āļ™āļžāļĢāļ°āđ€āļ­āļāļ‚āļ­āļ‡āļ‡āļēāļ™ Generative AI āđāļ•āđˆ CPU āļ—āļĩāđˆāļ”āļĩ āļāđ‡āļˆāļģāđ€āļ›āđ‡āļ™āļŠāļģāļŦāļĢāļąāļšāļ‡āļēāļ™āļ­āļ·āđˆāļ™ āđ† āđ€āļŠāđˆāļ™āļāļēāļĢāļˆāļąāļ”āļāļēāļĢ I/O, āļāļēāļĢāđ‚āļŦāļĨāļ”āļ‚āđ‰āļ­āļĄāļđāļĨ, āļāļēāļĢāļ›āļĢāļ°āļŠāļēāļ™āļ‡āļēāļ™āļāļąāļš GPU āđāļĨāļ°āļāļēāļĢāļĢāļąāļ™āļšāļĢāļīāļāļēāļĢāļ•āđˆāļēāļ‡ āđ† āļšāļ™āđ€āļ‹āļīāļĢāđŒāļŸāđ€āļ§āļ­āļĢāđŒ

āđāļ™āļ§āļ—āļēāļ‡āđ€āļĨāļ·āļ­āļ CPU āļŠāļģāļŦāļĢāļąāļš AI Server:

  • āđ€āļĨāļ·āļ­āļ CPU āđāļšāļš Multi-core / Multi-thread āđ€āļŠāđˆāļ™ 16–64 Core āļ‚āļķāđ‰āļ™āļāļąāļšāļ‚āļ™āļēāļ”āļ‡āļēāļ™
  • āđƒāļŠāđ‰ Server-grade CPU (āđ€āļŠāđˆāļ™ Intel Xeon, AMD EPYC) āđ€āļžāļ·āđˆāļ­āļĢāļ­āļ‡āļĢāļąāļšāļ‡āļēāļ™āļ•āđˆāļ­āđ€āļ™āļ·āđˆāļ­āļ‡ 24/7
  • āđƒāļ™ AI Server āļĢāļ°āļ”āļąāļš Enterprise āļĄāļąāļāđƒāļŠāđ‰ CPU 2 Socket āđ€āļŠāđˆāļ™ Dell PowerEdge XE7740 āļ—āļĩāđˆāļĢāļ­āļ‡āļĢāļąāļš Intel Xeon 6 āļŠāļđāļ‡āļŠāļļāļ” 86 cores/CPU āļĢāļ§āļĄāđ„āļ”āđ‰āļŦāļĨāļēāļĒāļĢāđ‰āļ­āļĒāļ„āļ­āļĢāđŒāđƒāļ™āđ€āļ„āļĢāļ·āđˆāļ­āļ‡āđ€āļ”āļĩāļĒāļ§

CPU āļ—āļĩāđˆāļ­āļ­āļāđāļšāļšāļĄāļēāļ”āļĩāļŠāđˆāļ§āļĒāđƒāļŦāđ‰:

  • āļāļēāļĢāđ€āļ•āļĢāļĩāļĒāļĄāļ‚āđ‰āļ­āļĄāļđāļĨ (Data Pipeline) āđ„āļĄāđˆāļ„āļ­āļ‚āļ§āļ”
  • āļāļēāļĢāļˆāļąāļ”āļāļēāļĢāļ‡āļēāļ™āđ€āļšāļ·āđ‰āļ­āļ‡āļŦāļĨāļąāļ‡ āđ€āļŠāđˆāļ™ Logging, Monitoring, API Server āļ—āļģāļ‡āļēāļ™āļĨāļ·āđˆāļ™
  • āļŠāļēāļĄāļēāļĢāļ–āđƒāļŠāđ‰āļ›āļĢāļ°āđ‚āļĒāļŠāļ™āđŒāļˆāļēāļ HPC āđāļĨāļ° AI Framework āđ„āļ”āđ‰āđ€āļ•āđ‡āļĄāļ›āļĢāļ°āļŠāļīāļ—āļ˜āļīāļ āļēāļž

3.2 GPU āđāļĨāļ° VRAM: āļŦāļąāļ§āđƒāļˆāļ‚āļ­āļ‡āļ‡āļēāļ™ Generative AI

GPU + VRAM āļ„āļ·āļ­āļ­āļ‡āļ„āđŒāļ›āļĢāļ°āļāļ­āļšāļŠāļģāļ„āļąāļāļ—āļĩāđˆāļŠāļļāļ”āđƒāļ™āļāļēāļĢāļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆ:

  • āļŠāļģāļŦāļĢāļąāļš Training āđ‚āļĄāđ€āļ”āļĨāļ‚āļ™āļēāļ”āđƒāļŦāļāđˆ āļ•āđ‰āļ­āļ‡āļāļēāļĢ GPU āļ—āļĩāđˆāļĄāļĩ Tensor Cores, VRAM āļŠāļđāļ‡ āđāļĨāļ°āļĢāļ­āļ‡āļĢāļąāļš NVLink/NVSwitch āđ€āļžāļ·āđˆāļ­āđ€āļŠāļ·āđˆāļ­āļĄ GPU āļŦāļĨāļēāļĒāđƒāļšāđƒāļŦāđ‰āļ—āļģāļ‡āļēāļ™āļĢāđˆāļ§āļĄāļāļąāļ™āđ€āļŦāļĄāļ·āļ­āļ™ GPU āđ€āļ”āļĩāļĒāļ§
  • āļŠāļģāļŦāļĢāļąāļš Inference āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆ āļˆāļģāļ™āļ§āļ™āļœāļđāđ‰āđƒāļŠāđ‰āļĄāļēāļ āđ† āļāđ‡āļĒāļąāļ‡āļ•āđ‰āļ­āļ‡āļāļēāļĢ GPU āļŦāļĨāļēāļĒāđƒāļš āđ€āļžāļ·āđˆāļ­āđāļšāđˆāļ‡āđ‚āļŦāļĨāļ”āđāļĨāļ°āļĨāļ” Latency

āđāļ™āļ§āļ—āļēāļ‡āđ€āļšāļ·āđ‰āļ­āļ‡āļ•āđ‰āļ™āļ—āļĩāđˆāļĄāļąāļāđƒāļŠāđ‰āđƒāļ™āđāļ§āļ”āļ§āļ‡ LLM:

  • āđ‚āļĄāđ€āļ”āļĨāļĢāļ°āļ”āļąāļš 7B (āđ€āļŠāđˆāļ™ LLaMA-3 7B āļŦāļĢāļ·āļ­āđ€āļ—āļĩāļĒāļšāđ€āļ—āđˆāļē)
    • āļŠāļēāļĄāļēāļĢāļ–āļĢāļąāļ™āđ„āļ”āđ‰āļ”āđ‰āļ§āļĒ GPU VRAM āļ›āļĢāļ°āļĄāļēāļ“ 8–16GB āļŦāļēāļāđƒāļŠāđ‰āđ€āļ—āļ„āļ™āļīāļ„ Quantization (āđ€āļŠāđˆāļ™ 4-bit)
  • āđ‚āļĄāđ€āļ”āļĨ 13B
    • āđƒāļŠāđ‰ GPU āđ€āļŠāđˆāļ™ RTX 3070 + RAM āļĢāļ°āļšāļš 64GB āļŠāļēāļĄāļēāļĢāļ–āļĢāļąāļ™āđ„āļ”āđ‰āļ—āļĩāđˆ 6.5 tokens/second āļŠāļģāļŦāļĢāļąāļš context āļŠāļąāđ‰āļ™
  • āđ‚āļĄāđ€āļ”āļĨ Llama 2 70B āđāļĨāļ°āļāļĨāļļāđˆāļĄāđ‚āļĄāđ€āļ”āļĨāļ‚āļ™āļēāļ”āđƒāļŦāļāđˆāļĄāļēāļ
    • āļĄāļĩāļāļēāļĢāđƒāļŠāđ‰āļ‡āļēāļ™āļˆāļĢāļīāļ‡āļ—āļĩāđˆāđƒāļŠāđ‰ GPU āļĢāļ°āļ”āļąāļš RTX 3090 āļˆāļģāļ™āļ§āļ™ 2 āđƒāļš āļŦāļĢāļ·āļ­ A6000 āđ€āļ›āđ‡āļ™āļ‚āļąāđ‰āļ™āļ•āđˆāļģāļŠāļģāļŦāļĢāļąāļšāļāļēāļĢāļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨ 70B āļ—āļĩāđˆ 4-bit GPTQ
    • āđƒāļ™āđ‚āļĨāļ Enterprise āļĄāļąāļāļĒāđ‰āļēāļĒāđ„āļ›āđƒāļŠāđ‰ GPU Data Center āđ€āļŠāđˆāļ™ NVIDIA H100, A100 āļžāļĢāđ‰āļ­āļĄ VRAM āļŠāļđāļ‡ 80–96GB āđāļĨāļ°āđ€āļŠāļ·āđˆāļ­āļĄāļ•āđˆāļ­āļ”āđ‰āļ§āļĒ NVLink/NVSwitch āđ€āļžāļ·āđˆāļ­āļĢāļ­āļ‡āļĢāļąāļš Training āđāļĨāļ° Inference āļĢāļ°āļ”āļąāļš Production

āļšāļ—āļ„āļ§āļēāļĄāļ‚āļ­āļ‡ droneth.or.th āļĢāļ°āļšāļļāļ§āđˆāļē Consumer GPU āļ—āļĩāđˆāļĄāļĩ VRAM 24GB āļĄāļąāļāđ„āļĄāđˆāļžāļ­āļŠāļģāļŦāļĢāļąāļšāđ‚āļĄāđ€āļ”āļĨāļ āļēāļĐāļēāļ‚āļ™āļēāļ”āđƒāļŦāļāđˆāļ­āļĒāđˆāļēāļ‡ Llama-3-70B āđƒāļ™āđ‚āļŦāļĄāļ”āļ›āļāļ•āļī āļˆāļķāļ‡āļ•āđ‰āļ­āļ‡āđ€āļĨāļ·āļ­āļāđƒāļŠāđ‰ Enterprise GPU āļ—āļĩāđˆāļĄāļĩ VRAM 48GB āļ‚āļķāđ‰āļ™āđ„āļ› āđāļĨāļ°āđ€āļŠāļ·āđˆāļ­āļĄ GPU āļŦāļĨāļēāļĒāđƒāļšāļ”āđ‰āļ§āļĒ NVLink/NVSwitch āļŠāļģāļŦāļĢāļąāļšāļ‡āļēāļ™āļĢāļ°āļ”āļąāļšāļ™āļąāđ‰āļ™

āļŠāļģāļŦāļĢāļąāļšāļĨāļđāļāļ„āđ‰āļēāļ­āļ‡āļ„āđŒāļāļĢāļ‚āļ­āļ‡ 2beshop.com āđ€āļĄāļ·āđˆāļ­āļ§āļēāļ‡āđāļœāļ™āđ€āļĨāļ·āļ­āļ GPU Server āļŠāļģāļŦāļĢāļąāļš Generative AI āļ„āļ§āļĢāļžāļīāļˆāļēāļĢāļ“āļē:

  • āļˆāļģāļ™āļ§āļ™ CUDA Cores / Tensor Cores
  • āļ‚āļ™āļēāļ” VRAM āļ•āđˆāļ­āđƒāļš āđāļĨāļ°āļĒāļ­āļ”āļĢāļ§āļĄ VRAM āļ‚āļ­āļ‡āļ—āļļāļ GPU
  • āļāļēāļĢāļĢāļ­āļ‡āļĢāļąāļš Framework āđ€āļŠāđˆāļ™ PyTorch, TensorFlow, CUDA, cuDNN
  • āļāļēāļĢāļĢāļ­āļ‡āļĢāļąāļš NVLink / NVSwitch āđƒāļ™āļāļĢāļ“āļĩāđƒāļŠāđ‰ GPU āļŦāļĨāļēāļĒāđƒāļšāļŠāļģāļŦāļĢāļąāļšāđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆ

3.3 RAM āļĢāļ°āļšāļš (System Memory)

āļŠāļģāļŦāļĢāļąāļšāļ‡āļēāļ™ Generative AI āļ—āļĩāđˆāļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆ RAM āļĄāļĩāļœāļĨāļ•āđˆāļ­:

  • āļāļēāļĢāđ‚āļŦāļĨāļ”āļŠāļļāļ”āļ‚āđ‰āļ­āļĄāļđāļĨāļ‚āļ™āļēāļ”āđƒāļŦāļāđˆ
  • āļāļēāļĢāļˆāļąāļ”āļāļēāļĢ Batch āļ‚āļ“āļ°āđ€āļ—āļĢāļ™
  • āļāļēāļĢāļĢāļąāļ™āļšāļĢāļīāļāļēāļĢāļ­āļ·āđˆāļ™āļšāļ™āđ€āļ‹āļīāļĢāđŒāļŸāđ€āļ§āļ­āļĢāđŒ āđ€āļŠāđˆāļ™ web server, database, monitoring.

āđāļ™āļ§āļ—āļēāļ‡āđ€āļĨāļ·āļ­āļ RAM:

  • āđ€āļ§āļīāļĢāđŒāļāļŠāđ€āļ•āļŠāļąāļ™ AI āļĄāļąāļāđ€āļĢāļīāđˆāļĄāļ•āđ‰āļ™āļ—āļĩāđˆ 32–128GB āļ‚āļķāđ‰āļ™āđ„āļ› āđāļĨāđ‰āļ§āđāļ•āđˆāļ‚āļ™āļēāļ”āļ‡āļēāļ™
  • AI Server āļĢāļ°āļ”āļąāļš Enterprise āļ­āļēāļˆāļĢāļ­āļ‡āļĢāļąāļšāđ„āļ”āđ‰āļ–āļķāļ‡ 3TB RAM āđ€āļŠāđˆāļ™ Dell PowerEdge XE7740
  • āļŠāļģāļŦāļĢāļąāļšāļāļēāļĢāļĢāļąāļ™ LLM 13B āļ­āļĒāđˆāļēāļ‡āļˆāļĢāļīāļ‡āļˆāļąāļ‡ āļĄāļĩāđāļ™āļ°āļ™āļģāđƒāļŦāđ‰āđƒāļŠāđ‰ RAM āļ­āļĒāđˆāļēāļ‡āļ™āđ‰āļ­āļĒ 64GB āđ€āļžāļ·āđˆāļ­āđ„āļĄāđˆāđƒāļŦāđ‰āļĢāļ°āļšāļšāļ„āļ­āļ‚āļ§āļ”

āļšāļ™āđ€āļ‹āļīāļĢāđŒāļŸāđ€āļ§āļ­āļĢāđŒ AI āļ‚āļ­āļ‡āļ­āļ‡āļ„āđŒāļāļĢ āđāļ™āļ°āļ™āļģāđƒāļŦāđ‰ “āđ€āļœāļ·āđˆāļ­ RAM āļĄāļēāļāļāļ§āđˆāļēāđ€āļ‹āļīāļĢāđŒāļŸāđ€āļ§āļ­āļĢāđŒāļ—āļąāđˆāļ§āđ„āļ›â€ āđ€āļžāļĢāļēāļ°āđ‚āļŦāļĨāļ”āļ‡āļēāļ™ AI āļĄāļĩāļ„āļ§āļēāļĄāļœāļąāļ™āļœāļ§āļ™āđāļĨāļ°āļ­āļēāļˆāļ•āđ‰āļ­āļ‡āļĢāļ­āļ‡āļĢāļąāļšāļœāļđāđ‰āđƒāļŠāđ‰āļžāļĢāđ‰āļ­āļĄāļāļąāļ™āļŦāļĨāļēāļĒāļĢāļēāļĒ

3.4 Storage āđāļĨāļ°āđ‚āļ„āļĢāļ‡āļŠāļĢāđ‰āļēāļ‡āļ‚āđ‰āļ­āļĄāļđāļĨ

āļ‡āļēāļ™ Generative AI āđƒāļŠāđ‰āļ‚āđ‰āļ­āļĄāļđāļĨāļˆāļģāļ™āļ§āļ™āļĄāļēāļ āļ—āļąāđ‰āļ‡ Dataset, Model Checkpoint, Log āđāļĨāļ°āļ‚āđ‰āļ­āļĄāļđāļĨāļœāļđāđ‰āđƒāļŠāđ‰ āļˆāļķāļ‡āļ•āđ‰āļ­āļ‡āļ­āļ­āļāđāļšāļš Storage āļ­āļĒāđˆāļēāļ‡āļĢāļ°āļĄāļąāļ”āļĢāļ°āļ§āļąāļ‡

āđāļ™āļ§āļ—āļēāļ‡āļˆāļąāļ” Storage:

  • āđāļĒāļāļ”āļīāļŠāļāđŒāļŠāļģāļŦāļĢāļąāļš
    • āļĢāļ°āļšāļšāļ›āļāļīāļšāļąāļ•āļīāļāļēāļĢ + āļ‹āļ­āļŸāļ•āđŒāđāļ§āļĢāđŒ AI → āđƒāļŠāđ‰ SSD/NVMe āđ€āļžāļ·āđˆāļ­āļ„āļ§āļēāļĄāđ€āļĢāđ‡āļ§
    • āđ€āļāđ‡āļšāļ‚āđ‰āļ­āļĄāļđāļĨāļ”āļīāļš, Dataset, Log, Model → āđƒāļŠāđ‰ HDD āļŦāļĢāļ·āļ­ Storage āļ„āļ§āļēāļĄāļˆāļļāļŠāļđāļ‡ āđ€āļŠāđˆāļ™ NAS/SAN āļŦāļĢāļ·āļ­ Object Storage
  • āļžāļīāļˆāļēāļĢāļ“āļē
    • āļ„āļ§āļēāļĄāļˆāļļāļĢāļ§āļĄ (āļĢāļ­āļ‡āļĢāļąāļšāļāļēāļĢāđ€āļ•āļīāļšāđ‚āļ•)
    • āļ„āļ§āļēāļĄāđ€āļĢāđ‡āļ§āļ­āđˆāļēāļ™/āđ€āļ‚āļĩāļĒāļ™ (IOPS, Throughput)
    • RAID āļŦāļĢāļ·āļ­āļĢāļ°āļšāļšāļŠāļģāļĢāļ­āļ‡āļ‚āđ‰āļ­āļĄāļđāļĨāđ€āļžāļ·āđˆāļ­āļ„āļ§āļēāļĄāļ›āļĨāļ­āļ”āļ āļąāļĒāđāļĨāļ° Compliance

āļ•āļąāļ§āļ­āļĒāđˆāļēāļ‡ AI Server āļĢāļ°āļ”āļąāļšāļŠāļđāļ‡ āđ€āļŠāđˆāļ™ PowerEdge XE7740 āļŠāļēāļĄāļēāļĢāļ–āļĢāļ­āļ‡āļĢāļąāļš NVMe āđ„āļ”āđ‰āļŠāļđāļ‡āļŠāļļāļ” 122.88TB āđ€āļžāļ·āđˆāļ­āļĢāļ­āļ‡āļĢāļąāļšāļ‡āļēāļ™ AI, Data Analytics āđāļĨāļ° HPC āļ‚āļ™āļēāļ”āđƒāļŦāļāđˆ

3.5 Network āđāļĨāļ°āļāļēāļĢāđ€āļŠāļ·āđˆāļ­āļĄāļ•āđˆāļ­

āđ€āļĄāļ·āđˆāļ­āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆāļĢāļąāļ™āđƒāļ™āļ­āļ‡āļ„āđŒāļāļĢ āļāļēāļĢāđ€āļŠāļ·āđˆāļ­āļĄāļ•āđˆāļ­ Network āļĄāļĩāļœāļĨāļ•āđˆāļ­āļ—āļąāđ‰āļ‡ Performance āđāļĨāļ°āļ„āļ§āļēāļĄāļ›āļĨāļ­āļ”āļ āļąāļĒ:

  • āļ‡āļēāļ™āļ—āļĩāđˆāļĢāļąāļ™āļšāļ™ Cloud āļŦāļĢāļ·āļ­āļĢāļąāļšāļ‚āđ‰āļ­āļĄāļđāļĨāļˆāļēāļāļŦāļĨāļēāļĒāļŠāļēāļ‚āļē āļ•āđ‰āļ­āļ‡āļĄāļĩ Bandwidth āđ€āļžāļĩāļĒāļ‡āļžāļ­ āļĢāļ§āļĄāļ–āļķāļ‡āļĢāļ°āļšāļš VPN / Secure Access āļŠāļģāļŦāļĢāļąāļšāđ€āļ‚āđ‰āļēāļ–āļķāļ‡ AI Server āļˆāļēāļāļ āļēāļĒāļ™āļ­āļ
  • āļ­āļ‡āļ„āđŒāļāļĢāļ‚āļ™āļēāļ”āļāļĨāļēāļ‡â€“āđƒāļŦāļāđˆāļ„āļ§āļĢāđƒāļŠāđ‰ Switch āļĢāļ°āļ”āļąāļš Enterprise āđ€āļžāļ·āđˆāļ­āļĢāļ­āļ‡āļĢāļąāļšāļāļēāļĢāđ€āļ•āļīāļšāđ‚āļ• āđāļĨāļ°āļāļēāļĢāđ€āļŠāļ·āđˆāļ­āļĄāļ•āđˆāļ­āļāļąāļš GPU Server āļŦāļĨāļēāļĒāđ€āļ„āļĢāļ·āđˆāļ­āļ‡āđ€āļ›āđ‡āļ™ Cluster
  • āļ āļēāļĒāđƒāļ™ AI Infrastructure āļĄāļąāļāđƒāļŠāđ‰āđ€āļ„āļĢāļ·āļ­āļ‚āđˆāļēāļĒāļ„āļ§āļēāļĄāđ€āļĢāđ‡āļ§āļŠāļđāļ‡ āđ€āļŠāđˆāļ™ 25/40/100GbE āļŦāļĢāļ·āļ­ InfiniBand āļŠāļģāļŦāļĢāļąāļšāļāļēāļĢāđ€āļŠāļ·āđˆāļ­āļĄāļ•āđˆāļ­āļĢāļ°āļŦāļ§āđˆāļēāļ‡ Node āđāļĨāļ° Storage

4. āļ•āļąāļ§āļ­āļĒāđˆāļēāļ‡āļŠāđ€āļ›āļ AI Server āļŠāļģāļŦāļĢāļąāļšāđ‚āļĄāđ€āļ”āļĨāļ‚āļ™āļēāļ”āļ•āđˆāļēāļ‡ āđ†

āļ”āđ‰āļēāļ™āļĨāđˆāļēāļ‡āļ™āļĩāđ‰āļ„āļ·āļ­āđāļ™āļ§āļ„āļīāļ”āđƒāļ™āļāļēāļĢāļˆāļąāļ”āļŠāđ€āļ›āļ AI Server āļŠāļģāļŦāļĢāļąāļšāļ‡āļēāļ™ Generative AI āļ•āļēāļĄāļ‚āļ™āļēāļ”āđ‚āļĄāđ€āļ”āļĨ (āđ€āļ›āđ‡āļ™āđāļ™āļ§āļ—āļēāļ‡āđ€āļŠāļīāļ‡āļ āļēāļžāļĢāļ§āļĄ āļ­āļ‡āļ„āđŒāļāļĢāļŠāļēāļĄāļēāļĢāļ–āļ›āļĢāļąāļšāļ•āļēāļĄāļ„āļ§āļēāļĄāļ•āđ‰āļ­āļ‡āļāļēāļĢāļˆāļĢāļīāļ‡):

4.1 āđ‚āļĄāđ€āļ”āļĨ 7B–13B (āđ€āļĢāļīāđˆāļĄāļ•āđ‰āļ™ Generative AI āļ āļēāļĒāđƒāļ™āļ­āļ‡āļ„āđŒāļāļĢ)

āđ€āļŦāļĄāļēāļ°āļŠāļģāļŦāļĢāļąāļšāļ­āļ‡āļ„āđŒāļāļĢāļ—āļĩāđˆāļ•āđ‰āļ­āļ‡āļāļēāļĢ:

  • āļ—āļ”āļĨāļ­āļ‡āđƒāļŠāđ‰ LLM āļ āļēāļĒāđƒāļ™
  • āļžāļąāļ’āļ™āļē Chatbot āļ āļēāļĒāđƒāļ™āļ­āļ‡āļ„āđŒāļāļĢ
  • Fine-tune āđ‚āļĄāđ€āļ”āļĨāļ”āđ‰āļ§āļĒāļ‚āđ‰āļ­āļĄāļđāļĨāđ€āļ‰āļžāļēāļ°āļ‚āļ­āļ‡āļšāļĢāļīāļĐāļąāļ—āđƒāļ™āļĢāļ°āļ”āļąāļšāđ€āļšāļ·āđ‰āļ­āļ‡āļ•āđ‰āļ™

āđāļ™āļ§āļ—āļēāļ‡āļŠāđ€āļ›āļ:

  • CPU: Server-grade 16–32 Core (Intel Xeon āļŦāļĢāļ·āļ­ AMD EPYC)
  • GPU:
    • 1–2 āđƒāļšāļĢāļ°āļ”āļąāļš RTX A-series āļŦāļĢāļ·āļ­ Data Center GPU (A-series/H-series)
    • VRAM āļ•āđˆāļ­āđƒāļš 24–48GB (āļĢāļ­āļ‡āļĢāļąāļšāđ‚āļĄāđ€āļ”āļĨ 13B āļ—āļĩāđˆ 4-bit āļŦāļĢāļ·āļ­ 7B āđāļšāļšāļ„āļ§āļēāļĄāđāļĄāđˆāļ™āļĒāļģāļŠāļđāļ‡āļ‚āļķāđ‰āļ™)
  • RAM āļĢāļ°āļšāļš: āđ€āļĢāļīāđˆāļĄāļ•āđ‰āļ™ 64–128GB āđ€āļžāļ·āđˆāļ­āļĢāļ­āļ‡āļĢāļąāļšāļ‡āļēāļ™āđ€āļ—āļĢāļ™/Inference āđāļĨāļ°āļšāļĢāļīāļāļēāļĢāļ­āļ·āđˆāļ™ āđ†
  • Storage:
    • NVMe SSD 1–2TB āļŠāļģāļŦāļĢāļąāļšāļĢāļ°āļšāļšāđāļĨāļ°āļ‹āļ­āļŸāļ•āđŒāđāļ§āļĢāđŒ AI
    • HDD / SSD āđ€āļžāļīāđˆāļĄāđ€āļ•āļīāļĄāļŠāļģāļŦāļĢāļąāļš Dataset 4–8TB āļ‚āļķāđ‰āļ™āđ„āļ›
  • Network: 10–25GbE āļ‚āļķāđ‰āļ™āđ„āļ› āļŦāļēāļāļ•āđ‰āļ­āļ‡āđāļŠāļĢāđŒāđ‚āļĄāđ€āļ”āļĨāđƒāļŦāđ‰āļœāļđāđ‰āđƒāļŠāđ‰āļŦāļĨāļēāļĒāļ„āļ™āđƒāļ™āļ­āļ‡āļ„āđŒāļāļĢ

4.2 āđ‚āļĄāđ€āļ”āļĨ 34B–70B āđāļĨāļ°āđ‚āļĄāđ€āļ”āļĨāļĢāļ°āļ”āļąāļš Enterprise

āđ€āļŦāļĄāļēāļ°āļŠāļģāļŦāļĢāļąāļšāļ­āļ‡āļ„āđŒāļāļĢāļ—āļĩāđˆāļ•āđ‰āļ­āļ‡āļāļēāļĢ:

  • āļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆāļĢāļ°āļ”āļąāļš Enterprise (āđ€āļŠāđˆāļ™ LLM 70B āļ‚āļķāđ‰āļ™āđ„āļ›)
  • āđ€āļ—āļĢāļ™/āđ„āļŸāļ™āđŒāļˆāļđāļ™āđ‚āļĄāđ€āļ”āļĨāļ”āđ‰āļ§āļĒ Dataset āļ‚āļ™āļēāļ”āđƒāļŦāļāđˆ
  • āļ—āļģ Generative AI āđ€āļ›āđ‡āļ™āļšāļĢāļīāļāļēāļĢāļŦāļĨāļąāļāļ‚āļ­āļ‡āļ­āļ‡āļ„āđŒāļāļĢāļŦāļĢāļ·āļ­āļœāļĨāļīāļ•āļ āļąāļ“āļ‘āđŒ

āđāļ™āļ§āļ—āļēāļ‡āļŠāđ€āļ›āļ:

  • CPU: Dual Socket Server-grade (āđ€āļŠāđˆāļ™ 2x Intel Xeon 6 āļŠāļđāļ‡āļŠāļļāļ” 86 cores/CPU)
  • GPU:
    • 4–8 āđƒāļšāļĢāļ°āļ”āļąāļš Data Center GPU āđ€āļŠāđˆāļ™ NVIDIA A100/H100
    • VRAM āļ•āđˆāļ­āđƒāļš 80–96GB
    • āļĢāļ­āļ‡āļĢāļąāļš NVLink / NVSwitch āđ€āļžāļ·āđˆāļ­āđƒāļŦāđ‰āļĢāļ°āļšāļšāļĄāļ­āļ‡āđ€āļŦāđ‡āļ™āđ€āļ›āđ‡āļ™ GPU āļ‚āļ™āļēāļ”āđƒāļŦāļāđˆāđƒāļšāđ€āļ”āļĩāļĒāļ§ āđāļĨāļ°āļĢāļ­āļ‡āļĢāļąāļš Training āđ‚āļĄāđ€āļ”āļĨāļĢāļ°āļ”āļąāļš 70B+ āđ„āļ”āđ‰āļ”āļĩ
  • RAM āļĢāļ°āļšāļš: 256GB–1TB āļŦāļĢāļ·āļ­āļĄāļēāļāļāļ§āđˆāļē āļ‚āļķāđ‰āļ™āļāļąāļšāļ‚āļ™āļēāļ” Dataset āđāļĨāļ°āļ‡āļēāļ™āđ€āļ—āļĢāļ™
  • Storage:
    • NVMe āļŦāļĨāļēāļĒāļĨāļđāļāļ„āļ§āļēāļĄāļˆāļļāļĢāļ§āļĄ 10–100TB āļŠāļģāļŦāļĢāļąāļš Model Checkpoint, Log āđāļĨāļ° Working Dataset
    • āđ€āļŠāļ·āđˆāļ­āļĄāļ•āđˆāļ­āļāļąāļš Data Lake / Storage āļ āļēāļĒāļ™āļ­āļāļĢāļ°āļ”āļąāļš Petabyte āļŦāļēāļāļĄāļĩāļāļēāļĢāđ€āļ—āļĢāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆ[3][4].
  • Network: 25–100GbE āļŦāļĢāļ·āļ­ InfiniBand āļŠāļģāļŦāļĢāļąāļšāļāļēāļĢāđ€āļŠāļ·āđˆāļ­āļĄāļ•āđˆāļ­āļĢāļ°āļŦāļ§āđˆāļēāļ‡ Node āđāļĨāļ° Storage āđ€āļžāļ·āđˆāļ­āļĢāļ­āļ‡āļĢāļąāļš HPC / AI Cluster

āļ•āļąāļ§āļ­āļĒāđˆāļēāļ‡āļˆāļĢāļīāļ‡āđ€āļŠāđˆāļ™ Dell PowerEdge XE7740 āļ—āļĩāđˆāļ–āļđāļāļ­āļ­āļāđāļšāļšāļĄāļēāđ€āļ›āđ‡āļ™ 4U Rack Server āļŠāļģāļŦāļĢāļąāļš AI āđ‚āļ”āļĒāđ€āļ‰āļžāļēāļ° āļĢāļ­āļ‡āļĢāļąāļš GPU āļŠāļđāļ‡āļŠāļļāļ” 16 āļ•āļąāļ§ āđāļĨāļ° RAM āļŠāļđāļ‡āļŠāļļāļ” 3TB āđ€āļŦāļĄāļēāļ°āļāļąāļšāļ‡āļēāļ™ AI, Data Analytics āđāļĨāļ° HPC āļ‚āļ™āļēāļ”āđƒāļŦāļāđˆ


5. āđ€āļĨāļ·āļ­āļ AI Server āđƒāļŦāđ‰āļ•āļĢāļ‡āļ‡āļēāļ™āđāļĨāļ°āļ‡āļšāļ›āļĢāļ°āļĄāļēāļ“āļ‚āļ­āļ‡āļ­āļ‡āļ„āđŒāļāļĢ

āđ€āļĄāļ·āđˆāļ­āļ­āļ‡āļ„āđŒāļāļĢāļāļģāļĨāļąāļ‡āļ•āļąāļ”āļŠāļīāļ™āđƒāļˆāđ€āļĨāļ·āļ­āļ AI Server āļŠāļģāļŦāļĢāļąāļšāļ‡āļēāļ™ Generative AI āļ„āļ§āļĢāļ—āļģāļ•āļēāļĄāļ‚āļąāđ‰āļ™āļ•āļ­āļ™āļ•āđˆāļ­āđ„āļ›āļ™āļĩāđ‰:

  1. āļ§āļīāđ€āļ„āļĢāļēāļ°āļŦāđŒāđ€āļ›āđ‰āļēāļŦāļĄāļēāļĒāļāļēāļĢāđƒāļŠāđ‰ AI āđƒāļŦāđ‰āļŠāļąāļ”āđ€āļˆāļ™

    • āđƒāļŠāđ‰ Generative AI āđ€āļžāļ·āđˆāļ­āļ­āļ°āđ„āļĢ? Chatbot, Content Generation, Code Assistant, āļŦāļĢāļ·āļ­ Image/Video Generation
    • āļ•āđ‰āļ­āļ‡āļāļēāļĢāđ€āļ—āļĢāļ™āđ‚āļĄāđ€āļ”āļĨāđ€āļ­āļ‡ āļŦāļĢāļ·āļ­āđƒāļŠāđ‰āđ‚āļĄāđ€āļ”āļĨāļŠāļģāđ€āļĢāđ‡āļˆāļĢāļđāļ›āđāļĨāđ‰āļ§āļ—āļģ Fine-tune
  2. āļāļģāļŦāļ™āļ”āļ›āļĢāļ°āđ€āļ āļ—āļ‡āļēāļ™āļŦāļĨāļąāļ

    • āđ€āļ™āđ‰āļ™ Training/Fine-tuning → āđƒāļŦāđ‰āļ™āđ‰āļģāļŦāļ™āļąāļāđ„āļ›āļ—āļĩāđˆ GPU, VRAM, NVLink, RAM āđāļĨāļ° Storage
    • āđ€āļ™āđ‰āļ™ Inference/āļšāļĢāļīāļāļēāļĢāļœāļđāđ‰āđƒāļŠāđ‰āļˆāļģāļ™āļ§āļ™āļĄāļēāļ â†’ āđƒāļŦāđ‰āļ™āđ‰āļģāļŦāļ™āļąāļāđ„āļ›āļ—āļĩāđˆ GPU āļŦāļĨāļēāļĒāđƒāļš, Network āđāļĨāļ°āļāļēāļĢāļ­āļ­āļāđāļšāļšāļĢāļ°āļšāļšāđƒāļŦāđ‰ Scale-out āđ„āļ”āđ‰
  3. āļ§āļēāļ‡āļŠāđ€āļ›āļāđƒāļŦāđ‰āļĢāļ­āļ‡āļĢāļąāļšāļ—āļąāđ‰āļ‡āļ›āļąāļˆāļˆāļļāļšāļąāļ™āđāļĨāļ°āļ­āļ™āļēāļ„āļ•

    • āđ€āļĨāļ·āļ­āļāđ€āļ„āļĢāļ·āđˆāļ­āļ‡āļ—āļĩāđˆāļŠāļēāļĄāļēāļĢāļ– āļ­āļąāļ›āđ€āļāļĢāļ”āđ€āļžāļīāđˆāļĄ GPU, RAM, Storage āđ„āļ”āđ‰āđƒāļ™āļ­āļ™āļēāļ„āļ•
    • āļ§āļēāļ‡āđāļœāļ™āđ€āļĢāļ·āđˆāļ­āļ‡ āđ„āļŸāļŸāđ‰āļēāđāļĨāļ°āļĢāļ°āļšāļšāļĢāļ°āļšāļēāļĒāļ„āļ§āļēāļĄāļĢāđ‰āļ­āļ™ āđ€āļŠāđˆāļ™ āļ•āļđāđ‰āđāļĢāđ‡āļ„, āļŦāđ‰āļ­āļ‡āđ€āļ‹āļīāļĢāđŒāļŸāđ€āļ§āļ­āļĢāđŒ, UPS āđƒāļŦāđ‰āļĢāļ­āļ‡āļĢāļąāļšāđ‚āļŦāļĨāļ”āļ‚āļ­āļ‡ GPU Server
    • āļžāļīāļˆāļēāļĢāļ“āļēāđ‚āļ„āļĢāļ‡āļŠāļĢāđ‰āļēāļ‡ AI Infrastructure āļ—āļąāđ‰āļ‡āļĢāļ°āļšāļš āđ€āļŠāđˆāļ™ HPC, Data Lake, Network, Security & Compliance
  4. āđ€āļ›āļĢāļĩāļĒāļšāđ€āļ—āļĩāļĒāļšāļ—āļēāļ‡āđ€āļĨāļ·āļ­āļ On-premise vs Cloud

    • Cloud āđ€āļŦāļĄāļēāļ°āļāļąāļšāļāļēāļĢāļ—āļ”āļĨāļ­āļ‡āđ€āļĢāđ‡āļ§ āđ† āļŦāļĢāļ·āļ­āđ‚āļŦāļĨāļ”āļ‡āļēāļ™āļ—āļĩāđˆāđ€āļ›āļĨāļĩāđˆāļĒāļ™āđāļ›āļĨāļ‡āļ•āļĨāļ­āļ”
    • On-premise AI Server āđ€āļŦāļĄāļēāļ°āļāļąāļšāļāļēāļĢāļ„āļļāļĄ Data, āļĨāļ”āļ„āđˆāļēāđƒāļŠāđ‰āļˆāđˆāļēāļĒāļĢāļ°āļĒāļ°āļĒāļēāļ§ āđāļĨāļ°āļ—āļģāļ‡āļēāļ™āļ•āđˆāļ­āđ€āļ™āļ·āđˆāļ­āļ‡ 24/7 āđƒāļ™āļ­āļ‡āļ„āđŒāļāļĢ

6. āļšāļ—āļŠāļĢāļļāļ› āđāļĨāļ° Call-to-Action (CTA)

āļāļēāļĢāđ€āļĨāļ·āļ­āļ āļŠāđ€āļ›āļ AI Server āļŠāļģāļŦāļĢāļąāļšāļ‡āļēāļ™ Generative AI āđ€āļžāļ·āđˆāļ­āđƒāļŦāđ‰āļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆāđ„āļ”āđ‰āļ”āļĩ āđ„āļĄāđˆāđ„āļ”āđ‰āļĄāļĩāļ„āļģāļ•āļ­āļšāđ€āļ”āļĩāļĒāļ§ āđāļ•āđˆāļ‚āļķāđ‰āļ™āļ­āļĒāļđāđˆāļāļąāļš:

  • āļ‚āļ™āļēāļ”āđ‚āļĄāđ€āļ”āļĨ (7B, 13B, 34B, 70B āļŦāļĢāļ·āļ­āđƒāļŦāļāđˆāļāļ§āđˆāļēāļ™āļąāđ‰āļ™)
  • āļĨāļąāļāļĐāļ“āļ°āļ‡āļēāļ™ (Training / Inference / Hybrid)
  • āļ›āļĢāļīāļĄāļēāļ“āļœāļđāđ‰āđƒāļŠāđ‰ āđāļĨāļ°āđ‚āļŦāļĨāļ”āļ‡āļēāļ™āļˆāļĢāļīāļ‡
  • āļ‡āļšāļ›āļĢāļ°āļĄāļēāļ“ āđāļĨāļ°āđāļœāļ™āļāļēāļĢāđ€āļ•āļīāļšāđ‚āļ•āļ‚āļ­āļ‡āđ‚āļ„āļĢāļ‡āļāļēāļĢ AI āđƒāļ™āļ­āļ‡āļ„āđŒāļāļĢ

āđ‚āļ”āļĒāļŠāļĢāļļāļ› āļŦāļēāļāļ„āļļāļ“āļ•āđ‰āļ­āļ‡āļāļēāļĢāļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆāđƒāļ™āļ­āļ‡āļ„āđŒāļāļĢāļ­āļĒāđˆāļēāļ‡āļĄāļĩāļ›āļĢāļ°āļŠāļīāļ—āļ˜āļīāļ āļēāļž:

  • āđ€āļĨāļ·āļ­āļ GPU Server / AI Server āļ—āļĩāđˆāļĄāļĩ GPU āļĢāļ°āļ”āļąāļšāļ­āļ‡āļ„āđŒāļāļĢ, VRAM āļŠāļđāļ‡, āļĢāļ­āļ‡āļĢāļąāļš NVLink/NVSwitch āļŠāļģāļŦāļĢāļąāļšāļ‡āļēāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆ
  • āđƒāļŠāđ‰ CPU Server-grade, RAM āđ€āļœāļ·āđˆāļ­āļŠāļđāļ‡ āđāļĨāļ° Storage āļ—āļĩāđˆāļ­āļ­āļāđāļšāļšāđāļĒāļ OS/Software āļāļąāļš Dataset āļ­āļĒāđˆāļēāļ‡āļŠāļąāļ”āđ€āļˆāļ™
  • āļ§āļēāļ‡āđāļœāļ™ Network āđāļĨāļ° Infrastructure āđƒāļŦāđ‰āļĢāļ­āļ‡āļĢāļąāļšāļāļēāļĢāļ‚āļĒāļēāļĒāđƒāļ™āļ­āļ™āļēāļ„āļ• āđ‚āļ”āļĒāļĄāļ­āļ‡āļ—āļąāđ‰āļ‡āđ€āļĢāļ·āđˆāļ­āļ‡ Performance āđāļĨāļ° Security

āļŦāļēāļāļ„āļļāļ“āļĒāļąāļ‡āđ„āļĄāđˆāđāļ™āđˆāđƒāļˆāļ§āđˆāļēāļˆāļ°āđ€āļĢāļīāđˆāļĄāļ•āđ‰āļ™āļ­āļĒāđˆāļēāļ‡āđ„āļĢ āļŦāļĢāļ·āļ­āļŠāđ€āļ›āļāđāļšāļšāđ„āļŦāļ™āđ€āļŦāļĄāļēāļ°āļāļąāļšāļ‡āļēāļ™ Generative AI āđƒāļ™āļ­āļ‡āļ„āđŒāļāļĢāļ‚āļ­āļ‡āļ„āļļāļ“ āļ—āļĩāļĄāļ‡āļēāļ™ 2beshop āļŠāļēāļĄāļēāļĢāļ–āļŠāđˆāļ§āļĒāļ§āļīāđ€āļ„āļĢāļēāļ°āļŦāđŒāļ‡āļēāļ™ āļ­āļ­āļāđāļšāļšāļŠāđ€āļ›āļ AI Server / GPU Server āđāļĨāļ°āđāļ™āļ°āļ™āļģāđ‚āļ‹āļĨāļđāļŠāļąāļ™āļ—āļĩāđˆāđ€āļŦāļĄāļēāļ°āļ—āļąāđ‰āļ‡āļ”āđ‰āļēāļ™āļ›āļĢāļ°āļŠāļīāļ—āļ˜āļīāļ āļēāļžāđāļĨāļ°āļ‡āļšāļ›āļĢāļ°āļĄāļēāļ“āđ„āļ”āđ‰ āļ„āļļāļ“āļŠāļēāļĄāļēāļĢāļ–āļ™āļģāļ‚āđ‰āļ­āļĄāļđāļĨāđƒāļ™āļšāļ—āļ„āļ§āļēāļĄāļ™āļĩāđ‰āđ„āļ›āļ„āļļāļĒāļāļąāļšāļ—āļĩāļĄ IT āļŦāļĢāļ·āļ­āļ›āļĢāļķāļāļĐāļēāļœāļđāđ‰āđ€āļŠāļĩāđˆāļĒāļ§āļŠāļēāļāļ‚āļ­āļ‡ 2beshop āđ€āļžāļ·āđˆāļ­āļˆāļąāļ”āļŠāđ€āļ›āļāļ—āļĩāđˆāļžāļĢāđ‰āļ­āļĄāļĢāļąāļ™āđ‚āļĄāđ€āļ”āļĨāđƒāļŦāļāđˆāđƒāļ™āđāļšāļšāļ—āļĩāđˆāļ•āļ­āļšāđ‚āļˆāļ—āļĒāđŒāļ˜āļļāļĢāļāļīāļˆāļ‚āļ­āļ‡āļ„āļļāļ“āļĄāļēāļāļ—āļĩāđˆāļŠāļļāļ”

āļ•āļīāļ”āļ•āđˆāļ­āđ€āļĢāļēāļœāđˆāļēāļ™āđ€āļ§āđ‡āļšāđ„āļ‹āļ•āđŒāđāļĨāļ°āļŠāļ­āļšāļ–āļēāļĄāļŠāļīāļ™āļ„āđ‰āļēāđ„āļ”āđ‰āđ€āļĨāļĒ

  • āļŠāļ™āđƒāļˆāļŠāļ­āļšāļ–āļēāļĄāđāļĨāļ°āļ‹āļ·āđ‰āļ­ Server  āļ„āļĨāļīāļāđ€āļĨāļĒ
  • āļ‹āļ·āđ‰āļ­āļŠāļīāļ™āļ„āđ‰āļēāļœāđˆāļēāļ™ Application āļĢāļąāļšāļŠāđˆāļ§āļ™āļĨāļ”āđ€āļžāļīāđˆāļĄÂ āļ„āļĨāļīāļāđ€āļĨāļĒ
  • LINE: @2beshop
  • āđ‚āļ—āļĢ 02-1186767

By admin