FeelIT

Cloud

무한한 확장성과 강력한 성능, 데이터 비즈니스의 가속도를 더합니다.

AI/GPU

NVIDIA H100/A100 등 고성능 GPU로 AI워크로드를 가속하세요. 여러 클라우드 벤더의 GPU 특징을 비교하여 고객에게 맞춤형 AI CLOUD 서비스를 제공합니다.

최신 GPU 자원과 고성능 연산 아키텍처를 통해 빠르게 변화하는 AI 모델 학습 및 대규모 데이터 분석의 속도를 극대화합니다. 복잡한 워크로드 설계부터 성능 최적화까지, 필아이티의 전문 엔지니어링이 고객사의 기술 혁신을 가속화합니다.

GPU 라인업

  • 항목
  • 메모리 용량 / 종류
  • 메모리 대역폭
  • FP32 연산 성능
  • FP16 Tensor 성능
  • FP8 Tensor 지원
  • 인터커넥트 (NVLink)
  • 최대 소비 전력 (TDP)
  • 핵심 기술
  • 용도
  • 항목 V100
  • 메모리 용량 / 종류 16GB / 32GB HBM2
  • 메모리 대역폭 약 900 GB/s
  • FP32 연산 성능 15.7 TFLOPS
  • FP16 Tensor 성능 125 TFLOPS
  • FP8 Tensor 지원 미지원
  • 인터커넥트 (NVLink) NVLink 2.0 (300 GB/s)
  • 최대 소비 전력 (TDP) 300W ~ 350W
  • 핵심 기술 1세대 Tensor 코어
  • 용도 가벼운 딥러닝 모델 학습·추론
  • 항목 A100
  • 메모리 용량 / 종류 40GB / 80GB HBM2e
  • 메모리 대역폭 약 1.6 ~ 2.0 TB/s
  • FP32 연산 성능 19.5 TFLOPS
  • FP16 Tensor 성능 312 TFLOPS
  • FP8 Tensor 지원 미지원
  • 인터커넥트 (NVLink) NVLink 3.0 (600 GB/s)
  • 최대 소비 전력 (TDP) 400W
  • 핵심 기술 MIG(멀티 인스턴스 GPU)
  • 용도 AI 모델 학습, 대용량 데이터 분석
  • 항목 H100
  • 메모리 용량 / 종류 80GB HBM3
  • 메모리 대역폭 약 3.35 TB/s
  • FP32 연산 성능 67 TFLOPS
  • FP16 Tensor 성능 1,979 TFLOPS
  • FP8 Tensor 지원 지원 (3,958 TOPS)
  • 인터커넥트 (NVLink) NVLink 4.0 (900 GB/s)
  • 최대 소비 전력 (TDP) 최대 700W (SXM 기준)
  • 핵심 기술 Transformer Engine, DPX 지시어
  • 용도 초거대 언어모델(LLM)과 생성형 AI

주요 특징

  • 01 GPU 수급 안정성 확보

    H100 등 고성능 GPU는 여전히 글로벌 수급이 불안정합니다. 필아이티는 AWS, NCP, Tencent 등 복수 벤더의 GPU 인스턴스를 확보하고 있어, 특정 벤더의 재고 부족 상황에서도 대체 리소스를 빠르게 배정합니다.

  • 02 즉시 사용 가능한 ML 환경

    CUDA, cuDNN, PyTorch, TensorFlow 등 주요 ML 프레임워크가 사전 설치된 환경을 제공합니다. GPU 드라이버 설정, 라이브러리 호환성 문제로 시간을 낭비할 필요 없이, 인스턴스 생성 즉시 학습을 시작할 수 있습니다.

  • 03 벤더별 GPU 비용 비교

    동일한 H100이라도 벤더마다 시간당 단가, 예약 할인율, 스팟 가격이 다릅니다. 필아이티가 실시간 가격을 비교 분석하여 동일 성능 대비 가장 비용 효율적인 조합을 추천합니다. 학습과 추론을 서로 다른 벤더에서 운영하는 전략도 가능합니다.

  • 04 탄력적 스케일링

    AI 워크로드는 학습 시 대규모 GPU가 필요하지만, 추론이나 유휴 시간에는 최소 리소스만 있으면 됩니다. 학습 기간에만 8x H100 클러스터를 확장하고, 완료 후 즉시 축소하여 불필요한 비용을 제거합니다.

기업의 상황에 맞춰 추천드립니다

어떤 GPU를 몇 장 써야하는지 부터 함께 고민합니다.
모델 규모와 예산을 알려주시면 벤더별 견적을 비교해 최적의 구성을 설계하고, 학습환경 세팅부터 운영까지 전담 지원합니다.

자체 AI 모델을 만들고 싶은 스타트업

오픈소스 LLM(Llama등)을 자사 도메인 데이터로
파인튜닝하여 커스텀 AI 서비스를 만들고 싶으신가요?

GPU 수급 지원
시간 단축을 위한 인프라 세팅 지원

AI 기능을 서비스에 넣으려는 기업

이미 학습된 모델을

실시간 API로 서비스하고 계신가요?

트래픽 맞춤 GPU 리소스 조절
비용 최적화 지원

자세한 상담을 원하시나요?

문의를 남겨주세요!
실무 경험을 가진 각 분야의 전문 인력들이 빠르게 답변 드리겠습니다.