무엇을 하시나요?
원하는 작업부터 선택하세요
내 GPU를 선택하면 바로 계산을 시작합니다
VRAM과 대역폭을 기준으로 실행 가능한 AI 모델과 예상 속도를 바로 계산합니다.
내 실행 환경
GPU를 선택해 주세요
선택 즉시 현재 환경에 맞는 모델을 계산합니다.
기본 하드웨어
보조 GPU 선택
서로 다른 GPU를 함께 쓰는 경우 메모리 분할·통신 손실을 보수적으로 반영합니다.
메모리 보정
고급 도구
Hugging Face 공개 LLM 직접 계산
여러 모델 함께 돌리기
AI 스택 배치 플래너
LLM·임베딩·리랭커·OCR/VLM을 보유 GPU에 나눠 배치합니다.
사용 가이드
처음에는 균형형으로 시작하세요
- RAG·문서 AI·여러 LLM 중 가까운 구성을 선택합니다.
- 보유 GPU와 동시에 실행할 모델을 확인합니다.
- 운영 방식과 목표 동시 사용자를 정합니다.
- 배치 계산 후 병목과 세 가지 대안을 비교합니다.
- 파이프라인
- 한 요청이 여러 모델을 순서대로 사용
- 독립 서비스
- 모델마다 별도 API와 사용자를 운영
- 순차 실행
- 설치해 두고 한 번에 하나만 실행
결과는 계산 추정치입니다. 실제 운영 전에는 내 환경에서 검증하세요.
처음이라면 여기서 시작하세요
AI 스택을 GPU에 배치해 보세요
보유 GPU와 함께 실행할 모델을 선택하면 GPU별 배치, 권장 동시 접속, 예상 처리량, 병목과 개선 방법을 계산합니다.
- 1하드웨어
- 2모델 선택
- 3운영 목표
- 4배치 결과
1
보유 GPU 목록
하드웨어보유한 GPU와 수량을 입력하세요.
2
동시에 띄울 모델 검색 후 클릭해서 선택 (여러 종류 섞어서 선택 가능)
모델 선택검색하거나 워크로드 종류를 골라 함께 실행할 모델을 추가하세요.
3
운영 방식
운영 목표기본 목표 세 가지만 선택하면 계산할 수 있습니다.
세부 조건
4
배치 결과결론과 배치안을 먼저 보고, 필요할 때 계산 상세를 펼치세요.
계산 상세 보기
GPU에 맞는 모델 3개를 바로 추천합니다
위에서 GPU를 선택하고 용도와 우선순위를 고르면 현재 워크로드의 실행 가능한 모델만 추립니다.
현재 GPU
GPU 선택 필요