도구 등록 →
Replicate logoR

Replicate

제작사: Replicate

간단한 API로 오픈 모델을 실행하고 파인튜닝.

모델 API & 인프라 사용량 기반, 컴퓨팅 사용 시간(초) 단위로 과금

어떤 도구일까, Replicate?

Replicate는 이미지, 비디오, 오디오, 언어 모델 등 오픈소스 머신러닝 모델을 직접 GPU 인프라를 구축하지 않고도 간단한 API로 손쉽게 실행할 수 있게 해주며, 자체 커스텀 모델의 파인튜닝과 배포도 지원합니다.

주요 기능

  • 바로 실행 가능한 방대한 오픈소스 모델 카탈로그
  • 초 단위로 과금되는 간단한 API, 유휴 인프라 비용 없음
  • 인기 오픈 모델을 커스터마이징할 수 있는 파인튜닝 지원
  • 자체 커스텀 모델을 패키징하고 배포할 수 있는 기능
  • 연동 전에 모델을 테스트해볼 수 있는 웹 플레이그라운드

시작하는 방법

  1. replicate.com에서 가입하고 API 토큰 발급받기
  2. 모델 카탈로그를 둘러보고 웹 플레이그라운드에서 테스트하기
  3. 애플리케이션에서 API로 모델 호출하기
  4. 카탈로그에 맞는 모델이 없다면 커스텀 모델을 파인튜닝하거나 배포하기

Replicate 요금

No monthly platform fee. September 2026 official hardware: T4 $0.81/hr, L40S $3.51/hr, A100 80GB $5.04/hr, H100/H200 $5.49/hr, billed per second.

Public models: processing time only. Private models and Deployments: setup + idle + processing.

Some LLMs bill per token. Check each model page.

요금제가격이런 사람에게 추천
Public modelHardware × seconds busyPrototypes and spiky traffic
T4$0.000225/sec ($0.81/hr)Light vision / small models
A100 80GB$0.001400/sec ($5.04/hr)Heavier image or mid LLMs
H100 / H200$0.001525/sec ($5.49/hr)Fast large models; deadly if left warm
Private / DeploymentSame rates while onlineIsolation — budget idle hours

AIKetra의 평가: Stay on public models until you have a latency SLA. The first production mistake is a min-1 H100 Deployment 'just to be safe'. That is a rent, not an API.

가격은 자주 바뀝니다. 결정하기 전에 위 공식 웹사이트에서 최신 정보를 확인하세요.

활용 사례

  • API로 이미지, 비디오, 오디오 생성 모델 실행
  • 로컬 GPU 구축 없이 다양한 오픈소스 모델 테스트
  • 기존 오픈 모델을 자체 데이터로 파인튜닝
  • 서버 관리 없이 커스텀 모델 배포

Replicate 비교

도구비교 포인트
Replicate간단한 API로 오픈 모델을 실행하고 파인튜닝.
Together AI대규모 LLM 호스팅에 더 집중
Hugging Face더 폭넓은 모델·데이터셋 생태계

자주 묻는 질문

Replicate, 무료로 쓸 수 있을까요?

Replicate 요금제: 사용량 기반, 컴퓨팅 사용 시간(초) 단위로 과금. 가격과 무료 요금제 한도는 계속 바뀌므로 최신 정보는 위 공식 웹사이트에서 확인하세요.

Replicate, 어디에 쓰는 도구인가요?

간단한 API로 오픈 모델을 실행하고 파인튜닝.

Replicate, 누구에게 잘 맞을까요?

Replicate 추천 대상: API로 이미지, 비디오, 오디오 생성 모델 실행.

Replicate, 대안이 있을까요?

자주 비교되는 대안: Together AI 및 Hugging Face. 차이는 위 비교표를 참고하세요.

Replicate, 요금은 얼마인가요?

You pay per second of the hardware the model uses. A T4 is $0.81/hour, an H100 is $5.49/hour. Public catalog models only bill while they run your request. A private or deployed instance also bills idle time.

관련 도구

최종 검토일: 2026-09 · AIKetra 편집팀이 검토했습니다 · 평가 기준