Replicate
오픈소스 AI 모델을 API로 실행하고 파인튜닝·배포까지 한 줄 코드로 해결하는 클라우드 플랫폼
최종 확인 2026. 10. 5.
개요
Replicate는 수천 개의 오픈소스 머신러닝 모델을 클라우드 API로 즉시 실행할 수 있게 해주는 서비스다. 이미지·비디오·음성 생성, 이미지 복원, 캡셔닝, 대형 언어 모델 추론 등 다양한 작업을 별도 인프라 구축 없이 한 줄 코드로 호출할 수 있다.
공개 모델 라이브러리에는 Flux, Imagen, GPT-Image, Recraft, Nano Banana, Seedream, DeepSeek 등 최신 모델이 계속 추가되며, 각 모델 페이지에서 예상 비용과 실행 예시를 확인할 수 있다. 커스텀 모델이 필요하면 오픈소스 도구 Cog로 패키징해 프라이빗 모델로 배포 가능하다.
요금은 사용한 만큼만 내는 종량제다. 공개 모델은 요청을 실제 처리한 활성 시간(또는 입출력 단위)만 과금하고 설정·대기 시간은 무료다. 프라이빗 모델은 전용 하드웨어를 쓰므로 설정·유휴·처리 시간 모두 과금된다(빠른 부팅 파인튜닝 제외). 하드웨어별 초당·시간당 단가표가 공개돼 있어 비용 추정이 가능하다.
2026년 4월에는 코딩 어시스턴트(Claude Code, OpenAI Codex 등)가 Replicate API를 더 잘 쓰도록 돕는 '에이전트 스킬'을 공개했고, 3월에는 Nano Banana Pro가 레이트 리밋 시 Seedream 5.0 lite로 자동 폴백하는 기능을 추가해 가용성을 높였다.
주요 기능
- 오픈소스 모델 API로 즉시 실행
- 모델 파인튜닝 지원
- Cog로 커스텀 모델 패키징·배포
- 이미지·비디오·음성·텍스트 생성 및 복원
- 사용량 기반 종량제 요금(공개 모델은 활성 시간만 과금)
- 전용 하드웨어 프라이빗 모델 배포
- 에이전트 스킬로 코딩 어시스턴트 연동 강화
- Nano Banana Pro 폴백 모델 자동 전환
장점
- 방대한 오픈소스 모델 라이브러리 보유
- 간단한 API로 인프라 없이 즉시 사용 가능
- 사용한 만큼만 지불하는 투명한 요금 체계
- 파인튜닝부터 배포까지 단일 워크플로 제공
- 에이전트 스킬로 개발 생산성 향상
단점
- 모델별 요금 체계 달라 비용 예측 어려움
- 프라이빗 모델은 유휴 시간에도 요금 발생
- 공용 하드웨어 풀 공유 시 대기열 발생 가능
- 일부 독점 모델은 별도 계약 필요
- 엔터프라이즈급 SLA·전용 지원은 별도 문의
가격 상세
프리미엄공개 모델은 요청 처리 시간(초당) 또는 입출력 토큰·이미지 단위로만 과금하며 설정·대기 시간은 무료다. 비공개 모델은 전용 하드웨어를 써서 설정·유휴·처리 시간 모두 과금(빠른 부팅 파인튜닝 제외). 하드웨어별 초당/시간당 요금표 제공(예: CPU Small $0.09/시, A100 80GB $5.04/시, H100 $5.49/시). 기업용 별도 계약 가능. 선불 크레딧 또는 후불 정산 방식 선택 가능.
자주 묻는 질문
- 무료로 체험할 수 있나요?
- 홈페이지에 'Try for free' 버튼이 있으며, 선불 크레딧 방식으로 소액부터 시작해 테스트할 수 있습니다.
- 요금은 어떻게 계산되나요?
- 공개 모델은 활성 처리 시간(초당) 또는 입출력 단위(이미지·토큰)로만 청구되고, 비공개 모델은 전용 하드웨어의 설정·유휴·처리 시간 전체가 과금됩니다(빠른 부팅 파인튜닝 제외).
- 직접 만든 모델을 올릴 수 있나요?
- 오픈소스 도구 Cog로 모델을 패키징하면 프라이빗 모델로 배포해 전용 하드웨어에서 실행할 수 있습니다.
- 최근 추가된 주요 기능은 무엇인가요?
- 2026년 4월 코딩 어시스턴트용 에이전트 스킬 공개, 3월 Nano Banana Pro 레이트 리밋 시 Seedream 5.0 lite로 자동 폴백 기능 추가.
마지막 확인:
출처