MoneyPrinterTurbo 주제나 사용자 정의 스크립트를 짧은 비디오로 변환하는 오픈 소스 제작 파이프라인입니다. 내레이션 생성, 영상 검색어 추출, 스톡 클립 검색, 음성, 시간 및 스타일 자막 합성, 음악 추가, 세로 또는 가로 비디오 렌더링, 여러 변형 생성, 선택적으로 TikTok, Instagram 및 YouTube Shorts에 게시할 수 있습니다.
자율적인 편집팀이 아닌 조립 시스템으로 이해하는 것이 가장 좋습니다. 대규모 언어 모델은 그럴듯하지만 잘못된 주장을 작성할 수 있습니다. 스톡 검색에서는 시각적으로 관련이 있지만 의미상 잘못된 영상이 반환될 수 있습니다. 텍스트 음성 변환은 이름을 잘못 발음할 수 있습니다. 기술적으로 성공적인 렌더링에도 여전히 속도가 약하거나 권리가 불분명할 수 있습니다. 실제 이점은 WebUI, API, CLI 및 에이전트 기술을 통해 파이프라인을 검사하고 사용자 정의할 수 있도록 한다는 것입니다.
현재 프로젝트에 포함된 내용
| 무대 | 현재 능력 | 인간의 책임 |
|---|---|---|
| 스크립트 | 여러 언어로 된 AI 생성 또는 사용자 제공 스크립트 | 출처 조사, 사실 검토, 어조 및 공개 |
| 시각적 검색 | 로컬 미디어와 Pexels, Pixabay 및 Coverr 검색 | 라이센스 증거, 주제 정확성 및 시각적 연속성 |
| 음성 | Edge TTS, Azure Speech, SiliconFlow, Gemini, MiMo, ElevenLabs 및 Chatterbox | 동의, 발음, 제공자 조건 및 음성 품질 |
| 자막 | TTS 타임스탬프 또는 로컬 faster-whisper 전사; 구성 가능한 스타일 | 교정, 타이밍, 줄 바꿈 및 접근성 |
| 오디오 | 볼륨 조절이 가능한 무작위 또는 선택된 배경 음악 | 음악 라이센스 및 이해하기 쉬운 내레이션 믹스 |
| 렌더링 | 1080×1920에서 9:16 및 1920×1080에서 16:9, 클립 지속 시간 제어 및 일괄 처리 | 페이싱, 안전 지대, 압축 및 장치 QA |
| 출판 | 세 가지 소셜 플랫폼에 대한 선택적 Upload-Post 통합 | 계정 보안, 최종 승인, 캡션 및 플랫폼 규정 준수 |
공급자를 선택하기 전에 워크플로를 선택하세요
저장소는 Kimi/Moonshot, OpenAI, Gemini, DeepSeek, Qwen, Azure OpenAI, xAI Grok, MiniMax을 포함한 클라우드 LLM, 게이트웨이 및 로컬 서비스를 지원합니다. Ollama, OneAPI 및 LiteLLM. 공급자 목록이 길다고 해서 모든 조합이 동일하게 유지된다는 의미는 아닙니다. 지원되는 하나의 구성으로 시작하고, 알려진 양호한 샘플을 유지하고, 한 번에 하나의 레이어를 변경하십시오.
| 작업 흐름 | 추천 출발점 | 주요 절충안 |
|---|---|---|
| 빠른 프로토타입 | Cloud LLM, Edge TTS, 온라인 스톡 및 타임스탬프 자막 | 가장 낮은 설정이지만 프롬프트와 검색어는 컴퓨터에서 나갑니다. |
| 품질 내레이션 | 검토된 스크립트, 프리미엄 TTS 및 발음 사전 | 더 높은 API 비용 및 음성/유사성 정책 작업 |
| 지역에 민감한 | Ollama, 로컬 자산, 자체 호스팅 Chatterbox 및 faster-whisper | 더 많은 하드웨어, 유지 관리 및 느린 실행 |
| 높은 볼륨 | API/CLI, 고정 구성, 미디어 캐시 및 배치 렌더링 대기열 | 관찰 가능성, 동시성 제한 및 편집 샘플링이 필요합니다. |
| 브랜드 캠페인 | 맞춤형 스크립트, 승인된 영상/음악/글꼴 라이브러리 및 수동 게시 게이트 | "원클릭"은 줄어들지만 권리 및 평판 위험은 훨씬 낮습니다. |
설치 및 운영 요구 사항
현재 README에서는 Windows 10, macOS 11 또는 주류 Linux 배포판과 Python 3.11 이상을 권장합니다. 최소 4개의 CPU 코어와 4GB RAM, 권장 사항으로 6~8개의 코어와 8GB RAM이 나열되어 있으며 GPU는 선택 사항이라고 나와 있습니다. GPU는 faster-whisper, 일괄 작업 및 더 무거운 로컬 처리에 유용합니다. 클라우드 중심 워크플로는 CPU, 메모리 및 네트워크 안정성에 더 많이 의존합니다.
배포 옵션에는 Windows 패키지, uv 기반 로컬 설치, Docker Compose, Google Colab, WebUI, API 및 CLI가 포함됩니다. 권장 컨테이너 명령은 GitHub Container Registry의 사전 빌드된 이미지를 사용합니다. 추적 대신 프로덕션에 릴리스 또는 이미지 다이제스트 고정 최신. 종속성과 컨테이너를 스캔하고, 이미지 외부에 구성을 저장하고, 인증된 네트워크 액세스가 의도적으로 구성되지 않은 한 WebUI를 localhost에 바인딩합니다.
| 방법 | 다음에 가장 적합 | 추가 제어 |
|---|---|---|
| 윈도우 패키지 | 빠른 개별 평가 | 공식 릴리스를 확인하고 평가판 기간 동안 민감한 API 키를 사용하지 마세요. |
| uv 로컬 설치 | 재현 가능한 Python 종속성이 필요한 개발자 | 잠금 파일, 격리된 환경 및 고정 커밋 사용 |
| 도커 | 반복 가능한 서비스 또는 팀 배포 | 다이제스트 고정, 포트 제한, 최소 볼륨 마운트, 루트가 아닌 사용자 실행 |
| 코랩 | 로컬 설정 없이 임시 실험 | 기밀 자산을 업로드하거나 노트북에 비밀을 유지하지 마십시오. |
| API/CLI | 자동화 및 배치 통합 | 인증, 대기열 제한, 멱등성 및 구조화된 로그 |
오류를 조기에 포착하는 생산 워크플로
- 청중과 주장을 정의하십시오. 하나의 결과, 대상 플랫폼, 기간, 언어 및 클릭 유도 문구를 작성합니다.
- 세대 이전에 연구하세요. 주의 사항이 필요한 날짜, 인용문, 숫자 및 주장이 포함된 원본 시트를 작성하세요.
- 스크립트를 잠급니다. 큰 소리로 읽고, 뒷받침되지 않는 진술을 제거하고 발음을 표시하세요.
- 촬영 목록을 만듭니다. 느슨하게 관련된 스톡 영상을 받아들이는 대신 모든 문장에 시각적인 목적을 부여하세요.
- 저렴한 초안을 생성하세요. 하나의 음성, 더 적은 변형 및 짧은 클립을 사용하여 구조를 검증합니다.
- 자산 및 라이선스를 검토합니다. 모든 외부 클립 및 트랙에 대한 소스 URL, 기여자, 다운로드 날짜 및 해당 라이센스를 기록하십시오.
- 내레이션과 자막을 검토하세요. 이름, 번호, 타이밍, 줄 길이 및 화자 강조를 수정하세요.
- 의도적으로 변형을 렌더링합니다. 후크, 음성, 속도, 영상 등 모든 변수를 한꺼번에 변경하는 것이 아니라 하나의 변수를 변경하세요.
- 최종 플랫폼 QA를 수행합니다. 전화기에서 소리를 켜고 끄면서 시청하세요. 안전 영역과 압축을 검사합니다.
- 먼저 수동으로 게시하세요. 승인, 롤백 및 계정 제어가 입증된 후에만 자동 업로드를 활성화합니다.
영상 라이선스에는 자산별 증거가 필요합니다.
README에서는 Pexels, Pixabay 및 Coverr을 무료 고화질 자산의 소스로 설명합니다. "무료"는 무제한과 동일하지 않습니다. 라이센스 조건은 변경될 수 있으며 로고, 인식할 수 있는 사람, 재산, 민감한 상황, 재배포 또는 독립형 재판매에 대한 규칙을 부과할 수 있습니다. 다운로드한 각 자산에 대해 단순히 스톡 사이트에서 가져온 것이라는 메모뿐 아니라 정확한 소스 및 라이선스 상태를 유지하세요.
자동 의미 일치는 명예 훼손 또는 오해의 소지가 있는 조합을 만들 수도 있습니다. 즉, 사기, 질병 또는 범죄에 대한 설명 아래에 무작위로 식별 가능한 사람이 나타날 수 있습니다. 지원되지 않는 신원, 위치 또는 원인을 암시하는 영상을 거부하세요. 주제가 민감할 경우 추상적이거나 독창적인 시각 자료를 사용하세요.
번들로 제공되는 샘플 음악이 YouTube에서 가져온 저장소 메모에는 침해가 있으면 제거하라고 나와 있습니다. 이 경고는 상업 출판 전에 번들 트랙을 자신의 문서화된 라이브러리로 대체하는 이유입니다. 마찬가지로 글꼴에도 별도의 라이선스가 있습니다. 저장소에 포함된다고 해서 모든 방송 또는 상업적 권리가 반드시 부여되는 것은 아닙니다.
스크립트 및 시각적 품질 기준표
| 차원 | 합격조건 | 일반적인 자동 오류 |
|---|---|---|
| 후크 | 첫 순간의 구체적인 약속이나 긴장감 | 일반 “빠르게 변화하는 오늘날의 세상에서” 오프닝 |
| 증거 | 모든 사실적 주장은 현재 출처에 매핑됩니다. | 자신 있게 조작된 통계 또는 오래된 사실 |
| 샷 관련성 | 정확한 문장이나 의도적인 은유를 보여주는 영상 | 잘못된 개체, 국가 또는 활동과 키워드 일치 |
| 간격 | 클립 변경은 시청자를 지치게 하지 않으면서 의미를 지원합니다. | 고정 기간 단축은 문장 리듬을 무시합니다. |
| 음성 | 이름, 약어 및 숫자는 자연스럽습니다. | 잘못된 발음 또는 감정적 불일치 |
| 자막 | 정확하고 읽기 쉬우며 플랫폼 안전 구역 내부 | 잘못된 줄 바꿈, 타이밍 드리프트 또는 숨겨진 하위 텍스트 |
| 오디오 믹스 | 휴대전화 스피커에서는 내레이션을 계속해서 이해할 수 있습니다. | 음악은 전환 시 자음이나 클립을 마스크합니다. |
| 권리 | 자산, 음악, 글꼴, 음성 및 초상 증거가 보관됩니다. | 검색 공급자 가용성이 권한과 같다고 가정 |
자막 타이밍: 빠름 vs 정확
기본 에지 방법은 TTS 타임스탬프를 사용하고 GPU가 필요하지 않으며 빠릅니다. 속삭임 방법은 로컬 faster-whisper을 사용하여 렌더링된 오디오를 기록하고 실제 전달을 더 잘 반영할 수 있지만 모델을 다운로드하고 컴퓨팅을 추가합니다. 문서화된 기본 Whisper 모델은 대략 3GB입니다. Large-v3-turbo는 약 1.6GB의 더 작고 빠른 대안으로 설명됩니다. 더 큰 모델이 항상 더 읽기 쉬운 캡션을 생성한다고 가정하기보다는 언어, 이름 및 음악으로 테스트하십시오.
어떤 경로를 사용하든 자동화된 타임스탬프는 초안입니다. 줄을 제한하고 이름이나 문법 단위가 분리되지 않도록 하며 캡션이 읽을 수 있을 만큼 길게 유지되도록 하세요. 다국어 출력의 경우 TTS 전에 스크립트를 번역하고 검토하십시오. 완성된 자막을 번역하면 타이밍이 깨지고 프레임당 텍스트 양이 부풀려질 수 있습니다.
보안 및 개인 정보 보호 경계
구성에는 LLM, 음성, 스톡 미디어 및 게시 API 키가 포함될 수 있습니다. config.toml을 커밋하거나 지원 스크린샷에서 공유하거나 공용 컨테이너 레이어에 굽지 마세요. 별도의 제한된 자격 증명, 공급자 예산 및 순환을 사용하십시오. WebUI 또는 API 포트가 localhost 외부에 노출되는 경우 인증, TLS, 네트워크 제한 및 속도 제한을 추가하세요. 비디오 생성 엔드포인트는 비용, 디스크 및 CPU를 소비할 수 있습니다.
자동 게시는 특히 중요합니다. 문서화된 Upload-Post 구성은 렌더링 후 생성된 비디오를 공개할 수 있습니다. YouTube 공개 상태를 비공개 또는 미등록으로 설정하고 명시적인 승인 게이트가 존재할 때까지 자동 업로드를 비활성화 상태로 유지하세요. 성공적인 렌더링은 게시 권한과 동일해서는 안 됩니다.
총 생산 경제성 측정
소프트웨어는 MIT 라이선스를 받았지만 실행 시 LLM, TTS, 스톡 API, 프록시, 게시, 컴퓨팅, 저장 및 검토 비용이 발생할 수 있습니다. 당 비용 측정 수락됨 렌더링 당이 아닌 비디오. 거부된 변형과 편집자 시간을 포함합니다. 단 하나의 사용 가능한 결과로 10개의 초안을 생성하는 파이프라인은 10배 더 생산적이지 않습니다.
| 미터법 | 공식 | 그것이 드러내는 것 |
|---|---|---|
| 합격률 | 게시된 후보 ¼ 렌더링된 후보 | 약한 프롬프트, 자산 또는 목소리로 인한 낭비 |
| 교정 시간 | 허용된 분당 사람이 편집하는 시간(분) | 자동화가 실제 노동력을 감소시키는지 여부 |
| 가변비용 | 모든 API 및 계산 지출 ¼ 허용된 동영상 | 공급자 및 변형 경제학 |
| 권리보장 | 증거가 있는 자산 ¼ 사용된 외부 자산 | 상업 출판 준비 |
| 청구 정확성 | 확인된 사실 주장 ¼ 사실 주장 | 편집의 신뢰성 |
| 보유 가치 | 템플릿별 플랫폼 시청 시간 및 완료율 | 처리량이 높을수록 청중의 결과가 향상되는지 여부 |
대안
| 옵션 | 최적의 핏 | 트레이드오프 |
|---|---|---|
| MoneyPrinterTurbo | 개방적이고 사용자 정의 가능한 스톡 영상 비디오 자동화 | 설정 및 편집/법적 통제는 귀하의 소유입니다. |
| CapCut | 빠른 작성자 편집, 템플릿 및 수동 다듬기 | 덜 프로그래밍 가능한 엔드투엔드 자동화 |
| Adobe Premiere Pro | 전문적인 편집, 오디오, 색상 및 전달 관리 | 더 높은 기술과 수동 생산 시간 |
| Descript | 대본 기반 편집, 음성 및 공동 검토 | 호스팅된 상업용 워크플로우 및 다양한 사용자 정의 모델 |
| Runway | 스톡 조립이 아닌 생성적 비디오 샷 | 높은 발전 비용 및 일관성 문제 |
| 커스텀 FFmpeg 파이프라인 | 정확한 결정론적 미디어 요구 사항을 갖춘 팀 | 더 많은 엔지니어링을 제공하지만 최대의 제어 및 감사 가능성 |
자주 묻는 질문
GPU가 필요합니까?
아니요. 프로젝트에서는 클라우드가 많은 워크플로가 클라우드 없이도 실행될 수 있다고 말합니다. GPU는 faster-whisper, 일괄 생성 및 더 무거운 로컬 처리를 지원합니다.
내 스크립트와 미디어를 사용할 수 있나요?
그렇습니다. 사용자 정의 스크립트와 로컬 자산이 지원되며 브랜드 및 권리 관리에 선호되는 경우가 많습니다.
생성된 모든 동영상은 수익을 창출해도 안전한가요?
아니요. 모든 주장, 저작물, 트랙, 글꼴, 음성, 유사성 및 플랫폼 규칙을 검토하세요. 오픈 소스 코드 라이선스는 출력 입력을 지우지 않습니다.
여러 언어를 지원하나요?
다국어 스크립트와 여러 TTS 제공자를 지원하지만 출력 품질은 선택한 모델, 음성, 용어 및 기본 리뷰에 따라 다릅니다.
자동 게시를 활성화해야 합니까?
수동 워크플로를 통해 최종 승인, 자격 증명 보안, 플랫폼 설정, 롤백 및 사고 처리가 검증된 후에만 가능합니다.
가장 좋은 첫 번째 테스트는 무엇입니까?
검증된 스크립트로 20~30초 길이의 비디오 하나를 제작하고, 모든 자산 라이선스를 기록하고, 수정 시간을 측정하고, 이를 기존 편집 작업 흐름과 비교합니다.
1차 소스
- 공식 저장소 및 현재 기능 문서
- 공식 영어 읽어보기
- 공식 MIT 라이센스
- 공식 릴리스
- Pexels 라이센스
- Pixabay 라이선스 요약
- Coverr 라이센스
- 변경되거나 합성된 콘텐츠에 대한 YouTube 공개 지침
2026년 7월 25일에 마지막으로 검토되었습니다. 공급자 지원, 종속성, 플랫폼 APIs 및 소스 라이선스가 변경되었습니다. 배포된 개정을 고정하고 생산 전에 모든 외부 조건을 다시 확인하세요.




