harry0703/MoneyPrinterTurbo — 利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.
MoneyPrinterTurbo — 주제나 키워드로 짧은 영상을 자동 생성하는 AI 도구
MoneyPrinterTurbo는 주제나 키워드를 입력하면 대본, 영상 소재, 음성, 자막, 배경음악을 구성해 짧은 영상을 만드는 오픈소스 프로젝트입니다. WebUI, API, CLI를 지원하며 여러 모델과 소재 공급자를 연결하고, 배치 생성과 TikTok·Instagram·YouTube Shorts 업로드도 제공합니다.
- 주제
AI 요약
MoneyPrinterTurbo는 영상 주제나 키워드에서 출발해 대본 작성부터 소재 검색, 음성 합성, 자막 생성, 배경음악과 편집까지 이어지는 자동화 작업 흐름을 제공합니다. 각 단계에 직접 만든 대본이나 로컬 이미지·영상을 넣을 수도 있습니다.
모델과 영상 생성
대본 작성에는 OpenAI, Anthropic Claude, Google Gemini, DeepSeek, Kimi 등 여러 LLM 제공자를 연결합니다. 영상 소재는 Pexels, Pixabay, Coverr의 스톡 영상이나 사용자가 올린 파일을 쓸 수 있습니다. MiniMax H3, Seedance, Wan 등 여러 문生영상(Text-to-Video) 서비스와 OpenAI 호환 이미지 생성 API도 지원합니다. 생성한 영상은 9:16, 16:9, 1:1 화면비로 구성할 수 있고, 음성 합성에는 Edge TTS와 Azure Speech, ElevenLabs 등 여러 공급자를 선택합니다.
실행 방식과 배포
AI Agent, WebUI, API, CLI 네 가지 실행 방식을 제공합니다. Python 3.11 이상 환경에서 uv로 의존성을 설치하거나 Docker Compose로 실행할 수 있습니다. WebUI는 기본적으로 8501 포트를 사용하며, API 문서는 8080 포트에서 확인합니다. 별도 프런트엔드에서 API를 호출할 때만 신뢰하는 출처를 CORS_ALLOWED_ORIGINS에 설정하면 됩니다.
CLI에서는 uv run python cli.py --video-subject "주제"처럼 영상 생성을 요청합니다. JSON 또는 JSONL 배치 파일로 최대 100개 작업을 순차 실행할 수 있으며, 각 작업은 기본 인자를 덮어쓸 수 있습니다. 작업을 시작하기 전에 입력값과 로컬 파일을 점검하고, 개별 작업이 실패해도 나머지 작업을 이어간 뒤 JSON 요약을 출력합니다.
자막과 시스템 요구사항
자막은 TTS 시간 정보를 쓰는 edge 모드와 faster-whisper로 음성을 전사하는 whisper 모드 중에서 고릅니다. Whisper는 로컬 모델 다운로드가 필요하며, GPU는 필수가 아니지만 로컬 전사나 대량 처리에서는 속도 향상에 도움이 됩니다. 완성한 영상은 TikTok, Instagram, YouTube Shorts에 자동 업로드할 수 있습니다.
원문: GitHub / 번역·요약: Trawling