Files

25 KiB
Raw Permalink Blame History

AutoClip

AutoClip

Un enlace. Un clic.

Código abierto, con corte y render en tu ordenador. Pega un enlace, elige plataforma y genera vídeo, portada y texto,
para Douyin, Xiaohongshu, TikTok, Reels, YouTube Shorts, Bilibili o YouTube.
La app es gratis; los modelos cloud cobran por uso. Puedes ajustar el resultado en el editor.

GitHub release GitHub stars Downloads License: MIT

AutoClip — GitHub Trending

Descargar escritorio · Casos · Inicio rápido · Documentación · Incidencia

简体中文 · English · 日本語 · 한국어 · Español · Português · Русский · Français

1.5.0 ya está publicado, con escritorio, CLI y MCP actualizados. El registro de cambios detalla la producción automática, paginación de subtítulos, encuadre y cola de vídeos largos. Actualiza versiones anteriores.

Clips reales

Haz clic en una imagen o en «Reproducir» para ver el clip completo. El idioma indicado es el de los subtítulos del resultado. Mostramos seis ejemplos; despliega la sección para ver otros diez.

Vertical · entrevista y pódcast a pantalla completa

Bill Gates — AI测试时竟会装傻?
Bill Gates
Entrevista · Douyin · Chino
▶ Reproducir 1:01 · Original
AI Experts Debate — We're Driving Toward a Cliff in the Fog
AI Experts Debate
Entrevista · Shorts · Inglés
▶ Reproducir 1:25 · Original
Tony Robbins — 风险极小,回报极大?
Tony Robbins
Pódcast a pantalla completa · Douyin · Chino
▶ Reproducir 1:45 · Original
Andrew Garfield × Amy Poehler — I Love Competition—but Hate Fake Casualness
Andrew Garfield × Amy Poehler
Pódcast a pantalla completa · Shorts · Inglés
▶ Reproducir 1:01 · Original

Horizontal · encuadre original

佟丽娅 × 鲁豫 — 舞蹈是我骨子里的东西
佟丽娅 × 鲁豫
Encuadre original · Bilibili · Chino
▶ Reproducir 1:41 · Original
Sam Altman — AI是文艺复兴,还是工业革命?
Sam Altman
Encuadre original · Bilibili · Chino
▶ Reproducir 2:02 · Original
Ver otros 10 clips reales
Adam Neumann — Success is how you feel one minute before death—full of love, no regret
Adam Neumann
Pódcast a pantalla completa · TikTok · Inglés
▶ Reproducir 0:59 · Original
小奇 × 鲁豫 — 想证明自己,又怕被注视
小奇 × 鲁豫
Entrevista · Douyin · Chino
▶ Reproducir 0:50 · Original
郭柯宇 × 鲁豫 — 演员的快感在创作过程 不在结果
郭柯宇 × 鲁豫
Entrevista · Douyin · Chino
▶ Reproducir 1:11 · Original
Willem Dafoe — Fake teeth made him feel lascivious and instantly became the character
Willem Dafoe
Pódcast a pantalla completa · TikTok · Inglés
▶ Reproducir 1:07 · Original
TIM × 罗永浩 — 红得快的网红 糊得更快
TIM × 罗永浩
Entrevista · Douyin · Chino
▶ Reproducir 1:05 · Original
Jensen Huang — AI是五层蛋糕 能源才是底层
Jensen Huang
Entrevista · Xiaohongshu · Chino
▶ Reproducir 1:17 · Original
Andrej Karpathy — AI还不能当实习生用 因认知能力严重不足
Andrej Karpathy
Entrevista · Douyin · Chino
▶ Reproducir 0:43 · Original
A20 Pro — 苹果芯片不是拼乐高
A20 Pro
Entrevista · Xiaohongshu · Chino
▶ Reproducir 2:00 · Original
Sylvester Stallone — 60岁写《洛奇》 是向衰老宣战
Sylvester Stallone
Entrevista · Douyin · Chino
▶ Reproducir 1:39 · Original
MrBeast — YouTube's first 5 seconds matter more than thumbnails
MrBeast
Pódcast a pantalla completa · TikTok · Inglés
▶ Reproducir 1:42 · Original

Vídeos, portadas y textos de publicación en la biblioteca de ejemplos →. Comparte tus clips. Los vídeos originales pertenecen a sus autores; estos clips se muestran solo como demostración.

Qué hace

Pega un enlace y listo

Genera según formato y duración de la plataforma. Cada plataforma produce automáticamente hasta 10 clips aptos mejor puntuados; el resto queda bajo demanda. Incluye portada, título, descripción, hashtags y paquete ZIP.

El empaquetado va incluido

Douyin / Xiaohongshu usan entrevista por defecto; TikTok / Reels / Shorts, pódcast a pantalla completa. Puedes elegir el diseño vertical sin cambiar el idioma de subtítulos y texto de la plataforma. Bilibili / YouTube son horizontales. El encuadre sigue al hablante y conserva escenas sin personas. El cierre de marca está activo por defecto y se desactiva en Ajustes; el texto copiado no lleva firma AutoClip.

Se queda en tu ordenador

Corte, encuadre y render son locales. Elige modelo de análisis y usa subtítulos del autor, Whisper / SenseVoice local o transcripción cloud configurada. CLI / MCP comparten el flujo de escritorio.

Tiempo y coste con vídeos reales

Son tres fuentes distintas medidas durante el desarrollo, no una comparación controlada del mismo vídeo. Los costes estiman el uso de texto de qwen-plus de entonces y excluyen ASR cloud, imágenes AI y servicios de publicación. La factura depende del proveedor.

Versión Original Salida Coste estimado del modelo de texto (CNY)
Nueva · con subtítulos Jensen · 1h43m (EN → Xiaohongshu) 7,5 min / 10 clips ¥0,09
Nueva · sin subtítulos TIM × Luo Yonghao · 2h52m (ZH → Douyin) 29,5 min / 10 clips ¥0,20
Anterior MrBeast · 2h06m (EN → TikTok) 65 min ¥0,64
Condiciones y registros

1 de octubre de 2026, el mismo Mac Apple Silicon. Los dos casos nuevos generaron 10 clips; el anterior, 33. Cambian tanto la fuente como la cantidad. Jensen usó subtítulos del autor; TIM, Whisper base local.

Los subtítulos del autor evitan transcribir. Sin ellos, elige ASR local o cloud. Plataformas y clips adicionales aumentan tiempo y consumo. Mediciones y cálculo (chino).

Elige modelos y flujo de datos

Corte y render se realizan en tu ordenador. El análisis cloud envía subtítulos y texto relevante; la comprensión visual o generación con referencias envía fotogramas necesarios, y la transcripción cloud envía audio. El análisis y la transcripción locales no necesitan la API cloud correspondiente. Los clips se suben a plataformas conectadas cuando eliges publicar. Analítica e informes de error se desactivan en Ajustes. Privacidad.

Inicio rápido

Quieres Usa Necesitas
Hacer clips en este equipo Escritorio macOS Apple Silicon o Windows x64
Autohospedar / Linux Docker Docker y Compose v2
Lotes / agentes CLI / MCP Python 3.10+ (3.11 recomendado) y FFmpeg

Escritorio

  1. Instala. Desde Releases. macOS Apple Silicon: .dmg. Windows 10 / 11 x64: -setup.exe. Python y FFmpeg van incluidos.
  2. Configura un modelo. Elige proveedor e introduce la API Key; selecciona un modelo de análisis disponible, prueba la conexión y guarda. Para modelos locales, carga un modelo e inicia Ollama / LM Studio primero.
  3. Enlace y plataforma. Empieza con una entrevista o pódcast con subtítulos y elige diseño vertical. Sin subtítulos, prepara Whisper / SenseVoice o configura transcripción cloud en Ajustes.
  4. Revisa y descarga. Comprueba subtítulos, encuadre y contenido, y guarda el paquete o conecta una cuenta para publicar. Genera alternativas si necesitas más clips.

Intel Mac / Linux pueden usar Docker o CLI. Consulta instalación y 1.5.0 Release para requisitos, primer inicio y alcance de validación.

Guía de instalación · Problemas

Docker / Web

git clone https://github.com/zhouxiaoka/autoclip.git
cd autoclip
cp env.example .env
mkdir -p data logs uploads
docker compose up -d --build

Abre la UI web. La API está al arrancar el backend. Guía Docker.

En Linux, si el montaje falla por permisos, corrige el dueño primero:

docker compose run --rm --no-deps --user root --entrypoint sh autoclip -c 'chown -R autoclip:autoclip /app/data /app/logs /app/uploads'
docker compose up -d

Para IP LAN o dominio propio, añade la dirección del frontend a AUTOCLIP_ALLOWED_ORIGINS en .env (separada por comas).

CLI / MCP

Python 3.10+ (3.11 recomendado), FFmpeg y FFprobe en PATH; no hace falta Redis. Descarga el ZIP oficial CLI / MCP, descomprímelo y ejecuta desde ese directorio:

python3 -m venv venv
source venv/bin/activate
python -m pip install -r requirements.txt
python -m pip install --force-reinstall --no-deps autoclip-1.5.0-py3-none-any.whl

Los comandos anteriores son para macOS / Linux. En Windows, crea con py -m venv venv y activa con .\venv\Scripts\Activate.ps1; después usa los mismos comandos python -m pip.

Guarda primero la configuración del modelo: reutiliza la del escritorio o configura tu directorio con el ejemplo sin claves del ZIP. Guía CLI / MCP (chino). produce no usa la modificación temporal de run --provider. --srt evita transcribir.

autoclip --version
autoclip produce talk.mp4 --srt talk.srt --platform douyin --portrait-style podcast --json
autoclip outputs PROJECT_ID --export-kits

El cliente MCP inicia el servidor. Para depurar por separado, ejecuta autoclip mcp en otro terminal; OpenCode puede configurarse con autoclip mcp install opencode.

Sustituye PROJECT_ID por el ID devuelto. MCP usa start_quick_output / get_quick_output_status; command debe ser la ruta absoluta de autoclip en el venv y args, ["mcp"]. Siguen disponibles run / export y herramientas anteriores. CLI / MCP (chino), OpenCode, Agent skill (chino).

Modelos

Opción Configuración
API en la nube Elige proveedor y API Key. Los compatibles con OpenAI aceptan Base URL.
Ollama Dirección predeterminada http://localhost:11434/v1. Descarga e inicia un modelo local y selecciona uno ofrecido por el servidor. Sin API Key.
LM Studio Carga un modelo y arranca Local Server, http://localhost:1234/v1 por defecto.

Dentro de Docker, localhost es el contenedor. Usa una dirección del host alcanzable.

Modelos (chino) · Local y contenedores (chino)

Agradecimientos ❤️

88API
88API
¡Gracias a 88API por patrocinar AutoClip! Reúne GPT, Claude, Gemini, Grok, DeepSeek, Kimi y GLM para analizar subtítulos, seleccionar momentos destacados y generar títulos.
🎨 Multimedia: Ofrece modelos de imagen, vídeo y audio como GPT-Image, Seedance, Veo, MiniMax Hailuo H3, Kling, Whisper y TTS. AutoClip utiliza API compatibles de análisis, portadas y transcripción.
🏷️ Servicio y facturación: Según el patrocinador, opera mediante una empresa extranjera y ofrece atención humana, facturas y recargas con proporción 1:1; se aplican las condiciones de la plataforma.
🎁 Nuevos usuarios: Obtén crédito de prueba para evaluar modelos mediante el enlace de referido, según las condiciones de la promoción. Guía de configuración (inglés)
Infistar
Infistar.cc
¡Gracias a Infistar.cc por patrocinar AutoClip! Ofrece una API multimodelo para analizar transcripciones de vídeos largos, seleccionar momentos destacados y generar títulos.
⚙️ Configuración compatible: En AutoClip, elige el proveedor compatible con OpenAI e introduce la Base URL, tu clave API y un modelo disponible.
🧩 Variedad de modelos: El proveedor ofrece Claude, GPT, Gemini, DeepSeek y otras familias. Elige modelos que admitan el endpoint compatible para comparar el análisis de transcripciones y la selección de momentos destacados.
🏷️ Precios y servicios: Según el patrocinador, algunos modelos cuestan desde el 1% del precio oficial, con facturación en RMB, emisión de facturas y verificación de autenticidad del modelo. Consulta en la plataforma los modelos, precios y condiciones vigentes.
🎁 Oferta para AutoClip: Los nuevos usuarios pueden recibir $5 de crédito de prueba al registrarse mediante el enlace de referido, según las condiciones de la promoción. Guía de configuración (inglés)

Preguntas frecuentes

¿Es gratis? ¿Necesito una API Key?

App gratuita y MIT. Análisis, transcripción e imágenes cloud usan tus credenciales y tarifas del proveedor; la portada automática no usa generación de pago por defecto. Ollama / LM Studio no necesitan clave cloud, pero sí hardware. Publicar requiere tu cuenta Bilibili o Upload-Post.

¿Se suben mis vídeos?

Corte y render se realizan en tu ordenador. El análisis cloud envía subtítulos y texto relevante; la comprensión visual o generación con referencias envía fotogramas necesarios, y la transcripción cloud envía audio. El análisis y la transcripción locales no necesitan la API cloud correspondiente. Los clips se suben a plataformas conectadas cuando eliges publicar. Analítica e informes de error se desactivan en Ajustes. Privacidad.

¿Qué vídeos funcionan mejor?

Entrevistas, pódcast, cursos y vídeos hablados son los casos más validados. Los subtítulos del autor son más rápidos; si faltan, usa transcripción local/cloud. Para juegos o poco diálogo, activa comprensión visual con un modelo de imágenes y revisa los momentos elegidos.

¿Por qué no se generaron clips?

Revisa transcripción, conexión del modelo, FFmpeg, disco y reglas de plataforma. YouTube largo exige fragmentos completos de al menos 180 segundos; usa Shorts/Bilibili para fuentes cortas. Si falla, adjunta versión 1.5.0, OS, duración, modelo y logs sin secretos en problemas conocidos.

Solución de problemas · Problemas conocidos

Documentación

Quieres Docs
Instalar y primeros clips Instalación
Autohospedar y automatizar Docker · CLI / MCP (chino) · Agent skill (chino) · OpenCode
Modelos y fallos Modelos (chino) · FAQ
Versiones, hoja de ruta, privacidad Cambios · Hoja de ruta (chino) · Tablero (chino) · Privacidad
Contribuir y traducir Contribuir (chino) · Traducciones (chino)

Contribuir

Se aceptan arreglos, ejemplos, comentarios y traducciones. Si AutoClip te sirve, un star ayuda.

Lo mantiene una persona. No hay soporte en vivo ni despliegue uno a uno.

Star History

Gracias a FastAPI, React, Tauri, FFmpeg, yt-dlp, Whisper, FunASR y a quien contribuye. MIT License.