25 KiB
AutoClip
Un enlace. Un clic.
Código abierto, con corte y render en tu ordenador. Pega un enlace, elige plataforma y genera vídeo, portada y texto,
para Douyin, Xiaohongshu, TikTok, Reels, YouTube Shorts, Bilibili o YouTube.
La app es gratis; los modelos cloud cobran por uso. Puedes ajustar el resultado en el editor.
Descargar escritorio · Casos · Inicio rápido · Documentación · Incidencia
简体中文 · English · 日本語 · 한국어 · Español · Português · Русский · Français
1.5.0 ya está publicado, con escritorio, CLI y MCP actualizados. El registro de cambios detalla la producción automática, paginación de subtítulos, encuadre y cola de vídeos largos. Actualiza versiones anteriores.
Clips reales
Haz clic en una imagen o en «Reproducir» para ver el clip completo. El idioma indicado es el de los subtítulos del resultado. Mostramos seis ejemplos; despliega la sección para ver otros diez.
Vertical · entrevista y pódcast a pantalla completa
![]() Bill Gates Entrevista · Douyin · Chino ▶ Reproducir 1:01 · Original |
![]() AI Experts Debate Entrevista · Shorts · Inglés ▶ Reproducir 1:25 · Original |
![]() Tony Robbins Pódcast a pantalla completa · Douyin · Chino ▶ Reproducir 1:45 · Original |
![]() Andrew Garfield × Amy Poehler Pódcast a pantalla completa · Shorts · Inglés ▶ Reproducir 1:01 · Original |
Horizontal · encuadre original
![]() 佟丽娅 × 鲁豫 Encuadre original · Bilibili · Chino ▶ Reproducir 1:41 · Original |
![]() Sam Altman Encuadre original · Bilibili · Chino ▶ Reproducir 2:02 · Original |
Ver otros 10 clips reales
![]() Adam Neumann Pódcast a pantalla completa · TikTok · Inglés ▶ Reproducir 0:59 · Original |
![]() 小奇 × 鲁豫 Entrevista · Douyin · Chino ▶ Reproducir 0:50 · Original |
![]() 郭柯宇 × 鲁豫 Entrevista · Douyin · Chino ▶ Reproducir 1:11 · Original |
![]() Willem Dafoe Pódcast a pantalla completa · TikTok · Inglés ▶ Reproducir 1:07 · Original |
![]() TIM × 罗永浩 Entrevista · Douyin · Chino ▶ Reproducir 1:05 · Original |
![]() Jensen Huang Entrevista · Xiaohongshu · Chino ▶ Reproducir 1:17 · Original |
![]() Andrej Karpathy Entrevista · Douyin · Chino ▶ Reproducir 0:43 · Original |
![]() A20 Pro Entrevista · Xiaohongshu · Chino ▶ Reproducir 2:00 · Original |
![]() Sylvester Stallone Entrevista · Douyin · Chino ▶ Reproducir 1:39 · Original |
![]() MrBeast Pódcast a pantalla completa · TikTok · Inglés ▶ Reproducir 1:42 · Original |
Vídeos, portadas y textos de publicación en la biblioteca de ejemplos →. Comparte tus clips. Los vídeos originales pertenecen a sus autores; estos clips se muestran solo como demostración.
Qué hace
Pega un enlace y listo
Genera según formato y duración de la plataforma. Cada plataforma produce automáticamente hasta 10 clips aptos mejor puntuados; el resto queda bajo demanda. Incluye portada, título, descripción, hashtags y paquete ZIP.
El empaquetado va incluido
Douyin / Xiaohongshu usan entrevista por defecto; TikTok / Reels / Shorts, pódcast a pantalla completa. Puedes elegir el diseño vertical sin cambiar el idioma de subtítulos y texto de la plataforma. Bilibili / YouTube son horizontales. El encuadre sigue al hablante y conserva escenas sin personas. El cierre de marca está activo por defecto y se desactiva en Ajustes; el texto copiado no lleva firma AutoClip.
Se queda en tu ordenador
Corte, encuadre y render son locales. Elige modelo de análisis y usa subtítulos del autor, Whisper / SenseVoice local o transcripción cloud configurada. CLI / MCP comparten el flujo de escritorio.
Tiempo y coste con vídeos reales
Son tres fuentes distintas medidas durante el desarrollo, no una comparación controlada del mismo vídeo. Los costes estiman el uso de texto de qwen-plus de entonces y excluyen ASR cloud, imágenes AI y servicios de publicación. La factura depende del proveedor.
| Versión | Original | Salida | Coste estimado del modelo de texto (CNY) |
|---|---|---|---|
| Nueva · con subtítulos | Jensen · 1h43m (EN → Xiaohongshu) | 7,5 min / 10 clips | ¥0,09 |
| Nueva · sin subtítulos | TIM × Luo Yonghao · 2h52m (ZH → Douyin) | 29,5 min / 10 clips | ¥0,20 |
| Anterior | MrBeast · 2h06m (EN → TikTok) | 65 min | ¥0,64 |
Condiciones y registros
1 de octubre de 2026, el mismo Mac Apple Silicon. Los dos casos nuevos generaron 10 clips; el anterior, 33. Cambian tanto la fuente como la cantidad. Jensen usó subtítulos del autor; TIM, Whisper base local.
Los subtítulos del autor evitan transcribir. Sin ellos, elige ASR local o cloud. Plataformas y clips adicionales aumentan tiempo y consumo. Mediciones y cálculo (chino).
Elige modelos y flujo de datos
Corte y render se realizan en tu ordenador. El análisis cloud envía subtítulos y texto relevante; la comprensión visual o generación con referencias envía fotogramas necesarios, y la transcripción cloud envía audio. El análisis y la transcripción locales no necesitan la API cloud correspondiente. Los clips se suben a plataformas conectadas cuando eliges publicar. Analítica e informes de error se desactivan en Ajustes. Privacidad.
Inicio rápido
| Quieres | Usa | Necesitas |
|---|---|---|
| Hacer clips en este equipo | Escritorio | macOS Apple Silicon o Windows x64 |
| Autohospedar / Linux | Docker | Docker y Compose v2 |
| Lotes / agentes | CLI / MCP | Python 3.10+ (3.11 recomendado) y FFmpeg |
Escritorio
- Instala. Desde Releases. macOS Apple Silicon:
.dmg. Windows 10 / 11 x64:-setup.exe. Python y FFmpeg van incluidos. - Configura un modelo. Elige proveedor e introduce la API Key; selecciona un modelo de análisis disponible, prueba la conexión y guarda. Para modelos locales, carga un modelo e inicia Ollama / LM Studio primero.
- Enlace y plataforma. Empieza con una entrevista o pódcast con subtítulos y elige diseño vertical. Sin subtítulos, prepara Whisper / SenseVoice o configura transcripción cloud en Ajustes.
- Revisa y descarga. Comprueba subtítulos, encuadre y contenido, y guarda el paquete o conecta una cuenta para publicar. Genera alternativas si necesitas más clips.
Intel Mac / Linux pueden usar Docker o CLI. Consulta instalación y 1.5.0 Release para requisitos, primer inicio y alcance de validación.
Guía de instalación · Problemas
Docker / Web
git clone https://github.com/zhouxiaoka/autoclip.git
cd autoclip
cp env.example .env
mkdir -p data logs uploads
docker compose up -d --build
Abre la UI web. La API está al arrancar el backend. Guía Docker.
En Linux, si el montaje falla por permisos, corrige el dueño primero:
docker compose run --rm --no-deps --user root --entrypoint sh autoclip -c 'chown -R autoclip:autoclip /app/data /app/logs /app/uploads'
docker compose up -d
Para IP LAN o dominio propio, añade la dirección del frontend a AUTOCLIP_ALLOWED_ORIGINS en .env (separada por comas).
CLI / MCP
Python 3.10+ (3.11 recomendado), FFmpeg y FFprobe en PATH; no hace falta Redis. Descarga el ZIP oficial CLI / MCP, descomprímelo y ejecuta desde ese directorio:
python3 -m venv venv
source venv/bin/activate
python -m pip install -r requirements.txt
python -m pip install --force-reinstall --no-deps autoclip-1.5.0-py3-none-any.whl
Los comandos anteriores son para macOS / Linux. En Windows, crea con py -m venv venv y activa con .\venv\Scripts\Activate.ps1; después usa los mismos comandos python -m pip.
Guarda primero la configuración del modelo: reutiliza la del escritorio o configura tu directorio con el ejemplo sin claves del ZIP. Guía CLI / MCP (chino). produce no usa la modificación temporal de run --provider. --srt evita transcribir.
autoclip --version
autoclip produce talk.mp4 --srt talk.srt --platform douyin --portrait-style podcast --json
autoclip outputs PROJECT_ID --export-kits
El cliente MCP inicia el servidor. Para depurar por separado, ejecuta autoclip mcp en otro terminal; OpenCode puede configurarse con autoclip mcp install opencode.
Sustituye PROJECT_ID por el ID devuelto. MCP usa start_quick_output / get_quick_output_status; command debe ser la ruta absoluta de autoclip en el venv y args, ["mcp"]. Siguen disponibles run / export y herramientas anteriores. CLI / MCP (chino), OpenCode, Agent skill (chino).
Modelos
| Opción | Configuración |
|---|---|
| API en la nube | Elige proveedor y API Key. Los compatibles con OpenAI aceptan Base URL. |
| Ollama | Dirección predeterminada http://localhost:11434/v1. Descarga e inicia un modelo local y selecciona uno ofrecido por el servidor. Sin API Key. |
| LM Studio | Carga un modelo y arranca Local Server, http://localhost:1234/v1 por defecto. |
Dentro de Docker, localhost es el contenedor. Usa una dirección del host alcanzable.
Modelos (chino) · Local y contenedores (chino)
Agradecimientos ❤️
![]() 88API |
¡Gracias a 88API por patrocinar AutoClip! Reúne GPT, Claude, Gemini, Grok, DeepSeek, Kimi y GLM para analizar subtítulos, seleccionar momentos destacados y generar títulos. 🎨 Multimedia: Ofrece modelos de imagen, vídeo y audio como GPT-Image, Seedance, Veo, MiniMax Hailuo H3, Kling, Whisper y TTS. AutoClip utiliza API compatibles de análisis, portadas y transcripción. 🏷️ Servicio y facturación: Según el patrocinador, opera mediante una empresa extranjera y ofrece atención humana, facturas y recargas con proporción 1:1; se aplican las condiciones de la plataforma. 🎁 Nuevos usuarios: Obtén crédito de prueba para evaluar modelos mediante el enlace de referido, según las condiciones de la promoción. Guía de configuración (inglés) |
|
Infistar.cc |
¡Gracias a Infistar.cc por patrocinar AutoClip! Ofrece una API multimodelo para analizar transcripciones de vídeos largos, seleccionar momentos destacados y generar títulos. ⚙️ Configuración compatible: En AutoClip, elige el proveedor compatible con OpenAI e introduce la Base URL, tu clave API y un modelo disponible. 🧩 Variedad de modelos: El proveedor ofrece Claude, GPT, Gemini, DeepSeek y otras familias. Elige modelos que admitan el endpoint compatible para comparar el análisis de transcripciones y la selección de momentos destacados. 🏷️ Precios y servicios: Según el patrocinador, algunos modelos cuestan desde el 1% del precio oficial, con facturación en RMB, emisión de facturas y verificación de autenticidad del modelo. Consulta en la plataforma los modelos, precios y condiciones vigentes. 🎁 Oferta para AutoClip: Los nuevos usuarios pueden recibir $5 de crédito de prueba al registrarse mediante el enlace de referido, según las condiciones de la promoción. Guía de configuración (inglés) |
Preguntas frecuentes
¿Es gratis? ¿Necesito una API Key?
App gratuita y MIT. Análisis, transcripción e imágenes cloud usan tus credenciales y tarifas del proveedor; la portada automática no usa generación de pago por defecto. Ollama / LM Studio no necesitan clave cloud, pero sí hardware. Publicar requiere tu cuenta Bilibili o Upload-Post.
¿Se suben mis vídeos?
Corte y render se realizan en tu ordenador. El análisis cloud envía subtítulos y texto relevante; la comprensión visual o generación con referencias envía fotogramas necesarios, y la transcripción cloud envía audio. El análisis y la transcripción locales no necesitan la API cloud correspondiente. Los clips se suben a plataformas conectadas cuando eliges publicar. Analítica e informes de error se desactivan en Ajustes. Privacidad.
¿Qué vídeos funcionan mejor?
Entrevistas, pódcast, cursos y vídeos hablados son los casos más validados. Los subtítulos del autor son más rápidos; si faltan, usa transcripción local/cloud. Para juegos o poco diálogo, activa comprensión visual con un modelo de imágenes y revisa los momentos elegidos.
¿Por qué no se generaron clips?
Revisa transcripción, conexión del modelo, FFmpeg, disco y reglas de plataforma. YouTube largo exige fragmentos completos de al menos 180 segundos; usa Shorts/Bilibili para fuentes cortas. Si falla, adjunta versión 1.5.0, OS, duración, modelo y logs sin secretos en problemas conocidos.
Solución de problemas · Problemas conocidos
Documentación
| Quieres | Docs |
|---|---|
| Instalar y primeros clips | Instalación |
| Autohospedar y automatizar | Docker · CLI / MCP (chino) · Agent skill (chino) · OpenCode |
| Modelos y fallos | Modelos (chino) · FAQ |
| Versiones, hoja de ruta, privacidad | Cambios · Hoja de ruta (chino) · Tablero (chino) · Privacidad |
| Contribuir y traducir | Contribuir (chino) · Traducciones (chino) |
Contribuir
Se aceptan arreglos, ejemplos, comentarios y traducciones. Si AutoClip te sirve, un star ayuda.
- Hablar: Discussions · Primer clip · Ideas
- Fallos: formulario con SO, versión, modelo, pasos y registros sin secretos
- Alianzas: christine_zhouye@163.com
Lo mantiene una persona. No hay soporte en vivo ni despliegue uno a uno.
Gracias a FastAPI, React, Tauri, FFmpeg, yt-dlp, Whisper, FunASR y a quien contribuye. MIT License.
















