Vídeo → PDF → IA
ChatGPT y Claude no ven vídeo. ClipContext convierte cualquier grabación en un PDF con los fotogramas que importan y la transcripción sincronizada — listo para adjuntar a la conversación.
Abrir la herramienta — es gratis
Sin registro, sin instalación, sin límite de tamaño. El vídeo se procesa dentro de tu navegador y nunca se sube a ningún servidor.
Los modelos de lenguaje leen texto e imágenes, no vídeo. O rechazan el archivo, o su tamaño hace inviable subirlo. Y cuando haces capturas a mano, acabas enviando diez pantallas casi idénticas y ninguna del momento que importaba, sin nada que enlace lo que aparece con lo que se estaba diciendo.
Cómo funciona
Arrastra el archivo a la página. Se lee directamente de tu disco — 300 MB o 3 GB da igual, porque no se sube nada a ninguna parte.
Transcríbelo ahí mismo, con Whisper ejecutándose en tu propia máquina, o arrastra un archivo de subtítulos .vtt / .srt que ya tengas.
Revisa los fotogramas, descarta los malos y descarga el documento. Junto a él viene el texto que le explica al modelo cómo leer ese PDF — eso es lo que cambia la calidad de la respuesta.
En vez de tomar un fotograma cada diez segundos, recorre el vídeo y guarda los momentos en que la pantalla realmente cambia. En una presentación, eso se convierte en un fotograma por diapositiva en lugar de cuarenta repetidos.
En el PDF, cada fotograma aparece junto a lo que se dice en ese punto, con el instante marcado. El modelo puede relacionar lo que había en pantalla con lo que se estaba diciendo.
No existe servidor. El vídeo, el audio y la transcripción se procesan en tu navegador — incluidas grabaciones confidenciales de reuniones.
El texto ya preparado le indica al modelo que cite los instantes, separe lo que vio de lo que oyó, y admita cuando la información no está en el documento en lugar de inventarla.
Privacidad
La mayoría de las herramientas de vídeo en línea exigen subir el archivo: va a la máquina de alguien, se procesa allí y queda almacenado durante un tiempo que tú no controlas. ClipContext no hace nada de eso — la página es un archivo estático y todo el procesamiento ocurre en tu navegador.
No hay cuenta, no hay base de datos, no hay rastreo. La única conexión externa es la descarga del modelo de transcripción, y solo si usas la transcripción automática. Lee la política completa.
No. Se abre en el navegador y funciona. Un Chrome o Edge actualizado da la mejor experiencia, porque la transcripción automática usa la tarjeta gráfica mediante WebGPU.
No hay límite impuesto por nosotros, precisamente porque no hay subida. El límite práctico es la memoria de tu ordenador. Los vídeos largos tardan más en recorrerse, y puedes detener el barrido cuando quieras.
MP4 (H.264), WebM y MOV en la mayoría de los casos. Los formatos que el navegador no sabe decodificar — HEVC y algunos MKV — no se abren; en esos casos hay que convertirlos a MP4 antes.
Usa Whisper ejecutándose localmente. El modelo rápido es razonable y el preciso es bastante mejor, a costa de una descarga mayor. Si ya tienes subtítulos de otro servicio, arrastra el archivo y sáltate este paso.
La herramienta tal como está hoy es gratuita y el código es abierto bajo licencia MIT. Como no hay coste de servidor, no hay motivo para cobrar por ella.
Cualquier modelo que acepte adjuntos y lea imágenes — Claude, ChatGPT y Gemini funcionan. Adjunta el PDF y pega el prompt que la herramienta genera junto a él.