Caso de uso
Un modelo que ve vídeo muestrea un fotograma por segundo, a ciegas. Una hora se vuelve 3.600 imágenes, más de un millón de tokens, y la mayoría es la misma pantalla quieta. El documento resuelve eso antes de llegar al modelo.
Preparar un vídeo para la IA gratis, y el vídeo no sale de tu ordenador
Tienes una grabación — una demo, una clase, una sesión de soporte, un incidente — y quieres preguntarle cosas a un modelo. Mandar el archivo choca con tres paredes: el límite de tamaño, el coste de procesar fotogramas repetidos, y el hecho de que la mayoría de los modelos simplemente no acepta vídeo.
Y aun donde lo acepta, el modelo pierde lo que se dijo junto a lo que se mostró: el habla llega como un bloque de texto suelto, sin saber a qué pantalla pertenece.
Un PDF (o Markdown, HTML, JSON) que cualquier modelo lee, con la información ya organizada:
No manda nada a ningún modelo. Monta el material y te lo entrega. Quien elige el modelo, la cuenta y la política de uso eres tú — incluido un modelo que corra dentro de tu propia empresa.
No sustituye ver el vídeo cuando el movimiento es el dato. Si lo que importa es una animación, una transición o el gesto de alguien, los fotogramas por cambio de escena lo pierden. Para pantalla de sistema, que es el caso común, capturan todo lo que interesa.
No resume por su cuenta. El resumen es trabajo del modelo; el nuestro es hacer que el modelo lea lo correcto.
Preparar un vídeo para la IA Ver los planes
Es el más genérico de los cinco, y el predeterminado de la herramienta — cuando no sabes qué documento quieres, este es el que sirve.