Saltar al contenido

Cómo analiza Garfunkel un video

Pega un enlace y Garfunkel convierte el video en un informe ordenado: qué se dice, qué se ve, cuál es el gancho, las mismas etiquetas para todos los posts y, si lo pides, cómo reaccionó la gente. Estos son los pasos, en orden.

Copia esta página en formato Markdown, lista para pegar en un asistente de IA.

  1. Paso 01 de 08

    Obtener el post

    Abrimos el enlace y obtenemos el video junto con la información que muestra la plataforma: el texto, quién lo creó y las cifras de vistas, Me gusta, comentarios y veces que se compartió. Conservamos esas cifras tal como las informa la plataforma, para que después puedas ordenar y comparar los posts. El archivo de video solo se conserva mientras lo procesamos y se elimina al terminar el análisis.

    Obtener el postUn enlace a un video se convierte en una tarjeta del post con su miniatura, creador, descripción y cantidad de reproducciones, Me gusta y comentarios.Enlace…/video/1842@creator1.2M84K1.1K
  2. Paso 02 de 08

    Separar el video

    Comprobamos si el video tiene audio y luego lo separamos de la imagen para analizar cada parte por su cuenta. El audio pasa a transcripción y la imagen, a la selección de fotogramas. Después volvemos a unir ambos para resumir el post.

    Separar el videoEl video se divide en dos: una tira de imágenes y una forma de onda del sonido.VideoImagenAudio
  3. Paso 03 de 08

    Transcribir el audio

    Un modelo de reconocimiento de voz transcribe todo lo que se dice en el video y añade una marca de tiempo a cada línea. Así puedes ver qué se dijo y cuándo. Si un video tiene voz, siempre lo transcribimos: si este paso falla, lo intentamos de nuevo en vez de omitirlo. Nunca cobramos por un post cuyo análisis falla.

    Modelo: Qwen3-ASR-0.6B · un modelo de reconocimiento de voz de código abierto

    Consulta la pestaña Transcripción del resultado

    Transcribir el audioLa forma de onda se convierte en tres líneas de transcripción, cada una con una marca de tiempo.0:000:030:07Transcripción0:00
    Este es el truco…
    0:03
    primero calientas la sartén
    0:07
    y luego añades el aceite.
  4. Paso 04 de 08

    Elegir los fotogramas

    Usamos un algoritmo para reducir la cantidad de fotogramas sin perder el sentido general del video. En los pasos siguientes, el modelo de IA analiza los fotogramas seleccionados junto con la transcripción.

    Elegir los fotogramasUna tira larga de fotogramas casi idénticos se reduce a unos pocos que muestran algo distinto cada uno.Todos los fotogramasFotogramas seleccionados
  5. Paso 05 de 08

    Resumir

    Un modelo de IA lee la transcripción y el texto mientras analiza los fotogramas. Así entiende el post completo, en lugar de analizar cada elemento por separado. Escribe un resumen breve y cuenta la historia en orden, momento a momento, vinculando cada parte con un instante del video.

    Modelo: gpt-6.1-sol · lee la transcripción y los fotogramas seleccionados al mismo tiempo

    ResumirLas líneas de transcripción y los fotogramas se reúnen en una tarjeta de resumen que enumera, en orden y con marcas de tiempo, los momentos clave de la historia.Transcripción0:000:030:07FotogramasResumenHistoria en orden0:00
    Presenta el truco
    0:04
    Calienta primero la sartén
    0:09
    Muestra el resultado
  6. Paso 06 de 08

    Encontrar el gancho

    El modelo analiza con atención los primeros segundos para identificar el gancho: las palabras o la imagen que captan la atención, qué tipo de gancho es y en qué momento aparece. También señala qué promete el gancho, cómo cumple esa promesa el video y por qué funciona.

    Modelo: gpt-6.1-sol · el mismo modelo y el mismo análisis que para el resumen

    Consulta la tarjeta Gancho del resultado

    Encontrar el ganchoUna línea de tiempo de los primeros segundos destaca el momento del gancho, su tipo y una cita, además de indicar la promesa, el resultado y por qué funciona.Primeros segundos0:000:010:020:030:04Demostración
    “Este es el truco…”
    PromesaFreír sin que nada se pegue a la sartén.
    ResultadoAl final, la comida se desliza fácilmente fuera de la sartén.
    Por qué funcionaMuestra cómo hacerlo en vez de explicarlo con palabras.
  7. Paso 07 de 08

    Etiquetar y analizar

    Con el resumen, la transcripción y los fotogramas, el modelo aplica las mismas etiquetas a todos los posts: formato, tema, emoción, tono, personas y marcas, lugares, objetos, edición y referencias culturales o a memes. Después revisa que las etiquetas principales sean coherentes. Como todos los posts reciben las mismas etiquetas, puedes compararlos lado a lado.

    Modelo: gpt-6-luna · aplica las etiquetas y revisa las referencias culturales y a memes

    Consulta las etiquetas del resultado

    Etiquetar y analizarUna tarjeta de resumen presenta una cuadrícula con nueve etiquetas: formato, tema, emoción, tono, personas y marcas, lugares, objetos, edición y cultura.Resumen
    FormatoTutorial
    TemaComida y bebida
    EmociónAlegría
    TonoJuguetón
    Personas y marcasUna persona creadora
    LugaresCocina de casa
    ObjetosSartén, aceite
    EdiciónCortes rápidos
    CulturaSonido en tendencia
  8. Paso 08 de 08

    Leer los comentarios

    Cuando pides analizar los comentarios, los recopilamos y el modelo lee cada uno en el contexto del post: su texto, resumen y transcripción. Así evalúa cada respuesta según lo que realmente se dijo y mostró en el video. El informe indica quién está de acuerdo, quién discrepa, qué pregunta la gente y qué le gustó.

    Modelo: gpt-6-luna · lee cada comentario en el contexto del post

    Añade comentarios al resultado

    Leer los comentariosTres comentarios, cada uno marcado como a favor, en desacuerdo o con una pregunta, aparecen sobre una barra que muestra qué opina la gente.
    Por fin, alguien lo explicó bien.Está de acuerdo
    Pero así no funciona.Cuestiona
    ¿De dónde sacaste esa sartén?Pregunta
    Qué opinan las personas

Cómo se construye el contexto

Cada paso se basa en el anterior, así que los siguientes nunca analizan solo el video original. Esto es lo que lee cada uno.

  1. 01TranscripciónLeeEl audio
  2. 02Resumen y ganchoLeeTranscripción, descripción y fotogramas seleccionados
  3. 03EtiquetasLeeResumen, transcripción, descripción y fotogramas seleccionados
  4. 04Informe de comentariosLeeComentarios, descripción, resumen y transcripción

Todos los posts, con la misma estructura

Cada post se analiza y se convierte en un resultado estructurado con un esquema fijo: los mismos campos y el mismo formato para todos. Así, los resultados son coherentes y comparables, fáciles de ordenar y filtrar, y se exportan sin problemas a una hoja de cálculo, la API o MCP.

{
  "format": "Tutorial",
  "theme": "Food & drink",
  "emotion": ["Joy"],
  "tone": ["Playful"],
  "hook": { "type": "Demonstration", "start": 0.0, "end": 2.0, "text": "So here’s the trick…" },
  "tags": ["home kitchen", "pan", "jump cuts"],
  "transcript": [{ "start": 0.0, "end": 2.4, "text": "So here’s the trick…" }],
  "comments": { "agree": 52, "push_back": 14, "questions": 18 }
}

Los nombres de los campos son ilustrativos; la documentación incluye los nombres reales.

Qué obtienes

  • Un resumen y la historia en orden
  • Una transcripción con marcas de tiempo
  • El gancho: qué es, cuándo aparece y por qué funciona
  • El mismo conjunto de etiquetas que en todos los demás posts
  • Un informe de comentarios, cuando lo solicitas
  • Búsqueda por significado: encuentra posts por el tema que tratan, no solo por las palabras que contienen
  • Exporta a hojas de cálculo, la API y MCP

El archivo de video se elimina cuando termina el análisis.