Puntuación

Cada clip llega con una nota, y con su motivo

Un episodio de noventa minutos guarda quizá ocho momentos que merecen publicarse. Buscarlos arrastrando la línea de tiempo es justo lo que hace que la gente abandone tras el primer clip. Katto puntúa cada segmento candidato de 0 a 100 en cuatro ejes, para que abras una selección ordenada en lugar de una línea de tiempo.

Cuatro ejes, una nota

El máximo que puede aportar cada eje es fijo, y los pesos están impresos aquí porque son todo el argumento. Hook y Flow suman sesenta puntos entre los dos: un clip que empieza mal o que se dispersa no se salva con el vocabulario.

Hook, 0 a 30

Solo los tres primeros segundos. Una palabra interrogativa en la apertura, una palabra de impacto, una cifra o un porcentaje, y si el clip arranca con una frase completa. Un clip que abre con una fórmula de despedida pierde el eje entero.

Flow, 0 a 30

Si el clip se sostiene. Densidad de habla medida por detección de actividad vocal, cuántos cortes de plano caen dentro del segmento, y si la energía del audio se mantiene en lugar de dar tumbos.

Value, 0 a 25

Densidad de palabras con contenido y de cifras, más la autonomía: ¿empieza con una palabra real en vez de una conjunción, y termina con una frase acabada? Los tramos cargados de autopromoción se penalizan aquí.

Trend, 0 a 15

El eje más pequeño, a propósito. Una pregunta, una estadística, vocabulario de alta carga y picos de energía en el audio. Inclina el orden, nunca lo decide.

Qué significa realmente una nota

Una nota sobre 100 invita a leerla como un porcentaje, y esa lectura es falsa. La pregunta útil es dónde queda un clip frente a los demás. En el conjunto de clips que Katto ha producido, la mediana cae en 68. Aproximadamente uno de cada cuatro llega a 80, y uno de cada diez alcanza 85. Así que un 76 es un buen clip que supera cerca de dos tercios del campo, y un 60 no es un fracaso, simplemente queda por debajo del medio.

Esto importa sobre todo cuando un vídeo entero puntúa bajo. Suele decir algo cierto sobre la fuente, una grabación demasiado plana o una conversación sin un giro claro, más que señalar una avería en la herramienta.

El mismo clip siempre saca la misma nota

Nada en el cálculo le pregunta su opinión a un modelo de lenguaje. Las entradas son la transcripción palabra a palabra, el mapa de actividad vocal, los cortes de plano detectados y la forma de onda del audio, y la aritmética encima es fija. Incluso la frase que explica una nota se ensambla a partir de los cuatro números en lugar de escribirse para ti.

Esa elección nos cuesta matiz. Un modelo captaría que un chiste funciona donde una lista de palabras no puede. Lo que compra es un sistema con el que se puede discutir: cuando falta un momento que querías, hay una señal que señalar, y volver a procesar el vídeo no produce en silencio otra respuesta. Los modelos entran después, para escribir títulos y descripciones de clips ya seleccionados.

Lo que se descarta antes de que lo veas

Dos patrones puntúan bien y rinden mal, así que ambos se tratan de frente. La apertura de un vídeo largo es enérgica y tiene forma de gancho, y también es donde viven las menciones de patrocinio y la promoción del canal: por encima de dos minutos, un segmento que arranca en los primeros 45 segundos carga una penalización fija. Las fórmulas de cierre funcionan en espejo: un segmento denso en «suscríbete» pierde puntos en Value y en Trend, y un clip que abre con eso pierde su Hook por completo.

Lo que la nota no afirma

No es una predicción de visualizaciones, y cualquier herramienta que diga lo contrario te vende una cifra que no puede sostener. El alcance depende de tu audiencia, de tu texto, de cuándo publiques y de lo que la plataforma favorezca esa semana, y nada de eso está en tu archivo de origen. La nota ordena a los candidatos dentro de un mismo vídeo, para que empieces por los tres mejores en lugar de por los tres primeros. La decisión editorial, qué momento merece el feed, sigue siendo tuya.

Preguntas

¿La nota la genera un modelo de lenguaje?

No. Nada en el camino de puntuación llama a un modelo. Los cuatro ejes se calculan a partir de la transcripción, el mapa de actividad vocal, los cortes de plano detectados y la forma de onda del audio. Un modelo escribe después el título y la descripción, sobre clips ya elegidos.

¿El mismo vídeo da siempre las mismas notas?

Sí. Misma fuente, mismas cifras. Ese es el sentido de un scorer determinista: cuando no aparece un clip esperado, la causa es una señal que se puede nombrar, no un modelo que hoy contestó distinto.

¿Qué se considera una buena nota?

El clip mediano que producimos está en 68. Alrededor de uno de cada cuatro está en 80 o por encima, y uno de cada diez llega a 85. Un 60 no es un mal clip, es uno por debajo de la mediana.

¿Una nota alta garantiza visualizaciones?

No, y no vamos a afirmarlo. Las visualizaciones dependen de tu audiencia, de tu miniatura, de la hora de publicación y del humor de la plataforma ese día. La nota ordena candidatos dentro de un mismo vídeo. Es un trabajo de clasificación, no un pronóstico.

¿Puedo orientar la selección?

Sí. Los temas y una indicación personalizada añaden un plus por palabras clave a los segmentos que coinciden, de modo que los momentos pedidos suben en el orden. Es una coincidencia de texto simple, sin coste ni latencia añadidos.

¿Por qué las intros casi nunca ganan?

Porque puntúan bien por el motivo equivocado. Una apertura en frío es enérgica y tiene forma de gancho, y ahí viven también las menciones de patrocinio y las promos del canal. En vídeos de más de dos minutos, todo lo que empieza en los primeros 45 segundos carga una penalización fija.

Mira las notas en tu propio vídeo

Cada clip muestra su total y sus cuatro ejes, para que contrastes el orden con tu propio criterio en lugar de creerlo sin más.