Pontuação

Cada clipe chega com uma nota, e com o motivo dela

Um episódio de noventa minutos guarda talvez oito momentos que valem uma publicação. Procurá-los arrastando a linha do tempo é exatamente o que faz as pessoas desistirem depois do primeiro clipe. A Katto pontua cada segmento candidato de 0 a 100 em quatro eixos, para que você abra uma seleção ordenada em vez de uma linha do tempo.

Quatro eixos, uma nota

O máximo que cada eixo pode contribuir é fixo, e os pesos estão impressos aqui porque são todo o argumento. Hook e Flow somam sessenta pontos entre os dois: um clipe que começa mal ou que se dispersa não se salva pelo vocabulário.

Hook, 0 a 30

Apenas os três primeiros segundos. Uma palavra interrogativa na abertura, uma palavra de impacto, um número ou uma percentagem, e se o clipe começa com uma frase completa. Um clipe que abre com uma fórmula de despedida perde o eixo inteiro.

Flow, 0 a 30

Se o clipe se sustenta. Densidade de fala medida por deteção de atividade vocal, quantos cortes de plano caem dentro do segmento, e se a energia do áudio se mantém em vez de oscilar.

Value, 0 a 25

Densidade de palavras com conteúdo e de números, mais a autonomia: começa numa palavra real em vez de uma conjunção, e termina numa frase acabada? Trechos cheios de autopromoção são penalizados aqui.

Trend, 0 a 15

O eixo mais pequeno, de propósito. Uma pergunta, uma estatística, vocabulário de forte carga e picos de energia no áudio. Inclina a ordem, nunca a decide.

O que uma nota significa de facto

Uma nota sobre 100 convida a lê-la como uma percentagem, e essa leitura é errada. A pergunta útil é onde um clipe fica em relação aos outros. No conjunto dos clipes que a Katto produziu, a mediana cai em 68. Cerca de um em cada quatro chega a 80, e um em cada dez alcança 85. Portanto um 76 é um bom clipe que supera aproximadamente dois terços do campo, e um 60 não é um fracasso, fica apenas abaixo do meio.

Isto importa sobretudo quando um vídeo inteiro pontua baixo. Costuma dizer algo verdadeiro sobre a fonte, uma gravação demasiado parada ou uma conversa sem uma viragem clara, e não que a ferramenta esteja avariada.

O mesmo clipe recebe sempre a mesma nota

Nada no cálculo pede a opinião de um modelo de linguagem. As entradas são a transcrição palavra a palavra, o mapa de atividade vocal, os cortes de plano detetados e a forma de onda do áudio, e a aritmética em cima disso é fixa. Até a frase que explica uma nota é montada a partir dos quatro números em vez de ser escrita para si.

Essa escolha custa-nos subtileza. Um modelo perceberia que uma piada resulta onde uma lista de palavras não consegue. O que ela compra é um sistema com que se pode discutir: quando falta um momento que queria, há um sinal para apontar, e reprocessar o vídeo não produz em silêncio outra resposta. Os modelos entram depois, para escrever títulos e descrições de clipes já selecionados.

O que é afastado antes de você ver

Dois padrões pontuam bem e rendem mal, por isso ambos são tratados de frente. A abertura de um vídeo longo é enérgica e tem forma de gancho, e é também onde vivem as leituras de patrocínio e a promoção do canal: acima de dois minutos, um segmento que começa nos primeiros 45 segundos leva uma penalização fixa. As fórmulas de fecho funcionam em espelho: um segmento carregado de «subscreve» perde pontos em Value e em Trend, e um clipe que abre com isso perde o Hook por completo.

O que a nota não afirma

Não é uma previsão de visualizações, e qualquer ferramenta que diga o contrário vende-lhe um número que não consegue sustentar. O alcance depende do seu público, do seu texto, de quando publica e do que a plataforma favorece nessa semana, e nada disso está no seu ficheiro de origem. A nota ordena os candidatos dentro de um mesmo vídeo, para que comece pelos três melhores em vez dos três primeiros. A decisão editorial, que momento merece o feed, continua a ser sua.

Perguntas

A nota é gerada por um modelo de linguagem?

Não. Nada no caminho de pontuação chama um modelo. Os quatro eixos são calculados a partir da transcrição, do mapa de atividade vocal, dos cortes de plano detetados e da forma de onda do áudio. Um modelo escreve depois o título e a descrição, em clipes já escolhidos.

O mesmo vídeo dá sempre as mesmas notas?

Sim. Mesma fonte, mesmos números. É esse o sentido de um scorer determinista: quando um clipe esperado não aparece, a causa é um sinal que se pode nomear, não um modelo que hoje respondeu de outra forma.

O que conta como uma boa nota?

O clipe mediano que produzimos está em 68. Cerca de um em cada quatro está em 80 ou acima, e um em cada dez chega a 85. Um 60 não é um mau clipe, é um clipe abaixo da mediana.

Uma nota alta garante visualizações?

Não, e não vamos afirmá-lo. As visualizações dependem do seu público, da sua miniatura, da hora de publicação e do humor da plataforma nesse dia. A nota ordena candidatos dentro de um mesmo vídeo. É trabalho de triagem, não previsão.

Posso orientar a seleção?

Sim. Os temas e uma instrução personalizada dão um bónus de palavras-chave aos segmentos correspondentes, por isso os momentos pedidos sobem na ordem. É uma simples correspondência de texto, sem custo nem latência adicionais.

Porque é que as intros quase nunca ganham?

Porque pontuam bem pelo motivo errado. Uma abertura a frio é enérgica e tem forma de gancho, e é aí que vivem também as leituras de patrocínio e as promos do canal. Em vídeos com mais de dois minutos, tudo o que começa nos primeiros 45 segundos leva uma penalização fixa.

Veja as notas no seu próprio vídeo

Cada clipe mostra o total e os quatro eixos, para que confronte a ordem com o seu próprio critério em vez de acreditar nela sem mais.