Cada clipe chega com uma nota, e com o motivo dela
Um episódio de noventa minutos guarda talvez oito momentos que valem uma publicação. Procurá-los arrastando a linha do tempo é exatamente o que faz as pessoas desistirem depois do primeiro clipe. A Katto pontua cada segmento candidato de 0 a 100 em quatro eixos, para que você abra uma seleção ordenada em vez de uma linha do tempo.
Quatro eixos, uma nota
O máximo que cada eixo pode contribuir é fixo, e os pesos estão impressos aqui porque são todo o argumento. Hook e Flow somam sessenta pontos entre os dois: um clipe que começa mal ou que se dispersa não se salva pelo vocabulário.
Apenas os três primeiros segundos. Uma palavra interrogativa na abertura, uma palavra de impacto, um número ou uma percentagem, e se o clipe começa com uma frase completa. Um clipe que abre com uma fórmula de despedida perde o eixo inteiro.
Se o clipe se sustenta. Densidade de fala medida por deteção de atividade vocal, quantos cortes de plano caem dentro do segmento, e se a energia do áudio se mantém em vez de oscilar.
Densidade de palavras com conteúdo e de números, mais a autonomia: começa numa palavra real em vez de uma conjunção, e termina numa frase acabada? Trechos cheios de autopromoção são penalizados aqui.
O eixo mais pequeno, de propósito. Uma pergunta, uma estatística, vocabulário de forte carga e picos de energia no áudio. Inclina a ordem, nunca a decide.
O que uma nota significa de facto
Uma nota sobre 100 convida a lê-la como uma percentagem, e essa leitura é errada. A pergunta útil é onde um clipe fica em relação aos outros. No conjunto dos clipes que a Katto produziu, a mediana cai em 68. Cerca de um em cada quatro chega a 80, e um em cada dez alcança 85. Portanto um 76 é um bom clipe que supera aproximadamente dois terços do campo, e um 60 não é um fracasso, fica apenas abaixo do meio.
Isto importa sobretudo quando um vídeo inteiro pontua baixo. Costuma dizer algo verdadeiro sobre a fonte, uma gravação demasiado parada ou uma conversa sem uma viragem clara, e não que a ferramenta esteja avariada.
O mesmo clipe recebe sempre a mesma nota
Nada no cálculo pede a opinião de um modelo de linguagem. As entradas são a transcrição palavra a palavra, o mapa de atividade vocal, os cortes de plano detetados e a forma de onda do áudio, e a aritmética em cima disso é fixa. Até a frase que explica uma nota é montada a partir dos quatro números em vez de ser escrita para si.
Essa escolha custa-nos subtileza. Um modelo perceberia que uma piada resulta onde uma lista de palavras não consegue. O que ela compra é um sistema com que se pode discutir: quando falta um momento que queria, há um sinal para apontar, e reprocessar o vídeo não produz em silêncio outra resposta. Os modelos entram depois, para escrever títulos e descrições de clipes já selecionados.
O que é afastado antes de você ver
Dois padrões pontuam bem e rendem mal, por isso ambos são tratados de frente. A abertura de um vídeo longo é enérgica e tem forma de gancho, e é também onde vivem as leituras de patrocínio e a promoção do canal: acima de dois minutos, um segmento que começa nos primeiros 45 segundos leva uma penalização fixa. As fórmulas de fecho funcionam em espelho: um segmento carregado de «subscreve» perde pontos em Value e em Trend, e um clipe que abre com isso perde o Hook por completo.
O que a nota não afirma
Não é uma previsão de visualizações, e qualquer ferramenta que diga o contrário vende-lhe um número que não consegue sustentar. O alcance depende do seu público, do seu texto, de quando publica e do que a plataforma favorece nessa semana, e nada disso está no seu ficheiro de origem. A nota ordena os candidatos dentro de um mesmo vídeo, para que comece pelos três melhores em vez dos três primeiros. A decisão editorial, que momento merece o feed, continua a ser sua.
Perguntas
Não. Nada no caminho de pontuação chama um modelo. Os quatro eixos são calculados a partir da transcrição, do mapa de atividade vocal, dos cortes de plano detetados e da forma de onda do áudio. Um modelo escreve depois o título e a descrição, em clipes já escolhidos.
Sim. Mesma fonte, mesmos números. É esse o sentido de um scorer determinista: quando um clipe esperado não aparece, a causa é um sinal que se pode nomear, não um modelo que hoje respondeu de outra forma.
O clipe mediano que produzimos está em 68. Cerca de um em cada quatro está em 80 ou acima, e um em cada dez chega a 85. Um 60 não é um mau clipe, é um clipe abaixo da mediana.
Não, e não vamos afirmá-lo. As visualizações dependem do seu público, da sua miniatura, da hora de publicação e do humor da plataforma nesse dia. A nota ordena candidatos dentro de um mesmo vídeo. É trabalho de triagem, não previsão.
Sim. Os temas e uma instrução personalizada dão um bónus de palavras-chave aos segmentos correspondentes, por isso os momentos pedidos sobem na ordem. É uma simples correspondência de texto, sem custo nem latência adicionais.
Porque pontuam bem pelo motivo errado. Uma abertura a frio é enérgica e tem forma de gancho, e é aí que vivem também as leituras de patrocínio e as promos do canal. Em vídeos com mais de dois minutos, tudo o que começa nos primeiros 45 segundos leva uma penalização fixa.
Veja as notas no seu próprio vídeo
Cada clipe mostra o total e os quatro eixos, para que confronte a ordem com o seu próprio critério em vez de acreditar nela sem mais.