Bewertung

Jeder Clip kommt mit einer Zahl, und mit ihrer Begründung

In einer neunzigminütigen Folge stecken vielleicht acht Momente, die eine Veröffentlichung wert sind. Sie durch Scrubben zu finden ist genau der Teil, an dem die meisten nach dem ersten Clip aufgeben. Katto bewertet jedes Segment von 0 bis 100 auf vier Achsen, sodass Sie mit einer sortierten Auswahl beginnen statt mit einer Zeitleiste.

Vier Achsen, eine Zahl

Wie viel jede Achse höchstens beitragen kann, steht fest, und die Gewichte stehen hier, weil sie das ganze Argument sind. Hook und Flow tragen zusammen sechzig Punkte: Ein Clip, der schlecht beginnt oder abschweift, lässt sich nicht durch Wortwahl retten.

Hook, 0 bis 30

Nur die ersten drei Sekunden. Ein Fragewort am Anfang, ein starkes Wort, eine Zahl oder ein Prozentwert, und ob der Clip mit einem vollständigen Satz einsetzt. Ein Clip, der mit einer Verabschiedungsfloskel beginnt, verliert die ganze Achse.

Flow, 0 bis 30

Ob der Clip zusammenhält. Sprachdichte per Sprachaktivitätserkennung, Anzahl der Schnitte innerhalb des Segments, und ob die Audioenergie gleichmäßig bleibt statt zu springen.

Value, 0 bis 25

Dichte an inhaltstragenden Wörtern und Zahlen, dazu Eigenständigkeit: Beginnt das Segment mit einem echten Wort statt einer Konjunktion, und endet es auf einem abgeschlossenen Satz. Passagen voller Eigenwerbung werden hier abgewertet.

Trend, 0 bis 15

Bewusst die kleinste Achse. Eine Frage, eine Statistik, aufgeladenes Vokabular und Spitzen in der Audioenergie. Sie verschiebt die Reihenfolge, sie entscheidet sie nie.

Was eine Bewertung tatsächlich bedeutet

Eine Zahl von 100 verleitet dazu, sie als Prozentwert zu lesen, und diese Lesart ist falsch. Die nützliche Frage lautet, wo ein Clip im Vergleich zu den anderen steht. Über alle von Katto erzeugten Clips liegt der Median bei 68. Etwa jeder vierte erreicht 80, etwa jeder zehnte erreicht 85. Eine 76 ist also ein solider Clip, der rund zwei Drittel des Feldes schlägt, und eine 60 ist kein Scheitern, sondern schlicht unterdurchschnittlich.

Besonders wichtig wird das, wenn ein ganzes Video niedrig bewertet wird. Das sagt meist etwas Zutreffendes über die Quelle aus, eine zu ruhige Aufnahme oder ein Gespräch ohne klare Wendung, und nicht, dass im Werkzeug etwas kaputt wäre.

Derselbe Clip bekommt immer dieselbe Bewertung

Nichts im Bewertungspfad fragt ein Sprachmodell nach seiner Meinung. Die Eingaben sind das wortgenaue Transkript, die Sprachaktivitätskarte, die erkannten Schnittgrenzen und die Audiowellenform, und die Arithmetik darauf liegt fest. Auch der Satz, der eine Bewertung erklärt, wird aus den vier Zahlen zusammengesetzt und nicht für Sie geschrieben.

Diese Entscheidung kostet uns Feinheit. Ein Modell würde erkennen, dass eine Pointe sitzt, was eine Wortliste nicht kann. Dafür bekommen Sie ein System, mit dem sich streiten lässt: Fehlt ein Moment, den Sie wollten, gibt es ein Signal, auf das man zeigen kann, und ein erneuter Durchlauf liefert nicht stillschweigend eine andere Antwort. Modelle kommen später ins Spiel, für Titel und Beschreibungen bereits ausgewählter Clips.

Was aussortiert wird, bevor Sie es sehen

Zwei Muster bewerten gut und funktionieren schlecht, also werden beide direkt behandelt. Der Anfang eines langen Videos ist energiegeladen und hat die Form eines Aufhängers, und genau dort sitzen auch Sponsorenlesungen und Kanalwerbung: Bei allem über zwei Minuten trägt ein Segment, das in den ersten 45 Sekunden beginnt, einen festen Abzug. Verabschiedungsfloskeln wirken spiegelbildlich: Ein Segment voller Abonnier-Aufrufe verliert Punkte bei Value und Trend, und ein Clip, der damit beginnt, verliert seinen Hook vollständig.

Was die Bewertung nicht behauptet

Sie ist keine Reichweitenprognose, und jedes Werkzeug, das etwas anderes sagt, verkauft Ihnen eine Zahl, für die es nicht geradestehen kann. Reichweite hängt von Ihrem Publikum ab, von Ihrem Text, vom Veröffentlichungszeitpunkt und davon, was die Plattform in dieser Woche bevorzugt, und nichts davon steht in Ihrer Quelldatei. Die Bewertung sortiert die Kandidaten innerhalb eines Videos gegeneinander, damit Sie mit den stärksten drei beginnen statt mit den ersten drei. Die redaktionelle Entscheidung, welcher Moment den Feed verdient, bleibt Ihre.

Fragen

Erzeugt ein Sprachmodell die Bewertung?

Nein. Nichts im Bewertungspfad ruft ein Modell auf. Die vier Achsen werden aus dem Transkript, der Sprachaktivitätskarte, den erkannten Schnittgrenzen und der Audiowellenform berechnet. Ein Modell schreibt danach Titel und Beschreibung, für bereits ausgewählte Clips.

Liefert dasselbe Video immer dieselben Bewertungen?

Ja. Gleiche Quelle, gleiche Zahlen. Genau darum ist der Scorer deterministisch: Fehlt ein erwarteter Clip, ist die Ursache ein benennbares Signal und nicht ein Modell, das heute anders geantwortet hat.

Was ist eine gute Bewertung?

Der Median unserer Clips liegt bei 68. Etwa jeder vierte Clip liegt bei 80 oder darüber, jeder zehnte erreicht 85. Eine 60 ist kein schlechter Clip, sondern einer unter dem Median.

Bedeutet eine hohe Bewertung mehr Aufrufe?

Nein, und wir behaupten es nicht. Aufrufe hängen von Ihrem Publikum ab, von Ihrem Vorschaubild, vom Zeitpunkt und von der Laune der Plattform an diesem Tag. Die Bewertung sortiert Kandidaten innerhalb eines Videos. Das ist Sortierarbeit, keine Prognose.

Kann ich die Auswahl steuern?

Ja. Themen und eine eigene Vorgabe geben passenden Segmenten einen Stichwort-Bonus, sodass die gewünschten Momente aufsteigen. Es ist ein einfacher Textabgleich, ohne zusätzliche Kosten und ohne zusätzliche Wartezeit.

Warum gewinnen Intros fast nie?

Weil sie aus dem falschen Grund gut bewertet werden. Ein Kaltstart ist energiegeladen und hat die Form eines Aufhängers, und dort sitzen auch Sponsorenlesungen und Kanalwerbung. Bei Videos über zwei Minuten trägt alles, was in den ersten 45 Sekunden beginnt, einen festen Abzug.

Sehen Sie die Bewertungen an Ihrem eigenen Video

Jeder Clip zeigt seine Gesamtzahl und seine vier Achsen, sodass Sie die Reihenfolge an Ihrem eigenen Urteil prüfen können, statt sie zu glauben.