Drei KIs, ein Text, und ich lag daneben

Ich habe drei Modelle denselben kurzen Text schreiben lassen und blind gewählt. Gewonnen hat das, das ich noch nie benutzt hatte.

Mein KI-Dashboard entscheidet seit heute selbst, welches Modell antwortet. Ein kleines, schnelles Modell schaut sich die Frage an und reicht sie weiter: Code hierhin, Recherche dorthin, Kreatives woanders hin. Nur bei einer Frage war ich unsicher: Wer schreibt eigentlich am besten? Im Internet stand ganz oben ein offenes Modell namens Kimi, das ich noch nie benutzt hatte. Das konnte ich nicht glauben.

Also getestet: dieselbe Aufgabe an drei Modelle, ein kurzer Text über eine KI, die nachts von allein weiterarbeitet. Die Ergebnisse bekamen nur Buchstaben, A, B und C. Ich habe gelesen und A gewählt. Und je öfter ich A las, desto besser gefiel es mir. Der beste Satz stand da drin: „Ich zog den Stecker nicht.“

A war Kimi. Die Liste, der ich nicht geglaubt hatte, hatte recht. Das hätte ich nicht erwartet.

Und noch etwas: Gebaut hat den Test Claude. Sein eigener Text lief mit, es hat verloren, und das Ergebnis hat es selbst in meine Tabelle eingetragen.


Write a comment