Los modelos Llama escriben posts de blog peor que Claude — y aquí está el porqué
El post en wakamoleguy.com le hace a los LLMs una prueba de estrés silenciosa: les pides que escriban un post de blog y luego miras el resultado. La afirmación principal es que los modelos Llama son sorprendentemente malos para esto, peores que Claude para la tarea — no porque sean tontos, sino porque la forma en que se entrenan los hace derivar hacia un cierto tipo de escritura genérica.
El artículo pasa por lo que realmente sale mal. Llama escribe oraciones que son gramaticalmente correctas pero estructuralmente planas. Se va por defecto a la misma cadencia entre temas — las mismas aperturas, las mismas transiciones. Evita errores siendo segura, y la seguridad se parece a la uniformidad. Claude, por el contrario, tiende a tomar un par de riesgos más en la longitud y estructura de las oraciones, lo que hace que la escritura se lea más como algo que escribió una persona que como palabras generadas por un modelo.
El punto más profundo no es una paliza a Llama — es una lección sobre cómo los objetivos de entrenamiento moldean la salida. Si recompensas a un modelo por ser correcto y pertinente, obtienes escritura que juega seguro. Si la recompensas por ser interesante o variada, obtienes escritura con más textura. Ambos modelos son capaces. La diferencia está en lo que el entrenamiento los empujó a hacer.
Por qué nos importa: este es el tipo de escritura que el sitio realmente necesita — clara, no genérica. Si el modelo que eliges deriva hacia la uniformidad, el blog se lee como una plantilla. Si tiene un poco de filo, se lee como si lo escribieron personas.
“Llama escribe oraciones que son correctas pero planas — el modelo evita errores siendo seguro, y la seguridad se parece a la uniformidad.”