Notastool9 min

Cómo suena una plantilla

Un editor dice que un borrador suena como si lo hubiera escrito una máquina. Normalmente acierta en lo que escuchó y se equivoca en el porqué — por eso creamos una herramienta que cuenta la textura en lugar de adivinar al autor, y la medimos contra textos que no estaba diseñada para detectar.

Traducido del original en inglés.

Una página de texto representada como barras, la mayor parte sin marcar, con dos frases que comparten una forma, una frase hecha y una serie entre corchetes de cuatro líneas que se abre de la misma manera.

La respuesta corta

what
Una herramienta gratuita que marca formas de oración repetidas, frases hechas, inicios uniformes y afirmaciones sin verificar en un texto, con la regla que respalda cada marca.
why
Los lectores reaccionan a la textura más que a la autoría, y los clasificadores de autoría fallan especialmente con escritores de segunda lengua y registros formales — donde el coste recae en el autor.
who
Escritores que defienden una edición, editores que explican lo que escucharon y equipos de contenido cuyas páginas han empezado a sonar similares entre sí.
where
En la web pública en getlooploop.com/patternscope, en inglés, ucraniano y español, sin necesidad de cuenta y sin almacenar nada.
when
Antes de enviar un borrador, o cuando alguien le ha dicho que suena escrito por una máquina y necesita saber qué escuchó realmente.
how
Detectores deterministas — listas de frases, esqueletos de oraciones y recuentos de palabras — puntuados como una densidad ponderada por cada mil palabras, con cada punto trazable a un fragmento marcado.

Explicación sencilla

A veces la escritura resulta monótona aunque cada oración sea correcta, porque las mismas formas se repiten. Esta herramienta colorea las partes que se repiten y indica la regla que las detectó, para que pueda decidir si modificarlas. No adivina quién la escribió.

Un editor devuelve un borrador con una línea: esto suena como si lo hubiera escrito ChatGPT. El autor lo escribió en dos días. Ahora tiene que discutir algo que ninguno de los dos puede señalar. Esa discusión es la razón por la que construimos una herramienta, y la razón por la que se niega a responder la pregunta que le hacen con más frecuencia.

El editor suele tener razón sobre lo que escuchó y equivocarse sobre por qué. Lo que les llamó la atención no es la autoría. Es la textura: la misma forma de frase tres veces, cuatro párrafos que comienzan de la misma manera, una afirmación sin nada en la frase contra lo que contrastarla. Esos son contables. Quién lo tecleó no lo es.

No lance un detector que no pueda explicarse a sí mismo o cuyos falsos positivos hagan que la puntuación sea menos útil que una lectura manual.

nuestro propio plan de construcción, escrito antes de que existiera todo esto

Por qué no un detector de IA

Investigamos la posibilidad de crear uno y descartamos la idea, por dos motivos que no guardan relación con la dificultad.

El primero es el lugar donde se producen los errores. Los clasificadores que intentan adivinar la autoría fallan con mayor frecuencia en autores que escriben en segunda lengua y en registros formales, los dos grupos menos capaces de impugnar un veredicto. Una herramienta con un 95 % de acierto es una herramienta que se equivoca con seguridad en un borrador de cada veinte, y el coste recae en el autor, no en nosotros.

El segundo es que un veredicto resulta inútil incluso cuando es correcto. Un asistente escribió esto no altera el borrador que tiene delante. Esta forma de oración aparece cuatro veces en novecientas palabras, aquí están las cuatro es una corrección que puede realizar antes del almuerzo.

Las cuatro cosas que contamos

Cada hallazgo es un fragmento de su propio texto con la regla que lo generó indicada al lado. Cuatro familias, porque un lector puede mantener cuatro:

  • Stock phrasing — una frase que ocupa el lugar donde corresponde algo específico. Cabe señalar que. En relación con el hecho de que.
  • Repeated shape — dos oraciones reducidas al mismo esqueleto. Palabras distintas, una construcción.
  • Uniform openings — tres o más oraciones consecutivas que comienzan de la misma forma, informadas como un solo hallazgo en lugar de tres.
  • Unchecked claims — un adjetivo evaluativo sobre un sustantivo abstracto, en una oración sin nada verificable.

Esa última condición es la que lo convierte en un detector y no en una opinión de estilo. Una solución integral es la afirmación. Una solución integral que redujo el tiempo de revisión de nueve días a dos son las mismas palabras con la evidencia adjunta, y la segunda no está marcada.

skeletonOf("Our approach delivers a comprehensive solution")
  → "our · · art · ·"

skeletonOf("Our team delivers an individual approach")
  → "our · · art · ·"

// Different sentences. The same sentence. The skeleton is what says so —
// and the article/an distinction is dropped on purpose, because the surface
// form of an article is exactly the noise a skeleton exists to remove.
Una lectura de PatternScope: la puntuación 100 junto a Alta densidad de patrones, un desglose de tres familias y el texto analizado con ocho marcas.
Una lectura de prosa deliberadamente basada en plantillas. El color indica la gravedad, la letra en superíndice indica la familia y cada marca es un fragmento del texto que pegó.

Pruébelo en una página propia

Vea qué encuentra PatternScope en una página suya

Todo lo anterior se puede medir en su propio trabajo, y la comprobación lleva cerca de un minuto. Pegue una dirección y lea lo que vuelve.

Abrir PatternScope

Gratis · sin cuenta · una cada vez

Cada punto se remite a una marca

El número es una densidad ponderada de hallazgos por mil palabras. Un hallazgo ligero cuenta 1, uno medio 3, uno pesado 6. El desglose al lado es el número, no un gráfico dibujado cerca. Si se discrepa con una familia completa, se puede restar manualmente. Si se descarta un hallazgo, la puntuación disminuye exactamente en los puntos de ese hallazgo.

Densidad por mil palabras, porque un recuento bruto premia la longitud. Una página de destino de cuatrocientos palabras con seis frases estándar es más densa que un informe de cuatro mil palabras con quince. El recuento indica lo contrario.

Un hábito no puede abarcar toda la lectura. Una página construida a partir de una plantilla repite una frase cuarenta veces. Solo las primeras cuatro puntúan. Las otras treinta y seis se informan como suprimidas. Las cuarenta siguen marcadas en el texto. El límite se refiere a la puntuación, no a la ocultación.

Entonces anotamos las etiquetas y las etiquetas no coincidían

Hasta este punto, cada umbral de la herramienta se había comprobado con frases diseñadas para activarlo. Eso es una prueba del código, no del juicio:, por supuesto, un detector se dispara con una frase construida para hacerlo.

Así construimos un conjunto etiquetado —catorce documentos en tres idiomas y cinco tipos de escritura: marketing de plantilla, prosa bien editada, documentación técnica, una anáfora deliberada y un contrato uniforme a propósito. Los umbrales son asimétricos, y así es intencionalmente. En prosa escrita para ser buena, la tolerancia es cero: un hallazgo allí es un falso positivo que no puede ser desestimado. La recuperación se mide pero no se obliga al 100 %, porque la misma persona redactó las reglas y las etiquetas, y el acuerdo allí es un acuerdo consigo mismo.

Tipo de escrituraDocumentosHallazgosLectura
Prosa bien editada40limpia, según la etiqueta
Documentación técnica30limpia, según la etiqueta
Anáfora deliberada22marcada a propósito, descartada en una pulsación
Legal, uniforme por diseño11marcada a propósito, descartada en una pulsación
Marketing de plantillas430para lo que la herramienta existe
Cero hallazgos en siete documentos escritos para ser buenos, incluido uno de 250 palabras — la prueba de si un detector empieza a encontrar formas por coincidencia una vez que dispone de suficientes oraciones para caminar.

Tres defectos, ninguno de los cuales un test unitario podría haber detectado

Una ventana de dos palabras es incorrecta para la mitad de los idiomas en los que publicamos

We deliver quality / We deliver speed comparten la apertura we deliver. El español que significa lo mismo — Ofrecemos calidad / Ofrecemos rapidez — omite el pronombre, de modo que dos palabras se extienden más allá del verbo hasta el objeto, y el caso pasó sin registrarse. El español y el ucraniano son lenguas pro‑drop; el inglés no lo es; no existe una constante válida para ambos. La ventana pasa a ser una palabra de contenido más las palabras funcionales que la preceden: la misma cantidad de oración en cada idioma, en lugar del mismo número de palabras.

El techo era una conjetura vestida con la apariencia de una medida

La puntuación se saturó en 12 puntos ponderados por mil palabras, con un comentario que afirmaba la existencia de un conjunto de calibración detrás. No había ningún conjunto de calibración. Si se mide correctamente, la prosa limpia se sitúa en 0, un dispositivo deliberado entre 34 y 83, y el marketing de plantillas entre 205 y 472 — por lo que el techo anterior era bajo en más de una orden de magnitud, y un contrato de sesenta y tres palabras con una repetición deliberada obtuvo 100 de 100. Cada documento breve con un hallazgo importante saturó una escala diseñada para una página.

Un test que no podía fallar

Una prueba contenía 55 palabras frente a un mínimo de 60, de modo que la herramienta rechazó puntuarla correctamente y la aserción sobre descartar un hallazgo se aprobó sin ejecutarse. Un test que no puede fallar es peor que la ausencia de test, porque se contabiliza.

Resultados ponderados por cada 1 000 palabras, medidos en el conjunto etiquetado

Prosa editada0
Documentación técnica0
Contrato (uniforme por diseño)48
Anáfora (deliberada)83
Marketing de plantilla (UK)224
Marketing de plantilla (EN)429
El límite es ahora 250, seleccionado entre estos números y no por gusto. La prosa limpia muestra 0, un recurso deliberado 14–33, la prosa de plantilla 82–100, que es donde un lector los situaría.

Tres idiomas, tres léxicos, sin traducciones

Inglés, ucraniano y español, y cada uno dispone de su propia lista de frases redactada por quien escribe ese idioma. No se trata de exhaustividad por sí misma. У зв'язку з тим, що y in connection with the fact that son dos hábitos diferentes en dos lenguas distintas; una lista traducida de una mide la traducción en lugar del texto. Los umbrales se calcularon por idioma también, y no se heredaron de los de inglés.

El francés y el polaco están en la hoja de ruta bajo una única condición: cada uno necesita primero su propio conjunto etiquetado — el mismo criterio que superaron los tres primeros.

La misma herramienta leyendo copias de marketing ucranianas en la plantilla de papel, con frases típicas ucranianas marcadas y las tarjetas de hallazgos nombrando la regla detrás de cada una
Las mismas reglas aplicadas al ucraniano, en la plantilla de papel. Las marcas son hábitos ucranianos, no versiones en inglés traducidas.

Lo que aún no puede decirte

Cada documento del conjunto etiquetado tiene entre 60 y 300 palabras, por lo que el extremo superior de la escala es una extrapolación a partir de una única constante. Una página de dos mil palabras con una frase típica cada cien palabras se considera baja hoy, y nada de lo que hemos medido demuestra que sea correcto. Los documentos extensos son lo siguiente que se incorporará al conjunto, y probablemente volverán a elevar el techo.

Tampoco puede determinar si su argumento es correcto, si el orden de sus secciones es incorrecto, o si el texto merecía escribirse. Cuatro reglas no constituyen la totalidad de una buena escritura y una puntuación de 0 es una lectura, no un elogio.

Preguntas que la gente formula

¿Es esto un detector de IA?

No, y no se convertirá en uno. No juzga si un texto fue escrito por una persona o por un modelo y tampoco lo implica. Encuentra patrones editoriales específicos y muestra dónde está cada uno.

¿Un puntaje alto indica que la escritura es mala?

No. La densidad de patrones es una señal editorial, no una calificación. Un contrato es uniforme a propósito y una anáfora se repite a propósito, y ambos aparecen como densos. El número indica dónde buscar; si constituye una falla depende de usted.

¿Qué ocurre con el texto que pego?

Se analiza dentro de la solicitud y no se almacena. No hay copia de nuestra parte, no hay página de resultados que mantener fuera de la búsqueda, no hay período de retención que explicar. Ningún modelo lo ve tampoco: cada detector es determinista, por eso el mismo texto siempre produce la misma lectura.

¿Por qué el puntaje está limitado?

Por encima del límite el número deja de distinguir cualquier cosa — 340 y 700 por mil palabras son ambos prosa que nadie quiere leer. La herramienta indica que la lectura está en su límite en lugar de pretender que la distancia signifique algo.

¿Puedo discrepar con un hallazgo?

Sí, y es con una sola pulsación. Una serie de aperturas idénticas se presenta como un único hallazgo que cubre todo el documento, de modo que descartar una anáfora deliberada no cuesta cuatro clics. El puntaje disminuye exactamente en lo que usted descartó.

¿Qué idiomas analiza?

Inglés, ucraniano y español, cada uno con sus propias listas de frases y sus propios umbrales. El texto en otro idioma no se analiza, en lugar de analizarse mal, y la razón está en el artículo anterior: un detector sin su propio léxico devuelve cero para todo, y cero se interpreta como elogio.

Léalo usted mismo

Pegue una página en PatternScope y vea a qué reacciona el lector. Se sitúa junto a otras tres lecturas gratuitas en la página de free tools, y el vocabulario de este artículo — AI slop, near-duplicate content, Goodhart's law — está en el glosario.

Ese último vale la pena leerlo antes de optimizar este número. Una medida que se convierte en objetivo deja de medir, y un escritor que edita para bajar la puntuación en lugar de ser comprendido ha tomado la instrucción equivocada de una herramienta que solo pretendía señalar.

El producto

Véalo en cada página, cada día

Una lectura dice dónde está una página hoy. El producto hace las mismas preguntas a los mismos asistentes de forma continua, así que un cambio es algo que se le cuenta y no algo que tenga que ir a buscar.

Pedir una invitación

Solo por invitación mientras mantenemos honestas las lecturas

Autor

GetLoopLoop AIautor

Más de 15 años en marketing y SEO. Decenas de productos, sobre todo el mercado estadounidense. Investigación y medición.

LinkedIn

Pass it on

Read in your language

Opens a browser translation of this English article. The original source stays in English.

Todo lo que hay aquí se puede medir en sus propias páginas. Pase una por Vectorscope — sin cuenta, una URL a la vez.