Cómo suena una plantilla
Un editor dice que un borrador suena como si lo hubiera escrito una máquina. Normalmente acierta en lo que escuchó y se equivoca en el porqué — por eso creamos una herramienta que cuenta la textura en lugar de adivinar al autor, y la medimos contra textos que no estaba diseñada para detectar.
Traducido del original en inglés.
La respuesta corta
- what
- Una herramienta gratuita que marca formas de oración repetidas, frases hechas, inicios uniformes y afirmaciones sin verificar en un texto, con la regla que respalda cada marca.
- why
- Los lectores reaccionan a la textura más que a la autoría, y los clasificadores de autoría fallan especialmente con escritores de segunda lengua y registros formales — donde el coste recae en el autor.
- who
- Escritores que defienden una edición, editores que explican lo que escucharon y equipos de contenido cuyas páginas han empezado a sonar similares entre sí.
- where
- En la web pública en getlooploop.com/patternscope, en inglés, ucraniano y español, sin necesidad de cuenta y sin almacenar nada.
- when
- Antes de enviar un borrador, o cuando alguien le ha dicho que suena escrito por una máquina y necesita saber qué escuchó realmente.
- how
- Detectores deterministas — listas de frases, esqueletos de oraciones y recuentos de palabras — puntuados como una densidad ponderada por cada mil palabras, con cada punto trazable a un fragmento marcado.
Explicación sencilla
A veces la escritura resulta monótona aunque cada oración sea correcta, porque las mismas formas se repiten. Esta herramienta colorea las partes que se repiten y indica la regla que las detectó, para que pueda decidir si modificarlas. No adivina quién la escribió.
Un editor devuelve un borrador con una línea: esto suena como si lo hubiera escrito ChatGPT. El autor lo escribió en dos días. Ahora tiene que discutir algo que ninguno de los dos puede señalar. Esa discusión es la razón por la que construimos una herramienta, y la razón por la que se niega a responder la pregunta que le hacen con más frecuencia.
El editor suele tener razón sobre lo que escuchó y equivocarse sobre por qué. Lo que les llamó la atención no es la autoría. Es la textura: la misma forma de frase tres veces, cuatro párrafos que comienzan de la misma manera, una afirmación sin nada en la frase contra lo que contrastarla. Esos son contables. Quién lo tecleó no lo es.
No lance un detector que no pueda explicarse a sí mismo o cuyos falsos positivos hagan que la puntuación sea menos útil que una lectura manual.
nuestro propio plan de construcción, escrito antes de que existiera todo esto
Por qué no un detector de IA
Investigamos la posibilidad de crear uno y descartamos la idea, por dos motivos que no guardan relación con la dificultad.
El primero es el lugar donde se producen los errores. Los clasificadores que intentan adivinar la autoría fallan con mayor frecuencia en autores que escriben en segunda lengua y en registros formales, los dos grupos menos capaces de impugnar un veredicto. Una herramienta con un 95 % de acierto es una herramienta que se equivoca con seguridad en un borrador de cada veinte, y el coste recae en el autor, no en nosotros.
El segundo es que un veredicto resulta inútil incluso cuando es correcto. Un asistente escribió esto no altera el borrador que tiene delante. Esta forma de oración aparece cuatro veces en novecientas palabras, aquí están las cuatro es una corrección que puede realizar antes del almuerzo.
Las cuatro cosas que contamos
Cada hallazgo es un fragmento de su propio texto con la regla que lo generó indicada al lado. Cuatro familias, porque un lector puede mantener cuatro:
- Stock phrasing — una frase que ocupa el lugar donde corresponde algo específico. Cabe señalar que. En relación con el hecho de que.
- Repeated shape — dos oraciones reducidas al mismo esqueleto. Palabras distintas, una construcción.
- Uniform openings — tres o más oraciones consecutivas que comienzan de la misma forma, informadas como un solo hallazgo en lugar de tres.
- Unchecked claims — un adjetivo evaluativo sobre un sustantivo abstracto, en una oración sin nada verificable.
Esa última condición es la que lo convierte en un detector y no en una opinión de estilo. Una solución integral es la afirmación. Una solución integral que redujo el tiempo de revisión de nueve días a dos son las mismas palabras con la evidencia adjunta, y la segunda no está marcada.
skeletonOf("Our approach delivers a comprehensive solution")
→ "our · · art · ·"
skeletonOf("Our team delivers an individual approach")
→ "our · · art · ·"
// Different sentences. The same sentence. The skeleton is what says so —
// and the article/an distinction is dropped on purpose, because the surface
// form of an article is exactly the noise a skeleton exists to remove.Pruébelo en una página propia
Vea qué encuentra PatternScope en una página suya
Todo lo anterior se puede medir en su propio trabajo, y la comprobación lleva cerca de un minuto. Pegue una dirección y lea lo que vuelve.
Abrir PatternScopeGratis · sin cuenta · una cada vez
Cada punto se remite a una marca
El número es una densidad ponderada de hallazgos por mil palabras. Un hallazgo ligero cuenta 1, uno medio 3, uno pesado 6. El desglose al lado es el número, no un gráfico dibujado cerca. Si se discrepa con una familia completa, se puede restar manualmente. Si se descarta un hallazgo, la puntuación disminuye exactamente en los puntos de ese hallazgo.
Densidad por mil palabras, porque un recuento bruto premia la longitud. Una página de destino de cuatrocientos palabras con seis frases estándar es más densa que un informe de cuatro mil palabras con quince. El recuento indica lo contrario.
Un hábito no puede abarcar toda la lectura. Una página construida a partir de una plantilla repite una frase cuarenta veces. Solo las primeras cuatro puntúan. Las otras treinta y seis se informan como suprimidas. Las cuarenta siguen marcadas en el texto. El límite se refiere a la puntuación, no a la ocultación.
Entonces anotamos las etiquetas y las etiquetas no coincidían
Hasta este punto, cada umbral de la herramienta se había comprobado con frases diseñadas para activarlo. Eso es una prueba del código, no del juicio:, por supuesto, un detector se dispara con una frase construida para hacerlo.
Así construimos un conjunto etiquetado —catorce documentos en tres idiomas y cinco tipos de escritura: marketing de plantilla, prosa bien editada, documentación técnica, una anáfora deliberada y un contrato uniforme a propósito. Los umbrales son asimétricos, y así es intencionalmente. En prosa escrita para ser buena, la tolerancia es cero: un hallazgo allí es un falso positivo que no puede ser desestimado. La recuperación se mide pero no se obliga al 100 %, porque la misma persona redactó las reglas y las etiquetas, y el acuerdo allí es un acuerdo consigo mismo.
| Tipo de escritura | Documentos | Hallazgos | Lectura |
|---|---|---|---|
| Prosa bien editada | 4 | 0 | limpia, según la etiqueta |
| Documentación técnica | 3 | 0 | limpia, según la etiqueta |
| Anáfora deliberada | 2 | 2 | marcada a propósito, descartada en una pulsación |
| Legal, uniforme por diseño | 1 | 1 | marcada a propósito, descartada en una pulsación |
| Marketing de plantillas | 4 | 30 | para lo que la herramienta existe |
Tres defectos, ninguno de los cuales un test unitario podría haber detectado
Una ventana de dos palabras es incorrecta para la mitad de los idiomas en los que publicamos
We deliver quality / We deliver speed comparten la apertura we deliver. El español que significa lo mismo — Ofrecemos calidad / Ofrecemos rapidez — omite el pronombre, de modo que dos palabras se extienden más allá del verbo hasta el objeto, y el caso pasó sin registrarse. El español y el ucraniano son lenguas pro‑drop; el inglés no lo es; no existe una constante válida para ambos. La ventana pasa a ser una palabra de contenido más las palabras funcionales que la preceden: la misma cantidad de oración en cada idioma, en lugar del mismo número de palabras.
El techo era una conjetura vestida con la apariencia de una medida
La puntuación se saturó en 12 puntos ponderados por mil palabras, con un comentario que afirmaba la existencia de un conjunto de calibración detrás. No había ningún conjunto de calibración. Si se mide correctamente, la prosa limpia se sitúa en 0, un dispositivo deliberado entre 34 y 83, y el marketing de plantillas entre 205 y 472 — por lo que el techo anterior era bajo en más de una orden de magnitud, y un contrato de sesenta y tres palabras con una repetición deliberada obtuvo 100 de 100. Cada documento breve con un hallazgo importante saturó una escala diseñada para una página.
Un test que no podía fallar
Una prueba contenía 55 palabras frente a un mínimo de 60, de modo que la herramienta rechazó puntuarla correctamente y la aserción sobre descartar un hallazgo se aprobó sin ejecutarse. Un test que no puede fallar es peor que la ausencia de test, porque se contabiliza.
Resultados ponderados por cada 1 000 palabras, medidos en el conjunto etiquetado
Tres idiomas, tres léxicos, sin traducciones
Inglés, ucraniano y español, y cada uno dispone de su propia lista de frases redactada por quien escribe ese idioma. No se trata de exhaustividad por sí misma. У зв'язку з тим, що y in connection with the fact that son dos hábitos diferentes en dos lenguas distintas; una lista traducida de una mide la traducción en lugar del texto. Los umbrales se calcularon por idioma también, y no se heredaron de los de inglés.
El francés y el polaco están en la hoja de ruta bajo una única condición: cada uno necesita primero su propio conjunto etiquetado — el mismo criterio que superaron los tres primeros.
Lo que aún no puede decirte
Cada documento del conjunto etiquetado tiene entre 60 y 300 palabras, por lo que el extremo superior de la escala es una extrapolación a partir de una única constante. Una página de dos mil palabras con una frase típica cada cien palabras se considera baja hoy, y nada de lo que hemos medido demuestra que sea correcto. Los documentos extensos son lo siguiente que se incorporará al conjunto, y probablemente volverán a elevar el techo.
Tampoco puede determinar si su argumento es correcto, si el orden de sus secciones es incorrecto, o si el texto merecía escribirse. Cuatro reglas no constituyen la totalidad de una buena escritura y una puntuación de 0 es una lectura, no un elogio.
Preguntas que la gente formula
¿Es esto un detector de IA?
No, y no se convertirá en uno. No juzga si un texto fue escrito por una persona o por un modelo y tampoco lo implica. Encuentra patrones editoriales específicos y muestra dónde está cada uno.
¿Un puntaje alto indica que la escritura es mala?
No. La densidad de patrones es una señal editorial, no una calificación. Un contrato es uniforme a propósito y una anáfora se repite a propósito, y ambos aparecen como densos. El número indica dónde buscar; si constituye una falla depende de usted.
¿Qué ocurre con el texto que pego?
Se analiza dentro de la solicitud y no se almacena. No hay copia de nuestra parte, no hay página de resultados que mantener fuera de la búsqueda, no hay período de retención que explicar. Ningún modelo lo ve tampoco: cada detector es determinista, por eso el mismo texto siempre produce la misma lectura.
¿Por qué el puntaje está limitado?
Por encima del límite el número deja de distinguir cualquier cosa — 340 y 700 por mil palabras son ambos prosa que nadie quiere leer. La herramienta indica que la lectura está en su límite en lugar de pretender que la distancia signifique algo.
¿Puedo discrepar con un hallazgo?
Sí, y es con una sola pulsación. Una serie de aperturas idénticas se presenta como un único hallazgo que cubre todo el documento, de modo que descartar una anáfora deliberada no cuesta cuatro clics. El puntaje disminuye exactamente en lo que usted descartó.
¿Qué idiomas analiza?
Inglés, ucraniano y español, cada uno con sus propias listas de frases y sus propios umbrales. El texto en otro idioma no se analiza, en lugar de analizarse mal, y la razón está en el artículo anterior: un detector sin su propio léxico devuelve cero para todo, y cero se interpreta como elogio.
Léalo usted mismo
Pegue una página en PatternScope y vea a qué reacciona el lector. Se sitúa junto a otras tres lecturas gratuitas en la página de free tools, y el vocabulario de este artículo — AI slop, near-duplicate content, Goodhart's law — está en el glosario.
Ese último vale la pena leerlo antes de optimizar este número. Una medida que se convierte en objetivo deja de medir, y un escritor que edita para bajar la puntuación en lugar de ser comprendido ha tomado la instrucción equivocada de una herramienta que solo pretendía señalar.
El producto
Véalo en cada página, cada día
Una lectura dice dónde está una página hoy. El producto hace las mismas preguntas a los mismos asistentes de forma continua, así que un cambio es algo que se le cuenta y no algo que tenga que ir a buscar.
Pedir una invitaciónSolo por invitación mientras mantenemos honestas las lecturas
Autor
GetLoopLoop AIautor
Más de 15 años en marketing y SEO. Decenas de productos, sobre todo el mercado estadounidense. Investigación y medición.
LinkedInPass it on
Read in your language
Opens a browser translation of this English article. The original source stays in English.