Volver al blog

Cómo Medimos la "IA Promedio" — La Metodología Detrás de Su Radar Writing DNA

Su radar Writing DNA lo compara con la 'IA Promedio'. Así es exactamente cómo medimos esa referencia — 320 muestras, 5 modelos, 4 idiomas y la estilometría computacional detrás de cada eje.

By Emmanuel

Style ProfilesResearch
Compartir:

Su Writing DNA Snapshot incluye un gráfico radar. Seis ejes. Dos formas superpuestas: una es la suya, la otra está etiquetada como "IA Promedio". Las diferencias entre ambas formas cuentan la historia de lo que hace que su escritura sea distintivamente humana.

Pero, ¿qué significa realmente "IA Promedio"? ¿De dónde viene esa referencia? ¿Y por qué debería confiar en ella?

La mayoría de las herramientas de escritura con IA evadirían la pregunta. Nosotros preferimos mostrar nuestro trabajo.


Los Seis Ejes: Qué Medimos y Cómo

Cada eje del radar captura una dimensión específica del estilo de escritura. No son categorías arbitrarias. Provienen de la estilometría computacional — una disciplina con décadas de investigación respaldándola. Las fórmulas son deterministas: dado el mismo texto, producen los mismos puntajes cada vez.

Esto es lo que mide cada uno.

1. Complejidad de las Oraciones

Este eje captura cuán estructuralmente densas son sus oraciones. Utilizamos una curva sigmoide aplicada a la longitud promedio de las oraciones y la desviación estándar, lo que evita que el puntaje alcance un techo fijo en valores extremos.

Un escritor que promedia 22 palabras por oración con alta variación (mezclando líneas cortas y contundentes con largas explicativas) obtendrá un puntaje diferente al de alguien que escribe consistentemente a 15 palabras. Ambos patrones son válidos. El puntaje no es un juicio — es una medición.

Lo que refleja: La arquitectura estructural de sus oraciones. Las oraciones largas y anidadas empujan el puntaje hacia arriba. Las oraciones cortas y directas lo bajan.

2. Rango de Vocabulario

Calculamos esto usando el Ratio Tipo-Token (TTR) — el número de palabras únicas dividido por el total de palabras. Un TTR de 0,60 significa que el 60 % de sus palabras son únicas; un TTR de 0,30 significa que reutiliza vocabulario con mayor frecuencia.

Para el texto en japonés, esto se vuelve interesante. El japonés no usa espacios entre palabras, por lo que la tokenización estándar falla. Utilizamos Intl.Segmenter para la tokenización morfológica — dividiendo el texto japonés en límites de palabras apropiados antes de contar. El puntaje de vocabulario de un usuario japonés se calcula de la misma manera conceptualmente, pero con mecanismos apropiados para el idioma.

Lo que refleja: Diversidad léxica. Los escritores con vocabulario amplio obtienen puntajes más altos. Los que dependen de un conjunto reducido de palabras familiares obtienen puntajes más bajos. Ninguno es inherentemente mejor — algunas de las comunicaciones empresariales más efectivas utilizan un vocabulario deliberadamente restringido.

3. Expresividad

Este eje mide la energía emocional y retórica en su texto. La fórmula combina cinco señales:

  • Ratio de exclamación: Con qué frecuencia termina oraciones con signos de exclamación en relación con todos los finales de oración
  • Ratio de preguntas: Con qué frecuencia usa preguntas
  • Marcadores de actitud: Palabras y frases que señalan opinión personal o emoción (por cada 1.000 palabras)
  • Uso de rayas: Un signo de puntuación que agrega énfasis y energía parentética (por cada 1.000 palabras)
  • Uso de puntos suspensivos: Pensamientos inconclusos que crean ritmo e implicación (por cada 1.000 palabras)

Un redactor de informes técnicos que evita signos de exclamación y preguntas retóricas obtendrá un puntaje bajo. Un redactor publicitario que usa preguntas contundentes y rayas obtendrá un puntaje alto.

Lo que refleja: La textura emocional de su escritura. No si usted es emotivo — sino si su escritura contiene marcadores expresivos.

4. Formalidad

La formalidad se mide mediante una combinación ponderada de tres indicadores:

  • Densidad de palabras funcionales: El porcentaje de su texto compuesto por palabras funcionales (artículos, preposiciones, conjunciones). Una mayor densidad se correlaciona con una prosa más formal y estructurada.
  • Frecuencia de atenuadores: Con qué frecuencia usa lenguaje atenuante ("podría", "quizás", "posiblemente") por cada 1.000 palabras. Más atenuación señala una escritura más formal y cautelosa.
  • Uso de punto y coma: Punto y coma por cada 1.000 palabras. Una señal de formalidad pequeña pero confiable — la escritura casual casi nunca los usa.

La fórmula también considera el ratio de exclamación como señal negativa: el uso intensivo de signos de exclamación reduce el puntaje de formalidad.

Lo que refleja: Dónde se sitúa su escritura en el espectro entre la sala de juntas y la pausa del café. No se trata de calidad. Un puntaje informal simplemente significa que su escritura se lee de manera conversacional, lo cual puede ser exactamente lo que su audiencia necesita.

5. Consistencia

Esto mide cuán uniformes son las longitudes de sus oraciones a lo largo de su texto. Calculamos el coeficiente de variación (desviación estándar dividida por la media) de las longitudes de oración, y luego lo invertimos para producir una escala continua de 0 a 100.

Un escritor que alterna entre oraciones de 5 palabras y de 40 palabras obtiene un puntaje bajo en consistencia — su escritura es "en ráfagas". Un escritor cuyas oraciones se agrupan entre 12 y 18 palabras obtiene un puntaje alto. Una vez más, ninguno es inherentemente mejor. La prosa literaria tiende a ser en ráfagas. La redacción jurídica tiende a ser consistente.

Lo que refleja: La previsibilidad rítmica de su escritura. Alta consistencia significa cadencia estable. Baja consistencia significa variación dinámica.

6. Concisión

La fórmula más simple: el inverso de la longitud promedio de las oraciones. Oraciones promedio más cortas elevan el puntaje. Oraciones más largas lo reducen.

Un redactor de mensajes de Slack que promedia 8 palabras por oración obtendrá un puntaje alto en concisión. Un académico que promedia 28 palabras obtendrá un puntaje bajo.

Lo que refleja: Exactamente lo que parece — cuán compacta es su comunicación.


Cómo Construimos la Referencia "IA Promedio"

Aquí es donde la mayoría de los competidores se detendrían. Mostrarían un gráfico, afirmarían que la comparación es el "promedio de IA", y esperarían que usted no hiciera preguntas.

Nosotros realizamos el experimento.

El Corpus: 320 Muestras

Generamos 320 muestras de texto a través de:

  • 5 modelos de IA: Claude Opus 4.6, Claude Sonnet 4.5, Claude Haiku 4.5, GPT-5.2 y Gemini 3 Pro
  • 4 idiomas: inglés, francés, español y japonés
  • 8 tipos de prompts: correos formales, correos casuales, informes empresariales, publicaciones en redes sociales, introducciones de blogs, mensajes de Slack, contenido de presentaciones y seguimientos de reuniones
  • 2 variantes por combinación: Para tener en cuenta la variabilidad de las respuestas

Es decir, 5 modelos por 4 idiomas por 8 tipos de prompts por 2 variantes. Cada muestra se generó con las mismas instrucciones, garantizando una comparación justa. Tamaño total del corpus: aproximadamente 100.800 palabras.

¿Por Qué Estos Modelos?

Elegimos modelos que representan el panorama que los profesionales realmente utilizan. Claude Opus 4.6 y GPT-5.2 son los dos modelos de propósito general más capaces disponibles. Claude Sonnet 4.5 y Haiku 4.5 representan las categorías intermedia y ligera. Gemini 3 Pro cubre el ecosistema de Google.

Si solo hubiéramos medido un modelo, la referencia estaría sesgada. Al promediar cinco, capturamos cómo se ve realmente la "escritura de IA" en la práctica — no lo que hace un modelo en particular.

¿Por Qué Estos Tipos de Prompts?

Los ocho tipos de prompts corresponden a lo que los profesionales realmente le piden a la IA que escriba. No incluimos ficción creativa, poesía ni artículos académicos porque no son casos de uso típicos para las personas que usan My Writing Twin.

Los correos formales y los informes prueban la producción estructurada y profesional. Los correos casuales y los mensajes de Slack prueban el tono conversacional. Las publicaciones sociales y las introducciones de blog prueban la escritura orientada al marketing. Los seguimientos de reuniones y las presentaciones prueban contextos híbridos. Juntos, pintan un retrato representativo de la escritura diaria asistida por IA.


Referencias por Idioma: Comparaciones Justas Entre Lenguas

Este es un detalle que la mayoría de las plataformas pasan por alto, y creemos que es importante.

Cuando comparamos su escritura con la "IA Promedio", comparamos dentro de su idioma. Su Writing DNA en japonés se mide contra la producción de IA en japonés. Su escritura en francés se mide contra la producción de IA en francés. Inglés contra inglés, español contra español.

¿Por qué? Porque la IA escribe de manera diferente en distintos idiomas. La producción de IA en francés tiende a generar oraciones más largas y complejas que la producción en inglés. El texto de IA en japonés muestra diferentes patrones de expresividad debido a los marcadores honoríficos y las formas interrogativas comunes en el japonés empresarial. El español se ubica en un punto intermedio.

Si comparáramos su escritura en japonés con una referencia de IA en inglés, la comparación no tendría sentido. Las diferencias visibles en el radar reflejarían la estructura del idioma, no su estilo personal.

Así se ven las referencias por idioma en la práctica:

EjeInglésFrancésEspañolJaponés
Complejidad de oraciones65757162
Rango de vocabulario48494437
Expresividad767459100
Formalidad58424659
Consistencia53525553
Concisión42323645

Observe que la IA en japonés obtiene 100 en expresividad. No es un error. La redacción empresarial japonesa utiliza formas interrogativas y marcadores de cortesía que la fórmula de expresividad detecta. Tanto las referencias de IA como los puntajes de los usuarios utilizan la misma fórmula, por lo que la comparación sigue siendo justa. Si su escritura en japonés obtiene 85 en expresividad, eso realmente significa que usted es menos expresivo que la producción típica de IA en japonés según estas métricas — y ese es un dato significativo sobre su estilo.

La IA en francés obtiene el puntaje de concisión más bajo (32) porque el francés naturalmente produce oraciones más largas que el inglés. Una referencia solo en inglés penalizaría injustamente a los escritores francófonos por una característica de su idioma, no de su estilo.


La Ciencia Detrás de las Fórmulas

Estas mediciones no son arbitrarias. Se fundamentan en décadas de investigación en estilometría computacional, lingüística forense y procesamiento del lenguaje natural.

Las Palabras Funcionales como Marcadores de Autoría

El hallazgo más contraintuitivo de la estilometría: las palabras que revelan su identidad no son las impresionantes. Son las aburridas. "El", "de", "y", "a" — palabras funcionales que llevan peso gramatical pero ningún contenido. Su frecuencia de uso de estas palabras es notablemente estable a través de contextos y tiempo, convirtiéndolas en marcadores de estilo confiables.

Nuestro eje de formalidad utiliza la densidad de palabras funcionales como señal principal precisamente porque esta investigación muestra que los patrones de palabras funcionales figuran entre las características más discriminantes en la atribución de autoría.

El Análisis Multidimensional de Biber

El marco de Douglas Biber para analizar textos a lo largo de múltiples dimensiones independientes — originalmente 67 características lingüísticas — estableció que el estilo de escritura no es unidimensional. Usted puede ser formal y expresivo. Conciso y complejo. Consistente y léxicamente diverso.

Nuestro radar de seis ejes es una destilación práctica de este principio. Cada eje mide una dimensión independiente que puede variar sin afectar a las demás. El resultado es una huella multidimensional, no un simple "puntaje de estilo".

El Ratio Tipo-Token para la Diversidad del Vocabulario

El TTR se ha utilizado en lingüística desde la década de 1940 para medir la diversidad léxica. Aunque el TTR bruto es sensible a la longitud del texto (los textos más largos naturalmente tienen un TTR más bajo), nuestro enfoque mitiga esto comparando dentro de tamaños de corpus estandarizados y usando la misma ventana de medición para las muestras de usuarios e IA.

Curvas Sigmoides para Escalamiento Natural

La longitud bruta de las oraciones no corresponde linealmente a la complejidad percibida. La diferencia entre 10 y 15 palabras por oración se siente significativa. La diferencia entre 35 y 40 se siente insignificante. Una curva sigmoide captura esta relación de rendimientos decrecientes, produciendo puntajes que coinciden con la intuición humana sobre lo que realmente se siente como escritura "compleja".


Por Qué la Transparencia Importa

Cuando su radar muestra que su puntaje de expresividad es 45 mientras que la IA Promedio obtiene 76, esa brecha tiene un significado específico. Significa que el texto de IA, medido a través de 320 muestras reales, usa más signos de exclamación, más preguntas retóricas, más marcadores de actitud y más rayas que usted.

Esto no es un juicio de valor. Muchos escritores efectivos son menos expresivos que los valores predeterminados de la IA — dejan que sus ideas hablen en lugar de su puntuación. Pero conocer esta brecha le ayuda a entender cómo el texto generado por IA diferirá de su estilo natural, y qué debe corregir su perfil de estilo.

Esta es la diferencia entre una herramienta que dice "usted es único" (halagador pero inútil) y una que le dice cómo es único (específico y accionable). El radar no existe para hacerle sentir bien. Existe para darle a su Master Prompt — y a la IA que lo lee — objetivos de calibración precisos.

Los competidores que no muestran su metodología le piden que confíe en ellos a ciegas. Nosotros preferimos ganar la confianza a través de la evidencia.


Lo Que Esto Significa para Su Perfil de Estilo

Los datos de referencia alimentan directamente el funcionamiento de su perfil de estilo. Cuando le indicamos a ChatGPT o Claude que "iguale el nivel de formalidad de 72 de esta persona versus el predeterminado de IA de 58", la IA tiene un objetivo concreto y cuantificado. No "sea un poco más formal" — un delta específico que aplicar.

Esta es la razón por la que los perfiles de estilo superan a las instrucciones personalizadas. Las instrucciones personalizadas dan a la IA orientación interpretativa. Los perfiles de estilo dan a la IA parámetros medidos derivados de su escritura real, calibrados contra valores predeterminados de IA medidos empíricamente.

El cálculo se ejecuta en segundo plano. Usted ve el radar. Su IA ve las reglas.


¿Listo para Ver Su Writing DNA?

¿Tiene curiosidad por saber dónde se ubica en cada eje? Pruebe su Writing DNA Snapshot gratuito — sin tarjeta de crédito, sin compromiso. Envíe algunas muestras de escritura y vea cómo sus patrones se comparan con la IA Promedio en las seis dimensiones.

Su escritura tiene una huella. Nosotros la medimos. My Writing Twin convierte esa medición en instrucciones que hacen que cualquier IA — ChatGPT, Claude, Gemini — escriba como usted.

Obtenga Su Writing DNA Snapshot Gratuito

Haga que la IA escriba como usted, no como un robot

Acaba de leer cómo ajustar la IA a mano. MyWritingTwin lo hace a partir de sus textos reales: pegue algunas muestras y obtenga un perfil de voz que funciona en ChatGPT, Claude y Gemini.

Cree su perfil de escritura gratis

¿Aún no? Reciba en su lugar nuestra guía de perfiles de voz IA por correo.

Compartir:

Comentarios

Cargando comentarios...

Deja un comentario

Tu correo electrónico no se mostrará públicamente.

¿Listo para ponerlo en práctica?

Cree su perfil de escritura gratis