Base de conocimientos/Reels/Texto en pantalla: mejores prácticas para legibilidad y retención
ReelsProducción

Texto en pantalla: mejores prácticas para legibilidad y retención

El texto en pantalla es el canal principal para quienes miran sin audio. Tipografía, tiempos y ubicación: consejos para reels sobre legibilidad y retención.

Por el equipo de investigación de Wreltik

Texto en pantalla: mejores prácticas para legibilidad y retención

El texto en pantalla hace más que subtitular tu video. Para el 85% de los espectadores que miran sin audio, es el único idioma que van a leer. La calidad de tu tratamiento de texto determina directamente si esos espectadores entienden, se involucran y recuerdan tu contenido.

Tamaño de tipografía y legibilidad

El texto que es legible en un monitor de escritorio suele ser ilegible en una pantalla de teléfono sostenida a la distancia del brazo. El tamaño mínimo legible para video móvil es de aproximadamente 28-32pt para el texto de cuerpo y 40-48pt para las palabras clave. Por debajo de eso, los espectadores se esfuerzan por leer — lo que aumenta la carga cognitiva y la probabilidad de que hagan scroll.

Probá el tamaño de tu texto mirando tu video en un teléfono sostenido a la distancia a la que lo tendrías naturalmente mientras scrolleás en la cama. Si tenés que acercar el teléfono para leer, el texto es demasiado pequeño.

Palabras por cuadro

El cerebro puede procesar aproximadamente 3-5 palabras de un vistazo antes de tener que esforzarse. Con más de 6-8 palabras en pantalla a la vez, leer se vuelve un esfuerzo. El espectador o trabaja para leer todo (lo que aumenta la carga cognitiva) o se rinde y hace scroll.

Dividí el texto en fragmentos digeribles. Máximo dos o tres líneas cortas por cuadro. Si necesitás comunicar más, usá revelados secuenciales de texto — cada fragmento nuevo reemplaza o se suma al anterior.

Los tiempos

El texto debería aparecer apenas antes que el audio correspondiente, no al mismo tiempo. El espectador lee más rápido de lo que habla el hablante. Si el texto aparece en el momento exacto en que se pronuncian las palabras, el espectador termina de leer antes de que el hablante termine de hablar, lo que crea un vacío incómodo. Un adelanto de 0,2-0,3 segundos le da al cerebro tiempo de procesar el texto antes de que el audio lo refuerce.

Tiempo mínimo en pantalla por fragmento de texto: 1,5 segundos. Más rápido que eso, y el espectador no puede terminar de leer. Este es el error de tiempos de texto más común — subtítulos que pasan más rápido de lo que cualquiera puede procesarlos.

Ubicación

La ubicación del texto en video vertical tiene que contemplar los elementos de la interfaz de cada plataforma. Instagram superpone la descripción, el nombre de usuario y los botones de interacción en la parte inferior de la pantalla. TikTok agrega el subtítulo, el handle y la información de la música. Colocar texto en el tercio inferior del cuadro garantiza que quede parcialmente tapado por la interfaz de la plataforma.

Zona segura: el 60% central del cuadro, en vertical. El 20% superior y el 20% inferior corren riesgo de quedar cubiertos por interfaces o subtítulos de la plataforma.

Jerarquía visual

No todo el texto es igualmente importante. Las palabras clave deben ser visualmente distintivas — en negrita, con color o más grandes que el texto que las rodea. El espectador que escanea tu texto debería identificar al instante la palabra o frase más importante en pantalla. Si todo se ve igual, nada se destaca, y el espectador tiene que esforzarse para entender qué importa.