Cómo escribir texto alternativo y pies de foto que las IA sí pueden entender y citar
Aprende a crear textos alternativos, pies de foto y datos estructurados que hagan tu contenido más comprensible para buscadores y motores de respuesta de IA.
Explorar más estrategias de contenido
En este artículo9 secciones
- Por qué el texto alternativo y los pies de foto importan para la búsqueda con IA
- Texto alternativo, pie de foto y descripción: qué debe decir cada uno
- Plantillas de texto alternativo y pies de foto listas para copiar
- Cómo escribir imágenes que aporten evidencia a una respuesta de IA
- Errores que reducen la comprensión de tus imágenes
- Cómo implementar texto alternativo, pies de foto y datos estructurados sin código
- Ejemplo de ImageObject para un blog alojado en RankLayer
- Cómo automatizar imágenes sin perder calidad ni posibilidades de citación
- Lista de comprobación antes de publicar una imagen
Por qué el texto alternativo y los pies de foto importan para la búsqueda con IA
El texto alternativo para imágenes es una de las piezas más olvidadas del SEO, pero también una de las más fáciles de mejorar. Cuando una persona pregunta a ChatGPT, Gemini o Perplexity por un restaurante, una clínica o una herramienta de software, estos sistemas necesitan reunir señales de varias partes de la web. El texto visible, el nombre de la imagen, el texto alternativo, el pie de foto y los datos estructurados pueden ayudarles a entender qué representa una imagen y por qué está relacionada con la página. Eso no significa que una imagen, por sí sola, vaya a conseguir una cita. Los motores de respuesta normalmente citan una página que contiene información útil, accesible y verificable. La imagen funciona como una pieza de contexto, no como un boleto mágico para aparecer en ChatGPT. Si tu artículo explica claramente un servicio y la imagen refuerza esa explicación, tienes una señal mucho más coherente. Piensa en el texto alternativo como una breve descripción para alguien que no puede ver la imagen. El pie de foto cumple otra función: aparece para todos los lectores y añade contexto editorial. Una foto puede tener un texto alternativo descriptivo y un pie de foto que explique el resultado, la ubicación o la relevancia comercial. Confundir ambos suele producir textos repetidos y poco útiles. La accesibilidad también es parte de la ecuación. Las pautas de accesibilidad para contenido web de W3C recomiendan describir la función o el significado de una imagen, no llenar el atributo con palabras clave. Esa es una buena regla para SEO y para la búsqueda con IA: describe lo que el lector necesita saber, no lo que esperas que un algoritmo repita.
Texto alternativo, pie de foto y descripción: qué debe decir cada uno
Una buena optimización empieza separando tres elementos. El texto alternativo vive en el atributo alt del HTML y se muestra cuando la imagen no carga o cuando una tecnología de asistencia la interpreta. El pie de foto, normalmente dentro de un elemento figure, se ve en la página y puede contar una historia más completa. La descripción larga puede aparecer en el texto cercano, una ficha de producto o una página dedicada cuando la imagen necesita mucho contexto. Para el texto alternativo, empieza por el objeto principal y añade una característica que lo diferencie. Por ejemplo, “dentista revisa una radiografía digital en una clínica de Monterrey” es más útil que “dentista Monterrey radiografía dental clínica”. La primera frase describe una escena real. La segunda parece una bolsa de palabras clave y no ayuda a una persona. El pie de foto puede responder a una pregunta que el alt no debería intentar resolver. En una captura de pantalla de un producto, el alt puede ser “panel de RankLayer mostrando el calendario de publicaciones de un blog”. El pie puede decir: “El calendario permite planificar artículos diarios sin instalar WordPress ni administrar un servidor”. Así, la imagen queda conectada con una ventaja concreta sin convertir el alt en un anuncio. La documentación de Google sobre las prácticas recomendadas para imágenes aconseja usar nombres de archivo, texto alternativo y contenido de página descriptivos. Google no ofrece una longitud universal obligatoria para el alt, pero en la práctica conviene mantenerlo entre 8 y ้น 125 caracteres cuando sea posible. No recortes información esencial por perseguir un número exacto, pero evita párrafos enteros dentro del atributo. Antes de publicar, haz esta prueba sencilla: si alguien solo leyera el alt, ¿entendería qué aparece en la imagen y por qué está ahí? Si la respuesta es no, falta contexto. Si el texto repite exactamente el título y la leyenda, probablemente sobra una parte.
Plantillas de texto alternativo y pies de foto listas para copiar
- ✓Restaurante: alt: “plato de tacos de pescado con ensalada servido en Restaurante La Plaza, Guadalajara”. Pie de foto: “Los tacos de pescado se preparan al momento y se sirven de martes a domingo durante la comida”.
- ✓Dentista: alt: “dentista explica una radiografía dental digital a una paciente adulta”. Pie de foto: “La revisión digital ayuda al equipo a explicar el diagnóstico y las opciones de tratamiento durante la consulta”.
- ✓Clínica: alt: “recepción luminosa de clínica dermatológica con área de espera”. Pie de foto: “La clínica atiende consultas dermatológicas con reserva previa en la zona de Coyoacán”.
- ✓SaaS, captura de producto: alt: “panel de análisis de RankLayer con visitas orgánicas y artículos publicados”. Pie de foto: “El panel reúne métricas de contenido para que un negocio revise qué temas atraen visitas”.
- ✓Tienda en línea: alt: “mochila impermeable azul mostrada de frente sobre fondo blanco”. Pie de foto: “La mochila tiene compartimento acolchado para computadora y capacidad de twenty litros”.
- ✓Profesional independiente: alt: “abogada revisa un contrato con un cliente en una oficina”. Pie de foto: “La consulta inicial se centra en identificar riesgos y próximos pasos antes de firmar el contrato”.
- ✓Evento local: alt: “chef preparando menú de temporada en cocina abierta de restaurante”. Pie de foto: “El menú de temporada estará disponible del 10 al 30 de noviembre, con reservas por teléfono”.
- ✓Antes y después, cuando sea apropiado: alt: “sonrisa de paciente antes y después de un tratamiento de blanqueamiento dental”. Pie de foto: “Imágenes compartidas con autorización del paciente; los resultados pueden variar según cada caso”.
Cómo escribir imágenes que aporten evidencia a una respuesta de IA
Los motores de respuesta no leen una imagen como lo haría una persona que entra a tu negocio. Necesitan relacionarla con señales textuales y con una página que responda una intención concreta. Por eso, un alt citable no intenta decirlo todo. Identifica el sujeto, la acción, el contexto y, cuando sea relevante, la ubicación o el momento. Una fórmula práctica es: “qué aparece + acción o característica + contexto específico”. Para un SaaS: “captura del panel de automatización de contenidos con un calendario de publicaciones diarias”. Para un restaurante: “chef emplatando menú vegetariano en la cocina de un restaurante en Bogotá”. Para una tienda: “zapatillas blancas de correr con suela amortiguada, vista lateral”. Estas frases son naturales, concretas y fáciles de asociar con una consulta. El pie de foto puede usar una segunda fórmula: “qué demuestra la imagen + dato verificable + siguiente acción o limitación”. Por ejemplo: “La pantalla muestra la programación de siete artículos para una semana; las métricas se conectan con Google Analytics; los resultados dependen del tema y de la competencia”. Esta estructura evita promesas infladas y ofrece un dato que una IA puede resumir sin deformarlo. No afirmes en una imagen algo que la imagen no demuestra. Una fotografía de una sala no prueba que una clínica sea la “mejor” de la ciudad. Una captura de un tablero no demuestra que una herramienta haya duplicado las ventas. Para afirmaciones de rendimiento, utiliza texto editorial con metodología, fechas y fuentes. También puedes revisar cómo las IA conversacionales eligen fuentes para entender por qué la claridad y la coherencia de toda la página pesan más que una sola etiqueta. La intención de búsqueda también cambia la descripción. Para “dentista cerca de mí”, la ubicación y el tipo de servicio pueden ser útiles. Para “cómo funciona un panel de analítica”, la función visible importa más que la ciudad. Elige las palabras según la pregunta del lector, no según una lista interminable de términos relacionados.
Errores que reducen la comprensión de tus imágenes
El error más común es escribir “imagen de” o “foto de” antes de una descripción que no aporta nada. Los lectores de pantalla ya saben que están ante una imagen, así que puedes ir directo al contenido. También conviene evitar “logo de”, salvo que el hecho de ser un logotipo sea relevante para comprender la página. Otro problema es el relleno de palabras clave. “Restaurante italiano Roma pizza pasta mejor restaurante italiano” no describe una escena y puede parecer manipulación. Usa una sola mención de la marca o la ubicación cuando sea necesaria. Si tienes diez fotos de una misma sucursal, no repitas exactamente el mismo alt en todas: diferencia la fachada, el salón, el menú y el plato mostrado. Las imágenes decorativas deben tener un alt vacío, escrito como alt="", para que las tecnologías de asistencia las omitan. Un separador visual, un fondo abstracto o un icono que no añade información no necesita una descripción forzada. Esta distinción mejora la experiencia de lectura y evita que tu página se llene de ruido semántico. También falla la automatización sin revisión. Un sistema puede confundir un pastel con una tarta salada, leer mal el texto de una captura o inventar una ubicación. En sectores regulados, como salud, derecho y finanzas, revisa cada descripción y evita revelar datos personales. La guía de prevención de alucinaciones en blogs automáticos con IA ofrece un marco útil para establecer controles antes de publicar. Por último, no ocultes información importante únicamente en una imagen. Precio, horario, ingredientes, advertencias y condiciones deben estar también en texto HTML visible. El alt puede complementar esa información, pero no debe ser el único lugar donde exista.
Cómo implementar texto alternativo, pies de foto y datos estructurados sin código
- 1
Reúne los datos reales de la imagen
Anota quién o qué aparece, qué está ocurriendo, dónde sucede y qué parte de la página apoya. Si no conoces un dato, no lo adivines. En una captura de producto, usa la versión y la función que realmente se ven.
- 2
Escribe un alt de una sola idea
Redacta una frase breve, específica y natural. Como referencia editorial, intenta mantenerla cerca de 125 caracteres, aunque la precisión debe ganar cuando haya información esencial.
- 3
Añade un pie de foto con contexto útil
Explica por qué la imagen importa para el lector. Incluye una fecha, ubicación, condición, resultado observado o limitación cuando ese dato ayude a interpretar la escena.
- 4
Usa un nombre de archivo descriptivo
Cambia IMG_4832.jpg por algo como tacos-pescado-menu-comida-guadalajara.jpg. Separa las palabras con guiones y evita nombres genéricos, caracteres extraños y cadenas de números.
- 5
Inserta la imagen cerca del texto relacionado
Coloca la fotografía de un tratamiento junto a la explicación de ese tratamiento, no al final de un artículo sin contexto. La proximidad entre imagen, título, párrafo y pie ayuda a que el tema sea más claro.
- 6
Añade datos estructurados solo cuando correspondan
Si tu página contiene una imagen principal, puedes usar ImageObject dentro del marcado de la página. No marques imágenes que no existan, no inventes licencias y valida el resultado con las herramientas oficiales de datos estructurados.
- 7
Comprueba rastreo, carga y accesibilidad
Verifica que la imagen tenga una URL pública, cargue sin iniciar sesión y no esté bloqueada por robots o meta robots. Después, revisa el HTML y prueba la página con una herramienta de accesibilidad.
Ejemplo de ImageObject para un blog alojado en RankLayer
Cuando ya hayas escrito un alt y un pie de foto útiles, puedes añadir un bloque de datos estructurados para describir la imagen con más precisión. El marcado no garantiza una cita en ChatGPT, Gemini o Perplexity, y tampoco sustituye el contenido visible. Su función es ayudar a los sistemas que procesan la página a identificar entidades, URLs, autores y relaciones. Este ejemplo puede adaptarse a una publicación de un blog alojado. Sustituye todos los valores entre comillas por datos reales de tu página: <script type="application/ld+json">{ "@context": "https://schema.org", "@type": "ImageObject", "contentUrl": "https://blog.tunegocio.com/imagenes/panel-calendario-publicaciones.webp", "url": "https://blog.tunegocio.com/imagenes/panel-calendario-publicaciones.webp", "name": "Panel de calendario de publicaciones", "caption": "El calendario permite planificar artículos diarios para un blog de negocio.", "description": "Captura de pantalla de un panel de calendario con publicaciones organizadas por fecha y tema.", "representativeOfPage": true, "creditText": "Tu Negocio", "license": "https://creativecommons.org/licenses/by/4.0/" }</script> No incluyas license ni creditText si no tienes derechos o una política de licencia que respalde esos valores. La documentación de Schema.org para ImageObject describe propiedades como contentUrl, caption, description y representativeOfPage. Para validar el marcado, utiliza el validador oficial de Schema.org y comprueba después que la página se pueda rastrear. En RankLayer, la ventaja práctica de un blog hospedado es que no tienes que construir desde cero el servidor, el cargador de imágenes o la plantilla de publicación. Puedes subir la imagen desde el editor y completar los campos de texto alternativo y pie de foto. Si alimentas publicaciones desde Zapier, conserva esos campos como columnas separadas, por ejemplo imagen_url, texto_alternativo y pie_de_foto, para que no terminen mezclados en un solo bloque difícil de revisar.
Cómo automatizar imágenes sin perder calidad ni posibilidades de citación
La automatización funciona mejor cuando convierte datos conocidos en campos controlados. Imagina una clínica que publica una guía semanal. Su formulario puede enviar a RankLayer el nombre del servicio, la ciudad, la URL de la imagen, el alt aprobado, el pie de foto y la fecha de revisión. El artículo se publica con una imagen coherente, pero el contenido sensible sigue pasando por una revisión humana antes de salir. Con Zapier, un flujo sencillo puede empezar con una nueva fila en Google Sheets o un evento de tu CRM. La automatización genera o envía el borrador, incorpora la imagen y conserva los metadatos. Antes de activar la publicación, añade una condición: si el campo texto_alternativo está vacío, si supera 150 caracteres o si contiene palabras como “mejor” y “garantizado”, el flujo se detiene para revisión. Para un restaurante, otra receta útil es actualizar una foto de menú de temporada con fecha de inicio y fin. Para un SaaS, puede ser una captura de una nueva función con versión y fecha. Para un e-commerce, conviene conectar el identificador del producto, color, vista y estado del inventario. La imagen debe reflejar lo que el lector puede comprar o usar hoy, no una promesa antigua. Mide resultados con una combinación de señales, no con una sola cifra. Revisa impresiones y consultas en Google Search Console, tráfico de imágenes, clics hacia páginas de servicio y conversiones en Google Analytics. También puedes registrar manualmente pruebas de consultas en ChatGPT, Gemini y Perplexity, anotando fecha, pregunta, respuesta y URL citada. Las citas de IA cambian por ubicación, idioma, frescura y contexto, así que una prueba aislada no es un estudio. Antes de escalar a cientos de artículos, prueba 20 o 30 páginas con tres variantes de pies de foto. Compara una leyenda descriptiva, una leyenda con dato verificable y una leyenda orientada a la experiencia local. Ese pequeño experimento suele revelar qué información falta y evita automatizar el mismo error miles de veces. Para una visión más amplia, puedes consultar la auditoría de preparación para motores de respuesta de IA.
Lista de comprobación antes de publicar una imagen
- ✓El texto alternativo describe el sujeto y la acción, no una lista de palabras clave.
- ✓El pie de foto añade información nueva y no repite literalmente el alt.
- ✓La imagen está junto al párrafo, título o sección que explica su significado.
- ✓El nombre del archivo es descriptivo y utiliza palabras separadas por guiones.
- ✓La imagen se carga rápidamente, tiene dimensiones adecuadas y funciona en móvil.
- ✓La URL de la imagen es pública y no requiere iniciar sesión.
- ✓Los datos comerciales importantes aparecen también como texto visible.
- ✓La imagen tiene permisos de uso y no muestra datos personales sin autorización.
- ✓El marcado ImageObject coincide con la imagen real y con la URL canónica.
- ✓Un humano revisó la descripción antes de automatizar la publicación.
- ✓La página tiene enlaces internos hacia contenidos relacionados y una respuesta clara a la intención de búsqueda.
- ✓Medirás impresiones, clics, conversiones y menciones de la página, no solo si una imagen aparece en una búsqueda.
Preguntas Frecuentes
¿Qué tipo de pie de foto ayuda a que ChatGPT y Gemini entiendan una imagen?▼
El mejor pie de foto explica qué muestra la imagen y por qué es relevante para la página. Añade un dato verificable, como una ubicación, fecha, función, condición o característica del producto. Evita frases promocionales sin pruebas, como “la mejor clínica” o “resultados garantizados”. El pie de foto debe complementar el texto alternativo, no repetirlo palabra por palabra.
¿Cuántos caracteres debe tener el texto alternativo para mejorar la visibilidad en IA?▼
No existe una longitud universal que garantice visibilidad en ChatGPT, Gemini o Perplexity. Como regla práctica, intenta escribir una frase de entre 8 y 125 caracteres cuando la escena sea sencilla. Si necesitas incluir un detalle esencial, la precisión importa más que cumplir un número exacto. Elimina introducciones como “imagen de” y conserva solo la información que ayuda a entender la imagen.
¿Las imágenes solas pueden ser citadas como evidencia por Perplexity o ChatGPT?▼
Normalmente, una imagen aislada no es una fuente suficiente para una respuesta citable. Los motores de respuesta suelen asociar la imagen con la página, el texto que la rodea, la autoridad del sitio y otras señales de rastreo. Una fotografía puede aportar contexto, pero las afirmaciones importantes deben estar escritas en HTML visible y respaldadas por información verificable. Por eso, optimiza la página completa y no solo el archivo gráfico.
¿Debo incluir palabras clave locales en el texto alternativo?▼
Inclúyelas solo si la ubicación forma parte de lo que la imagen representa. “Fachada de restaurante en Puebla” es razonable si la fotografía muestra esa sucursal. Añadir una ciudad que no aparece o que no tiene relación con la imagen sería engañoso y puede confundir a lectores y sistemas de búsqueda. La ubicación también debe aparecer en el texto visible de la página, en tu perfil empresarial y en otros datos coherentes.
¿Cómo puedo añadir datos estructurados de imágenes sin saber programar?▼
Puedes utilizar un editor o generador de datos estructurados que permita completar campos como URL, nombre, descripción y pie de foto. Después, valida el marcado con el validador de Schema.org y revisa el HTML publicado. Un blog hospedado como RankLayer puede simplificar la carga de imágenes y la inserción de campos sin que tengas que administrar WordPress o un servidor. Aun así, debes comprobar que los valores describan la imagen real y que la página sea rastreable.
¿Qué texto alternativo debe tener una captura de pantalla de un producto SaaS?▼
Describe la pantalla, la función visible y el contexto de uso. Un ejemplo sería: “panel de automatización con calendario de siete artículos programados”. Si el texto de la interfaz es esencial para entender la imagen, puedes mencionarlo brevemente, pero no copies una pantalla completa en el alt. El pie de foto puede explicar qué problema resuelve la función y añadir una fecha o versión.
¿Las imágenes decorativas necesitan texto alternativo?▼
Si una imagen es puramente decorativa y no aporta información, utiliza un atributo alt vacío para que las tecnologías de asistencia la omitan. No inventes una descripción solo para insertar palabras clave. Si el fondo o el icono comunica una idea necesaria para comprender la página, deja de ser decorativo y necesita una descripción breve. La decisión debe basarse en la función de la imagen para el lector.
¿Cómo sé si mis imágenes están ayudando al SEO y a las citas de IA?▼
Comienza con Google Search Console para observar impresiones y consultas relacionadas, y utiliza Google Analytics para revisar visitas y conversiones. Registra también pruebas periódicas en ChatGPT, Gemini y Perplexity con las mismas preguntas, idioma y ubicación aproximada. Busca mejoras en la comprensión y el tráfico de la página, no una garantía de cita por cada imagen. Si automatizas, revisa una muestra de páginas cada semana y corrige los patrones que se repitan.
Convierte cada publicación en una fuente más clara y accesible
Conocer RankLayerSobre el Autor
Vitor Darela de Oliveira is a software engineer and entrepreneur from Brazil with a strong background in system integration, middleware, and API management. With experience at companies like Farfetch, Xpand IT, WSO2, and Doctoralia (DocPlanner Group), he has worked across the full stack of enterprise software - from identity management and SOA architecture to engineering leadership. Vitor is the creator of RankLayer, a programmatic SEO platform that helps SaaS companies and micro-SaaS founders get discovered on Google and AI search engines