- Google Search Console comenzó a separar el rendimiento de búsquedas realizadas con Google Lens, Circle to Search, imágenes cargadas al buscador y “Search this image” de Chrome.
- El reporte permite analizar clics, impresiones, CTR y posición, aunque Google todavía no revela la imagen que originó la búsqueda ni las queries tradicionales.
- Para marcas, retailers y e-commerce, el contenido visual empieza a comportarse como una fuente medible de descubrimiento.
Una persona ve unos tenis en la calle, fotografía una lámpara en un restaurante o encuentra un bolso dentro de una imagen. No necesita conocer la marca ni escribir el nombre correcto del producto.
La imagen puede convertirse en la consulta.
A partir de este jueves 24 de septiembre, Google comenzó a desplegar globalmente en Search Console un nuevo filtro denominado Web: multimodal, que permite identificar el rendimiento del contenido cuando una imagen forma parte de la búsqueda. La medición incluye tráfico procedente de Google Lens, Circle to Search, imágenes cargadas directamente en Google y “Search this image” de Chrome, de acuerdo con Google Search Central.
Y aunque esto pareciera una actualización técnica, para marketing, retail y AdTech representa algo mayor: una parte del descubrimiento digital que ocurría prácticamente fuera del radar comienza a convertirse en dato.
La búsqueda ya no ocurre únicamente con palabras. Únete a la Comunidad y entiende cómo IA, Search, datos y nuevas interfaces están cambiando la forma en que las marcas son descubiertas.
De escribir lo que quieres a mostrarlo
El buscador tradicional depende de que una persona convierta su intención en palabras. La búsqueda multimodal reduce esa fricción.
Circle to Search, por ejemplo, permite seleccionar objetos directamente sobre lo que aparece en la pantalla de un teléfono. Google amplió esta experiencia durante 2026 para reconocer varios objetos dentro de una misma imagen, convirtiendo escenas como un outfit, una habitación o una fotografía en potenciales puntos de entrada a Search, según explicó la compañía en su blog oficial.
Lens ya muestra la escala de este comportamiento.
Google informó anteriormente que la herramienta procesaba cerca de 20 mil millones de búsquedas visuales mensuales y que alrededor de 20% estaban relacionadas con compras. La compañía también conecta Lens con su Shopping Graph para mostrar productos, precios, reseñas y comercios asociados a lo que identifica visualmente, según Google Ads & Commerce.
Para una marca, la diferencia es importante.
En una búsqueda textual, alguien puede escribir “tenis blancos Adidas”. En una búsqueda visual puede simplemente fotografiar los tenis.
Search Console confirma que el SEO ya no empieza sólo con palabras
El reporte de Performance de Search Console permite analizar normalmente clics, impresiones, CTR y posición promedio. Ahora esos datos pueden separarse entre búsquedas web tradicionales y búsquedas web multimodales.
Pero hay una limitación relevante.
Google señala que la dimensión Queries no está disponible para búsquedas multimodales, porque éstas utilizan principalmente imágenes y no necesariamente generan una consulta textual que pueda mostrarse.
John Mueller, Search Advocate de Google, explicó además que los propietarios de sitios podrán saber qué páginas aparecieron y con qué frecuencia, pero no recibirán la fotografía utilizada por el usuario. Search Engine Roundtable confirmó también, tras consultar con Mueller, que estos datos no estaban incluidos previamente dentro de los conteos tradicionales de Search Console.
Esto abre una nueva paradoja de atribución: una marca puede saber que una ficha de producto está apareciendo en búsquedas visuales, pero no necesariamente conocer qué objeto, color, combinación o contexto visual produjo ese descubrimiento.
Puede medir el resultado, pero no reconstruir completamente la intención.

En e-commerce, la fotografía empieza a comportarse como metadata
Para retail y commerce, el cambio es especialmente relevante.
Google recomienda complementar las páginas de producto con datos estructurados, Merchant Center e imágenes de calidad. Esa información puede hacer que productos sean elegibles para aparecer en Search, Google Images y Lens junto con datos como precio, disponibilidad o valoraciones, según su documentación para e-commerce.
Las fichas gratuitas de Merchant Center también pueden aparecer actualmente en Search, Images, Lens, YouTube y Gemini, y México forma parte de los mercados soportados.
Esto significa que la estrategia visual deja de ser únicamente creativa.
La imagen principal, fotografías adicionales, nombre del producto, marca, GTIN, disponibilidad y descripción forman parte de la información utilizada para conectar un artículo con lo que una persona busca. Google incluso recomienda utilizar varias imágenes del mismo producto para mostrar diferentes ángulos.
En otras palabras: una fotografía de producto también empieza a funcionar como infraestructura de descubrimiento.

El siguiente reto de MadTech: medir intención sin keyword
Buena parte del performance digital fue construido alrededor de señales explícitas: keywords, audiencias, clics y segmentos.
La búsqueda visual introduce otra lógica. El usuario no necesariamente dice qué quiere. Lo señala.
Una cámara puede capturar color, forma, categoría, estilo o contexto y convertirlos en señales de búsqueda. Para marcas, agencias y plataformas de commerce media, eso acerca terrenos que antes funcionaban por separado: SEO, feeds de producto, creatividad, computer vision y performance.
Google ya monetiza parte de ese entorno mediante resultados comerciales y anuncios de Shopping dentro de Lens.
Por eso el nuevo filtro de Search Console no debería interesar únicamente a especialistas SEO.
También puede ayudar a identificar qué páginas y productos están entrando al customer journey antes de que exista una búsqueda explícita de marca.
Ahí aparece una oportunidad clara para MadTech: conectar visibilidad multimodal con analítica, conversiones, Merchant Center, CRM y resultados comerciales para saber si ese descubrimiento visual termina generando negocio.

Google todavía controla una parte de la señal
La medición, sin embargo, sigue siendo incompleta.
Search Console puede mostrar qué páginas aparecieron en búsquedas multimodales, pero no entrega la fotografía utilizada como consulta y tampoco permite analizarlas mediante keywords tradicionales, según la documentación oficial.
Además, dentro de su reporte específico de Generative AI, Google permite aplicar el filtro multimodal, pero ofrece una visibilidad más limitada sobre la interacción del usuario. Las métricas disponibles y sus restricciones están detalladas en Search Console Help.
La búsqueda está dejando de ser exclusivamente un cuadro donde alguien escribe palabras y empieza a incorporar cámaras, pantallas y modelos capaces de interpretar objetos.
Las marcas ahora pueden medir una parte de ese cambio.
Pero la siguiente competencia no será únicamente por aparecer cuando alguien escriba correctamente un nombre.
Será por conseguir que una máquina reconozca, entienda y conecte lo que está viendo con una marca, un producto y una intención.
De SEO a GEO, visual search y commerce media: las reglas del descubrimiento están cambiando. Forma parte de la Comunidad y accede a análisis para quienes toman decisiones en marketing, tecnología y medios.


