InicioInvestigaciónNegocios locales y de servicios

SEMPITE Investigación · Estudio de medición · Septiembre 2026 · Por Jacob Gerrish

Rastreamos 1.416 sitios web de agentes inmobiliarios. Solo 1 de cada 5 está listo para IA.

En la Parte 1 descubrimos que toda la industria adivina lo que la IA puede y no puede ver. Así que lo medimos. Recolectamos 1.416 sitios web de agentes independientes y agencias en aproximadamente 55 mercados de EE. UU. y leímos cada uno de la misma manera que un rastreador de IA sin renderizado. La mayoría se ven bien para un humano, pero muestran a un asistente de IA cero propiedades, cero reseñas y apenas una identidad.

1 de 5cumple el estándar de listo para IA (19,9% de los sitios accesibles)
30,5%no muestran ninguna propiedad a un rastreador de IA sin renderizado
95,4%no exponen reseñas que una IA pueda leer
0de 1.097 sitios usan el schema RealEstateListing

Lo que hicimos

Construimos un marco de muestreo de 1.416 sitios web independientes de agentes inmobiliarios, equipos y agencias locales recolectando resultados de búsqueda en aproximadamente 55 mercados de EE. UU. en todas las regiones (desde Nueva York, LA y Chicago hasta Boise, Fargo, Honolulu y Anchorage), excluyendo deliberadamente los portales nacionales (Zillow, Realtor.com, Redfin, Homes.com, Trulia) y los agregadores de generación de leads. Luego rastreamos cada uno de la misma manera que lo hace un motor de respuestas de IA: HTML estático, sin ejecutar JavaScript, exactamente la postura de GPTBot, ClaudeBot, PerplexityBot y CCBot.

1.097 (77,5%) fueron accesibles mediante una recuperación estática. Cada métrica a continuación se calcula sobre esos 1.097, los sitios que un rastreador de IA puede recuperar realmente, porque esa es la denominación justa.

El sitio se ve bien. Las propiedades no están ahí.

Encontramos una página de propiedades o búsqueda en el 59,3% de los sitios accesibles. De esos 650 sitios, el 30,5% (IC del 95%: 27,0–34,1) no exponía ningún dato de propiedad legible por máquina (sin precio, sin habitaciones, sin baños, sin metros cuadrados, sin número MLS) en el HTML que su servidor envía.

Página de listados, sin datos de propiedades en HTML30,5%
Página de listados, solo 1 señal16,0%
Página de listados, renderizada en servidor (2+ señales)53,5%

Estas páginas no están vacías, una mediana de ~2.600 caracteres de texto de navegación y marketing está justo ahí. Lo que falta son las casas. Los listados se inyectan mediante un widget JavaScript IDX/MLS, y los rastreadores que alimentan las respuestas de IA no ejecutan JavaScript. Un humano ve una cuadrícula de propiedades; la IA ve el mobiliario de la página y sin inventario.

Casi ninguna identidad legible por máquina, y cero esquema de listados

Los datos estructurados son cómo un motor de respuestas sabe quién es un agente y qué tiene. El sector inmobiliario apenas los utiliza. Esto es lo que declaran en JSON-LD del lado del servidor los 1.097 sitios accesibles:

Cualquier esquema69,6%
Organization31,1%
RealEstateAgent29,4%
LocalBusiness20,9%
FAQPage3,1%
RealEstateListing0,0%

La mayoría de los “cualquier esquema” son plantillas genéricas de Organization o BreadcrumbList de una plantilla de sitio web. Solo el 29,4% se declara como RealEstateAgent, y ninguno de los 1.097 sitios publicó el esquema RealEstateListing para su inventario. El tipo de esquema más relevante para la industria no lo usa nadie.

El 95% no le da a la IA ninguna razón para confiar en ellos

Las reseñas son la señal más fuerte que un agente local puede enviar a un motor de respuestas, y el único lugar donde un independiente puede superar en señalización a un portal nacional. Sin embargo, 95,4% de los sitios accesibles (solo el 4,6%, IC del 95% 3,5–6,0, exponen alguno) no publican datos de AggregateRating o Review que una máquina pueda leer. Los widgets de cinco estrellas están en la página para humanos, renderizados en JavaScript, invisibles para el sistema que hace las recomendaciones.

1 de cada 9 bloquea a un rastreador de IA en la puerta, probablemente por accidente

10,8% de los sitios (IC del 95% 9,0–12,8) prohíben al menos un rastreador de IA principal en robots.txt. La pista de que no es intencional: la tasa de bloqueo es casi idéntica entre bots que no tienen nada que ver entre sí.

Amazonbot 11,4% GPTBot 10,6% Meta-ExternalAgent 8,0% Bytespider 7,7% Google-Extended 6,3% CCBot 6,2% Applebot-Extended 6,1% ClaudeBot 3,8%

Un Disallow general copiado de una plantilla excluye silenciosamente a un agente de ChatGPT, Claude, Perplexity, Rufus de Amazon y la IA de Google en una sola línea.

La mitad están en una plataforma IDX, y de ahí viene la invisibilidad

48,1% de los sitios accesibles funcionan sobre una plataforma IDX o de sitios web detectable. Entre aquellos con una página de listados, el 27,3% no sirve datos de propiedades en HTML, el patrón del widget de JavaScript, integrado por la plataforma.

Sierra Interactive8,5%
Squarespace7,7%
IDX Broker6,7%
Luxury Presence5,6%
Real Geeks5,4%

Le siguen Showcase IDX (4,0%), kvCORE (3,7%), Wix (2,6%), Placester (1,8%), iHomefinder (1,7%) y BoomTown (1,0%). La elección de la plataforma está decidiendo silenciosamente si los listados de un agente existen para la IA o no.

En conjunto: solo 1 de cada 5 está listo para IA

Combina las puertas (permite los rastreadores de IA principales y sirve datos reales de listados en HTML y declara una entidad de agente o negocio) y solo el 19,9% de los sitios accesibles supera la barrera (IC 95% 17,6–22,3). La buena noticia escondida en los números: las correcciones son poco glamurosas y baratas. Renderiza del lado del servidor las páginas de listados y ubicación, añade el esquema RealEstateAgent y Review, elimina el bloqueo suelto de robots. Nada de esto requiere gastar más que un portal. Requiere ser legible, lo cual casi nadie hace.

Método, en resumen

Marco de muestreo de 1.416 dominios independientes de agentes/brókeres/equipo recolectados mediante búsqueda en aproximadamente 55 mercados de EE. UU. (se excluyeron portales y agregadores), rastreados el 16 de septiembre de 2026. Para cada sitio obtuvimos robots.txt y analizamos la política para bots de IA; obtuvimos la página de inicio y extraímos el esquema JSON-LD, la marcaje de reseñas y la exposición de contacto; descubrimos una página de listados/búsqueda desde los enlaces de la página de inicio y la obtuvimos; y escaneamos el HTML servido en busca de señales legibles por máquina (precio, dormitorios, baños, pies cuadrados, n.º MLS). Todas las obtenciones fueron estáticas, sin ejecutar JavaScript, imitando a los rastreadores de IA que no renderizan. Las proporciones llevan intervalos de puntuación de Wilson y se calculan sobre los 1.097 sitios accesibles.

Limitaciones conocidas, dichas con claridad: una obtención estática no puede ver el contenido renderizado por JavaScript, que es el punto, porque los rastreadores de IA que no renderizan tampoco pueden, aunque algunos agentes (Googlebot, Gemini, AppleBot) sí renderizan y verían más de lo que creditamos aquí; medimos una página de listados por sitio, descubierta desde enlaces de la página de inicio, por lo que los sitios que ocultan su búsqueda detrás de un formulario o un enlace sin etiqueta pueden estar subcontados como “no se encontró página de listados”; el marco es recolectado por búsqueda y no un censo, por lo que sesga hacia agentes con suficiente visibilidad para aparecer en resultados; la detección de plataformas IDX es basada en huellas dactilares y conservadora; y el 22,5% del marco fue inaccesible en una obtención estática (190 devolvieron un estado de bloqueo para bots), lo cual en sí mismo es una señal leve de preparación que no contamos contra las métricas. Los datos brutos por sitio y el rastreador se entregan con el estudio.

Preguntas frecuentes

¿Cómo se eligieron los 1.416 sitios?

Recolectados mediante búsqueda en aproximadamente 55 mercados de EE. UU. en todas las regiones (incluidas Hawái y Alaska), excluyendo portales nacionales y agregadores de generación de leads. El 1.097 (77,5%) fueron accesibles y todas las métricas se calculan sobre esos. Se incluyen agentes afiliados a franquicias con su propio dominio de marca, ya que ese dominio es lo que lee un rastreador de IA.

¿Qué significa “listo para IA”?

Un compuesto: permite los rastreadores de IA principales en robots.txt, expone datos reales de listados (precio/dormitorios/baños/pies cuadrados/MLS) en HTML renderizado del lado del servidor, y declara una entidad RealEstateAgent o LocalBusiness. Solo el 19,9% superó las tres.

¿Por qué la IA no puede ver los listados en el 30% de los sitios?

De los 650 sitios con una página de listados, el 30,5% no sirvió datos de propiedades en HTML. Las páginas tienen una mediana de ~2.600 caracteres de otro texto, pero los listados son inyectados por un widget IDX de JavaScript, y los rastreadores de IA no ejecutan JavaScript.

¿Cuál es la brecha más grande?

Datos estructurados y reseñas. 0 de 1.097 sitios usan el esquema RealEstateListing y solo el 29,4% declara un RealEstateAgent; el 95,4% no expone reseñas legibles por máquina.

¿Los agentes bloquean la IA a propósito?

En su mayoría, no. El 10,8% bloquea un rastreador de IA principal, con tasas casi idénticas entre bots no relacionados (Amazonbot 11,4%, GPTBot 10,6%), lo que apunta a reglas de robots genéricas copiadas.

Ejecutamos esta verificación de preparación contra un sitio individual de agente o inmobiliaria, y luego corregimos lo que un motor de respuestas de IA no puede leer.

AI Search Visibility (GEO)

SEMPITE Investigación, 16 de septiembre de 2026. n = 1.416 sitios de agentes/inmobiliarias muestreados, 1.097 accesibles y medidos, 650 con una página de listados descubreible. Datos crudos por sitio y el rastreador publicados bajo CC BY 4.0.

Citar como: SEMPITE, “Rastreamos 1.416 sitios web de agentes inmobiliarios. Solo 1 de cada 5 está listo para la IA”, septiembre de 2026
sempite.com/es/research/real-estate-ai-readiness-crawl/ · CC BY 4.0 · Prensa: hello@sempite.com

Estudios relacionados

Toda la investigación de SEMPITE →

EN