La irrupción de los motores generativos de inteligencia artificial (ChatGPT, Perplexity, Google AI Overviews, entre otros) como capa de descubrimiento de información introduce un criterio de visibilidad distinto del que rige el posicionamiento en buscadores tradicionales. Este trabajo examina en qué medida los principales sitios de comercio electrónico de Argentina se encuentran preparados para ser identificados y citados por dichos motores. Se analizaron 39 dominios pertenecientes a empresas nucleadas en la principal cámara sectorial del país, evaluados mediante un instrumento de análisis GEO que puntúa seis criterios con respaldo en la literatura académica reciente. Los resultados muestran un puntaje global promedio de 35 sobre 100, sin que ningún dominio alcance el nivel considerado "preparado" para estos motores. El criterio más deficitario es la estructura del contenido (promedio 27/100) y el menos deficitario, la frescura de actualización (45/100), configurando una paradoja: los sitios se actualizan con frecuencia pero no estructuran su contenido de manera que una inteligencia artificial pueda extraerlo y citarlo. El 23% de la muestra presenta marcado técnico nulo. Se concluye que el comercio electrónico argentino de primer nivel exhibe un rezago sistemático en su preparación para la capa de descubrimiento generativo, lo que representa a la vez un riesgo de pérdida de visibilidad y una ventana de diferenciación temprana.
Durante dos décadas, la visibilidad de un sitio web estuvo determinada por su posicionamiento en los motores de búsqueda tradicionales. La adopción masiva de asistentes conversacionales basados en grandes modelos de lenguaje ha introducido una segunda capa de descubrimiento: una proporción creciente de usuarios formula sus consultas a un motor generativo que responde de manera sintética, citando un conjunto reducido de fuentes en lugar de ofrecer una lista de enlaces. En este esquema, la competencia por la atención ya no se dirime únicamente por la posición en un listado, sino por la probabilidad de ser la fuente que el modelo selecciona para construir su respuesta.
Este cambio da lugar a una disciplina específica, la optimización para motores generativos (Generative Engine Optimization, GEO), cuyo objeto es maximizar la probabilidad de que el contenido de un sitio sea recuperado y citado por un motor de inteligencia artificial. A diferencia de la optimización para buscadores, la GEO privilegia la capacidad del contenido de ser interpretado, fragmentado y atribuido de manera programática.
Existe evidencia de que este desplazamiento reduce el tránsito derivado de la búsqueda tradicional y concentra las citas en un número acotado de dominios. Sin embargo, no se dispone de un diagnóstico sistemático sobre el grado de preparación del comercio electrónico argentino frente a esta transición. El presente trabajo busca cubrir ese vacío mediante la medición de una muestra de dominios representativos del sector.
El instrumento empleado evalúa seis criterios. Cada uno se apoya en fuentes que publican su método y sus datos: investigación revisada por pares, estándares técnicos oficiales y documentación oficial de los propios motores. Todas las referencias figuran enlazadas al final de este trabajo:
Los criterios 1 a 3 se apoyan en Aggarwal et al. (Princeton, KDD 2024); el criterio 4, en la especificación Schema.org / JSON-LD, con Dang et al. (Universidad de Nantes, Semantic Web Journal 2025) como referencia del alcance del marcado en la web; y los criterios 5 y 6, en Chen, Wang, Chen y Koudas (Universidad de Toronto, Workshops del EDBT/ICDT 2026).
Se conformó una muestra de 39 dominios de empresas del ecosistema de comercio electrónico argentino, obtenidos del directorio público de socios de la principal cámara sectorial del país. La selección procuró variedad de rubros (indumentaria, electrónica, retail generalista, turismo, logística, medios de pago e infraestructura de comercio electrónico) y de escala (desde grandes operadores hasta comercios especializados). El listado completo de dominios se presenta en el Anexo A.
El análisis se realizó con Nostos, un motor de evaluación GEO que asigna a cada dominio un puntaje de 0 a 100 en cada uno de los seis criterios descritos, así como un puntaje global y un nivel de preparación en cuatro categorías.
| Nivel | Descripción | Rango |
|---|---|---|
| Nivel 1 | Listo para IAs | 80–100 |
| Nivel 2 | Ajustes puntuales | 55–79 |
| Nivel 3 | Reestructuración parcial | 30–54 |
| Nivel 4 | Reconstrucción necesaria | 0–29 |
Cada dominio fue analizado en una única medición durante julio de 2026. Se realizaron 40 análisis sobre 39 dominios; un dominio fue medido dos veces como control de consistencia y se computa una sola vez en los promedios. Para cada dominio, el instrumento examina la página principal, un conjunto de páginas internas adicionales y el sitemap del sitio, a partir de los cuales evalúa las señales estructurales, de marcado y de actualización accesibles públicamente. El puntaje de cada criterio resulta de la agregación de esas señales a nivel del dominio, no de una única página.
Nostos incorpora un mecanismo de detección en dos capas para identificar contenido que un sitio construye dinámicamente mediante JavaScript, sin necesidad de ejecutarlo. La primera capa reconoce la huella de más de veinte proveedores conocidos de widgets de reseñas, redes sociales, chat y reservas, mediante el análisis de las referencias a scripts externos e inline presentes en el documento. La segunda capa aplica heurísticas estructurales —contenedores vacíos con identificadores característicos y patrones de shell propios de frameworks de aplicaciones de página única (React, Vue, Angular, Next.js, Svelte)— como mecanismo de contención para proveedores no catalogados en la primera capa. Cuando se detecta contenido bajo este criterio, el sistema lo reporta explícitamente como presente pero no legible por sistemas automatizados, en lugar de asumir su inexistencia.
El puntaje global promedio de la muestra fue de 35 sobre 100. Ningún dominio de la muestra alcanzó el nivel de preparación para motores generativos. El puntaje máximo observado fue de 62 y el mínimo, de 12.
Los promedios por criterio, ordenados de mayor a menor deficiencia, fueron: estructura del contenido 27/100, densidad de datos 31/100, marcado técnico 32/100, autoridad y confianza 37/100, especificidad temática 43/100, frescura y actualización 45/100.
a) Marcado técnico ausente. El 23% de los dominios (9 de 39) presentó un marcado técnico nulo (0/100), y el 40% (16 de 39) puntuó 5 o menos. Casi la mitad de la muestra carece, por lo tanto, de los datos estructurados que un motor generativo requiere para interpretar y atribuir su contenido.
b) La paradoja de la actividad. El criterio de mayor puntaje fue la frescura de actualización (45) y el de menor puntaje, la estructura del contenido (27). Los sitios se mantienen activos —actualizan precios, stock y catálogo con frecuencia— pero no organizan su contenido de modo que una inteligencia artificial pueda extraerlo y citarlo. Se trata de actividad sin visibilidad: movimiento constante que no se traduce en presencia ante los motores generativos.
c) Severidad de los problemas. De las incidencias detectadas en los 39 análisis, aproximadamente el 40% se clasificó como crítica y el 42% como importante — un 82% del total no corresponde a ajustes cosméticos sino a carencias estructurales que requieren intervención sustantiva.
d) Diferencias por rubro. Aunque el tamaño de cada subgrupo es reducido, se observa una tendencia: los dominios de plataformas e infraestructura de comercio electrónico —los mismos proveedores de la tecnología que usa el resto del sector— registran el promedio más alto (56/100), mientras que indumentaria y deporte, y turismo, registran los más bajos (28/100). El rezago no se concentra necesariamente en los rubros de menor escala, sino en los más alejados de la infraestructura técnica del propio ecosistema.
El rezago observado no se concentra en los operadores de menor escala. La muestra incluye empresas de primer nivel dotadas de equipos técnicos propios, cuyos puntajes se ubican en el mismo rango deficitario que el resto. Esto sugiere que la brecha no obedece a falta de recursos, sino a la ausencia de una práctica todavía incipiente: la preparación deliberada del contenido para la capa de descubrimiento generativo no forma parte, aún, de las rutinas de desarrollo y marketing digital del sector.
La paradoja entre frescura y estructura resulta especialmente ilustrativa. La frescura alta indica que los sitios cuentan con procesos maduros de actualización de catálogo; sin embargo, esa actualización se limita a datos transaccionales (precio, disponibilidad) y no se acompaña de contenido estructurado de carácter informacional —guías, respuestas, datos comparativos— que es el tipo de material que los motores generativos recuperan y citan. El sector es operativamente activo pero comunicacionalmente invisible para la inteligencia artificial.
Desde una perspectiva estratégica, un rezago generalizado configura una ventana de diferenciación temprana: en un escenario donde prácticamente ningún actor está preparado, la adopción anticipada de prácticas GEO permite capturar visibilidad en un espacio de baja competencia.
Este estudio presenta limitaciones que conviene explicitar; ninguna de ellas invalida sus resultados, sino que delimita el alcance de sus conclusiones. Primero, la muestra, aunque diversa, está sesgada hacia operadores de gran escala e infraestructura del ecosistema, por lo que sus resultados no son directamente extrapolables al universo de comercios pequeños y medianos con tienda propia. Segundo, el instrumento de medición es de desarrollo propio (véase 3.4); si bien sus criterios se apoyan en investigación publicada y estándares técnicos oficiales, y su aplicación es consistente y reproducible, no constituye un estándar de industria consensuado. Tercero, se trata de una medición transversal en un único momento, que no capta la evolución temporal; las cifras describen el estado del sector en julio de 2026. El valor comparativo de la medición no depende de estas limitaciones, dado que todos los dominios fueron evaluados con el mismo instrumento, los mismos criterios y en el mismo período, lo que hace que las diferencias observadas entre ellos y los promedios agregados sean consistentes entre sí.
El comercio electrónico argentino de primer nivel exhibe un rezago sistemático en su preparación para ser identificado y citado por los motores generativos de inteligencia artificial. Con un puntaje promedio de 35 sobre 100 y ningún dominio en el nivel de preparación, el sector presenta una debilidad transversal en la estructura y el marcado de su contenido, atenuada apenas por una frecuencia de actualización elevada que, por sí sola, no basta para la visibilidad generativa. Este diagnóstico, antes que un señalamiento, delimita una oportunidad: la capa de descubrimiento por inteligencia artificial se encuentra, en el mercado argentino, mayormente inexplorada.
Se listan a continuación, en orden alfabético, los 39 dominios que integran la muestra, sin el puntaje individual de cada uno. Este criterio aporta transparencia metodológica —permite la reproducción independiente de la medición— sin exponer a ninguna empresa a un ordenamiento nominal de puntajes. Algunos grupos corporativos figuran con más de un dominio, por corresponder a sitios distintos analizados de manera independiente.
Nostos analiza cualquier sitio web con los mismos seis criterios de este estudio, gratis y en menos de un minuto.
Analizar mi sitio →