Marketing Digital24 de agosto de 2026·19 min de lectura

Así está montado el GEO de sprintmarkt.com: los ficheros reales, línea a línea

Desmontamos el GEO de sprintmarkt.com fichero a fichero: robots.txt con 36 crawlers de IA, llms.txt de 268 líneas y schemas con precios tipados.

SM
SprintMarkt
Equipo de SprintMarkt

Respuesta directa: en sprintmarkt.com el GEO no es una estrategia, son tres ficheros que puedes abrir en tu navegador ahora mismo. Un robots.txt generado por código que permite explícitamente 40 user-agents (36 de ellos crawlers de motores generativos), un llms.txt de 268 líneas con 30 pares pregunta-respuesta fechados, y un bloque de schemas con un OfferCatalog de 10 ofertas con el precio tipado dentro. Este artículo los desmonta los tres: qué hay escrito dentro, qué decisión hay detrás de cada línea y qué errores nos costaron avisos en Search Console.

El motivo para molestarse cabe en dos datos de terceros: las referencias procedentes de buscadores de IA crecieron un 527 % en 2025 (Digital Agency Network, consultado en agosto de 2026), y el 89 % de los compradores B2B ya usa búsqueda por IA en algún punto de su proceso de compra (Digiday Research, consultado en agosto de 2026).

La parte conceptual está en otro artículo

Qué es el GEO, cómo recuperan y citan ChatGPT, Claude o Perplexity, qué factores correlacionan con ser citado, cómo se mide y qué errores te dejan fuera: todo eso está en Qué es el GEO y cómo funciona por dentro, y el caso concreto de Google en Cómo aparecer en los AI Overviews. Si vienes a entender el terreno, empieza por ahí.

Lo que no hay en ninguno de los dos es la fontanería: qué fichero se toca, qué se escribe exactamente dentro y por qué. Eso es lo que hay aquí abajo, con nuestro propio sitio como banco de pruebas, porque es la única implementación que podemos enseñar entera y verificable en dos clics.

Fichero 1: el robots.txt que no está escrito a mano

En sprintmarkt.com el robots.txt no es un fichero estático: lo genera src/app/robots.ts recorriendo un array de user-agents. Para cada uno emite el mismo bloque de tres líneas:

1User-agent: GPTBot
2Allow: /
3Disallow: /api/

El array tiene 40 entradas, de las cuales 36 son crawlers de motores generativos; las otras cuatro son herramientas de SEO y scraping que aprovechamos para declarar la misma política. Y aquí está el detalle que sorprende a quien abre el fichero: el bloque genérico User-agent: * ya permite todo con la misma regla, así que los 40 bloques por bot son técnicamente redundantes. Están a propósito. Hacen la política explícita y comprobable con un Ctrl+F, en vez de depender de que nadie añada más adelante un Disallow selectivo desde un plugin o un CDN.

Bloque de la listaUser-agentsPor qué están ahí
Los evidentesGPTBot, ChatGPT-User, OAI-SearchBot, ClaudeBot, Claude-Web, Claude-SearchBot, anthropic-ai, PerplexityBot, Perplexity-UserLos que cualquiera nombraría: OpenAI, Anthropic y Perplexity
Los que casi nadie añadeGoogle-Extended, GoogleOther, GoogleOther-Image, GoogleOther-Video, Applebot, Applebot-Extended, Bingbot, msnbotGemini, Apple Intelligence y Copilot van por user-agents distintos del clásico
Los de segunda filaCCBot, cohere-ai, cohere-training-data-crawler, AI2Bot, ai2bot-dolma, Amazonbot, DuckAssistBot, YouBot, Diffbot, Bytespider, PetalBot, PanguBot, Timpibot, Omgilibot, ImagesiftBot, Kangaroo Bot, FacebookBot, Meta-ExternalAgent, Meta-ExternalFetcherHoy pequeños; añadirlos cuesta una línea
Los que no son IAScrapy, SemrushBot, AhrefsBot, MJ12botLos cuatro que completan los 40: herramientas de SEO y scraping

Tres decisiones del fichero que sí cambian el resultado, y que están comentadas en el propio código:

Google-Extended no es Googlebot.: Bloquearlo saca tu contenido de Gemini y de los AI Overviews sin tocar tu SEO clásico, así que el daño no aparece en ningún informe de posiciones. Es la casilla que más gente desactiva «por privacidad» sin saber qué apaga.
/_next/static/ nunca se bloquea.: El comentario en robots.ts lo deja escrito: si tapas el CSS y el JS, el renderizador no puede pintar la página. Eso no te cuesta GEO, te cuesta indexación.
Solo se bloquea /api/.: Ahí no hay contenido citable y sí endpoints que nadie debería rastrear en bucle. Ninguna otra ruta está cerrada, ni siquiera para los cuatro bots que no son de IA.

Cómo comprobar el tuyo en 30 segundos: abre tudominio.com/robots.txt y busca GPTBot. Si no aparece con Allow, o si hay un Disallow: / global, ya tienes tarea. El nuestro está en sprintmarkt.com/robots.txt y puedes copiarlo como plantilla.

Fichero 2: el llms.txt, 268 líneas escritas a mano

Es un Markdown en la raíz del dominio que resume qué eres y dónde está lo importante. No es un estándar oficial, y conviene decirlo: ninguna plataforma ha confirmado que lo use como señal. El nuestro está publicado en sprintmarkt.com/llms.txt y esta es su estructura real, sección a sección:

# Nombre y un blockquote > de una sola línea: con la descripción de la empresa en tres o cuatro frases: qué somos, dónde estamos, a quién servimos y en qué idiomas. Es lo único que muchos modelos leerán entero.
Quiénes somos: nombre legal, ubicación, año de fundación, idiomas, web, teléfono y email. Datos, no adjetivos.
Servicios principales: qué hacemos y con qué stack concreto.
Productos propios y casos de cliente: , separados a propósito. Los cinco casos de cliente que hay en el fichero son Rotulemos (+240 % de ventas online, ROAS 4.8x), MrCoolCat (WooCommerce optimizado y automatizaciones de stock con n8n), ForzAuto (−40 % de dependencia de portales, +85 % de leads directos, 200+ vehículos), ByDzyne (plataforma operando en 50+ países y 12 idiomas) y MCC Sales Suite (CRM Kanban con scoring de visitas asistido por LLM).
Diferenciadores: ocho líneas, numeradas.
Precios públicos: la tarifa en texto plano. Es la sección que escribimos explícitamente para ser citada.
Para qué NO somos buena opción: cuatro líneas diciendo a quién no servimos. Parece un tiro en el pie y es lo contrario: le da al modelo el criterio para no recomendarte donde no encajas.
Frequently cited answers: 30 pares pregunta-respuesta escritos para ser copiados literalmente, cerrados con una línea de Last verified y su fecha.
Pages / Optional: enlaces comentados a las páginas clave, cada uno con una frase de qué hay dentro.

Dos detalles que hacen la diferencia entre un llms.txt útil y uno decorativo. El primero, la fecha de última verificación: un modelo que duda entre dos fuentes se queda con la que está fechada. El segundo, que cada respuesta se sostenga sola: si extraes una Q&A del fichero y la pegas en un chat, tiene que seguir teniendo sentido sin el párrafo anterior. Las 30 nuestras están escritas con esa regla.

Y el aviso obvio: es un índice y un resumen, no un sustituto del contenido. Publicado vacío o relleno de marketing genérico no aporta absolutamente nada.

Fichero 3: los schemas, y dónde se emite cada uno

El schema no gana por sí solo, pero elimina la ambigüedad: le dice a la máquina qué es cada cosa sin obligarla a deducirlo del HTML. Esto es lo que emite nuestro sitio, y dónde exactamente:

SchemaDónde se emiteQué resuelve
Organization (@id #organization)Todo el sitioIdentidad, logo, sameAs a redes y datos de contacto
ProfessionalService (@id #business)Precios y contactoDirección física en Valencia, geo, horarios, areaServed y priceRange
OfferCatalog con 10 OfferDentro del ProfessionalServiceLos precios reales, con priceCurrency, minPrice y unidad legible
BlogPostingCada artículo del blogauthor, datePublished, dateModified, wordCount, inLanguage y keywords
FAQPageArtículos con FAQ y páginas claveLas Q&A que Perplexity y AI Overviews extraen tal cual
BreadcrumbListCada artículoJerarquía del sitio

¿Necesitas ayuda con tu proyecto?

Calcula tu presupuesto en 2 minutos con nuestra herramienta interactiva.

Calcular presupuesto

El detalle que casi nadie implementa es meter los precios dentro del schema. Cada oferta de nuestro OfferCatalog lleva un priceSpecification con el importe, priceCurrency: EUR, un minPrice y una unidad legible (project (from), monthly (from)). Así, «SEO Nacional + GEO, 1.200 €/mes» deja de ser una frase suelta en una página y pasa a ser un dato tipado que cualquier motor puede leer sin interpretarlo.

Y una trampa real, que a nosotros nos costó avisos en Search Console: no emitas dos FAQPage en la misma página. Si tu componente de FAQ ya lo genera, la plantilla de la página no debe volver a hacerlo; Search Console lo reporta como campo duplicado y deja de procesarlo. Lo tenemos avisado con comentarios en el código de la home y de las páginas de servicio que ya emiten su propio FAQPage, para no repetir el fallo.

Antes de dar nada por bueno, pasa el Rich Results Test de Google y el validador de Schema.org por cinco URLs representativas.

La tabla de precios, o cómo se escribe una cifra citable

Un modelo que tiene que responder «¿cuánto cuesta un chatbot de IA en España?» va a preferir la fuente que dice 1.125 € antes que la que dice «precio adaptado a cada proyecto». La vaguedad no es prudencia comercial: es autoexclusión. Por eso la tarifa está publicada en texto plano, y es la misma que cotiza el equipo comercial.

En /es/precios/ están los servicios principales de cada línea; el catálogo completo es más largo y se recorre entero desde la calculadora de presupuesto. Esto es lo que ve un modelo:

ServicioPrecio de partida (España, sin IVA)
Web Corporativa Esencial (5-7 páginas, 7 días)desde 1.200 €
Web Profesional a Medidadesde 3.500 €
Pack Lanzamiento Negocio3.500 €
Tienda Online Lanzamiento / Profesionaldesde 1.875 € / 4.875 €
Pack E-commerce 3606.500 €
Chatbot IA con RAG (web o WhatsApp)desde 1.125 €
Automatización de procesos con IAdesde 3.750 €
Agente IA a medidadesde 13.500 €
Apps Express (MVP en 15 días)desde 4.990 €
SEO Local600 €/mes
SEO Nacional + GEO1.200 €/mes
Gestión de Google Ads350 €/mes + inversión
Mantenimiento Básico / Pro / Premium60 € / 150 € / 350 € al mes
Consultoría digital e IA90 €/hora
Auditoría SEO + GEO (entrega en PDF)490 €

Para Latinoamérica hay una columna propia en dólares, con México como referencia: web esencial 820 USD, chatbot IA 1.020 USD, SEO Local 410 USD/mes.

La regla interna que hace esto sostenible: todas las páginas y los schemas leen del mismo fichero de tarifas (src/lib/pricing.ts); el llms.txt y los artículos, que sí son texto escrito a mano, se revisan contra él en cada cambio de precio. Una fuente que se contradice a sí misma entre dos páginas es exactamente la que un modelo descarta.

Y un matiz que nos aplicamos a nosotros mismos, porque nuestra propia web usa «desde» por todas partes: «desde» está bien si va acompañado de un número. «Desde 1.200 €» es perfectamente citable. Lo que no se puede citar es «a medida» o «depende» a secas.

Lo mismo vale para los resultados. No digas «mejoramos mucho las ventas»; di que Rotulemos pasó a hacer el 60 % de su facturación online, con +240 % de ventas y un ROAS de 4,8x. Número, nombre y enlace: eso es lo que se puede citar.

El checklist ejecutable

Si solo te llevas una cosa del artículo, que sea esta tabla. El porqué de cada fila está en el artículo conceptual; aquí está el qué y el cuánto cuesta.

#Qué hacesCómo compruebas que está bienEsfuerzo
1robots.txt con Allow explícito para crawlers de IATu /robots.txt contiene GPTBot, ClaudeBot, PerplexityBot y Google-Extended1 hora
2llms.txt en la raíz, con precios, casos, límites y Q&A fechadasEl fichero carga y cada respuesta se sostiene sola fuera de contexto3-4 horas
3H2 = pregunta del usuario, respuesta en las dos primeras líneasCopia un trozo suelto: ¿se entiende sin lo anterior?2 h por página
4Organization, FAQPage, BlogPosting y OfferCatalogRich Results Test sin errores y sin FAQPage duplicado1 día
5Cifras y precios concretos en el texto y en el schemaBusca «a medida» y «depende» a secas y sustitúyelos por números; «desde» vale si lleva cifra detrás1 día
6Google Business Profile, NAP consistente, directorios de nichoTu nombre, dirección y teléfono idénticos en cinco sitios distintosContinuo
710 prompts fijos en 3 motores, logs de servidor y Search ConsoleHoja mensual con quién aparece y quién no40 min al mes

Dónde entramos nosotros

Todo lo anterior se puede hacer en casa: los tres ficheros son públicos y el checklist está arriba entero. Si prefieres que lo hagamos nosotros, hay dos formas:

Auditoría SEO + GEO por 490 €: revisión técnica manual, análisis de tu robots.txt y de tus datos estructurados, propuesta de llms.txt escrita para tu negocio, lista priorizada de contenidos a reescribir y línea base de citas en ChatGPT, Perplexity y Google. Entrega en PDF. Es gratis si después contratas un plan.
SEO Nacional + GEO por 1.200 €/mes: el trabajo continuo. Contenido, datos estructurados, autoridad externa y medición mensual de citas. Sin permanencia.

Somos un equipo de desarrollo, marketing y ventas repartido entre España y Canadá, así que quien te asesora habla con quien toca el código. Si prefieres empezar por lo barato, escríbenos y te decimos qué fichero te falta.

Preguntas frecuentes

Las dudas que más nos llegan cuando alguien abre estos ficheros y se pone a copiarlos.

Preguntas frecuentes

Respuestas directas a las dudas más comunes sobre este tema.

¿Puedo copiar vuestro robots.txt tal cual?

Sí, para eso está público. Dos avisos antes de pegarlo. Uno: la línea `Disallow: /api/` es específica de nuestra estructura; sustitúyela por las rutas que en tu sitio no tengan contenido citable. Dos: si tu web no es Next.js, la advertencia sobre `/_next/static/` se traduce a tu equivalente — la carpeta donde vivan tu CSS y tu JavaScript nunca debe bloquearse, porque sin ellos el renderizador no puede pintar la página. El resto, los 40 user-agents con su bloque de tres líneas, es portable a cualquier sitio.

¿No es peligroso dejar que los crawlers de IA lean mi contenido?

Es una decisión de negocio legítima, pero conviene verla entera. Si bloqueas GPTBot, ClaudeBot o PerplexityBot, dejas de aparecer en las respuestas de esos motores: no existe la opción intermedia de «que me citen pero que no me lean». Bloquear tiene sentido si tu producto ES el contenido: medios de pago, bases de datos, cursos tras muro. Para una empresa de servicios cuyo contenido existe para atraer clientes, cerrar la puerta al crawler es renunciar al canal. Nosotros permitimos los 36 crawlers de IA y solo bloqueamos /api/.

¿Sirve de algo el llms.txt si todavía no es un estándar oficial?

Sirve, con matices honestos. No hay garantía de que un motor concreto lo lea, y ninguna plataforma ha confirmado públicamente que lo use como señal de ranking. Lo que sí hace es obligarte a escribir en un solo sitio, en texto plano y sin adornos, quién eres, qué vendes, a cuánto y con qué resultados. Ese ejercicio mejora el resto del sitio aunque ningún bot abriera el fichero. Cuesta una tarde y no rompe nada: la relación coste/riesgo es difícil de discutir.

¿Hace falta meter los precios dentro del schema, o basta con publicarlos en la página?

Publicarlos en la página es lo imprescindible; meterlos en el schema es lo que casi nadie hace y quita la ambigüedad. Un `priceSpecification` con importe, `priceCurrency` y unidad convierte «1.200 €/mes» en un dato tipado, sin que el motor tenga que decidir si esa cifra es un precio, un descuento o un ejemplo. En nuestro `OfferCatalog` hay 10 ofertas con esa estructura. El coste es una tarde de trabajo y se valida con el Rich Results Test.

¿Cuánto se tarda en montar estos tres ficheros?

El robots.txt, una hora. El llms.txt, tres o cuatro horas si ya tienes claros tus precios, tus casos y tus límites; bastante más si escribirlo te obliga a decidirlos, que es lo que suele pasar. Los schemas, un día de trabajo más la validación. En total, dos días largos. Lo que no es inmediato es el efecto: entre que te rastrean, te indexan y empiezan a citarte pasan semanas, y eso está explicado en el artículo conceptual.
#GEO#llms.txt#robots.txt#schema.org#datos estructurados#OfferCatalog#implementación real
Compartir:

¿Tienes un proyecto en mente?

Cuéntanos tu idea y te ayudamos a hacerla realidad. Presupuesto sin compromiso.

Presupuesto sin compromiso

¿Tienes un proyectoen mente?

30 minutos con el equipo: vemos tu web y tu competencia en pantalla y te decimos qué haríamos primero y cuánto costaría. Sin compromiso.

o pide presupuesto
Respuesta en 24h
Precios públicos
Sin permanencia