Saltar al contenido
megapromotingVamos a hablar

Experiencia · GEO

Visibilidad en las respuestas generadas: trabajamos la parte que se puede controlar y escribimos en la oferta lo que no se puede.

Qué recibe efectivamente un agente de modelo cuando pide tu página, qué decides para cada una de las tres categorías de rastreadores, qué publicas para poder ser usado como fuente. Sin posiciones, sin garantía de citación.

Oferta, con condicionesAvem piese, nu un rezultat măsurat, și le numim ca atare. Piesele: un fișier `llms.txt` scris de noi, servit de producție cu 200 și 2.137 de octeți; o verificare de acces cu zece identificatori de agenți de model, toți primind 200 și exact 252.041 de octeți pe aceeași pagină; liste de surse publicate lângă afirmații — 522 de citări în 26 de fișiere de conținut. Ce ne lipsește ca să putem scrie „construit deja”: o măsurătoare a citărilor pe care s-o putem arăta, și un modul de analiză pentru asta în analizorul propriu — are unul pentru răspunsuri directe, nu are unul pentru răspunsuri generate. Mai e un motiv, mai important: rezultatul nu ne aparține. Un răspuns generat nu are poziții, nu are un loc pe care să-l cumperi și nu se repetă identic de la un utilizator la altul. O pagină care ar promite altceva ar fi prima contrazisă de client, în prima zi.

Una respuesta generada no es una lista de enlaces. El modelo compone un texto y, si elige hacerlo, adjunta algunas fuentes. No existe el primer lugar, no existe una garantía de que una página vaya a ser citada, y la misma pregunta hecha por dos personas, o por la misma persona al día siguiente, puede devolver otra respuesta y otras fuentes. Esto no es un defecto de nuestro método, es la forma del mecanismo. Cualquier oferta que empiece con «te llevamos a ChatGPT» pasa por alto exactamente este punto.

Lo que queda por trabajar es la parte anterior a la respuesta: si la página es accesible para los agentes que la solicitan, si el texto está completo en HTML sin JavaScript, si dice claramente qué es la empresa y qué hace, y si las afirmaciones que contiene son verificables por alguien que no te conoce. Aquí todo se puede medir, en códigos de respuesta y en octetos. En este sitio solicitamos la misma página con diez identificadores de agentes de modelo: los de búsqueda, los activados por un usuario, los de entrenamiento. Todos recibieron 200 y exactamente la misma cantidad de contenido: 252.041 octetos. Esto es una constatación, no una promesa, y se puede rehacer con un comando.

La segunda cosa que se puede controlar es una decisión, no una configuración: qué haces con las tres categorías de rastreadores. La documentación de los proveedores las separa explícitamente: en OpenAI, `OAI-SearchBot` para el índice de búsqueda, `GPTBot` para entrenamiento, `ChatGPT-User` para la solicitud iniciada por una persona, sobre el cual se escribe que las reglas de `robots.txt` pueden no aplicársele; en Perplexity, `PerplexityBot` respeta `robots.txt`, mientras que `Perplexity-User` en general no lo respeta, porque la solicitud viene de una persona; `Google-Extended` tiene que ver con el entrenamiento y la fundamentación de los modelos Gemini y, dice la documentación, no influye en la inclusión ni en la clasificación en la búsqueda de Google. Son tres decisiones independientes, con consecuencias diferentes. En este sitio hoy existe una sola regla general, en 129 octetos, así que la posición es implícita, no decidida.

Lo tercero que decimos antes del contrato: para Google, gran parte de «GEO» es, mecánicamente, SEO. La propia documentación de Google escribe que, para aparecer como enlace de apoyo en AI Overviews o en AI Mode, la página debe estar indexada y ser elegible para aparecer en la búsqueda con un fragmento, y que no hacen falta nuevos archivos legibles por máquina para aparecer allí. La conclusión práctica no es que el trabajo desaparezca, sino que se desplaza: sin indexación, renderizado en el servidor y una página que diga algo verificable, no hay nada que citar. Por eso esta página se lee después de las otras dos, no en lugar de ellas.

Qué incluye

El trabajo, por componentes

Pedimos las páginas con el agente, no suponemos lo que recibe

Cada página importante se solicita con los identificadores publicados de los agentes de modelo y comparamos el código de respuesta, el tamaño y la huella del contenido con lo que recibe un navegador. En este sitio, diez identificadores en la misma página —de búsqueda, activados por el usuario, de entrenamiento— recibieron todos 200 y todos 252.041 octetos, y `robots.txt` fue idéntico para todos. Entregamos la tabla, no la conclusión: agente, dirección, código, octetos. Cuando un proveedor de alojamiento o un servicio de protección filtra uno de ellos, se ve aquí, no dentro de seis meses.

El texto completo en HTML, verificado en bytes

Un agente que no ejecuta JavaScript ve solo lo que está en la respuesta del servidor. Verificamos que la página esté renderizada en el servidor y que el texto que importa realmente esté ahí: en este sitio, el encabezado `x-nextjs-prerender: 1` y contenido idéntico para el agente y para el navegador. Es una verificación aburrida y es la primera que falla en los sitios construidos como aplicación: la página se ve perfecta en el navegador y está vacía para cualquiera que la lea como texto.

La posición frente a las tres categorías de crawlers, tomada explícitamente

Rastreador de búsqueda que envía personas de vuelta, agente activado por una persona que pidió la página, rastreador de entrenamiento. Son reglas independientes y consecuencias diferentes: bloquear al agente activado por el usuario significa que la persona que preguntó por ti recibe una respuesta sin ti. Escribimos las reglas, escribimos qué pierdes con cada una, la decisión es del propietario. Lo que no hacemos: no presentamos una sola regla general como estrategia — en este sitio existe exactamente eso, 129 bytes, y lo decimos.

Un resumen legible por máquina, escrito como documento

`llms.txt` es un archivo corto que dice qué es la organización, qué páginas importan y cómo deben interpretarse. El nuestro es estático, 2.137 bytes, responde 200 en producción y tiene una sección que dice lo que el sitio **no** sostiene: que mencionar una institución no significa asociación, que los proyectos de investigación no son dispositivos médicos. El límite, dicho en la misma frase en que lo ofrecemos: la documentación de Google escribe explícitamente que no necesitas nuevos archivos legibles por máquina para aparecer en sus funciones generativas. Lo publicamos porque te obliga a escribir en una página lo que realmente eres, no porque sea una palanca.

Las afirmaciones reciben la fuente junto a ellas, en la página

En nuestras páginas de servicio, cada afirmación tiene detrás un archivo y una línea, publicados en una lista al final de la página — 522 citas en 26 archivos de contenido. El propósito es doble: una persona que decide puede verificar, y un texto que lleva su verificación es más fácil de usar como fuente que uno que no la lleva. Lo que no decimos: que eso aumenta la probabilidad de ser citado. Aumenta la probabilidad de ser **utilizable**. No es lo mismo y no tenemos cómo medir lo segundo.

Lo que otras fuentes dicen sobre ti, inventariado

Una respuesta generada también se compone de páginas que no son tuyas: catálogos, registros públicos, artículos, discusiones. Hacemos el inventario de lo que existe, anotamos lo que está mal — nombre legal distinto, dirección muerta, descripción que contradice el sitio — y preparamos las solicitudes de corrección, que envías tú, desde tu dirección. Lo que no hacemos: no compramos menciones, no escribimos en foros bajo identidades inventadas y no producimos „reseñas”. Es una mentira con tu nombre encima, y cuando sale a la luz sale exactamente en el lugar donde intentabas ser creíble.

La observación de las respuestas, como un diario con fecha

Establecemos un conjunto de preguntas reales, escritas palabra por palabra, y las introducimos periódicamente en los motores que te importan. Cada entrada anota la fecha, el motor, la pregunta exacta, la respuesta recibida y las fuentes citadas. Es un diario de observaciones, reproducible como método, no como resultado — dos ejecuciones en días distintos pueden no coincidir, y lo escribimos en el encabezado del documento. Lo que no producimos: un porcentaje. Un porcentaje aquí sería una cifra inventada a partir de una muestra que no controlamos.

Las etiquetas inventadas, tratadas como tales

Este sitio envía tres metaetiquetas llamadas `ai:context`, `ai:category` y `ai:location`, puestas ahí en una versión anterior. Ningún motor documenta que las lea. No las vendemos como servicio y no las ponemos en logros; las dejamos escritas aquí como ejemplo de algo que parece optimización sin serlo. Si encontramos algo así en tu caso, recibes la misma frase: cuesta cero, demuestra cero.

Lo que no prometemos, escrito antes del contrato

No prometemos que serás citado, cuántas veces serás citado ni que aparecerás ante una pregunta determinada. No existe una posición que comprar y no existe una orden que obligue a un modelo a recomendar una empresa. Lo que entregamos es verificable de otra manera: la tabla de acceso para cada agente, el estado de la renderización, las reglas decididas para cada categoría de crawler, el resumen publicado, el inventario de fuentes de terceros y el diario de observaciones con fecha. Todo se puede rehacer sin nosotros.

Qué aspecto tiene

El recorrido, paso a paso.

01

La tabla de acceso y de renderización

Primera entrega: cada página importante solicitada con los identificadores publicados de los agentes de modelo, con código, tamaño y huella del contenido, más la verificación de que el texto está en HTML sin JavaScript. A partir de ahí, la discusión tiene una fila detrás. Aquí salen a la luz los filtros puestos por el proveedor de alojamiento de los que nadie sabía.

02

La decisión sobre las tres categorías, escrita antes de aplicarse

Ponemos por escrito qué ocurre con cada categoría si la dejas abierta y si la cierras, incluido el caso incómodo: el agente desencadenado por una persona que preguntó por ti. Solo después de que la decisión está tomada y firmada se cambia `robots.txt`. Entregamos las reglas y el motivo de cada una, no solo el archivo.

03

El resumen legible por máquina y el camino hacia él

Escribimos `llms.txt` como documento corto — qué es la organización, qué páginas importan, cómo deben interpretarse las afirmaciones — y hacemos que se pueda encontrar: mencionado en `robots.txt` y enlazado desde la página. En este sitio el archivo existe y responde 200, pero no está mencionado en ninguna parte y no tiene variante extendida; ambas carencias están escritas como carencias, no ocultas.

04

El inventario de las fuentes de terceros y las correcciones

La lista de páginas públicas que te mencionan, qué está mal en cada una y el texto de la solicitud de corrección. El envío lo haces tú, desde tu dirección. El motivo es simple: una corrección pedida por un intermediario desconocido se ignora, y una enviada bajo identidad falsa es exactamente lo que rechazamos.

05

El diario de observaciones y su revisión

Fijamos las preguntas, los motores y el ritmo. Cada ejecución añade entradas con fecha; no reescribimos las entradas viejas cuando la respuesta cambia, porque la diferencia entre ellas es lo único útil del documento. En la revisión nos fijamos en lo que cambió en el mecanismo, no solo en las respuestas — las categorías de crawler y sus reglas cambian más a menudo que el texto del sitio.

Un centru. În jur, ce intră în el — pe trasee separate.CENTRUL SE SPRIJINĂ PE CE E ÎN JURUL LUI
Răspunsul se compune din surse care se rotesc în jurul întrebării: pagina ta, cataloagele, articolele, discuțiile. Controlezi un singur corp din desen — și forma în care el poate fi citit.

Los datos

Qué tocamos, dónde están y cuánto se quedan

Las preguntas que hace cualquiera que tenga un delegado de protección de datos — hechas aquí antes de que las haga él.

Qué leemos de tu sitio
Solo lo público: el HTML, los encabezados de las respuestas, `robots.txt`, el mapa del sitio. Pedimos las mismas páginas varias veces, una vez por cada identificador de agente, a ritmo limitado. No necesitamos acceso de administración para la parte de verificación.
Qué leemos de fuera del sitio
Páginas públicas que te mencionan: catálogos, registros, artículos, perfiles. Las leemos como cualquier visitante. No creamos cuentas para llegar a contenido cerrado y no extraemos automáticamente, a gran volumen, de los motores generativos — sus condiciones lo prohíben, y un servicio construido sobre su incumplimiento se detiene solo un día.
Qué necesitamos de ti
Una decisión, no un acceso: qué haces con cada una de las tres categorías de crawlers. Además del derecho de publicar dos archivos en la raíz del sitio, `robots.txt` y el resumen legible por máquina. Y la lista de preguntas que tus clientes realmente hacen — el diario de observaciones solo es útil si las preguntas que contiene son las suyas, no las nuestras.
Qué contiene el diario de observaciones
La fecha, el motor, la pregunta escrita palabra por palabra, la respuesta recibida y las fuentes citadas en ella. Sin datos personales de quien hizo la pregunta, porque las preguntas son nuestras, hechas deliberadamente. Si quieres que sigamos preguntas venidas de usuarios reales, se establece por separado qué se anonimiza antes de entrar en el documento.
Dónde está y cuánto tiempo permanece
La tabla de acceso, las reglas decididas y el diario quedan versionados en el repositorio del proyecto, junto al código, no en una herramienta con suscripción de la que ya no los puedas sacar. Viven tanto como vive el repositorio. Cuando cambia una cifra, se ve en el historial quién y cuándo la cambió.

Un caso

Diez agentes, la misma página: qué recibe un modelo cuando pide nuestro sitio

La situación

Nuestro propio sitio, aproximadamente 250 direcciones públicas, 147 en el mapa del sitio. La pregunta de partida no fue «cómo aparecemos en ChatGPT», sino una a la que se puede responder: qué recibe efectivamente un agente de modelo cuando solicita una página nuestra, y en qué difiere de lo que recibe un navegador.

Qué construimos

Pedimos la misma página con diez identificadores publicados de agentes — de indexación para asistentes, activados por el usuario, de entrenamiento — y comparamos el código, el tamaño y `robots.txt` servido a cada uno. Por separado verificamos si el texto está en la respuesta del servidor o se construye en el navegador, leímos el archivo de resumen legible por máquina y buscamos el camino hacia él, e inventariamos lo que el sitio envía como señales orientadas a modelos.

Qué salió

Los diez recibieron 200 y exactamente 252.041 bytes; `robots.txt` fue idéntico para todos, 129 bytes, con un solo grupo general — por tanto, la posición frente a las tres categorías de rastreadores es implícita, no decidida. La página se renderiza en el servidor. El archivo de resumen existe, es estático y responde 200 con 2.137 bytes, pero no se menciona en `robots.txt`, no está enlazado desde ninguna página, y la variante extendida exigida por la convención devuelve 404. También encontramos tres metaetiquetas orientadas a modelos, añadidas en una versión anterior, que ningún motor documenta que lea.

Qué no dice el caso

Nada de lo anterior dice que vayamos a ser citados en algún lugar, y tampoco se midió algo así. Las constataciones son sobre el acceso y la forma — la parte que controlamos. De ellas, solo una decisión se toma hoy (el archivo de resumen existe); el resto son trabajos abiertos, incluida la decisión de fondo sobre los crawlers, que no es técnica y no la toma el proveedor.

Preguntas

Lo que nos pregunta la gente antes de llamar

¿Me garantizáis que ChatGPT o Perplexity va a recomendar mi empresa?

No, y nadie puede. Una respuesta generada se compone a petición, no se elige de una lista ordenada: no tiene posiciones, no tiene un lugar que comprar y no se repite de forma idéntica para dos usuarios o para dos días. No existe ningún comando que obligue a un modelo a recomendar una empresa. Lo que se puede hacer es no ser imposible de encontrar ni de verificar cuando el modelo busca: la página accesible al agente que la solicita, el texto completo en HTML, afirmaciones que se puedan confirmar de otras fuentes. Lo demás no nos pertenece y no vendemos lo que no nos pertenece.

Entonces, ¿de qué se ocupa concretamente esta página, frente al SEO y a las respuestas directas?

De la pregunta «qué llega a un modelo sobre ti y en qué forma». El SEO se ocupa del inventario del sitio —cada dirección recorrida, una sola versión oficial, títulos que no se repiten— para los motores que devuelven una lista. Las respuestas directas se ocupan de traducir la página a datos que una máquina lee sin adivinar, y ahí el resultado se puede probar con la herramienta del motor. Aquí no hay ni lista ni herramienta de prueba: hay un texto compuesto, en el que puedes ser usado como fuente o no. Por eso es la única de las tres que escribimos como oferta con condiciones.

¿Cómo medís, si no existe posición?

Con un registro de observaciones, no con una métrica. Establecemos las preguntas reales de tus clientes, las planteamos periódicamente, y anotamos cada vez la fecha, el motor, la pregunta palabra por palabra, la respuesta y las fuentes citadas. Lo que sale es una serie de observaciones fechadas, de la que se ve una tendencia. Lo que no sale es un porcentaje, porque un porcentaje aquí significaría una muestra que no controlamos, de un sistema que puede responder de forma distinta a la segunda pregunta. Un proveedor que te da una puntuación de «visibilidad en AI» te da una cifra sacada de un método que no te muestra.

¿`llms.txt` realmente sirve para algo?

Es una convención propuesta, no un estándar adoptado, y la documentación de Google dice explícitamente que no necesitas nuevos archivos legibles por máquina para aparecer en sus funciones generativas. Lo publicamos igualmente, por dos motivos prácticos: cuesta un archivo estático, y su redacción te obliga a formular en una sola página qué eres, qué haces y qué no sostienes —un ejercicio que normalmente muestra contradicciones en el resto del sitio. El nuestro tiene 2.137 octetos y una sección sobre cómo deben interpretarse las afirmaciones. Lo que no hacemos: no lo vendemos como palanca de visibilidad.

¿Debería bloquear los crawlers de inteligencia artificial?

Son tres decisiones, no una, y solo ellas forman la respuesta. El rastreador de búsqueda de un asistente te lleva a sus resultados y envía personas de vuelta. El agente activado por un usuario aparece porque alguien acaba de preguntar por ti — si lo bloqueas, esa persona recibe una respuesta sin ti, y la documentación de al menos dos proveedores escribe que estos agentes pueden no respetar `robots.txt`. El rastreador de entrenamiento es del que se suele hablar, y en Google está separado mediante `Google-Extended`, sobre el cual la documentación dice que no influye en la inclusión ni en la clasificación en la búsqueda. Nosotros ponemos las tres consecuencias sobre la mesa; la elección es del propietario del sitio.

He leído que los modelos citan mucho los foros. ¿Compramos menciones ahí?

No. No escribimos bajo identidades inventadas, no pagamos publicaciones y no producimos reseñas. El motivo no es moral en abstracto: una mención pagada es una afirmación sobre tu empresa que no puedes sostener, publicada en un lugar que no controlas, con tu nombre encima. Cuando alguien verifica —un cliente, un periodista, un modelo que compara fuentes— el descubrimiento se hace exactamente en el lugar en el que intentabas ser creíble. Lo que hacemos en cambio: inventario de las menciones reales existentes, corrección de las erróneas, y contenido en tu sitio que merezca ser citado.

¿Por qué esta página es «oferta» y no «ya construido», como las otras?

Porque nuestra regla exige un mínimo de dos implementaciones propias citadas con archivo y línea, y aquí tenemos piezas, no un resultado. Tenemos el archivo de resumen publicado y activo, tenemos la verificación de acceso con diez agentes en el propio sitio, tenemos las listas de fuentes debajo de cada afirmación. No tenemos una medición de las citas que podamos mostrar, y nuestro analizador tiene un módulo para respuestas directas y no tiene uno para respuestas generadas. Podríamos haber escrito igual «ya construido». Habría sido la primera afirmación contradicha por un cliente atento, y justamente acabamos de escribir una página entera sobre por qué no hacemos eso.

¿Qué cambia en seis meses?

Casi toda la superficie: los nombres de los agentes, sus reglas, la forma en que un motor muestra las fuentes, qué productos muestran respuestas generadas. Por eso no vendemos una lista de tácticas. Lo que no cambia es la capa de abajo: una página que no es accesible al agente, que se construye en el navegador y no en la respuesta del servidor, o que no dice de forma verificable qué es la empresa, no puede ser usada por nada —ni por un motor de búsqueda, ni por un modelo, ni por la persona que la abre. Eso se hace una vez y dura.

¿Hacéis esto por separado del SEO o junto con él?

Juntos, y no por comodidad comercial. La documentación de Google dice que, para aparecer como enlace de apoyo en sus funciones generativas, una página debe estar indexada y ser elegible para aparecer en la búsqueda con un fragmento. En otras palabras, en Google la condición de entrada en la respuesta generada es precisamente el trabajo de indexación. Se puede empezar también solo con la parte de acceso y resumen —es útil por sí sola—, pero si el sitio no es indexable, esa parte no tiene sobre qué asentarse, y lo decimos antes, no después.

En qué se basan las afirmaciones anteriores (12 fuentes)
  1. Zece identificatori de agenți de model pe aceeași pagină: toți primesc 200 și toți 252.041 de octeți; `robots.txt` identic, 129 de octeți, un singur grup `User-Agent: *`https://www.megapromoting.com/servicii · 2026-09-06
  2. OpenAI documentează trei agenți cu roluri separate: `OAI-SearchBot` pentru indexul de căutare, `GPTBot` pentru antrenare, `ChatGPT-User` pentru cererea pornită de un utilizator, despre care scrie că regulile din `robots.txt` pot să nu se aplicehttps://developers.openai.com/api/docs/bots · 2026-09-06
  3. Perplexity documentează `PerplexityBot`, care respectă `robots.txt`, și `Perplexity-User`, despre care scrie că în general nu îl respectă, pentru că cererea vine de la o persoanăhttps://docs.perplexity.ai/guides/bots · 2026-09-06
  4. `Google-Extended` ține de antrenarea și fundamentarea modelelor Gemini și nu influențează includerea sau clasarea în căutarea Googlehttps://developers.google.com/search/docs/crawling-indexing/google-common-crawlers · 2026-09-06
  5. Documentația Google spune că nu sunt necesare fișiere noi citibile de mașină pentru a apărea în funcțiile ei generative, și că o pagină trebuie să fie indexată și eligibilă să apară cu un fragment pentru a fi arătată ca link de sprijin în AI Overviews sau AI Modehttps://developers.google.com/search/docs/appearance/ai-features · 2026-09-06
  6. Rezumatul nu e găsibil: nu e menționat în `robots.txt`, nu e legat din nicio pagină, iar varianta extinsă `llms-full.txt` întoarce 404https://www.megapromoting.com/llms-full.txt · 2026-09-06
  7. Pagina e randată pe server, deci un agent care nu execută JavaScript primește textul complethttps://www.megapromoting.com/servicii · 2026-09-06

5 de ellas son código y archivos de nuestros repositorios. No publicamos su nombre ni la línea: juntos, en una sola página, describirían con demasiada precisión cómo están construidos sistemas que no son solo nuestros. Los repasamos contigo, en el repositorio, a petición — la verificación sigue siendo posible, solo que se hace en una conversación.

¿Qué te gustaría que funcionara mejor?

Cuéntanos tu proceso. Juntos decidimos qué merece la pena construir, qué podemos conectar y cómo verificamos el resultado.

Vamos a hablar