Pocos nodos brillantes concentrando líneas convergentes sobre fondo oscuro
TÉCNICO/12 AGO 2026/9 MIN DE LECTURA
Pocos nodos brillantes concentrando líneas convergentes sobre fondo oscuro
La citación generativa no se reparte: se concentra.

Las fuentes que la IA cita de verdad: un puñado de dominios

La IA no cita todo internet. Cuando ChatGPT, Gemini o Perplexity responden, concentran sus citas en un puñado de dominios de terceros: Reddit reúne cerca del 40% de la frecuencia agregada de citas y los veinte sitios más citados acumulan alrededor del 68% del total. Para una marca, eso cambia la pregunta. No basta con tener un buen sitio: hay que estar presente en las pocas fuentes que la IA lee antes de responder por ti.

Matías Ramírez
Matías Ramírez
Tecnología

La IA no cita todo internet. Cuando ChatGPT, Gemini o Perplexity responden, concentran sus citas en un puñado de dominios de terceros: Reddit reúne cerca del 40% de la frecuencia agregada de citas y los veinte sitios más citados acumulan alrededor del 68% del total. Para una marca, eso cambia la pregunta. No basta con tener un buen sitio: hay que estar presente en las pocas fuentes que la IA lee antes de responder por ti.

La imagen intuitiva de un motor generativo que rastrea toda la web para responder es falsa. En la práctica, cada respuesta se apoya en un conjunto sorprendentemente corto de fuentes recurrentes, y ese conjunto es medible. Saber cuáles son cambia dónde vale la pena invertir para que una marca aparezca en la respuesta.

¿A quién cita la IA cuando responde?

El Índice de Fuentes de Citación de Plataformas de IA 2026 —una síntesis de seis estudios independientes de rastreo, con más de 680 millones de citas registradas entre agosto de 2024 y abril de 2026— pone números a la intuición. Reddit es el dominio más citado, con cerca del 40% de la frecuencia agregada de citas multi-motor. Wikipedia queda en segundo lugar y YouTube en tercero, con alrededor del 19% de la cuota de fuentes tope en Google AI Overviews. La cola larga existe, pero pesa poco.

El dato que reordena la estrategia es la concentración. Según ese mismo índice, los veinte dominios principales acumulan cerca del 68% de todas las citas de ChatGPT, Claude, Gemini, Perplexity y Google AI Overviews sumados. No es una web abierta donde cualquier página compite en igualdad de condiciones: es un club corto donde la mayoría de las respuestas se cocina con los mismos ingredientes.

¿Por qué la lista es tan corta?

Porque los motores generativos optimizan por confianza, no por cobertura. Prefieren fuentes con estructura predecible, autoridad percibida y densidad de discusión humana. El resultado, reportado por Search Engine Land en su cobertura del estudio y por Contently en su análisis "Top 10 Sources LLMs Cite Most" del 29 de abril de 2026, es una concentración más extrema que la que en su día produjo el PageRank de Google. Y a diferencia del ranking clásico, su volatilidad se mide en semanas, no en meses: el conjunto de fuentes preferidas se mueve más rápido de lo que la mayoría de las marcas puede reaccionar.

Para una marca, esa combinación —lista corta y movimiento rápido— es a la vez amenaza y oportunidad. Amenaza, porque si no estás en el club no apareces en la respuesta por más impecable que sea tu sitio. Oportunidad, porque el conjunto es lo bastante chico como para mapearlo y trabajarlo con foco, en lugar de dispersar esfuerzo en toda la web.

¿Cita lo mismo cada motor?

No, y la diferencia entre motores es grande. Reddit es el dominio social más citado en ChatGPT y Perplexity, donde representa entre el 54% y el 63% de sus citas de redes sociales. En Gemini, en cambio, Reddit cae a cerca del 5%: Google favorece sus propias superficies y las de mayor consenso, YouTube y Wikipedia. En Google AI Overviews el reparto es explícito —YouTube ronda el 23% de las citas, Wikipedia el 18% y Google.com el 16%—, un perfil muy distinto al de ChatGPT.

La lectura operativa es que no existe una sola estrategia de fuentes: existe una por motor. Una marca cuya audiencia pregunta en ChatGPT necesita presencia en las conversaciones de Reddit relevantes a su categoría; una que se juega su visibilidad en Google AI Overviews necesita un canal de YouTube y una entidad limpia en Wikipedia. Tratar a todos los motores como uno solo desperdicia la mitad del esfuerzo.

Reddit sobre la frecuencia agregada de citas
~40%multi-motor
Cuota de los ~20 dominios más citados
~68%Índice 2026
Búsquedas con clic bajo un AI Overview
8%vs 15% sin resumen

¿Y qué pasa con el clic?

Aparecer citado importa más que nunca porque el clic al sitio se está evaporando. Pew Research Center analizó unas 69.000 búsquedas de 900 adultos de Estados Unidos en marzo de 2025 y publicó los resultados el 22 de julio de 2025. El hallazgo central: cuando había un AI Overview presente, solo el 8% de las búsquedas terminó en un clic a un resultado, frente al 15% sin resumen. Y apenas el 1% de los usuarios clickeó un enlace dentro del propio AI Overview.

El mismo estudio midió el abandono: el 26% de los usuarios cerró la navegación tras ver una página con resumen de IA, contra el 16% cuando no había resumen. En otras palabras, el resumen resuelve la consulta sin enviar tráfico a nadie. Si el motor responde con o sin ti, la única jugada que queda es ser la fuente que cita dentro de esa respuesta.

YouTube en Google AI Overviews
~23%de las citas
Wikipedia en Google AI Overviews
~18%de las citas
Reddit en Gemini
~5%vs 54–63% en ChatGPT
La visibilidad de una marca en la IA ya no depende solo de su sitio. Depende de estar presente en el club corto de dominios de terceros que el motor lee antes de responder — y ese club cambia según el motor que preguntes.

¿Qué cambia para una marca de LatAm?

El pozo de fuentes que la IA cita es abrumadoramente anglosajón. El español es apenas el 6,0% del contenido web frente al 49,7% del inglés, según W3Techs a junio de 2026, y la Wikipedia en español tiene cerca de 3,4 veces menos artículos que la inglesa. Reddit y Wikipedia —dos de las tres fuentes más citadas— aportan la mayor parte de su valor en inglés, así que una marca latinoamericana compite en una capa de fuentes en español mucho más delgada, con menos hilos de discusión y menos entradas enciclopédicas que respalden su presencia.

Ese corpus más delgado tiene dos caras. La incómoda: hay menos fuentes independientes en español describiendo tu categoría, así que un vacío o un error tarda más en corregirse por consenso. La útil: hay una palanca clara. YouTube tiene una penetración altísima en Latinoamérica y es la tercera fuente más citada, con cerca del 23% de las citas en Google AI Overviews. Para una marca de la región, un canal con contenido de categoría bien estructurado es probablemente el punto de entrada más accesible al conjunto de fuentes que la IA realmente lee.

¿Qué hacer esta semana?

La consecuencia accionable de todo esto es dejar de pensar solo en tu dominio y empezar a trabajar la capa de fuentes que el motor consulta. Cinco pasos concretos, en orden:

  1. Audita qué fuentes citan las respuestas de tu categoría. Haz las diez preguntas que un cliente le haría a la IA y anota, respuesta por respuesta, qué dominios aparecen citados. Ese es tu mapa real, no el que asumes.
  2. Gana presencia en el conjunto concentrado relevante. Como veinte dominios acumulan cerca del 68% de las citas, tu esfuerzo rinde más ahí que en superficies que la IA rara vez lee. Empieza por los dos o tres que aparecen en tu auditoría.
  3. Prioriza por motor. Si tu audiencia pregunta en ChatGPT o Perplexity, trabaja las conversaciones de Reddit de tu categoría; si te juegas en Google AI Overviews, prioriza YouTube y una entidad limpia en Wikipedia.
  4. Construye profundidad de fuentes en español. Compensa la capa delgada del idioma: contenido propio citable, participación genuina en comunidades hispanohablantes y una ficha enciclopédica correcta pesan más cuando hay menos fuentes independientes.
  5. Mide cuota de citación, no solo menciones. La mención dice que apareciste; la cuota de citación dice con qué frecuencia la IA te usa como fuente frente a tu categoría. Es la métrica que refleja presencia real en la respuesta.

Ninguno de estos pasos reemplaza a un buen sitio: lo complementan. Tu dominio sigue siendo la fuente que controlas por completo y la que fija tu identidad. Pero en un ecosistema donde el 68% de las citas se reparte entre veinte lugares, ignorar esos veinte lugares es ceder la respuesta a quien sí está en ellos.

Fuentes
  1. 01
    Índice de Fuentes de Citación de Plataformas de IA 2026 · síntesis de 6 estudios de rastreo, +680M de citas: Reddit ~40% de la frecuencia agregada, ~20 dominios = ~68% del total · ago 2024–abr 2026
  2. 02
    Search Engine Land · cobertura del estudio: concentración de fuentes más extrema que el PageRank y volatilidad en semanas · 2026
  3. 03
    Contently · "Top 10 Sources LLMs Cite Most": variación por motor y ranking de dominios citados · 29.04.2026
  4. 04
    Pew Research Center · ~69.000 búsquedas de 900 adultos de EE.UU.: 8% de clic con AI Overview vs 15% sin, 1% de clic dentro del resumen, 26% de abandono vs 16% · publicado 22.07.2025
  5. 05
    W3Techs · idiomas del contenido web: inglés 49,7%, español 6,0% · 06.2026
  6. 06
    Wikimedia · conteo de artículos por edición: la Wikipedia en español tiene ~3,4× menos artículos que la inglesa · 2026
¿Sabes qué fuentes cita la IA cuando responde por tu categoría? Escríbenos a hola@bisonagents.com con tu sitio y te devolvemos el mapa de fuentes y tu cuota de citación por motor.

Preguntas frecuentes

¿La IA cita todo internet o solo algunas fuentes?

Solo algunas. El Índice de Fuentes de Citación de Plataformas de IA 2026, que sintetizó seis estudios independientes con más de 680 millones de citas entre agosto de 2024 y abril de 2026, encontró que los veinte dominios más citados concentran cerca del 68% de todas las citas de ChatGPT, Claude, Gemini, Perplexity y Google AI Overviews. Reddit por sí solo reúne alrededor del 40% de la frecuencia agregada de citas. La citación generativa está más concentrada que la que produjo el PageRank de Google, y su volatilidad se mide en semanas.

¿Cada motor cita las mismas fuentes?

No. Según el Índice de Fuentes de Citación 2026, Reddit es el dominio social más citado en ChatGPT y Perplexity, con entre el 54% y el 63% de sus citas de redes sociales, pero en Gemini apenas ronda el 5% porque Google favorece YouTube y Wikipedia. En Google AI Overviews, YouTube concentra cerca del 23% de las citas, Wikipedia el 18% y Google.com el 16%. La consecuencia práctica es que la estrategia de presencia depende del motor donde tu categoría se resuelve.

¿Cuánto tráfico llega al sitio cuando hay un resumen de IA?

Menos. Pew Research Center analizó unas 69.000 búsquedas de 900 adultos de Estados Unidos en marzo de 2025 y publicó los resultados el 22 de julio de 2025: cuando había un AI Overview presente, solo el 8% de las búsquedas terminó en un clic a un resultado, frente al 15% sin resumen. Apenas el 1% clickeó un enlace dentro del propio AI Overview. Ser la fuente citada dentro del resumen importa más que rankear debajo de él.

¿Qué cambia para una marca de LatAm?

El pozo de fuentes que la IA cita es abrumadoramente anglosajón: Reddit y Wikipedia en inglés. El español es apenas el 6,0% del contenido web frente al 49,7% del inglés, según W3Techs a junio de 2026, y la Wikipedia en español tiene cerca de 3,4 veces menos artículos que la inglesa. Una marca latinoamericana compite en una capa de fuentes en español mucho más delgada. YouTube, en cambio, tiene una penetración altísima en la región, así que es la palanca de presencia más accesible.

¿Cómo se mide la presencia en estas fuentes?

Con cuota de citación, no solo con menciones. La mención cuenta que apareciste; la cuota de citación mide con qué frecuencia una respuesta generativa usa una fuente donde figuras, respecto de las que usa en tu categoría. Como los veinte dominios principales concentran cerca del 68% de las citas, conviene auditar primero qué fuentes citan las respuestas de tu categoría y priorizar tu presencia en ese conjunto concentrado, por motor, antes de invertir en superficies que la IA rara vez lee.