Saltar al contenido

seo · 4 min de lectura

El llms.txt no funciona: què fa que la IA et citi de veritat

Ahrefs va analitzar 137.000 dominis: el 97% dels llms.txt no reben ni una sola visita. Què funciona de veritat perquè la IA citi la teva empresa.

Publicat el · Evicron

Publicar un fitxer llms.txt es va convertir el 2025 en el ritual de moda per “preparar-se per a la IA”: una llista en Markdown a l’arrel del domini, pensada perquè ChatGPT, Claude o Perplexity la llegeixin abans que la resta de la web. Ahrefs acaba d’analitzar 137.000 dominis per comprovar si realment s’utilitza, i la resposta és contundent: el 97% dels fitxers llms.txt no van rebre ni una sola petició en tot el mes analitzat. Cap bot, cap humà, res. A Evicron, estudi d’IA i software a mida de Barcelona, això no ens sorprèn del tot — però sí que canvia què recomanem prioritzar a qui vol aparèixer en les respostes d’un assistent d’IA.

Què és el llms.txt i per què es va popularitzar

La idea, proposada a finals de 2024, era senzilla: igual que robots.txt dona instruccions als cercadors, un llms.txt donaria als models de llenguatge un resum curat del lloc — què és l’empresa, quines pàgines importen, què evitar — per estalviar-los haver d’interpretar tot l’HTML. Desenes de milers de webs el van adoptar sense que cap laboratori d’IA ho demanés formalment ni confirmés que l’utilitza per entrenar o per respondre en temps real. Aquest és precisament el punt que l’estudi d’Ahrefs posa a prova amb dades reals de trànsit, no amb promeses de màrqueting.

La dada: 137.000 dominis, gairebé ningú el llegeix

Del conjunt analitzat, uns 38.000 dominis tenien un llms.txt vàlid. D’aquests, el 97% no va registrar cap petició al maig de 2026. Del 3% restant que sí que va tenir trànsit, el repartiment és revelador: el 96% d’aquestes peticions va venir de bots que no són d’IA generativa. Els bots de recuperació lligats a ChatGPT i Perplexity —els que en teoria l’haurien de fer servir— van representar tot just l’1% de les peticions. La resta es va repartir entre eines d’auditoria SEO (21%), bots sense identificar (14%), rastrejadors clàssics com Googlebot (13%) i eines de perfilat tecnològic tipus BuiltWith (11%). Sumant les quatre categories de bots d’IA plegades, arriben al 19% del trànsit total al fitxer — i qui més el llegeix no són els assistents conversacionals, sinó agents de codificació (10,5%) i crawlers d’entrenament (5,3%). Un altre 12% del trànsit venia del mateix sector GEO/AEO: eines de validació i consultors comprovant si funciona, com fem ara nosaltres en escriure això.

Per què gairebé ningú el demana, encara que gairebé tothom el publica

La raó és senzilla i la confirmen els mateixos laboratoris: ChatGPT, Claude i Perplexity no anuncien que consultin el llms.txt com a font prioritària per respondre en temps real, i no hi ha evidència pública que s’utilitzi en l’entrenament dels models grans. Publicar-lo no fa mal, però tractar-lo com la peça central d’una estratègia de visibilitat en IA és apostar l’esforç al canal equivocat. Ja ho explicàvem a la nostra guia de GEO: els motors generatius no funcionen com un cercador clàssic al qual n’hi ha prou amb “avisar” — naveguen, comparen fonts i redacten, i ho fan sobre el contingut real de la web, no sobre un resum a part que gairebé mai arriben a obrir.

Què sí que mou l’agulla, segons les pròpies dades

No bloquegis els rastrejadors que sí que importen

Abans d’optimitzar res, comprova que no estàs bloquejant sense voler GPTBot i OAI-SearchBot (OpenAI), ClaudeBot (Anthropic), PerplexityBot o Google-Extended (Gemini i AI Overviews) al teu robots.txt. És la comprovació més barata i la que més visibilitat costa perdre quan falla: si el rastrejador no pot entrar, cap altre esforç de contingut serveix de res.

Contingut autocontingut i verificable

Un motor generatiu prioritza pàgines que pot citar sense ambigüitat: afirmacions concretes, dades amb font, estructura clara en H2/H3, sense dependre que el lector hagi vist una pàgina anterior. És el mateix criteri que detallàvem en explicar com comprovar si ChatGPT i Google ja et citen: la IA generativa no fa rànquing per enllaços, selecciona per com és de fàcil extreure una resposta fiable de la teva pàgina.

Autoritat real, no un fitxer de promeses

Que altres pàgines de referència del teu sector et mencionin o t’enllacin pesa més que qualsevol fitxer autodeclarat — un llms.txt és, al capdavall, la mateixa empresa dient d’ella mateixa què és important, i cap motor li dona el mateix pes que a una font externa independent.

Com ho treballem a Evicron

En els nostres projectes de posicionament web i SEO per a IA no descartem el llms.txt —el generem igualment, com en aquesta mateixa web—, però la prioritat real és l’accessibilitat tècnica per als rastrejadors d’IA, l’estructura del contingut i el senyal d’autoritat externa, que és on la mateixa dada mostra que es juga la visibilitat. Auditar això porta menys d’una setmana i evita mesos invertint esforç en el canal que menys trànsit mou.

Si vols saber si la teva empresa apareix en les respostes de ChatGPT, Gemini o Claude —i què cal corregir si no és així—, escriu-nos: comencem amb una auditoria de visibilitat real, no amb una llista de fitxers per publicar.

Parlem?

Explica'ns el teu projecte, problema o oportunitat. Et responem en menys de 24 hores amb un pla d'acció concret i pressupost orientatiu.