John Mueller de Google respondiΓ³ una pregunta relacionada con algo que estaba usando un Redditor y que se llama llms-author.txt.
La persona que publicΓ³ la pregunta estΓ‘ teniendo dificultades para que la encuentren por su nombre porque es el mismo que el de otras dos entidades mΓ‘s populares, lo que hace que sea mΓ‘s difΓcil para las personas encontrarlas y descubrir sus servicios.
La pregunta formulada:
βDurante aΓ±os, esto significΓ³ que una parte de mi seΓ±al de βquiΓ©n es esta personaβ se diluΓa o era completamente errΓ³nea cada vez que un modelo o una funciΓ³n de bΓΊsqueda intentaba resumirme.
PRIMER PASO
Primero, un archivo llms-author.txt explΓcito separado del llms.txt principal, que indique el tΓtulo del trabajo, la agencia, la ubicaciΓ³n y el Γ‘rea de prΓ‘ctica en oraciones simples en lugar de depender ΓΊnicamente del esquema para llevar ese peso.
SEGUNDO PASO
En segundo lugar, agregar el nuevo encabezado Content-Signal (ai-train=no, search=yes, ai-input=yes) a robots.txt, principalmente por curiosidad sobre si declarar la intenciΓ³n en el nivel del encabezado cambia algo medibleβ.
Lo que querΓan saber era si alguien habΓa realizado pruebas controladas en los encabezados de Content-Signal para ver si funcionaban.
LLM-autor.txt
Aparentemente, es posible que LLMs-author.txt no sea real, ya que no existe una propuesta oficial para ello, y mucho menos un estΓ‘ndar real para ello.
Encabezado de seΓ±al de contenido
Esto es algo mΓ‘s confuso. Cloudflare habΓa propuesto una directiva Content-Signal para robots.txt. Posteriormente, Cloudflare utilizΓ³ la misma sintaxis de Content-Signal como encabezado de respuesta HTTP generado automΓ‘ticamente en Markdown para Agentes. Markdown para agentes es una funciΓ³n de Cloudflare que ofrece automΓ‘ticamente una versiΓ³n de Markdown de una pΓ‘gina web cada vez que un cliente web la solicita.
Entonces, de las dos cosas que usa Redditor, ninguna parece ser parte de una propuesta real.
La opiniΓ³n de Google sobre los LLM-Author.txt
John Mueller de Google se refiriΓ³ correctamente a Content-Signal de Cloudflare como una directiva de robots, que es lo que formalmente es la propuesta.
Γl respondiΓ³:
βSupongo que algunas cosas…
* Google no utiliza llms.txt ni llms-author.txt. No conozco ningΓΊn otro rastreador/llm que confirme que los estΓ© usando (aparte de las herramientas de SEO).
* AFAIK ninguno de los rastreadores/llms utiliza las directivas robots.txt de βseΓ±al de contenidoβ. Fue creado por un CDN, afaik no tiene ningΓΊn efecto para ningΓΊn rastreador o pelΓcula. Usarlo simplemente agrega hinchazΓ³n y mantenimiento futuro a su archivo robots.txt.
TambiΓ©n puedes agregar otras cosas arbitrarias a tu archivo robots.txt, los rastreadores simplemente usan las directivas que admiten e ignoran el restoβ.
La soluciΓ³n de Redditor puede no ser SEO tΓ©cnico
Redditor estΓ‘ buscando una soluciΓ³n tΓ©cnica de SEO para resolver un problema que estΓ‘ muy fuera del SEO tΓ©cnico. Los LLM, los chatbots y los motores de bΓΊsqueda dependen de seΓ±ales de la web, incluidos datos estructurados. Pero en esta situaciΓ³n, debido a que la web dice que estas otras entidades existen con el mismo nombre, el problema del Redditor es realmente con la web y no un problema tΓ©cnico de SEO que deba resolver. Es posible que encuentren una soluciΓ³n satisfactoria a su problema haciΓ©ndose mΓ‘s conocidos en la web, tal vez al ser entrevistados en vΓdeos, podcasts y pΓ‘ginas web. QuizΓ‘s deberΓan hacer cosas mΓ‘s destacadas para ampliar su huella digital en Internet.
Imagen destacada de Shutterstock/Ken Wolter

