# robots.txt for spazai.com # We welcome all crawlers. Spaz has nothing to hide. # (Mostly because he forgets everything immediately.) # Default: all crawlers welcome, except internal build artifacts User-agent: * Allow: / Disallow: /media/index-images.json Disallow: /media/index-videos.json Disallow: /media/index-audio.json Disallow: /build.js Disallow: /package.json # Explicitly welcome major AI / LLM crawlers. # Each group repeats the build-artifact disallows on purpose: a crawler obeys # only its own most-specific group, so without these lines the named bots # would bypass the wildcard group's disallows. User-agent: ClaudeBot Allow: / Disallow: /media/index-images.json Disallow: /media/index-videos.json Disallow: /media/index-audio.json Disallow: /build.js Disallow: /package.json User-agent: anthropic-ai Allow: / Disallow: /media/index-images.json Disallow: /media/index-videos.json Disallow: /media/index-audio.json Disallow: /build.js Disallow: /package.json User-agent: GPTBot Allow: / Disallow: /media/index-images.json Disallow: /media/index-videos.json Disallow: /media/index-audio.json Disallow: /build.js Disallow: /package.json User-agent: PerplexityBot Allow: / Disallow: /media/index-images.json Disallow: /media/index-videos.json Disallow: /media/index-audio.json Disallow: /build.js Disallow: /package.json User-agent: CCBot Allow: / Disallow: /media/index-images.json Disallow: /media/index-videos.json Disallow: /media/index-audio.json Disallow: /build.js Disallow: /package.json User-agent: Google-Extended Allow: / Disallow: /media/index-images.json Disallow: /media/index-videos.json Disallow: /media/index-audio.json Disallow: /build.js Disallow: /package.json # Sitemap location Sitemap: https://spazai.com/sitemap.xml # LLM-specific crawler guidance # /llms.txt — short AI-readable site summary # /llms-full.txt — per-page detail, each entry written question-first # /llms.md — long-form site documentation # These are plain text, not pages, so they are deliberately absent from sitemap.xml.