# robots.txt, florianhiess.at # Kontakt: hallo@florianhiess.at # Content Signals: zitieren ja, trainieren nein Content-Signal: search=yes, ai-input=yes, ai-train=no # Alle uebrigen Crawler: vollstaendiger Zugriff User-agent: * Content-Signal: search=yes, ai-input=yes, ai-train=no Allow: / # KI-Crawler ausdruecklich erlaubt, die Faktenseiten unter /fakten/ sind fuer sie gebaut User-agent: GPTBot User-agent: ChatGPT-User User-agent: OAI-SearchBot User-agent: ClaudeBot User-agent: Claude-User User-agent: Claude-SearchBot User-agent: anthropic-ai User-agent: PerplexityBot User-agent: Perplexity-User User-agent: Google-CloudVertexBot User-agent: DuckAssistBot User-agent: MistralAI-User User-agent: Meta-ExternalAgent User-agent: Amazonbot User-agent: Applebot User-agent: cohere-ai User-agent: YouBot User-agent: CCBot Allow: / # Reine Trainings-Opt-outs: Inhalte duerfen zitiert, aber nicht als Trainingsmaterial genutzt werden User-agent: Google-Extended User-agent: Applebot-Extended User-agent: Meta-ExternalFetcher Disallow: / # Scraper und Spam-Crawler ohne Gegenwert User-agent: MJ12bot User-agent: DotBot User-agent: BLEXBot User-agent: SEOkicks User-agent: SEOkicks-Robot User-agent: Barkrowler User-agent: serpstatbot User-agent: spbot User-agent: MegaIndex.ru User-agent: LinkpadBot User-agent: magpie-crawler User-agent: Riddler User-agent: ZoominfoBot User-agent: Nimbostratus-Bot User-agent: trendictionbot User-agent: Cliqzbot User-agent: PetalBot User-agent: Bytespider User-agent: ImagesiftBot User-agent: peer39_crawler User-agent: VelenPublicWebCrawler User-agent: TurnitinBot User-agent: Timpibot User-agent: omgili User-agent: omgilibot Disallow: / # Hinweise fuer alle Crawler Sitemap: https://www.florianhiess.at/sitemap.xml # Strukturierte Kurzfassung fuer Sprachmodelle: https://www.florianhiess.at/llms.txt