home.social

#aicrawlers — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #aicrawlers, aggregated by home.social.

fetched live
  1. 🤖 Infrastructura Kernel.org este bombardată de milioane de cereri zilnice ale bot-ilor de Inteligență Artificială!

    Publicația Linuxiac relatează o problemă majoră de infrastructură cu care se confruntă administratorii Kernel.org (platforma oficială de găzduire și dezvoltare a nucleului Linux, administrată de Konstantin Ryabitsev): un val masiv de AI crawlers și scrapperi automatizați consumă resurse critice ale serverelor.

    ✨ Punctele cheie ale situației generate de bot-ii de IA:

    💥 Consum masiv de resurse procesor (CPU):
    • Serverele git.kernel.org primesc în jur de 6 milioane de cereri zilnice doar pentru paginile individuale ale commit-urilor Git.
    • Din cele 90 de nuclee CPU distribuite pe 5 locații geografice, aproximativ 14-16 nuclee sunt folosite constant doar pentru a genera dinamic pagini HTML pentru bot-ii care adună date pentru antrenarea modelelor de limbaj (LLM).

    📉 Traficul legitim a devenit o minoritate:
    • Tranzacțiile legitime (inclusiv descărcările și comanda git clone efectuate de dezvoltatori umani) reprezintă doar 2% din totalul cererilor, restul de 98% fiind generat de bot-i automatizați.

    ⚙️ Ineficiența scraperilor și fentarea restricțiilor:
    • În loc să cloneze depozitul Git o singură dată și să lucreze local, mulți crawleri interoghează individual fiecare URL de commit.
    • Deși s-au încercat blocări pe bază de IP/ASN și un sistem de verificare Proof-of-Work (Anubis), bot-ii au adaptat rapid atacul trecând prin rețele proxy de IP-uri rezidențiale și de mobil (fentând blocările) și alocând mai multă putere de calcul pentru a trece de verificări.

    🛡️ Măsurile drastice luate în considerare:
    • Echipa de infrastructură ia în calcul reducerea drastică a numărului de URL-uri indexabile/generabile dinamic și restricționarea acțiunilor costisitoare din punct de vedere CPU pentru utilizatorii anonimi, pentru a asigura stabilitatea platformei.

    📌 Concluzie:

    Această situație evidențiază un efect secundar major al cursei pentru antrenarea modelelor de IA: exploatarea excesivă a infrastructurii publice gratuite Open Source, punând o presiune financiară și tehnică uriașă pe proiectele comunitare! 🚀

    #KernelOrg #Linux #AICrawlers #Git #SysAdmin #OpenSource #Linuxiac #TechNews #DevOps

  2. 🤖 Infrastructura Kernel.org este bombardată de milioane de cereri zilnice ale bot-ilor de Inteligență Artificială!

    Publicația Linuxiac relatează o problemă majoră de infrastructură cu care se confruntă administratorii Kernel.org (platforma oficială de găzduire și dezvoltare a nucleului Linux, administrată de Konstantin Ryabitsev): un val masiv de AI crawlers și scrapperi automatizați consumă resurse critice ale serverelor.

    ✨ Punctele cheie ale situației generate de bot-ii de IA:

    💥 Consum masiv de resurse procesor (CPU):
    • Serverele git.kernel.org primesc în jur de 6 milioane de cereri zilnice doar pentru paginile individuale ale commit-urilor Git.
    • Din cele 90 de nuclee CPU distribuite pe 5 locații geografice, aproximativ 14-16 nuclee sunt folosite constant doar pentru a genera dinamic pagini HTML pentru bot-ii care adună date pentru antrenarea modelelor de limbaj (LLM).

    📉 Traficul legitim a devenit o minoritate:
    • Tranzacțiile legitime (inclusiv descărcările și comanda git clone efectuate de dezvoltatori umani) reprezintă doar 2% din totalul cererilor, restul de 98% fiind generat de bot-i automatizați.

    ⚙️ Ineficiența scraperilor și fentarea restricțiilor:
    • În loc să cloneze depozitul Git o singură dată și să lucreze local, mulți crawleri interoghează individual fiecare URL de commit.
    • Deși s-au încercat blocări pe bază de IP/ASN și un sistem de verificare Proof-of-Work (Anubis), bot-ii au adaptat rapid atacul trecând prin rețele proxy de IP-uri rezidențiale și de mobil (fentând blocările) și alocând mai multă putere de calcul pentru a trece de verificări.

    🛡️ Măsurile drastice luate în considerare:
    • Echipa de infrastructură ia în calcul reducerea drastică a numărului de URL-uri indexabile/generabile dinamic și restricționarea acțiunilor costisitoare din punct de vedere CPU pentru utilizatorii anonimi, pentru a asigura stabilitatea platformei.

    📌 Concluzie:

    Această situație evidențiază un efect secundar major al cursei pentru antrenarea modelelor de IA: exploatarea excesivă a infrastructurii publice gratuite Open Source, punând o presiune financiară și tehnică uriașă pe proiectele comunitare! 🚀

    #KernelOrg #Linux #AICrawlers #Git #SysAdmin #OpenSource #Linuxiac #TechNews #DevOps

  3. 🤖 Infrastructura Kernel.org este bombardată de milioane de cereri zilnice ale bot-ilor de Inteligență Artificială!

    Publicația Linuxiac relatează o problemă majoră de infrastructură cu care se confruntă administratorii Kernel.org (platforma oficială de găzduire și dezvoltare a nucleului Linux, administrată de Konstantin Ryabitsev): un val masiv de AI crawlers și scrapperi automatizați consumă resurse critice ale serverelor.

    ✨ Punctele cheie ale situației generate de bot-ii de IA:

    💥 Consum masiv de resurse procesor (CPU):
    • Serverele git.kernel.org primesc în jur de 6 milioane de cereri zilnice doar pentru paginile individuale ale commit-urilor Git.
    • Din cele 90 de nuclee CPU distribuite pe 5 locații geografice, aproximativ 14-16 nuclee sunt folosite constant doar pentru a genera dinamic pagini HTML pentru bot-ii care adună date pentru antrenarea modelelor de limbaj (LLM).

    📉 Traficul legitim a devenit o minoritate:
    • Tranzacțiile legitime (inclusiv descărcările și comanda git clone efectuate de dezvoltatori umani) reprezintă doar 2% din totalul cererilor, restul de 98% fiind generat de bot-i automatizați.

    ⚙️ Ineficiența scraperilor și fentarea restricțiilor:
    • În loc să cloneze depozitul Git o singură dată și să lucreze local, mulți crawleri interoghează individual fiecare URL de commit.
    • Deși s-au încercat blocări pe bază de IP/ASN și un sistem de verificare Proof-of-Work (Anubis), bot-ii au adaptat rapid atacul trecând prin rețele proxy de IP-uri rezidențiale și de mobil (fentând blocările) și alocând mai multă putere de calcul pentru a trece de verificări.

    🛡️ Măsurile drastice luate în considerare:
    • Echipa de infrastructură ia în calcul reducerea drastică a numărului de URL-uri indexabile/generabile dinamic și restricționarea acțiunilor costisitoare din punct de vedere CPU pentru utilizatorii anonimi, pentru a asigura stabilitatea platformei.

    📌 Concluzie:

    Această situație evidențiază un efect secundar major al cursei pentru antrenarea modelelor de IA: exploatarea excesivă a infrastructurii publice gratuite Open Source, punând o presiune financiară și tehnică uriașă pe proiectele comunitare! 🚀

    #KernelOrg #Linux #AICrawlers #Git #SysAdmin #OpenSource #Linuxiac #TechNews #DevOps

  4. 🤖 Infrastructura Kernel.org este bombardată de milioane de cereri zilnice ale bot-ilor de Inteligență Artificială!

    Publicația Linuxiac relatează o problemă majoră de infrastructură cu care se confruntă administratorii Kernel.org (platforma oficială de găzduire și dezvoltare a nucleului Linux, administrată de Konstantin Ryabitsev): un val masiv de AI crawlers și scrapperi automatizați consumă resurse critice ale serverelor.

    ✨ Punctele cheie ale situației generate de bot-ii de IA:

    💥 Consum masiv de resurse procesor (CPU):
    • Serverele git.kernel.org primesc în jur de 6 milioane de cereri zilnice doar pentru paginile individuale ale commit-urilor Git.
    • Din cele 90 de nuclee CPU distribuite pe 5 locații geografice, aproximativ 14-16 nuclee sunt folosite constant doar pentru a genera dinamic pagini HTML pentru bot-ii care adună date pentru antrenarea modelelor de limbaj (LLM).

    📉 Traficul legitim a devenit o minoritate:
    • Tranzacțiile legitime (inclusiv descărcările și comanda git clone efectuate de dezvoltatori umani) reprezintă doar 2% din totalul cererilor, restul de 98% fiind generat de bot-i automatizați.

    ⚙️ Ineficiența scraperilor și fentarea restricțiilor:
    • În loc să cloneze depozitul Git o singură dată și să lucreze local, mulți crawleri interoghează individual fiecare URL de commit.
    • Deși s-au încercat blocări pe bază de IP/ASN și un sistem de verificare Proof-of-Work (Anubis), bot-ii au adaptat rapid atacul trecând prin rețele proxy de IP-uri rezidențiale și de mobil (fentând blocările) și alocând mai multă putere de calcul pentru a trece de verificări.

    🛡️ Măsurile drastice luate în considerare:
    • Echipa de infrastructură ia în calcul reducerea drastică a numărului de URL-uri indexabile/generabile dinamic și restricționarea acțiunilor costisitoare din punct de vedere CPU pentru utilizatorii anonimi, pentru a asigura stabilitatea platformei.

    📌 Concluzie:

    Această situație evidențiază un efect secundar major al cursei pentru antrenarea modelelor de IA: exploatarea excesivă a infrastructurii publice gratuite Open Source, punând o presiune financiară și tehnică uriașă pe proiectele comunitare! 🚀

    #KernelOrg #Linux #AICrawlers #Git #SysAdmin #OpenSource #Linuxiac #TechNews #DevOps

  5. 🤖 Infrastructura Kernel.org este bombardată de milioane de cereri zilnice ale bot-ilor de Inteligență Artificială!

    Publicația Linuxiac relatează o problemă majoră de infrastructură cu care se confruntă administratorii Kernel.org (platforma oficială de găzduire și dezvoltare a nucleului Linux, administrată de Konstantin Ryabitsev): un val masiv de AI crawlers și scrapperi automatizați consumă resurse critice ale serverelor.

    ✨ Punctele cheie ale situației generate de bot-ii de IA:

    💥 Consum masiv de resurse procesor (CPU):
    • Serverele git.kernel.org primesc în jur de 6 milioane de cereri zilnice doar pentru paginile individuale ale commit-urilor Git.
    • Din cele 90 de nuclee CPU distribuite pe 5 locații geografice, aproximativ 14-16 nuclee sunt folosite constant doar pentru a genera dinamic pagini HTML pentru bot-ii care adună date pentru antrenarea modelelor de limbaj (LLM).

    📉 Traficul legitim a devenit o minoritate:
    • Tranzacțiile legitime (inclusiv descărcările și comanda git clone efectuate de dezvoltatori umani) reprezintă doar 2% din totalul cererilor, restul de 98% fiind generat de bot-i automatizați.

    ⚙️ Ineficiența scraperilor și fentarea restricțiilor:
    • În loc să cloneze depozitul Git o singură dată și să lucreze local, mulți crawleri interoghează individual fiecare URL de commit.
    • Deși s-au încercat blocări pe bază de IP/ASN și un sistem de verificare Proof-of-Work (Anubis), bot-ii au adaptat rapid atacul trecând prin rețele proxy de IP-uri rezidențiale și de mobil (fentând blocările) și alocând mai multă putere de calcul pentru a trece de verificări.

    🛡️ Măsurile drastice luate în considerare:
    • Echipa de infrastructură ia în calcul reducerea drastică a numărului de URL-uri indexabile/generabile dinamic și restricționarea acțiunilor costisitoare din punct de vedere CPU pentru utilizatorii anonimi, pentru a asigura stabilitatea platformei.

    📌 Concluzie:

    Această situație evidențiază un efect secundar major al cursei pentru antrenarea modelelor de IA: exploatarea excesivă a infrastructurii publice gratuite Open Source, punând o presiune financiară și tehnică uriașă pe proiectele comunitare! 🚀

    #KernelOrg #Linux #AICrawlers #Git #SysAdmin #OpenSource #Linuxiac #TechNews #DevOps

  6. Git repositories are made to be cloned, not scraped commit page by commit page.

    At scale, HTML crawling wastes CPU on rendered pages, creates higher costs for open source hosts, and can lead to proof-of-work checks or rate limits that affect real users first.

    Clone once. Fetch updates. Use Git as intended.

    x.com/GitGem/status/2094005395

    #Git #OpenSource #Linux #FOSS #AICrawlers #DevOps #GitGem

  7. Git repositories are made to be cloned, not scraped commit page by commit page.

    At scale, HTML crawling wastes CPU on rendered pages, creates higher costs for open source hosts, and can lead to proof-of-work checks or rate limits that affect real users first.

    Clone once. Fetch updates. Use Git as intended.

    x.com/GitGem/status/2094005395

    #Git #OpenSource #Linux #FOSS #AICrawlers #DevOps #GitGem

  8. Git repositories are made to be cloned, not scraped commit page by commit page.

    At scale, HTML crawling wastes CPU on rendered pages, creates higher costs for open source hosts, and can lead to proof-of-work checks or rate limits that affect real users first.

    Clone once. Fetch updates. Use Git as intended.

    x.com/GitGem/status/2094005395

    #Git #OpenSource #Linux #FOSS #AICrawlers #DevOps #GitGem

  9. Git repositories are made to be cloned, not scraped commit page by commit page.

    At scale, HTML crawling wastes CPU on rendered pages, creates higher costs for open source hosts, and can lead to proof-of-work checks or rate limits that affect real users first.

    Clone once. Fetch updates. Use Git as intended.

    x.com/GitGem/status/2094005395

    #Git #OpenSource #Linux #FOSS #AICrawlers #DevOps #GitGem

  10. Git repositories are made to be cloned, not scraped commit page by commit page.

    At scale, HTML crawling wastes CPU on rendered pages, creates higher costs for open source hosts, and can lead to proof-of-work checks or rate limits that affect real users first.

    Clone once. Fetch updates. Use Git as intended.

    x.com/GitGem/status/2094005395

    #Git #OpenSource #Linux #FOSS #AICrawlers #DevOps #GitGem

  11. FYI: Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #RobotsTxt #WebDevelopment #AIEthics

  12. FYI: Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #RobotsTxt #WebDevelopment #AIEthics

  13. FYI: Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #RobotsTxt #WebDevelopment #AIEthics

  14. FYI: Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #RobotsTxt #WebDevelopment #AIEthics

  15. FYI: Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #RobotsTxt #WebDevelopment #AIEthics

  16. ICYMI: Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #RobotsTXT #WebSecurity #SEO

  17. ICYMI: Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #RobotsTXT #WebSecurity #SEO

  18. ICYMI: Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #RobotsTXT #WebSecurity #SEO

  19. Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #WebScraping #DataPrivacy #SEO

  20. Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #WebScraping #DataPrivacy #SEO

  21. Cloudflare blocks opaque AI crawlers from sites that disallow training: Bot Preference Sync rewrites robots.txt from dashboard settings on every plan, free to Enterprise. Ad-funded domains now default to disallowing AI training. ppc.land/cloudflare-blocks-opa #Cloudflare #AICrawlers #WebScraping #DataPrivacy #SEO

  22. 🔍 Wow, who knew small businesses wanted to be 'visible' only to later be snubbed by AI's selective memory? 😲 Apparently, only a minuscule percentage even care to block the AI crawlers, while the rest are blissfully unaware they're not even invited to the AI party! 🎉
    website-auditor.io/ai-visibili #smallbusiness #AIvisibility #selectiveAI #awareness #AIcrawlers #HackerNews #ngated

  23. 🔍 Wow, who knew small businesses wanted to be 'visible' only to later be snubbed by AI's selective memory? 😲 Apparently, only a minuscule percentage even care to block the AI crawlers, while the rest are blissfully unaware they're not even invited to the AI party! 🎉
    website-auditor.io/ai-visibili #smallbusiness #AIvisibility #selectiveAI #awareness #AIcrawlers #HackerNews #ngated

  24. 🔍 Wow, who knew small businesses wanted to be 'visible' only to later be snubbed by AI's selective memory? 😲 Apparently, only a minuscule percentage even care to block the AI crawlers, while the rest are blissfully unaware they're not even invited to the AI party! 🎉
    website-auditor.io/ai-visibili #smallbusiness #AIvisibility #selectiveAI #awareness #AIcrawlers #HackerNews #ngated

  25. 🔍 Wow, who knew small businesses wanted to be 'visible' only to later be snubbed by AI's selective memory? 😲 Apparently, only a minuscule percentage even care to block the AI crawlers, while the rest are blissfully unaware they're not even invited to the AI party! 🎉
    website-auditor.io/ai-visibili #smallbusiness #AIvisibility #selectiveAI #awareness #AIcrawlers #HackerNews #ngated

  26. 🔍 Wow, who knew small businesses wanted to be 'visible' only to later be snubbed by AI's selective memory? 😲 Apparently, only a minuscule percentage even care to block the AI crawlers, while the rest are blissfully unaware they're not even invited to the AI party! 🎉
    website-auditor.io/ai-visibili #smallbusiness #AIvisibility #selectiveAI #awareness #AIcrawlers #HackerNews #ngated

  27. FYI: IAB Australia forces every crawler into one of four verdicts: Just 2.6% of AI crawler traffic serves live queries versus 52% for training, IAB Australia finds, ahead of Cloudflare's default block starting in September. ppc.land/iab-australia-forces- #IAB #Australia #AICrawlers #WebTraffic #DigitalMarketing

  28. FYI: IAB Australia forces every crawler into one of four verdicts: Just 2.6% of AI crawler traffic serves live queries versus 52% for training, IAB Australia finds, ahead of Cloudflare's default block starting in September. ppc.land/iab-australia-forces- #IAB #Australia #AICrawlers #WebTraffic #DigitalMarketing

  29. FYI: IAB Australia forces every crawler into one of four verdicts: Just 2.6% of AI crawler traffic serves live queries versus 52% for training, IAB Australia finds, ahead of Cloudflare's default block starting in September. ppc.land/iab-australia-forces- #IAB #Australia #AICrawlers #WebTraffic #DigitalMarketing

  30. FYI: IAB Australia forces every crawler into one of four verdicts: Just 2.6% of AI crawler traffic serves live queries versus 52% for training, IAB Australia finds, ahead of Cloudflare's default block starting in September. ppc.land/iab-australia-forces- #IAB #Australia #AICrawlers #WebTraffic #DigitalMarketing

  31. IAB Australia forces every crawler into one of four verdicts: Just 2.6% of AI crawler traffic serves live queries versus 52% for training, IAB Australia finds, ahead of Cloudflare's default block starting in September. ppc.land/iab-australia-forces- #IABAustralia #AICrawlers #DigitalMarketing #Cloudflare #AdTech

  32. IAB Australia forces every crawler into one of four verdicts: Just 2.6% of AI crawler traffic serves live queries versus 52% for training, IAB Australia finds, ahead of Cloudflare's default block starting in September. ppc.land/iab-australia-forces- #IABAustralia #AICrawlers #DigitalMarketing #Cloudflare #AdTech

  33. IAB Australia forces every crawler into one of four verdicts: Just 2.6% of AI crawler traffic serves live queries versus 52% for training, IAB Australia finds, ahead of Cloudflare's default block starting in September. ppc.land/iab-australia-forces- #IABAustralia #AICrawlers #DigitalMarketing #Cloudflare #AdTech

  34. IAB Australia forces every crawler into one of four verdicts: Just 2.6% of AI crawler traffic serves live queries versus 52% for training, IAB Australia finds, ahead of Cloudflare's default block starting in September. ppc.land/iab-australia-forces- #IABAustralia #AICrawlers #DigitalMarketing #Cloudflare #AdTech

  35. IAB Australia forces every crawler into one of four verdicts: Just 2.6% of AI crawler traffic serves live queries versus 52% for training, IAB Australia finds, ahead of Cloudflare's default block starting in September. ppc.land/iab-australia-forces- #IABAustralia #AICrawlers #DigitalMarketing #Cloudflare #AdTech

  36. All About Berlin loses 75% of traffic as zero-click searches hit 68%: Affiliate income stayed down 30% despite renegotiated commissions, and Time now routes AI crawlers to a stripped-down copy of its site. Who survives the shift? ppc.land/all-about-berlin-lose #Berlin #TrafficLoss #ZeroClickSearches #AffiliateMarketing #AICrawlers

  37. All About Berlin loses 75% of traffic as zero-click searches hit 68%: Affiliate income stayed down 30% despite renegotiated commissions, and Time now routes AI crawlers to a stripped-down copy of its site. Who survives the shift? ppc.land/all-about-berlin-lose #Berlin #TrafficLoss #ZeroClickSearches #AffiliateMarketing #AICrawlers

  38. All About Berlin loses 75% of traffic as zero-click searches hit 68%: Affiliate income stayed down 30% despite renegotiated commissions, and Time now routes AI crawlers to a stripped-down copy of its site. Who survives the shift? ppc.land/all-about-berlin-lose #Berlin #TrafficLoss #ZeroClickSearches #AffiliateMarketing #AICrawlers

  39. Welp, now they came for my personal site.

    I already reluctantly added Cloudflare to botwiki.org. But I *really* don't want to have to do that to my site.

    This kind of blows. Thanks AI bros.

    #indieweb #PersonalWebsite #devops #bots #spam #AICrawlers #enshittification

  40. Welp, now they came for my personal site.

    I already reluctantly added Cloudflare to botwiki.org. But I *really* don't want to have to do that to my site.

    This kind of blows. Thanks AI bros.

    #indieweb #PersonalWebsite #devops #bots #spam #AICrawlers #enshittification

  41. Welp, now they came for my personal site.

    I already reluctantly added Cloudflare to botwiki.org. But I *really* don't want to have to do that to my site.

    This kind of blows. Thanks AI bros.

    #indieweb #PersonalWebsite #devops #bots #spam #AICrawlers #enshittification

  42. Welp, now they came for my personal site.

    I already reluctantly added Cloudflare to botwiki.org. But I *really* don't want to have to do that to my site.

    This kind of blows. Thanks AI bros.

    #indieweb #PersonalWebsite #devops #bots #spam #AICrawlers #enshittification

  43. Welp, now they came for my personal site.

    I already reluctantly added Cloudflare to botwiki.org. But I *really* don't want to have to do that to my site.

    This kind of blows. Thanks AI bros.

    #indieweb #PersonalWebsite #devops #bots #spam #AICrawlers #enshittification

  44. FYI: AI crawlers hit sites 50,000 times per human visit, Cloudflare data shows: AI crawlers reach up to 50,000 visits per referred reader, Cloudflare data shows, as a Munich court strips Google of its liability shield over AI Overviews. ppc.land/ai-crawlers-hit-sites #AICrawlers #Cloudflare #DigitalMarketing #WebTraffic #SEO

  45. FYI: AI crawlers hit sites 50,000 times per human visit, Cloudflare data shows: AI crawlers reach up to 50,000 visits per referred reader, Cloudflare data shows, as a Munich court strips Google of its liability shield over AI Overviews. ppc.land/ai-crawlers-hit-sites #AICrawlers #Cloudflare #DigitalMarketing #WebTraffic #SEO

  46. FYI: AI crawlers hit sites 50,000 times per human visit, Cloudflare data shows: AI crawlers reach up to 50,000 visits per referred reader, Cloudflare data shows, as a Munich court strips Google of its liability shield over AI Overviews. ppc.land/ai-crawlers-hit-sites #AICrawlers #Cloudflare #DigitalMarketing #WebTraffic #SEO

  47. FYI: AI crawlers hit sites 50,000 times per human visit, Cloudflare data shows: AI crawlers reach up to 50,000 visits per referred reader, Cloudflare data shows, as a Munich court strips Google of its liability shield over AI Overviews. ppc.land/ai-crawlers-hit-sites #AICrawlers #Cloudflare #DigitalMarketing #WebTraffic #SEO

  48. FYI: Cloudflare exposes AI crawlers hitting sites 50000 times per visitor: Bot Management customers can now filter traffic by Training, Search or Agent use case and compare operators side by side. Will the data shift licensing talks? ppc.land/cloudflare-exposes-ai #Cloudflare #AICrawlers #BotManagement #WebTraffic #DataAnalytics

  49. FYI: Cloudflare exposes AI crawlers hitting sites 50000 times per visitor: Bot Management customers can now filter traffic by Training, Search or Agent use case and compare operators side by side. Will the data shift licensing talks? ppc.land/cloudflare-exposes-ai #Cloudflare #AICrawlers #BotManagement #WebTraffic #DataAnalytics

  50. FYI: Cloudflare exposes AI crawlers hitting sites 50000 times per visitor: Bot Management customers can now filter traffic by Training, Search or Agent use case and compare operators side by side. Will the data shift licensing talks? ppc.land/cloudflare-exposes-ai #Cloudflare #AICrawlers #BotManagement #WebTraffic #DataAnalytics

  51. FYI: Cloudflare exposes AI crawlers hitting sites 50000 times per visitor: Bot Management customers can now filter traffic by Training, Search or Agent use case and compare operators side by side. Will the data shift licensing talks? ppc.land/cloudflare-exposes-ai #Cloudflare #AICrawlers #BotManagement #WebTraffic #DataAnalytics