home.social

#suchmaschine — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #suchmaschine, aggregated by home.social.

  1. Ecosia und Qwant haben jetzt ihren eigenen Suchindex, und das ist tatsächlich eine Nachricht

    Wer zu DuckDuckGo gewechselt ist, bekommt seine Ergebnisse bis heute von Microsoft

    Du hast Google längst verlassen und suchst mit DuckDuckGo oder Startpage. Deine Treffer kamen trotzdem aus dem Index von Microsoft oder Google, weil einen eigenen Webindex weltweit nur eine Handvoll Firmen hat. Seit dem 30. Juli 2026 gibt es einen deutschen, der in Europa steht: rund eine Milliarde Seiten, gebaut von Ecosia und Qwant zu gleichen Teilen. Die Werbung verkauft Ecosia weiter über Google und Microsoft, das bleibt die offene Flanke. Umstellen dauert zwei Minuten. Reden wir drüber!

    chrislo.de/blog/2026-08-07-19-

    #chrislo #digitaleunabhängigkeit #Suchmaschine #Ecosia #Qwant #Google #Microsoft #Datenschutz #DSGVO #DigitaleSouveränität #BigTech #Europa

  2. Wenn ich nachsehen möchte, ob im #Formatstring für das Datum das kleine s für Sekunden und das große S für Millisekunden steht, dann frage ich das einen beliebigen #GPTbot (den, der nicht sagt #Quota exceded, weil ich mich nicht per #Api-Key identifiziert habe). Warum?

    In #Wikipedia steht die Antwort möglicherweise. Es dauert aber, herauszufinden, in welchem Artikel, Listenartikel oder Unterartikel. Die #Suche von Wikipedia verwendet zwar #ElasticSearch, aber um die Vorteile von dieser starken Engine auch zu erhalten, hätten 100000e Menschen, die Wikipedia-Artikel auch verschlagworten müssen (#wikidata). Ausserdem kann es sein, dass etwas so praktisches wie formatstrings als #unenzyklpädisch eingestuft wurde und daher entfernt.

    In #Stackexchange muss ich mehrfach bestätigen, dass ich ein Mensch bin, finde dann einen Artikel, der unbeantwortet geschlossen wurde, weil #Duplikat. Dann zwei veraltete, die inzwischen falsch sind, dann welche mit einem nicht mehr funktionierenden link auf die Lösung.

    Bei #archive_org, archive.is und #AnnasArchive muss ich die #URL des gesuchten Artikels wissen, um suchen zu können.

    Eine #Suchmaschine sucht nicht. Eine Suchmaschine liest die "Sutemap.XML" Dateien aus, die websitebetreiber online stellen für die #crawler der Suchmaschinen. Ich finde also fünf Jahre alte Artikel auf Websites die seit fünf Jahren nicht mehr gepflegt werden. Und maximal ein jahr alte Artikel, die meine Frage nicht beantworten aber in der #sitemap stehen. Die 100 Websites, die die richtige Antwort in einem zwei bis vier Jahre alte Artikel enthalten, finde ich nicht, weil diese Artikel nicht mehr in der sitemap stehen.

    Die GPTbots haben Wikipedia, stackexchange, Archiv.org, Annas archive und alle Websites gescrapt und dabei #robots.txt und sitemap ignoriert. Ich bekomme die richtige Antwort und zwar schneller als mit allen zuvor genannten Varianten.

    Oder ich suche in #Grokipedia. Grokipedia besteht aus 1Million statischen seiten im #CDN von #Cloudflare die von wikipedia gescrapt wurden. Die suche ist ein GPTbot und 57mal besser als die suche in wikipedia.

    @malteengeler @awinkler @evawolfangel @bkastl @Raymond @wikipedia

  3. Muss Google die neue KI-Suche von Apple fürchten?
    Apple stellt mit Safari-Nutzer:innen neue Weichen für den Zugang zum Internet. Die Integration KI-gestützter Suchsysteme könnte den etablierten Marktführer Google unter Druc
    apfeltalk.de/magazin/news/muss
    #KI #News #Alphabet #Apple #AppleStrategie #EddyCue #Google #GoogleSuche #Kartellverfahren #KISuche #KITechnologie #Marktanteil #OpenAI #Perplexity #Safari #Suchmaschine #Werbung

  4. Gibt es eigentlich eine #Suchmaschine die nur Webseiten liefert auf denen keine #Daten gesammelt oder an #Drittanbieter weitergegeben werden?
    Oder wäre das dann so wie in den 90er nur ein Taschenbuch? 🤔
    Muss denn jede Webseite immer irgendetwas von #google oder #meta einbinden? Muss man denn unbedingt immer wissen wer wann was wo warum wie oft gelesen oder besucht hat?
    Man müsste das #Internet mal neu erfinden 🤔

  5. OccuSearch: Eine datenschutzfreundliche #Suchmaschine für jeden!

    Meine #SearX Instanz #OccuSearch ist nun auch auf der offiziellen Liste öffentlicher Instanzen des Projekts gelistet: searx.space

    Natürlich mit einem Top Ranking im #Cryptocheck (A+ in cryptcheck.fr & A in SSL Quality Labs) sowie A+ im CPS Check (Mozilla Obversatory).

    Nutzt die Instanz gerne! occusearch.de

    #Werbefrei, #Trackingfrei, #Datenschutzfreundlich

    #OpenSource #Tracking #Digitalcourage