home.social

#grokipedia — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #grokipedia, aggregated by home.social.

  1. @[email protected]

    Heulen und zwar ganz viel.

    Beispielsweise der Roman Faust von Goethe ist eine #Primärquelle.

    Die Kritiken von Literaturkritikern, die über den Roman Faust von Goethe erschienen, sind eine #Sekundärquelle.

    An dritter Stelle steht das grüne Reklamheft über Faust von Goethe.

    Der Artikel in einer Enzyklopädie über faust von Goethe ist eine #Tertiärquelle.

    #Wikipedia, #Grokipedia und die Ausgaben von #Chatbots sind Tertiärquellen, kuratierte Informationen über den Roman Faust von Goethe.

    Wikipedia verwendet als Quellen ausschließlich Sekundärquellen und für Zitate die Primärquelle.

    Grokipedia verwendet auuschlieslich Websites als Quellen (keine Bücher, Archive, die nicht online sind).

    Die #Suchmaschine #Google verwendete in der Vergangenheit häufig Wikipedia als Quelle.

    Heute verwenden die Chatbots als Quelle Wikipedia und Grokipedia.

    In einer fernen Vergangenheit haben Eltern ihren Kindern empfohlen, in Wikipedia zu recherchieren.

    In einer näheren Vergangenheit haben Eltern ihren Kindern empfohlen, in Google zu recherchieren.

    Heute empfehlen Eltern ihren Kindern mit dem Chatbot zu recherchieren.

    Die Idee einer #Enzyklopädie ist eigentlich, sich in dieser Enzyklopädie einen #Überblick zu verschaffen und dann die verwendeten sekundärquellen selbst als #Quelle zu verwenden.

    Wikipedia stirbt. Es machen zu wenig Leute dabei mit.

    In Zukunft werden Menschen mit den Chatbots recherchieren und die Chatbots werden in Grokipedia recherchieren.

  2. Wenn ich nachsehen möchte, ob im #Formatstring für das Datum das kleine s für Sekunden und das große S für Millisekunden steht, dann frage ich das einen beliebigen #GPTbot (den, der nicht sagt #Quota exceded, weil ich mich nicht per #Api-Key identifiziert habe). Warum?

    In #Wikipedia steht die Antwort möglicherweise. Es dauert aber, herauszufinden, in welchem Artikel, Listenartikel oder Unterartikel. Die #Suche von Wikipedia verwendet zwar #ElasticSearch, aber um die Vorteile von dieser starken Engine auch zu erhalten, hätten 100000e Menschen, die Wikipedia-Artikel auch verschlagworten müssen (#wikidata). Ausserdem kann es sein, dass etwas so praktisches wie formatstrings als #unenzyklpädisch eingestuft wurde und daher entfernt.

    In #Stackexchange muss ich mehrfach bestätigen, dass ich ein Mensch bin, finde dann einen Artikel, der unbeantwortet geschlossen wurde, weil #Duplikat. Dann zwei veraltete, die inzwischen falsch sind, dann welche mit einem nicht mehr funktionierenden link auf die Lösung.

    Bei #archive_org, archive.is und #AnnasArchive muss ich die #URL des gesuchten Artikels wissen, um suchen zu können.

    Eine #Suchmaschine sucht nicht. Eine Suchmaschine liest die "Sutemap.XML" Dateien aus, die websitebetreiber online stellen für die #crawler der Suchmaschinen. Ich finde also fünf Jahre alte Artikel auf Websites die seit fünf Jahren nicht mehr gepflegt werden. Und maximal ein jahr alte Artikel, die meine Frage nicht beantworten aber in der #sitemap stehen. Die 100 Websites, die die richtige Antwort in einem zwei bis vier Jahre alte Artikel enthalten, finde ich nicht, weil diese Artikel nicht mehr in der sitemap stehen.

    Die GPTbots haben Wikipedia, stackexchange, Archiv.org, Annas archive und alle Websites gescrapt und dabei #robots.txt und sitemap ignoriert. Ich bekomme die richtige Antwort und zwar schneller als mit allen zuvor genannten Varianten.

    Oder ich suche in #Grokipedia. Grokipedia besteht aus 1Million statischen seiten im #CDN von #Cloudflare die von wikipedia gescrapt wurden. Die suche ist ein GPTbot und 57mal besser als die suche in wikipedia.

    @malteengeler @awinkler @evawolfangel @bkastl @Raymond @wikipedia

  3. Quel est l'article #Wikipedia le plus consulté mardi ? #Grokipedia ! Mais avec seulement 36.000 vues et une très faible part du trafic provenant du mobile (étrange, donc pas forcément que du trafic naturel généré par des humains).pageviews.wmcloud.org/topviews) #WikiStats