home.social

#abliteration — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #abliteration, aggregated by home.social.

  1. #KI ohne wenn und aber:

    IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.

    Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:

    ft.com/content/5630ed79-a263-4 #cybersecurity

  2. #KI ohne wenn und aber:

    IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.

    Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:

    ft.com/content/5630ed79-a263-4 #cybersecurity

  3. #KI ohne wenn und aber:

    IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.

    Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:

    ft.com/content/5630ed79-a263-4 #cybersecurity

  4. #KI ohne wenn und aber:

    IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.

    Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:

    ft.com/content/5630ed79-a263-4 #cybersecurity

  5. #KI ohne wenn und aber:

    IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.

    Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:

    ft.com/content/5630ed79-a263-4 #cybersecurity