#abliteration — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #abliteration, aggregated by home.social.
-
#KI ohne wenn und aber:
IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.
Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:
https://www.ft.com/content/5630ed79-a263-41ed-9a1a-321617ae310e?syn-25a6b1a6=1 #cybersecurity
-
#KI ohne wenn und aber:
IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.
Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:
https://www.ft.com/content/5630ed79-a263-41ed-9a1a-321617ae310e?syn-25a6b1a6=1 #cybersecurity
-
#KI ohne wenn und aber:
IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.
Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:
https://www.ft.com/content/5630ed79-a263-41ed-9a1a-321617ae310e?syn-25a6b1a6=1 #cybersecurity
-
#KI ohne wenn und aber:
IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.
Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:
https://www.ft.com/content/5630ed79-a263-41ed-9a1a-321617ae310e?syn-25a6b1a6=1 #cybersecurity
-
#KI ohne wenn und aber:
IT-Sicherheitsforscher haben nachgewiesen, dass die Sicherheitsmechanismen frei zugänglicher #AI-Modelle mit einem frei verfügbaren Tool namens "#Heretic" vollständig ausgehebelt werden können.
Der technische Ansatz dahinter heißt "#Abliteration" und beschreibt ein Verfahren, bei dem gezielt jene Bereiche im Inneren eines KI-Modells aufgespürt und deaktiviert werden, die für das Ablehnen gefährlicher Anfragen zuständig sind:
https://www.ft.com/content/5630ed79-a263-41ed-9a1a-321617ae310e?syn-25a6b1a6=1 #cybersecurity