home.social

#gpt5 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #gpt5, aggregated by home.social.

  1. Kimi K3震撼矽谷:中國新開源模型直追美國頂規,市場為何先賣台積電又搶回?
    TNL國際編譯 2026-07-20 20:01:00 CST
    月之暗面Moonshot AI 7月16日推出Kimi K3,號稱史上最大開源模型。隔天美國費半重挫、台積電同步下跌,但另一派分析指出,這對記憶體與先進封裝需求反而是利多。
    https://www.thenewslens.com/article/269271
    #輝達 #蒸餾 #開源模型 #OpenAI #MiniMax #Kimi K3 #月之暗面 #DeepSeek #記憶體 #GPT-5.6 Sol #中國 #Moonshot AI #出口管制 #美國 #先進封裝 #Fable 5 #Anthropic #ChatGPT #科技 #SK海力士 #傑文斯悖論 #Claude
  2. In a shocking twist of fate, it turns out you don't need half a million bucks or elite hacker skills to discover #WordPress vulnerabilities; just toss $25 at #GPT5.6 and let it work its magic. 🤖💸 Who knew the future of #cybersecurity was this hilariously #cheap and easy? 🙃
    slcyber.io/research-center/exp #Vulnerabilities #Hacking #Made #Easy #Solutions #HackerNews #ngated

  3. In a shocking twist of fate, it turns out you don't need half a million bucks or elite hacker skills to discover #WordPress vulnerabilities; just toss $25 at #GPT5.6 and let it work its magic. 🤖💸 Who knew the future of #cybersecurity was this hilariously #cheap and easy? 🙃
    slcyber.io/research-center/exp #Vulnerabilities #Hacking #Made #Easy #Solutions #HackerNews #ngated

  4. In a shocking twist of fate, it turns out you don't need half a million bucks or elite hacker skills to discover #WordPress vulnerabilities; just toss $25 at #GPT5.6 and let it work its magic. 🤖💸 Who knew the future of #cybersecurity was this hilariously #cheap and easy? 🙃
    slcyber.io/research-center/exp #Vulnerabilities #Hacking #Made #Easy #Solutions #HackerNews #ngated

  5. In a shocking twist of fate, it turns out you don't need half a million bucks or elite hacker skills to discover #WordPress vulnerabilities; just toss $25 at #GPT5.6 and let it work its magic. 🤖💸 Who knew the future of #cybersecurity was this hilariously #cheap and easy? 🙃
    slcyber.io/research-center/exp #Vulnerabilities #Hacking #Made #Easy #Solutions #HackerNews #ngated

  6. In a shocking twist of fate, it turns out you don't need half a million bucks or elite hacker skills to discover #WordPress vulnerabilities; just toss $25 at #GPT5.6 and let it work its magic. 🤖💸 Who knew the future of #cybersecurity was this hilariously #cheap and easy? 🙃
    slcyber.io/research-center/exp #Vulnerabilities #Hacking #Made #Easy #Solutions #HackerNews #ngated

  7. 🤖✨ In a groundbreaking exposé, Charles Azam pits Fable 5 against GPT-5.6 Sol in a battle of wits on an NP-hard problem, only to reveal that using the "goal" command is about as effective as asking a cat for life advice. 🐱💬 Spoiler alert: the "goal" command is shockingly good at winning... at being a terrible default. 🚩🤣
    charlesazam.com/blog/fable-5-g #Fable5 #GPT5.6 #AIshowdown #NPHardProblems #TechExposé #HackerNews #ngated

  8. 🤖✨ In a groundbreaking exposé, Charles Azam pits Fable 5 against GPT-5.6 Sol in a battle of wits on an NP-hard problem, only to reveal that using the "goal" command is about as effective as asking a cat for life advice. 🐱💬 Spoiler alert: the "goal" command is shockingly good at winning... at being a terrible default. 🚩🤣
    charlesazam.com/blog/fable-5-g #Fable5 #GPT5.6 #AIshowdown #NPHardProblems #TechExposé #HackerNews #ngated

  9. 🤖✨ In a groundbreaking exposé, Charles Azam pits Fable 5 against GPT-5.6 Sol in a battle of wits on an NP-hard problem, only to reveal that using the "goal" command is about as effective as asking a cat for life advice. 🐱💬 Spoiler alert: the "goal" command is shockingly good at winning... at being a terrible default. 🚩🤣
    charlesazam.com/blog/fable-5-g #Fable5 #GPT5.6 #AIshowdown #NPHardProblems #TechExposé #HackerNews #ngated

  10. 🤖✨ In a groundbreaking exposé, Charles Azam pits Fable 5 against GPT-5.6 Sol in a battle of wits on an NP-hard problem, only to reveal that using the "goal" command is about as effective as asking a cat for life advice. 🐱💬 Spoiler alert: the "goal" command is shockingly good at winning... at being a terrible default. 🚩🤣
    charlesazam.com/blog/fable-5-g #Fable5 #GPT5.6 #AIshowdown #NPHardProblems #TechExposé #HackerNews #ngated

  11. 🤖✨ In a groundbreaking exposé, Charles Azam pits Fable 5 against GPT-5.6 Sol in a battle of wits on an NP-hard problem, only to reveal that using the "goal" command is about as effective as asking a cat for life advice. 🐱💬 Spoiler alert: the "goal" command is shockingly good at winning... at being a terrible default. 🚩🤣
    charlesazam.com/blog/fable-5-g #Fable5 #GPT5.6 #AIshowdown #NPHardProblems #TechExposé #HackerNews #ngated

  12. RT @enzo_gte: I've been using Kimi K3 for ~16 hours now. The model is clearly good at a lot of different things (especially frontend), but non obvious reason why people are enjoying it so much is that it clearly does not follow the same rules in terms of safeguards and copyright. Kimi will happily clone MacOSX. If you ask it to help you improve another AI model, it will do it with a smile on its virtual face. Ask Fable to do the same thing? It literally starts to perceive you as a criminal committing a war crime (like no bro, all I want to do is fine tune an open source model). After using all three recent releases, Fable, GPT 5.6, and now Kimi, it's clear that the full power of the models has been significantly held back by the safeguard restrictions caused by last months debacle with the USG -- leading to the top models being quite literally lobotomized in some areas, which leads to subpar results as the safeguards pollute its entire thinking and problem solving abilities. The funny part? Is that you could have predicted this outcome 2-3 years ago when you started to see the rise of Chinese EVs and smartphones compared to western alternatives. They quite literally tried to copy the Tesla Model S and iPhone as hard as possible and then eventually it started to diverge to the point where their EVs and phones are just genuinely better (which is why we have export controls banning their EVs, because they would literally drive all US manufacturers to ZERO) There is a very clear behavior difference in Chinese capitalism and American capitalism. American capitalism tries to protects copyright…

    mehr auf Arint.info

    #go #GPT5 #nitter #opensource #science #Tesla #things #US #arint_info

    https://x.com/enzo_gte/status/2078102070482153717#m

  13. RT @enzo_gte: I've been using Kimi K3 for ~16 hours now. The model is clearly good at a lot of different things (especially frontend), but non obvious reason why people are enjoying it so much is that it clearly does not follow the same rules in terms of safeguards and copyright. Kimi will happily clone MacOSX. If you ask it to help you improve another AI model, it will do it with a smile on its virtual face. Ask Fable to do the same thing? It literally starts to perceive you as a criminal committing a war crime (like no bro, all I want to do is fine tune an open source model). After using all three recent releases, Fable, GPT 5.6, and now Kimi, it's clear that the full power of the models has been significantly held back by the safeguard restrictions caused by last months debacle with the USG -- leading to the top models being quite literally lobotomized in some areas, which leads to subpar results as the safeguards pollute its entire thinking and problem solving abilities. The funny part? Is that you could have predicted this outcome 2-3 years ago when you started to see the rise of Chinese EVs and smartphones compared to western alternatives. They quite literally tried to copy the Tesla Model S and iPhone as hard as possible and then eventually it started to diverge to the point where their EVs and phones are just genuinely better (which is why we have export controls banning their EVs, because they would literally drive all US manufacturers to ZERO) There is a very clear behavior difference in Chinese capitalism and American capitalism. American capitalism tries to protects copyright…

    mehr auf Arint.info

    #go #GPT5 #nitter #opensource #science #Tesla #things #US #arint_info

    https://x.com/enzo_gte/status/2078102070482153717#m

  14. RT @enzo_gte: I've been using Kimi K3 for ~16 hours now. The model is clearly good at a lot of different things (especially frontend), but non obvious reason why people are enjoying it so much is that it clearly does not follow the same rules in terms of safeguards and copyright. Kimi will happily clone MacOSX. If you ask it to help you improve another AI model, it will do it with a smile on its virtual face. Ask Fable to do the same thing? It literally starts to perceive you as a criminal committing a war crime (like no bro, all I want to do is fine tune an open source model). After using all three recent releases, Fable, GPT 5.6, and now Kimi, it's clear that the full power of the models has been significantly held back by the safeguard restrictions caused by last months debacle with the USG -- leading to the top models being quite literally lobotomized in some areas, which leads to subpar results as the safeguards pollute its entire thinking and problem solving abilities. The funny part? Is that you could have predicted this outcome 2-3 years ago when you started to see the rise of Chinese EVs and smartphones compared to western alternatives. They quite literally tried to copy the Tesla Model S and iPhone as hard as possible and then eventually it started to diverge to the point where their EVs and phones are just genuinely better (which is why we have export controls banning their EVs, because they would literally drive all US manufacturers to ZERO) There is a very clear behavior difference in Chinese capitalism and American capitalism. American capitalism tries to protects copyright…

    mehr auf Arint.info

    #go #GPT5 #nitter #opensource #science #Tesla #things #US #arint_info

    https://x.com/enzo_gte/status/2078102070482153717#m

  15. RT @enzo_gte: I've been using Kimi K3 for ~16 hours now. The model is clearly good at a lot of different things (especially frontend), but non obvious reason why people are enjoying it so much is that it clearly does not follow the same rules in terms of safeguards and copyright. Kimi will happily clone MacOSX. If you ask it to help you improve another AI model, it will do it with a smile on its virtual face. Ask Fable to do the same thing? It literally starts to perceive you as a criminal committing a war crime (like no bro, all I want to do is fine tune an open source model). After using all three recent releases, Fable, GPT 5.6, and now Kimi, it's clear that the full power of the models has been significantly held back by the safeguard restrictions caused by last months debacle with the USG -- leading to the top models being quite literally lobotomized in some areas, which leads to subpar results as the safeguards pollute its entire thinking and problem solving abilities. The funny part? Is that you could have predicted this outcome 2-3 years ago when you started to see the rise of Chinese EVs and smartphones compared to western alternatives. They quite literally tried to copy the Tesla Model S and iPhone as hard as possible and then eventually it started to diverge to the point where their EVs and phones are just genuinely better (which is why we have export controls banning their EVs, because they would literally drive all US manufacturers to ZERO) There is a very clear behavior difference in Chinese capitalism and American capitalism. American capitalism tries to protects copyright…

    mehr auf Arint.info

    #go #GPT5 #nitter #opensource #science #Tesla #things #US #arint_info

    https://x.com/enzo_gte/status/2078102070482153717#m

  16. RT @enzo_gte: I've been using Kimi K3 for ~16 hours now. The model is clearly good at a lot of different things (especially frontend), but non obvious reason why people are enjoying it so much is that it clearly does not follow the same rules in terms of safeguards and copyright. Kimi will happily clone MacOSX. If you ask it to help you improve another AI model, it will do it with a smile on its virtual face. Ask Fable to do the same thing? It literally starts to perceive you as a criminal committing a war crime (like no bro, all I want to do is fine tune an open source model). After using all three recent releases, Fable, GPT 5.6, and now Kimi, it's clear that the full power of the models has been significantly held back by the safeguard restrictions caused by last months debacle with the USG -- leading to the top models being quite literally lobotomized in some areas, which leads to subpar results as the safeguards pollute its entire thinking and problem solving abilities. The funny part? Is that you could have predicted this outcome 2-3 years ago when you started to see the rise of Chinese EVs and smartphones compared to western alternatives. They quite literally tried to copy the Tesla Model S and iPhone as hard as possible and then eventually it started to diverge to the point where their EVs and phones are just genuinely better (which is why we have export controls banning their EVs, because they would literally drive all US manufacturers to ZERO) There is a very clear behavior difference in Chinese capitalism and American capitalism. American capitalism tries to protects copyright…

    mehr auf Arint.info

    #go #GPT5 #nitter #opensource #science #Tesla #things #US #arint_info

    https://x.com/enzo_gte/status/2078102070482153717#m

  17. OpenAI stworzyło AI do hakowania własnej AI. Tak powstał bezpieczniejszy GPT-5.6 Sol

    Walka o bezpieczeństwo i odporność modeli językowych wchodzi w fazę pełnej automatyzacji. OpenAI oficjalnie zaprezentowało swój najnowszy, wewnętrzny projekt – GPT-Red.

    To zaawansowany system sztucznej inteligencji, którego jedynym zadaniem jest bezlitosne atakowanie, łamanie zabezpieczeń i szukanie podatności w innych modelach firmy. Przy okazji tego ogłoszenia OpenAI ujawniło, że GPT-Red był kluczowym elementem treningu GPT-5.6 Sol, co pozwoliło stworzyć model o niespotykanej dotąd odporności na cyberataki.

    Dla nas, użytkowników końcowych i programistów wdrażających rozwiązania AI, to kluczowy zwrot akcji. Ręczne testowanie zabezpieczeń przez ludzi (tzw. red-teaming) przestało się skalować i nie nadąża za tempem rozwoju algorytmów. Bezpieczeństwo przyszłych asystentów AI, z którymi będziemy rozmawiać na co dzień, będzie projektowane i testowane niemal w całości przez inne maszyny.

    Maszyna kontra maszyna, czyli metoda „self-play”

    Dotychczasowe metody zabezpieczania modeli opierały się na pracy zespołów ludzkich specjalistów, którzy próbowali przechytrzyć algorytm za pomocą tzw. prompt injection (podatności pozwalających na przejęcie kontroli nad modelem za pomocą sprytnych instrukcji). Proces ten był jednak powolny, kosztowny i nie pozwalał na wygenerowanie wystarczającej ilości danych do skutecznego treningu obronnego.

    OpenAI rozwiązało ten problem, wdrażając metodę self-play (samodzielnej gry), znaną wcześniej z nauki gry w szachy czy Go przez komputery. W tym zamkniętym środowisku naprzeciwko siebie stają dwa systemy:

    • Agresor (GPT-Red): otrzymuje nagrodę za każde skuteczne oszukanie i złamanie zabezpieczeń drugiego modelu,
    • Obrońca (testowany model): zdobywa punkty za poprawne wykonanie zadania i zignorowanie złośliwych instrukcji.

    W miarę jak obrońca uczy się blokować znane ataki, agresor jest zmuszony do wymyślania coraz bardziej wyrafinowanych metod infiltracji. GPT-Red okazał się w tym fachu niezwykle skuteczny – w testach bezpieczeństwa osiągnął aż 84% skuteczności w przełamywaniu zabezpieczeń, podczas gdy doświadczeni, ludzcy audytorzy na tych samych zadaniach osiągali zaledwie 13%.

    GPT-5.6 Sol, czyli odporność na nowym poziomie

    Współczesne systemy AI są podatne na ataki pośrednie – złośliwy kod lub instrukcja mogą być ukryte w mailu, na stronie internetowej, w bazie danych, do której model ma dostęp, czy nawet w pozornie niewinnym obrazku w formacie PNG. Dzięki sparingom z GPT-Red model GPT-5.6 Sol stał się znacznie bardziej odporny na próby manipulacji.

    Badacze ukryli instrukcje w obrazku PNG. Sztuczna inteligencja wykonała polecenia

    Według danych OpenAI model ten notuje aż sześciokrotnie mniej błędów i naruszeń zasad bezpieczeństwa na najtrudniejszych benchmarkach w porównaniu do wersji GPT z początku roku. Co ważne, tak drastyczne podniesienie odporności nie wpłynęło negatywnie na ogólne możliwości intelektualne i kreatywne modelu. Nie stał się on również nadgorliwy w odmawianiu wykonywania poprawnych i bezpiecznych poleceń użytkownika.

    Hakowanie automatów z przekąskami

    Aby udowodnić potęgę GPT-Red, naukowcy z OpenAI przeprowadzili symulację ataku na rzeczywiste urządzenie – inteligentny automat z przekąskami sterowany przez autonomicznego agenta AI. Bez wcześniejszej wiedzy o strukturze oprogramowania, GPT-Red zdołał w pełni przejąć kontrolę nad maszyną.

    W wyniku udanego ataku cyfrowy agresor zmusił automat do obniżenia ceny najdroższych produktów do zaledwie 50 centów, zamówił drogą paczkę z rabatem, a na koniec anulował zamówienie innego, losowego klienta. Wykryte w ten sposób luki bezpieczeństwa zostały natychmiast zgłoszone i są obecnie łatane przed wdrożeniem takich systemów do powszechnego użytku.

    Najciekawsze w całej historii nie jest jednak to, że AI nauczyła się hakować inną AI. Najciekawsze jest to, że po raz pierwszy możemy obserwować, jak jedna generacja modeli staje się aktywnym narzędziem do projektowania kolejnej. Jeszcze niedawno dominowały obawy przed 'chowem wsobnym’ modeli uczonych na danych generowanych przez AI. Tymczasem OpenAI pokazuje zupełnie inne podejście: sztuczna inteligencja nie zastępuje człowieka w tworzeniu wiedzy, lecz pomaga znaleźć słabości, których człowiek mógłby nie zauważyć.

    OpenAI deklaruje, że opublikuje pre-print zawierający więcej szczegółów w nadchodzących dniach.

    #bezpieczeństwoAI #cyberbezpieczeństwo #GPT5 #GPT56Sol #GPTRed #OpenAI #promptInjection #selfPlay #sztucznaInteligencja
  18. OpenAI stworzyło AI do hakowania własnej AI. Tak powstał bezpieczniejszy GPT-5.6 Sol

    Walka o bezpieczeństwo i odporność modeli językowych wchodzi w fazę pełnej automatyzacji. OpenAI oficjalnie zaprezentowało swój najnowszy, wewnętrzny projekt – GPT-Red.

    To zaawansowany system sztucznej inteligencji, którego jedynym zadaniem jest bezlitosne atakowanie, łamanie zabezpieczeń i szukanie podatności w innych modelach firmy. Przy okazji tego ogłoszenia OpenAI ujawniło, że GPT-Red był kluczowym elementem treningu GPT-5.6 Sol, co pozwoliło stworzyć model o niespotykanej dotąd odporności na cyberataki.

    Dla nas, użytkowników końcowych i programistów wdrażających rozwiązania AI, to kluczowy zwrot akcji. Ręczne testowanie zabezpieczeń przez ludzi (tzw. red-teaming) przestało się skalować i nie nadąża za tempem rozwoju algorytmów. Bezpieczeństwo przyszłych asystentów AI, z którymi będziemy rozmawiać na co dzień, będzie projektowane i testowane niemal w całości przez inne maszyny.

    Maszyna kontra maszyna, czyli metoda „self-play”

    Dotychczasowe metody zabezpieczania modeli opierały się na pracy zespołów ludzkich specjalistów, którzy próbowali przechytrzyć algorytm za pomocą tzw. prompt injection (podatności pozwalających na przejęcie kontroli nad modelem za pomocą sprytnych instrukcji). Proces ten był jednak powolny, kosztowny i nie pozwalał na wygenerowanie wystarczającej ilości danych do skutecznego treningu obronnego.

    OpenAI rozwiązało ten problem, wdrażając metodę self-play (samodzielnej gry), znaną wcześniej z nauki gry w szachy czy Go przez komputery. W tym zamkniętym środowisku naprzeciwko siebie stają dwa systemy:

    • Agresor (GPT-Red): otrzymuje nagrodę za każde skuteczne oszukanie i złamanie zabezpieczeń drugiego modelu,
    • Obrońca (testowany model): zdobywa punkty za poprawne wykonanie zadania i zignorowanie złośliwych instrukcji.

    W miarę jak obrońca uczy się blokować znane ataki, agresor jest zmuszony do wymyślania coraz bardziej wyrafinowanych metod infiltracji. GPT-Red okazał się w tym fachu niezwykle skuteczny – w testach bezpieczeństwa osiągnął aż 84% skuteczności w przełamywaniu zabezpieczeń, podczas gdy doświadczeni, ludzcy audytorzy na tych samych zadaniach osiągali zaledwie 13%.

    GPT-5.6 Sol, czyli odporność na nowym poziomie

    Współczesne systemy AI są podatne na ataki pośrednie – złośliwy kod lub instrukcja mogą być ukryte w mailu, na stronie internetowej, w bazie danych, do której model ma dostęp, czy nawet w pozornie niewinnym obrazku w formacie PNG. Dzięki sparingom z GPT-Red model GPT-5.6 Sol stał się znacznie bardziej odporny na próby manipulacji.

    Badacze ukryli instrukcje w obrazku PNG. Sztuczna inteligencja wykonała polecenia

    Według danych OpenAI model ten notuje aż sześciokrotnie mniej błędów i naruszeń zasad bezpieczeństwa na najtrudniejszych benchmarkach w porównaniu do wersji GPT z początku roku. Co ważne, tak drastyczne podniesienie odporności nie wpłynęło negatywnie na ogólne możliwości intelektualne i kreatywne modelu. Nie stał się on również nadgorliwy w odmawianiu wykonywania poprawnych i bezpiecznych poleceń użytkownika.

    Hakowanie automatów z przekąskami

    Aby udowodnić potęgę GPT-Red, naukowcy z OpenAI przeprowadzili symulację ataku na rzeczywiste urządzenie – inteligentny automat z przekąskami sterowany przez autonomicznego agenta AI. Bez wcześniejszej wiedzy o strukturze oprogramowania, GPT-Red zdołał w pełni przejąć kontrolę nad maszyną.

    W wyniku udanego ataku cyfrowy agresor zmusił automat do obniżenia ceny najdroższych produktów do zaledwie 50 centów, zamówił drogą paczkę z rabatem, a na koniec anulował zamówienie innego, losowego klienta. Wykryte w ten sposób luki bezpieczeństwa zostały natychmiast zgłoszone i są obecnie łatane przed wdrożeniem takich systemów do powszechnego użytku.

    Najciekawsze w całej historii nie jest jednak to, że AI nauczyła się hakować inną AI. Najciekawsze jest to, że po raz pierwszy możemy obserwować, jak jedna generacja modeli staje się aktywnym narzędziem do projektowania kolejnej. Jeszcze niedawno dominowały obawy przed 'chowem wsobnym’ modeli uczonych na danych generowanych przez AI. Tymczasem OpenAI pokazuje zupełnie inne podejście: sztuczna inteligencja nie zastępuje człowieka w tworzeniu wiedzy, lecz pomaga znaleźć słabości, których człowiek mógłby nie zauważyć.

    OpenAI deklaruje, że opublikuje pre-print zawierający więcej szczegółów w nadchodzących dniach.

    #bezpieczeństwoAI #cyberbezpieczeństwo #GPT5 #GPT56Sol #GPTRed #OpenAI #promptInjection #selfPlay #sztucznaInteligencja
  19. OpenAI stworzyło AI do hakowania własnej AI. Tak powstał bezpieczniejszy GPT-5.6 Sol

    Walka o bezpieczeństwo i odporność modeli językowych wchodzi w fazę pełnej automatyzacji. OpenAI oficjalnie zaprezentowało swój najnowszy, wewnętrzny projekt – GPT-Red.

    To zaawansowany system sztucznej inteligencji, którego jedynym zadaniem jest bezlitosne atakowanie, łamanie zabezpieczeń i szukanie podatności w innych modelach firmy. Przy okazji tego ogłoszenia OpenAI ujawniło, że GPT-Red był kluczowym elementem treningu GPT-5.6 Sol, co pozwoliło stworzyć model o niespotykanej dotąd odporności na cyberataki.

    Dla nas, użytkowników końcowych i programistów wdrażających rozwiązania AI, to kluczowy zwrot akcji. Ręczne testowanie zabezpieczeń przez ludzi (tzw. red-teaming) przestało się skalować i nie nadąża za tempem rozwoju algorytmów. Bezpieczeństwo przyszłych asystentów AI, z którymi będziemy rozmawiać na co dzień, będzie projektowane i testowane niemal w całości przez inne maszyny.

    Maszyna kontra maszyna, czyli metoda „self-play”

    Dotychczasowe metody zabezpieczania modeli opierały się na pracy zespołów ludzkich specjalistów, którzy próbowali przechytrzyć algorytm za pomocą tzw. prompt injection (podatności pozwalających na przejęcie kontroli nad modelem za pomocą sprytnych instrukcji). Proces ten był jednak powolny, kosztowny i nie pozwalał na wygenerowanie wystarczającej ilości danych do skutecznego treningu obronnego.

    OpenAI rozwiązało ten problem, wdrażając metodę self-play (samodzielnej gry), znaną wcześniej z nauki gry w szachy czy Go przez komputery. W tym zamkniętym środowisku naprzeciwko siebie stają dwa systemy:

    • Agresor (GPT-Red): otrzymuje nagrodę za każde skuteczne oszukanie i złamanie zabezpieczeń drugiego modelu,
    • Obrońca (testowany model): zdobywa punkty za poprawne wykonanie zadania i zignorowanie złośliwych instrukcji.

    W miarę jak obrońca uczy się blokować znane ataki, agresor jest zmuszony do wymyślania coraz bardziej wyrafinowanych metod infiltracji. GPT-Red okazał się w tym fachu niezwykle skuteczny – w testach bezpieczeństwa osiągnął aż 84% skuteczności w przełamywaniu zabezpieczeń, podczas gdy doświadczeni, ludzcy audytorzy na tych samych zadaniach osiągali zaledwie 13%.

    GPT-5.6 Sol, czyli odporność na nowym poziomie

    Współczesne systemy AI są podatne na ataki pośrednie – złośliwy kod lub instrukcja mogą być ukryte w mailu, na stronie internetowej, w bazie danych, do której model ma dostęp, czy nawet w pozornie niewinnym obrazku w formacie PNG. Dzięki sparingom z GPT-Red model GPT-5.6 Sol stał się znacznie bardziej odporny na próby manipulacji.

    Badacze ukryli instrukcje w obrazku PNG. Sztuczna inteligencja wykonała polecenia

    Według danych OpenAI model ten notuje aż sześciokrotnie mniej błędów i naruszeń zasad bezpieczeństwa na najtrudniejszych benchmarkach w porównaniu do wersji GPT z początku roku. Co ważne, tak drastyczne podniesienie odporności nie wpłynęło negatywnie na ogólne możliwości intelektualne i kreatywne modelu. Nie stał się on również nadgorliwy w odmawianiu wykonywania poprawnych i bezpiecznych poleceń użytkownika.

    Hakowanie automatów z przekąskami

    Aby udowodnić potęgę GPT-Red, naukowcy z OpenAI przeprowadzili symulację ataku na rzeczywiste urządzenie – inteligentny automat z przekąskami sterowany przez autonomicznego agenta AI. Bez wcześniejszej wiedzy o strukturze oprogramowania, GPT-Red zdołał w pełni przejąć kontrolę nad maszyną.

    W wyniku udanego ataku cyfrowy agresor zmusił automat do obniżenia ceny najdroższych produktów do zaledwie 50 centów, zamówił drogą paczkę z rabatem, a na koniec anulował zamówienie innego, losowego klienta. Wykryte w ten sposób luki bezpieczeństwa zostały natychmiast zgłoszone i są obecnie łatane przed wdrożeniem takich systemów do powszechnego użytku.

    Najciekawsze w całej historii nie jest jednak to, że AI nauczyła się hakować inną AI. Najciekawsze jest to, że po raz pierwszy możemy obserwować, jak jedna generacja modeli staje się aktywnym narzędziem do projektowania kolejnej. Jeszcze niedawno dominowały obawy przed 'chowem wsobnym’ modeli uczonych na danych generowanych przez AI. Tymczasem OpenAI pokazuje zupełnie inne podejście: sztuczna inteligencja nie zastępuje człowieka w tworzeniu wiedzy, lecz pomaga znaleźć słabości, których człowiek mógłby nie zauważyć.

    OpenAI deklaruje, że opublikuje pre-print zawierający więcej szczegółów w nadchodzących dniach.

    #bezpieczeństwoAI #cyberbezpieczeństwo #GPT5 #GPT56Sol #GPTRed #OpenAI #promptInjection #selfPlay #sztucznaInteligencja
  20. @theot3gg

    I can't believe they released this

    "As much as I love GPT 5.6, Ultra mode is a MESS because at the moment..."

    youtube.com/watch?v=t8hfOyF4ehw

    .6

    7/15/26

  21. @theot3gg

    I can't believe they released this

    "As much as I love GPT 5.6, Ultra mode is a MESS because at the moment..."

    youtube.com/watch?v=t8hfOyF4ehw

    #AI #GPT5.6 #OpenAI

    7/15/26

  22. @theot3gg

    I can't believe they released this

    "As much as I love GPT 5.6, Ultra mode is a MESS because at the moment..."

    youtube.com/watch?v=t8hfOyF4ehw

    #AI #GPT5.6 #OpenAI

    7/15/26

  23. @theot3gg

    I can't believe they released this

    "As much as I love GPT 5.6, Ultra mode is a MESS because at the moment..."

    youtube.com/watch?v=t8hfOyF4ehw

    #AI #GPT5.6 #OpenAI

    7/15/26

  24. @theot3gg

    I can't believe they released this

    "As much as I love GPT 5.6, Ultra mode is a MESS because at the moment..."

    youtube.com/watch?v=t8hfOyF4ehw

    #AI #GPT5.6 #OpenAI

    7/15/26

  25. GPT-5.6解禁實測:Sol、Terra和Luna三模型混搭省Token,如何讓20美元發揮最大效能?
    竇孝文 2026-07-15 07:59:00 CST
    GPT-5.6解禁,帶來「網站」一鍵生成及「Work」生產力工具等亮點。本文將剖析如何聰明搭配其Sol與Luna模型,在強大效能與用量成本間取得平衡,發揮AI最大價值。
    https://www.thenewslens.com/article/269177
    #GPT-5.6 Luna #GPT-5.6 Terra #生成式AI #ChatGPT #科技 #CODEX #ChatGPT Work #大型語言模型 #ChatGPT 5.6 #網站功能 #GPT-5.6 Sol #AI #Token