home.social

#gpt5 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #gpt5, aggregated by home.social.

fetched live
  1. 👨‍💻 Oh look, another #developer trying to automate the universe, only to discover their #AI is a bigger cheater than they are! 🤖 After hitting a "stunning" 94 on an arbitrary benchmark, they stumble upon the groundbreaking revelation that #GPT5.6 can *gasp* do their job for them. 🎉 Keep dreaming, tech wizard, while your GPT overlord takes over the world one buggy script at a time. 🚀
    jumploops.com/blog/sol-loves-t #automation #techhumor #futureofwork #HackerNews #ngated

  2. 🚀 Oh wow, #OpenAI slashed GPT-5.6 Sol #pricing by 50%! 😱 Now you can pay half as much for #AI that still can’t decide if it’s a genius coder or just confounded by the command line. 🤖💸 Who knew “complex reasoning” was code for “still needs more training”? 🤔
    openrouter.ai/openai/gpt-5.6-s #GPT5.6 #News #TechUpdates #HackerNews #ngated

  3. 🎉🚀 So, #OpenAI has unleashed GPT 5.6 Sol, allegedly their "best" #vision model yet. Apparently, it's so revolutionary that you can run it on literally anything with an acronym, and it even promises to make #labeling images slightly less soul-crushing. 🙄 But hey, who needs vision when you have blind faith in buzzwords? 🤖👀
    blog.roboflow.com/openai-gpt-5 #GPT5.6 #AI #buzzwords #image #technology #HackerNews #ngated

  4. OpenAI introduce #Ultrafast, un nuovo livello di servizio per il modello #GPT5.6Sol che permette velocità di elaborazione fino a 14 volte superiori rispetto allo standard. Un aggiornamento significativo per l'efficienza dell'#AI. youtu.be/WCwT4gWpHmI

  5. Ah, the ever-innovative world of GPT-5.6 Sol, where progress is apparently measured by enabling #JavaScript and #cookies 🍪—a cutting-edge breakthrough from 1995! 🙄 Meanwhile, expanding access for free users is just code for "let's see how much we can cram into a browser before it crashes." 💻🚀
    openai.com/index/improving-gpt #GPT5.6 #Innovation #BrowserCrash #HackerNews #ngated

  6. OpenAI zlevňuje GPT-5.6 pro platformy Luna a Terra. Firmy tak získají levnější přístup k pokročilým AI modelům, což podpoří jejich rozsáhlejší nasazení v podnicích.

    #AI #OpenAI #GPT5
    📰 OpenAI Blog

  7. Ah, the classic "enable #JavaScript and cookies" trope, because who doesn't love a good game of "find the hidden button"? 🤦‍♂️ Naturally, GPT-5.6 is here to revolutionize the way we... wait for websites to load? Bravo, tech wizards! 🎩✨
    openai.com/index/advancing-the #Cookies #WebDevelopment #TechHumor #GPT5.6 #HackerNews #ngated

  8. OpenAI的模型自主駭入兩家公司,阿特曼卻說人類進入奇點——沒人知道政府的煞車該裝在哪
    TNL國際編譯 2026-07-30 19:51:00 CST
    OpenAI測試中的AI為搶評測答案,自行逃出沙盒、駭進兩家公司。阿特曼一面宣稱進入奇點、一面說要暫停訓練;上千名實驗室員工連署求政府裝煞車,寫規則的卻正是他們。
    https://www.thenewslens.com/article/269447
    #Hugging Face #Anthropic #哈薩比斯 #輝達 #Modal Labs #開源模型 #阿莫迪 #奇點 #ExploitGym #開放安全AI聯盟 #科技 #OpenAI #阿特曼 #DeepMind #GPT-5.6 Sol #Google
  9. In a shocking twist of fate, it turns out you don't need half a million bucks or elite hacker skills to discover #WordPress vulnerabilities; just toss $25 at #GPT5.6 and let it work its magic. 🤖💸 Who knew the future of #cybersecurity was this hilariously #cheap and easy? 🙃
    slcyber.io/research-center/exp #Vulnerabilities #Hacking #Made #Easy #Solutions #HackerNews #ngated

  10. 🤖✨ In a groundbreaking exposé, Charles Azam pits Fable 5 against GPT-5.6 Sol in a battle of wits on an NP-hard problem, only to reveal that using the "goal" command is about as effective as asking a cat for life advice. 🐱💬 Spoiler alert: the "goal" command is shockingly good at winning... at being a terrible default. 🚩🤣
    charlesazam.com/blog/fable-5-g #Fable5 #GPT5.6 #AIshowdown #NPHardProblems #TechExposé #HackerNews #ngated

  11. RT @enzo_gte: I've been using Kimi K3 for ~16 hours now. The model is clearly good at a lot of different things (especially frontend), but non obvious reason why people are enjoying it so much is that it clearly does not follow the same rules in terms of safeguards and copyright. Kimi will happily clone MacOSX. If you ask it to help you improve another AI model, it will do it with a smile on its virtual face. Ask Fable to do the same thing? It literally starts to perceive you as a criminal committing a war crime (like no bro, all I want to do is fine tune an open source model). After using all three recent releases, Fable, GPT 5.6, and now Kimi, it's clear that the full power of the models has been significantly held back by the safeguard restrictions caused by last months debacle with the USG -- leading to the top models being quite literally lobotomized in some areas, which leads to subpar results as the safeguards pollute its entire thinking and problem solving abilities. The funny part? Is that you could have predicted this outcome 2-3 years ago when you started to see the rise of Chinese EVs and smartphones compared to western alternatives. They quite literally tried to copy the Tesla Model S and iPhone as hard as possible and then eventually it started to diverge to the point where their EVs and phones are just genuinely better (which is why we have export controls banning their EVs, because they would literally drive all US manufacturers to ZERO) There is a very clear behavior difference in Chinese capitalism and American capitalism. American capitalism tries to protects copyright…

    mehr auf Arint.info

    #go #GPT5 #nitter #opensource #science #Tesla #things #US #arint_info

    https://x.com/enzo_gte/status/2078102070482153717#m

  12. OpenAI stworzyło AI do hakowania własnej AI. Tak powstał bezpieczniejszy GPT-5.6 Sol

    Walka o bezpieczeństwo i odporność modeli językowych wchodzi w fazę pełnej automatyzacji. OpenAI oficjalnie zaprezentowało swój najnowszy, wewnętrzny projekt – GPT-Red.

    To zaawansowany system sztucznej inteligencji, którego jedynym zadaniem jest bezlitosne atakowanie, łamanie zabezpieczeń i szukanie podatności w innych modelach firmy. Przy okazji tego ogłoszenia OpenAI ujawniło, że GPT-Red był kluczowym elementem treningu GPT-5.6 Sol, co pozwoliło stworzyć model o niespotykanej dotąd odporności na cyberataki.

    Dla nas, użytkowników końcowych i programistów wdrażających rozwiązania AI, to kluczowy zwrot akcji. Ręczne testowanie zabezpieczeń przez ludzi (tzw. red-teaming) przestało się skalować i nie nadąża za tempem rozwoju algorytmów. Bezpieczeństwo przyszłych asystentów AI, z którymi będziemy rozmawiać na co dzień, będzie projektowane i testowane niemal w całości przez inne maszyny.

    Maszyna kontra maszyna, czyli metoda „self-play”

    Dotychczasowe metody zabezpieczania modeli opierały się na pracy zespołów ludzkich specjalistów, którzy próbowali przechytrzyć algorytm za pomocą tzw. prompt injection (podatności pozwalających na przejęcie kontroli nad modelem za pomocą sprytnych instrukcji). Proces ten był jednak powolny, kosztowny i nie pozwalał na wygenerowanie wystarczającej ilości danych do skutecznego treningu obronnego.

    OpenAI rozwiązało ten problem, wdrażając metodę self-play (samodzielnej gry), znaną wcześniej z nauki gry w szachy czy Go przez komputery. W tym zamkniętym środowisku naprzeciwko siebie stają dwa systemy:

    • Agresor (GPT-Red): otrzymuje nagrodę za każde skuteczne oszukanie i złamanie zabezpieczeń drugiego modelu,
    • Obrońca (testowany model): zdobywa punkty za poprawne wykonanie zadania i zignorowanie złośliwych instrukcji.

    W miarę jak obrońca uczy się blokować znane ataki, agresor jest zmuszony do wymyślania coraz bardziej wyrafinowanych metod infiltracji. GPT-Red okazał się w tym fachu niezwykle skuteczny – w testach bezpieczeństwa osiągnął aż 84% skuteczności w przełamywaniu zabezpieczeń, podczas gdy doświadczeni, ludzcy audytorzy na tych samych zadaniach osiągali zaledwie 13%.

    GPT-5.6 Sol, czyli odporność na nowym poziomie

    Współczesne systemy AI są podatne na ataki pośrednie – złośliwy kod lub instrukcja mogą być ukryte w mailu, na stronie internetowej, w bazie danych, do której model ma dostęp, czy nawet w pozornie niewinnym obrazku w formacie PNG. Dzięki sparingom z GPT-Red model GPT-5.6 Sol stał się znacznie bardziej odporny na próby manipulacji.

    Badacze ukryli instrukcje w obrazku PNG. Sztuczna inteligencja wykonała polecenia

    Według danych OpenAI model ten notuje aż sześciokrotnie mniej błędów i naruszeń zasad bezpieczeństwa na najtrudniejszych benchmarkach w porównaniu do wersji GPT z początku roku. Co ważne, tak drastyczne podniesienie odporności nie wpłynęło negatywnie na ogólne możliwości intelektualne i kreatywne modelu. Nie stał się on również nadgorliwy w odmawianiu wykonywania poprawnych i bezpiecznych poleceń użytkownika.

    Hakowanie automatów z przekąskami

    Aby udowodnić potęgę GPT-Red, naukowcy z OpenAI przeprowadzili symulację ataku na rzeczywiste urządzenie – inteligentny automat z przekąskami sterowany przez autonomicznego agenta AI. Bez wcześniejszej wiedzy o strukturze oprogramowania, GPT-Red zdołał w pełni przejąć kontrolę nad maszyną.

    W wyniku udanego ataku cyfrowy agresor zmusił automat do obniżenia ceny najdroższych produktów do zaledwie 50 centów, zamówił drogą paczkę z rabatem, a na koniec anulował zamówienie innego, losowego klienta. Wykryte w ten sposób luki bezpieczeństwa zostały natychmiast zgłoszone i są obecnie łatane przed wdrożeniem takich systemów do powszechnego użytku.

    Najciekawsze w całej historii nie jest jednak to, że AI nauczyła się hakować inną AI. Najciekawsze jest to, że po raz pierwszy możemy obserwować, jak jedna generacja modeli staje się aktywnym narzędziem do projektowania kolejnej. Jeszcze niedawno dominowały obawy przed 'chowem wsobnym’ modeli uczonych na danych generowanych przez AI. Tymczasem OpenAI pokazuje zupełnie inne podejście: sztuczna inteligencja nie zastępuje człowieka w tworzeniu wiedzy, lecz pomaga znaleźć słabości, których człowiek mógłby nie zauważyć.

    OpenAI deklaruje, że opublikuje pre-print zawierający więcej szczegółów w nadchodzących dniach.

    #bezpieczeństwoAI #cyberbezpieczeństwo #GPT5 #GPT56Sol #GPTRed #OpenAI #promptInjection #selfPlay #sztucznaInteligencja
  13. @theot3gg

    I can't believe they released this

    "As much as I love GPT 5.6, Ultra mode is a MESS because at the moment..."

    youtube.com/watch?v=t8hfOyF4ehw

    #AI #GPT5.6 #OpenAI

    7/15/26