home.social

#gptoss — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #gptoss, aggregated by home.social.

  1. Local LLM Arena #7
    Na początku GPT-OSS-20B zrobił na mnie bardzo dobre wrażenie. W benchmarku codingowym zremisował z Qwenem, a przy tym działał około 5 razy szybciej. Dlatego chciałem sprawdzić, jak poradzi sobie nie z krótkimi zadaniami, ale z normalną pracą nad kodem.
    Przygotowałem 5 praktycznych zadań, w których model musiał sam znaleźć problem w projekcie, zmienić kod i przejść testy.
    Wynik końcowy: 0/5.
    Sprawdziłem to jeszcze osobnym audytem, bo po wcześniejszych problemach z samym środowiskiem nie chciałem niesprawiedliwie obwiniać modelu. Tym razem jednak test przebiegł prawidłowo i wynik się potwierdził.
    Model może wyglądać bardzo dobrze w benchmarku, a znacznie gorzej radzić sobie wtedy, gdy musi przez dłuższą chwilę samodzielnie pracować nad prawdziwym projektem.
    GPT-OSS nadal jest szybki i ciekawy, ale jako lokalny zamiennik narzędzi, których używam do codziennego programowania, na razie mnie nie przekonał.
    Kolejnych modeli nie będę już testował. Czekają na mnie następne projekty, więc na razie zostaję przy Codex i Antigravity.
    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #GPTOSS #Coding #OpenSourceAI

  2. Local LLM Arena #7
    Na początku GPT-OSS-20B zrobił na mnie bardzo dobre wrażenie. W benchmarku codingowym zremisował z Qwenem, a przy tym działał około 5 razy szybciej. Dlatego chciałem sprawdzić, jak poradzi sobie nie z krótkimi zadaniami, ale z normalną pracą nad kodem.
    Przygotowałem 5 praktycznych zadań, w których model musiał sam znaleźć problem w projekcie, zmienić kod i przejść testy.
    Wynik końcowy: 0/5.
    Sprawdziłem to jeszcze osobnym audytem, bo po wcześniejszych problemach z samym środowiskiem nie chciałem niesprawiedliwie obwiniać modelu. Tym razem jednak test przebiegł prawidłowo i wynik się potwierdził.
    Model może wyglądać bardzo dobrze w benchmarku, a znacznie gorzej radzić sobie wtedy, gdy musi przez dłuższą chwilę samodzielnie pracować nad prawdziwym projektem.
    GPT-OSS nadal jest szybki i ciekawy, ale jako lokalny zamiennik narzędzi, których używam do codziennego programowania, na razie mnie nie przekonał.
    Kolejnych modeli nie będę już testował. Czekają na mnie następne projekty, więc na razie zostaję przy Codex i Antigravity.
    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #GPTOSS #Coding #OpenSourceAI

  3. Local LLM Arena #7
    Na początku GPT-OSS-20B zrobił na mnie bardzo dobre wrażenie. W benchmarku codingowym zremisował z Qwenem, a przy tym działał około 5 razy szybciej. Dlatego chciałem sprawdzić, jak poradzi sobie nie z krótkimi zadaniami, ale z normalną pracą nad kodem.
    Przygotowałem 5 praktycznych zadań, w których model musiał sam znaleźć problem w projekcie, zmienić kod i przejść testy.
    Wynik końcowy: 0/5.
    Sprawdziłem to jeszcze osobnym audytem, bo po wcześniejszych problemach z samym środowiskiem nie chciałem niesprawiedliwie obwiniać modelu. Tym razem jednak test przebiegł prawidłowo i wynik się potwierdził.
    Model może wyglądać bardzo dobrze w benchmarku, a znacznie gorzej radzić sobie wtedy, gdy musi przez dłuższą chwilę samodzielnie pracować nad prawdziwym projektem.
    GPT-OSS nadal jest szybki i ciekawy, ale jako lokalny zamiennik narzędzi, których używam do codziennego programowania, na razie mnie nie przekonał.
    Kolejnych modeli nie będę już testował. Czekają na mnie następne projekty, więc na razie zostaję przy Codex i Antigravity.
    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #GPTOSS #Coding #OpenSourceAI

  4. Local LLM Arena #7
    Na początku GPT-OSS-20B zrobił na mnie bardzo dobre wrażenie. W benchmarku codingowym zremisował z Qwenem, a przy tym działał około 5 razy szybciej. Dlatego chciałem sprawdzić, jak poradzi sobie nie z krótkimi zadaniami, ale z normalną pracą nad kodem.
    Przygotowałem 5 praktycznych zadań, w których model musiał sam znaleźć problem w projekcie, zmienić kod i przejść testy.
    Wynik końcowy: 0/5.
    Sprawdziłem to jeszcze osobnym audytem, bo po wcześniejszych problemach z samym środowiskiem nie chciałem niesprawiedliwie obwiniać modelu. Tym razem jednak test przebiegł prawidłowo i wynik się potwierdził.
    Model może wyglądać bardzo dobrze w benchmarku, a znacznie gorzej radzić sobie wtedy, gdy musi przez dłuższą chwilę samodzielnie pracować nad prawdziwym projektem.
    GPT-OSS nadal jest szybki i ciekawy, ale jako lokalny zamiennik narzędzi, których używam do codziennego programowania, na razie mnie nie przekonał.
    Kolejnych modeli nie będę już testował. Czekają na mnie następne projekty, więc na razie zostaję przy Codex i Antigravity.
    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #GPTOSS #Coding #OpenSourceAI

  5. Local LLM Arena #7
    Na początku GPT-OSS-20B zrobił na mnie bardzo dobre wrażenie. W benchmarku codingowym zremisował z Qwenem, a przy tym działał około 5 razy szybciej. Dlatego chciałem sprawdzić, jak poradzi sobie nie z krótkimi zadaniami, ale z normalną pracą nad kodem.
    Przygotowałem 5 praktycznych zadań, w których model musiał sam znaleźć problem w projekcie, zmienić kod i przejść testy.
    Wynik końcowy: 0/5.
    Sprawdziłem to jeszcze osobnym audytem, bo po wcześniejszych problemach z samym środowiskiem nie chciałem niesprawiedliwie obwiniać modelu. Tym razem jednak test przebiegł prawidłowo i wynik się potwierdził.
    Model może wyglądać bardzo dobrze w benchmarku, a znacznie gorzej radzić sobie wtedy, gdy musi przez dłuższą chwilę samodzielnie pracować nad prawdziwym projektem.
    GPT-OSS nadal jest szybki i ciekawy, ale jako lokalny zamiennik narzędzi, których używam do codziennego programowania, na razie mnie nie przekonał.
    Kolejnych modeli nie będę już testował. Czekają na mnie następne projekty, więc na razie zostaję przy Codex i Antigravity.
    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #GPTOSS #Coding #OpenSourceAI

  6. DES-Projekt Hochschulschriften: Unterstützung aus Frankreich

    Über das seit Dezember 2021 laufende DES-Projekt „Hochschulschriften“ des Vereins für Computergenealogie in Zusammenarbeit mit dem Max-Planck-Institut für Innovation und Wettbewerb in München berichtet der CompGen-Blog regelmäßig. Die Projektfamilie wächst dank einer französischen Bibliographie. Das Jahresverzeichnis der deutschen Hochschulschriften wurde zum 15. August 1885 vom preußischen Bildungsministerium ins Leben gerufen. Ein Auslöser dafür war, dass die französische […]

    compgen.de/2026/03/des-projekt

  7. DES-Projekt Hochschulschriften: Unterstützung aus Frankreich

    Über das seit Dezember 2021 laufende DES-Projekt „Hochschulschriften“ des Vereins für Computergenealogie in Zusammenarbeit mit dem Max-Planck-Institut für Innovation und Wettbewerb in München berichtet der CompGen-Blog regelmäßig. Die Projektfamilie wächst dank einer französischen Bibliographie. Das Jahresverzeichnis der deutschen Hochschulschriften wurde zum 15. August 1885 vom preußischen Bildungsministerium ins Leben gerufen. Ein Auslöser dafür war, dass die französische […]

    compgen.de/2026/03/des-projekt

  8. DES-Projekt Hochschulschriften: Unterstützung aus Frankreich

    Über das seit Dezember 2021 laufende DES-Projekt „Hochschulschriften“ des Vereins für Computergenealogie in Zusammenarbeit mit dem Max-Planck-Institut für Innovation und Wettbewerb in München berichtet der CompGen-Blog regelmäßig. Die Projektfamilie wächst dank einer französischen Bibliographie. Das Jahresverzeichnis der deutschen Hochschulschriften wurde zum 15. August 1885 vom preußischen Bildungsministerium ins Leben gerufen. Ein Auslöser dafür war, dass die französische […]

    compgen.de/2026/03/des-projekt