#programowanieai — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #programowanieai, aggregated by home.social.
-
Google przyznaje się do słabości w AI i stawia wszystko na Gemini 4
Miał być wielki czerwcowy debiut Gemini 3.5 Pro, a wyszło przesuwanie premiery i szczere przyznanie się do błędu.
Sundar Pichai potwierdził, że Google wciąż ustępuje konkurencji w kluczowej kwestii, jaką jest autonomiczne tworzenie kodu przez sztuczną inteligencję. Odpowiedzią na te problemy ma być uruchomienie potężnego, najambitniejszego w historii firmy procesu treningowego dla nowej generacji – Gemini 4.
Przyznanie się do błędu na spotkaniu z inwestorami
Podczas prezentacji wyników finansowych Alphabetu za drugi kwartał 2026 roku szef Google zaprezentował rzadko spotykaną u liderów rynku samokrytykę. Pytany o pozycję firmy w wyścigu technologicznym, Pichai wprost wskazał obszary, w których gigant z Mountain View musi nadrobić zaległości.
Największą bolączką amerykańskiego koncernu okazuje się programowanie oraz tzw. agentic coding, czyli samodzielne tworzenie i edytowanie kodu przez AI. To właśnie te wyzwania stoją za opóźnieniem oczekiwanego modelu Gemini 3.5 Pro, który miał trafić do użytkowników i partnerów już w ubiegłym miesiącu.
Dla czytelników oznacza to prosty sygnał: wyścig na rynku AI jest dziś tak zacięty, że nawet rynkowi giganci wolą zaliczyć wizerunkową wpadkę z przesunięciem premiery, niż wypuścić produkt niedopracowany.
Gigantyczna baza i nowe priorytety dla nowej generacji
Ucieczką do przodu ma być model Gemini 4. Google oficjalnie rozpoczęło już wstępny trening nowej architektury, określając go mianem „najbardziej ambitnego w historii firmy”. Pichai podkreślił, że utrzymanie pozycji w ścisłej czołówce wymaga stworzenia znacznie większego modelu bazowego niż dotychczas.
Aby to osiągnąć, Google przekierowuje ogromną część własnych mocy obliczeniowych i autorskich chipów TPU na rozwój nowej generacji. Priorytetem dla Gemini 4 ma być nie tylko ogólna sprawność językowa, ale przede wszystkim przewaga w złożonych zadaniach programistycznych i obsłudze autonomicznych agentów.
Nowa strategia: stały dopływ mniejszych modeli
Obecnie flagowy model Gemini 3.5 Pro pozostaje w fazie zamkniętych testów z partnerami i zadebiutuje dopiero wtedy, gdy będzie w pełni gotowy. Z kolei debiutu przełomowego Gemini 4 analitycy spodziewają się najwcześniej pod koniec roku.
Zanim to nastąpi, Google próbuje utrzymać uwagę rynku i deweloperów lżejszymi narzędziami. Firma ogłosiła przejście na niemal miesięczny cykl wydawniczy i wprowadziła do oferty mniejsze warianty, takie jak Gemini 3.6 Flash, 3.5 Flash-Lite oraz wyspecjalizowany model 3.5 Flash Cyber.
Mają one zapewnić biznesowi szybsze i tańsze przetwarzanie danych, podczas gdy inżynierowie Google DeepMind pracują nad odzyskaniem pozycji lidera w kategorii najpotężniejszych systemów AI.
#Gemini35Pro #Gemini4 #Google #programowanieAI #SundarPichai #sztucznaInteligencja
-
Chiński Kimi K3 rzuca wyzwanie amerykańskiej dominacji. Trzy biliony parametrów w otwartym kodzie
Na rynku sztucznej inteligencji doszło do poważnego przetasowania, które kwestionuje dotychczasowe założenia Zachodu o technologicznej wyższości Doliny Krzemowej.
Chiński startup Moonshot AI zaprezentował swój najnowszy zaawansowany model językowy – Kimi K3. To wielkoskalowa jednostka licząca aż 2,8 biliona parametrów, która według pierwszych niezależnych testów może realnie rywalizować z amerykańskimi liderami, takimi jak OpenAI czy Anthropic.
Dla całego ekosystemu AI ta premiera to punkt zwrotny. Po raz pierwszy model tej klasy nie został zamknięty za płatną subskrypcją i korporacyjnym API. Fakt, że Kimi K3 trafia na rynek jako oprogramowanie open-source, oznacza, że zewnętrzni programiści z całego świata będą mogli bezpłatnie pobrać, modyfikować i uruchamiać to narzędzie na własnej infrastrukturze. Taki krok może stanowić poważne wyzwanie dla komercyjnego modelu biznesowego firm z USA.
Skala modelu a rzeczywiste możliwości
Sam rozmiar na poziomie niemal trzech bilionów parametrów robi wrażenie, choć w nowoczesnych strukturach AI czysta wielkość nie jest już jedynym wyznacznikiem sukcesu. Moonshot AI zaprojektowało system tak, aby wymagał minimalnego nadzoru ze strony człowieka podczas wykonywania złożonych zadań inżynieryjnych. Pełne spektrum możliwości Kimi K3 w codziennej pracy z kodem i zaawansowaną logiką poznamy pod koniec miesiąca, kiedy wagi modelu zostaną oficjalnie uwolnione.
Wysokie oceny w niezależnych benchmarkach
Wstępne analizy rynkowe pokazują, że chińscy inżynierowie wykonali ogromny skok jakościowy. Ślepe testy konsumenckie przynoszą zaskakujące rezultaty:
- Wysoka pozycja w programowaniu: w testach preferencji platformy Arena.ai, Kimi K3 zajął czołowe miejsce w kategorii inżynierii interfejsów webowych.
- Rywalizacja z zachodnią czołówką: oceny przeprowadzone m.in. przez Artificial Analysis wskazują, że model pod względem analizy danych i wyciągania wniosków radzi sobie na poziomie porównywalnym z najpopularniejszymi systemami z USA.
- Wpływ na giełdę: informacja o premierze wywołała natychmiastową panikę na rynku azjatyckim – akcje bezpośrednich, lokalnych konkurentów Moonshot AI (firm Zhipu i MiniMax) tąpnęły w Hongkongu o odpowiednio 27% i 16%.
Geopolityczne tło i omijanie barier
Premiera Kimi K3 przypada na niezwykle napięty moment w globalnym sektorze technologicznym. Zaledwie kilka tygodni wcześniej rząd USA, zasłaniając się krytycznym bezpieczeństwem narodowym, zmusił firmę Anthropic do tymczasowego wycofania swoich flagowych modeli Fable i Mythos z powodu wykrytych luk w zabezpieczeniach. Pokazuje to, jak restrykcyjnie Waszyngton traktuje oprogramowanie klasy frontier, nakładając na nie surowe kontrole eksportowe.
Szybki debiut tak złożonego systemu z Chin udowadnia jednak, że tamtejsze podmioty – silnie wspierane przez technologicznych gigantów Alibaba oraz Tencent – rozwijają się niezależnie, skutecznie omijając amerykańskie blokady dotyczące sprzedaży zaawansowanego sprzętu obliczeniowego.
Kod źródłowy Kimi K3 zostanie udostępniony 27 lipca 2026 roku. Choć uruchomienie modelu z otwartymi wagami o tej wielkości będzie wymagało od zewnętrznych deweloperów ogromnego zaplecza sprzętowego, sam fakt oddania go społeczności diametralnie zmienia zasady gry w wyścigu o dominację nad generatywną sztuczną inteligencją.
#KimiK3 #modeleJęzykowe #MoonshotAI #openSource #programowanieAI #rynekTechnologicznyWChinach #sztucznaInteligencja
-
Premiera Claude Sonnet 5. Nowy model Anthropic przynosi autonomiczną rewolucję bez dopłat
Zamiast kolejnych marketingowych obietnic o „inteligentnych asystentach”, na rynek trafia technologia, która podobno realnie potrafi wyręczyć człowieka w żmudnej pracy przed ekranem.
Firma Anthropic oficjalnie zaprezentowała model Claude Sonnet 5, który od dziś staje się standardem dla wszystkich użytkowników platformy. Zamiast po prostu generować tekst, system ten potrafi samodzielnie planować działania, obsługiwać terminal oraz pisać kod na poziomie, który jeszcze kilka miesięcy temu wymagał najdroższych rozwiązań serwerowych.
Duża autonomia w cenie podstawowego pakietu
W nomenklaturze Anthropic linia Sonnet to modele średniej wielkości, plasujące się między lekkim Haiku a najbardziej zaawansowanym Opus. Najnowsza, piąta generacja jednak skraca ten dystans. Z opublikowanych wykresów i testów wynika, że Sonnet 5 pod względem czystej wydajności i logicznego rozumowania niemal zrównuje się z flagowym modelem Opus 4.8, oferując przy tym znacznie niższą cenę i wyższą kulturę pracy.
Model został zaprojektowany z myślą o tak zwanym działaniu agentowym (ang. agentic workflows). W praktyce oznacza to, że potrafi on samodzielnie realizować złożone, wieloetapowe zadania, automatycznie weryfikować własne błędy i korzystać z zewnętrznych narzędzi systemowych, takich jak przeglądarki czy wiersz poleceń. W wymagającym teście programistycznym SWEbench-Pro nowy Sonnet osiągnął wynik 63,2%, deklasując swojego poprzednika (Sonnet 4.6) i udowadniając, że potrafi utrzymać kontekst nawet w trudnym środowisku technicznym.
Wyższa kultura bezpieczeństwa i atrakcyjny cennik
Co niezwykle istotne w kontekście komercyjnym, Claude Sonnet 5 trafia od dziś na stałe do wszystkich planów taryfowych, stając się domyślnym silnikiem zarówno dla użytkowników darmowych (Free), jak i subskrybentów pakietu Pro czy rozwiązań korporacyjnych [source: 3]. Dla programistów i twórców platform przygotowano specjalny, promocyjny cennik API obowiązujący do 31 sierpnia 2026 roku, który wynosi zaledwie 2 dolary za milion tokenów wejściowych oraz 10 dolarów za wyjściowe.
Duży nacisk położono również na rzetelne systemy ochrony. Testy bezpieczeństwa wykazały, że Sonnet 5 wykazuje znacznie mniejszą skłonność do halucynacji i ulegania atakom typu prompt injection niż wersja 4.6. Jednocześnie model posiada fabrycznie włączone, działające w czasie rzeczywistym blokady przed złośliwym wykorzystaniem w zadaniach hakerskich. Jego skuteczność w tworzeniu niebezpiecznych exploitów (na przykład dla przeglądarki Firefox 147) została celowo ograniczona do zaledwie kilkunastu procent, pozostawiając zaawansowane analizy odporności sieciowej domeną modeli Opus 4.8 oraz specjalistycznego Mythos 5.
#Anthropic #automatyzacja #bezpieczeństwoIT #ClaudeSonnet5 #modeleJęzykowe #programowanieAI #sztucznaInteligencja
-
Google Antigravity samodzielnie napisze i wdroży twoją aplikację
Sztuczna inteligencja coraz śmielej wkracza w świat inżynierii oprogramowania. Google właśnie zaprezentowało dużą aktualizację swojego środowiska AI Studio.
Nowy agent kodujący o nazwie Antigravity przestaje być tylko inteligentnym asystentem podpowiadającym fragmenty kodu. Od teraz potrafi samodzielnie zbudować pełnoprawną, nowoczesną aplikację webową, łącznie z podpięciem bazy danych i systemem logowania.
Branża technologiczna od dłuższego czasu zachłystuje się koncepcją generowania interfejsów za pomocą naturalnych poleceń (promptów). Jednak do tej pory narzędzia tego typu zazwyczaj tworzyły ładne, ale statyczne makiety. Google postanowiło pójść o krok dalej. Ich zaktualizowane środowisko AI Studio pozwala na stworzenie kompletnego produktu – od pomysłu do wdrożenia – bez opuszczania okna przeglądarki.
Pełnoprawny backend bez pisania linijki kodu
Największą innowacją w ogłoszonym systemie jest głęboka integracja z platformą Firebase. Agent Antigravity potrafi teraz proaktywnie wykryć, że nasz projekt wymaga przechowywania danych lub uwierzytelniania użytkowników.
Po zatwierdzeniu przez twórcę, sztuczna inteligencja samodzielnie konfiguruje bazę danych Cloud Firestore oraz podpina moduł Firebase Authentication (pozwalający m.in. na bezpieczne logowanie kontem Google). To obniża próg wejścia dla osób, które mają świetny pomysł na aplikację, ale brakuje im wiedzy z zakresu budowy i zabezpieczania architektury backendowej.
Nowoczesne frameworki i obsługa zewnętrznych API
Google zadbało o to, by wygenerowany kod spełniał współczesne standardy. Oprócz wsparcia dla Reacta i Angulara, środowisko natywnie obsługuje teraz popularny framework Next.js. Agent doskonale radzi sobie z ekosystemem nowoczesnych narzędzi webowych – jeśli poprosimy o płynne animacje lub profesjonalny interfejs, sztuczna inteligencja sama zainstaluje odpowiednie biblioteki (jak Framer Motion czy Shadcn).
Co więcej, Antigravity pozwala na łączenie aplikacji z zewnętrznymi usługami. Deweloperzy mogą wprowadzić własne klucze API (np. do procesorów płatności czy map), a system bezpiecznie przechowa je w nowym, wbudowanym menedżerze poświadczeń (Secrets Manager).
Od prototypu do gotowego produktu
Dzięki rozszerzonej pamięci kontekstowej, agent znacznie lepiej rozumie strukturę całego projektu. Pozwala to na iteracyjne budowanie nawet bardzo skomplikowanych narzędzi, takich jak chociażby aplikacje z synchronizacją w czasie rzeczywistym (np. proste gry wieloosobowe czy narzędzia do wspólnej pracy). Nowy system zapisuje również sesje, pozwalając na swobodne zamknięcie przeglądarki i powrót do pracy w dowolnym momencie.
Choć Google używa w swojej komunikacji modnego określenia „vibe coding”, w rzeczywistości dostarcza na rynek potężne narzędzie pracy. Antigravity to wyraźny sygnał, że gigant z Mountain View nie zamierza oddać pola w wyścigu o portfele deweloperów, w którym do tej pory mocno rozpychały się narzędzia takie jak Cursor czy GitHub Copilot.
#agentAntigravity #AIWProgramowaniu #FirebaseIntegracja #generatorAplikacjiWebowych #GoogleAIStudio #GoogleCloud #NextJsAI #programowanieAI #sztucznaInteligencjaDlaDeweloperów #vibeCodingApple wykorzysta Gemini od Google do tworzenia własnych modeli AI offline
-
AWS rzuca wyzwanie Copilotowi. Kiro już dostępne, a startupy dostaną je za darmo
Amazon Web Services (AWS) oficjalnie ogłosił ogólną dostępność Kiro – swojego zaawansowanego asystenta AI dla programistów.
Narzędzie, które ma konkurować z GitHub Copilotem, wyróżnia się unikalnym podejściem do generowania kodu opartym na specyfikacjach. Co ważne, wybrane startupy mogą korzystać z najdroższej wersji narzędzia przez rok zupełnie bezpłatnie.
Kiro nie jest tylko wtyczką do IDE. Działa również w terminalu (CLI), co jest kluczowe dla inżynierów DevOps i backendowców. Narzędzie jest napędzane przez potężne modele, w tym Claude Sonnet 4.5, Claude Haiku 4.5 oraz autorski model „Auto”, który dobiera silnik do zadania.
Koniec ze „zgadywaniem” kodu? Podejście Spec-Driven
To, co odróżnia Kiro od konkurencji, to metodologia spec-driven development. Zamiast generować kod „na ślepo” z prostego prompta, Kiro najpierw wymaga zdefiniowania dokładnych wymagań (specyfikacji). Dopiero na ich podstawie tworzy, testuje i wdraża kod.
AWS chwali się, że ich własny zespół użył Kiro do wdrożenia funkcjonalności w 2 dni zamiast planowanych 2 tygodni.
Testy, które przewidują setki scenariuszy
Nowością w wersji finalnej jest property-based testing. Tradycyjne testy sprawdzają jeden scenariusz (np. „czy dodało produkt do koszyka”). Kiro generuje automatycznie setki wariantów.
Jak wyjaśnia Tomasz Stachlewski, dyrektor ds. architektury w AWS:
„Property-based testing w Kiro sprawdzi setki różnych scenariuszy – czy system prawidłowo zarządza statusami samochodów w bazie danych (…), czy właściwie waliduje dane przy różnych kombinacjach parametrów wyszukiwania”.
Oferta dla startupów: rok za darmo
AWS walczy o rynek agresywną promocją. Startupy (do poziomu finansowania Series B) mogą otrzymać do 100 licencji Kiro Pro+ za darmo na okres jednego roku. Program potrwa do 31 grudnia 2025 roku.
#asystentAiDlaProgramistow #awsKiro #claudeSonnet45 #darmoweLicencjeAws #news #programowanieAi #specDrivenDevelopment #startupy
-
OpenAI wprowadza Codex – autonomicznego agenta AI do kodowania w ChatGPT
OpenAI ogłosiło wprowadzenie Codex, zaawansowanego agenta AI do kodowania, dostępnego w ramach ChatGPT.
Narzędzie, oparte na modelu codex-1 (ulepszonej wersji modelu rozumowania o3), zostało zaprojektowane dla doświadczonych programistów, umożliwiając automatyzację prostych zadań programistycznych, takich jak pisanie kodu, naprawa błędów czy testowanie. Codex działa w chmurze, w izolowanych kontenerach odzwierciedlających środowisko programistyczne użytkownika, z możliwością integracji z repozytoriami GitHub.
OpenAI szykuje rewolucję w generowaniu obrazów: ChatGPT z nowym modelem i integracją z Adobe Figma
Codex wyróżnia się zdolnością do jednoczesnego wykonywania wielu zadań, które mogą trwać od 1 do 30 minut, w zależności od ich złożoności. Agent pokazuje swoje kroki i przemyślenia, co zwiększa przejrzystość i ułatwia debugowanie. OpenAI podkreśla, że kod generowany przez Codex wymaga ręcznej weryfikacji przed użyciem w produkcji, odpowiadając na obawy dotyczące jakości i bezpieczeństwa kodu AI.
Narzędzie jest dostępne w fazie podglądu badawczego dla subskrybentów ChatGPT Pro, Enterprise i Team, z planami rozszerzenia na użytkowników Plus i Edu. W początkowym okresie dostęp jest bezpłatny, ale wkrótce pojawią się limity i nowa struktura cenowa.
OpenAI pozycjonuje Codex jako krok w kierunku autonomicznych agentów AI, które mogą działać jak wirtualni współpracownicy. Firma twierdzi, że Codex jest już używany wewnętrznie do rutynowych zadań, takich jak refaktoryzacja czy pisanie testów, co przyspiesza pracę programistów.
#agenciAI #AI #Codex #news #OpenAI #programowanieAI #programująceAI #sztucznaInteligencja