home.social

#asystentai — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #asystentai, aggregated by home.social.

fetched live
  1. Sztuczna inteligencja na Wimbledonie wytłumaczy ci, co dzieje się na korcie

    Oglądanie sportowych statystyk w aplikacjach przypominało do tej pory analizowanie skomplikowanego arkusza kalkulacyjnego. Organizatorzy Wimbledonu postanowili z tym skończyć, integrując swoje platformy cyfrowe z nowymi, narzędziami sztucznej inteligencji.

    Oficjalna aplikacja turniejowa nie tylko poda ci suchy wynik, ale płynnie wyjaśni w naturalnym języku, dlaczego dany punkt zadecydował o losach spotkania.

    Najstarszy i najbardziej prestiżowy turniej tenisowy na świecie zderza się z najnowszą technologią. Wraz ze startem pierwszych meczów tegorocznej edycji, do aplikacji mobilnej oraz na stronę internetową Wimbledonu trafiły nowe funkcje napędzane przez modele IBM watsonx. To potężna rewolucja dla fanów, ponieważ system całkowicie zmienia sposób interakcji z danymi sportowymi w czasie rzeczywistym.

    Asystent w smartfonie i analiza punktów zwrotnych

    Największą innowacją jest zaktualizowany asystent Match Chat, który pozwala kibicom na zadawanie pytań naturalnym językiem. Zamiast gorączkowo przebijać się przez tabele z procentem udanych serwisów, użytkownik może po prostu zapytać o to, co wydarzyło się do tej pory na korcie. W odpowiedzi otrzyma spójną, tekstową analizę wzbogaconą o najciekawsze zdjęcia i powtórki wideo, wygenerowaną na żywo w zaledwie kilka sekund.

    Równie intrygująco wypada funkcja Key Moments, która na bieżąco diagnozuje dynamikę każdego pojedynku. Algorytmy nie wyłapują jedynie ładnych zagrań, ale precyzyjnie wskazują momenty – takie jak wyjątkowo długa wymiana czy pechowy podwójny błąd serwisowy – które drastycznie zmieniają prawdopodobieństwo wygranej danego zawodnika. To pozwala zrozumieć, co faktycznie dzieje się w głowach tenisistów i jak ułamek sekundy wpływa na losy całego meczu.

    Dekada pracy deweloperskiej skompresowana do kilku miesięcy

    Za kulisami tej kibicowskiej wygody kryje się imponujący, inżynieryjny wyczyn. Odświeżenie cyfrowej platformy Wimbledonu wymagało zmapowania potężnego archiwum, liczącego ponad 15 tysięcy cyfrowych zasobów. Praca, która tradycyjnie zajęłaby sztabowi specjalistów wiele miesięcy, została wykonana przez jednego inżyniera w zaledwie cztery tygodnie przy pomocy sztucznej inteligencji.

    Jak podają przedstawiciele IBM, wykorzystanie zaawansowanych asystentów kodowania pozwoliło skompresować szacowane na 10 lat prace deweloperskie do zaledwie dziewięciu miesięcy. To namacalny dowód na to, że sztuczna inteligencja nie jest już tylko branżową ciekawostką dla użytkowników końcowych, ale bezlitośnie skutecznym budowniczym nowej cyfrowej infrastruktury.

    #analitykaSportowa #aplikacjaWimbledon #asystentAI #IBMWatsonx #sztucznaInteligencjaWSporcie #technologieMobilne #tenisNażywo
  2. Pixel podsłucha każdą rozmowę. Google szykuje funkcję „Audio Memory”, ale w Europie to prawny koszmar

    Dopiero co informowaliśmy o zmianach w zapisywaniu multimediów przez wyszukiwarkę Google, a w kodzie systemu Android właśnie odkryto znacznie bardziej radykalną funkcję.

    Amerykański gigant przygotowuje rozwiązanie „Audio Memory”, które ma stale monitorować otoczenie użytkownika i zapisywać wszystko – od piosenek po prywatne konwersacje. Choć to wielki krok w stronę wszechwiedzącego asystenta AI, europejskie przepisy o ochronie prywatności mogą zatrzymać tę nowość na granicy.

    Całodobowy nasłuch z myślą o notatkach AI

    Funkcja oznaczona w kodzie systemu jako „blueflax” została odnaleziona w najnowszej wersji narzędzia Android System Intelligence dla smartfonów Pixel. Oficjalne linijki kodu wprost opisują jej cel: narzędzie ma śledzić wszystko, co słyszysz w ciągu dnia. Rozwiązanie to ma działać na podobnej zasadzie, co fizyczne dyktapony AI zintegrowane z modelami językowymi. Ich zadaniem jest rejestrowanie spotkań na żywo, tworzenie dokładnych transkrypcji, a następnie generowanie na ich podstawie zwięzłych notatek.

    Google próbuje jednak tonować nastroje związane z prywatnością. Przetwarzanie całego zebranego dźwięku ma odbywać się w pełni lokalnie, bez jakiegokolwiek udziału chmury. Całość będzie oparta na bezpiecznej architekturze Private Compute Core, co w praktyce oznacza, że tło dźwiękowe oraz treść naszych prywatnych rozmów nigdy nie trafią na zewnętrzne serwery korporacji.

    Unijne przepisy kontra ambicje Doliny Krzemowej

    Dla europejskich organów regulacyjnych lokalne przetwarzanie danych to jednak o wiele za mało. Sam fakt, że system operacyjny w sposób ciągły analizuje i kataloguje ludzki głos bez aktywnego wywołania, kwalifikuje się jako przetwarzanie danych wrażliwych. Unijne rozporządzenie RODO jest w tej kwestii bezwzględne – na tego typu nasłuch użytkownik musi wyrazić jednoznaczną, uprzednią zgodę.

    Prawdziwym prawnym koszmarem jest jednak problem osób trzecich. Nawet jeśli właściciel Pixela zgodzi się na monitorowanie otoczenia, to jego znajomi, współpracownicy czy przypadkowy kelner w restauracji takiej zgody nie wyrazili. W świetle polskiego prawa pasywne nagrywanie i transkrypcja głosów osób postronnych bez ich wiedzy to rażące naruszenie dóbr osobistych.

    Muzyczna baza danych i niepewna przyszłość w Polsce

    Nowe narzędzie Google wchłonie również dotychczasową funkcję „Co gra?” (Now Playing). Oprócz rozpoznawania utworów granych na żywo w sklepie czy radiu, system zyska opcję monitorowania muzyki odtwarzanej z innych aplikacji bezpośrednio na telefonie, tworząc jedną, potężną historię tego, czego słuchaliśmy w ciągu dnia.

    Czy pełne „Audio Memory” trafi na polskie Pixele? Pamiętając potężne opóźnienia we wdrożeniu Apple Intelligence w Unii Europejskiej ze względu na restrykcyjny Akt o rynkach cyfrowych (DMA), plany Google mogą ulec poważnej zmianie. Najbardziej prawdopodobny scenariusz to całkowita blokada modułu nagrywania rozmów w Europie lub udostępnienie mocno okrojonej wersji, skupiającej się wyłącznie na bezpiecznym identyfikowaniu piosenek.

    Pixele od Google nie otrzymają interfejsu inspirowanego „Liquid Glass”

    #Android #asystentAI #AudioMemory #GooglePixel #podsłuchiwanieRozmów #prywatnośćWSieci #RODO #sztucznaInteligencja #UniaEuropejska
  3. Spotify rzuca wyzwanie Google. Projekt Studio stworzy prywatny podcast z Twojego życia

    Podczas konferencji Investor Day 2026 w Nowym Jorku, nowi dyrektorzy generalni Spotify, Alex Norström oraz Gustav Söderström, zaprezentowali nową strategię rozwoju platformy, która ma przenieść serwis z ery kurateli i rekomendacji do ery generatywnej.

    Najważniejszym punktem ogłoszenia była prezentacja samodzielnej aplikacji desktopowej Studio by Spotify Labs. Narzędzie to bezpośrednio kopiuje i rozwija format spopularyzowany przez Google NotebookLM, umożliwiając tworzenie prywatnych, syntetycznych podcastów opartych na osobistych danych użytkownika.

    Klon NotebookLM w wersji audio-lifestyle

    Aplikacja Studio została udostępniona w fazie testowej dla wybranej grupy dorosłych użytkowników. W wersji bazowej system analizuje profil gustu muzycznego, oparty na bazie danych zwanej Large Taste Model przetwarzającej biliony codziennych sygnałów, i na podstawie komend tekstowych generuje spersonalizowane audycje z udziałem wirtualnych podcasterów. Prawdziwą zmianą technologiczną jest jednak funkcja głębokiej integracji z prywatnym życiem cyfrowym. Za zgodą klienta Studio uzyskuje stały wgląd do skrzynki e-mail, kalendarza, notatek oraz zakładek w przeglądarce internetowej.

    Pytaniem otwartym pozostaje, na ile użytkownicy będą skłonni zaufać takiej integracji. W każdym razie dzięki temu wirtualny asystent potrafi przetworzyć surowe informacje w płynną rozmowę audio, tworząc spersonalizowane przeglądy poranne, streszczenia firmowej korespondencji czy przewodniki turystyczne z uwzględnieniem rezerwacji hotelowych i propozycji restauracyjnych. Wygenerowane pliki dźwiękowe trafiają bezpośrednio do prywatnej sekcji Personal Podcasts w bibliotece Spotify, gdzie automatycznie synchronizują się między wszystkimi urządzeniami użytkownika, pozostając całkowicie niewidoczne dla reszty społeczności.

    Bariera językowa i polska rzeczywistość

    Choć aplikacja Studio to klon funkcjonalny podsumowań audio dostępnych w NotebookLM, to jednak rozwiązanie Google pozostaje górą z perspektywy użytkowników w Polsce. Oficjalne komunikaty Spotify mówią wprawdzie o uruchomieniu fazy Research Preview w ponad dwudziestu wybranych krajach w nadchodzących tygodniach, jednak analiza dotychczasowych wdrożeń firmy pozwala z dużą pewnością założyć, że Polska nie znajdzie się w pierwszej fali testów. Podobna funkcja interaktywnego czatu z podcastami jest obecnie ograniczona wyłącznie do terytorium Stanów Zjednoczonych, Irlandii oraz Szwecji.

    Główną przeszkodą jest specyfika samego formatu. Generowanie naturalnie brzmiącego dwugłosu podcasterów wymaga ogromnych zasobów językowych i perfekcyjnej syntezy mowy, która na starcie będzie zoptymalizowana wyłącznie pod język angielski. Ponadto, o ile blokady regionalne w usługach Google można stosunkowo łatwo ominąć zmianą lokalizacji w smartfonie, o tyle w przypadku Spotify weryfikacja regionalna opiera się na kraju wydania karty płatniczej przypisanej do subskrypcji Premium.

    Polscy użytkownicy mają zatem dwa wyjścia. Albo będą musieli poczekać na oficjalne wdrożenie lokalnej odmiany językowej nowych funkcji Spotify, co z racji rygorystycznych unijnych przepisów dotyczących prywatności i analizowania treści skrzynek mailowych przez algorytmy AI może potrwać wiele miesięcy, albo skorzystają z Google NotebookLM. To drugie rozwiązanie w Polsce działa doskonale, bezproblemowo przetwarzając polskie dokumenty źródłowe i w pełni obsługując generowanie wirtualnych podcastów na dowolny temat, jaki przyjdzie nam do głowy.

    Google integruje Gemini z NotebookLM. Nowa funkcja „Notatniki” ma uporządkować pracę z AI

    #asystentAI #Google #iMagazine #NotebookLM #podcasty #Software #spotify #SpotifyStudio #sztucznaInteligencja
  4. Wyciek prosto od Google. Asystent COSMO trafił na chwilę do sklepu Play

    Google zaliczyło w weekend majowy niezłą wpadkę, która zdradza plany firmy na nadchodzącą konferencję I/O 2026.

    Przez przypadek do oficjalnego sklepu Play trafiła eksperymentalna aplikacja COSMO – zaawansowany asystent AI dla urządzeń z Androidem. Choć program został bardzo szybko usunięty ze sklepu, zdążył ujawnić, jak w niedalekiej przyszłości zmieni się obsługa naszych smartfonów. Zamiast prostego czatbota, dostaniemy narzędzie, które ma aktywnie przewidywać nasze potrzeby.

    Gigabajtowa aplikacja i sztuczna inteligencja w kieszeni

    COSMO to projekt stworzony przez dział Google Research, który wylądował na głównym koncie wydawcy jako potężna paczka o wadze 1,13 GB. Taki rozmiar nie jest przypadkowy – aplikacja ma wbudowany lokalny model językowy Gemini Nano. Oznacza to, że asystent potrafi przetwarzać informacje bezpośrednio na smartfonie, bez konieczności łączenia się z chmurą.`

    W teorii to dla potencjalnego użytkownika świetna wiadomość, bo oznacza większą prywatność i błyskawiczny czas reakcji bez pożerania pakietu danych. W ustawieniach wyciekłej aplikacji użytkownicy mogli zresztą wybrać, czy chcą korzystać wyłącznie z lokalnego modelu Nano, z zewnętrznych serwerów (oznaczonych skrótem „PI”), czy z trybu hybrydowego. Program prosił również o dostęp do ekranu i pozwalał na konfigurację dopasowania głosowego (Voice Match).

    Co potrafi nowy eksperyment od Google?

    Chociaż interfejs udostępnionej aplikacji był niezwykle surowy, lista ukrytych w niej „Umiejętności” (Skills) robi ogromne wrażenie. COSMO zaprojektowano tak, by działał w tle i reagował na szerszy kontekst naszych codziennych spraw. Przykładowo, jeśli w konwersacji padnie propozycja spotkania, asystent sam zaproponuje dodanie wydarzenia do kalendarza. Z kolei wzmianka o konkretnym zdjęciu wywoła automatyczne wyszukiwanie fotografii w galerii, byśmy mogli od razu się nią podzielić, bez przerywania rozmowy.

    Na tym możliwości się nie kończą. Program ma oferować między innymi:

    • Funkcję Deep Research do zaawansowanego zbierania i podsumowywania wielu źródeł w jeden raport.
    • Opcję Recall, która ułatwia przypominanie sobie ważnych informacji.
    • Narzędzie Document Writer, które automatycznie przygotowuje dokumenty, listy i streszczenia, o których wspomnimy.
    • Automatyczne tłumaczenie trudnego żargonu i podsumowywanie zakończonych konwersacji.

    Przedwczesna premiera przed wielkim wydarzeniem

    Wypuszczenie tak zaawansowanego, ale wciąż ewidentnie testowego narzędzia dla każdego użytkownika to wypadek przy pracy. Aplikacja nie była przeznaczona dla zwykłych konsumentów i zniknęła już z serwerów. Biorąc jednak pod uwagę zbliżającą się majową konferencję Google I/O 2026, możemy być pewni, że COSMO to poligon doświadczalny. Przetestowane w nim inteligentne funkcje z dużym prawdopodobieństwem trafią niedługo do oficjalnej wersji Gemini, całkowicie redefiniując to, czego oczekujemy od smartfonów.

    Czy asystent AI może pogłębić kryzys psychiczny? Grok i Gemini oblewają test bezpieczeństwa, Claude stawia granice

    #Android #aplikacjeMobilne #asystentAI #COSMO #GeminiNano #Google #GoogleIO2026 #sztucznaInteligencja #wyciek
  5. AI już nie zgubi kontekstu. Google wprowadza Notatniki do darmowego Gemini

    Praca ze sztuczną inteligencją bywa męcząca, gdy po kilku dniach chcesz wrócić do starego projektu, a algorytm zdążył już zgubić kontekst.

    Google zaczęło właśnie wdrażać na to sensowne rozwiązanie. Funkcja tworzenia notatników, znana z projektu NotebookLM, sukcesywnie trafia do standardowej, darmowej wersji aplikacji Gemini. To jedna z najbardziej praktycznych zmian w codziennym korzystaniu z AI dla każdego, kto używa asystenta do czegoś więcej niż pisania luźnych zapytań. W praktyce oznacza to przejście z jednorazowych rozmów do długoterminowej pracy projektowej – bliższej temu, jak korzystamy z klasycznych narzędzi biurowych.

    Mała, ale kluczowa zmiana. Google nareszcie ułatwi nawigację w NotebookLM

    Twój asystent dostaje własne foldery

    Zamiast przekopywać się przez długą listę starych czatów, na bocznym pasku strony gemini.google.com z czasem pojawi się nowa zakładka „Notebooks” (lub Notatniki). To działa jak zwykłe segregatory na dokumenty – zakładasz osobne miejsce dla konkretnego tematu i wrzucasz tam wybrane rozmowy z asystentem, pliki PDF czy inne teksty.

    Co najważniejsze, w obrębie danego notatnika sztuczna inteligencja trzyma stały kontekst. Jeśli założysz projekt „Analiza rynku”, Gemini będzie czerpać wiedzę wyłącznie ze zgromadzonych tam materiałów. To spora zaleta, bo zauważalnie zmniejsza ryzyko zmyślania faktów przez algorytm. Możesz tam też na stałe zdefiniować, w jakim tonie asystent ma Ci odpowiadać.

    Limity, które w zupełności wystarczą

    Do tej pory zaawansowane organizowanie pracy było domeną płatnych subskrypcji. Teraz Google udostępnia tę funkcję bezpłatnie, pozwalając na podpięcie do 50 źródeł do jednego notatnika. Do codziennej pracy biurowej czy na studia – w sam raz. Subskrybenci planów AI Plus, Pro i Ultra mają wyższe limity (od 100 do 600 źródeł w projekcie).

    Wartością dodaną z NotebookLM jest też łatwy eksport. Na podstawie zebranych materiałów można kilkoma kliknięciami wygenerować infografikę lub krótkie podsumowanie audio lub wideo.

    Proces udostępniania nowej funkcji już się rozpoczął i obejmuje na razie przeglądarkową wersję Gemini. Właściciele aplikacji mobilnych oraz wersji na system macOS otrzymają nową sekcję w najbliższym czasie, więc jeśli jeszcze nie widzisz jej u siebie, uzbrój się w odrobinę cierpliwości.

    #AIZaDarmo #asystentAI #Gemini #Google #NotebookLM #nowościTechnologiczne #organizacjaPracy #produktywność #sztucznaInteligencja
  6. Asystent AI, który naprawdę pracuje na twoich plikach. Perplexity Personal Computer debiutuje na Macu (i przeraża ceną)

    Pamiętasz czasy, gdy asystenci sztucznej inteligencji żyli wyłącznie w chmurze i czekali, aż wpiszesz im komendę w okienku przeglądarki? To już przeszłość. Zwłaszcza gdy masz Maca i… gruby portfel.

    Twórcy Perplexity oficjalnie uruchomili zapowiadaną wcześniej funkcję Personal Computer dla komputerów Apple. Zamiast kolejnego chatbota dostajemy „wirtualnego pracownika”, który działa w tle, automatycznie przegląda lokalne pliki i integruje się z systemowymi aplikacjami macOS. Jest jednak pewien szkopuł – cena, która błyskawicznie chłodzi entuzjazm przeciętnego użytkownika.

    Od agenta w chmurze do lokalnego węzła na biurku. Perplexity idzie o krok dalej niż Apple

    Twój Mac jako autonomiczne centrum operacyjne

    Co dokładnie zmienia Personal Computer? Zamiast polegać na zewnętrznych serwerach przy prostych zadaniach, rozwiązanie przenosi ciężar operacyjny wprost na dysk twojego komputera. Aplikacja łączy się z rodzimymi programami Apple, takimi jak iMessage, Mail czy Kalendarz, uzyskując jednocześnie – zgodnie z zapewnieniami producenta – bezpieczny dostęp do lokalnych folderów. Dzięki temu może wyszukiwać, analizować, a nawet edytować dokumenty bez konieczności ręcznego „karmienia” modelu danymi.

    Prawdziwy potencjał tego środowiska ujawnia się po zainstalowaniu go na stacjonarnym Macu mini. W takiej konfiguracji sprzętowej wirtualny agent może działać w tle 24 godziny na dobę przez 7 dni w tygodniu. Świetnie wypada też integracja mobilna – jadąc pociągiem, możesz zainicjować złożone zadanie prosto z iPhone’a, a twój domowy sprzęt po prostu wykona polecenie na fizycznych plikach, każdorazowo weryfikując autoryzację przez system 2FA.

    Ekskluzywny klub za 200 dolarów miesięcznie

    Jeśli już zacierasz ręce na myśl o zautomatyzowaniu swojej codziennej biurokracji, radzę wziąć głęboki oddech. Perplexity jasno pozycjonuje swoją nowość jako potężne narzędzie dla wąskiego grona profesjonalistów.

    Pełen dostęp do funkcji Personal Computer na Maca wymaga nowej subskrypcji Perplexity Max, którą wyceniono na zaporowe 200 dolarów miesięcznie. Popularny wśród użytkowników plan Pro (za 20 dolarów) zapewnia dostęp wyłącznie do okrojonej, webowej wersji asystenta nazwanej Perplexity Computer. Tak drastyczny próg wejścia wyraźnie pokazuje, że firma celuje w zaawansowanych analityków i menedżerów, dla których oszczędność kilkudziesięciu godzin w miesiącu warta jest każdych pieniędzy.

    Perplexity Computer łączy siły Opus, Gemini oraz ChatGPT

    Ekosystem, który jest rynkowym wyzwaniem

    To śmiały ruch, który stanowi bezpośrednią rękawicę rzuconą rynkowym gigantom. Oprócz asystenta desktopowego, firma niedawno udostępniła również Comet – dedykowaną, inteligentną przeglądarkę dla użytkowników iPhone’ów i iPadów.

    Skończył się czas imponowania generowaniem wierszyków. Wchodzimy w erę asystentów typu agentic AI, gdzie system sam wykonuje ustrukturyzowaną pracę wewnątrz naszych własnych aplikacji. Perplexity pokazuje, jak to powinno działać na sprzęcie Apple, tyle że przy cenie 200 dolarów miesięcznie, dla absolutnej większości użytkowników pozostanie to wyłącznie intrygującą ciekawostką.

    #asystentAI #automatyzacjaPracy #Mac #MacMini #macOS #Perplexity #PerplexityMax #personalComputer #sztucznaInteligencja
  7. MOVA idzie dalej niż roboty sprzątające. Asystent AI przypinany do smartfona i głośniki na start

    Marka MOVA, znana do tej pory na polskim rynku z produkcji zaawansowanych urządzeń do utrzymania czystości, wykonuje zwrot w swojej strategii.

    Firma wkracza w zupełnie nową dla siebie kategorię, wprowadzając inteligentny dyktafon napędzany sztuczną inteligencją oraz linię plenerowych głośników Bluetooth. Zdejmujemy warstwę marketingu i sprawdzamy, co dokładnie trafiło na półki.

    Asystent AI w formacie karty kredytowej

    Zdecydowanie najciekawszym elementem nowej oferty jest MOVA TPEAK AI Note. To nie jest zwykły dyktafon. Urządzenie ma zaledwie 2,89 mm grubości (odpowiada to trzem kartom kredytowym) i waży skromne 28 gramów. Zamiast nosić je w kieszeni, doczepia się je magnetycznie bezpośrednio do pleców smartfona.

    Sprzęt zasila bateria o pojemności 130 mAh, co według specyfikacji pozwala na 24 godziny ciągłego nagrywania. Dyktafon wspiera również standard bezprzewodowego ładowania Qi, co umożliwia awaryjne zasilanie go prosto z telefonu (jeśli ten posiada funkcję ładowania zwrotnego).

    Prawdziwa potęga tego gadżetu kryje się jednak w oprogramowaniu zintegrowanym z modelami językowymi (w tym ChatGPT). Możliwości asystenta można podzielić na dwa główne bloki:

    • Nagrywanie:
      • Automatyczny start i zatrzymywanie zapisu po wykryciu głosu.
      • Samodzielne rozpoznawanie kontekstu (rozmowa telefoniczna vs spotkanie na żywo).
      • Rozróżnianie od 3 do 5 mówców podczas jednego nagrania.
    • Analiza i przetwarzanie:
      • Konwersja mowy na tekst w czasie rzeczywistym (transkrypcja).
      • Tłumaczenie rozmów na żywo.
      • Generowanie zwięzłych podsumowań spotkań na podstawie szablonów.
      • Tworzenie map myśli.

    Transfer plików między dyktafonem a telefonem odbywa się przez dwupasmowe Wi-Fi, co pozwala na błyskawiczne zgranie materiału. Jak deklaruje producent, przesłanie godzinnego nagrania zajmuje około 10 sekund.

    Dźwięk na plener. Synchronizacja do 100 głośników

    Drugim filarem dzisiejszej premiery jest sprzęt audio. Producent pokazał dwa nowe głośniki bazujące na najnowszym standardzie Bluetooth V6.0. Kluczową nowością jest tu wsparcie dla funkcji Stereo Mode, pozwalającej na bezprzewodową synchronizację nawet do 100 głośników jednocześnie.

    MOVA TPEAK S1 Mini: kompaktowy, outdoorowy głośnik z 45-milimetrowym przetwornikiem o mocy 6W. Posiada certyfikat odporności na pył i wodę IP67. Ogniwo o pojemności 2000 mAh wystarcza na 25 godzin odtwarzania muzyki. Obsługuje także bezpośrednie odtwarzanie z kart microSD (TF) i tryb karty dźwiękowej pod USB-C.

    MOVA TPEAK S1: większy, 20-watowy model wykorzystujący przetwornik z potrójną membraną. Jego wyróżnikiem jest wbudowany pierścień RGB z pięcioma trybami podświetlenia pulsującego w rytm muzyki. Bateria zapewnia do 8 godzin pracy, a konstrukcja posiada certyfikat wodoodporności IPX7.

    Ceny i dostępność w Polsce

    MOVA od razu wrzuca sprzęt do największych polskich sieci handlowych (m.in. RTV Euro AGD, Media Expert czy Komputronik) oraz na platformę Allegro. Od 1 do 26 kwietnia 2026 roku obowiązują ceny promocyjne:

    • MOVA TPEAK AI Note: sugerowana cena 649 zł (w promocji taniej nawet o 31%).
    • MOVA TPEAK S1: sugerowana cena 299 zł (w promocji do 30% taniej).
    • MOVA TPEAK S1 Mini: sugerowana cena 169 zł (w promocji do 30% taniej).

    O ile na rynku taniego audio konkurencja jest gigantyczna, to dyktafon AI doczepiany na magnes prezentuje się jako niezwykle praktyczne narzędzie. Przy cenie promocyjnej wynoszącej około 450 zł to gadżet, obok którego żaden student, dziennikarz czy pracownik spędzający życie na spotkaniach nie przejdzie obojętnie – o ile oczywiście realne działanie sprzętu dorówna obietnicom producenta.

    MOVA idzie na całość: robot-kosiarka jak czołg i ponad 200 narzędzi w jednym systemie [galeria]

    #asystentAI #ChatGPT #dyktafonAI #głośnikBluetooth #MOVA #nowościTechnologiczne #smartHome #sztucznaInteligencja #TPEAKAINote #TPEAKS1 #TPEAKS1Mini
  8. Mała, ale kluczowa zmiana. Google nareszcie ułatwi nawigację w NotebookLM

    Niedawno pisaliśmy o potężnej, płatnej funkcji „Cinematic Video Overviews” w NotebookLM. Okazuje się jednak, że Google przygotowuje również mniejsze, ale niezwykle praktyczne ulepszenia interfejsu, które znacząco ułatwią życie użytkownikom bezpłatnej wersji tego narzędzia.

    Popularność NotebookLM rośnie w niesamowitym tempie. Problem polega na tym, że osoby intensywnie korzystające z tego asystenta badawczego szybko gromadzą na swoim koncie dziesiątki różnych projektów (notatników). Do tej pory interfejs usługi był pod tym względem dość spartański – znalezienie starszego dokumentu w zakładce „Moje notatniki” wymagało żmudnego, ręcznego przewijania strony głównej.

    Jak donosi branżowy informator ukrywający się pod pseudonimem TestingCatalog, inżynierowie z Mountain View zamierzają wreszcie rozwiązać ten problem. W przygotowaniu są dwie użyteczne nowości:

    • Wyszukiwarka notatników: na ekranie głównym NotebookLM pojawi się dedykowany przycisk wyszukiwania. Zamiast przewijać ich listę, wystarczy wpisać kilka pierwszych liter tytułu projektu, aby natychmiast go wywołać.
    • Przypinanie projektów: to rozwiązanie doskonale znane z komunikatorów internetowych. Użytkownicy otrzymają możliwość przypinania najważniejszych lub aktualnie edytowanych notatników na samej górze ekranu głównego. Dzięki temu kluczowe materiały będą zawsze pod ręką.

    Brak tak podstawowych funkcji w tak zaawansowanym narzędziu opartym na sztucznej inteligencji był dotąd sporym niedopatrzeniem. Obie funkcje znajdują się obecnie w fazie rozwoju. Biorąc pod uwagę ich czysto użytkowy charakter, można bezpiecznie założyć, że trafią one do wszystkich użytkowników usługi za darmo, w przeciwieństwie do zaawansowanych funkcji wideo zablokowanych za paywallem subskrypcji AI Ultra.

    NotebookLM wchodzi na wyższy poziom. Google prezentuje kinowe podsumowania wideo

    #asystentAI #funkcjeNotebookLM #GoogleNotebookLM #interfejsAI #NotebookLMAktualizacja #sztucznaInteligencjaGoogle #wyszukiwarkaWNotebookLM
  9. Gemini przejmie kontrolę nad aplikacjami w Androidzie

    Wraz z premierą nowej generacji flagowców (serii Galaxy S26 i Pixel 10), Google zapowiedziało potężną nowość: automatyzację zadań przez sztuczną inteligencję.

    Teraz firma odkrywa karty i tłumaczy, jak to działa od zaplecza. Magia opiera się na dwóch filarach: nowym API o nazwie „AppFunctions” oraz bezpośredniej automatyzacji interfejsu.

    Najważniejsze nowości i ceny Samsung Galaxy S26 Ultra [wideo]

    Z założenia asystenci AI, tacy jak Gemini, mają przestać być tylko inteligentnymi wyszukiwarkami, a stać się cyfrowymi agentami (agentic AI), którzy wykonują za nas pracę wewnątrz aplikacji firm trzecich. Google podzieliło się właśnie technicznymi szczegółami tego rozwiązania. Zmiana paradygmatu w ekosystemie Androida będzie realizowana na dwa sposoby.

    AppFunctions, czyli API dla sztucznej inteligencji

    Pierwsze i najbardziej eleganckie rozwiązanie to wbudowana w Androida 16 (oraz powiązaną bibliotekę Jetpack) funkcja „AppFunctions”. Pozwala ona deweloperom na wystawienie konkretnych możliwości ich aplikacji bezpośrednio dla asystentów AI. Google porównuje ten system do popularnego protokołu MCP (Model Context Protocol) używanego na serwerach, z tą różnicą, że AppFunctions działa całkowicie lokalnie na urządzeniu, co gwarantuje prywatność i bezpieczeństwo danych.

    Jak to wygląda w praktyce? Jeśli użytkownik powie: „Znajdź przepis na makaron w mailach od Anny i dodaj składniki do mojej listy zakupów”, Gemini wykorzysta AppFunctions do uruchomienia ukrytego procesu. Najpierw przeszuka aplikację pocztową, odszuka właściwy wątek korespondencji, wyciągnie z niego tekst, a następnie wywoła funkcję aplikacji z listą zakupów, aby automatycznie dodać tam odpowiednie produkty – a to wszystko bez ręcznego otwierania tych programów przez użytkownika.

    Google potwierdziło, że system ten debiutuje właśnie na Samsungach Galaxy S26 (wymaga nakładki OneUI 8.5 lub nowszej). Umożliwia to m.in. wywołanie komendy: „Pokaż mi zdjęcia mojego kota z Samsung Gallery”. Gemini samo przeszuka galerię i wyświetli zdjęcia w swoim własnym oknie czatu, skąd można je od razu wysłać znajomym.

    UI Automation: brutalna siła dla opornych aplikacji

    Google zdaje sobie jednak sprawę, że zanim wszyscy deweloperzy wdrożą u siebie nowe API, miną lata. Dlatego Android zyskał również drugi mechanizm: automatyzację interfejsu użytkownika (UI automation).

    To rozwiązanie zostało zaprezentowane podczas dzisiejszych premier Pixela 10 i Galaxy S26. Jeśli aplikacja nie obsługuje natywnie AppFunctions, platforma i tak poradzi sobie z zadaniem. Sztuczna inteligencja wizualnie analizuje interfejs otwartej aplikacji i fizycznie „klika” w odpowiednie przyciski, symulując ruchy użytkownika.

    Dla deweloperów oznacza to, że ich aplikacje zyskają wsparcie dla automatyzacji Gemini przy zerowym nakładzie pracy inżynieryjnej. Google zapowiada, że technologia ta zostanie jeszcze mocniej rozwinięta i zintegrowana z systemem wraz z premierą Androida 17.

    Co to oznacza dla polskich użytkowników?

    Od strony technologicznej mechanizmy te są głęboko zaszyte w systemie i nie posiadają twardych blokad regionalnych. Prawdziwym testem dla polskich użytkowników będzie jednak bariera językowa. Złożone przepływy pracy (tzw. workflows) wymagają od modelu AI doskonałego zrozumienia intencji użytkownika. Zanim polskojęzyczne Gemini nauczy się bezbłędnie interpretować komendy wymagające przeskakiwania między trzema różnymi aplikacjami, prawdopodobnie będziemy zmuszeni do posiłkowania się językiem angielskim.

    Nowy Google Pixel 10 Pro – pierwsze wrażenia

    #AppFunctionsAndroid16 #asystentAI #cyfrowyAgentAI #GeminiAutomatyzacja #GooglePixel10Automatyzacja #ModelContextProtocolAndroid #SamsungGalaxyS26Gemini #UIAutomationAndroid
  10. Koniec irytującego znikania. Gemini na Androidzie wreszcie pozwoli na prawdziwy multitasking

    Ile razy zdarzyło Ci się poprosić asystenta AI o napisanie maila, tylko po to, by stracić całą treść po przypadkowym tapnięciu w tło? Google wreszcie naprawia największą wadę interfejsu Gemini na Androidzie.

    Do tej pory korzystanie z Gemini jako nakładki na system przypominało stąpanie po cienkim lodzie. Wystarczył jeden fałszywy ruch – dotknięcie ekranu poza oknem asystenta – by Gemini się zamykało, zabierając ze sobą całą konwersację. Chciałeś sprawdzić coś w innej aplikacji w trakcie generowania odpowiedzi? Zapomnij.

    Pływający przycisk ratuje sytuację

    Jak donosi Android Authority (powołując się na analizę kodu beta wersji aplikacji Google), nadchodzi rozwiązanie. Zamiast znikać bez śladu, zminimalizowane okno Gemini zamieni się w mały, pływający przycisk (FAB; floating action button) przy krawędzi ekranu.

    To zmienia zasady gry. Dlaczego? Bo daje użytkownikowi szereg korzyści:

    • Ciągłość pracy: możesz zlecić Gemini skomplikowane zadanie, zminimalizować je, popracować w innej apce i wrócić do gotowego wyniku jednym tapnięciem.
    • Kontekst: możesz skakać między aplikacjami, kopiując dane potrzebne do promptu, bez resetowania sesji.
    • Wygoda: dopiero gdy skończysz, przesuwasz przycisk do krawędzi (gest swipe), by zamknąć asystenta całkowicie.

    Google szykuje się na rok 2026

    Ta zmiana to element większej układanki. Google potwierdziło już, że w 2026 roku Gemini całkowicie zastąpi klasycznego Asystenta Google. Aby to się udało bez buntu użytkowników, AI musi działać w tle tak płynnie, jak stary dobry Asystent, a nie blokować cały ekran.

    W połączeniu z niedawną premierą lżejszego modelu Gemini 3 Flash, Google wyraźnie czyści przedpole przed nowym rokiem, usuwając irytujące „choroby wieku dziecięcego” swojej sztucznej inteligencji.

    Gemini 3 Flash: to nie jest wersja „Lite”. W kodowaniu bije nawet wersję Pro

    #aktualizacja #Android #asystentAI #Gemini #Google #GoogleApp #multitasking
  11. Google ulepsza mapy w Gemini. Asystent zyskuje bogatsze, wizualne odpowiedzi w wersji angielskiej

    Google aktualizuje sposób, w jaki jego sztuczna inteligencja prezentuje wyniki lokalizacyjne.

    Do tej pory integracja Gemini z Google Maps ograniczała się często do tekstu i prostych linków. Nowa wersja, wdrażana obecnie dla języka angielskiego, stawia na format graficzny i użyteczne podsumowania.

    Firma z Mountain View zmienia interfejs odpowiedzi w swoim asystencie AI. Zgodnie z zapowiedziami, zamiast tekstowych opisów z mapą ukrytą na końcu, Gemini zaczyna prezentować wyniki w sposób zbliżony do natywnej aplikacji Map.

    Kluczową zmianą jest wprowadzenie interaktywnych kart lokalizacji. Oprócz standardowej mapy z nowymi, tematycznymi pinezkami, asystent wyświetla zdjęcia miejsc oraz ich oceny.

    Nowością są generowane przez AI podsumowania opinii. Gemini analizuje recenzje użytkowników i wyciąga z nich najważniejsze wątki (np. „O czym ludzie mówią najczęściej”) oraz praktyczne wskazówki, co pozwala na szybszą ocenę miejsca bez konieczności ręcznego przeglądania setek komentarzy.

    Aktualizacja jest obecnie wdrażana dla aplikacji mobilnej i wersji desktopowej w języku angielskim. Nie wiemy jeszcze, czy rozwiązanie to pojawi się również w innych wersjach językowych, niemniej bazując na dotychczasowej polityce wdrożeń Google, należy tego oczekiwać po pewnym czasie.

    Google stanowczo: „Nie mamy planów na reklamy w Gemini”. To zupełnie inna droga niż OpenAI

    #aktualizacjaGoogle #asystentAI #GoogleGemini #googleMaps #news #sztucznaInteligencja

  12. Google Gemini i AI w święta – zorganizuj przyjęcie bez stresu

    Masz wrażenie, że święta to maraton z listą zadań dłuższą niż kolejka do karpia? Co, jeśli część tego chaosu da się oddać w outsourcing – algorytmowi?

    Czytaj dalej:
    pressmind.org/google-gemini-i-

    #PressMindLabs #asystentai #gem #googlegemini #planowanieprzyjec #swieta

  13. Google wprowadza AI do organizacji świąt – nowy sposób na przyjęcia

    Czy można zorganizować święta i nie osiwieć? Google mówi: tak – o ile pozwolisz, by AI zagrała rolę współgospodarza.

    Czytaj dalej:
    pressmind.org/google-wprowadza

    #PressMindLabs #asystentai #gemini #gems #google #organizacjaswiat

  14. Comet na Androida – mobilna przeglądarka myśląca jak asystent AI

    Czy mobilna przeglądarka powinna umieć nie tylko otwierać karty, ale też myśleć, streszczać i działać za nas? Perplexity uważa, że tak – i właśnie przenosi ten pomysł na Androida.

    Czytaj dalej:
    pressmind.org/comet-na-android

    #PressMindLabs #android #asystentai #chrome #comet

  15. Mała zmiana w Gemini, która wiele ułatwia. Koniec z komendami typu @YouTube i @Mapy

    Google wprowadza istotną aktualizację swojego asystenta AI, Gemini, która ma na celu uczynienie rozmów z nim bardziej naturalnymi.

    Z interfejsu znikają specjalne komendy wywołujące aplikacje, takie jak „@Google Maps” czy „@YouTube”. Nie oznacza to jednak usunięcia funkcji, a ich pełną, automatyczną integrację.

    Dotychczas, aby zadać Gemini pytanie dotyczące konkretnej usługi Google, użytkownicy musieli korzystać ze specjalnego znacznika „@”, podobnie jak w innych narzędziach AI, aby aktywować odpowiednie rozszerzenie. Przykładowo, trzeba było wpisać „@YouTube znajdź film o…” lub „@Google Maps podaj trasę do…”. Teraz ten wymóg znika.

    Jak nie dać się oszukać w sieci? 6 nowości od Google, które chronią Twoje dane i konto

    Zmiana polega na tym, że Gemini ma być na tyle inteligentne, by samodzielnie zrozumieć intencje użytkownika na podstawie kontekstu pytania. Zamiast wpisywać komendę, wystarczy teraz zapytać w naturalny sposób, np. „Gdzie jest najbliższa kawiarnia i o której się otwiera?” lub „Pokaż mi loty do Tokio i zaproponuj, co można tam robić”. Gemini automatycznie rozpozna, że ma skorzystać z danych Map, Lotów czy YouTube, aby udzielić odpowiedzi.

    Zniknięcie znaczników „@” z pola podpowiedzi to świadoma decyzja projektowa. Google chce, aby użytkownicy wchodzili w interakcję z AI w sposób płynny i konwersacyjny, bez konieczności zastanawiania się, którą „wtyczkę” należy w danym momencie aktywować. To krok w stronę uczynienia z Gemini bardziej zintegrowanego asystenta, a mniej technicznego narzędzia.

    Warto również zauważyć, że sama nazwa tych integracji uległa zmianie. Dotychczasowa sekcja „Rozszerzenia” (Extensions) w ustawieniach Gemini została przemianowana na „Połączone aplikacje” (Connected Apps). Wciąż znajdują się tam kluczowe usługi, takie jak Google Workspace (Kalendarz, Dysk, Gmail), Google Photos, czy YouTube Music, co pokazuje, jak głęboko asystent jest zintegrowany z całym ekosystemem.

    Google prezentuje Veo 3.1. Lepszy dźwięk i edycja w wideo generowanym przez AI

    #AI #aktualizacja #asystentAI #Gemini #Google #googleMaps #interfejs #news #PołączoneAplikacje #sztucznaInteligencja #YouTube

  16. Google rewolucjonizuje Chrome dzięki AI. Nadchodzi inteligentny asystent, ale Polacy muszą poczekać

    Google zapowiedział fundamentalną zmianę w działaniu swojej przeglądarki. Chrome, najpopularniejsze narzędzie do przeglądania internetu na świecie, wkracza w nową erę, w której sercem ma być sztuczna inteligencja.

    Firma ogłosiła integrację modelu Gemini bezpośrednio z przeglądarką, co ma przekształcić ją z pasywnego okna na świat w aktywnego, inteligentnego partnera. Jest jednak ważna informacja dla polskich użytkowników – na premierę nowych funkcji w naszym kraju trzeba będzie poczekać.

    Nowa wizja Google zakłada, że przeglądarka ma nie tylko wyświetlać strony, ale także je rozumieć i pomagać użytkownikowi w szybszym i łatwiejszym załatwianiu spraw. Ma się to odbywać na trzech głównych płaszczyznach.

    „Bez nich nie byłoby OpenAI”. Sam Altman ujawnia kluczową rolę Polaków w stworzeniu GPT-4

    Największą nowością ma być Gemini w Chrome – asystent AI, który rozumie kontekst tego, co robimy w wielu otwartych kartach jednocześnie. Google podaje przykład studenta pracującego nad referatem, który zamiast przeskakiwać między dziesiątkami otwartych źródeł, będzie mógł zadać asystentowi pytanie, a ten sam połączy informacje z różnych artykułów czy nawet znajdzie konkretne odniesienia w filmach na YouTube.

    Asystent zintegruje się również z innymi usługami, takimi jak Dokumenty czy Kalendarz Google. W przyszłości jego możliwości mają być jeszcze większe – ma samodzielnie wykonywać wieloetapowe zadania, jak np. zamówienie zakupów spożywczych.

    Zmiany dotkną również paska adresu (omnibox), który otrzyma specjalny Tryb AI. Pozwoli on na zadawanie skomplikowanych, wielowątkowych pytań bezpośrednio w miejscu, w którym do tej pory wpisywaliśmy adresy i proste zapytania. Dodatkowo, omnibox zacznie wyświetlać kontekstowe sugestie wyszukiwania, bazując na stronie, którą aktualnie przeglądamy. Przykładowo, czytając o produkcie, który chcemy kupić, przeglądarka może podsunąć pytanie o „politykę gwarancyjną”.

    YouTube Music z zapowiedziami albumów, a podcasty dostaną… własne wideo z AI

    Google podkreśla, że rozwój AI idzie w parze z bezpieczeństwem. Firma rozszerza wykorzystanie sztucznej inteligencji do proaktywnego blokowania nowych typów oszustw, bezpiecznego uzupełniania danych logowania czy pomagania w rozwiązywaniu problemów z przejętymi hasłami. Jak podaje firma, to już działa – dzięki ostrzeżeniom opartym na AI, użytkownicy Chrome na Androidzie otrzymują dziennie o około 3 miliardy mniej spamerskich i oszukańczych powiadomień.

    Wszystkie nowe funkcje asystenta i omniboksu będą na początku dostępne wyłącznie w Stanach Zjednoczonych i w języku angielskim. Google zapowiada, że w nadchodzących tygodniach planuje rozszerzyć ich dostępność na kolejne kraje i języki, jednak na ten moment nie podano konkretnego harmonogramu dla Polski.

    Sąd zdecydował w sprawie Google. Chrome i Android zostają, ale firma musi dzielić się danymi

    #AI #asystentAI #Gemini #Google #GoogleChrome #news #omnibox #przeglądarkaInternetowa #przyszłość #sztucznaInteligencja #technologia

  17. Proton wprowadza Lumo – asystenta AI, który ma stawiać prywatność na pierwszym miejscu

    Firma Proton, znana z tworzenia zorientowanych na prywatność narzędzi, takich jak Proton Mail, uruchomiła własnego asystenta AI o nazwie Lumo.

    Nowy chatbot ma wyróżniać się na rynku dzięki zaawansowanym funkcjom ochrony danych, w tym pełnemu szyfrowaniu i polityce braku logów.

    Lumo oferuje kilka kluczowych mechanizmów ochrony prywatności. Firma zapewnia, że nie przechowuje żadnych logów z rozmów, a historia czatów jest chroniona szyfrowaniem end-to-end. Dostępny jest również „tryb ducha” (ghost mode), w którym konwersacje znikają natychmiast po zamknięciu okna. Zastosowano także szyfrowanie „zero-access”, co oznacza, że tylko użytkownik na swoim urządzeniu może odszyfrować historię rozmów.

    Asystent jest dostępny przez stronę internetową oraz aplikacje na Androida i iOS, a do jego podstawowego użycia nie jest wymagane posiadanie konta. Lumo może odpowiadać na pytania, analizować przesłane pliki, a także łączyć się z kontem Proton Drive w celu uzyskania dostępu do plików w chmurze. Ma również dostęp do internetu, choć jego wyniki nie zawsze mogą być najświeższe.

    Proton podkreśla, że Lumo bazuje na modelach open-source i działa w europejskich centrach danych firmy. W komunikacie firma wyraźnie odcina się od partnerstw z amerykańskimi i chińskimi gigantami AI. „W przeciwieństwie do Apple Intelligence i innych, Lumo nie jest partnerstwem z OpenAI (…), a Twoje zapytania nigdy nie są wysyłane do stron trzecich” – oświadczył Proton.

    Lumo jest drugim narzędziem AI w portfolio firmy, po asystencie pisania w Proton Mail wprowadzonym w zeszłym roku. Jego debiut stanowi ważną alternatywę na rynku chatbotów, skierowaną do użytkowników, dla których ochrona danych i prywatność są absolutnym priorytetem, w odróżnieniu od modeli stosowanych przez największych graczy technologicznych.

    #AI #asystentAI #Bezpieczeństwo #chatbot #endToEnd #Lumo #news #openSource #Proton #prywatność #sztucznaInteligencja #szyfrowanie #technologia

  18. ChatGPT Agent już dostępny w aplikacji na Maca. AI, które samo wykona za ciebie zadania

    OpenAI udostępniło swoją nową funkcję, ChatGPT Agent, w aplikacji na komputery Mac.

    Narzędzie, zaprezentowane w zeszłym tygodniu, pozwala sztucznej inteligencji na autonomiczne wykonywanie złożonych, wieloetapowych zadań, takich jak przeglądanie stron internetowych, analiza danych, generowanie kodu czy interakcja z zewnętrznymi platformami, np. Dyskiem Google.

    Działanie Agenta w aplikacji na Maca jest identyczne jak w wersji webowej. Użytkownik może go aktywować za pomocą polecenia /agent lub dedykowanego przycisku w interfejsie. Po zleceniu zadania, Agent pracuje w wizualnym środowisku, a jego postępy można śledzić na „osi czasu rozumowania”, co pozwala na bieżącą interwencję i modyfikację poleceń. Technologia łączy system Deep Research do analizy treści oraz Operator do wykonywania działań na stronach internetowych.

    Możliwości narzędzia zaprezentowano na kilku przykładach. W jednym z nich Agent zaplanował zagraniczny ślub, wyszukując stroje, planując trasę zwiedzania i sprawdzając ceny hoteli na wielu różnych stronach. W innym, na podstawie danych z Dysku Google, automatycznie stworzył prezentację, generując wykresy i obrazy za pomocą Terminala i generatora obrazów OpenAI. Potrafi również przechodzić przez procesy zakupowe, na przykład przygotowując zamówienie na 500 naklejek i zatrzymując się tuż przed finalizacją płatności.

    Obecnie funkcja ChatGPT Agent jest dostępna dla subskrybentów planów Pro, Plus oraz Team. Obowiązują jednak limity użycia: 400 zapytań miesięcznie dla użytkowników Pro oraz 40 dla posiadaczy planów Plus i Team. OpenAI zapowiedziało udostępnienie narzędzia dla klientów Enterprise i Edu do końca lipca.

    Wprowadzenie Agenta to kolejny krok w rozwoju AI od prostego chatbota do zaawansowanego asystenta zdolnego do samodzielnej pracy. Twórcy sugerują, by myśleć o nim jak o „wirtualnym stażyście”, któremu można zlecić zadanie, a po pewnym czasie wrócić po gotowe wyniki, wymagające jedynie finalnej korekty.

    #AI #aplikacja #asystentAI #automatyzacja #ChatGPT #ChatGPTAgent #Mac #news #OpenAI #produktywność #sztucznaInteligencja #technologia

  19. Koniec z przeglądaniem, czas na działanie. Perplexity rzuca wyzwanie Google z przeglądarką AI Comet

    Perplexity, znana ze swojej konwersacyjnej wyszukiwarki AI, idzie o krok dalej i rzuca wyzwanie gigantom rynku. Firma zaprezentowała Comet – nową przeglądarkę internetową, która ma zredefiniować sposób, w jaki korzystamy z sieci.

    Zamiast być pasywnym narzędziem do wyświetlania stron, Comet ma pełnić rolę aktywnego, inteligentnego asystenta, zdolnego do wykonywania złożonych, wieloetapowych zadań na polecenie użytkownika.

    Aravind Srinivas, CEO Perplexity, w rozmowie z The Verge określił Comet mianem „natywnej przeglądarki AI” lub nawet „systemu operacyjnego AI dla pracowników umysłowych”. Jej celem nie jest proste dostarczanie odpowiedzi, ale przejmowanie całych procesów, które do tej pory wymagały ręcznego przełączania się między dziesiątkami kart i aplikacji. Srinivas posunął się nawet do stwierdzenia, że w przyszłości Comet, dzięki integracji z zaawansowanymi modelami językowymi, będzie w stanie zastąpić takie role jak rekruterzy czy asystenci zarządu.

    Wizja firmy zakłada, że użytkownik jednym poleceniem w języku naturalnym będzie mógł zlecić zadanie, którego realizacja zajmuje dziś rekruterowi tydzień pracy. Chodzi o takie procesy jak wyszukiwanie kandydatów na LinkedIn, wysyłanie do nich spersonalizowanych wiadomości, śledzenie odpowiedzi, aktualizowanie statusów w arkuszu kalkulacyjnym, a na końcu umawianie spotkań w kalendarzu, z uwzględnieniem dostępności wszystkich stron.

    Jak to działa w praktyce?

    Comet, oparty na otwartym projekcie Chromium (na którym bazuje m.in. Google Chrome), głęboko integruje się z popularnymi usługami, takimi jak Gmail czy Kalendarz Google. Z boku interfejsu znajduje się asystent AI, któremu można wydawać polecenia. Potrafi on nie tylko odpowiadać na pytania czy streszczać treści (w tym filmy z YouTube), ale także aktywnie działać w imieniu użytkownika – na przykład tworzyć listę zakupów na podstawie przepisu i dodawać produkty do koszyka w sklepie internetowym.

    Przeglądarka ma również ułatwiać pracę z wieloma źródłami jednocześnie. Użytkownik może na przykład poprosić o porównanie informacji z kilku otwartych kart, używając specjalnej komendy „@tab”. Akurat z tym zadaniem świetnie radzi sobie systematycznie rozwijany NotebookLM od Google’a.

    Google NotebookLM – wirtualny asystent badacza / naukowca / dziennikarza / pisarza / studenta – you name it

    Plany na przyszłość i dostępność

    Ambicje Perplexity są ogromne. Firma prowadzi już podobno rozmowy z producentami smartfonów, aby Comet stał się domyślną lub preinstalowaną przeglądarką na nowych urządzeniach, co stanowiłoby bezpośrednie wyzwanie dla dominacji Google Chrome i Safari. Na razie jednak Comet dostępny jest w zamkniętej wersji beta, dla użytkowników najdroższego planu subskrypcyjnego Perplexity Max, kosztującego 200 dolarów miesięcznie. Pozostali mogą póki co zapisać się na listę oczekujących. Chyba warto, skoro firma zapowiada, że w przyszłości pojawi się również wersja darmowa.

    #AI #AravindSrinivas #asystentAI #automatyzacja #Comet #GoogleChrome #news #Perplexity #przeglądarkaInternetowa #sztucznaInteligencja #technologia

  20. Gemini na zegarku i wideo ze zdjęć. Google ogłasza comiesięczne aktualizacje Gemini Drops

    Google rozpoczyna nową inicjatywę o nazwie „Gemini Drops”, w ramach której firma będzie co miesiąc informować o nowościach i ulepszeniach wprowadzanych do swojego asystenta AI.

    W pierwszej odsłonie cyklu zapowiedziano kilka istotnych funkcji, które trafią do aplikacji Gemini, a także usprawnienia samego modelu językowego napędzającego usługę.

    Wśród nowości znalazła się integracja z modelem Veo 3, który pozwala na transformację statycznych zdjęć w dynamiczne, ośmiosekundowe klipy wideo z dźwiękiem. Funkcja ta jest dostępna bezpośrednio w aplikacji Gemini. Ponadto asystent Google staje się bardziej dostępny – aplikacja Gemini trafiła oficjalnie na wszystkie zegarki z systemem Wear OS w wersji 4 lub nowszej, co pozwala na interakcję z AI bez konieczności wyciągania telefonu.

    Usprawnienia obejmują również funkcje związane z produktywnością. Użytkownicy mogą teraz korzystać z „Zaplanowanych Działań” (Scheduled Actions), aby zlecać Gemini cykliczne zadania, takie jak przygotowanie porannego podsumowania kalendarza i nieprzeczytanych e-maili. Dodatkowo, w odpowiedzi na prośby użytkowników, do rozmów głosowych w trybie Gemini Live wprowadzono napisy, co pozwala na jednoczesne śledzenie tekstu konwersacji.

    Google poinformowało również o aktualizacji swojego najbardziej zaawansowanego modelu, Gemini 2.5 Pro. Firma podkreśla, że nowa wersja jest jeszcze lepsza w zadaniach związanych z kodowaniem, nauką, logicznym rozumowaniem oraz w testach multimodalnych, które sprawdzają zdolność do jednoczesnego przetwarzania różnych typów danych, jak tekst i obrazy.

    Google prezentuje nowe, natywne możliwości audio w modelach Gemini 2.5

    #AI #aktualizacja #asystentAI #Gemini #Gemini25Pro #GeminiDrops #Google #GoogleAI #news #Oprogramowanie #sztucznaInteligencja #technologia #Veo3 #wearOs

  21. ChatGPT z nową funkcją. Asystent AI przejrzy internet i wykona za ciebie zadania

    OpenAI zaprezentowała nową, zaawansowaną funkcję o nazwie „ChatGPT agent”. Jest to rozszerzenie zapowiadanej wcześniej, ale ograniczonej funkcji „Operator”, które pozwala asystentowi AI na przeglądanie internetu i wykonywanie złożonych zadań w imieniu użytkownika.

    Nowe narzędzie łączy w sobie dwie technologie: „Operator”, który odpowiada za wizualne przeglądanie stron, oraz „Deep Research”, który potrafi szybko analizować i wyciągać wnioski z treści tekstowych.

    OpenAI prezentuje usługę Operator – Agent AI w przeglądarce zrobi za ciebie wszystko

    Po zleceniu zadania, agent uruchamia się w wirtualnej maszynie i rozpoczyna działanie. W trakcie pracy może zadawać użytkownikowi dodatkowe pytania w celu doprecyzowania polecenia lub prosić o zalogowanie się do zewnętrznych serwisów, aby sfinalizować transakcję. Użytkownik ma możliwość przejęcia kontroli lub wysłania dodatkowych instrukcji w dowolnym momencie. Dla zachowania przejrzystości, ChatGPT agent prezentuje oś czasu ze swoim procesem rozumowania i przeglądania, co pozwala łatwo zweryfikować źródło każdej informacji.

    Asystent AI został wyposażony w szereg narzędzi. Korzysta zarówno z przeglądania tekstowego, jak i wizualnego. Posiada również własny terminal do generowania kodu i analizy danych. Co istotne, może wykonywać wywołania API do publicznych i prywatnych usług, takich jak Dysk Google, Kalendarz Google, GitHub czy SharePoint.

    OpenAI przyznaje, że nowa funkcja wiąże się z ryzykiem, np. próbami oszustw ze strony złośliwych witryn internetowych. Firma podkreśla, że dołożyła wszelkich starań, aby wytrenować model w identyfikowaniu podejrzanych stron, ale jednocześnie zaznaczyła, że jest to nowa technologia i zaleca użytkownikom zachowanie ostrożności.

    Nowa funkcja „ChatGPT agent” jest udostępniana od dziś dla użytkowników planu Pro. Wkrótce ma trafić do użytkowników planów Plus i Team. Do końca lipca planowane jest jej wdrożenie dla klientów Enterprise i Edu. Użytkownicy Pro otrzymają limit 400 zapytań miesięcznie, podczas gdy dla użytkowników Plus i Team limit ten wyniesie 40 zapytań na miesiąc.

    #agenciAI #AI #asystentAI #automatyzacja #ChatGPT #Internet #news #OpenAI #sztucznaInteligencja

  22. Google wzmacnia AI w wyszukiwarce. Płatne nowości i dzwoniący asystent dla wszystkich

    Google wprowadza istotne nowości do trybu AI w swojej wyszukiwarce. Płatni subskrybenci w USA otrzymają dostęp do zaawansowanego modelu Gemini 2.5 Pro oraz nowej funkcji Deep Search, natomiast wszyscy amerykańscy użytkownicy będą mogli skorzystać z asystenta AI, który zadzwoni w ich imieniu do firm.

    Subskrybenci usług Google AI Pro oraz AI Ultra w Stanach Zjednoczonych mogą już korzystać z modelu Gemini 2.5 Pro w trybie AI. Jest on przeznaczony do rozwiązywania bardziej złożonych zapytań wymagających zaawansowanego rozumowania, matematyki i kodowania. Równocześnie udostępniana jest funkcja Deep Search, która również bazuje na Gemini 2.5 Pro. Pozwala ona na zadawanie skomplikowanych pytań i otrzymywanie po kilku minutach szczegółowych, rozbudowanych odpowiedzi.

    Działanie Deep Search polega na przeprowadzeniu przez AI „setek wyszukiwań” i analizie informacji z różnych źródeł w celu wygenerowania „kompleksowego, w pełni opatrzonego cytatami raportu”. Co więcej, przed rozpoczęciem procesu badawczego asystent może poprosić użytkownika o dodatkowe szczegóły, by lepiej zrozumieć jego potrzeby. Google traktuje tę funkcję, podobnie jak dostęp do Gemini 2.5 Pro, jako zaawansowaną możliwość, której udostępnienie wiąże się z kosztami, dlatego w pierwszej kolejności trafia ona do płacących klientów.

    Najciekawszą nowością dostępną dla wszystkich użytkowników w USA jest funkcja, która pozwala wyszukiwarce dzwonić w imieniu użytkownika do firm w celu uzyskania informacji np. o cenach czy dostępności usług. Po wyszukaniu frazy takiej jak „salony pielęgnacji zwierząt w pobliżu” pojawi się opcja, by to „AI sprawdziło ceny”. Następnie użytkownik wypełnia w wyszukiwarce krótki kwestionariusz dotyczący swoich potrzeb (np. rodzaj zwierzaka, typ usługi, termin). Technologia ta, bazująca na modelach Gemini i systemie Duplex, była wcześniej testowana w ramach Labs jako „Ask for me”. Chociaż funkcja jest darmowa, subskrybenci AI Pro i AI Ultra będą mieli wyższe limity jej użycia.

    #AI #AIMode #asystentAI #DeepSearch #Duplex #Gemini25Pro #Google #GoogleAIPro #news #sztucznaInteligencja #wyszukiwarkaGoogle

Share on Mastodon

Enter the server where you have an account.