home.social

#fullduplex — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #fullduplex, aggregated by home.social.

fetched live
  1. RT @C_of_Creativity: Es kann Unterbrechungen verarbeiten – unglaublich! Für konversationale KI wird ein 11B-Modell für Echtzeit-Voice-Fullduplex-Verarbeitung von Ende-zu-Ende vorgestellt, das gestreamtes Sprachverständnis und Spracherzeugung gemeinsam ausführt. Im Gegensatz zu herkömmlichen Kaskadenstapeln (ASR → LLM → TTS) ermöglicht dieses Modell durch eine einzige integrierte Architektur volle Fullduplex-Kommunikation, Echtzeitfähigkeit und nahtlose Sprachinteraktionen, wodurch die Notwendigkeit mehrerer Modelle oder API-Übergänge entfällt und die Ende-zu-Ende-Latenz reduziert wird. Durch offene, robuste und hochnatürliche Konversationsfunktionen setzt es neue Maßstäbe. Darüber hinaus ist es das erste offene Fullduplex-Modell, das Toolaufrufe unterstützt und dabei den natürlichen Konversationsfluss während der Tool-Ausführung aufrechterhält. Für jedes Tool kann definiert werden, welche „Wartemeldung“ vom Agenten gesprochen wird, sobald das LLM den Tool-Aufruf und die zugehörige Antwort generiert! huggingface.co/nvidia/NVIDIA… Link nvidia/NVIDIA-NemotronLabs-VoiceChat-11B · Hugging Face Wir sind auf einem Weg, künstliche Intelligenz durch Open Source und offene Wissenschaft voranzubringen und zu demokratisieren. huggingface.co

    mehr auf Arint.info

    #AI #Fullduplex #HuggingFace #NVIDIA #OpenSource #VoiceChat #arint_info

    https://x.com/C_of_Creativity/status/2085197789013909828#m

  2. Nowy tryb głosowy GPT-Live trafia do ChatGPT i CarPlay. Koniec ze sztywną rozmową

    Dotychczasowe systemy głosowe w samochodach i smartfonach działały w sposób wymuszony. Użytkownik musiał wypowiedzieć komendę, zamilknąć i czekać na przetworzenie danych, a najmniejsza pauza na zastanowienie przerywała komunikację. OpenAI właśnie zmienia te zasady.

    Firma ogłosiła oficjalne wdrożenie nowej generacji modeli głosowych o nazwie GPT-Live, które od dziś trafiają do aplikacji mobilnych na iOS i Androida, oferując natywne wsparcie dla systemu Apple CarPlay.

    Dla kierowców to ogromna zmiana. Zamiast ograniczeń znanych z klasycznych asystentów, otrzymują partnera do rozmowy, który potrafi płynnie reagować na sytuację na drodze i przeszukiwać internet bez przerywania jazdy. Co ważne, to dopiero pierwsza z dzisiejszych nowości od OpenAI – jeszcze dziś w Stanach Zjednoczonych zadebiutuje nowy, flagowy model GPT-5.6.

    Architektura full-duplex, czyli rozmowa bez czekania na swoją kolej

    Najważniejszą zmianą techniczną w GPT-Live jest porzucenie systemu turowego na rzecz architektury full-duplex. Oznacza to, że asystent potrafi jednocześnie mówić i słuchać. Kierowca może wejść w słowo sztucznej inteligencji w dowolnym momencie – model natychmiast przerwie swoją wypowiedź i zareaguje na nową komendę, bez potrzeby ponownego uruchamiania aplikacji.

    Podczas rozmowy system na bieżąco analizuje dźwięki z otoczenia. Jeśli użytkownik zawiesi głos, by się zastanowić, GPT-Live poczeka i nie wejdzie mu w słowo. Dodatkowo model potrafi wtrącać naturalne potwierdzenia, takie jak „mhmm” czy „tak”, dając sygnał, że stale analizuje potok słów. Zaimplementowano również ulepszone filtry odcinające hałas tła, w tym dźwięki ruchu ulicznego.

    Delegowanie zadań w tle i wsparcie dla GPT-5.5

    Aby zaawansowane funkcje głosowe nie opóźniały odpowiedzi, OpenAI oddzieliło model odpowiedzialny za interakcję od procesów myślowych. Gdy użytkownik zada złożone pytanie wymagające przeszukania sieci lub głębszego rozumowania, GPT-Live deleguje to zadanie w tle do modelu GPT-5.5 (jeszcze dziś, 9 lipca 2026, spodziewamy się publicznej premiery GPT-5.6). Asystent podtrzymuje płynną rozmowę z kierowcą, podczas gdy drugi algorytm w tle szuka właściwych danych.

    Zarówno darmowi, jak i płatni użytkownicy otrzymują dostęp do nowej technologii w ramach dwóch wersji:

    • Base / GPT-Live-1 mini: szybszy model dla użytkowników bezpłatnego planu Free.
    • Premium / GPT-Live-1: wersja dla subskrybentów planów Plus i Pro, oferująca opcję wyboru poziomu rozumowania w tle (Szybki, Średni lub Wysoki).

    System wspiera język polski, choć producent uprzedza, że w początkowej fazie model może mówić z obcym akcentem, co będzie eliminowane w kolejnych tygodniach. W momencie premiery funkcja nie obsługuje jeszcze analizy wideo ani współdzielenia ekranu – te opcje wymagają tymczasowego przełączenia się na starszy, standardowy tryb głosowy.

    OpenAI podkupuje szefa projektów Vision Pro i inteligentnych okularów

    #aplikacjeSamochodowe #AppleCarPlay #asystentGłosowy #ChatGPT #fullDuplex #GPT55 #GPTLive #iOS #OpenAI #sztucznaInteligencja
  3. Nowy tryb głosowy GPT-Live trafia do ChatGPT i CarPlay. Koniec ze sztywną rozmową

    Dotychczasowe systemy głosowe w samochodach i smartfonach działały w sposób wymuszony. Użytkownik musiał wypowiedzieć komendę, zamilknąć i czekać na przetworzenie danych, a najmniejsza pauza na zastanowienie przerywała komunikację. OpenAI właśnie zmienia te zasady.

    Firma ogłosiła oficjalne wdrożenie nowej generacji modeli głosowych o nazwie GPT-Live, które od dziś trafiają do aplikacji mobilnych na iOS i Androida, oferując natywne wsparcie dla systemu Apple CarPlay.

    Dla kierowców to ogromna zmiana. Zamiast ograniczeń znanych z klasycznych asystentów, otrzymują partnera do rozmowy, który potrafi płynnie reagować na sytuację na drodze i przeszukiwać internet bez przerywania jazdy. Co ważne, to dopiero pierwsza z dzisiejszych nowości od OpenAI – jeszcze dziś w Stanach Zjednoczonych zadebiutuje nowy, flagowy model GPT-5.6.

    Architektura full-duplex, czyli rozmowa bez czekania na swoją kolej

    Najważniejszą zmianą techniczną w GPT-Live jest porzucenie systemu turowego na rzecz architektury full-duplex. Oznacza to, że asystent potrafi jednocześnie mówić i słuchać. Kierowca może wejść w słowo sztucznej inteligencji w dowolnym momencie – model natychmiast przerwie swoją wypowiedź i zareaguje na nową komendę, bez potrzeby ponownego uruchamiania aplikacji.

    Podczas rozmowy system na bieżąco analizuje dźwięki z otoczenia. Jeśli użytkownik zawiesi głos, by się zastanowić, GPT-Live poczeka i nie wejdzie mu w słowo. Dodatkowo model potrafi wtrącać naturalne potwierdzenia, takie jak „mhmm” czy „tak”, dając sygnał, że stale analizuje potok słów. Zaimplementowano również ulepszone filtry odcinające hałas tła, w tym dźwięki ruchu ulicznego.

    Delegowanie zadań w tle i wsparcie dla GPT-5.5

    Aby zaawansowane funkcje głosowe nie opóźniały odpowiedzi, OpenAI oddzieliło model odpowiedzialny za interakcję od procesów myślowych. Gdy użytkownik zada złożone pytanie wymagające przeszukania sieci lub głębszego rozumowania, GPT-Live deleguje to zadanie w tle do modelu GPT-5.5 (jeszcze dziś, 9 lipca 2026, spodziewamy się publicznej premiery GPT-5.6). Asystent podtrzymuje płynną rozmowę z kierowcą, podczas gdy drugi algorytm w tle szuka właściwych danych.

    Zarówno darmowi, jak i płatni użytkownicy otrzymują dostęp do nowej technologii w ramach dwóch wersji:

    • Base / GPT-Live-1 mini: szybszy model dla użytkowników bezpłatnego planu Free.
    • Premium / GPT-Live-1: wersja dla subskrybentów planów Plus i Pro, oferująca opcję wyboru poziomu rozumowania w tle (Szybki, Średni lub Wysoki).

    System wspiera język polski, choć producent uprzedza, że w początkowej fazie model może mówić z obcym akcentem, co będzie eliminowane w kolejnych tygodniach. W momencie premiery funkcja nie obsługuje jeszcze analizy wideo ani współdzielenia ekranu – te opcje wymagają tymczasowego przełączenia się na starszy, standardowy tryb głosowy.

    OpenAI podkupuje szefa projektów Vision Pro i inteligentnych okularów

    #aplikacjeSamochodowe #AppleCarPlay #asystentGłosowy #ChatGPT #fullDuplex #GPT55 #GPTLive #iOS #OpenAI #sztucznaInteligencja
  4. Запуск I2S Трансивера на Artery [часть 2] (DMA FSM, Pipeline)

    В этом тексте вы узнаете, что общего между I2S трансивером и оладьями . Да... Именно так. А также зачем программисту микроконтроллеров конвейеры и цифровые фильтры . В тексте изложено про то, как источать звук при помощи I2S + DMA.

    habr.com/ru/articles/834304/

    #DMA #i2s #конвейер #fsm #hiload #конечные_автоматы #pipeline #wm8731 #artery #fullduplex

  5. Friend designed something very cool. A new type of a raspi SDR hat!
    Receive and transmit have already been tested too.
    #SDR #homebrew #hamradio #fullduplex #70cm #TETRA #raspberrypi

  6. Friend designed something very cool. A new type of a raspi SDR hat!
    Receive and transmit have already been tested too.
    #SDR #homebrew #hamradio #fullduplex #70cm #TETRA #raspberrypi

  7. Okay, stupid question, but for those knowledgeable in #80211ax #WiFi6, is it - as ethernet is - #FullDuplex? ie: I have a #M1 MBP 13", and an #Eero6 with Wi-Fi 6. If I'm receiving a file, and choose to send a file at the same time over ethernet, neither slow down - cos full duplex. Is WiFi the same? Or does an upload appreciably slow a download?

    Thanks for what is probably a stupid question.

    [edited to change bidirectional to full duplex]

  8. Okay, stupid question, but for those knowledgeable in #80211ax #WiFi6, is it - as ethernet is - #FullDuplex? ie: I have a #M1 MBP 13", and an #Eero6 with Wi-Fi 6. If I'm receiving a file, and choose to send a file at the same time over ethernet, neither slow down - cos full duplex. Is WiFi the same? Or does an upload appreciably slow a download?

    Thanks for what is probably a stupid question.

    [edited to change bidirectional to full duplex]