#gpt4o — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #gpt4o, aggregated by home.social.
-
https://winbuzzer.com/2026/05/05/image-ai-models-now-drive-app-growth-beating-chatb-xcxwbn/
Image AI Launches Beat Chatbot Upgrades on App Growth
#AI #AIImageGeneration #AIModels #GenerativeAI #Chatbots #ChatGPT #OpenAI #GPT4o #Google #GoogleGemini #MetaAI #DeepSeekR1 #MultimodalAI
-
New research shows that updates to GPT‑4o spark genuine grief—people are mourning their AI companion as if it were a person. The study dives into how language models become digital relationships and what emotional attachment means for future AI design. Curious? Read the full findings. #GPT4o #AICompanion #AIMourning #DigitalRelationships
🔗 https://aidailypost.com/news/study-finds-gpt4o-updates-trigger-real-mourning-users-personify-model
-
Apple odkrywa na nowo zapomnianą technikę AI do generowania obrazów – Normalizing Flows
Apple zaprezentowało dwa badania, w których reaktywuje mało znaną technikę AI – Normalizing Flows (NF), mogącą konkurować z popularnymi dziś modelami dyfuzyjnymi (np. Stable Diffusion) i autoregresyjnymi (np. GPT-4o).
Czym są Normalizing Flows? To modele, które uczą się przekształcać dane rzeczywiste (np. obrazy) w szum i odwrotnie, z możliwością dokładnego obliczania prawdopodobieństwa wygenerowanego obrazu – coś, czego nie potrafią modele dyfuzyjne.
Pierwsze badanie TarFlow łączy Normalizing Flows z architekturą Transformerów. Generuje obraz bez tokenizacji, operując bezpośrednio na wartościach pikseli. To redukuje utratę jakości typową dla modeli przekształcających obrazy w symbole tekstowe.
Obrazy o różnych rozdzielczościach wygenerowane przez modele TarFlow. Od lewej do prawej, od góry do dołu: obrazy 256×256 w AFHQ, obrazy 128×128 i 64×64 w ImageNet.
2 badanie STARFlow działa w przestrzeni latentnej – generuje uproszczony obraz, który dekoder przekształca w wysoką rozdzielczość. Model może być zasilany zewnętrznymi LLM-ami (np. Gemma), które interpretują polecenia tekstowe użytkownika, a STARFlow skupia się na szczegółach wizualnych.
Losowe próbki STARFlow na ImageNet 256 × 256 i 512 × 512.
Jak wygląda porównanie Apple z OpenAI?
GPT-4o generuje obrazy jako sekwencje tokenów (jak tekst), co daje uniwersalność, ale jest wolne i zasobożerne – wymaga pracy w chmurze.
STARFlow jest zoptymalizowany pod pracę lokalną (on-device) – szybszy i bardziej energooszczędny.
Apple stawia na wydajne, lokalne generowanie obrazów, idealne dla urządzeń mobilnych.
#AI #aiapple #AppleAI #appleai #appleml #applevsopenai #generatywnaSztucznaInteligencja #generowanieobrazów #gpt4o #normalizingflows #OpenAI #starflow #sztucznaInteligencja #sztucznainteligencja #tarflow #technologia #transformerai
-
🧩 #Llama4Maverick nutzt 128 Experten für deutlich mehr Rechenleistung und schlägt sogar #GPT4o und #Gemini20 in Benchmarks – bei nur der Hälfte der aktiven Parameter von #DeepSeekv3.
🎓 Beide #KIModelle wurden mithilfe des riesigen Lehrmodells #Llama4 Behemoth trainiert, das mit 288 Milliarden aktiven Parametern zu den leistungsstärksten weltweit zählt.
👉 https://eicker.TV #Technik #Medien #Politik #Wirtschaft (2/2)
-
Search Engine Journal: OpenAI Rolls Out GPT-4o Image Creation To Everyone. “OpenAI has rolled out a new image generation system directly integrated with GPT-4o. This system allows the AI to access its knowledge base and conversation context when creating images. This integration is said to enable more contextually relevant and accurate visual outputs.”
-
📝 If you missed my talk at #ODSCWest yesterday, don't worry! The writeup is ready ✨
1️⃣ Let's see the challenges of building voice bots that actually sound human 💁♀️ https://www.zansara.dev/posts/2024-09-05-building-voice-agents-with-open-source-tools-part-1/
2️⃣ Let's make a simple #Pipecat voice bot with the same latency as #GPT4o #VoiceMode for a fraction of the cost 💸 https://www.zansara.dev/posts/2024-10-30-building-voice-agents-with-open-source-tools-part-2/
-
OpenAI verschiebt Einführung des “Voice Mode” auf Juli
OpenAI, der Hersteller von ChatGPT, hat angekündigt, die Einführung der neuen "Voice Mode"-Funktion um einen Monat auf Juli zu verschieben. Ursprünglich sollte das reali
https://www.apfeltalk.de/magazin/news/openai-verschiebt-einfuehrung-des-voice-mode-auf-juli/
#KI #News #Benutzererfahrung #chatGPT #EchtzeitAntworten #GPT4o #KITechnologie #OpenAI #Sprachkonversation #TechnischeVerzgerungen #VideoUndBildschirmfreigabe #VoiceMode