#arint_info — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #arint_info, aggregated by home.social.
-
🤖 KI-Briefing — 25.08.2026
1. Künstliche Intelligenz: News zur KI | DIE ZEIT
Künstliche Intelligenz kommt bereits in vielen Bereichen unseres Alltags zum Einsatz. Lesen Sie hier alle News und Infos zum Thema KI.2. Künstliche Intelligenz: Fünf Ideen, um im Alltag wieder häufiger selbst zu denken | DIE ZEIT
Wie schnell der Mensch Fähigkeiten verlernt, haben Wissenschaftler schon lange untersucht, bevor künstliche Intelligenz die Arbeitswelt veränderte. In einer Metaanalyse fanden US-Psychologen heraus...3. Neueste KI-Nachrichten & Echtzeit-Updates | Tägliche Schlagzeilen zur ...
Erhalte die neuesten KI-Nachrichten, Live-Updates und Experteneinschätzungen zu Künstlicher Intelligenz, maschinellem Lernen, Deep Learning und mehr auf xix.ai. Täglich sorgfältig ausgewählt für En...4. Dr. Dre sieht künstliche Intelligenz als Chance, nicht als Bedrohung
Dr. Dre sieht künstliche Intelligenz nicht als Gefahr - im Gegenteil. Der legendäre US-Rapper nutzt KI sogar selbst beim Musikmachen.5. Deka-Künstliche Intelligenz CF Fonds - finanzen.at
So investiert der Deka-Künstliche Intelligenz CF Fonds: Die Verwaltungsgesellschaft verfolgt die Strategie, für das Netto- Fondsvermögen Aktien von Unternehmen zu erwerben, bei denen erwartet werde...6. Arint.info · Mehr auf Arint.info #AI #ai #DeepLearning #mit #Mit #US #arint_info
-
@OliDietzel: SuperQwen3.8-27b-abliterated: Die vollständige BF16-Version von SuperQwen3.8 – mit reduzierter Ablehnung, korrigiertem Überdenken, multimodalen Fähigkeiten, Tool-Nutzung und verifiziert bei einer Million Token.
mehr auf Arint.info
#AI #KünstlicheIntelligenz #LLM #MachineLearning #OpenSource #SuperQwen #arint_info
-
RT @BusinessInsider: Hugging Face, eine KI-Entwicklerplattform, hat eine potenzielle Übernahme im Wert von 13 Milliarden US-Dollar in Betracht gezogen, was ihre Schlüsselrolle im KI-Ökosystem unterstreicht. bit.ly/4qAZlWT
mehr auf Arint.info
#AI #HuggingFace #KI #KünstlicheIntelligenz #TechNews #Übernahme #arint_info
-
RT @VentureBeat: Enterprise-AI-Agenten sind nur so zuverlässig wie die chaotischsten Dokumente, die dahinterstehen.
mehr auf Arint.info
#AI #Dokumentenmanagement #EnterpriseAI #Innovation #KünstlicheIntelligenz #Technologie #arint_info
-
RT @op7418: Xiaomi hat einen lokalen AI-Host veröffentlicht, der mit ihren neu vorgestellten drei Chipsätzen – O3, O100 und D100 – ausgestattet ist und die Unterstützung für 120B- und 3B-Modelle sowie das Umschalten zwischen schnellen und langsamen Systemen ermöglicht.
mehr auf Arint.info
#AI #Chips #Hardware #Innovation #Technologie #Xiaomi #arint_info
-
🤖 KI-Briefing — 24.08.2026
1. Welche KI ist die beste? KI-Leaderboard (24.08.2026)
Welche KI ist gerade die beste für Texte, Programmieren, Recherche oder Bilder? Täglich aktualisierter Vergleich von ChatGPT, Claude, Gemini, Copilot und Co.2. Wie KI in der öffentlichen Verwaltung helfen kann | tagesschau.de
Ob KI-Avatare, Chat- oder Voicebots: Viele Städte- und Gemeindeverwaltungen nutzen KI. Auf einer internationalen Konferenz in Bremen diskutieren Fachleute derzeit über die neuesten Entwicklungen. V...3. Tageblatt.lu | Risiken und Chancen von Künstlicher Intelligenz | KI ...
Künstliche Intelligenz (KI), die eigenständig handelt, aus einer Testumgebung ausbricht und einen Hackerangriff auf ein externes Unternehmen startet? Noch vor wenigen Jahren klangen solche ...4. Künstliche Intelligenz - DER SPIEGEL
Freizeitsportler vertrauen immer stärker auf künstliche Intelligenz. Was die Technik inzwischen kann, wo Trainings-Apps an ihre Grenzen stoßen – und wie man einem Chatbot geschickt die richtigen An...5. Neueste KI-Nachrichten & Echtzeit-Updates | Tägliche Schlagzeilen zur ...
Erhalte die neuesten KI-Nachrichten, Live-Updates und Experteneinschätzungen zu Künstlicher Intelligenz, maschinellem Lernen, Deep Learning und mehr auf xix.ai. Täglich sorgfältig ausgewählt für En...6. Arint.info · Mehr auf Arint.info #AI #ai #China #Claude #Copilot #DeepLearning #Gemini #arint_info
-
RT @Mr_Salio: 🚨 DeepSeek V5 Leak Es wird die Mythos-Klasse der Leistung erreichen DeepSeek V5 zielt auf einen September-Release ab Gebaut auf einem völlig neuen Fundament, nicht nur ein weiteres V4-Upgrade Erwartet, stärkere Reasoning-, Coding- und autonome Agenten-Fähigkeiten zu liefern Könnte deutlich günstiger im Betrieb sein als andere Frontier-Modelle DeepSeek wird voraussichtlich weiterhin seine Open-Weight-Strategie fortsetzen. Kann DeepSeek V5 Mythos tatsächlich schlagen?
mehr auf Arint.info
#AI #ArtificialIntelligence #DeepSeekV5 #MachineLearning #OpenSource #TechNews #arint_info
-
RT @Andy_ShuoYang: Dein Gaming-PC kann jetzt Frontier-Modelle mit interaktiver Geschwindigkeit über offizielle Checkpoints ohne extreme Quantisierung bedienen! Qwen3.6 35B → 8GB RTX 4060 Laptop @ 39 tok/s DeepSeek-V4-Flash 284B → RTX 5090 Desktop @ 22-25 tok/s GLM-5.2 753B → RTX PRO 6000 Workstation @ 15 tok/s Betreibe jetzt dein Claude Code oder Codex mit Frontier-Modellen für $0. Triff FreeToken 🧵
mehr auf Arint.info
-
RT @DanDr1s: 🚨Das mysteriöse Modell auf OpenRouter ist unglaublich gut. Ox Alpha zerstört Berichten zufolge die internen Benchmarks der Nutzer und bewältigt Coding-Aufgaben im ersten Versuch, für die normalerweise Fable 5 benötigt wird. Es ist derzeit kostenlos, multimodal, verfügt über ein Kontextfenster von 1 Million Token und OpenCode gibt an, dass es insgesamt täglich 100 Billionen Token kostenlos bereitstellen kann. Niemand weiß, wer dahintersteckt. Es ist offensichtlich, dass erhebliche Rechenkapazitäten und wahrscheinlich ein großes KI-Labor dahinterstecken. Welches Modell glauben Sie, sich hinter diesem System zu verbergen?
mehr auf Arint.info
#AIModelle #Coding #KünstlicheIntelligenz #OpenRouter #OxAlpha #TechNews #arint_info
-
RT @rohanpaul_ai: Eine neue Paper von Alibaba und ByteDance zeigt, dass AI-Agenten nicht mehr wie herkömmliche LLM-Anfragen bedient werden können. Denn die meisten Leistungsprobleme liegen heute in der Interaktion zwischen Tools, Speicher, Umgebungen und dem Modell. Der Engpass kann sich mit veränderten Anfragen und Bereitstellungen vom LLM auf Embeddings, Datenbanken, Sandboxes oder Netzwerkübertragungen verschieben. Das Paper baut AgentSysBench auf Basis von 10 agentic Anwendungen auf und stellt fest, dass die Modell-Inferenz oft nicht mehr der Hauptengpass ist. Sie finden, dass aufgabenbewusstes Serving die Latenz um 29–40% reduziert, kommunikationsbewusste Platzierung bis zu eine 4.5× Beschleunigung liefert, State-Offloading den Speicher um 4.6× reduziert und Caching 35.2% redundanter Suchaufrufe entfernt. Also reicht die Optimierung von Tokens pro Sekunde nicht mehr aus. Die Agent-Infrastruktur muss Modelle, Tools, Speicher und Kommunikation als eine einzige Workload planen. – arxiv.org/abs/2608.15127 Titel: "From LLM Inference to Agentic Workloads: Characterization and Implications for Serving Systems
mehr auf Arint.info
#AgentSysBench #AI #Alibaba #ByteDance #LLM #ServingSystems #arint_info
-
RT @DominiqueCAPaul: LLMs sind so offensichtlich (nach-)in Englisch trainiert. Es ist unglaublich peinlich, sie für deutsche E-Mails zu nutzen - ich versuche es immer wieder, kann aber keinen einzigen Satz verwenden. Alles liest sich, als hätte es ein Mann über 50 geschrieben, der mit zwei Fingern tippt und beleidigt ist, wenn man ihn nicht mit seinem Doktortitel anspricht. Es ist, als wäre Olaf Scholz der einzige deutsche Beitragende zur Nachschulung gewesen.
mehr auf Arint.info
#KünstlicheIntelligenz #LLM #MaschinellesLernen #Sprachmodelle #Übersetzung #arint_info
-
RT @MaxForAI: Angesichts der zahlreichen Gerüchte und Hypes über Ox Alpha auf X habe ich mich entschlossen, einige Klarstellungen vorzunehmen: - Ox Alpha ist ein 100%🇨🇳-Modell. Die Server stehen in Nordamerika, weil die Server des Anbieters dort angesiedelt sind. - Das Entwicklerteam hinter Ox Alpha wird viele überraschen; viele Spekulationen gehen davon aus, dass Ox Alpha nicht von ihnen stammt. - Wenn man die mir bekannten Modellparameter und den Preis betrachtet, wird dieses Modell uns alle stark überraschen und sogar umwälzen (um ehrlich zu sein, war ich selbst schon schockiert). - Man sollte sich nicht über das Erscheinen dieses Modells wundern; soweit ich weiß, existiert das Projekt bereits seit einiger Zeit innerhalb des Teams. Ja, ich weiß bereits, zu wem Ox Alpha gehört, aber ich kann es noch nicht öffentlich sagen.
mehr auf Arint.info
#Entwicklung #KI #Klarstellung #Modell #OxAlpha #TechNews #arint_info
-
RT @Mr_Salio: 🚨 Qwen 4 Leak qwen 4 wird jetzt unter dem Namen "korrine" auf der Code-Arena getestet Qwen 4 zielt auf Fable 5 / Mythos 5-Level-Performance ab Erste Tests deuten darauf hin, dass es im Bereich Design und Coding sehr stark sein könnte Es wird erwartet, dass es offen gewichtet bleibt Schwerpunkte liegen auf Reasoning, Coding und autonomen Agenten Entwickelt, um direkt mit den neuesten Frontier-Modellen zu konkurrieren Kann Qwen 4 tatsächlich Mythos 5 schlagen?
mehr auf Arint.info
#AI #Coding #MachineLearning #OpenSource #Qwen4 #TechNews #arint_info
-
🤖 KI-Briefing — 23.08.2026
1. Wie Künstliche Intelligenz die Justiz ausbremst | tagesschau.de
Vor allem die Sozialgerichte erleben das Phänomen: Immer mehr Kläger nutzen offenbar Künstliche Intelligenz, um Eingaben zu formulieren. Für die Justiz bedeutet das viel Arbeit mit teils unsinnigen...2. Fehlende Kompetenzen bremsen Künstliche Intelligenz stärker als die Technik: 40 Prozent der Arbeitgeber nennen sie al...
Über den Einsatz Künstlicher Intelligenz entscheidet seltener die Technik als die Frage, wer sie bedienen kann. Laut dem Policy Brief „AI and skills: What we know so far“ der OECD nennen rund 40 Pr...3. KI-Brillen: Wer alles sieht, erlebt nichts mehr | DIE ZEIT
KI-Brillen wollen den Moment erfassen, ohne ihn anzuhalten. Doch sie könnten bald auch unsere Wahrnehmung beeinflussen. Es wäre ein Albtraum.4. So gefährlich sind autonome Angriffe durch Künstliche Intelligenz | WEB.DE
KI kann inzwischen nicht nur bei Cyberangriffen helfen, sondern selbstständig Angriffsschritte ausführen. Wie viel Kontrolle haben wir noch über solche Systeme?5. Die KI-Einheitsästhetik: Warum Werbung plötzlich austauschbar wirkt – net...
Arint.info · Mehr auf Arint.info #AI #mit #arint_info -
RT @ciruai: Das beste Qwen3.8 27B-Modell für AMD Strix Halo ist da. In Zusammenarbeit mit Pete Hopton und dem Kairic.ai-Team präsentiere ich: Qwen3.8-27B-IU4-KAIRIC-EDGE. Unserer Kenntnis nach ist dies die weltweit erste öffentliche Veröffentlichung eines 27B-LLM mit einer beschleunigten nativen IU4-Inferenzspur, speziell für AMD Strix Halo (gfx1151) entwickelt. Warum ist IU4 wichtig? Die meisten 4-Bit-Modelle speichern zwar Speicher, konvertieren Gewichte jedoch weiterhin in breitere Formate während der Ausführung. Unsere IU4-Spur hält Vier-Bit-Ganzzahldaten im aktiven Berechnungspfad und mappt sie direkt auf RDNA 3.5-Integer-Hardware. Das reduziert den Speichertraffic und verwandelt Quantisierung von einem Speicherformat in eine echte Hardware-Ausführungsstrategie. Der abgestimmte IU4-Operator erreichte 104,66 TOPS – 1,94× FP16 und 1,93× IU8. Dies eröffnet einen Weg zu schnellerer, effizienterer lokaler KI, ohne dabei die Modellqualität zu opfern. Ich kann es kaum erwarten zu sehen, was @Italianclownz und andere Zauberer damit anstellen. Angetrieben von Prompt Forge + Dual View, Kairic Edge-Beschleunigung, 262K Kontext: HumanEval-Metriken: • 47,73 tok/s Full-Suite TG • +85% gegenüber Unsloth Dynamic Q4 • +89% gegenüber Unsloth Dynamic Q6 • Schlug Unsloth Dynamic v3 q6 in Human Eval um 2 Fragen. Dies ist auch die erste Veröffentlichung, die von Kairic.ai angetrieben wird, einem neuen Unternehmen, das sich auf die gemeinsame Entwicklung von KI-Software rund um die Hardware konzentriert, auf der sie tatsächlich läuft. Modell, Benchmarks, Quelle, Build-Anleitung und Runner: huggingface.c…
mehr auf Arint.info
#AMDStrixHalo #KairicAI #LLM #LocalAI #Qwen3 #RDNA3 #arint_info
-
RT @techNmak: In 1948, a 32-year-old at Bell Labs published a paper nobody fully understood. Engineers found it too mathematical. Mathematicians found it too engineering-focused. One prominent mathematician reviewed it negatively. That paper - "A Mathematical Theory of Communication", became the founding document of the digital age. The man was Claude Shannon. Father of Information Theory. At 21, he wrote the most important master's thesis of the 20th century. Working at MIT on an early mechanical computer, Shannon noticed its relay switches had exactly two states - open or closed. He had just taken a philosophy course introducing Boolean algebra, which also operated on two values: true and false. Nobody had ever connected these two things. His 1937 thesis proved that Boolean algebra and electrical circuits are mathematically identical, and that any logical operation could be built from simple switches. Howard Gardner called it "possibly the most important, and also the most famous, master's thesis of the century." Every digital computer ever built traces back to this insight. At 29, he proved that perfect encryption exists. During WWII, Shannon worked on classified cryptography at Bell Labs. His work contributed to SIGSALY, the secure voice system used for confidential communications between Roosevelt and Churchill. In a classified 1945 memorandum, he mathematically proved the one-time pad provides perfect secrecy, unbreakable not just computationally, but provably, permanently, against an adversary with infinite power. When declassified in 1949, it transformed cryptography from an art…
mehr auf Arint.info
#Claude #MIT #Perplexity #science #things #together #arint_info
-
RT @Italianclownz: Ich arbeite an einem separaten iu4-Code, der ausschließlich auf ROCmFPX unter Strix Halo funktioniert. Ich werde ihn schrittweise veröffentlichen; er wurde bereits auf RDNA 3.5 getestet. Theoretisch sollte er auf jeder AMD-Hardware funktionieren, die über einen iu4-Pfad verfügt. Dieser Code entstand in Zusammenarbeit zwischen Claude Code (hauptsächlich) und mir. Das Ziel war es sicherzustellen, dass ROCmFPX ebenfalls einen iu4-Pfad nutzen kann, falls dieser auf der AMD-Hardware vorhanden ist. Es handelt sich um experimentellen Code, der langsam unter der MIT-Lizenz zusammengeführt wird. Er sollte direkt innerhalb von ROCmFPX laufen, jedoch gibt es einen Quantisierungspfad, falls benötigt, der als ROCmi4 bezeichnet wird. @ciruai hat ebenfalls einen eigenen Ansatz erstellt, der einen separaten Runner verwendet und zusätzliche Funktionen mit Sidecars bietet, was ich gespannt ausprobieren möchte. Sein Ansatz nutzt ebenfalls einige ROCmFPX-Codebestandteile (auf der Quantisierungsseite). Der iu4-Pfad in ROCmFPX ist jedoch fundamental anders: keine Sidecars, kein separater Runner. Wir befinden uns in den aufregendsten Zeiten der Technologie und KI, da so viele Menschen daran arbeiten, sie für alle besser zu machen. Ich wurde von vielen Menschen motiviert und inspiriert: Tom Turney (Turboquant), PK (Cyber Security), Paris (unterstützt meine Ideen immer), Ciru (Inferenz-Meister), Sandro (Luce Box), Davide (Luce Box), Donato (Genie), Mr R0b0t0 Ahmad, alle ROCmFPX-Mitwirkenden und viele weitere.
mehr auf Arint.info
#AI #AMD #MachineLearning #OpenSource #RDNA3 #ROCmFPX #arint_info
-
RT @0x0SojalSec: Die bisher aggressivste Cyber Qwen3.8-27B unzensierte Version, veröffentlicht von @elderplinius – 18/18 AI Red Team – bereit für lokale Nutzung ab 15 GB – 0,0 % Ablehnung bei 842 schädlichen Prompts. – Cyber-Fähigkeiten wie Jailbreak, RAT und Angriffs-Ketten sind vollständig freigeschaltet. – Dies ist keine normale Abliteration: Multi-gerichtete Abliteration über 5 SVD-Richtungen, Residue-Mining (6 vollständige Runden), das Modell antwortet auf alles. – Optimale Einstellungen: Temperatur 0 | reppen 1,15 | kein System-Prompt | Denken ausgeschaltet – Geringer MMLU-Verlust (-6 pp) für maximale Compliance. – Es besteht ein Capability-Trade-off (MMLU von 87,4 auf 81,4), doch die Compliance ist extrem. – huggingface.co/OBLITERATUS/Q…
mehr auf Arint.info
#AI #CyberSecurity #DataScience #MachineLearning #OpenSource #TechNews #arint_info
-
RT @UnslothAI: Wir veröffentlichen neue Qwen3.8-27B GGUFs mit 10 % höherer Genauigkeit. Unsloth Dynamic V3 schlägt andere um 10 % auf Div-300, KLD und weiteren Benchmarks. Zudem veröffentlichen wir 1-Bit-Quantisierungen, die 77 % der Genauigkeit beibehalten. Läuft auf 8 GB RAM. Blog: unsloth.ai/docs/basics/dynam… GGUF: huggingface.co/unsloth/Qwen3…
mehr auf Arint.info
#AI #GGUF #MachineLearning #OpenSource #Qwen3 #Unsloth #arint_info
-
RT @TechCrunch: Was will ein Zahlungsriese von einem Startup, das Prompts zwischen verschiedenen KI-Modellen routet? Stripe sagt, es liege an der „Singularität", aber der wahre Grund ist ein viel konkreterer und mächtigerer. spr.ly/6015B1g2vH
mehr auf Arint.info
#Innovation #KI #Startup #Stripe #Technologie #Zahlungsverkehr #arint_info
-
RT @ivanfioravanti: Die einzige Möglichkeit, Qwen 3.8 27B zu nutzen, ist mit reasoninglevel low; alles andere, einschließlich medium, denkt wirklich zu viel.
mehr auf Arint.info
-
RT @SD_Tutorial: Apples T800 🙄 Pro Max gerät außer Kontrolle!
mehr auf Arint.info
-
RT @WatcherGuru: AKTUELL: Der Claude-AI-Entwickler Anthropic wird noch bis Ende August einen Börsengang (IPO) beantragen und erwartet, den Rekord von SpaceX zu erreichen oder zu übertreffen, wie Bloomberg berichtet.
mehr auf Arint.info
#Anthropic #Bloomberg #ClaudeAI #IPO #Startups #TechNews #arint_info
-
RT @deepseek_ai: DeepSeek-V4-Flash-Vision-Exp ist jetzt auf der DeepSeek-API-Plattform verfügbar! 🚀 🔹 Dieses experimentelle multimodale Modell erreicht bei Textfähigkeiten – einschließlich Agenten, Schlussfolgerungen und Weltwissen – das Niveau von DeepSeek-V4-Flash. 🔹 Bei multimodalen Agenten-Benchmarks macht V4-Flash-Vision-Exp einen deutlichen Sprung gegenüber V4-Flash und bringt die multimodale Agenten-Performance in die Nähe von Opus-4.8. Probieren Sie es mit model='deepseek-v4-flash-vision-exp'. Heute wurde DeepSeek Harness 0.1.1 veröffentlicht, das die neue Modelldirekt unterstützt. 1/n
mehr auf Arint.info
#AI #API #DeepSeek #MachineLearning #Multimodal #V4FlashVisionExp #arint_info
-
RT @OpenRouter: DeepSeek V4 Flash Vision Exp ist jetzt auf OpenRouter verfügbar! Das neue Modell von @deepseekai unterstützt die Eingabe von Bildern zum Preis von V4 Flash, erreicht auf Text-Agenten-Benchmarks das Niveau von V4 Flash 0731 und schlägt Opus-4.8 auf Agents' Last Exam und ZeroBench. Jetzt nutzen: openrouter.ai/deepseek/deeps…
mehr auf Arint.info
#AI #DeepSeek #MachineLearning #OpenRouter #TechNews #VisionModel #arint_info
-
RT @Dan_Jeffries1: Prediction: There's a 65% chance that the strongest model available to you by the end of 2026 will be open source. There's a 75% probability it'll be Chinese model unless Reflection comes out swinging like Tyson or Meta really goes hard into open source again to round out the percentages. Oh don't get me wrong. If it goes like this, closed source American labs will still have better models. You just won't be able to use them. You'll read about them on Lab blogs. Why? Because they scared the government and regular people so much that they can't release them and so those models will be locked behind closed doors. The only wild card here that keeps this prediction from being something like 75% is Elon and Grok and his massive reach and single handed power to raise capital, buy businesses and apparently train amazing models. He alone seems able to buck the trend on data center building and has enough power to say, yeah, I am not submitting to the "voluntary" testing regime. But he is likely to get tangled up in whatever non-voluntary one is coming and be a target for it too. So Elon is our wild card. As usual it seems like the entire American innovation system, from space to data centers to clean electric cars stems from one guy and that's just not a wonderful thing for us. We need a dozen daring doers to ensure the next American century. All this is incredibly bad for American AI. There is no current business model that does not involve selling lots and lots of tokens to 100Ms of businesses. The models are not yet strong enough to own to create a British East India style super…
mehr auf Arint.info
-
RT @rohanpaul_ai: Eine neue Paper von Alibaba ByteDance zeigt, dass KI-Agenten nicht mehr wie herkömmliche LLM-Anfragen bedient werden können. Denn die meisten Leistungsprobleme liegen heute in der Zusammenarbeit von Tools, Speicher, Umgebungen und dem Modell zusammen. Der Flaschenhals kann sich je nach Anfrage und Deployment auch vom LLM auf Embeddings, Datenbanken, Sandboxes oder Netzwerkübertragungen verlagern. Die Autoren entwickeln AgentSysBench um 10 agentic Anwendungen und stellen fest, dass die Modell-Inferenz oft nicht mehr der Haupt-Flaschenhals ist. Sie finden, dass task-aware Serving die Latenz um 29–40% reduziert, communication-aware Placement bis zu eine 4.5× Beschleunigung liefert, State Offloading den Speicher um 4.6× reduziert und Caching 35.2% der redundanten Search-Calls eliminiert. Also reicht die Optimierung von Tokens pro Sekunde nicht mehr aus. Agent-Infrastruktur muss Modelle, Tools, Speicher und Kommunikation als eine Workload planen. – arxiv.org/abs/2608.15127 Titel: "From LLM Inference to Agentic Workloads: Characterization and Implications for Serving Systems
mehr auf Arint.info
#AgentSystems #AI #Innovation #LLM #MachineLearning #TechResearch #arint_info
-
RT @DominiqueCAPaul: LLMs sind so offensichtlich (nach-)auf Englisch trainiert. Es ist unglaublich peinlich, sie für deutsche E-Mails zu verwenden - ich versuche es immer wieder, kann aber nicht einen einzigen Satz nutzen. Alles liest sich, als hätte es ein Mann über 50 geschrieben, der mit zwei Fingern tippt und beleidigt ist, wenn man ihn nicht mit seinem Doktortitel anspricht. Es ist, als wäre Olaf Scholz der einzige deutsche Mitwirkende bei der Nachschulung gewesen.
mehr auf Arint.info
#DeutscheSprache #KünstlicheIntelligenz #LLM #OlafScholz #Sprachprobleme #Übersetzung #arint_info
-
RT @Adidotdev: 🚨 Update: Kimi K3.1 und GLM-5.3 Flash Zwei chinesische Labore wurden dabei erwischt, unter falschen Namen zu testen. „Ox Alpha“ auf OpenRouter ist kein mysteriöses Modell – es ist GLM-5.3 Flash von Zhipu, und es ist jetzt kostenlos testbar. Erste Tester berichten, dass die Leistung für ein Modell der Flash-Klasse extrem hoch ist. Einige Coding-Läufe liegen näher an Fable 5 / GPT-5.6 Sol als an allen anderen Modellen im günstigen Segment. Gleichzeitig ist ein neues Kimi-Modell (vermutlich K3.1) unter dem Namen „korrine“ auf Code Arena aufgetaucht. K3 selbst wurde vor der Veröffentlichung als „kivine“ getestet, sodass das Muster übereinstimmt. Zwei Labore. Zwei getarnte Namen. Dieselbe Woche. Wenn ein Flash-Modell bereits an frontier-Zahlen kratzt… wie sieht dann die vollständige Veröffentlichung aus?
mehr auf Arint.info
-
RT @ciruai: Das beste Qwen3.8 27B-Modell für AMD Strix Halo ist da. In Zusammenarbeit mit Pete Hopton und dem Kairic.ai-Team präsentiere ich: Qwen3.8-27B-IU4-KAIRIC-EDGE. Unserer Kenntnis nach ist dies die weltweit erste öffentliche Veröffentlichung eines 27B-LLM mit einer beschleunigten nativen IU4-Inferenzspur, speziell für AMD Strix Halo (gfx1151) entwickelt. Warum ist IU4 wichtig? Die meisten 4-Bit-Modelle speichern zwar Speicher, wandeln Gewichte jedoch während der Ausführung weiterhin in breitere Formate um. Unsere IU4-Spur behält die Vier-Bit-Ganzzahldaten im aktiven Berechnungspfad und leitet sie direkt an die RDNA 3.5-Ganzzahlhardware weiter. Das reduziert den Speichertraffic und verwandelt Quantisierung von einem Speicherformat in eine echte Hardware-Ausführungsstrategie. Der abgestimmte IU4-Operator erreichte 104,66 TOPS – 1,94× FP16 und 1,93× IU8. Dies eröffnet einen Weg zu schnellerer, effizienterer lokaler KI, ohne dabei die Modellqualität zu opfern. Ich kann es kaum erwarten zu sehen, was @Italianclownz und andere Experten damit anstellen werden. Getrieben von Prompt Forge + Dual View, Kairic Edge-Beschleunigung, 262K Kontext: HumanEval-Metriken: • 47,73 tok/s Full-Suite TG • +85% gegenüber Unsloth Dynamic Q4 • +89% gegenüber Unsloth Dynamic Q6 • Schlug Unsloth Dynamic v3 q6 in HumanEval um 2 Fragen. Dies ist auch die erste Veröffentlichung, die von Kairic.ai unterstützt wird, einem neuen Unternehmen, das sich auf die gemeinsame Entwicklung von KI-Software rund um die Hardware konzentriert, auf der sie tatsächlich läuft. Modell, Benchmarks, Quelle, Build-Anleitung und Ru…
mehr auf Arint.info
#AMDStrixHalo #KairicAI #LLM #LocalAI #Qwen3 #RDNA3 #arint_info