#reinforcementlearning — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #reinforcementlearning, aggregated by home.social.
-
Reinforcement Learning is hard!... Just saying.
-
Was passiert, wenn #Algorithmen in der #Intensivmedizin mitentscheiden?
Ein KI-System an der TU #Wien liefert Behandlungsvorschläge bei #Sepsis – und die Ergebnisse sorgten für Aufmerksamkeit. Die Mediziner müssen sich auch mit der Frage befassen, wer die Verantwortung trägt, wenn Technologie zum Mitentscheider werden könnte. 🤖💉
#MedizinischeKI #Intensivmedizin #ReinforcementLearning #KINutzen #Retröt
-
Крестики-нолики. Самообучение с подкеплением
На примере игры в крестики-нолики рассмотрены идеи и базовые методы обучения с подкреплением. Кратко дано методологическое обоснование методов.
-
5/ Das fand ich hier sehr interessant:
Collins, Harry, Simon Thorne, Paul Newbury & Robert Evans. 2026. More problems of large language
models in comparison with human knowledge. AI & Society. https://doi.org/10.1007/s00146-
026-03021-w.Ist von drei Informatikern und drei Soziologen geschrieben worden. Sie sagen, dass wir unser Wissen in Gruppen, in Communities erwerben. Tischler*innen bringen Lehrlingen bei, was wichtig ist, wie man sich verhält, als Tischler*in.
Bei Ihren Gruppen kommen auch Wissenschaftler*innen, Christ*innen und Neonazis vor. Der Witz an den LLMs ist: Die kriegen alles auf einmal. Gewichtet wird es höchstens durch die Häufigkeit des Vorkommens im Netz. Da das Netz überwiegende weiß ist, ergeben sich Stereotype und Rassismus aus den Daten. Damit das keinen Skandal gibt, braucht man das #ReinforcementLearning. Das ist dann die drangebastelte #Moral. Das wird auch im Artikel thematisiert, genau so wie vom #Papst. Früher wollte uns die #Kirche sagen, wie das mit der Moral ist. Hüstl. Na, das will sie immer noch. Aber da ist relativ klar, wer spricht und was er will. Außer bei Musks Grok ist das bei den anderen KI-Systemen nicht klar. Auch das wird in diesem Artikel thematisiert.
Ich finde es gut, auf diese Weise mal wieder über unsere menschliche Intelligenz nachzudenken. Es ist sehr beeindruckend, was wir als Menschen und Gesellschaften erreicht haben. Nur leider geht gerade alles den Bach runter. Auf verschiedene Arten und Weisen, in verschiedenen Bereichen der Gesellschaft.
-
4/ Darüber kann man hier nachlesen:
Lappin, Shalom. 2024. Assessing the strengths and weaknesses of large language models. Journal of Logic,
Language and Information 33(1). 9–20. https://doi.org/10.1007/s10849-023-09409-x.NB: Als Sprachwissenschaftler interessieren mich die #LLMs ohne das #ReinforcementLearning und irgendwelche draufgebauten Inferenzsysteme.
-
#Pythagoras and the #Cult of #Numbers : Medium
Natural #Tissue #Immortality: Indefinite survival of #SeaCucumber #Explants : Science
#Google #Research Stabilizes “#Willow” #QuantumProcessor Using Continuous #ReinforcementLearning Control Layers: Google
Latest #KnowledgeLinks