home.social

#nlp — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #nlp, aggregated by home.social.

fetched live
  1. Проверка теории улучшения результата LoRA файн‑тюнинга на «умных» слоях

    При LoRA‑дообучении адаптеры обычно применяются ко всем слоям модели, хотя активность разных слоев во время обработки промпта заметно различается. Возникает вопрос: можно ли выбрать более «умные», активные слои для конкретной темы и получить прирост качества? Проверил гипотезу на Qwen3-1.7B: воспроизвёл метод из статьи Act‑LoRA, добавил свою метрику по градиентам, статистически проверил устойчивость сигнала и получил результат, который многое объясняет о том, как на самом деле работает LoRA‑дообучение.

    habr.com/ru/articles/1074796/

    #машинное_обучение #дообучение_llm #lora #finetuning #transformers #pytorch #huggingface #nlp #llm #research

  2. RE: mastodon.social/@JustCodeCultu

    "How and why did artificial intelligence–a field that was committed for so long to the explicit, formal representation of human perception, reason, and expertise–become narrowly redefined as a practice of large-scale statistical pattern recognition, one that prioritized effective prediction over explanatory power? One answer lies in the strange and enduring quest to endow machines with the capacity for language.

    This talk draws from the new book, Divination Engines: Natural Language Processing, Artificial Intelligence, and the Making of Algorithmic Culture (University of Chicago Press 2026), which traces the long history speech and natural language processing from telephony to text mining and examines the far-reaching consequences of opening language to statistical interpretation. …"

    #AI #NLP

  3. 🚨 New FREE Book - Published August 22, 2026 | Version v1
    Book Open
    Ukraine and Russia

    The purpose of this study is to analyze the setting, causes, conditions, and nature of the political, ideological, and military conflict in Ukraine.

    🔗papers.ssrn.com/sol3/papers.cf

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #cryptoreg
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM

  4. 🏛️ Unsere Projektwebseite ist online!

    👉 voxlapidum.hist.uzh.ch

    Vox Lapidum ist ein KI-gestützter Chatbot für über 500'000 lateinische Inschriften und macht die grösste Epigraphik-Datenbank der Welt für Forschung, Bildung und Museen erlebbar.

    Gefördert durch das @DIZH entwickelt von @uzh und Pädagogische Hochschule Zürich in Partnerschaft mit Freies Gymnasium Zürich, Vindonissa Museum und Augusta Raurica.

    #DigitalHumanities #Epigraphik #NLP #OpenScience #AncientHistory #Altertumswissenschaften #Antike #Geschichte

  5. We added confidence scoring to the rule engine.

    Because:

    exact match

    and

    semantic relationship

    shouldn't necessarily have the same strength.

    The engine should know not only what matched, but how strongly it matched.

    #AI #NLP #buildinpublic #edorena

  6. 🚨 New FREE Book - Published August 22, 2026 | Version v1
    Book Open
    Ukraine and Russia

    The purpose of this study is to analyze the setting, causes, conditions, and nature of the political, ideological, and military conflict in Ukraine.

    🔗agustinvstartari.com/books

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #cryptoreg
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM

  7. A Coddy #Developer #Survey found that 80% of #developers find #AIcoding tools #addictive, leading to #workaholism and #burnout. While these tools are #useful, developers worry about becoming #overlyreliant on them, weakening their #problemsolving skills and expanding their #workload. Additionally, the need to verify #AIgeneratedcode adds to the workload, creating a #verificationdebt that can negate the time saved. zdnet.com/article/i-cant-stop- #AIagent #AI #ML #NLP #LLM #GenAI

  8. An #anonymous #AIlab released a model called #OxAlpha, claiming it can process 100 trillion tokens per day. The model’s capabilities and architecture suggest it might be an unreleased version of #Zhipu’s #GLM model, possibly GLM-5.3, or Microsoft’s MAI model. The exact identity of the lab remains unknown, fuelling speculation and analysis within the AI community. wccftech.com/a-mysterious-ai-l #AIagent #AI #ML #NLP #LLM #GenAI

  9. 🚨 New FREE Book - The Templars:
    An Introductory Framework

    The Templars: An Introductory Framework is part of the Work Papers series, a collection devoted to the critical analysis of power through its discursive, legal, religious, and military manifestations.

    🔗papers.ssrn.com/sol3/papers.cf

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #cryptoreg
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM

  10. The gap between #openweightAI and #closedsourceAI models is closing, with open models catching up to the capabilities of closed models at a faster rate with each new era. This trend is evident across three eras of #LLMdevelopment: early scaling, reasoning, and agentic. While benchmarks provide valuable insights, they don’t capture the full picture of model performance and user experience. newsletter.semianalysis.com/p/ #AIagent #AI #ML #NLP #LLM #GenAI

  11. 🚨 New FREE Book - Published August 22, 2026 | Version v1
    Book Open
    Ukraine and Russia

    The purpose of this study is to analyze the setting, causes, conditions, and nature of the political, ideological, and military conflict in Ukraine, not only from the country's internal perspective
    🔗zenodo.org/records/22059020

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #cryptoreg
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM

  12. Are you into #NLP #ML or #ASR?

    @mozilladatacollective is running a model #competition with $USD 20k in prizes 💰️ 💻️

    One of the key open problems in Automatic Speech Recognition is #CodeSwitching - where speakers use different languages or dialects in the same utterance.

    This competition focuses on code switching in three languages - North American Spanish and English, Indonesian and Javanese and Spanish and Nahuatl.

    Your challenge?

    Build ASR systems that accurately transcribe natural, code-switched speech across these three under-served language pairs, improving the SoTA for these speakers.

    competitions.mozilladatacollec

  13. О командах и организациях в организациях или снова о философии…

    Сегодня HR-службам не позавидуешь. Часто именно они оказываются в центре скандалов, обвинений и объекты «раздачи слонов». И везде есть своя правда. Компании оказались не готовы к происходящему, HR-службы заваленными резюме, а понимания какова должна быть идеальная структура компания в новых условиях (а какие они?) и как должен выглядеть идеальный сотрудник нет. Руководство компаний часто идет на ощупь, пытаясь рефлекторно отвечать на вызовы – по мере поступления проблем. А тут еще ИИ, не только в качестве проблемы ATS-фильтров, но и как новый «член команды». Не говоря уже о требовании к кандидатам слиться с ИИ-помощником в едином экстазе и порыве… В связи с чем попалась очередная любопытная статья на РБК В статье описана проблема взаимодействия людей и ИИ-агентов. В погоне за инновационностью и для того, чтобы выглядеть более прогрессивно, менеджеры компаний начинают ИИ-агентов объявлять «членами» команды, наделять ИИ-агентов реальными должностными полномочиями. В результате чего ИИ вытесняет людей из процесса принятия решения, а люди начинают сваливать на ИИ свои провалы. Мне эта ситуация показалась интересна с двух точек зрения: с точки зрения науки менеджмента и философской науки. С точки зрения науки менеджмента . Что такое «команда», откуда это взялось и почему именно эта, командная парадигма, и стала проблемой. Анализируя историю последних 30 лет, можно заметить тенденцию к переосмыслению понятия «предприятие» с организационной точки зрения. Если до 90-х годов XX века, предприятие понималась скорее как механизм, имеющий жесткие правила (впрочем, не лишенный гибкости),более-менее стройную иерархическую структуру управления и подчиненную вполне понятной цели – получения прибыли, то потом все поменялось.

    habr.com/ru/articles/1073118/

    #agi #nlp #hr #hrтехнологии #ииассистент #ииагенты #ии_и_машинное_обучение #ии_помощник

  14. О новом мире, деглобализации, иммиграции и будущем llm

    Если вся вторая половина века XX-го и начало XXI-го веков проходили под знаком глобализации, то теперь, если верить Хантингтону ( я имею ввиду его работу "Столкновение цивилизаций"), нас ждет многополярный мир, разделенный на несколько цивилизаций. Несмотря на то, что книга написана в далеком уже 1996 году, события последних лет говорят о том, что она не только не устарела, но стала еще более актуальной. Кроме того, внутри одних общностей иммиграция стала создавать значительные локальности иных по отношению к принимающей, неохотно смешиваемых, культур. Еще один фактор - это обосабливание некогда общих культур. Если основной тенденцией эпохи однополярного мира после холодной войны и нацеленности на создание единой глобальной экономики и повсеместной вестернизации, было стирание границ, то сегодня нас ждет обратный процесс. Более того, по мысли Хантингтона он не прекращался и в более или менее скрытом виде наблюдается уже с 80-90-х годов прошлого века. Если с первыми двумя факторами более-менее все понятно, по крайней мере в отношении их культурного и лингвистического анализа, то с последним не все так просто. Так, в случае "простого" смешения и/или пересечении семантических полей изначально обособленных общностей, наше понимание упрощается несколькими факторами. Во-первых, семантическое ядро изначально изолированных культур имеет четкие границы, что значительно упрощает применение, например, таких инструментов как TF-IDF и BM25. Во-вторых, эти культуры существуют достаточно давно и на протяжении истории возникло довольно большое количество исследований.

    habr.com/ru/articles/1073112/

    #ииагенты #agi #nlp #ииассистент #ии_чатбот #ии_и_машинное_обучение #ии

  15. Философия и культурология становится трендом в IT. А может такое уже было?

    Крупные компании начинают не просто привлекать, а брать в штат философов , культурологов. Цукерберг и Безос начинают ходить на благотворительные ужины и скупать произведения искусства… И видя такие новости, у меня возникает ощущение того, что история движется кругами. И если заменить слово «ИИ» на «парадигма мышления», то мы увидим множество совпадений в ретроспективе последних 3000 лет. Основной посыл можно свести к вопросам осмысленности ответов ИИ. При этом не имеет значение факт наличия или отсутствия сознания у ИИ. Пользователи хотят видеть те ответы, которые ожидают. Вне зависимости от того, сформированы они с участием человека или без. Кроме того, они хотят быть уверенными, что эти ответы остаются в пространстве культурных кодов той или иной цивилизационной парадигмы. Ответы должны быть согласованы с теми нормами, принципами и знаниями, которые составляют картину мира пользователя. Без этого на них нельзя встроить в наши, человеческие, цепочки рассуждений. Ни со смысловой, ни с этической, ни с эстетической, ни с правовой точки зрения. Это приводит к росту внутренней напряженности пользователей ввиду фонового недоверия: никогда не знаешь в какой момент ИИ-система выдаст какую-то «дичь». Отсюда следует несколько проблем: 1. Проблема common sense или проблема предела рациональности мышления Не секрет, что одними из основных претензий к ИИ сегодня это тот самый common sense, понимаемый как обобщенное и общепринятое мнение. С точки зрения LLM/ML — это усредненное значение, полученное в результате статистической обработки как можно больших массивов данных. Это не лучшее, это именно наиболее ожидаемое. И здесь нет творчества. Даже GenAI не больше, чем вероятностная машина, обеспечивающая выдачу наиболее частотного слова или даже фразы. Рисование картинок ИИ – все таже комбинаторика.

    habr.com/ru/articles/1073104/

    #nlp #agi #ииассистент #ииинжиниринг #ииагенты #иипомощники

  16. The same words can support different interpretations depending on context.

    The PUTMAN Model explores a computational approach to meaning reconstruction: how context, relationships, and prior structure influence interpretation.

    The Interpretive Debugger makes part of that process visible — showing contextual links, competing interpretations, pruning, and deviation.

    Paper:
    zenodo.org/records/18651588

    Live Demo:
    putmanmodel.github.io/putman-i

    #AI #AIAgents #NLP #CognitiveScience #OpenSource #Philosophy

  17. 🚨 New Article - The Syntax of Digital Dehumanization: Subjugated Societies as Risk Objects in AI-Governed Discourse
    Security Frames, Humanitarian Frames, and the Loss of Political Subjecthood

    This article introduces loss of political subjecthood as a formal effect of AI-mediated discourse

    🔗papers.ssrn.com/abstract=73080

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #crypto
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM

  18. 🚨 New FREE Book - Propaganda Machinery: National Socialism

    The study distinguishes party propaganda before 1933 from the state system of propaganda, censorship, and cultural coordination developed after the seizure of power.

    🔗papers.ssrn.com/sol3/papers.cf

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #cryptoreg
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM

  19. 🚨 New FREE Book - Propaganda Machinery: National Socialism

    The study distinguishes party propaganda before 1933 from the state system of propaganda, censorship, and cultural coordination developed after the seizure of power.

    🔗zenodo.org/records/21996200

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #cryptoreg
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM

  20. 476 000 новостей против нейронки: пять попыток заставить текст предсказывать цену

    Гипотеза «новости двигают рынок» — самая интуитивная в трейдинге. Настолько интуитивная, что я потратил на её проверку недели GPU-часов, полный архив финансовых телеграм-каналов с 2021 года и пять принципиально разных постановок задачи — от простых счётчиков упоминаний до NLP-разметки и пер-минутного event study. Результат: ноль из пяти . Ни одна постановка не улучшила боевую модель (с одной унизительной для NLP оговоркой — она в конце). Но интересен не сам ноль — интересно, как именно проваливалась каждая попытка . Две из пяти сначала показали «улучшение» в бэктесте, и если бы я остановился на агрегатной цифре, сейчас бы искренне рассказывал вам, что нейронка с новостями торгует лучше. Эта статья — подробный разбор всех пяти механизмов: что строил, какие признаки считал, какие цифры получил и где именно каждая версия обманывала. Это обещанное продолжение статьи про сидовый шум ±10 п.п. — протокол проверки оттуда, здесь он работает на живом сквозном примере.

    habr.com/ru/articles/1072382/

    #алготрейдинг #машинное+обучение #nlp #анализ_данных #sentiment_analysis #бэктестинг #нейронные_сети #мосбиржа

  21. 🤠 This dock is closing down.

    The Information Service Engineering / Knowledge-driven AI team has left sigmoid.social and set up a new home on KIT's own instance:

    ▸ FOLLOW US AT · @[email protected]

    Same call sign, same crew — #knowledgegraphs, #NLP, #neurosymbolicAI, #digitalhumanities and more. Your follow should travel with us automatically, but if you're reading this, re-follow at the new port to be sure. 📡

    This account is now dormant.

    SEE YOU SPACE COWBOY…

    #SemanticWeb #AI #culturalheritage

  22. 🚨 New FREE Book - Propaganda Machinery: National Socialism

    The study distinguishes party propaganda before 1933 from the state system of propaganda, censorship, and cultural coordination developed after the seizure of power.

    🔗zenodo.org/records/21996200

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #cryptoreg
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM

  23. Онлайн-магистратура НИЯУ МИФИ «Специалист по работе с данными и применению ИИ»: как успеть поступить в 2026 году

    Привет, это команда Яндекс Практикума. Приём документов на поступление в 2026 году закончится меньше, чем через неделю, но вы ещё можете успеть поступить в онлайн-магистратуру «Специалист по работе с данными и применению ИИ» НИЯУ МИФИ в партнёрстве с Практикумом. В статье мы расскажем, что входит в программу и как на неё поступить.

    habr.com/ru/companies/yandex_p

    #яндекс_практикум #мифи #магистратура #онлайнобразование #ии #ml #cv #nlp

  24. One of the hardest parts of building Edorena wasn't writing the matcher.

    It was deciding what a "match" actually means.

    Exact match?
    Related action?
    Related object?
    Concept match?
    Context match?

    We finally have a model for answering those questions.

    #AI #NLP #buildinpublic #edorena

  25. 🚨 New FREE Book - Propaganda Machinery: National Socialism

    The study distinguishes party propaganda before 1933 from the state system of propaganda, censorship, and cultural coordination developed after the seizure of power.

    🔗zenodo.org/records/21996200

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #cryptoreg
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM

  26. 🚨 New FREE Book - Christus Solus

    What happens to language when a Name cannot be replaced?
    Christus Solus is not a book about belief. It is a study of how one Name alters the grammar of every sentence that dares to contain it.

    🔗zenodo.org/records/21980284

    #LLM #MedicalNLP #LegalTech #MedTech #AIethics #AIgovernance #cryptoreg
    #healthcare #ArtificialIntelligence #NLP #aifutures #lawstodon
    #tech #agustinvstartari #linguistics #ai #LRM