home.social

#ollama — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #ollama, aggregated by home.social.

  1. Infinito.Nexus 14.0: Turn Local AI into a Secure Digital Workforce

    In Short Infinito.Nexus 14.0 enables companies to operate AI on their own infrastructure, connect it securely to existing business applications and deploy AI agents such as Hermes and OpenClaw as virtual employees. Sensitive information can be processed by local models, while optional connections to OpenAI, Anthropic and OpenRouter provide access to external frontier models when greater capabilities are needed. Companies decide which data may leave their infrastructure, which tools an agent can use and which actions remain restricted. Infinito.Nexus 14.0 brings models, enterprise applications and autonomous agents together in one controlled infrastructure. Organizations can now combine local AI for sensitive data with external frontier models and deploy agents such as Hermes and OpenClaw as isolated virtual employees. Generative AI has already changed how employees search, write, analyze and develop. But most organizations still face an uncomfortable choice: either send business data to an external AI provider or accept the operational complexity of building a local AI platform from scratch. Infinito.Nexus 14.0 introduces a third option: a hybrid AI architecture in which organizations decide where every workload runs. Sensitive prompts can be processed by local models through Ollama or LM Studio. Tasks that require the capabilities of frontier models can be routed to OpenAI, Anthropic or OpenRouter. Applications and agents use one centrally managed gateway instead of implementing separate provider integrations. The result is not merely another enterprise chatbot. Version 14.0 provides the foundation for a secure digital workforce. […]

    blog.infinito.nexus/blog/2026/

  2. Infinito.Nexus 14.0: Turn Local AI into a Secure Digital Workforce

    In Short Infinito.Nexus 14.0 enables companies to operate AI on their own infrastructure, connect it securely to existing business applications and deploy AI agents such as Hermes and OpenClaw as virtual employees. Sensitive information can be processed by local models, while optional connections to OpenAI, Anthropic and OpenRouter provide access to external frontier models when greater capabilities are needed. Companies decide which data may leave their infrastructure, which tools an agent can use and which actions remain restricted. Infinito.Nexus 14.0 brings models, enterprise applications and autonomous agents together in one controlled infrastructure. Organizations can now combine local AI for sensitive data with external frontier models and deploy agents such as Hermes and OpenClaw as isolated virtual employees. Generative AI has already changed how employees search, write, analyze and develop. But most organizations still face an uncomfortable choice: either send business data to an external AI provider or accept the operational complexity of building a local AI platform from scratch. Infinito.Nexus 14.0 introduces a third option: a hybrid AI architecture in which organizations decide where every workload runs. Sensitive prompts can be processed by local models through Ollama or LM Studio. Tasks that require the capabilities of frontier models can be routed to OpenAI, Anthropic or OpenRouter. Applications and agents use one centrally managed gateway instead of implementing separate provider integrations. The result is not merely another enterprise chatbot. Version 14.0 provides the foundation for a secure digital workforce. […]

    blog.infinito.nexus/blog/2026/

  3. Codebase Intelligence для агента: строим «dev tool будущего» и сразу тестируем на Rails монолите в 3,5M+ строк

    Сгенерированная картинка для привлечения внимания. Промпт: «Продемонстрируй, что всё новое — это хорошо забытое старое» (нет) За последний год инструментов для агентной разработки стало столько, что в них легко потеряться: одни обещают сохранять контекст между сессиями, другие — «понимать» всю кодовую базу целиком, третьи — память, планирование и автономность в одном флаконе. На GitHub каждую неделю появляются репозитории с внушительным (и не всегда честно заработанным) числом звёзд, которые обещают всё и сразу, а на поверку оказываются README-проектами; другие честно работают на демо-репозитории и падают с OOM при первой же встрече с реальным энтерпрайз-проектом — и так далее, список можно продолжать долго. Осенью прошлого года я пользовался связкой Claude + RooCode + семантический поиск на Ollama , и это был мой основной рабочий инструмент — ровно до того момента, как связка перестала работать (об этом чуть ниже). Я решил полностью пересесть на Claude Code и начал искать замену семантическому индексу, но так её и не нашёл: альтернативы для меня просто не работали — на монолите в 3,5M+ строк они либо индексировались часами, либо требовали отдать код в облако (и заплатить немалую сумму за эмбеддинги!!!), либо поддерживали Ruby, мягко говоря, номинально. В итоге я принял непростое для себя решение сделать собственный инструмент — начав с форка простого движка семантического поиска на Ollama + Qdrant — и, что характерно, сделал: полностью локальный, чтобы ни код, ни его производные (индекс, эмбеддинги, граф вызовов) никуда не уезжали. На сегодняшний день на него ушло больше полугода (и, честно признаюсь, не одна сотня чашек чая).

    habr.com/ru/articles/1084028/

    #coding_agents #MCP #семантический_поиск #RAG #Ruby_on_Rails #граф_вызовов #техдолг #Qdrant #Ollama #Codebase_Intellegence

  4. Codebase Intelligence для агента: строим «dev tool будущего» и сразу тестируем на Rails монолите в 3,5M+ строк

    Сгенерированная картинка для привлечения внимания. Промпт: «Продемонстрируй, что всё новое — это хорошо забытое старое» (нет) За последний год инструментов для агентной разработки стало столько, что в них легко потеряться: одни обещают сохранять контекст между сессиями, другие — «понимать» всю кодовую базу целиком, третьи — память, планирование и автономность в одном флаконе. На GitHub каждую неделю появляются репозитории с внушительным (и не всегда честно заработанным) числом звёзд, которые обещают всё и сразу, а на поверку оказываются README-проектами; другие честно работают на демо-репозитории и падают с OOM при первой же встрече с реальным энтерпрайз-проектом — и так далее, список можно продолжать долго. Осенью прошлого года я пользовался связкой Claude + RooCode + семантический поиск на Ollama , и это был мой основной рабочий инструмент — ровно до того момента, как связка перестала работать (об этом чуть ниже). Я решил полностью пересесть на Claude Code и начал искать замену семантическому индексу, но так её и не нашёл: альтернативы для меня просто не работали — на монолите в 3,5M+ строк они либо индексировались часами, либо требовали отдать код в облако (и заплатить немалую сумму за эмбеддинги!!!), либо поддерживали Ruby, мягко говоря, номинально. В итоге я принял непростое для себя решение сделать собственный инструмент — начав с форка простого движка семантического поиска на Ollama + Qdrant — и, что характерно, сделал: полностью локальный, чтобы ни код, ни его производные (индекс, эмбеддинги, граф вызовов) никуда не уезжали. На сегодняшний день на него ушло больше полугода (и, честно признаюсь, не одна сотня чашек чая).

    habr.com/ru/articles/1084028/

    #coding_agents #MCP #семантический_поиск #RAG #Ruby_on_Rails #граф_вызовов #техдолг #Qdrant #Ollama #Codebase_Intellegence

  5. Codebase Intelligence для агента: строим «dev tool будущего» и сразу тестируем на Rails монолите в 3,5M+ строк

    Сгенерированная картинка для привлечения внимания. Промпт: «Продемонстрируй, что всё новое — это хорошо забытое старое» (нет) За последний год инструментов для агентной разработки стало столько, что в них легко потеряться: одни обещают сохранять контекст между сессиями, другие — «понимать» всю кодовую базу целиком, третьи — память, планирование и автономность в одном флаконе. На GitHub каждую неделю появляются репозитории с внушительным (и не всегда честно заработанным) числом звёзд, которые обещают всё и сразу, а на поверку оказываются README-проектами; другие честно работают на демо-репозитории и падают с OOM при первой же встрече с реальным энтерпрайз-проектом — и так далее, список можно продолжать долго. Осенью прошлого года я пользовался связкой Claude + RooCode + семантический поиск на Ollama , и это был мой основной рабочий инструмент — ровно до того момента, как связка перестала работать (об этом чуть ниже). Я решил полностью пересесть на Claude Code и начал искать замену семантическому индексу, но так её и не нашёл: альтернативы для меня просто не работали — на монолите в 3,5M+ строк они либо индексировались часами, либо требовали отдать код в облако (и заплатить немалую сумму за эмбеддинги!!!), либо поддерживали Ruby, мягко говоря, номинально. В итоге я принял непростое для себя решение сделать собственный инструмент — начав с форка простого движка семантического поиска на Ollama + Qdrant — и, что характерно, сделал: полностью локальный, чтобы ни код, ни его производные (индекс, эмбеддинги, граф вызовов) никуда не уезжали. На сегодняшний день на него ушло больше полугода (и, честно признаюсь, не одна сотня чашек чая).

    habr.com/ru/articles/1084028/

    #coding_agents #MCP #семантический_поиск #RAG #Ruby_on_Rails #граф_вызовов #техдолг #Qdrant #Ollama #Codebase_Intellegence

  6. Come Scegliere il Miglior Mini PC per l'AI Locale nel 2026: Strix Halo vs DGX Spark vs Mac

    Un mini PC grande quanto un libro tascabile è oggi in grado di eseguire localmente un modello da 200 miliardi di parametri. Ma la scelta non dipende solo dal prezzo. La capacità della memoria determina quali modelli possono essere caricati, la larghezza di banda influisce sulla velocità di esecuzione e lo stack software — CUDA, ROCm o Metal — stabilisce se gli strumenti che utilizi funzioneranno davvero. Ecco un confronto tra le quattro principali opzioni disponibili nel 2026, con prezzi e benchmark aggiornati.

    buysellram.com/blog/how-to-cho…

    #AIlocale #LLM #MiniPC #HardwareAI #StrixHalo #DGXSpark #AppleSilicon #EdgeAI #InfrastrutturaAI #Ollama #RyzenAI #AIPC #AMD #NVIDIA #Apple

  7. Come Scegliere il Miglior Mini PC per l'AI Locale nel 2026: Strix Halo vs DGX Spark vs Mac

    Un mini PC grande quanto un libro tascabile è oggi in grado di eseguire localmente un modello da 200 miliardi di parametri. Ma la scelta non dipende solo dal prezzo. La capacità della memoria determina quali modelli possono essere caricati, la larghezza di banda influisce sulla velocità di esecuzione e lo stack software — CUDA, ROCm o Metal — stabilisce se gli strumenti che utilizi funzioneranno davvero. Ecco un confronto tra le quattro principali opzioni disponibili nel 2026, con prezzi e benchmark aggiornati.

    buysellram.com/blog/how-to-cho…

    #AIlocale #LLM #MiniPC #HardwareAI #StrixHalo #DGXSpark #AppleSilicon #EdgeAI #InfrastrutturaAI #Ollama #RyzenAI #AIPC #AMD #NVIDIA #Apple

  8. Come Scegliere il Miglior Mini PC per l'AI Locale nel 2026: Strix Halo vs DGX Spark vs Mac

    Un mini PC grande quanto un libro tascabile è oggi in grado di eseguire localmente un modello da 200 miliardi di parametri. Ma la scelta non dipende solo dal prezzo. La capacità della memoria determina quali modelli possono essere caricati, la larghezza di banda influisce sulla velocità di esecuzione e lo stack software — CUDA, ROCm o Metal — stabilisce se gli strumenti che utilizi funzioneranno davvero. Ecco un confronto tra le quattro principali opzioni disponibili nel 2026, con prezzi e benchmark aggiornati.

    buysellram.com/blog/how-to-cho…

    #AIlocale #LLM #MiniPC #HardwareAI #StrixHalo #DGXSpark #AppleSilicon #EdgeAI #InfrastrutturaAI #Ollama #RyzenAI #AIPC #AMD #NVIDIA #Apple

  9. Come Scegliere il Miglior Mini PC per l'AI Locale nel 2026: Strix Halo vs DGX Spark vs Mac

    Un mini PC grande quanto un libro tascabile è oggi in grado di eseguire localmente un modello da 200 miliardi di parametri. Ma la scelta non dipende solo dal prezzo. La capacità della memoria determina quali modelli possono essere caricati, la larghezza di banda influisce sulla velocità di esecuzione e lo stack software — CUDA, ROCm o Metal — stabilisce se gli strumenti che utilizi funzioneranno davvero. Ecco un confronto tra le quattro principali opzioni disponibili nel 2026, con prezzi e benchmark aggiornati.

    buysellram.com/blog/how-to-cho…

    #AIlocale #LLM #MiniPC #HardwareAI #StrixHalo #DGXSpark #AppleSilicon #EdgeAI #InfrastrutturaAI #Ollama #RyzenAI #AIPC #AMD #NVIDIA #Apple

  10. Come Scegliere il Miglior Mini PC per l'AI Locale nel 2026: Strix Halo vs DGX Spark vs Mac

    Un mini PC grande quanto un libro tascabile è oggi in grado di eseguire localmente un modello da 200 miliardi di parametri. Ma la scelta non dipende solo dal prezzo. La capacità della memoria determina quali modelli possono essere caricati, la larghezza di banda influisce sulla velocità di esecuzione e lo stack software — CUDA, ROCm o Metal — stabilisce se gli strumenti che utilizi funzioneranno davvero. Ecco un confronto tra le quattro principali opzioni disponibili nel 2026, con prezzi e benchmark aggiornati.

    buysellram.com/blog/how-to-cho…

    #AIlocale #LLM #MiniPC #HardwareAI #StrixHalo #DGXSpark #AppleSilicon #EdgeAI #InfrastrutturaAI #Ollama #RyzenAI #AIPC #AMD #NVIDIA #Apple

  11. Do we have any owners of one of those Ryzen AI Max+ 395 128GB UMA boxes here that operate them on the daily for at least a few months as a claude LLM coding server and are capable of giving a comparative run down on their performance vs the OG claude and its collection of formal prose generators?

    Also: Especially curious to hear any numbers that came out of a watt meter in daily consumption and base/peak numbers. Same with the used models, their size, their respective achieved tok/s and response times.

    And should you have had the opportunity of comparing this against non-UMA beefy dGPUs on the above parameters that'd also be quote interesting.

    #claude #aicoding #AIAsssisted #ollama #onprem #selfhosing #StrixPoint #ryzenaimaxplus395 #ryzenAiMax #powerconsumption #costefficiency #uma

  12. Do we have any owners of one of those Ryzen AI Max+ 395 128GB UMA boxes here that operate them on the daily for at least a few months as a claude LLM coding server and are capable of giving a comparative run down on their performance vs the OG claude and its collection of formal prose generators?

    Also: Especially curious to hear any numbers that came out of a watt meter in daily consumption and base/peak numbers. Same with the used models, their size, their respective achieved tok/s and response times.

    And should you have had the opportunity of comparing this against non-UMA beefy dGPUs on the above parameters that'd also be quote interesting.

    #claude #aicoding #AIAsssisted #ollama #onprem #selfhosing #StrixPoint #ryzenaimaxplus395 #ryzenAiMax #powerconsumption #costefficiency #uma

  13. I'll take a #StrixHalo Mini PC at $699 anytime of the day.

    From my perspective, you cannot offer something worse at $599 when the Mac Mini M4 exists, let alone $1,000 when RTX 4060 laptops exist.

    Plus, at this point NVIDIA and Apple for #AI are not negotiable. You either have it or you don't.

    #PC #PCHardware #Hardware #AMD #StrixPoint #Zen5 #RDNA4 #RDNA #Radeon #Mac #MacMini #Apple #AppleSilicon #LLM #LM #Ollama #NVIDIA #RTX #MiniPC #MacMiniM4 #Laptop #LaptopHardware #Computer #Computers

  14. I'll take a #StrixHalo Mini PC at $699 anytime of the day.

    From my perspective, you cannot offer something worse at $599 when the Mac Mini M4 exists, let alone $1,000 when RTX 4060 laptops exist.

    Plus, at this point NVIDIA and Apple for #AI are not negotiable. You either have it or you don't.

    #PC #PCHardware #Hardware #AMD #StrixPoint #Zen5 #RDNA4 #RDNA #Radeon #Mac #MacMini #Apple #AppleSilicon #LLM #LM #Ollama #NVIDIA #RTX #MiniPC #MacMiniM4 #Laptop #LaptopHardware #Computer #Computers

  15. I'll take a #StrixHalo Mini PC at $699 anytime of the day.

    From my perspective, you cannot offer something worse at $599 when the Mac Mini M4 exists, let alone $1,000 when RTX 4060 laptops exist.

    Plus, at this point NVIDIA and Apple for #AI are not negotiable. You either have it or you don't.

    #PC #PCHardware #Hardware #AMD #StrixPoint #Zen5 #RDNA4 #RDNA #Radeon #Mac #MacMini #Apple #AppleSilicon #LLM #LM #Ollama #NVIDIA #RTX #MiniPC #MacMiniM4 #Laptop #LaptopHardware #Computer #Computers

  16. I'll take a #StrixHalo Mini PC at $699 anytime of the day.

    From my perspective, you cannot offer something worse at $599 when the Mac Mini M4 exists, let alone $1,000 when RTX 4060 laptops exist.

    Plus, at this point NVIDIA and Apple for #AI are not negotiable. You either have it or you don't.

    #PC #PCHardware #Hardware #AMD #StrixPoint #Zen5 #RDNA4 #RDNA #Radeon #Mac #MacMini #Apple #AppleSilicon #LLM #LM #Ollama #NVIDIA #RTX #MiniPC #MacMiniM4 #Laptop #LaptopHardware #Computer #Computers

  17. I'll take a #StrixHalo Mini PC at $699 anytime of the day.

    From my perspective, you cannot offer something worse at $599 when the Mac Mini M4 exists, let alone $1,000 when RTX 4060 laptops exist.

    Plus, at this point NVIDIA and Apple for #AI are not negotiable. You either have it or you don't.

    #PC #PCHardware #Hardware #AMD #StrixPoint #Zen5 #RDNA4 #RDNA #Radeon #Mac #MacMini #Apple #AppleSilicon #LLM #LM #Ollama #NVIDIA #RTX #MiniPC #MacMiniM4 #Laptop #LaptopHardware #Computer #Computers