#ollama — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #ollama, aggregated by home.social.
-
Локальный ассистент для зумов, часть 2: как граф встреч становится памятью и почему ему можно верить
В первой части я собрал локального ассистента для созвонов: диаризация, стенограмма, граф знаний в Obsidian, ноль облаков. За полтора месяца ежедневной работы оказалось, что записать встречу — меньшая половина дела. Вторая часть — про то, как граф живёт неделями и почему ему можно верить: факты с датами «с» и «по», провенанс цитат из стенограммы, досье как этаж между поиском и графом, ночной прогон, песочница для облака, поиск по блокам и скрипт «забыть встречу целиком». Кода мало, устройства много. Читать дальше
https://habr.com/ru/articles/1078828/
#локальные_llm #ассистент_встреч #ollama #диаризация #граф_знаний #graphrag #obsidian #speechtotext #zoom #приватность
-
Локальный ассистент для зумов, часть 2: как граф встреч становится памятью и почему ему можно верить
В первой части я собрал локального ассистента для созвонов: диаризация, стенограмма, граф знаний в Obsidian, ноль облаков. За полтора месяца ежедневной работы оказалось, что записать встречу — меньшая половина дела. Вторая часть — про то, как граф живёт неделями и почему ему можно верить: факты с датами «с» и «по», провенанс цитат из стенограммы, досье как этаж между поиском и графом, ночной прогон, песочница для облака, поиск по блокам и скрипт «забыть встречу целиком». Кода мало, устройства много. Читать дальше
https://habr.com/ru/articles/1078828/
#локальные_llm #ассистент_встреч #ollama #диаризация #граф_знаний #graphrag #obsidian #speechtotext #zoom #приватность
-
Локальный ассистент для зумов, часть 2: как граф встреч становится памятью и почему ему можно верить
В первой части я собрал локального ассистента для созвонов: диаризация, стенограмма, граф знаний в Obsidian, ноль облаков. За полтора месяца ежедневной работы оказалось, что записать встречу — меньшая половина дела. Вторая часть — про то, как граф живёт неделями и почему ему можно верить: факты с датами «с» и «по», провенанс цитат из стенограммы, досье как этаж между поиском и графом, ночной прогон, песочница для облака, поиск по блокам и скрипт «забыть встречу целиком». Кода мало, устройства много. Читать дальше
https://habr.com/ru/articles/1078828/
#локальные_llm #ассистент_встреч #ollama #диаризация #граф_знаний #graphrag #obsidian #speechtotext #zoom #приватность
-
https://www.europesays.com/pl/668928/ NVIDIA PAIR – darmowe narzędzie rozdzielające zadania agentów AI między komputery w domowej sieci #AgenciAI #AiPc #DgxSpark #GPU #IFA2026 #LMStudio #LokalnaInferencja #Nauka #NaukaITechnika #NaukaTechnika #nvidia #ollama #PAIR #PersonalAIRouter #PL #Poland #Polish #Polska #Polski #RtxSpark #Science #ScienceAndTechnology #ScienceTechnology #SztucznaInteligencja #Technika #Technology
-
Most developers still think #Java + #AI means calling APIs from Spring Boot. The ecosystem goes deeper—from RAG frameworks to local inference with #Ollama or GPU workloads on #JVM.
@ArturSkowronski maps the #GenAI tooling iceberg for modern #Java: https://javapro.io/2026/06/03/the-gen-ai-iceberg-java-tooling-edition/ -
Most developers still think #Java + #AI means calling APIs from Spring Boot. The ecosystem goes deeper—from RAG frameworks to local inference with #Ollama or GPU workloads on #JVM.
@ArturSkowronski maps the #GenAI tooling iceberg for modern #Java: https://javapro.io/2026/06/03/the-gen-ai-iceberg-java-tooling-edition/ -
Most developers still think #Java + #AI means calling APIs from Spring Boot. The ecosystem goes deeper—from RAG frameworks to local inference with #Ollama or GPU workloads on #JVM.
@ArturSkowronski maps the #GenAI tooling iceberg for modern #Java: https://javapro.io/2026/06/03/the-gen-ai-iceberg-java-tooling-edition/ -
Most developers still think #Java + #AI means calling APIs from Spring Boot. The ecosystem goes deeper—from RAG frameworks to local inference with #Ollama or GPU workloads on #JVM.
@ArturSkowronski maps the #GenAI tooling iceberg for modern #Java: https://javapro.io/2026/06/03/the-gen-ai-iceberg-java-tooling-edition/ -
Most developers still think #Java + #AI means calling APIs from Spring Boot. The ecosystem goes deeper—from RAG frameworks to local inference with #Ollama or GPU workloads on #JVM.
@ArturSkowronski maps the #GenAI tooling iceberg for modern #Java: https://javapro.io/2026/06/03/the-gen-ai-iceberg-java-tooling-edition/ -
https://www.europesays.com/ie/672544/ Nvidia & Microsoft push local AI agents on Windows #acer #AIAgents(AgenticAI) #AIPC #ContentCreation #Creators #CyberLink #DataPrivacy #DeveloperTools #EdgeAI #EdgeComputing #Éire #ElectronicArts(EA) #GenerativeAI(GenAI) #HybridCloud #IE #Ireland #Lenovo #Linux #MacOS #Microsoft #MicrosoftWindows #Nvidia #Ollama #OpenSource #Optimisation #optimization #PCHardware #PCMarket #PortableComputer #RayTracing(RTX) #SmallOffice #Technology #Ubisoft
-
أطلق Raycast تحديثه v2، الذي يعيد دعم "Bring Your Own Model" (BYOM) لربط مزودين متوافقين مع OpenAI، أو تشغيل نماذج محلية عبر Ollama، أو استخدام OpenRouter API ضمن Raycast AI. هذه الميزات تتطلب الآن اشتراك Raycast Pro. كما يوسع التحديث إدارة النوافذ بأوامر دقيقة لتغيير الحجم والتحريك، وإمكانية إنشاء تخطيطات مخصصة من النوافذ الحالية. ويشمل التحسينات دعم النص من اليمين إلى اليسار في Raycast AI، وتحسينات في Quick AI، وتعديلات على ترتيب البحث عن الملفات.
-
أطلق Raycast تحديثه v2، الذي يعيد دعم "Bring Your Own Model" (BYOM) لربط مزودين متوافقين مع OpenAI، أو تشغيل نماذج محلية عبر Ollama، أو استخدام OpenRouter API ضمن Raycast AI. هذه الميزات تتطلب الآن اشتراك Raycast Pro. كما يوسع التحديث إدارة النوافذ بأوامر دقيقة لتغيير الحجم والتحريك، وإمكانية إنشاء تخطيطات مخصصة من النوافذ الحالية. ويشمل التحسينات دعم النص من اليمين إلى اليسار في Raycast AI، وتحسينات في Quick AI، وتعديلات على ترتيب البحث عن الملفات.
-
A short recap of my recent experiments of running an LLM.
Would be great to hear suggestions from others.
- Where else can we get decent hardware?
- What models do you run for your teams?
- How to reduce complexity of the setup?https://www.linkedin.com/pulse/recap-my-journey-self-host-llm-artur-neumann-6ddfe/
-
A short recap of my recent experiments of running an LLM.
Would be great to hear suggestions from others.
- Where else can we get decent hardware?
- What models do you run for your teams?
- How to reduce complexity of the setup?https://www.linkedin.com/pulse/recap-my-journey-self-host-llm-artur-neumann-6ddfe/
-
A short recap of my recent experiments of running an LLM.
Would be great to hear suggestions from others.
- Where else can we get decent hardware?
- What models do you run for your teams?
- How to reduce complexity of the setup?https://www.linkedin.com/pulse/recap-my-journey-self-host-llm-artur-neumann-6ddfe/
-
A short recap of my recent experiments of running an LLM.
Would be great to hear suggestions from others.
- Where else can we get decent hardware?
- What models do you run for your teams?
- How to reduce complexity of the setup?https://www.linkedin.com/pulse/recap-my-journey-self-host-llm-artur-neumann-6ddfe/
-
A short recap of my recent experiments of running an LLM.
Would be great to hear suggestions from others.
- Where else can we get decent hardware?
- What models do you run for your teams?
- How to reduce complexity of the setup?https://www.linkedin.com/pulse/recap-my-journey-self-host-llm-artur-neumann-6ddfe/
-
Я хотел просто навести порядок в Obsidian. В итоге написал два индекса, semantic search и RAG
Я начинал с простого AI-аудита заметок, а в итоге Vault Audit AI вырос в систему с двумя индексами, поиском по смыслу, Similar Notes, semantic duplicates и RAG по собственному хранилищу. В статье разбираю, как всё это устроено, что ломалось по дороге и почему почти 700 тестов всё равно не спасли от сюрпризов в реальном Obsidian.
https://habr.com/ru/articles/1078328/
#Obsidian #Vault_Audit_AI #RAG #semantic_search #embeddings #LLM #TypeScript #vector_search #knowledge_management #Ollama
-
Я хотел просто навести порядок в Obsidian. В итоге написал два индекса, semantic search и RAG
Я начинал с простого AI-аудита заметок, а в итоге Vault Audit AI вырос в систему с двумя индексами, поиском по смыслу, Similar Notes, semantic duplicates и RAG по собственному хранилищу. В статье разбираю, как всё это устроено, что ломалось по дороге и почему почти 700 тестов всё равно не спасли от сюрпризов в реальном Obsidian.
https://habr.com/ru/articles/1078328/
#Obsidian #Vault_Audit_AI #RAG #semantic_search #embeddings #LLM #TypeScript #vector_search #knowledge_management #Ollama
-
Я хотел просто навести порядок в Obsidian. В итоге написал два индекса, semantic search и RAG
Я начинал с простого AI-аудита заметок, а в итоге Vault Audit AI вырос в систему с двумя индексами, поиском по смыслу, Similar Notes, semantic duplicates и RAG по собственному хранилищу. В статье разбираю, как всё это устроено, что ломалось по дороге и почему почти 700 тестов всё равно не спасли от сюрпризов в реальном Obsidian.
https://habr.com/ru/articles/1078328/
#Obsidian #Vault_Audit_AI #RAG #semantic_search #embeddings #LLM #TypeScript #vector_search #knowledge_management #Ollama
-
CVE Alert: CVE-2026-85180 - ollama - ollama - https://www.redpacketsecurity.com/cve-alert-cve-2026-85180-ollama-ollama/
#OSINT #ThreatIntel #CyberSecurity #cve-2026-85180 #ollama #
-
CVE Alert: CVE-2026-85180 - ollama - ollama - https://www.redpacketsecurity.com/cve-alert-cve-2026-85180-ollama-ollama/
#OSINT #ThreatIntel #CyberSecurity #cve-2026-85180 #ollama #
-
CVE Alert: CVE-2026-85180 - ollama - ollama - https://www.redpacketsecurity.com/cve-alert-cve-2026-85180-ollama-ollama/
#OSINT #ThreatIntel #CyberSecurity #cve-2026-85180 #ollama #
-
CVE Alert: CVE-2026-85180 - ollama - ollama - https://www.redpacketsecurity.com/cve-alert-cve-2026-85180-ollama-ollama/
#OSINT #ThreatIntel #CyberSecurity #cve-2026-85180 #ollama #
-
CVE Alert: CVE-2026-85180 - ollama - ollama - https://www.redpacketsecurity.com/cve-alert-cve-2026-85180-ollama-ollama/
#OSINT #ThreatIntel #CyberSecurity #cve-2026-85180 #ollama #
-
🧪 LLM Benchmark Showdown: 5 lokale Ollama-Modelle im Vergleich
Getestet auf derselben Hardware (#gmktecevo2 #AMDRyzenAIMaxPlus395 #strixhalo):
• #GSM8K (100 Samples) — Math
• #BFCL (100/Kategorie) — Function Calling
• #MBPP+ (50) — Python Coding
• #HumanEval+ (20) — Python Coding📊 Ergebnisse (Accuracy / Output TK/s / VRAM):
**qwen3.8:27b**
GSM8K 82% | BFCL 91.5% | MBPP+ 100% | HE+ 100%
⚡ 25.5 TK/s | 💾 18 GB VRAM**qwen3.6:27b**
GSM8K 83% | BFCL 93% | MBPP+ 98% | HE+ 75%
⚡ 12.7 TK/s | 💾 33 GB VRAM**qwen3.6:35b**
GSM8K 84% | BFCL 90% | MBPP+ 98% | HE+ 55%
⚡ 61.8 TK/s | 💾 27 GB VRAM**ornith-1.5:35b**
GSM8K 75% | BFCL 92.5% | MBPP+ 78% | HE+ 0%
⚡ 63.6 TK/s | 💾 26 GB VRAM**nemotron-3.5-lightning:30b**
GSM8K 59% | BFCL 74% | MBPP+ 94% | HE+ 0%
⚡ 91.9 TK/s | 💾 26 GB VRAM🏆 Fazit:
qwen3.8:27b ist der klare Sieger — als einziges Modell 100% bei beiden Coding-Benchmarks, bei GSM8K/BFCL gleichauf mit den anderen Qwen-Modellen. Bei 25.5 TK/s und nur 18 GB VRAM das beste Qualität/Speed/Effizienz-Verhältnis.
qwen3.6:27b ist qualitativ nah dran (BFCL sogar 93%), aber mit 12.7 TK/s unerträglich langsam und frisst 33 GB VRAM — fast 2× so viel wie qwen3.8 bei halber Speed.
qwen3.6:35b ist mit 61.8 TK/s 2.4× schneller als qwen3.8, aber HE+ nur 55% (vs 100%). Trading Code-Qualität für Speed.
ornith-1.5:35b und nemotron-3.5-lightning:30b fallen bei Coding komplett durch (HE+ 0%), sind aber die schnellsten Modelle im Feld (64 / 92 TK/s).
💡 TK/s = generierte Tokens/Sekunde (Warm-Run, ollama --verbose).
💾 VRAM = GPU-Speicher bei max context (262K bzw. 1M bei nemotron). -
Hab mir im Februar ein #MacStudio mit #M4max und 128GB RAM gekauft... Für verrückte fast 4100€... Und ich dachte mir das ist der größte finanzielle Fehler ever
Hab damit dann viel #ollama #lmstudio #omlx gehostet - #LLM Experimentarium
Habs sogar ein paar Monaten nur mit den eigenen LLMs gecodet, aber Qualität naja...
Da sich die letzten Monate das #openWeights Business geändert hat und keine 120b Modelle veröffentlicht werden, die der perfekte fit dafür wären, nutze ich die 30b Modelle...
Leider mit zunehmendem Frust... #Gemma und #Qwen sind dafür einfach zu klein...
Dann bringt qwen auch nach 3.6 keine kleinen Modelle mehr raus - es gab kein 3.7 und kein 3.8 - letztes haben sie wieder man angekündigt
Bedeutet der Mac Studio war eigentlich nur als Desktop PC im Einsatz - eher #gaming und #Roblox programmierworkstation
Dann hab ich mich mal schlau gemacht - #apple hat meine 128gb Version zum frontier Modell gemacht - und die Modelle sind nirgendwo zu bekommen... Ganz merkwürdig Markt leer gesaugt
Vllt bringt Apple bald neue Mac Studio Modell raus???Okay - eBay preise abgecheckt - da gehen Modell für über 5k€ über den Tisch, aber sehr selten die 128gb Variante
eBay inseriert - 6999,99€ sofort kauf oder Preisvorschlag ab 6000€
Hab das Ding jetzt für 6200€ weiter verkauft
Leider über eBay bezahlt, deshalb wird mein Gewinn versteuert, aber ich gönne
Ist das nicht krass? Was da abgeht, das ist so verrückt auf dem Gebrauch Mac Markt!
-
My kid has released another tool that he's written for himself:
Ovi is a lightweight local model server that delivers an ollama‑style developer experience, built natively on Intel’s OpenVINO runtime for efficient CPU and GPU inference:
https://github.com/nathanael-thms/ovi.
Check out the docs at https://ovi.nattho.com
-
Ab dem 2. August gilt die KI-Kennzeichnungspflicht: was dein Verein, dein Betrieb und du privat jetzt wirklich schulden
Die 35 Millionen Euro Bußgeld, mit denen dir gerade Beratung verkauft wird, stehen in einem ganz anderen Teil der KI-Verordnung. Ab dem 2. August 2026 musst du KI-Inhalte kennzeichnen, aber nur in zwei Fällen. Welche das sind und warum dein Verein sich nie auf die Privatausnahme berufen kann. Reden wir drüber!
#chrislo #DigitaleUnabhängigkeit #LokaleKI #KIVerordnung #AIAct #Kennzeichnungspflicht #Vereine #EURegulierung #Bundesnetzagentur #Deepfakes #Ollama #DigitalOmnibus
-
https://www.tkhunt.com/2360509/ 【GitHub 8000スター】Hermes Desktop 完全解説|Nous Research製AIエージェントをGUIで操作・14ツール×16連携×マルチAIの衝撃【MITオープンソース】 #AgenticAi #AI #AIエージェント #AI活用伝道師 #ArtificialIntelligence #Discord連携 #electron #HermesAgent #HermesDesktop #LMStudio #MessagingGateway #mit #NousResearch #Ollama #Slack連携 #SoulMD #エージェント型AI #オープンソース #マルチAIプロバイダー #人工知能
-
📬 Karakeep: Bookmark-Archiv mit lokaler KI und Open WebUI
#Internet #Softwareentwicklung #Archiv #Bookmark #Hoarder #Karakeep #Linkwarden #Ollama #Selfhosting https://sc.tarnkappe.info/8c8971 -
https://www.tkhunt.com/2298182/ AIワークフローを視覚的に構築できる”n8n” #AgenticAi #AI #AIエージェント #AIワークフロー #ai開発 #API連携 #ArtificialIntelligence #ChatGPT #Claude #Docker #DX #GitHub連携 #Integromat #IT #llm #make #MCP #ModelContextProtocol #n8n #Notion連携 #Ollama #OSS #RPA #SaaS #Slack連携 #Webhook #Zapier #エージェント型AI #エンジニア #オートメーション #オープンソース #コーティング #セルフホスト #デジタルトランスフォーメーション #テック #ノーコード #ノート #フロー #プログラミング #マルチエージェント #ローカルLLM #ローコード #ワークフロー自動化 #人工知能 #初心者 #効率化ツール #学習 #技術 #業務効率化 #生産性向上 #自動化 #解説 #開発
-
(more Linux and FOSS news in previous posts of thread)
Introducing Proton Workspace: An encrypted suite for team collaboration:
https://proton.me/business/blog/proton-workspace
(Now my university will have a hard time finding an excuse to use Office 365 lol)ONLYOFFICE ends its partnership with Nextcloud over new unauthorized "Euro-Office" fork:
https://alternativeto.net/news/2026/4/onlyoffice-ends-its-partnership-with-nextcloud-over-new-unauthorized-euro-office-fork/The Document Foundation kicks out Collabora Office devs from LibreOffice project:
https://www.collaboraonline.com/blog/tdf-ejects-its-core-developers/
(April's Fools joke, I think? Or is it real? 🤔)Arti 2.2 enables HTTP CONNECT by default, enhances RPC features, and fixes security issues:
https://alternativeto.net/news/2026/4/arti-2-2-enables-http-connect-by-default-enhances-rpc-features-and-fixes-security-issues/Servo 0.0.6 Released With Many Great Improvements:
https://www.phoronix.com/news/Servo-0.0.6-ReleasedPi-hole releases FTL v6.6, Web v6.5, and Core v6.4.1 with security fixes, adds MAC control:
https://alternativeto.net/news/2026/4/pi-hole-releases-ftl-v6-6-web-v6-5-and-core-v6-4-1-with-security-fixes-adds-mac-control/OpenVPN 2.7.1 Released with New Features, Improvements, and Bug Fixes:
https://9to5linux.com/openvpn-2-7-1-released-with-new-features-improvements-and-bug-fixesKodi 22 'Piers' Alpha 3 is out -- download it now!:
https://betanews.com/article/kodi-22-piers-alpha-3-is-out-download-it-now/Ollama gains major performance boosts on Apple Silicon thanks to Apple's MLX framework:
https://alternativeto.net/news/2026/3/ollama-gains-major-performance-boosts-on-apple-silicon-thanks-to-apple-s-mlx-framework/Cloudflare Announces EmDash As Open-Source "Spiritual Successor" To WordPress:
https://www.phoronix.com/news/Cloudflare-EmDashVulkan 1.4.348 Ships Four New Extensions - Including One To Help OpenGL Emulation:
https://www.phoronix.com/news/Vulkan-1.4.348-ReleasedNginx 1.29.7 Delivers Multipath TCP Support:
https://www.phoronix.com/news/Nginx-1.29.7-Multipath-TCPGentoo Releases Experimental Images Using GNU/Hurd:
https://www.phoronix.com/news/Gentoo-GNU-Hurd-ExperimentalRedox OS Introducing New CPU Scheduler For ~1.5x Performance In Heavy Tasks:
https://www.phoronix.com/news/Redox-OS-New-CPU-SchedCoreboot 26.03 Open-Source Firmware Adds Full Support for Intel PantherLake SoCs:
https://9to5linux.com/coreboot-26-03-open-source-firmware-adds-full-support-for-intel-pantherlake-socs#WeeklyNews #OpenSource #FOSSNews #OpenSourceNews #FOSS #News #ProtonWorkspace #ONLYOFFICE #LibreOffice #Arti #Servo #PiHole #OpenVPN #Kodi #Ollama #EmDash #Cloudflare #Vulkan #Nginx #Gentoo #GNUHurd #RedoxOS #Coreboot #OfficeSuite #OS #OperatingSystem #AI #ArtificialIntelligence #Tor #VPN #MediaServer #AdBlocker #SelfHosting #AdBlocking #WebServer #FosseryTech
-
Как я добавил систему рекомендаций контента в легаси-проект на PHP 7.2
Привет, хабр! Хочу поделиться историей о том, как столкнулся с проблемой, возможно знакомой многим разработчикам: необходимость внедрить систему рекомендаций в проект, который все еще работает на старой версии php. Обновление версии php в legacy-проекте — это часто настоящий квест. То времени нет, то бизнес-фичи надо пилить, то еще какие-то причины. И часто бывает, что обновление версии php в командах откладывается на потом.
https://habr.com/ru/articles/957224/
#qdrant #ollama #php #векторный_поиск #рекомендательная_система #рекомендательные_системы #библиотека
-
Как я добавил систему рекомендаций контента в легаси-проект на PHP 7.2
Привет, хабр! Хочу поделиться историей о том, как столкнулся с проблемой, возможно знакомой многим разработчикам: необходимость внедрить систему рекомендаций в проект, который все еще работает на старой версии php. Обновление версии php в legacy-проекте — это часто настоящий квест. То времени нет, то бизнес-фичи надо пилить, то еще какие-то причины. И часто бывает, что обновление версии php в командах откладывается на потом.
https://habr.com/ru/articles/957224/
#qdrant #ollama #php #векторный_поиск #рекомендательная_система #рекомендательные_системы #библиотека
-
Как я добавил систему рекомендаций контента в легаси-проект на PHP 7.2
Привет, хабр! Хочу поделиться историей о том, как столкнулся с проблемой, возможно знакомой многим разработчикам: необходимость внедрить систему рекомендаций в проект, который все еще работает на старой версии php. Обновление версии php в legacy-проекте — это часто настоящий квест. То времени нет, то бизнес-фичи надо пилить, то еще какие-то причины. И часто бывает, что обновление версии php в командах откладывается на потом.
https://habr.com/ru/articles/957224/
#qdrant #ollama #php #векторный_поиск #рекомендательная_система #рекомендательные_системы #библиотека
-
Менеджер закладок на своём сервере
Хранить тысячи закладок в браузере — совершенно неблагодарная задача. Там отсутствуют даже офлайн-предпросмотр и автоматические теги, не говоря о полнотекстовом поиске и автоматическом скачивании/архивировании по RSS. Для нормального управления закладками нужно специализированное решение. Тут много вариантов, а одно из лучших — это опенсорсное приложение Hoarder («Копилка информации»). Оно устанавливается на сервер и выступает единой БД для доступа из любых клиентов: Android, iOS, Chrome, Firefox и т. д. Рассмотрим базовые функции этого приложения и как установить его на машине, где хранится личный информационный архив. Это может быть или домашний сервер, или VPS.
https://habr.com/ru/companies/ruvds/articles/896082/
#ruvds_статьи #Hoarder #хранилище_закладок #информационный_архив #персональное_хранилище #NextJS #Drizzle #NextAuth #tRPC #Puppeteer #OpenAI #Meilisearch #youtubedl #Ollama #Monolith #Shaarli #LinkAce #Linkding