#gemma — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #gemma, aggregated by home.social.
-
Как запустить Gemma на сервере: сравниваем Ollama и llama.cpp
Откройте любую статью-инструкцию по установке LLM, в которой фигурирует Ollama. Уверен, в комментариях к ней автору уже объяснили, насколько он неправ и что единственное верное решение — использовать llama.cpp. В этой статье запустим Gemma 4 и через Ollama, и напрямую через llama.cpp — и посмотрим, во сколько обходится удобство.
https://habr.com/ru/companies/selectel/articles/1088372/
#selectel #ai #ml #aiагенты #gemma #Ollama #llamacpp #LLM #llmмодели #Gemma_4
-
Как запустить Gemma на сервере: сравниваем Ollama и llama.cpp
Откройте любую статью-инструкцию по установке LLM, в которой фигурирует Ollama. Уверен, в комментариях к ней автору уже объяснили, насколько он неправ и что единственное верное решение — использовать llama.cpp. В этой статье запустим Gemma 4 и через Ollama, и напрямую через llama.cpp — и посмотрим, во сколько обходится удобство.
https://habr.com/ru/companies/selectel/articles/1088372/
#selectel #ai #ml #aiагенты #gemma #Ollama #llamacpp #LLM #llmмодели #Gemma_4
-
https://www.europesays.com/it/706583/ Gemma: Fabio, devo capire cosa provo! – Uomini e donne Clip | Witty TV – wittytv.it #29Settembre #avvicinamenti #baci #Canale5 #conoscenza #Entertainment #fabio #gemma #Intrattenimento #IT #Italia #Italy #MariaDeFilippi #TronoClassico #TronoOver #UominiEDonne #UominiEDonne2026/2027
-
🧠 #Google ha annunciato che l'#Antigravity SDK ora supporta i workflow locali: le stesse capacità agentiche che alimentano Antigravity, ma eseguite interamente sulla propria macchina, con supporto iniziale per #Gemma 4 26B A4B tramite LiteRT di Google AI Edge.
👉 I dettagli: https://lnkd.in/p/ehAySBUW
___
✉️ 𝗦𝗲 𝘃𝘂𝗼𝗶 𝗿𝗶𝗺𝗮𝗻𝗲𝗿𝗲 𝗮𝗴𝗴𝗶𝗼𝗿𝗻𝗮𝘁𝗼/𝗮 𝘀𝘂 𝗾𝘂𝗲𝘀𝘁𝗲 𝘁𝗲𝗺𝗮𝘁𝗶𝗰𝗵𝗲, 𝗶𝘀𝗰𝗿𝗶𝘃𝗶𝘁𝗶 𝗮𝗹𝗹𝗮 𝗺𝗶𝗮 𝗻𝗲𝘄𝘀𝗹𝗲𝘁𝘁𝗲𝗿:
https://bit.ly/newsletter-alessiopomaro -
🧠 #Google ha annunciato che l'#Antigravity SDK ora supporta i workflow locali: le stesse capacità agentiche che alimentano Antigravity, ma eseguite interamente sulla propria macchina, con supporto iniziale per #Gemma 4 26B A4B tramite LiteRT di Google AI Edge.
👉 I dettagli: https://lnkd.in/p/ehAySBUW
___
✉️ 𝗦𝗲 𝘃𝘂𝗼𝗶 𝗿𝗶𝗺𝗮𝗻𝗲𝗿𝗲 𝗮𝗴𝗴𝗶𝗼𝗿𝗻𝗮𝘁𝗼/𝗮 𝘀𝘂 𝗾𝘂𝗲𝘀𝘁𝗲 𝘁𝗲𝗺𝗮𝘁𝗶𝗰𝗵𝗲, 𝗶𝘀𝗰𝗿𝗶𝘃𝗶𝘁𝗶 𝗮𝗹𝗹𝗮 𝗺𝗶𝗮 𝗻𝗲𝘄𝘀𝗹𝗲𝘁𝘁𝗲𝗿:
https://bit.ly/newsletter-alessiopomaro -
🧠 #Google ha annunciato che l'#Antigravity SDK ora supporta i workflow locali: le stesse capacità agentiche che alimentano Antigravity, ma eseguite interamente sulla propria macchina, con supporto iniziale per #Gemma 4 26B A4B tramite LiteRT di Google AI Edge.
👉 I dettagli: https://lnkd.in/p/ehAySBUW
___
✉️ 𝗦𝗲 𝘃𝘂𝗼𝗶 𝗿𝗶𝗺𝗮𝗻𝗲𝗿𝗲 𝗮𝗴𝗴𝗶𝗼𝗿𝗻𝗮𝘁𝗼/𝗮 𝘀𝘂 𝗾𝘂𝗲𝘀𝘁𝗲 𝘁𝗲𝗺𝗮𝘁𝗶𝗰𝗵𝗲, 𝗶𝘀𝗰𝗿𝗶𝘃𝗶𝘁𝗶 𝗮𝗹𝗹𝗮 𝗺𝗶𝗮 𝗻𝗲𝘄𝘀𝗹𝗲𝘁𝘁𝗲𝗿:
https://bit.ly/newsletter-alessiopomaro -
🧠 #Google ha annunciato che l'#Antigravity SDK ora supporta i workflow locali: le stesse capacità agentiche che alimentano Antigravity, ma eseguite interamente sulla propria macchina, con supporto iniziale per #Gemma 4 26B A4B tramite LiteRT di Google AI Edge.
👉 I dettagli: https://lnkd.in/p/ehAySBUW
___
✉️ 𝗦𝗲 𝘃𝘂𝗼𝗶 𝗿𝗶𝗺𝗮𝗻𝗲𝗿𝗲 𝗮𝗴𝗴𝗶𝗼𝗿𝗻𝗮𝘁𝗼/𝗮 𝘀𝘂 𝗾𝘂𝗲𝘀𝘁𝗲 𝘁𝗲𝗺𝗮𝘁𝗶𝗰𝗵𝗲, 𝗶𝘀𝗰𝗿𝗶𝘃𝗶𝘁𝗶 𝗮𝗹𝗹𝗮 𝗺𝗶𝗮 𝗻𝗲𝘄𝘀𝗹𝗲𝘁𝘁𝗲𝗿:
https://bit.ly/newsletter-alessiopomaro -
🧠 Chcete offline AI modely? Lokálně je lze provozovat i na mobilu
https://infoek.cz/chcete-offline-ai-modely-lokalne-je-lze-provozovat-i-na-mobilu-2026/
🧠 Do you want offline AI models? They can be run locally on mobile
-
🧠 Chcete offline AI modely? Lokálně je lze provozovat i na mobilu
https://infoek.cz/chcete-offline-ai-modely-lokalne-je-lze-provozovat-i-na-mobilu-2026/
🧠 Do you want offline AI models? They can be run locally on mobile
-
「Android Studio Quail 4」が安定版に ~「Gemma 4」ローカル実行、23種の開発“スキル”/ソースコードを外に出さない“オフラインAIコーディング”が可能に
https://forest.watch.impress.co.jp/docs/news/2138937.html#forest_watch_impress #Android_Studio #Google #Android #Gemini #Gemma #genai #AIコーディング #AIエージェント #プログラミング #Windows #Mac #Linux
-
「Android Studio Quail 4」が安定版に ~「Gemma 4」ローカル実行、23種の開発“スキル”/ソースコードを外に出さない“オフラインAIコーディング”が可能に
https://forest.watch.impress.co.jp/docs/news/2138937.html#forest_watch_impress #Android_Studio #Google #Android #Gemini #Gemma #genai #AIコーディング #AIエージェント #プログラミング #Windows #Mac #Linux
-
「Android Studio Quail 4」が安定版に ~「Gemma 4」ローカル実行、23種の開発“スキル”/ソースコードを外に出さない“オフラインAIコーディング”が可能に
https://forest.watch.impress.co.jp/docs/news/2138937.html#forest_watch_impress #Android_Studio #Google #Android #Gemini #Gemma #genai #AIコーディング #AIエージェント #プログラミング #Windows #Mac #Linux
-
Переводим книги нейронками для себя: год спустя. Словари, скорости и почему переводчики всё ещё нужны
Год назад я написал статью « Переводим fb2 книжки, с нейронками, для себя » — про то, как собрал на паре Tesla P40 в гараже программу Sunny Narrator («Солнечный сказочник»), которая переводит художественные книги через локальные и облачные LLM. Тогда это был скорее прототип «доказать себе, что так можно»: черновики читались с головной болью, книга в тысячу страниц переводилась два дня, а электричество, отключённое посреди процесса, стоило ещё двух. За год программа доехала до версии 2.1, я перевёл достаточно книг, чтобы набить руку, и понял главное: это уже инструмент не только для меня, но и для переводчиков — и для всех любопытных . Рассказываю, что изменилось, сколько это стоит в токенах и почему без человека ничего не работает.
https://habr.com/ru/articles/1077366/
#перевод #переводы #fb2 #epub #llm #llmприложения #словари #tesla_p40 #qwen #gemma
-
I posted about building a D&D virtual “DM’s Assistant” using Gemini Nano on-device models on Android. A fun app to build that has been actually helping me in my home games. #androiddev #gemini #gemma
https://ajkueterman.com/posts/on-device-ai-with-gemini-nano/
-
I posted about building a D&D virtual “DM’s Assistant” using Gemini Nano on-device models on Android. A fun app to build that has been actually helping me in my home games. #androiddev #gemini #gemma
https://ajkueterman.com/posts/on-device-ai-with-gemini-nano/
-
El lado del mal - El AIBot de la Universidad que ayuda no sólo a los estudiantes https://www.elladodelmal.com/2026/08/el-aibot-de-la-universidad-que-ayuda-no.html #IA #AI #ChatBot #LLM #Misalignment #LLM #Jailbreak #Hacking #Gemma
-
El lado del mal - El AIBot de la Universidad que ayuda no sólo a los estudiantes https://www.elladodelmal.com/2026/08/el-aibot-de-la-universidad-que-ayuda-no.html #IA #AI #ChatBot #LLM #Misalignment #LLM #Jailbreak #Hacking #Gemma
-
El lado del mal - El AIBot de la Universidad que ayuda no sólo a los estudiantes https://www.elladodelmal.com/2026/08/el-aibot-de-la-universidad-que-ayuda-no.html #IA #AI #ChatBot #LLM #Misalignment #LLM #Jailbreak #Hacking #Gemma
-
RT @googlegemma: 3.431 Token/s auf Gemma 4 31B!
mehr auf Arint.info
-
RT @googlegemma: 3.431 Token/s auf Gemma 4 31B!
mehr auf Arint.info
-
RT @googlegemma: 3.431 Token/s auf Gemma 4 31B!
mehr auf Arint.info
-
Building a local AI storyteller - Part II - When the model is not enough
A blog by JustusIn the first part of this series, I described the most important lesson I learned while building a local AI storyteller: A good LLM application is not a clever prompt. It is software architecture around a probabilistic component. That sounds reassuringly architectural. It also leaves one...
#dev #softwaredevelopment #java #ai #llm #localmodels #gemma #qwen #softwarearchitecture
-
The M1 Pro MacBook Pro can run Gemma 4 26B-A4B offline!
https://stairjoke.ninja/notes/the-m1-pro-macbook-pro-can-run-gemma-4-26b-a4b-offline
-
So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.
Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.
Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark
-
So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.
Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.
Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark
-
So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.
Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.
Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark
-
iOS「Google AI Edge Eloquent」v1.4.1配信
https://web.brid.gy/r/https://jetstream.blog/2026/08/22/ios-google-ai-edge-eloquent-v1-4-1-release/
-
iOS「Google AI Edge Eloquent」v1.4.1配信
https://web.brid.gy/r/https://jetstream.blog/2026/08/22/ios-google-ai-edge-eloquent-v1-4-1-release/
-
‘Insidious: Out of the Further’ review: Time to give Lin Shaye a break
In the spring of 2011, a low-budget horror film stuck around for a while. Sandwiched between the launches…
#NewsBeep #News #Movies #chase #cultmeeting #cyrus #Entertainment #further #Gemma #horrorfranchise #Insanity #low-budgethorrorfilm #movie #newcharacter #originalcast #ownmother #psychicelise #sinisterrealm #UK #UnitedKingdom #World
https://www.newsbeep.com/uk/745083/ -
日本語対応!iOS「Google AI Edge Eloquent」【v1.4.0】
https://web.brid.gy/r/https://jetstream.blog/2026/08/14/ios-google-ai-edge-eloquent-v1-4-0-release/
-
日本語対応!iOS「Google AI Edge Eloquent」【v1.4.0】
https://web.brid.gy/r/https://jetstream.blog/2026/08/14/ios-google-ai-edge-eloquent-v1-4-0-release/
-
Qwen3.5/3.6 на 16Гб VRAM: кванты, fine-tune, сравнение и немного про Gemma-4
Всем привет. В свободное время и под настроение я ваяю маленькие, незамысловатые игры на основе d10-кубов механик, похожие на PvP или PvE настолки, которые нередко проходят в автоматическом режиме (ИИ vs ИИ), а иногда получается что-то чуть серьезнее: вроде игры "Жизнь", но на стероидах с экономикой, сражениями и в масштабах солнечной системы. Не являясь настоящим программистом и написав за всю жизнь, наверное, самое большее - ну, возможно, не более тысячи строк кода - мне для воплощения своих причудливых идей, естественно, потребовалась помощь психиатров нейросетей, которые, как тогда говорили - уже научились писать вполне рабочий, годный код. Конкретна эта история начиналась банально, а может даже и несколько варварски: с web-чата с одной китайской нейросетью со значком в виде кита в формате ctrl+c > ctrl+v в файлики игры, но вскоре проекты разрослись, структура стала сложной и потребовалось что-то вроде OpenCode или LM Studio Bionic (вышел совсем недавно, но мне понравился), а затем встал и выбор локальной модели, которая всегда будет бесплатной, под рукой и без ограничений типа " server is busy... try later ". Зоопарк моделей разросся довольно быстро и хотя базовых моделей не так много, но это количество предстояло умножить на разные варианты квантования и присыпать сверху горкой т.н. fine-tune моделей, которые, буквально, сотнями, если не тысячами - рассыпаны по HuggingFace, а их авторы обещают космическую скорость инференса, интеллект передовых моделей и "думалку" (режим thinking) от какого-нибудь Deep Seep, Claude или Fable.
-
Humbled that our number of Chrome-only active users surpassed 1,000 for the first time.
https://github.com/webbrain-one/webbrain
#Chrome #ChromeExtension #WebExtension #Milestone #OpenSource #GitHub #WebBrain #offlinellm #qwen #gemma #ollama #llamacpp
-
Humbled that our number of Chrome-only active users surpassed 1,000 for the first time.
https://github.com/webbrain-one/webbrain
#Chrome #ChromeExtension #WebExtension #Milestone #OpenSource #GitHub #WebBrain #offlinellm #qwen #gemma #ollama #llamacpp
-
«Тосок бессмысл»: как я не смог заставить Gemma 4 писать хорошие стихи
Дано: стихотворение. Тема — «тщетность накопления жизненного опыта», амфибрахий, четыре строки. Заканчивается словом «тосок». Такого слова в русском языке нет. Мой оценщик поставил этому тексту техничность 1.000 — идеал. К этому моменту я месяц жёг GPU-часы на арендной L40S, пытаясь заставить Gemma 4 писать русские стихи. У меня был план из четырёх пунктов, свежая статья с рабочим рецептом, размеченный корпус на 13 тысяч пар и собственная метрика, проверенная на Пушкине. План развалился весь, но каждый раз не в том месте, где я ждал: главный подозреваемый до последнего выглядел очевидным, а виновным оказался совсем другой персонаж. Это детектив про то, как четыре файнтюна подряд проиграли необученной базе, как я месяц принимал решения по шуму и не знал об этом — и почему рифму нельзя выучить в принципе, а можно только навязывать. Настоящие цифры, реальный loss и плохие стихи прилагаются.
https://habr.com/ru/articles/1069520/
#LLM #LoRA #файнтюнинг #Gemma #генерация_стихов #силлаботоника #рифма #ограниченное_декодирование #reward_hacking #vLLM
-
Тест Qwen3.5 9b, Gemma 4 12b и Bonsai 27b на легенде пенсионного возраста GTX 1080 ti
Все началось вообще не с идеи написать очередной бенчмарк. Мне нужно было собрать локальный пайплайн для длинных подкастов: получить транскрипт, найти в нем интересные куски, выбрать несколько сильных фрагментов и уже из них делать короткие вертикальные ролики. Облачные модели с этой задачей справляются, но постоянно гонять туда длинные расшифровки не очень хотелось. Плюс было интересно понять, насколько далеко сейчас можно уехать на железе. Под рукой была GTX 1080 Ti на 11 ГБ. Карта 2017 года, архитектура Pascal, никаких Tensor Cores. Так из прикладной задачи постепенно вырос небольшой домашний стенд. Я прогнал три модели в одинаковых условиях, отдельно проверил длинный контекст, затем сделал свой набор reasoning‑задач и сравнил режимы с размышлением и без него. Результаты получились не совсем такими, как я ожидал.
https://habr.com/ru/articles/1069290/
#gemma #qwen #bonsai #бенчмарк #локальные_нейросети #ai #искусственный_интеллект
-
Hab mir im Februar ein #MacStudio mit #M4max und 128GB RAM gekauft... Für verrückte fast 4100€... Und ich dachte mir das ist der größte finanzielle Fehler ever
Hab damit dann viel #ollama #lmstudio #omlx gehostet - #LLM Experimentarium
Habs sogar ein paar Monaten nur mit den eigenen LLMs gecodet, aber Qualität naja...
Da sich die letzten Monate das #openWeights Business geändert hat und keine 120b Modelle veröffentlicht werden, die der perfekte fit dafür wären, nutze ich die 30b Modelle...
Leider mit zunehmendem Frust... #Gemma und #Qwen sind dafür einfach zu klein...
Dann bringt qwen auch nach 3.6 keine kleinen Modelle mehr raus - es gab kein 3.7 und kein 3.8 - letztes haben sie wieder man angekündigt
Bedeutet der Mac Studio war eigentlich nur als Desktop PC im Einsatz - eher #gaming und #Roblox programmierworkstation
Dann hab ich mich mal schlau gemacht - #apple hat meine 128gb Version zum frontier Modell gemacht - und die Modelle sind nirgendwo zu bekommen... Ganz merkwürdig Markt leer gesaugt
Vllt bringt Apple bald neue Mac Studio Modell raus???Okay - eBay preise abgecheckt - da gehen Modell für über 5k€ über den Tisch, aber sehr selten die 128gb Variante
eBay inseriert - 6999,99€ sofort kauf oder Preisvorschlag ab 6000€
Hab das Ding jetzt für 6200€ weiter verkauft
Leider über eBay bezahlt, deshalb wird mein Gewinn versteuert, aber ich gönne
Ist das nicht krass? Was da abgeht, das ist so verrückt auf dem Gebrauch Mac Markt!
-
Hab mir im Februar ein #MacStudio mit #M4max und 128GB RAM gekauft... Für verrückte fast 4100€... Und ich dachte mir das ist der größte finanzielle Fehler ever
Hab damit dann viel #ollama #lmstudio #omlx gehostet - #LLM Experimentarium
Habs sogar ein paar Monaten nur mit den eigenen LLMs gecodet, aber Qualität naja...
Da sich die letzten Monate das #openWeights Business geändert hat und keine 120b Modelle veröffentlicht werden, die der perfekte fit dafür wären, nutze ich die 30b Modelle...
Leider mit zunehmendem Frust... #Gemma und #Qwen sind dafür einfach zu klein...
Dann bringt qwen auch nach 3.6 keine kleinen Modelle mehr raus - es gab kein 3.7 und kein 3.8 - letztes haben sie wieder man angekündigt
Bedeutet der Mac Studio war eigentlich nur als Desktop PC im Einsatz - eher #gaming und #Roblox programmierworkstation
Dann hab ich mich mal schlau gemacht - #apple hat meine 128gb Version zum frontier Modell gemacht - und die Modelle sind nirgendwo zu bekommen... Ganz merkwürdig Markt leer gesaugt
Vllt bringt Apple bald neue Mac Studio Modell raus???Okay - eBay preise abgecheckt - da gehen Modell für über 5k€ über den Tisch, aber sehr selten die 128gb Variante
eBay inseriert - 6999,99€ sofort kauf oder Preisvorschlag ab 6000€
Hab das Ding jetzt für 6200€ weiter verkauft
Leider über eBay bezahlt, deshalb wird mein Gewinn versteuert, aber ich gönne
Ist das nicht krass? Was da abgeht, das ist so verrückt auf dem Gebrauch Mac Markt!
-
從奈洛比到雅加達,開發者一面倒向中國開源AI模型——便宜好用,還不會被美國關掉TNL國際編譯 2026-08-07 14:34:00 CST
從非洲到拉美,開發者正改用中國開源AI:免費、可改、能自己下載。6月美國一紙禁令讓Anthropic全球撤下Fable模型,把「便宜」推成主權保險。美中模型爭奪,台灣早已選邊。
https://www.thenewslens.com/article/269549
#開源模型 #烏干達 #Pax Silica #OpenAI #Meta #美中科技戰 #奈洛比 #月之暗面 #肯亞 #WAICO #DeepSeek #AI模型 #主權AI #阿里巴巴 #Gemma #Hugging Face #OpenRouter #封閉模型 #Llama #Google #Anthropic #矽盛世 #科技 #全球南方 -
從奈洛比到雅加達,開發者一面倒向中國開源AI模型——便宜好用,還不會被美國關掉TNL國際編譯 2026-08-07 14:34:00 CST
從非洲到拉美,開發者正改用中國開源AI:免費、可改、能自己下載。6月美國一紙禁令讓Anthropic全球撤下Fable模型,把「便宜」推成主權保險。美中模型爭奪,台灣早已選邊。
https://www.thenewslens.com/article/269549
#開源模型 #烏干達 #Pax Silica #OpenAI #Meta #美中科技戰 #奈洛比 #月之暗面 #肯亞 #WAICO #DeepSeek #AI模型 #主權AI #阿里巴巴 #Gemma #Hugging Face #OpenRouter #封閉模型 #Llama #Google #Anthropic #矽盛世 #科技 #全球南方 -
I'm currently testing a few #LLM #MLX runtimes/apps on my #M5 Pro 24 GB. So far, I can't say which one gets the best performance out of a local LLM like #Gemma 4 12B.
I've tested #Ollama, #LMStudio, #oMlx, and #osaurus. Each one has its own 1-2 tweaks that are supposed to squeeze out more performance.What's your experience been like?