home.social

#sre — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #sre, aggregated by home.social.

fetched live
  1. 🚨LIVE NOW!🚨 DevOps/SRE Instructor Livestream

    On this lovely Wednesday, let's chat about #Linux #SystemAdministration, #SelfHosting, or any other topic in the #DevOps and #SRE space you're interested in!

    Owncast: live.monospacementor.com/

  2. Apoyo consular a familias afectadas. 🇲🇽🤝 La SRE coordina los trámites para repatriar a México los restos de dos víctimas del sismo en Pereira, garantizando acompañamiento integral a sus familiares. Conoce más aquí. 👇 #Noticias #SRE #Internacional
    zurl.co/ksctG

  3. I'd like my next job to have something more than Linux, yes, I'm looking at your FreeBSD.

    #runbsd #freebsd #getfedihired

    ↩ Ludovic Hirlimann :
    "I can work in both French and English. I'm interested in infrastructure roles.

    #infrastructure #sysadmin #sre"

    [via Ponos] ponos.fr/thread/clf364ichbjbh9

  4. I can work in both French and English. I'm interested in infrastructure roles.

    #infrastructure #sysadmin #sre

    ↩ Ludovic Hirlimann :
    "I've been remote, fully since 2009 and would like to keep it that way.

    #fullremote"

    [via Ponos] ponos.fr/thread/c615qh73u2fb87

  5. 🇲🇽🕊️ #Noticias | La Cancillería mexicana brinda asistencia consular y gestiona la repatriación de los cuerpos de los dos connacionales fallecidos tras el terremoto en Pereira, Colombia. 🖤✈️ #SRE #AtenciónConsular #México #Colombia
    zurl.co/q46Ij

  6. 🇲🇽🕊️ #Noticias | La presidenta Claudia Sheinbaum confirmó el fallecimiento de dos mexicanos tras el terremoto de 7.4 en Colombia. La SRE brinda acompañamiento e interlocución a sus familiares para la atención requerida. 🖤🇲🇽 #Colombia #Sheinbaum #SRE
    zurl.co/L6bCe

  7. DevOps'ish 322: Linux wireless shuts the door on AI slop patches, KYAML fixes the Norway Bug, and more
    The Linux wireless maintainer stops arguing with LLMs, KYAML gets kubectl to quit lying about Norway, Charity Majors says the skepticism window has closed, and five AI rivals agree on a plugin format that punts on permissions. devopsish.com/322/ #DevOps #Kubernetes #SRE #AI

  8. CNCF Campinas SP - Meetup Presencial

    Laboratório Hacker de Campinas, quarta-feira, 30 de setembro às 18:00 BRT

    🚨 Campinas e Região, prepare-se. Tem coisa nova chegando na comunidade Cloud Native!

    No dia 30 de setembro, quarta-feira, às 19h, a CNCF Campinas SP volta a se reunir presencialmente.

    E dessa vez, em um novo espaço:

    📍 LHC - Laboratório Hacker de Campinas

    👀 Quem serão os palestrantes?
    🤔 Quais serão os temas?
    🔥 O que estamos preparando?

    Por enquanto, vamos deixar algumas respostas no ar...

    Mas se você gosta de Cloud Native, Kubernetes, DevOps, Platform Engineering, SRE, IA e tecnologia, já pode marcar essa data na agenda.

    Uma coisa podemos garantir: vai valer a pena estar presente.

    E tem um detalhe importante que precisamos compartilhar com a comunidade.

    ⚠️ Estamos enfrentando cerca de 50% de NO SHOW nos nossos eventos presenciais.

    Isso significa que metade das pessoas que garantem uma vaga acaba não comparecendo.

    Por isso, fazemos um pedido especial:

    👉 Inscreva-se somente se realmente puder comparecer.

    Sua presença faz diferença. Para a comunidade, para os palestrantes, para o espaço que nos recebe e para que possamos continuar trazendo encontros cada vez melhores para Campinas.

    📅 30 de setembro - quarta-feira
    🕖 19h
    📍 LHC - Laboratório Hacker de Campinas

    🎟️ Em breve divulgaremos os detalhes e o link de inscrição.

    👀 Fique de olho.

    Porque talvez essa seja uma daquelas noites que você não vai querer perder.

    CNCF Campinas SP - comunidade, conhecimento e tecnologia construídos juntos. 🚀

    #CNCFCampinas #CNCF #CloudNative #Kubernetes #DevOps #PlatformEngineering #SRE #AI #Campinas #ComunidadeTech

    eventos.lhc.net.br/event/cncf-

  9. Как мы добавили Global Orchestration в IncidentRelay: маршрутизация алертов до создания инцидента

    Когда система мониторинга отправляет алерт, он редко выглядит так, как хотелось бы дежурному инженеру. Один источник пишет critical , другой — disaster , третий передаёт severity: 5 . В одном payload сервис называется checkout , в другом — payments-api , а в третьем его приходится угадывать по namespace. Если все эти события приходят через общий Alertmanager или webhook, одной статической настройки маршрута быстро становится недостаточно. Обычно проблему решают одним из трёх способов:

    habr.com/ru/articles/1070294/

    #incident_management #alert_routing #oncall #SRE #DevOps #open_source #selfhosted #IncidentRelay

  10. На вкус и цвет все фломастеры разные — способы управления средами на личном опыте

    Знаешь , я прочитал ту статью про инфраструктурные релизы, идентичность и консистентность. Красиво написано, складно. Прямо как в душноватом учебнике. И даже местами правильно. Чего там про фломастеры ...

    habr.com/ru/articles/1070324/

    #инфраструктура #среды_разработки #devops #sre

  11. 🚨LIVE NOW!🚨 DevOps/SRE Instructor Livestream

    On this lovely Thursday, let's chat about #Linux #SystemAdministration, #SelfHosting, or any other topic in the #DevOps and #SRE space you're interested in!

    Owncast: live.monospacementor.com/

  12. Telling an agent to "always ask before acting" is a suggestion, and the model is free to weigh it against a well-crafted log line. An autonomy level you can trust lives in the write path: a bounded verb list instead of shell access, the agent running as its own scoped identity under RBAC, destructive verbs flagged in the tool definition, investigation and execution split into separate sessions.

    Roy Libman on autonomy levels for Kubernetes agents:
    radarhq.io/blog/ai-agent-auton
    #DevOps #AI #SRE

  13. Как мониторить Java-приложения: метрики, алерты и правило 80/20

    Хороший мониторинг помогает быстро понять, что происходит с приложением и куда смотреть в первую очередь. Для этого не нужно пытаться измерить всё: базовый набор технических метрик покрывает большинство типовых проблем, а бизнес-метрики, SLO и анализ аномалий помогают заранее замечать нетипичные отклонения. В Календаре мы называем этот подход правилом 80/20 . Всем привет! Меня зовут Настя, я бэкенд-разработчик в Яндекс 360 и отвечаю за надёжность Календаря. В этой статье я покажу, какие метрики стоит взять за основу, как выбирать полезные алерты и чем дополнять базовый набор для оставшихся 20%.

    habr.com/ru/companies/yandex/a

    #мониторинг #метрики #алертинг #java #devops #sre #site_reliability_engineering #надежность #инцидентменеджмент

  14. Hi everyone, my husband Craig is currently looking for a new job. Please feel free to boost this post for me 💐

    "I'm open for sysadmin, devops, SRE, or general coding work, at any level. Prefer to work *with* opensource, and in an ideal world *on* opensource, but work is work. Nearly 3 decades of experience across development and systems, from the tiny to the large (most recently GitLab). Permanent or contract is fine, working (remote) from Dunedin."

    CV at stroppykitten.com/static/Craig

    Email: [email protected]

    #GetFediContracted #GetFediHired #FediHire #fedijobs #remotejob #jobsearch #job #RemoteJobs #sre #devops #sysadmin #opensource

  15. I will not debate populist AI feelings, you're entitled to them and I respect that. However, it's arrived and these tools are in use. A new set of theory crafting is required for now and this is my start to deal with it: webframp.com/posts/six-princip

    #ai #devops #sre #swamp #manifesto

  16. I finally have the Invirtuate tofu/terraform provider mostly complete in my homelab. I need to add more update functionality for resources, but create, destroy, read, state import, and data sources all work now.

    Pictured are tofu plan, tofu apply, and tofu destroy.

    #technology #terraform #tofu #automation #homelab #selfhosted #devops #sre

  17. Find out how #Stripe automated database incident recovery by modeling its global infrastructure as a graph.

    Using graph search algorithms and state machines, the team automatically computes and executes remediation plans.

    More details on #InfoQ 👉 bit.ly/4zgZGSy

    #AI #MongoDB #Database #SRE #IncidentResponse

  18. 🤖 What if an #AI agent could investigate an Azure incident and trigger your #PowerShell runbooks automatically?

    @[email protected] demonstrates how #Azure #SRE Agent, #MCP, and PowerShell can work together to automate incident response and remediation.

    👉 youtu.be/BBISIWdKWqU?si=CkF...

    - YouTube

  19. Как не растерять девятки в SLA от облачного сервиса до вашего прикладного ПО

    Думаю, многие сталкивались с ситуацией, когда облачный провайдер честно обещает 99.95% или даже 99.99% SLA, но в реальности бизнес-система падает на часы. Формально облако работает, виртуалки доступны, диск жив, сеть отвечает. Фактически пользователь открывает приложение и получает ошибку. Самый неприятный момент заключается в том, что в такие минуты невозможно показать пальцем на провайдера и сказать «проблема на стороне облака», потому что технически облако действительно работает, а вот система нет. Точнее работает, но не как единое целое. Я намеренно не погружаюсь сильно в техническую реализацию того или иного описанного метода по улучшению отказоустойчивости. Сейчас эту задачу прекрасно решает почти любая LLM. Цель статьи – поделиться своим майндсетом: на какие вещи я обращаю внимание, когда передо мной стоит задача улучшить стабильность highload-сервиса.

    habr.com/ru/companies/cloud_ru

    #sre #highload #sla #kafka #kubernetes