home.social

#bare_metal — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #bare_metal, aggregated by home.social.

  1. Написал свой ассемблер, чтобы понять, откуда берётся ff010113. Почти половину моей программы он выдумывает

    Написал свой ассемблер, чтобы понять, откуда в дизассемблере берётся ff010113. Заодно посчитал, сколько строк моей программы процессор вообще не умеет исполнять, и проверил это на четырёх наборах команд, включая живой ESP32 на столе. На кристалле первая программа серии сломалась: она пишет в UART быстрее, чем провод успевает передавать, и в эмуляторе этого не видно. Что сказала плата?

    habr.com/ru/articles/1076022/

    #RISCV #ассемблер #кодирование_инструкций #псевдоинструкции #RV32I #компоновщик #релокация #bare_metal #QEMU

  2. Как восстановить KRaft-кворум после потери большинства контроллеров

    Представьте себе баг-репорт: все шесть подов в статусе 1/1 Running, Readiness зелёный, kafka-agent на брокерах отдаёт 204. А кластер мёртв: оператор бесконечно крутит реконсайл и валится в TimeoutException: Timed out waiting for a node assignment. Call: describeMetadataQuorum. Если зайти на том контроллера, можно увидеть, что __cluster_metadata-0/quorum-state: leaderId выставлен, а appliedOffset в 0. Ни одна запись метаданных не применена. JVM живые, raft-лог на диске растёт, и при этом ни один под не написал в stdout ни строки следующие восемь часов. Это не выдумка, а реальный баг-репорт Strimzi от 25 мая 2026 , и к нему мы ещё вернёмся. В Kafka 4.x больше нет привычного «запасного выходa» в виде ZooKeeper: метаданные переехали внутрь самой Kafka (KRaft), и если кворум контроллеров теряет большинство, чинить уже приходится сам кластер Kafka, а не внешний сервис. Раньше чтобы с этим справиться в Kafka существовал ZooKeeper, отдельная система со своими инструментами, ансамблем и культурой восстановления. В версии 4.x его нет, и в документации от процедуры остался только линк на 3.9 . Метаданные переехали внутрь самой Kafka (KRaft), и если кворум контроллеров теряет большинство, чинить уже приходится сам кластер Kafka, а не внешний сервис. В этой статье расскажем, что делать в такой ситуации и как восстанавливать этот кворум, чтобы не случилось ситуации, описанной выше.

    habr.com/ru/companies/vktech/a

    #vk_cloud #bare_metal #выделенные_серверы #гибридная_инфраструктура #onpremises #виртуализация #gpu_нагрузки #infiniband #high_performance_computing #erp_crm_системы

  3. Как восстановить KRaft-кворум после потери большинства контроллеров

    Представьте себе баг-репорт: все шесть подов в статусе 1/1 Running, Readiness зелёный, kafka-agent на брокерах отдаёт 204. А кластер мёртв: оператор бесконечно крутит реконсайл и валится в TimeoutException: Timed out waiting for a node assignment. Call: describeMetadataQuorum. Если зайти на том контроллера, можно увидеть, что __cluster_metadata-0/quorum-state: leaderId выставлен, а appliedOffset в 0. Ни одна запись метаданных не применена. JVM живые, raft-лог на диске растёт, и при этом ни один под не написал в stdout ни строки следующие восемь часов. Это не выдумка, а реальный баг-репорт Strimzi от 25 мая 2026 , и к нему мы ещё вернёмся. В Kafka 4.x больше нет привычного «запасного выходa» в виде ZooKeeper: метаданные переехали внутрь самой Kafka (KRaft), и если кворум контроллеров теряет большинство, чинить уже приходится сам кластер Kafka, а не внешний сервис. Раньше чтобы с этим справиться в Kafka существовал ZooKeeper, отдельная система со своими инструментами, ансамблем и культурой восстановления. В версии 4.x его нет, и в документации от процедуры остался только линк на 3.9 . Метаданные переехали внутрь самой Kafka (KRaft), и если кворум контроллеров теряет большинство, чинить уже приходится сам кластер Kafka, а не внешний сервис. В этой статье расскажем, что делать в такой ситуации и как восстанавливать этот кворум, чтобы не случилось ситуации, описанной выше.

    habr.com/ru/companies/vktech/a

    #vk_cloud #bare_metal #выделенные_серверы #гибридная_инфраструктура #onpremises #виртуализация #gpu_нагрузки #infiniband #high_performance_computing #erp_crm_системы

  4. Как восстановить KRaft-кворум после потери большинства контроллеров

    Представьте себе баг-репорт: все шесть подов в статусе 1/1 Running, Readiness зелёный, kafka-agent на брокерах отдаёт 204. А кластер мёртв: оператор бесконечно крутит реконсайл и валится в TimeoutException: Timed out waiting for a node assignment. Call: describeMetadataQuorum. Если зайти на том контроллера, можно увидеть, что __cluster_metadata-0/quorum-state: leaderId выставлен, а appliedOffset в 0. Ни одна запись метаданных не применена. JVM живые, raft-лог на диске растёт, и при этом ни один под не написал в stdout ни строки следующие восемь часов. Это не выдумка, а реальный баг-репорт Strimzi от 25 мая 2026 , и к нему мы ещё вернёмся. В Kafka 4.x больше нет привычного «запасного выходa» в виде ZooKeeper: метаданные переехали внутрь самой Kafka (KRaft), и если кворум контроллеров теряет большинство, чинить уже приходится сам кластер Kafka, а не внешний сервис. Раньше чтобы с этим справиться в Kafka существовал ZooKeeper, отдельная система со своими инструментами, ансамблем и культурой восстановления. В версии 4.x его нет, и в документации от процедуры остался только линк на 3.9 . Метаданные переехали внутрь самой Kafka (KRaft), и если кворум контроллеров теряет большинство, чинить уже приходится сам кластер Kafka, а не внешний сервис. В этой статье расскажем, что делать в такой ситуации и как восстанавливать этот кворум, чтобы не случилось ситуации, описанной выше.

    habr.com/ru/companies/vktech/a

    #vk_cloud #bare_metal #выделенные_серверы #гибридная_инфраструктура #onpremises #виртуализация #gpu_нагрузки #infiniband #high_performance_computing #erp_crm_системы

  5. Накатить ось на 500+ серверов и настроить всё за 10 минут: наш опыт использования Foreman

    Когда в компании парк из тысячи серверов, хочется наладить процесс для удобной работы с ними. Один из вариантов — автоматизировать установку и настройку операционных систем. Я Иван Протченко, инженер из команды Читать дальше

    habr.com/ru/companies/cloud_ru

    #foreman #автоматизация #bare_metal #облачная_инфраструктура #установка_ос #настройка_ос #ос_в_облаке #очень_много_серверов

  6. Накатить ось на 500+ серверов и настроить всё за 10 минут: наш опыт использования Foreman

    Когда в компании парк из тысячи серверов, хочется наладить процесс для удобной работы с ними. Один из вариантов — автоматизировать установку и настройку операционных систем. Я Иван Протченко, инженер из команды Читать дальше

    habr.com/ru/companies/cloud_ru

    #foreman #автоматизация #bare_metal #облачная_инфраструктура #установка_ос #настройка_ос #ос_в_облаке #очень_много_серверов

  7. Накатить ось на 500+ серверов и настроить всё за 10 минут: наш опыт использования Foreman

    Когда в компании парк из тысячи серверов, хочется наладить процесс для удобной работы с ними. Один из вариантов — автоматизировать установку и настройку операционных систем. Я Иван Протченко, инженер из команды Читать дальше

    habr.com/ru/companies/cloud_ru

    #foreman #автоматизация #bare_metal #облачная_инфраструктура #установка_ос #настройка_ос #ос_в_облаке #очень_много_серверов