home.social

#kafka — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #kafka, aggregated by home.social.

  1. Большая история крохотного BPMN

    Что полезного может делать бизнес-процесс, в котором всего одна задача, и та пользовательская? Что можно рассказать про BPMN-схему, которая поместится на экране смартфона? Муки выбора, драма, предательство и обстоятельства непреодолимой силы — вот что! Я расскажу, как на самом деле разрабатываются BPMN, исполняемые в движках вроде Camunda и Flowable, и, может быть, вы перестанете считать их просто «очередной графической нотацией»

    habr.com/ru/articles/1076074/

    #bpmn #camunda #camunda_8 #zeebe #kafka #бизнеспроцессы #оркестрация #eventdriven_architecture #микросервисы #масштабирование

  2. Миграция MariaDB → PostgreSQL без даунтайма: почему обычные утилиты не подошли и как мы сделали это через Debezium CDC

    Перед командой, выросшей на MySQL/MariaDB, встаёт вопрос перехода на PostgreSQL: лицензии, экосистема расширений, более предсказуемое поведение при конкурентных нагрузках - причин достаточно. Проблема в другом: как перенести боевую базу, которая не останавливается ни на минуту, без часов простоя и без риска потерять данные, записанные во время переноса. В этой статье - как мы решали эту задачу для интернет-магазина на MariaDB, почему готовые консольные конвертеры не годятся для «живой» миграции, и как выглядит рабочая схема на Debezium + Kafka Connect, включая Ansible-роль для повторяемого запуска.

    habr.com/ru/articles/1061438/

    #mysql #postgresql #devops #debezium #kafka

  3. DoorDash's new Entity Cache runs on Envoy and Valkey, caching over 100 endpoints across 50 services at 1.5M requests/sec with 99.99999% availability.

    Using Kafka-driven invalidation and the XFetch algorithm, it reduces cache stampedes and cuts P99 latency spikes by up to 80%.

    Read the full story on InfoQ 👉 bit.ly/45jwGvi

    #Caching #Envoy #Valkey #Kafka #DistributedSystems #InfoQ

  4. Kafka Consumer в тестовой автоматизации: архитектурный разбор

    Привет, Хабр! На связи Егор Лаптев — QA Fullstack Java в SENSE на проекте крупного российского банка. End-to-end тесты UI проверяют только то, что видно на экране: кнопка нажалась, форма открылась, данные отобразились. Но в распределённых системах значительная часть бизнес-логики уходит за кадр — в асинхронные события, которые летят через Kafka. Если событие не дошло до топика или пришло с неверным payload, пользователь этого не увидит, а бизнес-процесс сломается. В этой статье расскажу, как мы научились проверять Kafka-события прямо в автотестах — без Kafka UI, kcat и обёрточных сервисов, одной зависимостью и так, чтобы это работало в корпоративной сети с SSL. Покажу архитектуру коннектора, разберу три основных проблемы (SSL-сертификаты, конфликты consumer group и асинхронные тайминги), и поделюсь моделью работы инженера в связке с AI-агентом. Кому будет полезно: QA-инженерам и специалистам по автоматизации, которые тестируют распределённые системы и хотят проверять Kafka-события прямо в автотестах; и инженерам, которым интересна практическая модель работы в связке с AI-агентом — как она ускоряет разработку тестовой инфраструктуры.

    habr.com/ru/companies/it_sense

    #kafka #kafka_consumer #kafka_в_тестировании #qa_automation #sasl #асинхронное_тестирование #aiагенты #allure #consumer_group #распределенные_системы

  5. Kafka Consumer в тестовой автоматизации: архитектурный разбор

    Привет, Хабр! На связи Егор Лаптев — QA Fullstack Java в SENSE на проекте крупного российского банка. End-to-end тесты UI проверяют только то, что видно на экране: кнопка нажалась, форма открылась, данные отобразились. Но в распределённых системах значительная часть бизнес-логики уходит за кадр — в асинхронные события, которые летят через Kafka. Если событие не дошло до топика или пришло с неверным payload, пользователь этого не увидит, а бизнес-процесс сломается. В этой статье расскажу, как мы научились проверять Kafka-события прямо в автотестах — без Kafka UI, kcat и обёрточных сервисов, одной зависимостью и так, чтобы это работало в корпоративной сети с SSL. Покажу архитектуру коннектора, разберу три основных проблемы (SSL-сертификаты, конфликты consumer group и асинхронные тайминги), и поделюсь моделью работы инженера в связке с AI-агентом. Кому будет полезно: QA-инженерам и специалистам по автоматизации, которые тестируют распределённые системы и хотят проверять Kafka-события прямо в автотестах; и инженерам, которым интересна практическая модель работы в связке с AI-агентом — как она ускоряет разработку тестовой инфраструктуры.

    habr.com/ru/companies/it_sense

    #kafka #kafka_consumer #kafka_в_тестировании #qa_automation #sasl #асинхронное_тестирование #aiагенты #allure #consumer_group #распределенные_системы

  6. Kafka Consumer в тестовой автоматизации: архитектурный разбор

    Привет, Хабр! На связи Егор Лаптев — QA Fullstack Java в SENSE на проекте крупного российского банка. End-to-end тесты UI проверяют только то, что видно на экране: кнопка нажалась, форма открылась, данные отобразились. Но в распределённых системах значительная часть бизнес-логики уходит за кадр — в асинхронные события, которые летят через Kafka. Если событие не дошло до топика или пришло с неверным payload, пользователь этого не увидит, а бизнес-процесс сломается. В этой статье расскажу, как мы научились проверять Kafka-события прямо в автотестах — без Kafka UI, kcat и обёрточных сервисов, одной зависимостью и так, чтобы это работало в корпоративной сети с SSL. Покажу архитектуру коннектора, разберу три основных проблемы (SSL-сертификаты, конфликты consumer group и асинхронные тайминги), и поделюсь моделью работы инженера в связке с AI-агентом. Кому будет полезно: QA-инженерам и специалистам по автоматизации, которые тестируют распределённые системы и хотят проверять Kafka-события прямо в автотестах; и инженерам, которым интересна практическая модель работы в связке с AI-агентом — как она ускоряет разработку тестовой инфраструктуры.

    habr.com/ru/companies/it_sense

    #kafka #kafka_consumer #kafka_в_тестировании #qa_automation #sasl #асинхронное_тестирование #aiагенты #allure #consumer_group #распределенные_системы

  7. Как мы ушли от ETL к CDC: выбираем архитектуру real-time аналитики на PostgreSQL, Kafka и ClickHouse. Часть 1

    Все началось с просьбы сделать отчеты в реальном времени. На первый взгляд задача выглядела простой, но довольно быстро выяснилось, что существующая архитектура для этого не подходит. Проект был разбит на множество микросервисов, каждый из которых хранил данные в собственной PostgreSQL-базе. Чтобы строить сквозные отчеты, информацию нужно было где-то объединять. На тот момент аналитика уже работала через ETL: раз в сутки Airflow восстанавливал общую PostgreSQL из ежедневных бекапов, а Redash выполнял запросы уже к ней. Решение было надежным и не требовало нагрузки на production, но для real-time оно не годилось — в лучшем случае отчеты показывали состояние системы на начало дня.

    habr.com/ru/articles/1051760/

    #postgresql #clickhouse #kafka #debezium #cdc #kubernetes #etl #realtime_аналитика #kafka_connect #devops

  8. Тонкости Kafka Connect и Debezium

    Привет! Меня зовут Ильсаф, я инженер данных в MAGNIT OMNI — бизнес-группе ритейлера «Магнит», которая отвечает за развитие омниканального опыта для клиентов. В этой статье я собрал свои практические наблюдения по работе Kafka Connect и Debezium с PostgreSQL: от настройки репликации до мониторинга и бэкфиллинга.

    habr.com/ru/companies/magnit/a

    #kafka #kafka_connect #debezium #cdc #observability

  9. Геораспределенное резервирование Postgres при помощи Debezium

    Всем привет, меня зовут Николай Голубев, я — техлид из компании HFLabs. Эта статья написана по мотивам моего выступления на конференции

    habr.com/ru/companies/oleg-bun

    #highload #PostgreSQL #базы_данных #высоконагруженные_системы #Debezium #хранение_данных #Kafka #релоцирование

  10. CDC своими руками: Kafka + Debezium в домашней лаборатории

    Третья статья цикла о построении CDC-пайплайна с нуля. Сегодня — самое интересное: захватываем изменения из PostgreSQL и отправляем в Kafka. И разбираемся, почему WAL может съесть весь диск, даже если данные не меняются.

    habr.com/ru/articles/990902/

    #kafka #debezium #cdc #devops #data_engineering

  11. 📚 Oh, the irony! We're delving into how the king of #contradictions penned his #mystical hilltop #odyssey. Spoiler alert: It involves a lot of words, pretentiousness, and the kind of existential dread that would make even #Kafka roll his eyes. 🙄📖
    theguardian.com/books/2025/dec #irony #existentialdread #HackerNews #ngated

  12. Also #bunq ist auch witzig…
    Stellt sich raus: die Steuer-ID tippen genügt nicht, sie wollen einen Nachweis. Wie? sagen sie nicht. Stellt sich raus: Foto per Chat …
    Oh, aber kein Foto vom Dokument auf anderem Display (Notebook, Ablage)
    aha. Also als Bild exportieren … aber NICHT mit geschwärzten Stellen - weil "Bearbeitet geht nicht" 😂 klar doch…
    Dann soll es wieder gehen… eine E-Mail sagt: Adresse bestätigen… tja, aber ich komme nicht in die App, weil… kaputt?!

    alter Falter 😂 #kafka

  13. Как оптимизация перформанса Debezium JDBC Sink Connector помогла улучшить Open-source версию решения

    Debezium — популярный фреймворк для Change Data Capture (CDC), позволяющий отслеживать изменения в источниках данных (таких как базы данных) и передавать их в потоковые платформы вроде Apache Kafka. Одним из компонентов Debezium является JDBC Sink Connector, предназначенный для записи данных из Kafka в реляционные базы данных посредством интерфейса Java Database Connectivity (JDBC). Debezium JDBC Sink Connector может решать множество задач: от репликации данных между БД и синхронизации обновлений между микросервисами до создания резервных копий данных для целей тестирования или разработки. Мы в VK Tech используем Debezium JDBC sink connector, чтобы строить перформанс-интеграции. Но в нагрузочных тестах столкнулись с проблемой производительности, которая не решалась никакими обходными путями. Поэтому нам пришлось детально погрузиться в нюансы обработки событий в Debezium JDBC connector. Привет, Хабр. Меня зовут Артём Дубинин. Я старший разработчик Backend в команде Tarantool CDC — решения для репликации данных в реальном времени между системами управления базами данных (СУБД). В этой статье я изложу свою интерпретацию создания Debezium, расскажу о том, как работает Debezium JDBC connector, а также о нашем варианте оптимизации перформанса, который попал в Open-source версию.

    habr.com/ru/companies/vktech/a

    #Tarantool #архитектура #отказоустойчивость #debezium #Kafka #JDBC_Sink_Connector #jdbc #vk_tech #tarantool_cdc #перформанс

  14. Spark, DataSphere и немного магии: как мы строим аналитическую платформу в облаке для банка

    Для решения классических аналитических задач в банке дата‑специалисты обрабатывают миллиарды транзакций. Поэтому создание единого информационного пространства для работы с большими объёмами данных потребует решить как задачи оптимизации производительности и обеспечения безопасности, так и задачи удобства для пользователей — и найти баланс между ними. Сергей Виноградов на конференции Data&ML2Business рассказал про разработку и построение DWH для задач Яндекс Пэй. В этой статье — дополненный рассказ о том, как устроена аналитическая платформа на базе Greenplum® и ClickHouse®, которую решили строить на базе managed‑сервисов в облаке. А также о том, как жизнь аналитиков облегчает связка Apache Spark™ и Jupyter‑ноутбуков в Yandex DataSphere.

    habr.com/ru/companies/yandex_c

    #spark #kafka #cdc #debezium #change_data_capture #map_reduce

  15. A quotation from Kafka

    Writing is a sweet and marvelous reward, but a reward for what? In the course of the night it became clear to me, as plain as a children’s show-and-tell lesson, that it is a reward for serving the devil. This descent down to the dark powers, this unleashing of ghosts by nature bound, these questionable embraces and whatever else may be going on down there, none of it remembered as one writes stories in the sunlight up above. Perhaps there are also different ways of writing, but I only know this one; at night, when fear keeps me from sleeping, I only know this one.

    Franz Kafka (1883-1924) Czech-Austrian Jewish writer
    Letter (1922-07-05) to Max Brod

    More info about this quote: wist.info/kafka-franz/79871/

    #quote #quotes #quotation #qotd #kafka #franzkafka #creativity #damnation #devil #fear #impetus #muse #writing

  16. I’ve shut down my personal Facebook account — and with it, the Ridley Park page. Years of tolerating bot-infested “moderation” was enough. I may spin up a Ridley-only account later, but for now, the page sleeps.

    ridleypark.blog/2025/09/02/don

    #Facebook #Meta #Censorship #DigitalLife #Philosophy #Bots #Kafka #AmWriting #Writing #SocialMedia #BlogPost #Bollox #Blogging #AuthorLife

  17. CDC без боли: как мы делали отказоустойчивую репликацию с Debezium и Kafka

    Я Евгений Прочан, в платформенной команде Magnit OMNI развиваю инфраструктуру DWH. Расскажу здесь, почему нам понадобилось перейти от батчинга к CDC и как мы это делали. Причин перехода было две: потребность бизнеса в расширении возможностей инфраструктуры и нестабильность нашего старого процесса репликации. Мы используем в основном базы данных PostgreSQL. Оттуда пакетами раз в час передаём данные в S3, ClickHouse и таблицы Iceberg. Наша потоковая нагрузка достигает примерно полутора терабайта данных, 6000 операций в секунду (около 1500 в самой нагруженной базе данных).

    habr.com/ru/companies/magnit/a

    #kafka #postgresql #debezium #dwh #отказоустойчивость

  18. [Перевод] Мониторинг и управление воркфлоу между взаимодействующими микросервисами

    Как получить прозрачность в бизнес-процессах, если архитектура строится на микросервисах и событийных потоках? В своей статье Бернд Рюкер, сооснователь Camunda, делится практическими подходами к отслеживанию и управлению процессами в распределённых системах. Он объясняет, как переход от простого мониторинга событий к полноценной оркестрации помогает лучше понимать происходящее, своевременно реагировать на инциденты и сохранять контроль над сложными бизнес-операциями. В статье разбираются плюсы и минусы различных подходов — от Elastic-подобного мониторинга до использования движков рабочих процессов, а также рассматривается важность баланса между оркестрацией и хореографией.

    habr.com/ru/articles/926542/

    #microservices #orchestration #choreography #workflow #bpmn #process_mining #kafka #camunda #data_lake

  19. "Ma mère était infiniment bonne pour moi, c'est vrai, mais ce n'était que relativement à toi, c'est-à-dire, pour moi, dans un mauvais rapport."

    #Kafka, Lettre au père
    #famille #patriarcat #fils #père #masculinite

  20. Join таблиц в реальном времени на Apache Flink ( Часть 2 )

    В данной статье приводится решение проблемы построения витрин данных в реальном времени с помощью Apache Flink. Рассказывается 2 часть подробной реализации решения этой задачи. В данной части рассмотрена проблема учета сообщений на удаление и частично операций update , в связи с чем достигается полная консистентность данных СИ с СП при условии гарантии, что ключ join условия не обновляется.

    habr.com/ru/articles/908220/

    #java #apache_flink #big_data #big_data_analytics #big_data_solutions #architecture #big_data_architecture #debezium #kafka #cdc

  21. Devhands Open Sessions c Владимиром Перепелицей. Очереди в 2025м, что выбрать: Kafka, RabbitMQ, NATS или что-то ещё?

    Привет, Хабр! На прошлой неделе мы провели стрим по очередям с Владимиром Перепелицей (эксперт по большим проектам, очередям и Tarantool, Solution Architect в Exness, создатель S3 в VK Cloud, регулярный спикер и член ПК конференций Highload). Обсудили выбор брокера или системы очередей 2025м году: что поменялось? NATS, его особенности, перспективы, кого он “подвинет” в первую очередь - Kafka или RabbitMQ? Что нового в свежей Apache Kafka 4? Насколько популярны архитектуры, где, например, Kafka основной storage (IoT, сбор метрик и тд). Под катом - расшифровка стрима.

    habr.com/ru/articles/899670/

    #kafka #tiered_storage #nats #redis #streaming #kafka_streams #highload #queues

  22. Репликация данных с использованием Debezium и Kafka

    В этой статье мы рассмотрим эволюцию стратегий репликации данных, начиная с ручных подходов и заканчивая автоматизированными решениями, использующими современные технологии, такие как Kafka и Debezium. Ниже описан пример примененный в компании Wildberries.

    habr.com/ru/articles/861868/

    #debezium #kafka #sql

  23. Thema Visualisierung von #MySQL/ #mariadb Transaktionen:

    Hat hier jemand ein #Grafana im Einsatz? Wenn ja, mit #Prometheus?Mit #exporter oder mit #debezium als #cdc plus #Kafka?

    Oder einfach nur Grafana + MySQL-select alle x Sekunden?

    Hab mich vorgestern versucht, einzulesen und war überrascht, wie viele verschiedene Konstellationen möglich sind!

    #linux
    #foss
    #monitoring

  24. Присматриваемся к Kafka tiered storage — 2

    Добрый день, уважаемые ИТ-ники. На связи Михаил Голованов . Продолжаем увлекательные эксперименты с tiered storage в Apache Kafka. В этот раз починим то, что не смогли починить ранее (сборка реализации AivenOpen) и поэкспериментируем с реализаций для Minio S3 в качестве бекэнда. Как и в прошлый раз, теория будет перемежаться практикой. Поехали

    habr.com/ru/companies/vtb/arti

    #kafka #s3 #tiered_storage

  25. Ganz wunderbar: Die Miniserie Kafka. Ich bin hingerissen von der Umsetzung und dem fantastischen Cast. (Nicholas Ofczarek! Lars Eidinger als Rilke, Charly Hübner als Rowohlt u.v.m.)
    Lustigerweise lese ich gerade auch "1913 - Der Sommer des Jahrhunderts" von Florian Illies und das passt hervorragend, denn ein kleiner Teil des Personals taucht hüben wie drüben auf.
    ardmediathek.de/serie/kafka/st
    #kafka #1913 #FlorianIllies

  26. We also saw community-driven efforts to support CI, binaries, and containers for the Eventing #Kafka Broker receiver & dispatcher (containers), #OpenPolicyAgent's Conftest (ci, binaries), #Skupper (ci, binaries), #Goss (ci, binaries), & rotobuf-maven-plugin (ci) 🎉