home.social

#nosql — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #nosql, aggregated by home.social.

  1. Масштабируй! Почему Cassandra 5 стала спасением, а FoundationDB прилегла в чулан

    Привет, Хабр! Меня зовут Роман Ананьев из команды DBA в Авито . В этой статье я расскажу о поиске альтернативы для многошардовых инсталляций MongoDB. Основная цель исследования — найти базу данных с поддержкой автошардирования, которая упростит эксплуатацию и лучше утилизирует ресурсы. Когда проект вырастает из уютных нескольких шардов MongoDB и превращается в огромную систему на сотни узлов, стандартные подходы к масштабированию начинают пожирать железо и время инженеров. Здесь продуктовый инженер упирается в ресурсы, и у него начинается головная боль, как перелить данные из одних шардов в другие. Это текст не про то, что MongoDB плохая, она — прекрасный стандарт рынка, в топ-5 движков БД. Я расскажу про то, что происходит, когда у стандартной технологии заканчивается запас прочности на нужном масштабе, и про то, как мы в Авито перебрали множество NoSQL и NewSQL кандидатов, чтобы найти одного подходящего. В статье я разберу результаты технического исследования, проведённого командой DBA. Мы сравнили производительность, утилизацию ресурсов и архитектурные грабли Cassandra 5, FoundationDB и других БД. Также объясню, почему погоня за низкой latency в случае с FDB обернулась трёхкратным перерасходом дискового пространства.

    habr.com/ru/companies/avito/ar

    #базы_данных #nosql #foundationdb #apache_cassandra #хранение_данных #сравнение_производительности #сравнение_баз_данных

  2. Как я подключил Obsidian к Claude и Codex: домашний сервер, CouchDB, MCP и баг, который съедал заметки

    Статья про то, как я связал Obsidian с Claude и Codex через домашний сервер, CouchDB и MCP, а по дороге поймал баг, который тихо съедал куски заметок. 🔧 Это не про «как всё стало умным», а про нормальную историю с self-hosted, авторизацией, странностями LiveSync, мобильными клиентами, CORS, OAuth 2.1. 👀 Внутри выводы о том, как давать AI доступ к базе знаний и не потерять эти самые данные. Заходите, читайте и делитесь своим опытом ❤️

    habr.com/ru/companies/X5Tech/a

    #obsidian #claude #codex #couchdb #mcpserver #nosql #livesync #домашний_сервер #база_знаний #OAuth_21

  3. Обучение универсальным навыкам в IT

    Дисклаймер: вся статья это мнение автора, если вы не согласны или готовы предложить что-то, то прошу в комментарии. IT охватывают огромный простор навыков и идей, многие из них специфичны и предназчена для узкого круга профессий. При этом существуют навыки, которые или универсальны для всех, или не будут лишними точно. В данной статье пойдет речь про Git, SQL и NoSQL, Linux, базовый азы алгоритмов и структур данных и о английском языке. Дополнительно поставил себе задачу, добавить как можно больше бесплатных или квази-бесплатных ресурсов.

    habr.com/ru/articles/1045808/

    #гайд #роадмеп #sql #мнение #алгоритмы #новичкам #начинающим #учеба #linux #nosql

  4. Why should data persistence in 2026 still depend on the database? @wernerwedge analyzes how #JakartaData paves the way for standardized data access — whether Oracle, MongoDB, or Cassandra.

    Read now: javapro.io/2026/03/03/jakarta-

    #JakartaEE #NoSQL #JPA #JAVAPRO @jakartaee @EclipseFdn

  5. Why should data persistence in 2026 still depend on the database? @wernerwedge analyzes how #JakartaData paves the way for standardized data access — whether Oracle, MongoDB, or Cassandra.

    Read now: javapro.io/2026/03/03/jakarta-

    #JakartaEE #NoSQL #JPA #JAVAPRO @jakartaee @EclipseFdn

  6. FYI: NoSQL Data Storage: Options & Careful Considerations #shorts: Exploring data storage solutions. Decisions about data storage depend on how one intends to use the data. Translating data requires careful consideration to ensure easy removal and avoid excessive business logic. #NoSQL #datastorage #database #datamanagement youtube.com/shorts/gFEMNKhXDxA

  7. FYI: NoSQL Data Storage: Options & Careful Considerations #shorts: Exploring data storage solutions. Decisions about data storage depend on how one intends to use the data. Translating data requires careful consideration to ensure easy removal and avoid excessive business logic. #NoSQL #datastorage #database #datamanagement youtube.com/shorts/gFEMNKhXDxA

  8. Aerospike Community Edition без ограничений: наш опыт снятия лимитов

    Лимиты актуальных версий Aerospike Community Edition мешают нормально использовать его в продакшен, но есть способ это исправить. Расскажу о том как мы это сделали и о том как это автоматизировать.

    habr.com/ru/articles/1042530/

    #aerospike #nosql #opensourse #базы_данных

  9. Aerospike Community Edition без ограничений: наш опыт снятия лимитов

    Лимиты актуальных версий Aerospike Community Edition мешают нормально использовать его в продакшен, но есть способ это исправить. Расскажу о том как мы это сделали и о том как это автоматизировать.

    habr.com/ru/articles/1042530/

    #aerospike #nosql #opensourse #базы_данных

  10. Aerospike Community Edition без ограничений: наш опыт снятия лимитов

    Лимиты актуальных версий Aerospike Community Edition мешают нормально использовать его в продакшен, но есть способ это исправить. Расскажу о том как мы это сделали и о том как это автоматизировать.

    habr.com/ru/articles/1042530/

    #aerospike #nosql #opensourse #базы_данных

  11. Cloud thinking: Data in 3rd denormalised form

    One schema to rule them all and in the darkness bind them.

    That’s the SQL way. One schema, many tables, be efficient with space. Join, don’t duplicate. Third normal form and structured data. More structure.

    But that’s not always the best way to scale. How important is it that everything is identical everywhere? How important is history? When a customer moves house, do you want to know the difference between the address they want their next order delivered to and the address the last order was delivered to?

    When you let go of SQL and joins, and when storage is cheap, does it matter if you have multiple copies, so long as each document has the right copy for itself?

    When you aggregate data, when your change log turns multiple orders into 1 delivery schedule for your driver, does it matter that the driver has their own copy for when they lose signal? Does it matter that there’s a copy of the addresses in the route that will be deleted tomorrow because it serves no more purpose?

    If storage is cheap and joins and transmissions are expensive, wouldn’t you want to cache data and trade storage for speed?

    Shouldn’t you embrace heterogeneous data? The address on your payment looks like the address on the order, but it serves a different purpose, it’s embedded in a different context, and it has a different lifecycle.

    It’s sometimes hard to change your mental model, but it can save you from doing the wrong thing.

    #cloudcomputing #cosmosdb #data #nosql
  12. Cloud thinking: Data in 3rd denormalised form

    One schema to rule them all and in the darkness bind them.

    That’s the SQL way. One schema, many tables, be efficient with space. Join, don’t duplicate. Third normal form and structured data. More structure.

    But that’s not always the best way to scale. How important is it that everything is identical everywhere? How important is history? When a customer moves house, do you want to know the difference between the address they want their next order delivered to and the address the last order was delivered to?

    When you let go of SQL and joins, and when storage is cheap, does it matter if you have multiple copies, so long as each document has the right copy for itself?

    When you aggregate data, when your change log turns multiple orders into 1 delivery schedule for your driver, does it matter that the driver has their own copy for when they lose signal? Does it matter that there’s a copy of the addresses in the route that will be deleted tomorrow because it serves no more purpose?

    If storage is cheap and joins and transmissions are expensive, wouldn’t you want to cache data and trade storage for speed?

    Shouldn’t you embrace heterogeneous data? The address on your payment looks like the address on the order, but it serves a different purpose, it’s embedded in a different context, and it has a different lifecycle.

    It’s sometimes hard to change your mental model, but it can save you from doing the wrong thing.

    #cloudcomputing #cosmosdb #data #nosql
  13. Велосипед для жрицы Трои, или как мы переизобретали Outbox для нетранзакционной базы данных

    Привет, Хабр! На связи системный аналитик Илья Глазунов и разработчик Захар Корсаков. Мы работаем с платформой карточного хранилища Т-Банка. Когда данных становится много, а архитектура обязана оставаться простой, классические решения начинают упираться в ограничения стека. В нашем случае нужно было организовать асинхронную доставку событий из Cassandra, но без CDC, без отдельного брокера и без разрастания зоопарка технологий. Так мы пришли к Non-transactional Outbox — схеме, которая по духу напоминает Kafka Inside the Database, но живет в рамках наших ограничений и требований к отказоустойчивости. В статье покажем, что такое Outbox, с чем его едят и как готовят. Расскажем допущения по реализации в нашем случае, вытекающие из отличий от классического паттерна Outbox. Обрисуем ту реализацию, которую сделали своими руками, и покажем бенчмарки нагрузочного тестирования. В конце поделимся списком вопросов, которые возникали чаще всего при обсуждении решения внутри банковского сообщества Apache Cassandra.

    habr.com/ru/companies/tbank/ar

    #apache #apache_cassandra #nosql #базы_данных #системный_анализ