home.social

#apache_superset — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #apache_superset, aggregated by home.social.

fetched live
  1. Пишем свой Native Filter плагин для Apache Superset: пошаговый рабочий туториал

    Всем привет! Меня зовут Александр Цай, я ведущий инженер-аналитик в МТС Web Services. Занимаюсь всем, что связано с данными и ИИ. Найти, заполучить, обработать, спроектировать, развернуть — это все ко мне. Опущу все нудные подробности, решили мы развернуть себе Superset 6.1.0 — последнюю версию, но столкнулись с тем, что заказчику категорически не нравится штатный фильтр по датам и он не хочет пересаживаться со своего BI, а хочет он календарик. А еще — пару плагинов с оглядкой на PowerBI. Поэтому встал вопрос создания собственного плагина-фильтра. Казалось бы, задача несложная. Пара-тройка гайдов в en сегменте имеется, есть даже документация и штатный генератор шаблонов. Но по факту оказалось, что все это не работает. Генератор так вообще не обновлялся аж с 2024 года: выдает шаблон, который ссылается на уже несуществующие классы и типы, что автоматически делает все гайды неактуальными… А что все это значит? Время написать свой собственный! Об этом и расскажу в сегодняшнем материале. Дисклеймер: Я питонист до мозга костей и в тайпскрипте, да и фронте в целом, понимаю не очень много. Простите меня, адепты сего языка программирования, но код самого плагина навайбкожен (хоть и проверен насколько я смог). В npm не запушил тоже умышленно, цель статьи — дать исходники и показать, как можно собрать плагин. Любой желающий может что-то додумать и доработать, собрать или разобрать и так далее. Читать дальше

    habr.com/ru/companies/ru_mts/a

    #apache_superset #tutorial #dyi #визуализация_данных #sql #bigdata #apache #frontend #typescript

  2. Как «Дикси» мигрировала с Power BI на Sigla Vision за 5 месяцев

    Привет, Хабр! Это GlowByte, мы занимаемся внедрением и миграцией BI‑платформ. В этом посте разбираем свежий кейс: как федеральная розничная сеть «Дикси» вместе с нами и вендором «ДатаМайнд» мигрирует аналитику с Power BI на Sigla Vision. Расскажем, как выбирали платформу, в каком порядке переносили 155 дашбордов и какие цифры получились к середине 2026 года.

    habr.com/ru/companies/glowbyte

    #Power_BI #Sigla_Vision #миграция_BI #импортозамещение #BIплатформа #дашборды #Apache_Superset #ритейл #аналитика_данных #кейс_внедрения

  3. «Наэйай мне биай»: как мы научили Apache Superset говорить по-человечески. Знакомьтесь — AI-powered BI

    Привычная многим картина, когда бизнес «с полей» запрашивает дополнительную аналитику, менеджер идет выбивать ресурсы команды под задачу, аналитик вручную «перемалывает» данные и собирает обновленные дашборды…проходят недели, бюрократические жернова перемалывают прибыль, "гиря ударяется о пол" и бизнес в итоге принимает решение «на глазок». С приходом AI в индустрию бизнес-аналитики забрезжила надежда, что эти темные времена останутся только в воспоминаниях тех, кто еще застал пейджер и охоту на мамонта. В сегодняшней статье разберём, как на базе версии Apache Superset с поддержкой MCP и связки Foundation Models от Cloud.ru можно собрать рабочего AI-агента аналитика, который фразу «построй мне аналитику по продажам» за минуты превращает в полноценный дашборд с возможностью скейлинга в продакшене.

    habr.com/ru/companies/raft/art

    #aiагенты #bi #mcp #apache_superset #texttosql #аналитика_данных #бизнесаналитика #визуализация_данных #автоматизация

  4. Разработка BI-аналитики для застройщика в Apache Superset

    На старте у клиента уже были дашборды, но они не закрывали текущие задачи бизнеса. Данные находились в разных системах — 1С, Excel, Google Таблицы, XML-выгрузки и внутренняя система. Клиент принял решение выстроить аналитику заново и выбрал Apache Superset как инструмент визуализации. Сначала собрали единый слой в PostgreSQL, настроили загрузку через Python, привели метрики к одной логике и зафиксировали правила расчётов. После этого уже собрали дашборды под управленческие задачи клиента. Визуализация строилась так, чтобы быстро находить отклонения и принимать решения, а не просто смотреть отчёты. В результате у клиента появилась система, где данные считаются одинаково для всех, автоматически обновляются и используются в работе без дополнительных проверок.

    habr.com/ru/articles/1021606/

    #Кейс #бизнесаналитика #biаналитика #bi #дашборды #застройщики #apache_superset #автоматизация_аналитики #управленческие_отчеты

  5. Разработка BI-аналитики для застройщика в Apache Superset

    На старте у клиента уже были дашборды, но они не закрывали текущие задачи бизнеса. Данные находились в разных системах — 1С, Excel, Google Таблицы, XML-выгрузки и внутренняя система. Клиент принял решение выстроить аналитику заново и выбрал Apache Superset как инструмент визуализации. Сначала собрали единый слой в PostgreSQL, настроили загрузку через Python, привели метрики к одной логике и зафиксировали правила расчётов. После этого уже собрали дашборды под управленческие задачи клиента. Визуализация строилась так, чтобы быстро находить отклонения и принимать решения, а не просто смотреть отчёты. В результате у клиента появилась система, где данные считаются одинаково для всех, автоматически обновляются и используются в работе без дополнительных проверок.

    habr.com/ru/articles/1021604/

    #Кейс #бизнесаналитика #biаналитика #bi #дашборды #застройщики #apache_superset #автоматизация_аналитики #управленческие_отчеты

  6. Apache Superset — боремся с фильтрами по дате. Часть 2

    В этой статье продолжаем борьбу с фильтрами по дате в Apache Superset. Сегодня разберем, как реализовать подобие логики remove_filter в старых версиях (до 5), чтобы виртуальный датасет не оборачивался фильтрами.

    habr.com/ru/articles/1016384/

    #apache_superset #jinja #фильтр #дата #танцы_с_бубном #визуализация #большие_данные

  7. Apache Superset — боремся с фильтрами по дате. Часть 1

    В этой статье хотелось бы начать раскрытие больной для многих пользователей Apache Superset темы — фильтры по дате. Начнем с малого: как суперсет выбирает колонку даты; как выбрать желаемую колонку вместо той, которую он выбирает; каким образом это реализовано; какие баги породили этим решением; почему КОП не доведет до добра.

    habr.com/ru/articles/1013520/

    #apache_superset #фильтрация_данных #костылизация #визуализация #большие_данные

  8. Основы ETL на примере работы с Superset, Airflow и ClickHouse

    В этой статье я расскажу, как можно запустить простой ETL-процесс на виртуальном сервере, используя связку Superset, Airflow и ClickHouse. В качестве платформы я взял готовую конфигурацию от Beget, включающую Superset и Airflow из коробки — это позволяет сосредоточиться на логике обработки данных, а не на настройке окружения. В качестве примера мы подготовим процесс выгрузки и визуализации данных о товарах с сайта Wildberries. Для извлечения данных мы будем использовать Python-библиотеки selenium и BeautifulSoup — они хорошо подходят для парсинга веб-страниц. Дополнительно применим re для обработки текстовой информации с помощью регулярных выражений.

    habr.com/ru/companies/beget/ar

    #etl #apache_airflow #apache_superset #clickhouse #dag #обработка_данных #biинструменты #анализ_данных #beget

  9. Оптимизация дашбордов в Superset

    В этой статье я бы хотела поделиться опытом в оптимизации дашбордов в Apache Superset. Мы в Газпромбанке перешли на этот BI-инструмент относительно недавно. В основном мы работаем в нем с движком Impala. Иногда бывает так, что некоторые дашборды загружаются дольше других, роняют страницу в браузере или даже замедляют работу для других пользователей на кластере. У коллег накопился большой опыт в оптимизации SQL-запросов и в стандартах разработки витрин. Но конкретно в работе с построением дашбордов есть своя специфика, которая не всегда учитывается, когда речь заходит об оптимальности работы. Superset так же проводит все расчеты на стороне источника через запросы к БД, как это происходит в обычных IDE. Только он преобразует конечный результат в графики, что скрывает от наших глаз сложные запросы, которые иногда там формируются. Ниже мы рассмотрим, как можно оптимизировать работу с датасетами, графиками и содержанием дашборда, а также как ускорить загрузку с помощью агрегированных таблиц.

    habr.com/ru/companies/gazpromb

    #apache_superset #оптимизация #дашборды #apache_impala

  10. Как превратить сырые данные в аналитический отчет

    Делюсь опытом и готовыми решениями по сбору и структурированию сырых данных, превращая их в полезный инструмент для аналитиков.

    habr.com/ru/articles/888436/

    #парсер_сайтов #данные #обработка_данных #хранение_данных #apache_superset #парсинг #mongodb

  11. Пара шаблонов кастомизированных элементов Handlebars для Apache Superset — 2

    Причины написания статьи, общие правила использования handlebars в superset и советы содержатся в первой статье , поэтому сразу опишу следующие шаблоны.

    habr.com/ru/articles/853476/

    #handlebars_superset #шаблоны_графиков #jinja #css #html #apache_superset #templates #charts #аналитика #дашборд

  12. Пара шаблонов кастомизированных элементов Handlebars для Apache Superset

    Apache Superset всё чаще становится выбором для визуализации данных благодаря открытому коду. Но, увы, столкнувшись с его ограничениями и тонкостями, даже самые опытные пользователи могут столкнуться с трудностями. Есть много ограничений, которые требуют обращения за доработками к разработчикам, но с помощью шаблона Handlebars в сочетании с шаблонизацией jinja некоторые трудности можно обойти. С его помощью можно внедрить web-верстку прямо в ваши дашборды, обходя множество подводных камней. Готовых шаблонов для handlebars (superset) мало, так как это довольно трудоемкая задача, часто выходящая за рамки работы с готовыми BI-системами.

    habr.com/ru/articles/851756/

    #handlebars_superset #шаблоны_графиков #jinja #css #html #аналитика #дашборд #apache_superset #templates #charts

  13. Контейнеры, разминаем мозги под Kubernetes – разговоры у костра

    Привет, друзья! Разговоры у вечернего костра, у палатки, у реки, в спокойный, тихий вечер и в располагающей к технической честности и объективности атмосфере, а не «у пепелища дата-центра», как некоторым может показаться! 😊 Приготовьтесь погрузиться в захватывающую историю, как, но, важнее, почему мы сознательно пришли к активному использованию контейнеров и «доросли» до внедрения Kubernetes в высоконагруженном проекте «BI-конструктор». Но про Kubernetes в посте не будет не слова, будет только про контейнеры, но мы подготовим мозг к следующему посту, уже исключительно про Kubernetes, но тоже максимально доступно. Однако, я буду все рассказывать очень простыми (иногда техническими) словами, без ныряния в многоуровневый мат, уж простите. Я убежден, что когда ты все прочувствовал и выстрадал умом и сердцем, то сможешь этот опыт передать доступно и понятно другим, а когда сам не понимаешь, о чем говоришь, то и остальных просто запутаешь. И еще один момент – технических картинок и графиков по теме тоже не будет, они вызывают головную боль от растекания абстракций и их легко найти самостоятельно и в конце я дам рецепт где. Но, даже без них, не сомневайтесь, вы все поймете с первого раза. Итак, наливайте кофе, насыпайте попкорн, кладите в карман таблетку от головной боли (иногда будет сложно, но ради вашего же блага) и ныряйте «под кат».

    habr.com/ru/companies/bitrix/a

    #apache_superset #trino #docker #dockercompose #kubernetes