home.social

#bazydanych — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #bazydanych, aggregated by home.social.

fetched live
  1. Paliwo dla sztucznej inteligencji. Dlaczego w branży medycznej i kryminalnej „nudne” dane kosztują miliony

    Kiedy myślimy o sztucznej inteligencji, zazwyczaj widzimy efektowne generatory obrazów, inteligentne asystenty w smartfonach czy algorytmy piszące kod za programistów.

    Tymczasem prawdziwa rewolucja AI dokonuje się obecnie w laboratoriach kryminalistycznych, przemyśle farmaceutycznym i placówkach badających bezpieczeństwo naszej żywności. W tych miejscach technologia napotyka jednak na gigantyczny problem, którego nie da się rozwiązać samym zwiększaniem mocy obliczeniowej.

    Sundar Pichai chwali się kodem pisanym przez AI, a pracownicy Google… wyśmiewają go w wewnętrznych memach

    Gdy sztuczna inteligencja nie może zgadywać

    Większość popularnych modeli językowych (jak ChatGPT czy Gemini) ma tendencję do halucynowania – gdy nie znają odpowiedzi, po prostu ją wymyślają, by zadowolić użytkownika. W branży farmaceutycznej czy śledczej taka pomyłka jest niedopuszczalna. System analityczny wspomagany przez AI, badający próbkę trucizny z miejsca zbrodni albo poszukujący zanieczyszczeń w lekach, nie może opierać się wyłącznie na domysłach. Musi osiągać możliwie najwyższą pewność identyfikacji.

    Aby algorytmy mogły skutecznie minimalizować ryzyko błędu, muszą być karmione idealnie czystymi, zweryfikowanymi danymi. Słynna informatyczna zasada „garbage in, garbage out” (śmieci na wejściu, śmieci na wyjściu) w świecie poważnej nauki nabiera kluczowego znaczenia. I właśnie dlatego na rynku technologicznym rośnie potężny biznes firm, które zajmują się wyłącznie dostarczaniem „twardych faktów” dla sztucznej inteligencji.

    Chemiczne odciski palców na wagę złota

    Doskonałym przykładem tego zjawiska jest nowe wydanie Wiley Registry of Mass Spectral Data (edycja 2026). Z pozoru to nudny, hermetyczny produkt dla chemików. W praktyce – to gigantyczna baza zawierająca ponad 915 500 zweryfikowanych „odcisków palców” (widm masowych) dla różnych związków chemicznych.

    Kiedy nowoczesne, napędzane przez AI narzędzia laboratoryjne analizują nieznaną substancję, muszą błyskawicznie porównać jej strukturę z ogromną bazą wzorców. Baza Wiley została zaktualizowana o ponad 42 tysiące nowych widm wyłącznie po to, aby sprostać wymaganiom nowoczesnych, zautomatyzowanych przepływów pracy (workflows) opartych na sztucznej inteligencji. Każda wprowadzona tam dana musi zostać rygorystycznie sprawdzona, aby zminimalizować ryzyko pomyłki algorytmu.

    Niewidzialny fundament rewolucji

    Ten z pozoru niszowy produkt świetnie obrazuje kierunek, w którym zmierza dzisiejsza technologia. Wyścig zbrojeń w świecie AI nie polega już tylko na tworzeniu sprytniejszych algorytmów. Prawdziwą przewagę zdobywają te instytucje, które mają dostęp do gigantycznych, świetnie uporządkowanych i – co najważniejsze – weryfikowalnych baz danych. Bez takich cyfrowych słowników użyteczność nawet najpotężniejszej sztucznej inteligencji na świecie byłaby dramatycznie ograniczona.

    #AIWMedycynie #bazyDanych #halucynacjeAI #kryminalistyka #sztucznaInteligencja #technologieLaboratoryjne #widmaMasowe #WileyRegistry
  2. Poszukiwane polecajki.
    Potrzebne jakieś narzędzie do tworzenia baz danych. Wymagania: darmowe i proste w obsłudze (tak by ogarnęły je osoby, które na co dzień obsługują raczej Netflixa, Instagrama i Worda niż zaawansowane programy). Gdyby było po polsku to już w ogóle świetnie (ale jeśli nie będzie to nie będzie tragedii).

    W bazie danych będą odpowiedzi na wnioski o udostępnienie informacji publicznej z wielu różnych instytucji.

    #bazadanych #bazydanych

  3. Czy możliwy jest atak SQL Injection w 2025 roku? Tak, poprzez parsowanie znaków w psql

    Ostatnio głośno było o atakach na Departament Skarbu, które zostały przypisane chińskim grupom APT. Atakujący wykorzystywali podatności w produktach BeyondTrust Privileged Remote Access oraz Remote Support, które pozwalały na zdalne wykonanie poleceń. Podatności zostały sklasyfikowane jako CVE-2024-12356. TLDR: W czasie poszukiwań RCE, badacze z Rapid7 natknęli się na podatność SQL...

    #WBiegu #BazyDanych #Postgresql #SQLInjection #Websec

    sekurak.pl/czy-mozliwy-jest-at

  4. Wiele razy pisaliśmy na blogu o skalowaniu aplikacji, a konkretnie komponentów aplikacji. To łatwiej sobie wyobrazić niż skalowanie baz danych, a te również mogą podlegać temu procederowi. Tylko jak to się robi? Tego dotyczy ten artykuł i rzeczywiście - prawdopodobnie przynajmniej z części z tych technik musieliście już kiedyś skorzystać.

    #BazaDanych #BazyDanych #database #optymalizacja #skalowanie #scaling

    blog.algomaster.io/p/system-de

  5. Ciekawy tekst o stosunkowo prostej rzeczy, jaką jest typ kolumny będącej kluczem podstawowym w tabeli w PostgreSQL. Co prawda, typ TEXT brzmi źle już bez żadnego testowania, ale dobrze wiedzieć, że UUID ma aż takie walory wydajnościowe. Warto wiedzieć.

    #SQL #PostgreSQL #BazyDanych

    maciejwalkowiak.com/blog/postg

  6. Potencjalnie ciekawy artykuł dla osób, które w swoich aplikacjach mają wyszukiwarkę i musi być ona "odporna" na różne warianty wpisywanych fraz przez użytkowników. Tutaj bardzo klarowna opowieść o tym, jak Levels.fyi poradziła sobie z tym w swojej bazie PostgreSQL.

    #searching #wyszukiwarka #programowanie #BazyDanych #SQL

    levels.fyi/blog/scalable-searc

  7. Osoby mające kontakt z bazami danych wiedzą o tym, że obok istnieje typu CHAR istnieje też VARCHAR, który ma zmienną długość. Ale co to tak naprawdę oznacza i czy CHAR ma jakiekolwiek zalety? Dowiecie się z tego artykułu, podobnie jak tego, że silnik można nazywać "motorem".

    #BazyDanych #SQL

    badtke.pro/char-a-varchar-mity