Przejdź do treści
FARMA

O portalu

FARMA odpowiada na jedno pytanie: jak wygląda życie w tym miejscu — wyłącznie na podstawie rejestrów publicznych, z podanym źródłem przy każdej liczbie.

Jedna zasada

Żadna liczba na tym portalu nie jest wymyślona. Każda ma źródło, datę, okres i — gdy to wskaźnik własny — opisaną metodę liczenia. Czego nie mamy, tego nie ma: brak danych pokazujemy jako brak, a nie jako zero, średnią albo puste miejsce.

Brzmi to banalnie, dopóki nie zacznie kosztować. Kosztuje w miejscach takich jak te:

Czego ten portal nie robi

Skąd dane

Z rejestrów publicznych: Rejestr Cen Nieruchomości (GUGiK), Bank Danych Lokalnych GUS, otwarte API NFZ, rejestry Centrum e-Zdrowia i Głównego Inspektoratu Farmaceutycznego, Krajowy Rejestr Sądowy. Pełna lista z częstotliwością aktualizacji i datą ostatniego pobrania jest na stronie źródła danych.

Wszystkie zebrane zbiory są do pobrania w całości jako paczki CSV — bez klucza i bez limitu. Jest też publiczne API dla tych, którzy wolą pytać punktowo.

Jak to jest zrobione

Portal działa na zwykłym hostingu współdzielonym, bez dostępu do powłoki. Cała aktualizacja danych chodzi z jednego zadania crona, które rozdziela pracę na krótkie porcje mieszczące się w limicie czasu. Wdrożenie idzie FTP-em.

To ograniczenie ukształtowało prawie każdą decyzję techniczną: kopia zapasowa robi się przez przeglądarkę, bo nie ma mysqldump; wykresy są rysowane po stronie serwera, bo dodatkowa biblioteka ważyłaby dziesięć razy więcej niż dane, które pokazuje; import dużych plików dzieli się na przebiegi, bo jeden długi zostałby ubity przez serwer.

Pełny dziennik zmian jest w repozytorium, a stan wszystkich importów widać na stronie źródeł.

Kontakt

Błędy w danych najszybciej wychwytują ci, którzy znają okolicę. Przy każdym profilu lokalizacji jest formularz zgłoszenia — jeśli któraś liczba wygląda podejrzanie, napisz. Sprawdzamy przy źródle i, jeśli błąd jest po stronie rejestru, zgłaszamy go dalej.