Przejdź do treści

Metodologia

Strona dokumentuje wszystkie zewnętrzne źródła danych wykorzystywane w serwisie surname.pl, ich licencje oraz sposób, w jaki oznaczamy treści zweryfikowane wobec generowanych algorytmicznie. Pełniejszy rejestr datasetów wraz z bezpośrednimi linkami do plików źródłowych znajdziesz na stronie Źródła danych.

Źródła danych i licencje

Źródła danych i licencje wykorzystywane w surname.pl
DatasetLicencjaData pobrania
Nazwiska występujące w rejestrze PESEL — częstośćCC0 1.02026-04-06
Nazwiska występujące w rejestrze PESEL — rozkład wojewódzkiCC0 1.02026-04-07
Wikidata (P734 — nazwisko)CC0 1.02026-04-07
Etymologia LLM (Claude)wygenerowane na potrzeby projektu2026-04-18

Daty w kolumnie «Data pobrania» odnoszą się do momentu pobrania źródłowych plików. Publiczny zbiór danych «Nazwiska występujące w rejestrze PESEL», udostępniany na portalu dane.gov.pl przez Ministerstwo Cyfryzacji, zawiera stan na styczeń 2026.

Skąd pochodzą etymologie

Żadna etymologia w serwisie nie jest weryfikacją źródłową opartą na literaturze onomastycznej. Import haseł z Wiktionary został rozważony i odrzucony — jakość materiału dla nazwisk okazała się zbyt niska, by go publikować. Pod każdą etymologią znajduje się etykieta wskazująca, w jaki sposób powstała:

Dzięki etykiecie czytelnik od razu wie, czy ma do czynienia z opisem opracowanym przez model językowy, czy z wynikiem analizy budowy nazwiska.