Graf cytowań polskiego orzecznictwa — jako dane
Który przepis powołuje które orzeczenie — 7 076 000+ znormalizowanych krawędzi między 540 000+ orzeczeniami a artykułami aktów Dz.U. Ten sam graf, który napędza prawnet.pl, w pakiecie CSV na licencji: bez treści orzeczeń, ze schematem i sumami kontrolnymi.
Jeden graf, dwie tabele, zero treści orzeczeń
Każde orzeczenie w bazie ma znormalizowaną podstawę prawną: adres Dz.U. (rok, pozycja) i artykuł. Z tego powstaje graf, po którym można liczyć, rankować i budować.
Krawędzie: orzeczenie → przepis
7 076 000+ wierszy „orzeczenie X powołuje art. Y aktu Z” — z sądem i datą, więc od razu policzysz trendy per sąd i per rok. Wiersz z pustym artykułem to cytowanie na poziomie całego aktu.
Węzły: metadane orzeczeń
540 855 orzeczeń SN, TK, KIO i sądów powszechnych: sygnatura, sąd, typ, data, słowa kluczowe i stały link do strony orzeczenia. Pełne teksty zostają u źródła — w rejestrze SAOS.
Adresy Dz.U., nie stringi
Podstawy prawne są znormalizowane do (rok, pozycja, artykuł) Dziennika Ustaw — łączą się wprost z bazą aktów i z każdym innym zbiorem, który mówi adresami Dz.U.
Jak można korzystać z Prawnet Dane
Zaczynamy od dumpa — pełny graf w plikach, na licencji. API jest już dostępne w becie; program akademicki to kolejny pas tej samej drogi.
Dump grafu (CSV.gz)
Pełny graf cytowań + metadane orzeczeń w dwóch plikach CSV.gz, ze schema.json, sumami SHA256 i licencją. Bez treści orzeczeń — wyłącznie krawędzie i metadane. Aktualizowany wraz z bazą.
- cytowania.csv.gz — krawędzie: orzeczenie → przepis Dz.U.
- orzeczenia.csv.gz — sygnatura, sąd, data, słowa kluczowe
- Licencja użytku wewnętrznego; AI/ML — odrębnie
API grafu cytowań
Programistyczny dostęp do grafu: orzeczenia do przepisu, przepisy w orzeczeniu, liczniki per sąd i statystyki — na żywo, bez pobierania dumpa. Wygeneruj klucz w panelu i wywołaj pierwszy endpoint w minutę.
- REST, klucz API, limity wg planu (Free 1000/dzień)
- Te same dane, które napędzają prawnet.pl
- Status: beta — dokumentacja i klucze już dostępne
Program akademicki
Badasz orzecznictwo, sieci cytowań albo empiryczną analizę prawa? Uczelniom i badaczom udostępniamy dane do celów naukowych na preferencyjnych warunkach — z atrybucją w publikacji.
- Cel naukowy, niekomercyjny
- Atrybucja: „Prawnet Dane (prawnet.pl/dane)”
- Napisz z adresu uczelnianego
Co dokładnie jest w plikach
Ten sam opis kolumn trafia do pakietu jako schema.json — poniżej jego treść. Wszystkie pliki mają sumy SHA256.
Jak dbamy o rzetelność
- AI wyłącznie klasyfikuje — każda etykieta wyniku i każda statystyka w zbiorze pochodzi z treści opublikowanych orzeczeń, nigdy z modelu.
- Zamknięty katalog przepisów — odpowiedzi spoza katalogu są odrzucane (zabezpieczenie przed halucynacjami).
- Statystyki agregujemy dopiero od 20 orzeczeń — mniejsze próby są ukrywane, nie publikowane.
- Korpus: 540 000+ orzeczeń z publicznego API SAOS i graf 7 mln znormalizowanych powiązań przepis–orzeczenie.
- Etykiety AI trafiają do statystyk tylko przy wysokiej pewności modelu i są walidowane wyrywkowo.
- To statystyka historyczna — nie prognoza wyniku sprawy ani porada prawna.
Najczęstsze pytania
Skąd pochodzą dane i czy wolno je licencjonować?
Orzeczenia pochodzą z publicznego rejestru SAOS (saos.org.pl). Graf cytowań — normalizacja podstaw prawnych do adresów Dz.U. i artykułów — jest opracowaniem Prawnet i to jego dotyczy licencja. Pakiet zawsze wskazuje SAOS jako źródło orzeczeń.
Czy dump zawiera treści orzeczeń?
Nie. Pakiet to wyłącznie krawędzie grafu (orzeczenie → przepis) i metadane orzeczeń: sygnatura, sąd, typ, data, słowa kluczowe oraz stały link do strony orzeczenia na prawnet.pl. Pełne teksty pozostają w rejestrze SAOS i na stronach orzeczeń.
A dane osobowe (RODO)?
Metadane orzeczeń przekazujemy w postaci, w jakiej sądy opublikowały je w rejestrze SAOS („as published”) — nie wzbogacamy ich o żadne dodatkowe dane osobowe. Licencjobiorca przetwarza je jako odrębny administrator, we własnym celu i na własnej podstawie prawnej.
Czy mogę trenować na tych danych modele AI?
Licencja podstawowa obejmuje użytek wewnętrzny (analizy, research, produkty wewnętrzne) i nie obejmuje trenowania modeli AI/ML — to odrębna licencja. Napisz na info@prawnet.pl, opisz zastosowanie, a przygotujemy warunki.