Tekst to nie tylko słowa i zdania. Za każdym dłuższym opracowaniem stoi kontekst, siatka logicznych powiązań oraz założenia, które autor formułuje z określoną intencją. W trakcie lektury obszernego, skomplikowanego materiału człowiek może łatwo zgubić właściwy sens lub kontekst, bowiem zmęczenie i natłok informacji robią swoje.
I tu pojawia się kluczowe pytanie – jak przełożyć opisaną w długim, skomplikowanym dokumencie rzeczywistość na precyzyjną informację tak, żeby kluczowe cechy dokumentu pozostały zachowane, a postać docelowa była łatwo i szybko przyswajalna.
Żeby móc taki sposób ustalić, założyłem sobie cel jakim jest przetworzenie rozporządzenia o BDOT10k w taki sposób, aby można było efekt wykorzystać do łatwiejszego zrozumienia przez człowieka kluczowych treści i wzajemnych powiązań relacyjnych oraz logicznych warstw i słowników w zakresie bazy BDOT10k.
Link do oryginału przetwarzanego rozporządzenia BDOT10k
Rozporządzenie jest dość specyficzną lekturą zawierającą dziesiątki stron formalnego języka prawno-technicznego, z tabelkami oraz rozbudowaną siatką atrybutów z relacjami przestrzennymi i logicznymi obiektów w opisie.
Założyłem, że proces przetwarzania będzie następować przez użycie komercyjnego modelu LLM w sposób automatyczny, powtarzalny, bez ingerencji człowieka, bez przekłamań i z uwzględnieniem precyzyjnego przekazania wszystkich kluczowych informacji.