OBSERWATORIUM PROGNOZPRO / Wersja rozwojowa / Polska
PROGNOZY.PL / JAK TO DZIAŁA
Najpierw dowody.
Jasny przedmiot prognozy, jawny benchmark i uczciwe ograniczenia.
01 / ŹRÓDŁO
Prognozujemy konkretną liczbę.
Śledzimy EUR, USD, CHF, GBP, NOK i SEK względem PLN: kursy średnie z tabeli A Narodowego Banku Polskiego. Nie jest to bieżący kurs transakcyjny ani cena w kantorze. Jednostka: złote za jedną jednostkę wybranej waluty.
Horyzonty 1, 5 i 20 oznaczają kolejne publikacje NBP. Dni bez tabeli nie są dopisywane. Planowana data celu pomija weekendy, ale nie święta; faktyczny cel wyznacza kolejność opublikowanych tabel.
Punkt odniesienia stanowi metoda „ostatnia wartość”: przyszły kurs jest równy ostatniemu opublikowanemu kursowi. Linia płaska jest wynikiem tej metody, a nie prognozą pewnego braku zmian.
Panel bazowy walut obejmuje ostatnią wartość, średnią z 20 odczytów i dryf z 60 odczytów. Liga PRO porównuje sześć metod: ostatnią wartość, AutoARIMA, AutoETS, sieć MLP, automatyczny wybór oraz prognozę łączoną. Aktualny protokół to pro-v2; wcześniejsze zapisy pozostają w archiwum.
AutoARIMA i AutoETS działają bez sezonowości. MLP wykorzystuje osiem opóźnień zmian i jedną warstwę 16 neuronów; skalowanie dopasowuje wyłącznie do wcześniejszych danych. To model eksperymentalny.
Automatyczny wybór wskazuje metodę z najmniejszym MAE na 30 wcześniej znanych celach danego horyzontu. Prognoza łączona waży cztery modele według odwrotności ich MAE, z dolnym ograniczeniem błędu 1e-9; wagi sumują się do 100%. Przy równym wyniku kolejność wyboru to ostatnia wartość, AutoARIMA, AutoETS, MLP. Wybór i wagi liczymy ponownie w każdym kroku testu.
03 / TESTOWANIE
Historia i nowe prognozy to osobne próby.
Panel bazowy walut sprawdza ostatnie 40 wspólnych celów. Liga PRO sprawdza 20 wspólnych celów dla każdego horyzontu i wszystkich sześciu metod. Model otrzymuje wyłącznie obserwacje dostępne przed celem; wybór modelu korzysta tylko z wcześniejszych, już znanych wyników. Test używa obecnej wersji historii, bez odtwarzania dawnych rewizji i godzin publikacji.
MAE to średni błąd bezwzględny. Porównanie z baseline liczymy jako 1 − MAE modelu / MAE baseline. Wynik dodatni oznacza mniejszy błąd. Przy zerowym błędzie baseline wynik jest nieokreślony (N/A).
Liga LIVE obejmuje wyłącznie zapisane prognozy i rzeczywiste odczyty. Porównuje sześć metod na tych samych kompletnych zadaniach, w obrębie jednego rynku, horyzontu i aktualnego protokołu. Obejmuje do 1000 najnowszych przebiegów i rozliczeń. Przy powtórzeniu tego samego zadania liczy się najwcześniejszy zapis w tej próbie. Prognozy wystawione w dniu celu lub później są wyłączone.
Pokazujemy osobno liczbę zadań i różnych dat celu. Poniżej 30 dat wynik oznaczamy jako wstępny; przekroczenie tego progu nie dowodzi trwałej przewagi. Nakładające się horyzonty nie są niezależnymi próbami. Brak rozliczeń pozostaje brakiem wyniku — nie zastępujemy go testem historycznym.
Nie pokazujemy ogólnej „skuteczności w procentach”. Dla FX udostępniamy eksperymentalne przedziały o poziomie nominalnym 80%. Promień to kwantyl błędów bezwzględnych z maksymalnie 80 historycznych prognoz tego modelu i horyzontu, których cele są już znane (minimum 60). Wybieramy rangę ceil((n+1) × 0,8), bez założenia rozkładu normalnego. Dolna granica jest ograniczona do zera. Pokrycie i średnią szerokość mierzymy na maksymalnie 20 kolejnych celach: w każdym kroku kalibracja korzysta wyłącznie z wyników już znanych. Zależność czasowa danych wyklucza traktowanie 80% jako gwarancji.
04 / ARCHIWUM
Wartości zapisanej prognozy nie zmieniamy.
Rekord prognozy zawiera czas wystawienia, odwołanie do danych wejściowych, metodę, horyzont i hash treści. Prognozy bazowe walut przechowują także orientacyjną datę celu; rzeczywisty cel wyznaczają kolejne publikacje źródła. Rekordy są dopisywane, a baza blokuje ich edycję oraz usuwanie. Przy kolejnych importach nie tworzymy ponownie tych samych prognoz.
Hash pozwala sprawdzić integralność. Nie dowodzi niezależnie czasu wystawienia — zewnętrzne znaczniki czasu pozostają kolejnym etapem. Wynik rzeczywisty zapisujemy raz, przy pierwszym imporcie zawierającym docelową publikację. Późniejsze rewizje nie nadpisują rozliczenia.
PALIWA / ŹRÓDŁO
Ceny krajowe z podatkami.
Archiwum paliw zapisuje trzy proste modele: ostatnią cenę, średnią czterech odczytów i dryf z dwunastu odczytów przeliczony na tydzień. Historia i bieżąca tabela KE muszą mieć zgodne daty, jednostki i wartości. Nota metodologiczna Polski podłączona na stronie KE pochodzi z 2018 r.; jej aktualność dla sposobu doboru próby wymaga potwierdzenia.
Przedziały FX opierają się na rozkładzie historycznych błędów prognoz. Przedziały paliw są kalibrowane niezależnie na końcowym ciągu kolejnych tygodni: 60–80 wcześniejszych błędów tego samego modelu i horyzontu. Pokrycie sprawdzamy na 20 kolejnych celach. Nowe prognozy bazowe fuel-v2 zapisują zakres w rejestrze; starszych rekordów nie uzupełniamy wstecz.
CPI korzysta z miesięcznej historii GUS od 1982 roku. Modele wykorzystują ostatnie 240 pełnych odczytów indeksu rok do roku; odejmujemy 100, aby wyświetlić inflację w procentach. Błąd podajemy w punktach procentowych. Horyzonty wynoszą 1, 3 i 12 miesięcy.
Szybki szacunek przechowujemy i pokazujemy osobno. Nie trafia do treningu modeli pełnego CPI. Nowe zapisy CPI mają osobne zasady cpi-release-v1. Kwalifikację sprawdzamy dla każdego horyzontu: według potwierdzonego kalendarza, a przy jego braku wymagamy zapisu przed rozpoczęciem miesiąca celu. Przy rozliczeniu ponownie sprawdzamy rzeczywiste daty publikacji. Prognoza musi poprzedzać dzień pierwszego odczytu, także szybkiego szacunku. Zapis w trakcie miesiąca wymaga zachowanego potwierdzenia daty szacunku. Pełny komunikat musi zgadzać się z CSV GUS; miesiąc celu nie jest datą publikacji. Wynik zapisujemy raz, bez zmiany przy późniejszych rewizjach. Starsze scenariusze pozostają poza LIVE.
07 / STATUS WERSJI
Jasno mówimy, czego jeszcze nie wiemy.
To wersja rozwojowa. Harmonogram sprawdza waluty co 30 minut, a paliwa i CPI co 6 godzin; nowe dane zależą od terminów publikacji źródeł. Stan importów jest widoczny w serwisie. Dla walut zapis kwalifikowany do LIVE wymaga tabeli z bieżącego dnia w Polsce. Dla paliw wymagamy daty źródłowej niepóźniejszej niż dziś i zapisu przed upływem tygodnia od tej daty. Dodatkowo przy rozliczeniu sprawdzamy, czy prognoza poprzedza dzień celu. Zewnętrzny znacznik czasu i pełna historia rewizji pozostają w przygotowaniu.
Krótki test nie dowodzi przyszłej przewagi. Używaj wyniku jako scenariusza, nie gwarancji ani instrukcji zawarcia transakcji. Paliwa korzystają z Weekly Oil Bulletin KE: Pb95, olej napędowy i LPG, ceny z podatkami. PLN/l = (EUR/1000 l) / (EUR za PLN z tego samego tygodnia) / 1000. Prognozy paliw dotyczą dokładnych dat za 1 i 4 tygodnie; braku odczytu nie zastępujemy ceną z innego tygodnia.