Forum strony www.multipasko.pl [Regulamin]


Dodaj wpis w tym temacie
Spis tematów
Login:

Hasło:
Strona: 1 2 3
Wyślij wiadomość do admina

Przewiń wpisy ↓

Usuwanie losowań z statystyki

2026-07-02 (20:16)

status Kulek
Data rejestracji: 2026-01-03
Ilość postów: 18

17068
wpis nr 1 622 582
[ CZCIONKA MONOSPACE ]

Cześć!
Zastanawiam się nad nowym podejściem do analizy wyników. Czy warto brać pod uwagę każde losowanie, czy może lepiej oznaczać te "dziwne" (skrajne asymetrie) jako szum?

Wiadomo, że rozkład 10/10 parzystych to norma, a 16/4 to rzadkość. Moim zdaniem te rzadkie zdarzenia mogą działać jak błąd pomiarowy przy szukaniu trendów na kule. Gdzie Wy postawilibyście granicę między losowaniem "użytecznym statystycznie" a "anomalią"? Czy macie swoje parametry takiej normy?
2026-07-03 (06:18)

status heme24
Data rejestracji: 2015-12-08
Ilość postów: 390

14639
wpis nr 1 622 612
[ CZCIONKA MONOSPACE ]

Witam.

Jako nieliczny zauważyłeś podstawowy problem gier losowych. Wyniki gier to szum, jak tego nie posegregujesz i wrzucisz jak leci do programu analitycznego to też otrzymasz szum. Nie rozumieją tego tutejsi typerzy i jest jak jest.
Wyniki trzeba w jakiś sposób zaszufladkować i nadać klasy, problemem jest jak to zrobić. Ideałem byłoby nadać wynikom np. 20 klas i potem tylko wybrać jakieś klasy i wrzucić to do jakiegoś programu np. sieci.
Można też polować na nietypowe układy które rzadko ale wchodzą, ale niestety problemem jest jak to zrobić , mi się tego na razie nie udało ale innej drogi nie ma.
2026-07-03 (14:42)

status Kulek
Data rejestracji: 2026-01-03
Ilość postów: 18

17068
wpis nr 1 622 649
[ CZCIONKA MONOSPACE ]

Dziękuję za odpowiedź.
Masz rację – Twoja uwaga uchroniła mnie przed zbyt pochopnym użyciem brzytwy Ockhama. Skoro każde losowanie jest informacją, nie możemy go po prostu wyrzucić, a jedynie musimy je właściwie sklasyfikować. Moja intuicja podpowiadała mi podejście z fizyki, gdzie do modelu bierze się tylko dane istotne, pomijając szum.

Największym problemem jest właśnie zdefiniowanie cech tych klas. Są statystyk które opierają się na błędnym założeniu dotyczących numeracji kul. Dla mnie numery to tylko etykiety (ID), a nie wartości matematyczne. Liczenie sumy liczb z kul to pomyłka logiczna, kula z numerem 5 nie ma w sobie „piątki” niczego, to tylko nazwa.(to tylko moja opinia na temat statystyk opartych na wartościach które sa etykietą. Owszem użyłem w poście sformułowania liczby parzyste nie parzyste. bo uznałem to za odpowiednie do zobrazowania moich myśli na tym etapie rozmowy)Czy zdradził byś mi jakie chechy dotychczas przyszly Ci do głowy.

Jedyną naturalną cechą fizyczną, jaką można by badać, jest np. kolejność ładowania kul do bębna lub ich fizyczne zużycie. Przy okazji, czy ktoś z Was wie, czy Lotto publikuje informacje o serwisowaniu maszyn? Chodzi mi o to, kiedy wymieniane są komplety kul lub całe maszyny losujące.
2026-07-03 (15:33)

status GRU
Data rejestracji: 2026-03-16
Ilość postów: 1994

17146
wpis nr 1 622 650
[ CZCIONKA MONOSPACE ]

Numery kul są etykietami, ale etykieta sama w sobie jest cechą informacyjną. Nie niesie znaczenia fizycznego ani matematycznego, ale niesie znaczenie statystyczne, bo pozwala śledzić zachowanie konkretnego obiektu w czasie. W losowaniach nie analizujemy wartości liczby, tylko jej historię, powiązania, kolejność występowania i relacje z innymi etykietami. To właśnie te cechy informacyjne tworzą strukturę, cykle, układy i powtarzalność. Cech fizycznych nie da się zdobyć, bo Lotto ich nie publikuje, więc jedyną sensowną analizą jest analiza informacyjna — czyli traktowanie etykiet jako identyfikatorów obiektów w systemie.
2026-07-03 (18:48)

status Jan69
Data rejestracji: 2015-09-19
Ilość postów: 503

14527
wpis nr 1 622 655
[ CZCIONKA MONOSPACE ]

Kulek, nie trafiłem na informację dotyczacą polskiego Totalizatora, ale w sieci jest trochę informacji z zagranicy. Na przykład z Nowej Zelandii ( https://www.procurement.govt.nz/about-us/news/procuring-lucky-numbers-and-the-machine-that-runs-them/ ):

"Dostępnych jest 6 maszyn losujących. Cztery z nich są w aktywnej rotacji, wybierane losowaniem w noce losowań, a 2 są rezerwowe.
W grze znajdują się 4 zestawy piłek. Są one regularnie poddawane rotacji w celu zapewnienia uczciwości gry i oceniane za pomocą precyzyjnego systemu pomiarowego. Weryfikacja ta potwierdza, że ​​każda piłka spełnia specyfikację producenta i nadaje się do użytku.
Po maksymalnie 10-krotnym użyciu zestawu piłek przeprowadza się proces mający na celu sprawdzenie, czy piłki nadal spełniają specyfikacje producenta."

Tu też nieco informacji: https://lotterywinners.com/blog/how-lottery-machines-work/


Jest też ciekawy wpis na jednym forum ( https://www.quora.com/Does-lottery-balls-has-digital-numbers-so-they-can-change-number-any-time ):
"W loteriach z kulkami znajduje się kilka zapieczętowanych, identycznych zestawów kulek w pudełkach. Audytorzy nadzorujący losowanie w danym dniu wybierają losowo jedno z pudełek. Następnie każda kulka jest wyjmowana i ważona, wszystkie powinny ważyć tyle samo. Po wylosowaniu kulek dopasowują rozmiar i rodzaj czcionki na kulkach, aby każda kulka była identyczna. Kulki są następnie umieszczane w szczelinie wrzutowej, a całość jest zapieczętowywana. Nigdy nie znika z pola widzenia audytorów."

W raporcie WLA Security Control Standard (WLA‑SCS) – czyli oficjalnym, międzynarodowym standardzie bezpieczeństwa dla loterii – są bardzo szczegółowe, ale proceduralne zapisy dotyczące:
- organizowania losowań,
- kontroli i konserwacji maszyn losujących,
- obsługi i wymiany kul (ball sets),
- zabezpieczania sprzętu i dokumentacji.
https://publications.world-lotteries.org/security-and-risk-management/wla-scs-2024-code-of-practice

Można też poszperać na stronach producenta maszyn losujących: https://smartplay.com/lottery-products/lottery-draw-machines/

Może komuś uda się znaleźć (w darknecie?) instrukcję producenta dla polskich maszyn losujących?
2026-07-03 (19:17)

status heme24
Data rejestracji: 2015-12-08
Ilość postów: 390

14639
wpis nr 1 622 656
[ CZCIONKA MONOSPACE ]

Witam.

Zostawmy może numery kul bo i ty i Gru macie rację, ale to nic nie zmienia.
Klasyfikacja losowań to jedyna droga, zresztą 2 osoby z tego forum też to samo kiedyś dostrzegły. Próbowałem z kilkoma metodami m.innymi z k-means, sumami,średnimi ale bez efektów, delikatne efekty były jak z losowań eliminowałem liczby ze środka histogramu, ale to też nie to. Celem jest stworzenie genomów losowań , genom ten można też stworzyć na danych losowych a potem dołożyć wyniki prawdziwe.
Teraz zamierzam testować metodę Weka EM.
Osobiście uważam że wyniki w jakimś zakresie da się przewidzieć ale jest to arcy trudne i wymaga czasu. Potem pozostaje co z tymi wybranymi losowaniami zrobimy, ja
bawię się sieciami ale na danych rozmytych i nie sieci uczące się.
2026-07-03 (21:35)

status MultiTest
Data rejestracji: 2020-08-05
Ilość postów: 6540

16235
wpis nr 1 622 666
[ CZCIONKA MONOSPACE ]

'Klasyfikacja losowań to jedyna droga"

skąd wiadomo że jedyna ?
2026-07-03 (23:13)

status GRU
Data rejestracji: 2026-03-16
Ilość postów: 1994

17146
wpis nr 1 622 689
[ CZCIONKA MONOSPACE ]

MultiTest

Wiele na to wskazuje
2026-07-03 (23:20)

status MultiTest
Data rejestracji: 2020-08-05
Ilość postów: 6540

16235
wpis nr 1 622 691
[ CZCIONKA MONOSPACE ]

a co Heme odpowie ?
2026-07-03 (23:21)

status GRU
Data rejestracji: 2026-03-16
Ilość postów: 1994

17146
wpis nr 1 622 692
[ CZCIONKA MONOSPACE ]

Zrobiłem burzę mózgów


kilka godzin

sporo narzędzi użytych

coś tak jakby wynik nieśmiały z nieśmiałej klasy

20
74
31
13
37
68
67
35
78
72
22
47
36
65
5
60
42
62
48
59
zobaczymy czy to były > mózgi > czy muski ha ha ha

2026-07-03 (23:25)

status GRU
Data rejestracji: 2026-03-16
Ilość postów: 1994

17146
wpis nr 1 622 694
[ CZCIONKA MONOSPACE ]

Jestem sceptycznie nastawiony bo to ciężki temat

ale kto wie
2026-07-03 (23:27)

status Kulek
Data rejestracji: 2026-01-03
Ilość postów: 18

17068
wpis nr 1 622 695
[ CZCIONKA MONOSPACE ]

Heme24, masz rację, zostawmy to, by się nie ograniczać. Jeśli metoda pozamatematyczna zadziała, to super. Jeśli testujesz różne rozwiązania statystyczne, to nieśmiało mogę Ci polecić narzędzie, jakim jest wykładnik Hursta (H); Harold Edwin Hurst. Pomaga on ocenić charakter danych ze względu na wynik, jaki otrzymasz:

H = 0,5: Przyszłe zmiany są całkowicie niezależne od przeszłych (błądzenie losowe).

0,5 < H < 1,0: Szereg persystentny, czyli tzw. „efekt Józefa” (siedem lat tłustych, siedem lat chudych). Jak coś rośnie, to prawdopodobnie będzie rosło dalej.

0 < H < 0,5: Szereg powracający do średniej (antypersystentny). Jeśli coś urosło, to prawdopodobnie zaraz spadnie.



Jan69, dziękuję za Twoją odpowiedź. Chyba masz niesamowity dar wyszukiwania wartościowych informacji. Sam Twój wpis zapowiada u mnie mały przewrót kopernikański, jeśli chodzi o postrzeganie losowań. Podejrzewam, że intuicja Heme24 znajduje w Twoim wpisie dość silne potwierdzenie. Ciągłość chronologiczna losowań jest naruszona – zdarzenia losowe nie następują bezpośrednio jedno po drugim. Nawet zadania matematyczne z rachunku prawdopodobieństwa na poziomie szkoły średniej zawierają sformułowania typu: „rzucamy symetryczną kostką X razy pod rząd”. Jeśli każde losowanie traktujemy jako osobny byt, to chronologia nie powinna mieć znaczenia, Jednak szukający złotego grala nie wychodzą z tego załorzenia Domyślam się, że Heme24 chodziło o inny rodzaj szumu, jednak podejrzewał, że coś jest na rzeczy.


GRU, wielkie umysły myślą tak samo ;P

MultiTest oraz inni, co sądzicie o mojej argumentacji w części wpisu skierowanej do Jana69?
2026-07-06 (20:59)

status Kulek
Data rejestracji: 2026-01-03
Ilość postów: 18

17068
wpis nr 1 622 917
[ CZCIONKA MONOSPACE ]

Przyszedł mi do głowy pomysł, jaki podział można zastosować. Wszystkie wartości są przykładowe. Bierzemy 1000 losowań i wyszukujemy w nich liczby, które padły dokładnie 250 razy. Dlaczego tyle? Ponieważ prawdopodobieństwo wylosowania każdej z liczb wynosi 1/4, co daje właśnie 250 na 1000 losowań. Sprawdzamy, które liczby spełniają ten warunek. Następnie losowania można podzielić na trzy grupy. Należy policzyć, ile średnio tych liczb wpada w jednym losowaniu i podzielić bazę danych na: poniżej średniej, w normie oraz powyżej średniej. Kłopotem jest to, że te liczby nie powinny być uwzględniane w statystykach, które powstaną na podstawie tego podziału.
2026-07-07 (05:42)

status heme24
Data rejestracji: 2015-12-08
Ilość postów: 390

14639
wpis nr 1 622 942
[ CZCIONKA MONOSPACE ]

Witam.

Kulek o tym jakie liczby wypluje ci program lub algorytm decyduje co mu zapodasz na wejście, czasami fajnie się to zgrywa i wtedy są efekty, ale efekty te rzadko występują, ideałem by było żeby wyniki losowań pogrupować w klasy i wtedy teoretycznie jak trafimy klasę to efekty powinny być lepsze.
Ale problemem jest jak to zrobić, czasami pomaga eliminacja liczb na podstawie histogramu.
Podział na 3 klasy to raczej za mało.
2026-07-07 (05:48)

status heme24
Data rejestracji: 2015-12-08
Ilość postów: 390

14639
wpis nr 1 622 943
[ CZCIONKA MONOSPACE ]

Jeszcze jest problem zlepów czyli nierównomiernego ułożenia liczb losowanych, program który wybiera ci liczby powinien to uwzględniać, powiedz jaki program wytypuje ci taki układ :23,24,26,29,30 lub taki:56,57,58,59 ?i to też jest jedna z przyczyn kiepskiego typowania przez typerów.
2026-07-07 (13:51)

status MultiTest
Data rejestracji: 2020-08-05
Ilość postów: 6540

16235
wpis nr 1 622 970
[ CZCIONKA MONOSPACE ]

Kulek,

I to jest konkret wart analizy.

Na przykład 1000 losowań wstecz.
Numery 14886 do 15885
Zgodnie z twoim pomysłem wyszukujemy w nich liczby, które padły dokładnie 250 razy.
Co może zaskoczyć ?

Dokładnie jest tylko dwie: 42,70 po 250 razy.

Dla takiej skali 1000 losowań można by do tej samej grupy zaklasyfikować także liczby 4,10,53,59,58 z wystąpieniem od 251 do 252 procentowo 25,1% -25,2% i poniżej przedziału 250 gdzie jest już 7 liczb : 11,16,17,61,65,41,56 z wystąpieniami od 248 do 249.
Niech te wszystkie liczby będą "klasą centralną 250"

Są jeszcze liczby 45,72,5 które wyraźnie przekroczyły normę 250 występując od 280 do 282 razy - niech to będzie "klasa GZ 250+" określająca górny zakres liczb
Można też wyodrębnić najbardziej odstające liczby jako klasę dolnego zakresu 'DZ 250-'
W tej klasy są tylko 3 liczby 40,34,66.

Dla pełnego obrazu można wyodrębnić klasy dla pozostałych liczb jako ' Standard Plus'
8,21,52,18,24,26,36,3,12,50,78,30,39,63,69,76,44,2,71,35,55,74,33,46,67,31,64,13,19,22
z wystąpieniem od 254 do 276
i 'Standard Minus" z 32 liczbami 41,56,9,68,79,27,20,25,37,7,77,75,1,28,47,62,43,57,51,6,32,48,49,80,14,29,73,54,60,23,38,15 od 225 do 248 wystąpień.

Teraz wystarczyć sprawdzić te klasy dla następnych 1000 losowań od nr 15886 do 16885:
Ponownie dokładnie 250 wystąpień to tylko 2 liczby: 26,59

Klasa centralna jest teraz w klasie Standard Minus
Po połowie liczb z klasy Standard Plus jest powyżej i poniżej 250 wystąpień.
21 z 32 liczb klasy Standard Minus jest teraz w grupie od 249 do 272 wystąpień.

klasa GZ 250+ jest dalej w najczęstszych liczbach
tylko 1 jedna liczba z klasy 'DZ 250-' jest powyżej 250 wystąpień.
===========================================
Prognoza liczb jakie wyszła z ostatnich tysiąca losowań :
10,39,5,63,6,72,68,53,22,46,52,51,44,41,71


2026-07-07 (15:02)

status Kulek
Data rejestracji: 2026-01-03
Ilość postów: 18

17068
wpis nr 1 622 981
[ CZCIONKA MONOSPACE ]

Nie przeanalizowałem jeszcze dokładnie Twojego postu, gdyż sam porządkuję swoje wnioski. Zaskoczył mnie fakt, że tylko dwie liczby spełniają dany warunek. Proponujesz margines błędu ±1 od średniej 250, ale warto tu rozważyć regułę trzech sigm. Przy odchyleniu standardowym wynoszącym 13,693, przedział ±1σ (czyli od 236 do 264) powinien statystycznie objąć około 68% wyników (czyli ok. 54 liczby z puli Multi).

Co do wspomnianych dwóch liczb – mogą one służyć jako klucz do podziału losowań na klasy:

Brak obu liczb.

Wystąpienie jednej z nich.

Wystąpienie obu jednocześnie.

Z tego względu wykluczyłbym te liczby z dalszej analizy statystycznej. Twoje uwagi nasunęły mi nową koncepcję podziału na klasy. Mam jednak wątpliwość czy nie próbujesz zastosować prawa wielkich liczb, to czy liczba wypadnie jeden raz więcej czy mniej nie ma znaczenia przy 250. Więc średnia 250 jest bez znaczenia dla pojedyńczego wystąpienia liczby, ale warto dalej eksperymentować!
2026-07-07 (15:08)

status Jan69
Data rejestracji: 2015-09-19
Ilość postów: 503

14527
wpis nr 1 622 982
[ CZCIONKA MONOSPACE ]

Kulek, w ramach inspiracji podrzucę wątek, którym zajmowałem się parę lat temu: "Zegar Bawarski".
Wpisy na ten temat popełnili m.in. @starteg1 i @Statyk.

https://forum.multipasko.pl/2298?page=35&sort=&dir=
https://forum.multipasko.pl/2298?page=89&sort=&dir=

Z grubsza zahacza o poruszany tu temat grupowania liczb. Zbudowałem tę "maszynę" (excel), ale brak efektów (i coraz głębsze zgłębianie aspektów nauki związanych z losowością) zniechęcił mnie do dalszego rozwijania tego pomysłu. Ale to był chyba najoryginalniejszy pomysł na grupowanie liczb, jaki spotkałem na tym forum (przynajmniej w czasie, gdy jeszcze z zapałem szukałem "Graala" ).
Podrzucam jako inspirujący "punkt odbicia", który być może natchnie kogoś do jeszcze bardziej intrygujących pomysłów. Mądre jest zdanie głoszące, że ważniejsza jest droga, niż dotarcie do celu
2026-07-07 (17:37)

status MultiTest
Data rejestracji: 2020-08-05
Ilość postów: 6540

16235
wpis nr 1 622 993
[ CZCIONKA MONOSPACE ]

Kulek
Tu istotną rzeczą jest podział na klasy jakie mogły wynikać z 1000 losowań.
To że taka próba w Multi już pokazuje działanie Prawa wielkich liczb nie ma tu nic do rzeczy.
Kolejne 1000 losowań pokazuje czy takie klasy są skuteczne.
Wniosek jest taki że jak się chce wyrzucać kulki z analizy statystycznej to najlepiej wyjąć je z maszyny.
A jak chcesz się już naprawdę pobawić w prognozowanie to nie lekceważ pozornie nieistotnych drobiazgów.
2026-07-07 (19:16)

status Kulek
Data rejestracji: 2026-01-03
Ilość postów: 18

17068
wpis nr 1 623 004
[ CZCIONKA MONOSPACE ]

MultiTest, przetrawiłem Twój wpis, masz zadziwiającą zdolność spostrzegania. Sprawdziłem minimalną wielkość próby statystycznej (poziom ufności 95%, błąd 5%) i wynosi ona 288 losowań. Wszystko powyżej tej liczby to już twarda matematyka, a nie wróżenie z fusów. Zależy mi na tym, aby próba była możliwie najmniejsza, dlatego proponuję trzymać się tych okolic zamiast 1000 losowań. Dzięki temu nasza krzywa będzie bardziej dynamiczna (jak ta z Twojego awatara), a nie tak płaska i rozmyta przez zbyt dużą ilość danych.



Jan69, "Zegar Bawarski" – ładna, enigmatyczna nazwa. Faktycznie wygląda to inspirująco. Czy w razie "W" mogę liczyć na Twoją pomoc?
| Dodaj wpis w tym temacie | Spis tematów | Wyniki lottoStrona: 1 2 3
Wyślij wiadomość do admina